IN

InBoost AI Agent

OpenHands Plugin Live Demo

Autonomous Coding Agent Orchestration Benchmark & Interactive A/B Playground

SiliconFlow: MiniMaxAI/MiniMax-M3
SWE-bench Verified Cohort ($N=10$)
Resolve Rate (Docker)
50.0% 20.0%
2.5x Выигрыш качества
Wall-Clock Time
327.5s 722.9s
-54.7% Быстрее в 2.2 раза
GPU Occupancy
236.2s 568.0s
-58.4% Разгрузка GPU
Total Cost (10 tasks)
$0.0928 $0.1667
-44.3% Экономия затрат
Empty Patches (Сбои)
1 / 10 7 / 10
Спасено 6 задач из 7
Скорость теста:
repo

Название задачи

Vanilla OpenHands (CodeActAgent)
B2 Monolithic Heavy ГОТОВ
[Ожидание запуска...] Выберите задачу и нажмите «Запустить A/B тест».
Шаги
Время
Стоимость
GPU Время
InBoost AI Agent (Tiered + Arbiter)
B0/B1/B2 Gates Active ГОТОВ
[Ожидание запуска...] Выберите задачу и нажмите «Запустить A/B тест».
Шаги
Время
Стоимость
GPU Время

Сгенерированный Unified Git Diff (Хирургическая точность патча)

Патч не сгенерирован
// Сгенерированный патч отобразится здесь после завершения тестирования...
Drop-In замена в OpenHands за 1 строку (config.toml): Zero Breaking Changes
[core]
default_agent = "InBoostAgent"   # <--- Замените 'CodeActAgent' на 'InBoostAgent'

[inboost]
profile = "balanced"
max_churn_lines = 180
enforce_diff_budget = true
slm_model = "Qwen/Qwen2.5-7B-Instruct"
heavy_model = "deepseek-ai/DeepSeek-V3"