开源终端 AI 编程 Agent:以在线 Evidence Runtime 验证链(LLM 输出是 Claim、工具结果才是 Evidence)为核心,SWE-bench_Lite 官方评测 36.7% 实例级通过率(可复现报告)。支持 7 种推理范式、MCP 工具、多模型。Python。