Xenon

開源終端 AI 程式設計 Agent:以線上 Evidence Runtime 驗證鏈(LLM 輸出是 Claim、工具結果才是 Evidence)為核心。SWE-bench_Lite 官方評測 40.0% 實例級通過率(同模型 A/B

Xenon 是什麼?

開源終端 AI 程式設計 Agent:以線上 Evidence Runtime 驗證鏈(LLM 輸出是 Claim、工具結果才是 Evidence)為核心。SWE-bench_Lite 官方評測 40.0% 實例級通過率(同模型 A/B +6.7pp,可複現報告)。7 種推理範式、MCP 工具、落盤補救與驗證閉環。Python。