AgentDebugX是一个开源调试框架,将LLM智能体调试组织为"检测-归因-恢复-重跑"闭环。其核心DeepDebug在Who&When基准上对qwen3.5-9b达到精确的智能体与步骤归因准确率,在GAIA上单次重跑即可修复失败任务。该工具提供Python库、CLI、Web控制台和可安装的智能体技能。
产品
·HuggingFace Daily Papers(社区热门论文)
AgentDebugX:面向LLM智能体的开源故障调试框架
— AgentDebugX: An Open-Source Toolkit for Failure Observability, Attribution, and Recovery in LLM Agents