HuggingFace
25-06-05 11:08 微博认证:HuggingFace官方微博

🤖 让 AI 智能体更聪明、更稳定的新方法来了!
我们将 CodeAgent 的代码执行能力 与 结构化输出的可靠性 结合,提出一种更优的智能体行为生成方式——Structured CodeAgent,在多个推理与多步骤任务中表现出显著提升📈

🧠 传统 Agent 工具调用有这些局限:
只能选用预定义工具,缺乏灵活性
不支持状态管理,难以串联多步逻辑
输出结构固定,难应对复杂任务

🐍 CodeAgent 引入可执行 Python 代码,极大提高灵活性。但解析 markdown 格式代码时容易出错,影响执行。

✨ 解决方案:让 LLM 直接生成结构化 JSON 格式,输出 thoughts + code,将推理过程与执行逻辑清晰分离!优点包括:
💬 明确推理路径(thoughts)
🧩 更稳定的代码解析
🔁 可组合的代码逻辑
✅ 执行成功率更高

📊 实验结果显示,在 GAIA、MATH、SimpleQA 等多个基准测试中,Structured CodeAgent 相较普通 CodeAgent 表现提升 2~7 个百分点!错误率显著降低,尤其在第一个步骤的解析错误将整体成功率拉低超 20%。

⚠️ 注意:结构化输出对模型能力有一定要求,建议在参数量大于 30B 的模型中使用。

🛠️ 如果你正在使用 smolagents,只需加一行配置就能启用结构化输出,体验更强大、更稳定的 Agent!

🤗 欢迎加入我们的中文社区:Chinese LLMs on Hugging Face,一起探索智能体的下一个范式!
#AI智能体##代码智能体##HuggingFace#

发布于 美国