ArXiv开源SMITH框架:革新大语言模型智能体工具创建与使用
文 / Mr.Xu
发布时间: · 2 次阅读
摘要:ArXiv团队推出了一种名为SMITH(Schema-grounded Multi-task Iterative Tool Honing)的新框架,通过强化学习联合训练大语言模型智能体的工具创建和使用能力。SMITH通过构建多任务迭代训练机制,显著提升了工具生成的准确性和工具使用的有效性。实验结果表明,使用SMITH训练的4B Qwen3模型在多个推理任务中表现优异,超越了未训练的30B-A3B工具生成器,并在跨任务场景中提升了其他模型的性能。
SMITH框架:革新大语言模型智能体工具创建与使用
核心突破
- 联合训练机制:SMITH通过强化学习框架,将工具创建和使用过程整合到一个策略中,实现了多任务迭代训练。
- 多轴奖励机制:通过捕捉模式(schema)、代码和结果三个维度的失败信号,SMITH能够独立优化每个失败模式,从而提升整体性能。
- 跨任务适用性:在13个程序推理任务中,SMITH训练的4B Qwen3模型在未见任务上的宏观平均准确率达到79.8%,超越了未训练的30B-A3B工具生成器。
技术亮点
- Schema-grounded训练:通过基于模式的训练机制,SMITH确保生成的工具模式能够被智能体有效调用,避免了传统方法中工具生成与使用之间的脱节问题。
- 独立奖励信号:三个独立的奖励轴(模式、代码、结果)使得模型能够更精准地优化每个失败模式,从而提升训练效率和最终性能。
- 跨任务迁移能力:SMITH不仅提升了工具生成和使用的准确性,还增强了模型在跨任务场景中的适应能力。例如,SMITH生成的工具提升了LFM-2.5-350M和Qwen3-30B-A3B在相同推理任务中的表现。
行业影响
- 提升智能体工具使用效率:SMITH框架为开发更智能、更高效的AI智能体提供了新的技术路径,特别是在需要复杂工具使用的场景中,如自动化编程、科学实验和数据分析。
- 推动大语言模型工具化发展:通过优化工具创建和使用过程,SMITH有望推动大语言模型在更多实际应用场景中的落地,例如智能助手、自动化系统和机器人技术。
开发者建议
- 关注强化学习应用:开发者可以探索将强化学习应用于更多大语言模型训练场景,以提升模型在复杂任务中的表现。
- 探索跨任务迁移:SMITH展示了跨任务迁移的潜力,开发者可以尝试将类似方法应用于其他多任务学习场景。
- 优化工具调用机制:SMITH的成功表明,优化工具调用机制对于提升智能体性能至关重要,开发者可以进一步研究如何改进工具调用策略。
—— 完 ——消息来源:ArXiv cs.AI (2026-08-25)
社区整体评论区
正在加载实时智能评论与划词标注…