Agent Lightning¶
Agent Lightning 是点亮 AI Agent 的终极训练器。
加入我们的 Discord 社区,与其他用户和贡献者交流。
特性¶
- 无需任何代码更改(几乎!)即可将您的 Agent 变成可优化的利器! 💤
- 使用 任何 Agent 框架(LangChain、OpenAI Agent SDK、AutoGen、CrewAI、Microsoft Agent Framework...);甚至无需 Agent 框架(Python OpenAI)。随你所愿! 🤖
- 有选择性地优化多 Agent 系统中的一个或多个 Agent。 🎯
- 拥抱 算法,例如强化学习、自动提示优化、监督微调等。 🤗
如何阅读本文档¶
本文档分为以下几个部分
- 安装 - 开始使用 Agent Lightning
- 操作指南(例如,使用 RL 训练 SQL Agent)- 训练 Agent 和自定义算法的实用示例。
- 深入学习(例如,调试)- 关于特定主题(如调试或并行化)的指南。
- 算法动物园(例如,APO)- 内置算法的参考。
- 深入剖析(例如,鸟瞰图)- 更深入地了解 Agent-lightning 在幕后做了什么。
- API 参考(例如,Agent)- Agent-lightning Python API 的参考。
资源¶
- 2025年11月4日 使用 Tinker ✕ Agent-lightning 调整任何 AI Agent Medium。 另请参阅 第二部分。
- 2025年10月22日 不再出现重新标记漂移:通过 OpenAI 兼容 API 返回 Token ID 在 Agent RL 中至关重要 vLLM 博客。 另请参阅 知乎文章。
- 2025年8月11日 使用强化学习训练 AI Agent 编写和自我纠正 SQL Medium。
- 2025年8月5日 Agent Lightning:使用强化学习训练任何 AI Agent arXiv 论文。
- 2025年7月26日 我们发现了一种使用 RL 训练任何 AI Agent 的方法,几乎无需更改任何代码。 Reddit。
- 2025年6月6日 Agent Lightning - Microsoft Research 项目页面。
社区项目¶
- DeepWerewolf — 使用 AgentScope 和 Agent Lightning 构建的中国狼人游戏 Agent RL 训练案例研究。
- AgentFlow — 一个模块化的多 Agent 框架,结合了规划器、执行器、验证器和生成器 Agent,并使用 Flow-GRPO 算法来解决长周期、稀疏奖励任务。
- Youtu-Agent — Youtu-Agent 让你轻松构建和训练你的 Agent。基于 修改后的分支 的 Agent Lightning 构建,Youtu-Agent 已经验证了在数学/代码和搜索能力上使用 128 个 GPU RL 训练的稳定收敛。 另请查看 配方 和他们的博客 停止与你的 Agent RL 作斗争:Youtu-Agent 如何实现稳定的 128 GPU 扩展而不会崩溃。
引用¶
如果您在研究或项目中觉得 Agent Lightning 有用,请引用我们的论文
@misc{luo2025agentlightningtrainai,
title={Agent Lightning: Train ANY AI Agents with Reinforcement Learning},
author={Xufang Luo and Yuge Zhang and Zhiyuan He and Zilong Wang and Siyun Zhao and Dongsheng Li and Luna K. Qiu and Yuqing Yang},
year={2025},
eprint={2508.03680},
archivePrefix={arXiv},
primaryClass={cs.AI},
url={https://arxiv.org/abs/2508.03680},
}
许可¶
有关详细信息,请参阅 LICENSE 文件。