开源指南:在多种Agent框架中用RL训练模型
一套开放方法与指南,可在 Claude Code、Codex、OpenCode 等真实 Agent 框架内用强化学习训练任意模型,无需改动框架或训练代码。LFM2.5-2.6B 在四个框架上从 42% 提升到 54%,工具调用减少 31%。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
一套开放方法与指南,可在 Claude Code、Codex、OpenCode 等真实 Agent 框架内用强化学习训练任意模型,无需改动框架或训练代码。LFM2.5-2.6B 在四个框架上从 42% 提升到 54%,工具调用减少 31%。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel