Hugging Face 用代理把 Claude Code、Codex 等 10 个编码 harness 变成 RL 训练环境
Hugging Face 的 Clement Delangue 介绍,团队在不改动 harness 和训练代码的前提下,把 Claude Code、Codex。
Hugging Face 的 Clement Delangue 介绍,团队在不改动 harness 和训练代码的前提下,把 Claude Code、Codex。
微软与加州大学圣巴巴拉分校研究者公开论文 ScholarEvolve,从已发表 Agent 研究中提取改进思路,写入运行框架 Harness,再用真实任务检验,执行任务的模型本身保持不变。
新加坡南洋理工大学安波教授团队发布报告《Finding the Right Fit: Model–Harness Interactions across Agent Tasks》。
LangChain 创始人 Harrison Chase 提出,智能体改进是 harness 改进而非模型改进,值得做的干预多在工具边界,例如传入什么上下文、何时提供工具、失败如何恢复、事后衡量什么,并表示这正是 deepagents 编排逻辑加 LangSmith 衡量能力要构建的闭环。