Tag

Harness

共 6 篇文章

Agent 安全也能自进化?SafeEvolve 让 Harness 与 Policy 从安全经验中共同进化

Agent 安全也能自进化?SafeEvolve 让 Harness 与 Policy 从安全经验中共同进化

随着大模型Agent逐渐具备自主规划、工具调用、网页访问和多步任务执行能力,Agent安全正在面临新的挑战。 过去,安全对齐往往主要关注模型最终输出是否有害,例如是否拒绝危险请求、是否生成不当内容。但对于能够与外部环境持续交互的Agent而言,风险可能发生在最终回答之前,也可能隐藏在中间决策、工具调
wangguo
0
0
87
直播预告!如何在真实  Coding Agent Harness 中接入 RL?

直播预告!如何在真实 Coding Agent Harness 中接入 RL?

随着编码智能体从“模型能力”走向“模型 + Harness”协同,工具调用、上下文管理与控制流正在成为影响智能体能力的重要因素。 然而,将真实 Agent Harness 接入强化学习训练并不简单:环境故障与奖励投机会污染训练信号,训练与推理环境的差异也可能导致策略更新偏离真实 Agent 行为。
wangguo
0
0
112
直播预告!从 Harness 看 AI4AI 如何实现

直播预告!从 Harness 看 AI4AI 如何实现

我们能否在不更新任何模型参数的情况下,把强模型的能力迁移给弱模型? 我们通常认为,更强的 AI 能力需要通过蒸馏,OPD等各种方式训练更弱的模型,但在 Harness 的热潮下,一个更本质的问题值得探索:如果完全不改模型参数,强模型能不能在 test time 直接帮弱模型“搭好思考方式”? Har
wangguo
0
0
114
当 Harness 也能被 AI 自动设计:AI4AI 正在重写小模型变强的方式

当 Harness 也能被 AI 自动设计:AI4AI 正在重写小模型变强的方式

今年,AI 的竞争正在悄悄换一个方向:决定一个 AI 系统能力的,开始不只是模型本身,还有模型外面的那套“工作方式”。 过去,我们想让一个模型变强,通常意味着继续训练它:更多数据、更好的反馈、更大的计算量,本质上都是在改变模型内部的参数。但 Agent 时代正在让另一条路线变得越来越重要:模型可以完
wangguo
0
0
100
Harness基模JIT-27B,为每个任务写一套“Claude Code”

Harness基模JIT-27B,为每个任务写一套“Claude Code”

Harness基模JIT-27B,为每个任务写一套“Claude Code” Agent benchmark 通常把模型视为能力的主要来源,但同一模型只要更换记忆组织、规划协议、工具暴露方式或错误恢复流程,最终表现就可能跨越一个明显的档位。 这样的差异来自 Agent Harness:它定义模型在什
wangguo
0
0
167
正在直播 B 站