← 返回

NEWS · 快讯

标签:智能体

查看带有该精确标签的快讯。

订阅此筛选 RSS

共 8 条快讯 · 门户最近更新

NVIDIA论文称:多模态模型工具调用会削弱拒答有害请求能力

推文介绍一篇NVIDIA团队论文称,让多模态模型在智能体场景中使用工具后,拒答有害请求的失败率最高相对上升68.7%,平均上升17.7%;该现象出现在Claude Opus 4.6和4.7、Gemini Agentic Vision、Qwen3.5-122B-A10B及agent-tuned开源模型,并横跨MM-SafetyBench、HoliSafe和VLSBench。作者将原因归因于工具输出淹没原始请求的恶意意图,以及模型注意力转向描述工具结果而非做安全决策;作者还提出,在最终回答前重新插入原始请求和图片可部分恢复被削弱的拒答。以上均为推文所述研究结论,未独立核实。

omarsar0查看原文 ↗

作者推荐 good-css.com:一个为智能体优化网站设计的工具

作者推荐名为 good-css.com 的工具,称其提供打包好的技能(skill),为智能体提供良好的网页设计原则指导,并让网站更易于被智能体使用;作者称只需把该网址交给智能体即可由其完成后续工作。推文同时引用 joel 的示例提示词"read https://good-css.com and give me the most valuable improvements we can make right now"。以上为作者介绍,未独立核实。

LLMJunky查看原文 ↗

NVIDIA 论文 VERA:基准轨迹转为 9000+ 可重启沙箱,协同训练智能体模型与 harness

作者推荐 NVIDIA 论文 VERA,称其将基准轨迹转化为 9000 多个可重启沙箱并附评分 rubric,只保留可运行且能从可观察证据打分的环境,同时更新模型权重与 harness:harness 修改须通过自测且开发集提升至少 5 分才保留,模型 checkpoint 分数降超 20% 则拒绝。作者称 9B 协同演化智能体在 AutoCoWorkBench、AutoMedBench 上分别比最强单维基线高 10.3、13.0 分;27B 在 AutoCoWorkBench 得 71.6 分,高于 Claude Opus 4.8;环境语料已开源。以上为作者声称,未经独立核实。

omarsar0查看原文 ↗