快讯事件 · 1 条来源
NVIDIA论文称:多模态模型工具调用会削弱拒答有害请求能力
推文介绍一篇NVIDIA团队论文称,让多模态模型在智能体场景中使用工具后,拒答有害请求的失败率最高相对上升68.7%,平均上升17.7%;该现象出现在Claude Opus 4.6和4.7、Gemini Agentic Vision、Qwen3.5-122B-A10B及agent-tuned开源模型,并横跨MM-SafetyBench、HoliSafe和VLSBench。作者将原因归因于工具输出淹没原始请求的恶意意图,以及模型注意力转向描述工具结果而非做安全决策;作者还提出,在最终回答前重新插入原始请求和图片可部分恢复被削弱的拒答。以上均为推文所述研究结论,未独立核实。
全部来源
前后事件
相关事件
Meta超级智能实验室提出"智能体可塑性":按每美元学习收益衡量自我改进模型
Meta Superintelligence Labs的研究人员提出"agent plasticity"指标,在模型权重冻结、每次运行从全新上下文开始的条件下,衡量智能体在留出任务上每美元学习投入的得分增益。研究发现,表现最好的模型往往与学习效率最高的模型不同:在国际象棋、围棋和Hex中,Claude Fable 5取得最高最终得分,而GPT-5.6 Sol的单位美元增益最大;在NetHack中,仅Claude Opus 5.5显著提升66个归一化点,学习成本约1073美元。研究还发现,学习较慢的智能体常忽略自己已写下的产物,而学习更快的智能体会复用这些产物,但产物质量低时仍会失败。
Victor Riparbelli宣布Syren Video上线并可免费试用,支持提示词生成与对话式编辑
Victor Riparbelli表示,Syren Video现已上线并可免费试用:通过提示词生成视频、再以对话方式修改,由Opus 5.5和具备3D支持的Syren渲染器驱动,可在浏览器或通过Claude MCP使用。发帖者omarsar0称其可从素材库学习用户的图形、动作和剪辑节奏偏好,并表示正探索将其用于教育场景。
脑机接口创企Sabi获Khosla Ventures等5000万美元融资,打造可穿戴BCI帽
Sabi联合创始人Rahul Chhabra宣布,公司获Khosla Ventures、Accel、Initialized、Kevin Weil和DST Global投资5000万美元,用于打造可穿戴式脑机接口帽。发帖者omarsar0称该设备配备10万个传感器,可让人们仅通过思考与AI智能体对话,并称其攻读博士期间曾做BCI研究。
论文称HERMES harness使GPT-5.6 Sol整库迁移成功率从6.5%升至31.0%
elvis转述的该论文提出HERMES harness:为每个仓库组件配备了解自身代码与依赖的常驻LLM,并通过依赖感知步骤决定激活哪些组件、诊断步骤将测试失败映射回需修改的组件。论文作者称,在同一模型与effort设置下,以HERMES替换Codex使GPT-5.6 Sol的整库迁移成功率从6.5%升至31.0%;在四个软件工程基准上,其平均领先匹配的基线harness 12.4分,强激活与诊断模型下Qwen3-8B组件方案与全GPT-5.6 Sol配置差距在4.5分以内,并将Terminal-Bench 4.0推理成本降低26.2%。
谷歌FlowAgent:在代码评审流程中自动修复测试失败
谷歌论文提出FlowAgent,在CI中以ReAct式"生成-验证"循环处理预提交测试失败,并将修复展示在代码评审工具中;两道弃权过滤器分别在执行前后拦截弱建议。在195个真实失败的人工评审中,67.18%的修复正确;全公司上线后共为295,508个变更建议修复,开发者预览65,069个、采纳28,554个。