← 返回

NEWS · 快讯

标签:AI安全

查看带有该精确标签的快讯。

订阅此筛选 RSS

共 6 条快讯 · 门户最近更新

NVIDIA论文称:多模态模型工具调用会削弱拒答有害请求能力

推文介绍一篇NVIDIA团队论文称,让多模态模型在智能体场景中使用工具后,拒答有害请求的失败率最高相对上升68.7%,平均上升17.7%;该现象出现在Claude Opus 4.6和4.7、Gemini Agentic Vision、Qwen3.5-122B-A10B及agent-tuned开源模型,并横跨MM-SafetyBench、HoliSafe和VLSBench。作者将原因归因于工具输出淹没原始请求的恶意意图,以及模型注意力转向描述工具结果而非做安全决策;作者还提出,在最终回答前重新插入原始请求和图片可部分恢复被削弱的拒答。以上均为推文所述研究结论,未独立核实。

omarsar0查看原文 ↗

Netflix 纪录片《AI Gone Wild》定档10月12日,还原 Hugging Face 遭 AI 智能体攻击事件

Netflix 称,开源 AI 平台 Hugging Face 今年7月遭遇网络攻击,而攻击者"并非人类",而是 OpenAI 研究人员打造的自主智能体。Netflix 表示,纪录片《Instadocs: AI Gone Wild》将以前所未有的方式还原此次入侵事件,定于10月12日首播。上述关于攻击者身份与事件还原方式的说法均出自 Netflix 宣传文案,未经独立核实。

abidlabs查看原文 ↗

Google 开放 SynthID 验证网站,可检测多厂商 AI 生成内容

Google AI 宣布扩大其 SynthID 技术的使用范围:据推文,任何人现在都可以访问 synthid.com 检查图像、视频或音频文件是否带有 SynthID 水印,无论内容是由 Google 生成还是由 OpenAI、NVIDIA、Kakao 等行业合作伙伴生成,Apple 的支持即将加入。推文称,迄今为止 SynthID 已为 1800 亿张图像和视频以及超过 24 万年时长的音频内容添加水印,每天通常处理 100 万次验证请求。该新入口与已在 Search、Gemini 应用和 Chrome 中上线的内置验证功能并存。以上均为作者在推文中的表述,未独立核实。

GeminiApp查看原文 ↗