推文称 DeepSeek 将智能体记忆缓存压缩至每 token 890 bytes
推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。
共 6 条快讯 · 门户最近更新
推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。
NVIDIA AI 官方账号发文介绍其研究团队提出的 PivotOPD 方法。据正文,该方法针对 AI agent 在任务早期犯错后一路沿错误方向继续的问题,在训练过程中由教师模型向 agent 展示更好的动作,并演示如何在后续几步内回到正确轨道。推文附论文与演示链接。
作者称,其智能体产品支持跨设备使用:用户可在笔记本上启动任务、合上盖子,之后通过手机查看任务状态,智能体会继续运行即使用户不在设备旁。该描述为作者声明,未独立核实。
作者自述其智能体实践演进:从单个 Claude Code 会话到多智能体系统,再到自研编排器下约 8 个专业智能体组成的持久化团队。作者称 Opus 5.5 等模型已能很好协同,并认为 Code、Claude Desktop 等应用落后但会追上,主张自建 agent 编排器获得个性化优势。以上为作者观点,未经独立核实。
Netflix 称,开源 AI 平台 Hugging Face 今年7月遭遇网络攻击,而攻击者"并非人类",而是 OpenAI 研究人员打造的自主智能体。Netflix 表示,纪录片《Instadocs: AI Gone Wild》将以前所未有的方式还原此次入侵事件,定于10月12日首播。上述关于攻击者身份与事件还原方式的说法均出自 Netflix 宣传文案,未经独立核实。
Scale AI 宣布开源其 RL 环境框架 AgentEnv。该公司表示,其构建的所有强化学习环境均运行在 AgentEnv 之上,开源目的是让更多人能够构建供智能体学习的训练环境。