推文称 DeepSeek 将智能体记忆缓存压缩至每 token 890 bytes
推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。
共 3 条快讯 · 门户最近更新
推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。
推文作者称 Mistral AI 的 Mistral Large 4 是一个 1T 参数模型(49B 激活),开放权重将于本月底推出。他们对该模型进行了一系列真实场景测试,并与多个主流闭源及开源模型(包括 GPT-6.1 Sol、Astra、Claude Fable、Claude Opus 5.5、Claude Sonnet 5.5、Kimi K3、GLM 5.3 Flash、DeepSeek Flash 和 Muse Spark)进行了对比,以展示其当前水平,并表示后续将更新更多评分。以上均为作者自称,尚未独立核实。
作者引述一段 Fireside Alpha 内容称,Ben Affleck 透露自己从年轻时就对计算机感兴趣,会写 Python、了解卷积神经网络、曾大量使用 GPU,并借助自己的名人身份获得私下了解 Google 和 OpenAI 视频模型的机会。上述内容均为作者引述的一方说法,未经独立核实。