← 返回

NEWS · 快讯

标签:缓存压缩

查看带有该精确标签的快讯。

订阅此筛选 RSS

共 1 条快讯 · 门户最近更新

推文称 DeepSeek 将智能体记忆缓存压缩至每 token 890 bytes

推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。

DeepLearningAI查看原文 ↗

#缓存压缩 · AI快讯 · Portal