推文称 DeepSeek 将智能体记忆缓存压缩至每 token 890 bytes
推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。
共 2 条快讯 · 门户最近更新
推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。
Cline 官方账号在 thread 中表示,用户可以免费试用 DeepSeek-V4.1-Flash 等模型;同时推出 ClinePass 订阅服务,作者称该服务提供约 5 倍折扣的开放权重模型访问权限。折扣力度和免费试用信息均为作者方说法,未经独立核实。