← 返回快讯

快讯事件 · 1 条来源

推文称 DeepSeek 将智能体记忆缓存压缩至每 token 890 bytes

DeepLearningAI

推文称,针对智能体“读多写少”的场景,DeepSeek 缩小了其记忆缓存:每 token 缓存为 890 bytes,较 DeepSeek-V1 小 437 倍;同时称从 4K 到 1M 输入,每个输出 token 的计算量增加 25%。推文还称 Flash 在 AA Index 上以 39 比 36 领先 V4-Pro,任务成本为 0.27 美元对 0.67 美元。以上均为原文主张,未独立核实。

全部来源

前后事件

相关事件

DeepLearningAI Data Points盘点:Gemini 4 Argon与GPT-6 Astra并列53分,Mistral Large 4成美中以外最强模型

DeepLearningAI本周Data Points盘点多项AI动态:Gemini 4 Argon在Artificial Analysis Intelligence Index上以53分与GPT-6 Astra并列,且每任务成本约为其60%;Mistral Large 4(1T参数、开放权重,十月下旬推出)成为美国和中国以外最强的模型;Reflection AI开放权重模型Beam声称推理算力比同类开放模型低3–4倍;Microsoft MAI-Transcribe-2-Streaming以38款中第1名领跑流式语音转写准确率。

DeepLearningAI共 1 条来源

Google Gemini 3.8 Live 端到端语音模型亮相

DeepLearningAI 介绍,Google 的 Gemini 3.8 Live 模型采用语音到语音架构,在一个系统中完成聆听、推理和回应。推文称,Extended Thinking 版本在 Artificial Analysis 的 Speech to Speech Index 中排名第一;标准版在真人盲评现场对话中排名第二,输入音频价格为每小时 0.84 美元,为该指数最低。两个版本还支持图像和视频输入。

DeepLearningAI共 1 条来源

推文称 DeepSeek 将智能体记忆缓存压缩至每 token 890 bytes