← 返回快讯

快讯事件 · 1 条来源

oMLX 0.7.1.dev1 发布:新增 Clef/OpenJev 决策模型与批量预填充,Qwen 等模型解码提速最高 61%

jundotkim

oMLX 发布 0.7.1.dev1 dev 版本,新增决策模型(Clef、OpenJev)、并发请求批量预填充和全新 Web UI。速度方面,Qwen3.8-Flash-Next 专家卸载、M3 Ultra 上 32K 预填充从 396 提升至 636 tok/s(+61%),Qwen3.6-35B-A3B 在 M5 Max 上解码从 156 提升至 205 tok/s(+31%),批量预填充使 8 个间隔 0.4 秒到达的提示词首 token 时间从 7.41 秒降至 5.75 秒(-22%)。

全部来源

前后事件