快讯事件 · 1 条来源
River AI 推出开源 River Recipes:首个 text-to-SQL 配方称以低于 1% 成本训练开源模型超越 GPT-6 Astra Pro 与 Claude Opus 5.5
ClementDelangue 转发了 Igor Babuschkin 的帖子,介绍 River AI 推出的 River Recipes 开源计划。团队表示,该计划旨在将研究转化为经过验证、可复现的训练配方;首个配方针对 text-to-SQL 任务,称其训练的开源模型在 Arcwise-Plat 基准上以低于 1% 的成本超越 GPT-6 Astra Pro 和 Claude Opus 5.5。作者还预测几年后全球大部分大模型使用将运行在定制化开源权重模型上,并强调 River 的使命是帮助每个人拥有自己的智能、独立于大型 AI 实验室。以上性能与成本数据均为作者及团队声称,未经独立核实。
全部来源
前后事件
相关事件
Remi Fabre展示Microduck情绪功能早期设计,对比仿真与实体机器人表现
Remi Fabre表示已重新拿到Microduck机器人,得以回放情绪并对比仿真与实体的表现;其称目前仍为早期设计,还有很大提升空间。相关代码托管于pollen-robotics的microduck_emotions仓库。
OpenAI数学问题开源为RL环境,Ofir Press推测其借Lean形式化规模化构建
Adithya S K表示,OpenAI数学问题现已开源为强化学习环境。Ofir Press推测,OpenAI或为数学问题创建了大量带Lean形式化的RL环境:起初手工构建较简单的环境,待模型能自主创建环境后,再基于arXiv论文扩展问题数量。
Matthieu Lapeyre:Microduck以定制主板解决原型过热降频问题
Matthieu Lapeyre介绍,Microduck此前基于Radxa的原型存在热管理问题,运行仅20分钟就会降频并过热关机;团队通过新的定制主板解决了该问题,并让Microduck漫游以测试实际续航。ClementDelangue转发并评论"love the building in public"。
TRL v1.15发布:默认启用融合LM头,最长训练序列最高提升6.9倍
TRL v1.15发布,SFT、DPO、KTO、GRPO、RLOO和蒸馏默认启用融合LM头:通过Triton内核直接计算token级量,避免实例化巨大的[batch, seq, vocab] logits张量。以Gemma 3 1B(262k词表)为例,相同GPU下各算法最大序列长度最高提升6.9倍,8k上下文峰值显存降低52-82%,训练速度最高快约11%。发布方Lysandre表示,此优化无需额外启用,已是v1.15默认行为;该版本还包含SFT选择性激活检查点、视觉数据集assistant-only loss等更新。
Whistle语音转文字模型走红Hugging Face Hub:16.9 MB对标Whisper base,主打端侧运行
据Victor M介绍,Hugging Face Hub上的Whistle模型仅16.9 MB,语音转文字能力可对标Whisper base,适合在端侧设备上运行。该帖由ClementDelangue转发。