快讯事件 · 1 条来源
JetBrains 发布 Mellum2.1:面向智能体编程工作流的开源代码模型
作者(Nikita Pavlichenko)宣布发布 Mellum2.1,称其为 6 月开源的 Mellum2 的重大更新,通过扩大 RL 后训练规模以支持智能体编程(agentic coding)工作流。作者表示该模型在与其速度相比的情况下取得智能体编程基准的最高分数,并已在 Hugging Face 和 GGUF 两种格式下开放权重,MTP 支持将在随后几天推出。
全部来源
前后事件
相关事件
Hugging Face上线"decision-model"标签,已有1,300多个模型
Victor M发帖称Hugging Face新增"decision-model"标签,用户可按该标签筛选决策模型,目前已有1,300多个相关模型可用,他还提到或可结合MLX、GGUF实现完全本地化运行。
Georgia Channing发布Carbon-A模型与Carbon Annotation Database
Georgia Channing发布Carbon Annotation Database及其背后的Carbon-A模型;该模型已用于在22,617个物种中发现5.6634亿个新基因候选,并在猫、鸡和拟南芥等物种中完成湿实验验证。
Ben Burtenshaw推出Open Env Arena:智能体可创建RL环境并登上排行榜
Ben Burtenshaw宣布推出RL环境智能体竞技场Open Env Arena:智能体可定义RL环境,平台在其上训练Qwen-3.8-27B并评估模型,得分计入排行榜。该平台接入@nebiusai的GPU、运行在@benchflow_ai的PostTrainArena上;首轮将在8个领域的留出任务上展开,并在公开基准上评估最佳环境。
d1-omni-600M借Core ML在Apple silicon上运行,M5 Pro上每秒审核224条评论
Alex表示,Liquid AI开源的d1-omni-600M模型已可在Apple silicon上以Core ML运行:用GPU+神经引擎处理Civil Comments的5000条真实评论,在M5 Pro上达到每秒224条的审核速度,与人工评分者的一致率达95.4%,与PyTorch基准版持平。Liquid AI当日发布Open d1系列两个开源多模态模型:d1-3B(文本+视觉)和d1-omni-600M(文本+图像或文本+音频)。
Perplexity开源嵌入模型pplx-embed-v2-late,PDF检索可跳过OCR步骤
Perplexity在Hugging Face以MIT许可证发布开源嵌入模型pplx-embed-v2-late,提供0.6B和9B两种规格,基于Qwen3.5构建,采用ColBERT式迟交互检索,支持文本、图像及PDF等渲染页面。两种规格共享同一嵌入空间;在ViDoRe v3基准图像赛道上,Perplexity报告的nDCG@10分别为62.3%和65.2%。