← 返回快讯

快讯事件 · 1 条来源

Hugging Face博客介绍ML Intern:从提示词到已训练评估模型的完整流程

abidlabs

Hugging Face博客发布一系列示例和完整提示词,介绍如何有效使用ML Intern。该工具可将提示词转化为已在Hub上训练并评估的模型,流程包括规划、申请预算、冒烟测试、训练、评估和发布,一周内以约100美元算力训练了6个模型。

全部来源

前后事件

相关事件

Yuchen Jin:ChatGPT快速给出更优雅证明,深度专长叠加善用AI成护城河

Yuchen Jin分享一段视频见闻:一位数学博士生与导师花六个月证明一条定理,投稿前询问ChatGPT,AI迅速用他们未曾考虑的方法给出更优雅的证明,二人陷入存在主义危机。他表示数学家不必绝望,类比编程领域的变化,认为深度领域专长与善用AI的结合是这个时代的护城河。

abidlabs共 1 条来源

TRL v1.15发布:默认启用融合LM头,训练序列长度最高提升至6.9倍

Lysandre介绍TRL v1.15版本,SFT、DPO、KTO、GRPO、RLOO和蒸馏训练默认改用融合LM头,通过Triton内核直接计算所需的token级量,避免物化巨大的[batch, seq, vocab] logits张量。在Gemma 3 1B(262k词表)实测中,最大序列长度最高从28k提升至114k,8k上下文下峰值显存降低52-82%,训练速度最高提升约11%,无需额外配置即默认生效。

abidlabs共 1 条来源