Hugging Face 官方账号转发 Viviana Márquez 的消息:Liquid AI 宣布发布 Open d1,为其 d1 决策模型家族中的两个开放权重多模态模型。其中 d1-3B 支持文本+视觉,d1-omni-600M 支持文本+图像或文本+音频。团队表示这些模型可在 NVIDIA DGX 数据中心、RTX 工作站到 Jetson 边缘设备上实现实时决策。以上型号、能力与部署说法均来自作者/团队原文,未独立核实。
huggingface查看原文 ↗
Liquid AI 宣布发布 Open d1 系列:d1-3B 支持文本加视觉,d1-omni-600M 支持文本加图像或文本加音频。团队表示模型可在多种环境实时决策,从 NVIDIA DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备,并已在 Hugging Face 开放获取。
liquidai查看原文 ↗
Perplexity 宣布推出 pplx-embed-v2-late,两个 late-interaction 嵌入模型,可在共享嵌入空间中检索文本、图像和页面,并支持跨模态查询。团队表示两个模型均达到前沿性能(frontier performance),现已在 Hugging Face 公开发布。
ClementDelangue查看原文 ↗
作者转发 Xenova 的推文称,EmbeddingGemma 2 已在 Hugging Face 发布,可将文本、图像、视频和音频映射到统一的嵌入空间。据介绍,该模型仅有 740M 参数,可通过 Transformers.js 在浏览器中基于 WebGPU 完全本地运行。以上为作者/团队声称,未经独立核实。
LysandreJik查看原文 ↗