Liquid AI 发布 Open d1:两款开放权重多模态决策模型
Liquid AI 宣布推出 Open d1,包含其 d1 决策模型家族中的两款开放权重多模态模型:d1-3B 支持文本+视觉,d1-omni-600M 支持文本+图像或文本+音频。官方表示这些模型可实现实时决策,部署范围从 NVIDIA DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备。
共 9 条快讯 · 门户最近更新
Liquid AI 宣布推出 Open d1,包含其 d1 决策模型家族中的两款开放权重多模态模型:d1-3B 支持文本+视觉,d1-omni-600M 支持文本+图像或文本+音频。官方表示这些模型可实现实时决策,部署范围从 NVIDIA DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备。
Liquid AI 宣布发布 Open d1,推出 d1 决策模型家族的两个开源权重多模态模型:d1-3B 支持文本加视觉,d1-omni-600M 支持文本加图像或文本加音频。官方称模型面向实时决策,可部署于从 NVIDIA DGX 数据中心、RTX 工作站到 Jetson 边缘设备等多种环境。转发者表示 d1-3B 在 RTX 4090 上据称延迟为 8 毫秒,并称其为"一次前向传播输出结果、零输出 token"的决策模型;这些性能数据来自作者转述,未经独立核实。
Hugging Face 官方账号转发 Viviana Márquez 的消息:Liquid AI 宣布发布 Open d1,为其 d1 决策模型家族中的两个开放权重多模态模型。其中 d1-3B 支持文本+视觉,d1-omni-600M 支持文本+图像或文本+音频。团队表示这些模型可在 NVIDIA DGX 数据中心、RTX 工作站到 Jetson 边缘设备上实现实时决策。以上型号、能力与部署说法均来自作者/团队原文,未独立核实。
作者表示,Liquid AI 发布 Open d1 系列的两款开源权重多模态决策模型:d1-3B(文本 + 视觉)与 d1-omni-600M(文本 + 图像或文本 + 音频)。团队称模型可在多种环境进行实时决策,从 NVIDIA DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备。
Liquid AI 宣布推出 Open d1,包含其 d1 决策模型家族的两款开源权重多模态模型:d1-3B 支持文本加视觉,d1-omni-600M 支持文本加图像或文本加音频。公司称这些模型可实现"实时决策",部署范围从 NVIDIA DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备。转发者 Piotr Mazurek 表示该模型也已获得 sgl_project 的支持。
Liquid AI 宣布推出 Open d1,包含 d1 决策模型系列中的两个开放权重多模态模型:d1-3B 支持文本加视觉,d1-omni-600M 支持“文本+图像”或“文本+音频”。团队称这些模型可在 NVIDIA DGX 数据中心、RTX 工作站及 Jetson 边缘设备等环境中进行实时决策。
Liquid AI 宣布发布 Open d1,为其 d1 决策模型系列中的两个开源权重多模态模型:d1-3B 支持文本与视觉,d1-omni-600M 支持文本加图像或文本加音频。官方称这些模型可在多种环境进行实时决策,部署范围从 NVIDIA DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备。
Liquid AI 宣布开源 Open d1 系列两个开放权重多模态决策模型:d1-3B 支持文本+视觉,d1-omni-600M 支持文本+图像或文本+音频。官方称这些模型可用于实时决策,部署范围从 NVIDIA DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备。相关表述均为作者/团队声称,未经独立核实。
Liquid AI 宣布发布 Open d1:其 d1 决策模型家族中的两个开放权重多模态模型。官方称 d1-3B 支持文本+视觉,d1-omni-600M 支持文本+图像或文本+音频,可在从 NVIDIA DGX 数据中心、RTX 工作站到 Jetson 边缘设备上实时运行。转发者表示 d1-3B 小得可以在 MacBook 上运行,并用其为穿搭打分演示多模态视频输入,更多演示见其 Hugging Face Space(链接未展开)。