← 返回

NEWS · 快讯

标签:AI

查看带有该精确标签的快讯。

订阅此筛选 RSS

共 11 条快讯 · 门户最近更新

Liquid AI 发布 Open d1 系列开源多模态决策模型,覆盖 d1-3B 与 d1-omni-600M

Liquid AI 宣布发布 Open d1:d1 决策模型系列中的两个开源权重多模态模型。d1-3B 支持文本+视觉,d1-omni-600M 支持文本+图像或文本+音频。团队表示这些模型可在从 @nvidia DGX 数据中心到 RTX 工作站再到 Jetson 边缘设备上实现实时决策。转发者 Derya Unutmaz 称此类单次前向完成决策的模型对机器人、自主实验室、医疗设备和物理 AI 具有重大意义。

liquidai查看原文 ↗

Databricks 宣布 Workday Data Connect 联邦功能在 Unity Catalog 进入 Beta

Databricks 官方宣布,Workday Data Connect 联邦(federation)功能现已在 Unity Catalog 进入 Beta 阶段。团队表示,使用 Workday Data Cloud 的团队可以对其共享的 HR 与财务表获得零拷贝、只读访问;Databricks 负责执行查询,Unity Catalog 负责管理访问权限、血缘与审计。用户可将现有的人员与财务数据与企业其他数据结合,用于分析和 AI 场景,包括基于 Genie 的自然语言数据探索、人力分析和财务规划。

databricks查看原文 ↗

Paul Graham 称 Replit 比他此前想象的更重要:AI 渗透组织的深层变革将以代码形式发生

Replit 官方账号援引 Paul Graham 的言论:他在与 Amjad(Replit 方面)交谈后表示,Replit 比他此前认为的更重要,是 AI 渗透组织的方式。其观点认为,组织可以通过使用 AI 驱动的应用在一定程度上与 AI 对齐,但最深层的变革会以代码的形式发生。以上为作者引用 Graham 的个人判断,未独立核实。

Replit查看原文 ↗

Google Gemini 3.8 Live 端到端语音模型亮相

DeepLearningAI 介绍,Google 的 Gemini 3.8 Live 模型采用语音到语音架构,在一个系统中完成聆听、推理和回应。推文称,Extended Thinking 版本在 Artificial Analysis 的 Speech to Speech Index 中排名第一;标准版在真人盲评现场对话中排名第二,输入音频价格为每小时 0.84 美元,为该指数最低。两个版本还支持图像和视频输入。

DeepLearningAI查看原文 ↗

本·阿弗莱克自称会写 Python、了解卷积神经网络,并私下看过谷歌与 OpenAI 的视频模型

作者引述一段 Fireside Alpha 内容称,Ben Affleck 透露自己从年轻时就对计算机感兴趣,会写 Python、了解卷积神经网络、曾大量使用 GPU,并借助自己的名人身份获得私下了解 Google 和 OpenAI 视频模型的机会。上述内容均为作者引述的一方说法,未经独立核实。

abidlabs查看原文 ↗

Google 与 MIT 报告推出 Coco:面向软硬件协同设计的智能体平台

dair_ai 援引 Google 与 MIT 的报告介绍 Coco——一个供 TPU 架构师用于硬件与模型协同设计的智能体平台。报告称,每次设计决策依赖数百 GB 训练前未见过的全新仿真扫描数据;Coco 将每次扫描登记到规范化的关系数据库中,智能体报告的每个数字均可通过 SQL 查询溯源。智能体可自主组合类型化工具、运行对比相同执行配置下系统等重复性分析,并读取 UI 导航状态作为上下文。报告称短期目标是将架构师搭建仿真和获取洞察的时间减半。论文链接:arxiv.org/abs/2610.02376。

dair_ai查看原文 ↗