AI 热点资讯

Liquid 发布决策模型 d1,输出 token 为零

核心速览
  • •Liquid AI 发布决策模型 d1,只返回校准概率、不生成文本
  • •英伟达在 Hugging Face 开放表格基础模型 Kumo Tabular
  • •ChatGPT 在 DevDay 当天上线共享空间 Space 和会议纪要功能
  • •OpenClaw 企业版控制面免费开放
  • •DeepSeek Harness 推出正式桌面版。
jiufeng
2026年9月30日
15 分钟阅读
本文目录

概览

本期共 9 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · Liquid 发布决策模型 d1,输出 token 为零
  2. 重点 · 英伟达开放 Kumo Tabular,表格预测不用训练
  3. 重点 · ChatGPT 上线共享空间 Space,会议纪要可存进工作区

全球 AI 资讯

  1. OpenClaw 企业版控制面开源,承诺永久免费
  2. Grokipedia 停更数月后恢复更新
  3. Wabi 从应用生成器转型为个人智能体信使
  4. ProvenanceGuard 核查 MCP 智能体:事实对了,来源也得对

区域与早期信号

  1. DeepSeek Harness 正式推出桌面版,登录送 6 元
  2. 元点小桥人形机器人首发 1000 台一周内售罄
2026-09-30 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

01/09

Liquid 发布决策模型 d1,输出 token 为零

d1 不写文本,只在调用方事先定好的选项上返回校准过的概率,面向分类、路由、打分这类任务。

Liquid AI 发布了 d1,定位是「决策模型」。调用时传入上下文和一组带类型的问题,一次调用就返回固定选项集合上的校准概率,每次响应里的 usage.output_tokens 都是 0。Liquid 的迁移指南给了一条判断规则:答案是 N 个已知选项之一,就用决策模型;需要组织新字符串的,继续用 LLM。

  • 目标任务:分类、工单路由、打分、内容审核、重排序、LLM-as-judge 检查
  • 调用方式:通过 Liquid API 托管,模型名 d1:free
  • 权重:模型库标注为仅 API、不可训练,不提供 GGUF、MLX 或 ONNX 权重
  • 示例:官方 cookbook 里的 road-decider 是一个像素风生存赛车游戏,d1 每一步在左、中、右三条路里选一条

局限:d1 目前只能通过托管 API 使用,不能本地自托管,也不能微调。报道没有给出它和通用 LLM 做同类任务时的准确率对比,MarkTechPost 也指出,复杂的多步推理仍要交给 LLM。

cookbook/examples/road-decider at main · Liquid4All/cookbook

图片来源:GitHub;已转存至九凤 R2。

来源:MarkTechPost · Liquid4All cookbook: road-decider

02/09

英伟达开放 Kumo Tabular,表格预测不用训练

Kumo Tabular 读一张带标签的表,一次前向传播就预测新行。模型分三档,参数量从 2800 万到 2.15 亿,采用 OpenMDW-1.1 许可证,可以商用。

NVIDIA Kumo Tabular 属于 NVIDIA Kumo Structured 模型集合,是面向表格数据的开放基础模型,已经上架 Hugging Face。给它一张已标注的表,它在单次前向传播里给出新行的标签,不需要训练、调参或特征工程,分类和回归都能做。

  • 规模:三档,28M 到 215M 参数
  • 许可证:OpenMDW-1.1,可商用
  • 预训练数据:只用了人工合成数据
  • 榜单:官方称在 TabArena、BeyondArena、TALENT、ScoringBench 四个榜单上排名第一

局限:「四榜第一」和「新的准确率-效率前沿」都是英伟达在官方博客里的说法,目前还没有独立复现。

来源:Hugging Face Blog(NVIDIA)

03/09

ChatGPT 上线共享空间 Space,会议纪要可存进工作区

OpenAI 在 DevDay 当天推出团队共享工作区 ChatGPT Space,同时推出能记笔记、存个人化摘要的 Meetings。

9 月 29 日 OpenAI 在旧金山开 DevDay,ChatGPT 官方账号同一天在 X 上发布了 Space 和 Meetings。Space 用来和团队、AI 一起创作与协作,页面是交互式文档,可以放图表、图片、清单和仪表盘,ChatGPT 还能按用户手头的工作直接生成页面。Meetings 负责记会议笔记,并把个人化摘要和后续待办存进工作区。Axios 此前报道,OpenAI 计划在这届 DevDay 上发布 20 多项产品和功能。

局限:这两项功能目前主要靠官方 X 帖子公布,报道里没写开放范围、适用套餐和价格。OpenAI 此前已经提供录音转写功能 ChatGPT Record。

来源:RuntimeWire · OpenAI Help:ChatGPT Record · OpenAI DevDay

全球 AI 资讯

04/09

OpenClaw 企业版控制面开源,承诺永久免费

OpenClaw 基金会发布 OpenClaw Enterprise,让组织在自有基础设施上部署和管控常驻 AI 智能体,现阶段只建议内部试点。

9 月 29 日,OpenClaw 基金会发布 OpenClaw Enterprise。这是一套开源控制面,用来在组织自己的基础设施上部署、治理常驻智能体。基金会表示组织使用它将永远免费,代码已在 GitHub 公开。项目最早出自 OpenAI 内部,后来由 OpenAI 捐给 OpenClaw 基金会,之后与 Red Hat、NVIDIA 一起开发。

局限:官方定位是「可用于内部试点工作负载」,还不是生产级。许可证免费,但运行智能体仍需接入模型提供方,管理员可以换成第三方或内部模型。RuntimeWire 指出,成熟度和运行成本跟免费许可一样重要。

来源:RuntimeWire · OpenClaw(X) · GitHub:openclaw-enterprise

05/09

Grokipedia 停更数月后恢复更新

SpaceXAI 旗下的 AI 百科 Grokipedia 又开始修改条目,但很多改动只有一句「重查全部引用和来源」。

8 月 Lawfare 报道,Grokipedia 自 4 月起就没再审核过编辑。The Verge 发现,平台的实时更新页面最近又出现了多个页面的改动:奥巴马词条显示两天前「Fact-checked by Grok」,马斯克词条在记者写稿的一小时内完成了核查。

局限:更新并不全面。从奥巴马词条点进去的檀香山词条,上次核查还是 7 个月前。很多改动只有「recheck all references and sources」一句备注,看不出实际改了多少内容。SpaceXAI 没有立即回复置评请求;X 与 SpaceXAI 的设计负责人 Benji Taylor 上周发帖谈到 Grokipedia,称 v0.2 会更好。

来源:The Verge

06/09

Wabi 从应用生成器转型为个人智能体信使

Wabi 2.0 把「用提示词做 App」改成一个会替用户办事、按需生成界面的个人智能体。

Wabi 原本让任何人都能用提示词构建应用。这周它宣布转型为 AI 信使,把聊天、应用和持续进行的任务合到一起,同时保留做应用的能力。创始人 Eugenia Kuyda 之前创办过 AI 陪伴应用 Replika,她把 Wabi 2.0 描述为「替你办事、在需要时生成你要的界面的个人智能体」。

局限:公告和报道都没有给出定价、开放地区或用户规模;「按需生成界面」的效果目前只有厂商自己的描述。

来源:TechCrunch · Wabi(X)

07/09

ProvenanceGuard 核查 MCP 智能体:事实对了,来源也得对

Multiverse Computing 的新论文检查智能体答案里的每条论断实际来自哪个 MCP 工具输出,以及这个输出是不是答案里点名的来源。

通过 Model Context Protocol,智能体可以调搜索工具、读结构化的病人或账户记录、查数据库、拉元数据,再把这些内容合成一个答案。团队指出,RAGAS faithfulness、MiniCheck、AlignScore、SummaC 等常见核查方法都是先把证据合并起来再判断论断有没有依据,通常说不出支撑某条论断的是哪个工具输出,也查不出它是不是答案里点名的来源。ProvenanceGuard 就是针对这个缺口做的。

  • 医疗领域评测:共 281 条 trace;其中 40 条 trace 的留出集(260 条可判来源的论断)上,block F1 0.802,source accuracy 0.858
  • 多源基准(更难):block F1 0.846,source-plus-relation accuracy 0.229
  • 注入探针:50 个全部检出

局限:这是一篇 arXiv 预印本,还没经过同行评审;主评测集中在医疗领域 trace 上,0.802 和 0.858 两个数字只来自 40 条 trace 的留出集。在更难的多源基准上,source-plus-relation accuracy 只有 0.229。

来源:Hugging Face Blog(Multiverse Computing) · arXiv

区域与早期信号

08/09

DeepSeek Harness 正式推出桌面版,登录送 6 元

据爱范儿实测,DeepSeek Harness 推出了 macOS 和 Windows 桌面端,不用再从终端部署,定位也从写代码扩展到日常办公。

DeepSeek 推出 DeepSeek Harness 桌面端,提供 macOS 和 Windows 版本。安装后登录即送 6 元赠金,10 月 6 日前有效。可以用账号或 API Key 登录,扣的是 DeepSeek 开放平台余额。标准、PTC、极简、创作四种智能体预设都还在,插件和自定义第三方模型也保留了。9 月 28 日发布的 0.2.0-rc.1 优化了 Office 和 PDF 的文字选择与预览。

局限:当前版本号仍是 rc。按爱范儿实测,账号登录不会同步 DeepSeek 应用里的聊天记录。这条目前只有一篇中文媒体的实测报道,还没有全球英文报道。

来源:爱范儿

09/09

元点小桥人形机器人首发 1000 台一周内售罄

这款 88cm、13kg 的小型人形机器人首发价 8888 元,报道称开售首日卖出 600 多台。

据雷锋网报道,元点小桥 9 月 2 日开售,首发价 8888 元。首日销量超过 600 台,登上京东人形机器人销量榜第一,不到一周首发 1000 台就售罄。它还拿下了 IFA 2026 创新大奖「下一代与新兴技术」类别最佳。

  • 规格:高 88cm,整机约 13kg,关节模组最高 50N·m
  • 动作:站立、行走、小跑、舞蹈、后空翻
  • 开发:支持 VR、动捕、摇杆遥操作;配套 OpenBridge 开源生态和 Skill Hub 技能广场

局限:销量和「全球首个 AI 原生具身本体」都是厂商口径,报道本身偏宣传稿,没有第三方数据;目前只有中文来源。

来源:雷锋网

用 JIUFENG 自己生成一张

在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。

免费生成图片