本文目录
AI 热点资讯

WeatherNext 3 接入搜索与 Gemini,逐小时刷新

核心速览
  • Google DeepMind 发布 WeatherNext 3,逐小时刷新并接入搜索、Gemini 与 Maps
  • Cloudflare 把 GPT-5.6 Cyber 接进漏洞发现与临时防火墙规则
  • Claude Fable 5.1 解开 1653 年数字密码
  • 英伟达以 129.3 亿美元收购 Hugging Face,并在 IFA 发布个人 AI 路由 PAIR。
jiufeng
2026年9月4日
17 分钟阅读
WeatherNext 3 接入搜索与 Gemini,逐小时刷新

概览

本期共 10 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · WeatherNext 3 上线:逐小时刷新,接入搜索与 Gemini
  2. 重点 · Cloudflare 把 GPT-5.6 Cyber 接进漏洞发现与修补
  3. 重点 · Claude Fable 5.1 用 44 分钟解开 1653 年的数字密码
  4. Gemini 语音功能进入 Gmail、Docs 与 Keep
  5. 四家主流模型服务罕见同时中断

全球 AI 资讯 6. 英伟达 129.3 亿美元收购 Hugging Face 7. 英伟达 PAIR 把闲置电脑并成本地推理池 8. NeoMME 开放 260M/800M 多语种多模态编码器

区域与早期信号 9. GLM-5.3-Flash 夜间额度按客户端分档优惠,持续到 9 月 20 日 10. 腾讯 WorkBuddy 开放平台首批联合 30 多个硬件品牌

2026-09-04 AI 热点信号地图
2026-09-04 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

WeatherNext 3 上线:逐小时刷新,接入搜索与 Gemini

Google DeepMind 的旗舰天气预报模型换代,同时进入搜索、Gemini、Maps 与云端。

Google DeepMind 与 Google Research 于 9 月 3 日发布 WeatherNext 3。官方公告称,新版本引入实时卫星数据、逐小时刷新、更高分辨率、更精确的降水预报以及清洁能源相关变量,并已接入 Search、Gemini、Maps、Google Maps Platform 与 Google Cloud。项目由 Google DeepMind 天气科学负责人 Ferran Alet 与两个团队的研究者共同推进。

作为对照,公开仓库中的上一代 WeatherNext 2 使用 0.25 度全球网格(赤道附近约 30 公里),每 6 小时初始化一次,生成 64 个集合成员。

证据来源要分开看:官方博客援引 Brightband 的独立实时评测,称 WeatherNext 3 是迄今最先进、最准确的全球天气 AI 模型,RuntimeWire 也提到 Brightband 的 Operational WeatherBench 已把 WeatherNext 3 纳入;而官方给出的「CRPS 最高改进 60%」是限定口径——对照 NASA IMERG 降水观测的改进幅度上限。

GitHub - google-deepmind/weathernext
GitHub - google-deepmind/weathernext

图片来源:GitHub;已转存至九凤 R2。

来源:Google Blog · RuntimeWire · TechCrunch · GitHub

Cloudflare 把 GPT-5.6 Cyber 接进漏洞发现与修补

边缘流量数据加 OpenAI 模型:找到漏洞、判断线上是否可达,再同时给补丁和临时 WAF 规则。

Cloudflare 于 9 月 3 日开放 Vulnerability Discovery and Remediation 的邀请制早期访问。该服务位于 Cloudflare Managed Defense 之内,用 OpenAI 的 GPT-5.6 Cyber 承担侦察、漏洞挖掘与验证;Cloudflare 再结合自己的网络侧信息,判断受影响代码是否已部署、哪些路由可以到达,最终同时给出软件补丁建议和临时防火墙规则。GPT-5.6 Cyber 此前通过 OpenAI 受限的 Daybreak 计划推出。

可用性有边界:目前只对受邀客户开放,扫描对象限于客户授权的代码,每一处变更都要人工批准,Managed Defense 的人员会在服务面向更大市场之前参与设定边界。报道也直说,这套联动能否成立,取决于这些检查在真实环境里是否站得住脚。

来源:RuntimeWire · OpenAI

Claude Fable 5.1 用 44 分钟解开 1653 年的数字密码

一道被视为未解的 17 世纪谜题被拆开,但评测方说靠的是穷举与坚持,不是更强的密码分析。

The Decoder 报道,Anthropic 的 Claude Fable 5.1 解开了 Sir Thomas Urquhart 1653 年出版物中的 "Cyphral Distich"——两行、每行 32 个数字。评测机构 Vals AI 称,模型在没有人类帮助的情况下用 44 分钟给出答案:每个数字指向该出版物 32 个章节之一中的一个词,这些词的首字母连起来是 "O God uphold King Charls the Second and make him the supreme ruler of this land"。

此前该作者用其他前沿模型测试未解谜题数月,没有一个给出可验证的解;这次的做法是让 Fable 5.1 自己去找一道它认为可解的题,它筛选后选中了这首诗。

Vals AI 同时给出保留意见:成功来自系统性试错和持续性,而不是更强的密码分析能力,事后看解法并不复杂,人类同样可以解出。这条目前只有一家英文媒体报道,证据链依赖 Vals AI 的单方描述。

来源:The Decoder

Gemini 语音功能进入 Gmail、Docs 与 Keep

Google 把 Gemini 做成邮件、文档和笔记里的操作层,最强的一档留给高价套餐。

9 月 3 日,Google 开始向付费订阅者推送 Gmail、Docs 和 Keep 的 Gemini 语音界面:Gmail Live 支持就收件箱里的信息提问并继续追问,Keep Live 用于整理口述笔记,Docs Live 把一段口述的想法直接变成结构化文档。Sundar Pichai 在 X 上宣布本次推送,并单独点名 Docs Live;这些功能在今年 I/O 上首次预览。

分层很清楚:Gmail Live 与 Keep Live 覆盖 Plus、Pro、Ultra 套餐,Docs Live 需要 Pro 或 Ultra;面向企业用户的访问只是「稍后提供」的承诺,尚无时间表。

来源:RuntimeWire · Google Workspace 博客

四家主流模型服务罕见同时中断

ChatGPT、Claude、Grok 与 Gemini 几乎在同一时间出问题。

Ars Technica 报道,ChatGPT、Claude、Grok 和 Gemini 几乎同时出现服务中断,四家主流模型服务在同一时间段不可用,属于罕见的重叠故障。

可核实的部分到此为止:这条目前只有 Ars Technica 一家英文报道的标题与导语可用,故障的起止时间、影响范围与原因暂时没有可引用的说明。

来源:Ars Technica

全球 AI 资讯

英伟达 129.3 亿美元收购 Hugging Face

开放模型的主要分发入口易主,交易要到 2027 年上半年才可能完成。

黄仁勋 9 月 3 日在英伟达博客宣布,公司已同意以 12,930,300,000 美元收购 Hugging Face。The Decoder 拆解称,其中约 119 亿美元为收购价,另有最高 10 亿美元的股票计划用于留住员工;据 SEC 文件,交易预计 2027 年上半年才会完成,且仍需监管批准。平台规模是超过 1800 万开发者、研究者与创作者,超过 20 万家公司在用。

英伟达承诺 Hugging Face 保持开放:开发者可自选模型、框架、云与推理服务商和计算平台,在平台上构建或部署不要求使用英伟达算力。这些目前只是公司表态,交易本身也尚未获批;The Decoder 的判断是,英伟达买下的是开放模型生态的「前门」,同时得到一条新的算力销售通道。

来源:NVIDIA · The Decoder

英伟达 PAIR 把闲置电脑并成本地推理池

免费开源工具,把家里网络内的兼容 PC 拼起来跑本地推理,配合 Ollama 和 LM Studio。

英伟达发布 Personal AI Router(PAIR):一个免费工具,把家里的多台电脑同步起来承担本地 AI 推理任务,可搭配 Ollama、LM Studio 这类工具使用,对应的开源软件放在 GitHub 的 NVIDIA/Personal-AI-Router 仓库。The Verge 首先澄清了名字带来的误解——PAIR 不是硬件路由器,而是一套软件;兼容设备以 RTX 20 系及更新的 GeForce GPU 为主。

限制也在这里:要用上这套调度,前提是本地网络里本来就有多台兼容且闲置的机器;RTX 20 系这道门槛把更早的硬件挡在外面。

来源:The Verge · PAIR 项目页 · GitHub

NeoMME 开放 260M/800M 多语种多模态编码器

单个双向 Transformer 直接吃文本 token 和图像 patch,索引存储压到每页 6 kB。

H company 在 Hugging Face 发布 NeoMME,包含 260M 与 800M 两个规模的多语种多模态编码器。它不使用单独预训练的视觉塔,也不用因果语言模型,而是由一个双向 Transformer 同时处理文本 token 与原始图像 patch,并以掩码离散扩散目标从零训练整个模型。团队按 ColPali 的整页图像方法微调出 NeoMME-Retriever,一次前向即返回稠密嵌入与延迟交互嵌入。

公布的数据是:两个规模都落在 ViDoRe v3 的 nDCG@10 与模型大小帕累托前沿上;在 NVIDIA L40S、2048×2048 输入下,260M 模型约每秒编码 51 页,约为 ColModernVBERT 吞吐的两倍;分层 token 池化配合非对称量化,把延迟交互索引从每页约 1.5 MB 压到 6 kB,即缩小约 255 倍。

这些结果均来自作者团队自报的评测:帕累托前沿的说法限定在 ViDoRe v3 的 nDCG@10 与模型规模两个维度,吞吐对比也绑定特定 GPU 与输入尺寸,尚无第三方复现。

来源:Hugging Face · arXiv

区域与早期信号

GLM-5.3-Flash 夜间额度按客户端分档优惠,持续到 9 月 20 日

智谱给 GLM Coding Plan 付费用户开夜间窗口,每天 23:00 到次日 9:00。

据 IT之家,智谱 AI 宣布 GLM Coding Plan 推出「Flash × ZCode」夜间畅用活动:即日起至 9 月 20 日,每晚 23:00 至次日 9:00,所有付费套餐用户无需手动开启、系统自动生效。该时段 GLM-5.3-Flash 的额度规则按客户端分档:通过智谱官方编程工具 ZCode 使用,额度消耗为 0;通过套餐支持的其他 Agent 使用,可用额度翻倍(×2)。

边界要说清:这是限时活动,9 月 20 日结束,优惠只针对 GLM-5.3-Flash。本条目前只有中文媒体报道可核,未见对应的英文一手公告。

来源:IT之家

腾讯 WorkBuddy 开放平台首批联合 30 多个硬件品牌

Agent 平台向外接硬件与行业软件,发布会给出的是合作方数量,不是使用规模。

InfoQ 中文报道,腾讯 9 月 2 日在深圳举行 WorkBuddy 生态发布会,首批亮相 9 款联名硬件,覆盖智能眼镜、录音卡、领夹麦、AI 桌宠、键盘麦克风等办公交互设备。发布会公布的合作规模是 30 多个硬件品牌、30 多个 Buddy 应用、100 多个开放平台共创伙伴,名单包括安克、Rokid、广发证券、北森、帆软。WorkBuddy 今年 3 月上线,半年迭代了 50 多个版本。

腾讯云副总裁、CodeBuddy & WorkBuddy 负责人刘毅在会上表示,AI 提效取决于能连接多少数据、多少能力、走进多少真实场景;开放平台负责人于洪潇以财务对账为例说明卡点:银行流水在网银、发票在税务系统、凭证在 ERP,模型够不着数据,也不掌握行业 know-how。

上述数字都是发布会口径。报道未给出 WorkBuddy 的用户规模、联名硬件的上市时间与开放平台的接入条件,也没有第三方验证;仅有中文来源。

来源:InfoQ 中文