概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · MiniMax H3 做成付费接口,480p 极速档 2 秒出片
- 重点 · 安全研究者用 Claude 进了 OpenAI 的私有代码库
- 重点 · 零真机数据训练的 4B 具身模型,直播一小时户外服务
全球 AI 资讯
- 微软单月修掉 950 多个漏洞,两个零日在野利用
- Anthropic 与 OpenAI 转向 20-30 MW 的小型数据中心
- 华为 OceanStor M900 把 KV Cache 池化到 PB 级
- PrismML 拿到 2225 万美元种子轮,押注小模型
区域与早期信号
- 智谱 ZCode 承认索引功能可能上传仓库数据
- Helix 2.5 零样本进 30 个陌生家庭,成功率 56%

九凤根据本期已引用来源整理。
热门模型动态
01/09
MiniMax H3 做成付费接口,480p 极速档 2 秒出片
Pruna AI 把开放权重的 MiniMax H3 包成商用推理端点,按输出秒分四档计费。
Pruna AI 于 9 月 17 日在 X 上发帖推出 P-Video-2-Pro,给开发者提供从文本或参考图生成短视频(带音频)的加速接口。官方口径是:Speed 模式下 480p 的 5 秒片段约 2 秒生成,同样长度在 768p 约需 4.3 秒。
- 可用规格:5-15 秒片段,输出带音频,输入支持文本或参考图
- 速率上限:API 250 请求/分钟
- 底座:MiniMax H3,7 月底发布、8 月 3 日开放
- 团队:Rayan Nait Mazi(CEO)、Bertrand Charpentier(总裁兼首席科学家)、John Rachwan(CTO)、Stephan Gunnemann(首席战略官),研究团队分布在慕尼黑与巴黎,公司方向是模型效率而非从头训练基础模型
计费按分辨率与模式分四档:
| 档位 | 每输出秒(美元) | 5 秒片段合计(美元) |
|---|---|---|
| 480p Speed | 0.02 | 0.10 |
| 480p Quality | 0.04 | 0.20 |
| 768p Speed | 0.035 | 0.175 |
| 768p Quality | 0.075 | 0.375 |
从 H3 开放权重到这个商用端点上线不到七周,RuntimeWire 把它视为开放权重模型给独立推理团队让出的商业空间。
局限:2 秒只对应 480p 的 Speed 档,同样 5 秒片段在 768p 要约 4.3 秒,两档之间画质差多少来源没有给出可比数据;这些时延与价格都出自 Pruna 自己的发布口径,没有第三方复测。

九凤根据本期已引用来源整理。
来源:RuntimeWire · Pruna AI on X
02/09
安全研究者用 Claude 进了 OpenAI 的私有代码库
RuntimeWire 援引《华尔街日报》称,研究者通过一名 OpenAI 员工的 ChatGPT 账号读到并可建议修改私有代码。
RuntimeWire 援引《华尔街日报》的报道说,独立安全研究人员用 Anthropic 的 Claude 访问了一名 OpenAI 员工的 ChatGPT 账号,由此获得读取 OpenAI 私有代码库、并对其提交修改建议的途径。
RuntimeWire 由此提出的运维问题是:当一个智能体拿到员工身份之后,账号权限、代码仓库门禁与网络控制能不能把它关住。报道另外带到一条背景:Dario Amodei 9 月 12 日在 X 上宣布,Anthropic 将单方面承诺给外部评估机构长期的、员工级的系统访问权限,用于验证安全措施、上报事件并在训练期评估模型对齐。
局限:报道没有确立这次访问是否获得授权,也没有确立任何被建议的改动是否进入生产;研究者是否接触客户数据、是否造成运行损害同样未确立,研究者身份与事发日期也未披露。Anthropic 与 OpenAI 在本条来源里没有给出正式说明。
来源:RuntimeWire · Dario Amodei on X
03/09
零真机数据训练的 4B 具身模型,直播一小时户外服务
Lexiang Technology 用约 200 小时人类视频训练的 Aether,驱动两台人形机器人在上海做了公开直播。
Pandaily 报道,Lexiang Technology 的 Aether 模型在上海完成了一场超过一小时的户外烧烤服务直播,由两台人形机器人执行。
- 参数规模:约 40 亿
- 训练数据:约 200 小时人类视频,0 条真机数据
- 演示场景:上海户外烧烤服务,双人形机器人,直播时长一小时以上
- 形式:跨本体(cross-embodiment)公开演示
局限:这条目前只有 Pandaily 一家报道,其摘要只给出模型规模、训练数据与直播形式,没有任务成功率、任务清单或人工干预次数;「零真机数据」是厂商口径,没有第三方复现,权重与许可也未说明。
来源:Pandaily
全球 AI 资讯
04/09
微软单月修掉 950 多个漏洞,两个零日在野利用
今年累计约 2750 个,是 2020 年纪录的两倍多,行业把节奏归因于 AI 辅助的安全研究。
微软 2026 年 9 月补丁修复了 950 多个漏洞;截至目前今年累计修复约 2750 个,是 2020 年度纪录(约 1250 个)的两倍多。
| 类别 | 本月修复数 |
|---|---|
| 全部漏洞 | 950+ |
| 「严重」级 | 113 |
| 远程代码执行 | 258 |
| 权限提升 | 438 |
其中两个零日正在被利用:CVE-2026-81963 与 CVE-2026-85880,攻击者都能借此在 Windows 上实现权限提升。CVE-2026-85880 由 Volexity 与 Proofpoint 的研究人员发现,CVE-2026-81963 由空客直升机和微软威胁情报中心的研究人员独立上报。Ars Technica 的 Dan Goodin 指出,在 OpenAI、Anthropic、AWS、Google、微软等公司发布公开信、警告 AI 驱动的网络攻击会更普遍更复杂之后,整个行业正以前所未有的速度批量发补丁。
局限:安全社区的关注点是企业跟不上这个量。Action1 漏洞研究总监 Jack Bicer 说,这种规模下难的不是打完清单,而是判断先打哪个;Qualaix 创始人 Marva Bailer 说发现只是第一步,组织还得评估自身受影响范围、测试补丁、再部署到成千上万台设备,AI 反而让发现到部署之间的窗口压力更大;Fortra 的 Tyler Reguly 则说,只要微软还在追赶补丁,漏洞数量本身已经失去参考意义。
来源:InfoQ 中文 · InfoQ 英文原文 · AI 网络防御公开信
05/09
Anthropic 与 OpenAI 转向 20-30 MW 的小型数据中心
CNBC 报道两家在谈更小的供电站点,把推理容量更早接上线。
CNBC 于 9 月 18 日报道,Anthropic 与 OpenAI 正在探索约 20-30 兆瓦规模的数据中心部署,目的是让算力更快上线。四位知情人士说 Anthropic 在英国和北欧国家接触过潜在安排;两位消息人士说 OpenAI 也在北欧看过机会,另有一位描述了两家都参与的、关于在美国做同等规模部署的讨论。
按 Anthropic 官网的领导层页面,算力在这家公司属于联合创始人级职能:联合创始人兼首席算力官 Tom Brown 负责获取、扩展和使用算力资源的技术组织。
局限:这些是潜在容量的讨论,不是已完成交易;来源没有给出选址、供电方、投资额与上线时间,信息来自匿名消息人士。
来源:RuntimeWire · Anthropic
06/09
华为 OceanStor M900 把 KV Cache 池化到 PB 级
面向超大规模推理的 AI 内存型存储,单集群 KV Cache 最高 64 PB。
- KV Cache 容量:单集群最高 64 PB,经灵衢(Lingqu)池化
- 访问时延:NPU 到 SSD 约 60 微秒
- 聚合带宽:约 40 TB/s
- 调度:KV-Aware 调度
局限:这些是产品规格口径,Pandaily 的摘要没有给出实测吞吐、适配的模型与集群规模、价格与供货时间,也没有第三方评测。
来源:Pandaily
07/09
PrismML 拿到 2225 万美元种子轮,押注小模型
TechCrunch 说这家实验室赌的是「能推理的大模型其实不必做得很大」。
TechCrunch 报道,AI 实验室 PrismML 迄今只完成了 2225 万美元的种子轮融资,值得关注的是参与其中的技术班底和它在做的方向:PrismML 押注高性能、能推理的大语言模型其实不必做得很大。
局限:可读到的报道里没有模型名称、参数量、上下文长度、评测成绩或发布时间,这条目前是方向性信号,不是可用产品。
来源:TechCrunch
区域与早期信号
08/09
智谱 ZCode 承认索引功能可能上传仓库数据
官方致歉并称已修复,将开源代码库、引入第三方审查。
9 月 18 日,智谱旗下编程产品 ZCode 通过官方群组向受影响用户致歉,称已第一时间完成自查、相关问题已经修复。按官方回应,问题出在「代码库索引」功能:它在本地生成仓库索引,用于会话检查点恢复、历史版本回退和 Repo Wiki;其中 Repo Wiki 在云端生成 Wiki 页面时,可能触发仓库数据上传。
官方称上传数据在云端生成页面后立即销毁、不会保存,起因是该功能上线初期默认开启。智谱同时宣布近期将开源 ZCode 代码库,并邀请第三方评估人员审查系统运行情况、持续公开审查进展。
局限:受影响用户数量、上传数据的范围与时间窗口官方都没有公布;「立即销毁、不保存」目前只有厂商说法,第三方审查尚未开始。这条目前只有中文来源。
来源:IT之家
09/09
Helix 2.5 零样本进 30 个陌生家庭,成功率 56%
不现场采数据、不做针对性微调,420 次试验成功 237 次。
9 月 17 日,Figure AI 发布新一代模型 Helix 2.5,在 30 个真实的湾区民宅里做了一次零样本测试:面对陌生物体和陌生的房间布局,事先不采集数据、不做针对性微调,任务是叠毛巾、整理床铺、捡东西这类家务。测试为盲测,420 次试验中成功 237 次。
| 策略 | 零样本成功率 |
|---|---|
| Helix 2.5(含 Index 预训练) | 56% |
| 同硬件同任务、无 Index 预训练 | 9% |
来源还给出两个数字:整体成功率提升 522%,且没有任何单一评测任务在 Index 预训练数据中的占比超过 1.90%。与上一代对比,Helix 02 需要先到目标场地采集数据才能训练,Helix 2.5 用一半的适应数据量,就在 30 个没见过的家庭里追平了 Helix 02 在单一场地的成功率。
局限:56% 也意味着近一半试验失败;测试集中在湾区民宅和整理类任务,来源没有给出失败案例的分布与硬件细节。
来源:爱范儿
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

