概览
本期共 11 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Nex-AGI 发布 N2.5 三档模型,Pro 权重仍未放出
- 重点 · 订阅者报告 Claude token 在无人操作时被消耗
- 重点 · GPT-5.6 Sol 被用来自主跑量子计算实验
全球 AI 资讯
- NVIDIA 推出 CUDA Rust,把 GPU kernel 交给编译期检查
- Chrome 改成两周一版,理由是 AI 改变了安全形势
- AlphaGenome Atlas 预测人类基因组 90 亿个单碱基变异
- Pathway 的 BDH 架构把推理搬进潜空间,不生成思维链
- MiniMax 赞助东京会议,把日本 IP 的报酬问题摆上台面
区域与早期信号
- Herdr 拿到 600 万美元种子轮,给常驻编码智能体做运行时
- 该拒的是话题里的一个子集,不是整个话题
- 石头科技在 IFA 首发泳池清洁机器人(中文来源)

九凤根据本期已引用来源整理。
热门模型动态
01/11
Nex-AGI 发布 N2.5 三档模型,Pro 权重仍未放出
Nex-AGI 一次推出 35B Mini、397B Pro、1.6T Max 三个智能体模型,Mini 已可下载,Pro 权重仍标着「即将发布」。
三档分工不同:Mini 与 Pro 是多模态模型,面向操作电脑与浏览器;Max 去掉视觉输入,把最大的一档集中在推理、编程、科研与长时间运行的智能体任务上。公开材料把 Nex-AGI 描述为一项机构合作,涉及 Shanghai Innovation Institute、Shanghai Qiji Zhifeng、Mosi Intelligence 与 Kuafu Technology,团队统一署名 Nex-AGI Team,没有具名的创始人或 CEO,法律实体与总部也未公开。此前的 N1 技术报告日期为 2025 年 12 月 4 日,同样署名一个大型研究团队;团队更早的开源栈覆盖模型、数据集、智能体框架、强化学习工具与推理基础设施。
放出权重和能跑起来是两回事:Mini 可以按官方示例部署在两张 H100 上,Max 的参考配置要两个节点、共 16 张 H200,而 Pro 的权重至今没有出现在模型库里。

图片来源:huggingface;已转存至九凤 R2。
来源:RuntimeWire · Hugging Face · GitHub
02/11
订阅者报告 Claude token 在无人操作时被消耗
一名 Claude Max 20x 用户在完全没干活的对照时段里看到用量从 45% 涨到 55%,Anthropic 此后就黑客盗用向用户发出提醒。
8 月 4 日,英国东萨塞克斯的独立 AI 顾问 Grant De Swardt 发现自己的 Claude Max 20x 账号在他当天没有工作的情况下,token 用量仍在往上走。第二天他关掉了挂在 Claude 上的所有东西、也没有使用它,消耗还是继续增加。他向 TechCrunch 描述了那段最清晰的对照区间:用量从 45% 升到 55%,其间他没有进行任何工作,Cowork 的计划任务已暂停或完成,Dispatch 与云端执行被关闭,本地也没有对应的 Claude Code 任务在跑。
证据边界要说清楚:目前公开的完整对照记录来自这一位用户,报道由 TechCrunch 单独完成;Anthropic 的动作发生在此之后,是向用户发出黑客警告。
来源:TechCrunch
03/11
GPT-5.6 Sol 被用来自主跑量子计算实验
OpenAI 发布使用案例,称一名 MIT 研究者用 GPT-5.6 Sol 配合 Codex 自主运行量子实验、分析结果并校准量子比特。
按 OpenAI 官网这则案例的描述,这套用法覆盖实验流程里的三段活:运行实验、分析结果、校准量子比特,且被描述为自主运行。
这是 OpenAI 自己发布的客户故事,属厂商叙述。本站未见第三方复现或独立报道;这套用法能不能迁移到别的实验室,要等研究方自己的公开材料。
来源:OpenAI
全球 AI 资讯
04/11
NVIDIA 推出 CUDA Rust,把 GPU kernel 交给编译期检查
两个 NVlabs 开源项目分别覆盖 SIMT 与 Tile 两种编程模型,用 Rust 的所有权规则在编译期拒掉别名错误。
此前 Rust 可以启动 CUDA kernel,但 kernel 本体通常得用别的语言写,CUDA Rust 补的就是这一段。cuda-oxide 对应传统的 SIMT 模型,也就是描述单个线程做什么、再启动成千上万个;cutile-rs 对应较新的 Tile 模型,这个模型同时有 C++ 与 Python 版本。两者都原生编译 Rust kernel。NVIDIA 给出的动机是 AI 的系统层已经大量用 Rust:Nova Linux 驱动是 Rust 写的,NVIDIA Dynamo 有 Rust 核心,NVTX 有 Rust 绑定,只有 GPU kernel 一直是例外。
两个项目的成熟度差得很远:cutile-rs 已经发到 crates.io,支持 stable Rust 1.89+,并且已被 Hugging Face 的 Grout 推理引擎和 mistral.rs 使用;cuda-oxide 在 GitHub 上标注为 early alpha。
来源:MarkTechPost · NVIDIA 开发者博客 · GitHub
05/11
Chrome 改成两周一版,理由是 AI 改变了安全形势
从 Chrome 153 起,桌面、iOS 与 Android 的发布周期由四周缩短到两周。
Google 今年早些时候承诺的节奏变更正式生效:周二上线的 Chrome 153 同时覆盖三端,此后按两周一版走。Google 给的理由是 Chrome 的安全策略在 AI 时代发生了变化——自动化 AI 工具与社区漏洞报告推高了补丁与更新的数量,更短的发布周期更容易管理这些安全修复。
这条是发布节奏的调整,不是某个具体漏洞的修复公告;「AI 推高补丁量」也是 Google 自己的口径。
来源:TechCrunch · Google 安全博客
06/11
AlphaGenome Atlas 预测人类基因组 90 亿个单碱基变异
Google DeepMind 上线的图谱覆盖人类基因组里每一种可能的单字母改变,共 90 亿个变异的分子效应预测。
DeepMind 称这是目前最全面的「基因突变如何影响分子生物学」目录,通过一个免费网站门户面向学术研究开放。它建立在此前的 AlphaGenome 模型之上,要绕开的问题是:人类基因组约有 90 亿种可能的单字母突变,在实验室里逐一测试实际上做不到。
边界也写在来源里:Atlas 给出的是模型预测而不是实验测定,开放范围是学术研究,经免费门户使用。
07/11
Pathway 的 BDH 架构把推理搬进潜空间,不生成思维链
BDH 用类脑的稀疏神经元图在潜空间里推理,不输出中间的思维链 token,训练与扩展跑在 Amazon SageMaker HyperPod 上。
Pathway 的 Baby Dragon Hatchling(BDH)被描述为一种后 Transformer 的类脑架构:最初表述为一张神经元图,神经元之间通过稀疏的局部交互通信,状态保存在类似突触的连接里。它不把推理外化成一串额外生成、再喂回后续步骤的 token,而是在潜空间里从样例学习并逐步修正解;模型状态在上下文中自适应,不需要在测试时更新权重,推理跨度也不被固定大小的上下文窗口框住。
这篇发在 AWS 机器学习博客上,讲的是 BDH 怎么在 SageMaker HyperPod 上开发与扩展;架构主张来自 Pathway 与其论文,本站未见第三方评测。
来源:AWS 机器学习博客 · arXiv 论文
08/11
MiniMax 赞助东京会议,把日本 IP 的报酬问题摆上台面
9 月 11 日的东京会议围绕日本 IP 在生成式 AI 中如何被使用、保护与商业化,H3 拿到一个主题演讲席位。
MiniMax 将赞助这场会议,议程把权利人的报酬与权利保护放在中心位置。公司披露 2025 年有 73% 的收入来自中国大陆以外,东京这一场要检验的,就是能否把外界对 H3 的兴趣转成围绕报酬、权利保护与日本 IP 全球商业化的本地关系。创始人闫俊杰身兼董事长、CEO 与 CTO,此前在商汤工作六年多,做到副总裁与研究院副院长。
会议 9 月 11 日才开,目前公开的只有议程与主办信息,没有具体的授权协议或分成方案;这条的一手材料是 MiniMax 在 X 上的贴文。
来源:RuntimeWire · MiniMax on X
区域与早期信号
09/11
Herdr 拿到 600 万美元种子轮,给常驻编码智能体做运行时
Bessemer 领投,创始人 Can Celik 要把这个「合上笔记本也不中断」的开源运行时做成开发者工具公司。
Herdr 针对的是长时间运行的编码智能体缺少持久化、状态跟踪与远程控制,而且这些能力不该绑死在某一家模型厂商的界面里。Bessemer Venture Partners 领投这轮 600 万美元种子轮,Y Combinator、e2 与多名天使投资人跟投;融资在 9 月 8 日宣布,距离加入 YC 2026 年秋季批次刚好一个月。
规模是这条的关键限制:YC 页面上 Herdr 仍登记为一人公司,Celik 在 8 月还写过「Herdr 背后只有我一个人」,融资公告把招人列为这笔钱的首要用途。这轮要验证的,是开源采用能不能撑起一门持久的开发者工具生意。
来源:RuntimeWire · Herdr on X
10/11
该拒的是话题里的一个子集,不是整个话题
Multiverse Computing 的团队认为,把有害当成话题级属性,正是模型见到危险词就误拒安全提示的根源。
文章指出,多数安全对齐工作把有害当作话题的属性——提示只要落进武器、欺诈、自残这类大类就算不安全,LlamaGuard-3 这类护栏模型编码的正是这种话题级分类法;XSTest、OR-Bench 这些基准探测的就是由此产生的失败模式,而拒答校准的工作在试图把这个数字压回去。
作者的论点是真实部署对不上这张话题级图景:同一个基座模型被改造成通用助手、教育产品、企业系统或公共部门服务时,同一话题内需要不同的边界——公民教育辅导和公共部门助手可以共用一个模型,却在政治话题上需要相反的行为。这是厂商团队在 Hugging Face 上发的方法论文章,具体评测数字需回原文核对,本站未见第三方复现。
来源:Hugging Face · XSTest 论文
11/11
石头科技在 IFA 首发泳池清洁机器人(中文来源)
RockAqua P1 在柏林展馆的泳池里自主巡航,同台还有新一代割草机器人 RockNeo Q2 LiDAR。
9 月 4 日的柏林 IFA 9 号馆,石头科技把一池水搬进展厅,全球首发泳池清洁机器人 RockAqua P1;正对泳池展示的是新一代智能割草机器人 RockNeo Q2 LiDAR。同场的科沃斯与追觅展台前也围了几圈人。雷锋网援引 IDC 数据:2025 年度全球家用清洁机器人出货 3272 万台,石头以 580 万台占 17.7%,科沃斯 14.3%、追觅 10.5%、小米 6.7%、云鲸 5.3%——前五名全部来自中国,合计超过 54%;曾经的行业霸主 iRobot 在 2025 年 12 月申请破产保护,接盘方是它的中国代工厂深圳杉川。
证据边界:这是中文行业观察稿,产品侧只有展会首发信息,没有价格、上市时间与自主导航的性能指标。
来源:雷锋网
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

