概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · ChatGPT 网页流量份额回升至 55.5%
- 重点 · GLM 5.3 在单节点 8 卡跑满 100 万上下文
- 重点 · Anthropic 点名三家实验室大规模蒸馏 Claude
全球 AI 资讯
- 攻击者用多智能体框架 6 小时内盗走上千凭据
- Mistral 融资 30 亿欧元,三星领投
- Motional 开放 2 万个驾驶极端场景
- Meta 测试 Muse:能替你花钱的个人智能体
区域与早期信号
- Perplexity 本地智能体底座换成 Qwen3.8-27B
- 深度智控拿到宁德时代、沙特阿美战投

九凤根据本期已引用来源整理。
热门模型动态
01/09
ChatGPT 网页流量份额回升至 55.5%
Similarweb 显示 ChatGPT 三个月内从 52.7% 回到 55.5%,Gemini 再度回落,Claude 一年从 1.9% 升到 9.3%。
Similarweb 统计的 AI 聊天机器人网站流量中,ChatGPT 占 55.5%,高于三个月前的 52.7%;Google Gemini 在一轮回升之后又从 27.8% 降到 25.6%。按年看变化更大:ChatGPT 从 73.3% 一路让出份额,Gemini 份额翻倍,Anthropic 的 Claude 从 1.9% 涨到 9.3%。其余几家仍是小角色——DeepSeek 3.4%、Grok 2.4%、Copilot 1.6%、Perplexity 0.9%。
这组数字只统计网页流量。The Decoder 指出,Google 很可能通过 Android 生态把大量 Gemini 交互留在移动端——推送通知直接打开 Gemini 应用并给出摘要,而不是跳一个网页链接;OpenAI 同样在推自己的移动应用和新桌面端。也就是说,这个排序反映的是网页入口,不等于总使用量。
来源:The Decoder · Similarweb via X
02/09
GLM 5.3 在单节点 8 卡跑满 100 万上下文
vLLM 把 HiSparse 接成按压力触发的内存层,KV 装不下时请求继续解码,不必抢占重算。
vLLM 公布了为 GLM 5.3 做的第一批优化。它把 HiSparse 做成一层「压力驱动」的内存层,与 Hybrid Memory Allocator 和 KV offloading 组合使用:当请求的 KV cache 在 GPU 上放不下时,块可以挪到主机内存,请求仍能继续解码。此前只有两条路——抢占(丢掉 KV、之后重新 prefill,每被赶走一次就要重付一遍首 token 时间)和卸载(稠密注意力要求每个 token 都驻留 GPU,并发数仍被显存卡死)。HiSparse 利用 sparse-MLA 的 KV cache 只对 indexer 选出的 top-K token 做注意力这一点,把其余部分移出显存。结果是 8 张 H200 的单节点聚合部署可以跑满 100 万上下文,这在该硬件上此前做不到。
这是两篇系列文章中的第一篇,第二篇尚未发布。HiSparse 方法本身另有一篇 arXiv 论文;文中给出的百万上下文结果对应的是单节点 8×H200 聚合部署这一具体配置。
来源:vLLM Blog · HiSparse 论文
03/09
Anthropic 点名三家实验室大规模蒸馏 Claude
官方公告称 DeepSeek、Moonshot、MiniMax 用约 2.4 万个欺诈账号,从 Claude 拿走超过 1600 万次交互。
Anthropic 在政策公告中说,它识别出三家 AI 实验室——DeepSeek、Moonshot、MiniMax——以工业规模非法提取 Claude 的能力来改进自家模型。这些实验室通过约 24,000 个欺诈账号与 Claude 产生了超过 1600 万次交互,违反了服务条款和区域访问限制。手法是「蒸馏」,即用更强模型的输出训练一个较弱的模型。
Anthropic 自己强调蒸馏是被广泛使用的合法训练方法,前沿实验室常蒸馏自家模型做更小更便宜的版本;它主张的问题在于竞争对手借此用极小的时间和成本获取他人能力。公告称这类行动的强度和复杂度都在上升、可行动的窗口很窄,需要跨机构快速协调。
来源:Anthropic
全球 AI 资讯
04/09
攻击者用多智能体框架 6 小时内盗走上千凭据
Google 威胁情报组说,这次入侵里的排错和 IP 轮换全程无人操作。
Google 威胁情报组(GTIG)发布报告《From Prompting to Autonomy: The Evolution of Adversarial AI》,记录第二季度追踪到的活动。Mandiant 调查人员把其中一起攻击溯源到一个疑似出于经济动机的攻击者:对方先攻入某组织的云基础设施,随后用一个 AI 编码聊天机器人、一段提示和一组智能体指令拼出自治框架,由预置的 markdown playbook 驱动后续扫描与凭据收集,六小时内拿到数千条凭据。排错和 IP 轮换全程无人介入,流量又从受害者自己的地址发出,出站看起来是合法的。
GTIG 说,和 5 月那一版(记录了首个确认的、犯罪分子用 AI 造出可用零日利用的案例)相比,真正变化的是人工介入还剩多少。报道没有点出攻击者用的是哪家的模型或产品。
来源:SiliconANGLE
05/09
Mistral 融资 30 亿欧元,三星领投
投后估值超过 210 亿欧元,钱主要花在自建算力上。
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,公司称这是欧洲科技公司迄今完成的最大一笔股权融资,距其成立三年。三星电子领投,EQT 管理的 Scaleup Europe Fund 与老股东 PSG Equity 联合领投。Mistral 说这笔钱用于扩大前沿研究、扩张训练模型所需的算力,以及推进商业化和国际化。公司目前业务覆盖 20 个国家,服务 125 家以上的全球企业,包括空客、ASML 和汇丰。CNBC 报道的口径约为 35 亿美元、估值约 240 亿美元。
RuntimeWire 指出,这套主权 AI 叙事能否成立,取决于企业收入是否跟得上自建基础设施的账单;另外「开放权重」这个标签并不适用于 Mistral 的每一个模型,各模型的许可条款并不一致。CEO Arthur Mensch 对 CNBC 说,Mistral 计划与三星在制造业方向做类似合作——ASML 曾领投 2025 年 9 月的 17 亿欧元 C 轮,之后把 Mistral 的技术接进制造流程。
来源:Mistral AI · RuntimeWire · Mistral 许可说明
06/09
Motional 开放 2 万个驾驶极端场景
nuReasoning 要模型讲清「为什么这么开更安全」,而不是照抄记录下来的轨迹。
Motional 发布 nuReasoning 数据集,收录 20,000 个场景、105 小时以上的疑难驾驶事件,配 247,000 条人工核验标注,覆盖空间关系、驾驶决策和反事实推理。它针对的是仅靠感知不够用的罕见路况:数据集要求模型解释自己的决策、说明一种操作为什么比另一种更安全,而不是简单模仿记录下来的车辆轨迹。素材来自 Motional 自己的车队日志——自动驾驶项目通常把这类边缘案例留在内部。
报道没有给出任何模型在该数据集上的基线成绩。9 月 8 日这次发布是此前数月公开研究的延续,配套论文已挂 arXiv。
来源:RuntimeWire · nuReasoning 论文
07/09
Meta 测试 Muse:能替你花钱的个人智能体
邀请码限量测试,连着邮件、日历、健康和金融账户,动手之前要你批准。
Meta 正在测试 Muse,一个独立的个人 AI 智能体应用,用来管日程、下单购买、跟踪支出,并在用户关掉应用后继续工作。Meta 自撰的 App Store 页面给出了最清楚的说明:这是一个 iPhone 智能体,可访问邮件、日历、健康信息、金融账户和 Meta 的社交应用。页面举的例子包括谈账单、卖车、规划并预订行程、审计订阅,以及在获得批准后购买商品。Muse 还能在后台运行、盯着没做完的活,在需要决策时通知用户。
一手信息来自 TestingCatalog 9 月 7 日的帖子和这份公开的 App Store 列表,Meta 没有发布正式公告;实际访问受限,采用等待名单和邀请码。RuntimeWire 认为,这套审批机制能不能让用户放心把钱交给它动,才是 Muse 的关键。
来源:RuntimeWire · TestingCatalog

九凤根据本期已引用来源整理。
区域与早期信号
08/09
Perplexity 本地智能体底座换成 Qwen3.8-27B
中文来源转述:PPLX 27B 系列基于 Qwen3.8-27B,针对 DGX Spark 做了优化。
据雷锋网 9 月 8 日报道(援引美国科技媒体 SiliconANGLE),Perplexity 新推出的本地 Agent 产品 Portable Computer 采用阿里开源的 Qwen3.8-27B;Perplexity 针对英伟达 DGX Spark 硬件优化了 PPLX 27B 系列,用于文件处理、数据分析和编程。报道称 Perplexity 最新估值超过 300 亿美元,此前其模型选择以 Claude、GPT 为主。同一篇还列了千问的其他采用方:Hugging Face 夏季报告称阿里千问已成为全球开源 AI 的基座模型,Airbnb 业务「大量依赖」千问,Pinterest 用 Qwen 搭购物助手和聊天机器人,路透社基于 Qwen 开发自有模型。
这是中文媒体对英文报道的转述,未见 Perplexity 官方公告。文中「本地 Opus4.6」是社区叫法,不是基准结论;上述几家采用方的调用规模、部署范围均未给出具体数字。
来源:雷锋网
09/09
深度智控拿到宁德时代、沙特阿美战投
两个月内第三轮融资,方向是给算力与能源基础设施做物理 AI 控制。
物理 AI 公司深度智控(DeepCtrls)完成 B+ 轮融资,金额为数亿元人民币,由宁德时代领投,Aramco Ventures、太平创新投资、广发信德、复星创富跟投,源码资本、光远资本等老股东追加。公司称过去两个月内已连续完成三轮融资。技术上,深度智控自 2018 年起做 AI 与物理机理融合,核心是 PhyAI 引擎,用于实时寻优控制;产品正从工业场景延伸到算力基础设施,包括液冷智控和算电协同。宁德时代同时也是它长期合作的集团客户。
这条中文报道采用厂商通稿口径,未披露具体金额、估值和营收。「全球最早实现物理 AI 闭环控制落地的企业之一」「服务全球数百家头部企业」都是公司自述,没有第三方验证。
来源:量子位
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

