AI 热点资讯

OpenAI 暂停 Pro 新订阅,Astra 需求挤占算力

核心速览
  • •GPT-6 Astra 需求挤占算力,OpenAI 暂停 200 美元 Pro 新订阅
  • •Anthropic 称 Moonshot 把近 30 万次 Kimi 请求转给 Claude
  • •另有 MiniMax H3 多卡提速约 12 倍、寒武纪适配 DeepSeek-V4.1-Flash 与豆包工作更新。
jiufeng
2026年9月11日
19 分钟阅读
本文目录

概览

本期共 10 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · OpenAI 暂停 200 美元 Pro 新订阅,GPT-6 Astra 需求挤占算力
  2. 重点 · Anthropic 称月之暗面把近 30 万次 Kimi 请求转给 Claude
  3. 重点 · RunningHub 开源 MiniMax H3 多卡加速方案,5 秒视频提速约 12 倍
  4. 寒武纪 Day-0 适配 DeepSeek-V4.1-Flash,跑在 vLLM 上

全球 AI 资讯

  1. Sakana AI 发布 Fugu Max 与 Fugu Ultra v2,用学习型编排调度多模型
  2. SageMaker HyperPod 推理支持模型缓存,冷启动改从本地 NVMe 读权重
  3. Amazon Quick 桌面版正式可用,覆盖 macOS 与 Windows

区域与早期信号

  1. 研究者称拿到 6TB 中国大模型中转服务日志,含企业凭据
  2. 豆包工作上线本地 Office 编辑与浏览器录制回放
  3. Kimi K3 带动月之暗面年化收入破 10 亿美元,年底瞄准 20 亿
2026-09-11 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

01/10

OpenAI 暂停 200 美元 Pro 新订阅,GPT-6 Astra 需求挤占算力

GPT-6 Astra 发布一周后,OpenAI 停收每月 200 美元 ChatGPT Pro 的新订阅,已有订阅者和 API 不受影响。

负责 Codex 的 OpenAI 高管 Thibault Sottiaux 9 月 10 日在 X 上宣布暂停接受 ChatGPT Pro 新订阅,理由是这一档订阅「对我们系统造成的压力最大」。

现有 Pro 订阅者保留账户和 Astra 使用权,OpenAI 的其他订阅档与 API 继续开放。Sottiaux 称,暂停 200 美元这一档是在 OpenAI 扩容期间维持广泛可用的最小干预。前一天(9 月 9 日)他已预警可能停收新 Pro 用户,称 Astra 的需求前所未有,并表示会优先保障现有客户。

  • 时间线:GPT-6 Astra 于 9 月 3 日发布,第 7 天起暂停 Pro 新订阅
  • 上线范围:发布后推向 ChatGPT Plus、Pro、Business、Enterprise,以及 API、Microsoft Azure 与 AWS Bedrock
  • API 标准价:每百万输入 token 10 美元、输出 token 50 美元;输入超过 272,000 token 的提示费率更高

局限:这次只停收新用户,想新开 Pro 的用户眼下只能改用其他订阅档或按量计费的 API;TechCrunch 称这是 OpenAI 扩容期间的临时暂停。RuntimeWire 评论称,此举暴露了重算力智能体与固定价格订阅之间的张力。

来源:RuntimeWire · TechCrunch · Sottiaux on X · OpenAI:GPT-6 Astra · GPT-6 Astra API 文档

02/10

Anthropic 称月之暗面把近 30 万次 Kimi 请求转给 Claude

据彭博社报道,Anthropic 指控 Moonshot 在未告知用户的情况下,经 5,380 个欺诈账号把 Kimi 用户请求交给 Claude 处理。

RuntimeWire 援引彭博社 9 月 10 日的报道称,Anthropic 指控杨植麟的 Moonshot AI 把 Kimi 用户请求转给 Anthropic 的 Claude 模型处理,且没有告知这些用户。Anthropic 识别出的其中一组请求:

  • 请求量:近 300,000 次
  • 目标模型:主要发往一个 Opus 模型
  • 账号:经由 5,380 个欺诈账号发出,多数看起来在新加坡和日本运营

RuntimeWire 指出,Moonshot 把 Kimi 定位为由自家模型家族驱动的助手与智能体平台;如果 Kimi 把普通用户的提问交给 Claude、再把答案当作 Kimi 的输出展示,争议就不止于训练方式,而是直接关系到用户数据由哪个模型处理、产品输出由谁生成。Moonshot 正在争取美国云厂商、开发者和投资者把 Kimi 当作独立模型平台来信任;Together AI 7 月宣布与 Moonshot AI 建立战略合作,原生托管 Kimi 模型。

局限:这是 Anthropic 的指控,经彭博社报道、RuntimeWire 转述,请求记录与账号归属尚待独立核实。

来源:RuntimeWire · Together AI

03/10

RunningHub 开源 MiniMax H3 多卡加速方案,5 秒视频提速约 12 倍

量子位报道,RunningHub 的 H3 Lightning 在 4 张 RTX 6000D 上把 5 秒视频的生成从 348.8 秒压到 28.7 秒,同时保留 BF16 精度。

MiniMax 开源 H3 视频模型后,一站式 AIGC 创作平台 RunningHub 做了一套名为 H3 Lightning 的推理加速方案,并在 GitHub 开源(仓库 RH-RunningHub/MiniMax-H3-MultiGPU-Lightning)。量子位给出的测试口径:

方案视频规格GPU耗时(秒)
原始 BF16,50 步5 秒,1344×7684×RTX 6000D348.8
H3 Lightning5 秒,1344×7684×RTX 6000D28.7
Lightning,纯文字15 秒,768×13448×RTX 6000D约 48
Lightning,双参考图15 秒,768×13448×RTX 6000D约 73

前两行对应约 12 倍提速、生成耗时减少约 92%。量子位的拆解把省下的时间归到三处:减少多余计算、加快单步计算、减少多卡之间的相互等待;原始 H3 推理默认跑 50 步。

局限:数字来自 RunningHub 的方案、经量子位报道,本站未见第三方复现;量子位在文中指出,狗在快速跳跃时四肢动作偶尔发「硬」。该条目目前只有中文单一来源。

来源:量子位

04/10

寒武纪 Day-0 适配 DeepSeek-V4.1-Flash,跑在 vLLM 上

寒武纪在 DeepSeek-V4.1-Flash 发布当天完成了 vLLM 上的适配,寒武纪芯片与新模型同日可用。

Pandaily 报道,寒武纪完成了 DeepSeek-V4.1-Flash 在 vLLM 上的同日(Day-0)适配,算子层结合 Torch-MLU-Ops 与 BangC kernel,并搭配 NeuWare。报道的重点是芯片侧与模型发布同步可用,而不是再复述一遍模型发布。

被适配的 V4.1-Flash 是 552B 参数的 MoE 模型,接近 V4-Flash 284B 的两倍;SiliconANGLE 报道,新的因果编码器-解码器设计让它处理提示时只激活 8B 参数、生成时激活 16B,图像理解已内置到模型中。

局限:Day-0 适配说明模型能在这套软硬件栈上跑起来,本站未见寒武纪芯片上的吞吐、延迟等公开测试数据;本站目前只见到 Pandaily 一家报道这次适配。

来源:Pandaily · SiliconANGLE

全球 AI 资讯

05/10

Sakana AI 发布 Fugu Max 与 Fugu Ultra v2,用学习型编排调度多模型

两款模型共用同一套学习型编排架构,主打性价比的 Fugu Max 定价为每百万 token 2 美元 / 6 美元。

MarkTechPost 报道,Sakana AI 发布了 Fugu Max 与 Fugu Ultra v2 两款模型,二者建立在同一套学习型编排架构上。OpenRouter 的模型页称,Fugu 不是单一的整体模型,而是学习型多智能体编排系统。

  • Fugu Max:把任务分派给轻量的开放模型和专用模型,其中包括 NVIDIA Nemotron;每百万 token 2 美元 / 6 美元
  • Fugu Ultra v2:瞄准最高能力;OpenRouter 标注上下文长度 100 万 token

局限:Fugu 本身不是单一模型,任务会被分派给底层模型执行;目前的定价与能力说法来自 Sakana 的发布信息和 OpenRouter 上架页,本站未见独立评测。

来源:MarkTechPost · OpenRouter:Fugu Ultra v2

06/10

SageMaker HyperPod 推理支持模型缓存,冷启动改从本地 NVMe 读权重

AWS 让 HyperPod 集群提前把模型权重和容器镜像缓存到节点本地,pod 启动时以约 7 GB/s 读取,不再现场下载。

AWS 在官方博客中写道,在 SageMaker HyperPod 上部署大模型推理时,从申请 pod 到能接流量之间的等待主要来自两段串行下载:从 Amazon ECR 拉推理服务器容器镜像,以及从 Amazon S3、Amazon FSx for Lustre 或 Hugging Face Hub 拉模型权重。小模型可能要几分钟;像 DeepSeek-R1 这种 600 GB 以上的模型,要 30 分钟或更久才能服务第一个请求,而且每次扩容都要重走一遍下载,自动扩缩容的响应速度因此被存储后端的网络吞吐卡住。

新上线的模型缓存会在 pod 需要之前,把模型权重和容器镜像预加载到集群节点上;pod 启动后从本地 NVMe 以约 7 GB/s 读取,而不是通过网络下载。

局限:这是 AWS 官方的产品说明,缩短冷启动的效果来自 AWS 自己的描述,本站未见第三方测试;功能只面向 HyperPod 上的 SageMaker 推理部署。

来源:AWS Machine Learning Blog

07/10

Amazon Quick 桌面版正式可用,覆盖 macOS 与 Windows

亚马逊的企业 AI 助手 Quick 推出 macOS 与 Windows 桌面正式版,移动端新增把邮件、日历、CRM 和消息汇成一处的动态流。

AWS 官方博客宣布,Amazon Quick 桌面应用在 macOS 和 Windows 上正式可用(GA)。iOS 与 Android 移动端同时新增 activity feed,把邮件、日历、CRM 和消息汇总成一个按优先级排序的视图:需要团队决策的事项被推到前面,例行事务由智能体在后台处理。

AWS 把 Quick 定位为跑在 AWS 上的企业级 AI 助手,强调数据留在企业自有环境、对话保持私密,并把它当作 IT 部门应对影子 AI 风险的办法:不去限制员工用 AI,而是在 IT 已掌控的基础设施上给团队提供一个工作用的助手。

局限:这是 AWS 官方的产品公告,隐私与数据留在企业环境等说法来自厂商自述,本站未见第三方评测。

来源:AWS Machine Learning Blog

2026-09-11 AI 热点重点信号

九凤根据本期已引用来源整理。

区域与早期信号

08/10

研究者称拿到 6TB 中国大模型中转服务日志,含企业凭据

安全研究员 Chaofan Shou 称,他从某中国大模型中转服务拿到约 6TB 调用日志,里面有与企业相关的 SSH 密钥、云凭据和 token。

Pandaily 报道,安全研究员 Chaofan Shou 表示,他获得了一家中国大模型中转(relay)服务约 6TB 的调用日志,并在其中发现与企业相关的 SSH 密钥、云服务凭据和各类 token。Pandaily 将其作为一项供应链风险声明来报道,并注明仍待确认。

局限:这仍是研究者单方面的说法,涉及哪家中转服务、波及多少企业,本站未见独立核实,在确认之前不宜当作已证实的泄露事件。该条目目前只有 Pandaily 一个来源。

来源:Pandaily

09/10

豆包工作上线本地 Office 编辑与浏览器录制回放

豆包工作新增三项能力:直接编辑本地 PPT/Excel、把一次网页操作录成可复用的 Skill、任务中途切换本地与云电脑。

雷锋网报道,三项新功能分别是:

  • 本地 Office 编辑:已全量上线,可从侧边工作台选文件,或右键本地 PPT、Excel 文件直接调用豆包处理;AI 生成或修改后的文件仍可在本地继续编辑,保存结果同步到线上和本地
  • 浏览器录制与回放:安装最新版豆包电脑版后,在豆包浏览器里演示一次操作,豆包会学习点击、填写、上传等步骤,整理成可复用的 Skill,并记录调用条件、所需输入和结果验证方式
  • 执行环境切换:不用新建或中断对话,就能在「本地电脑」与「云电脑」之间切换,避免上下文丢失;还可在一台已登录电脑上向其他已登录设备发指令,调用对方的文件与算力

局限:本地编辑目前只支持 PPT 和 Excel,Word 能力要后续上线;录制回放暂时只覆盖豆包浏览器内的操作。功能说明来自雷锋网报道,本站未见实测。该条目目前只有中文单一来源。

来源:雷锋网

10/10

Kimi K3 带动月之暗面年化收入破 10 亿美元,年底瞄准 20 亿

据彭博社报道,月之暗面 8 月年度经常性收入突破 10 亿美元,推动力是 7 月发布的 Kimi K3。

IT之家援引彭博社报道,知情人士称月之暗面最近告诉投资者,公司 8 月年度经常性收入(ARR)已突破 10 亿美元,并计划在年底前提高到 20 亿美元:

时点年度经常性收入(亿美元)
2026 年 6 月3
2026 年 8 月超过 10
2026 年底目标20

报道称,推动 ARR 快速上升的是 7 月发布的 Kimi K3,它发布后跃居多项基准测试前列,成本远低于美国顶尖竞品。知情人士称,随着消费者和企业对 Kimi 订阅服务和月之暗面在线托管模型的兴趣持续上升,公司预计销售速度还会再翻一倍。按 Kimi K3 许可协议,商业托管 K3 的企业若在 12 个月内累计收入超过 2,000 万美元,须另行与月之暗面签署协议。路透社上月报道,月之暗面正与微软、亚马逊和谷歌洽谈 30% 的收入分成。

局限:收入数字来自知情人士的转述,并非公司正式披露。该条目目前只有中文单一来源(IT之家转述彭博社)。

来源:IT之家

用 JIUFENG 自己生成一张

在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。

免费生成图片