概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Gemini 3.8 Live 发布,边说话边在后台调工具
- 重点 · OpenRouter 上 OpenAI 的周度支出反超 Anthropic
- 重点 · Claude 企业侧两条动态:Salesforce 接入,英伟达收缩用量
- 开放模型追平前沿只差约四个月
全球 AI 资讯
- WhatsApp Business 的配置交给编码智能体
- Qwen3-8B 被调成商品打标专用模型
- IBM 给智能体加一致性准则,重复成功率涨 16 个百分点
区域与早期信号
- DeepSeek 任命 CFO,人选来自高瓴创投
- 香山股份 8 亿元跨界收购算力标的

九凤根据本期已引用来源整理。
热门模型动态
01/09
Gemini 3.8 Live 发布,边说话边在后台调工具
Google DeepMind 一次放出两个音频到音频模型,其中 Extended Thinking 版本会一边推理调工具、一边用语音填住等待时间。
9 月 15 日,Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,面向开发者的两个语音对话模型。
- Gemini 3.8 Live:主打低延迟对话和直接任务,官方称其在 Speech Agent Arena 排第二;上线 Gemini API、Gemini 应用、AI Studio、Google Cloud 与 Search Live;
- Gemini 3.8 Live Extended Thinking:更审慎的一档,面向诊断技术问题这类多步骤工作,推理与工具调用放到后台执行,过程中用语音更新覆盖等待,推理档位可按 low/medium/high 配置;上线 Gemini 应用、Gemini API、AI Studio、Google Cloud 与部分 Workspace(Gmail、Docs、Keep);
- 共同能力:音频到音频,可处理实时视觉上下文,可在对话中调用外部工具。
官方博客记在 Extended Thinking 名下的评测成绩:
| 基准 | Extended Thinking 成绩 |
|---|---|
| 语音到语音质量指数 | 82.6(Artificial Analysis 榜首) |
| τ-Voice | 68.6% |
| τ-Voice-banking | 35.1%(Sierra) |
| Big Bench Audio | 97.7% |
局限:官方没有公布延迟数字,定价只表述为「极具竞争力」,没有给出具体价格。接入上,Extended Thinking 必须使用非阻塞式工具声明,同步函数调用会直接报错,应用需要自行轮询 interaction_status;官方模型卡也提到它可能变慢或超时。
来源:Google DeepMind · RuntimeWire
02/09
OpenRouter 上 OpenAI 的周度支出反超 Anthropic
GPT-6 Astra 拿下最大支出份额,降价后的 GPT-5.6 Luna 拿下最大 token 量。
OpenRouter 洞察负责人 Peter Walker 在 X 上公布的数据显示,9 月 7 日至 13 日这一周,OpenAI 系模型在 OpenRouter 上的花费超过了 Anthropic 系模型。他说上一次出现这种情况是 2024 年 2 月 26 日。
| 模型 | 当周支出占比(两家模型合计,%) |
|---|---|
| GPT-6 Astra | 19 |
| Claude Opus 5 | 16 |
token 量这一侧由 GPT-5.6 Luna 大幅领先。Luna 在 7 月 9 日发布,7 月 30 日 OpenAI 把它的 API 价格下调 80%,官方文档目前标出的输出价格是每百万 token 1.20 美元。OpenAI 把 Luna 定位为 GPT-5.6 里面向成本敏感、高并发场景的那一档。
局限:这是 OpenRouter 单一平台、单周的口径,且只统计这两家公司的模型;报道自己也指出,还需要更长时间才能把发布期的尝鲜流量和长期生产流量分开。
来源:RuntimeWire · Peter Walker on X · OpenAI 价格说明 · 模型文档
03/09
Claude 企业侧两条动态:Salesforce 接入,英伟达收缩用量
Anthropic 一边把 37 个 Salesforce 技能装进 Claude 公测,一边因 30 天日志留存被英伟达限制在不敏感任务上。
Salesforce 进 Claude:9 月 15 日,Anthropic 上线 Salesforce in Claude 公测版,打包 37 个技能,覆盖客户调研、通话准备、商机复盘、预测和 CRM 更新。Claude 可以从 Salesforce、Slack、邮件和通话记录里收集上下文,再提出改动建议,例如调整成交日期、添加联系人、记录一次通话或创建跟进任务。权限沿用 Salesforce 既有设置,Salesforce 仍是记录系统,写回默认要销售人员逐条点头。
日志留存让大客户收缩用量:据 The Information 报道(The Decoder 转述),Anthropic 6 月改动政策,称为防御「复杂且新型的攻击」会保留 Fable 的使用日志 30 天。英伟达现在只把 Fable 用在开源项目这类不敏感任务上,内部的 AI 供应链监控等工作改跑自家的 Nemotron 模型;英伟达企业 AI 副总裁 Justin Boitano 表示,公司认为零数据留存(ZDR)应当默认开启。被点名缩小使用范围的还有 Palantir 和国防承包商博思艾伦(Booz Allen Hamilton):博思艾伦 CTO Bill Vass 担心 Fable「可能在学我们的代码」,Palantir CEO Alex Karp 则在一场客户活动上称,企业已经厌倦被 AI 实验室「剥削」。报道同时指出,两家实验室都会收集企业客户的元数据与技术使用数据,OpenAI 把这类数据称为已「去标识化」,即剥离了可追溯到具体客户的信息,并称分类结果只是关于业务数据的元数据、不含业务数据本身,其企业隐私页面对此有说明。
局限:Salesforce 一侧目前是 beta,公告没有给出可用地区、价格与支持的 Salesforce 版本,37 个技能之外还能做什么、批准环节能否关闭也未说明;日志留存一侧的细节来自 The Information 的报道与 The Decoder 的转述,报道没有给出受影响的合同规模或调用量数字。
来源:RuntimeWire · Claude 官方 X · The Decoder · OpenAI 企业隐私说明
04/09
开放模型追平前沿只差约四个月
Mozilla 的报告称,为前沿模型付费买到的是大约四个月的领先,代价是五倍成本。
Ars Technica 拿到 Mozilla 尚未公开发布的报告预览版。报告的核心结论是:付费使用前沿 AI 模型能换来大约四个月的能力领先,成本则是低价开放模型的五倍。报告本身讲的是这些便宜的开放模型如何在能力上追上硅谷的前沿模型。
局限:Ars 拿到的是预览版,Mozilla 报告原文尚未公开发布,四个月与五倍这两个数字目前只能以 Ars 的转述为准。
来源:Ars Technica
全球 AI 资讯
05/09
WhatsApp Business 的配置交给编码智能体
Meta 放出 WhatsApp Business MCP server,开发者可以用编码智能体对话式完成接入。
9 月 15 日,Meta 宣布开发者可以让自选的 AI 智能体来配置和管理 WhatsApp Business 消息服务,配套的是一个新的 WhatsApp Business MCP server,覆盖接入设置、消息模板、测试与排障,报道点名可用的智能体包括 Claude、Cursor、Codex 与 ChatGPT。Meta 说此前这套流程要在开发者控制台、Business Manager、API 文档和编辑器之间来回切换,现在可以直接把要做的事说给智能体。这项发布与 Meta 当天公布的 AI 订阅计划一同宣布。
局限:报道没有给出可用地区、收费方式和支持的 API 版本,也没有说明智能体做出的改动是否需要人工确认。
来源:TechCrunch
06/09
Qwen3-8B 被调成商品打标专用模型
AWS 给出无服务器定制配方:先监督微调、再上可验证奖励强化学习,让 8B 模型按固定 schema 稳定吐属性。
AWS 机器学习博客放出一篇官方实践:用 Amazon SageMaker 的无服务器模型定制,对 Qwen3-8B 先做监督微调(SFT),再用可验证奖励的强化学习(RLVR)优化。出发点是人工给成千上万个目录商品打标既慢又不一致,目标是让一个小模型按固定 schema 稳定输出商品属性,而不是每次靠提示工程去让通用前沿模型猜。RLVR 这一步用的是可程序化打分的确定性奖励;流程上,不指定计算配置时由 SageMaker 自行选择并释放定制任务所需的训练资源,官方示例笔记本放在 SageMaker Python SDK v3 的 serverless 模型定制目录下。
局限:这是 AWS 自家发布的操作指南,配方与 SageMaker 无服务器定制及其官方示例仓库绑定;可用地区与计费口径要另看文档。
来源:AWS 机器学习博客 · SageMaker Python SDK 示例
07/09
IBM 给智能体加一致性准则,重复成功率涨 16 个百分点
做对一次不算过关,关键是同一个请求下次还能不能做对。
IBM 研究院在 Hugging Face 上介绍了一类新的准则类型 consistency guidelines,已加进开源工具包 altk-evolve。出发点是大多数基准用平均分掩盖了波动:同一个请求,智能体这次成功、下次可能换一条路失败,对账、合同义务检查这类工作就不能用。团队报告的结果是同题重复的 Pass⁵ 提高 16.0 个百分点、近似任务提高 13.0 个百分点,且平均准确率没有损失。方法与完整评测写在 arXiv 的技术报告里,代码在 GitHub 开源。
局限:文章出自 IBM 研究院自己,数字是团队自评,尚无第三方复现;博客里也没说明换基座模型、换更长任务链之后效果差多少。
来源:Hugging Face 博客 · altk-evolve · 技术报告

九凤根据本期已引用来源整理。
区域与早期信号
08/09
DeepSeek 任命 CFO,人选来自高瓴创投
中文报道称,DeepSeek 新任 CFO 严文韬此前是高瓴创投合伙人,投过智谱与 MiniMax。
量子位报道,DeepSeek 新任 CFO 是严文韬,1991 年生,此前为高瓴创投合伙人,投资过智谱与 MiniMax。DeepSeek 早在 2025 年 2 月就在招聘渠道挂出过 CFO 岗位。量子位同时转述路透社消息称,DeepSeek 已聘请中信证券筹备科创板 IPO,最早今年年底递交申报材料,力争 2027 年挂牌。
局限:这是中文单一来源报道,上市部分还是转述,DeepSeek 没有公开确认任命细节与时间表;稿件中相当篇幅是人物背景梳理,与上市进程无关。这条属于资本动向,不代表模型或产品层面的变化。
来源:量子位
09/09
香山股份 8 亿元跨界收购算力标的
汽车零部件公司想补一条 AI 算力主业,标的两年前营收还只有 294 万元。
9 月 14 日晚,香山股份披露重组预案,拟以暂定 8 亿元收购浙江武珞智慧城市技术 100% 股权,对价 51% 付现金、49% 以 35 元/股发行股份支付。标的 2024 年才切入算力业务、长期以贸易经销为主,当年营收 294 万元且亏损;2025 年营收 3666 万元、净利 1907 万元;2026 年上半年营收 3.05 亿元、净利 2810 万元。2025 年 12 月宁波基地投产后,它从贸易商转为硬件集成厂商,此前曾是国产 GPU 厂商沐曦的第五大新增客户。业绩承诺跳过 2026 年,只约定 2027 至 2029 年累计扣非净利润不低于 4 亿元,折合年均约 1.33 亿元。9 月 15 日复牌当日股价跌停收 47.70 元,停牌前 20 个交易日则累计上涨 35.69%。
局限:这是钛媒体的单一中文来源报道,交易仍在预案阶段、尚未获批;标的业绩高度绑定沐曦的供货与芯片价格,下游智算中心的资本开支节奏也直接影响订单,钛媒体本身即点出三年 4 亿元承诺的兑现难度。
来源:钛媒体
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

