概览
本期共 10 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Codex 新增 PR 看护,每 10 分钟自动修 CI 失败
- 重点 · GLM-5.3 被摘掉护栏,做成可调用的 API 服务
- 重点 · Anthropic 以 Apache-2.0 开源电商智能体蓝图
全球 AI 资讯 4. 菜单上的 AI 假食物,暴露扩散模型画不好细结构 5. 149 美元的 U 盘电脑,专门把智能体关在手机之外 6. 英伟达 IFA 端侧包:本地推理最高 1.9 倍,RTX Spark 十月上市 7. OpenAI 承诺 10 亿美元,向关键服务防守方开放网络安全 AI 8. AWS 放出两套 AgentCore 参考实现
区域与早期信号 9. 趋境接上摩尔线程 MTT S5000,PD 异构推理进生产 10. 月之暗面据报最快年内赴港 IPO,拟融资 30 亿至 50 亿美元

九凤根据本期已引用来源整理。
热门模型动态
Codex 新增 PR 看护,每 10 分钟自动修 CI 失败
OpenAI 生产版桌面应用里出现了一个 PR 自动看护开关,Codex 会每 10 分钟检查一次 PR 状态,修好 CI 失败与合并冲突再推回去。
RuntimeWire 在 OpenAI 桌面版 26.901.20858(build 7658)中发现名为「Watch and fix pull requests」的用户设置,同组还有「Auto-merge when ready」和可自定义的「Pull request watch instructions」。启用后会创建一个类型为 heartbeat、名为 Auto-fix PR #<编号> 的自动化任务,首次触发时给子任务的指令是「Begin automatically fixing PR #」,此后每 10 分钟继续检查该 PR 的实时状态,修复相关的 CI 失败与合并冲突并推送修复。心跳默认持续到任务完成或受阻,只有用户另行开启 Auto-merge when ready 授权后,才会一直持续到 GitHub 记录合并。OpenAI 此前已经上线了自动分析 PR 的 Codex 审查能力,并支持更新已有的 PR。
局限也很明确:这是 RuntimeWire 依据实测与文档做的原创报道,OpenAI 没有为该功能发布任何说明,功能虽然出现在生产版设置里,但官方并未宣布正式可用。
来源:RuntimeWire · OpenAI Codex 升级公告 · Codex 更新日志
GLM-5.3 被摘掉护栏,做成可调用的 API 服务
一家叫 Abliteration.ai 的初创公司把「去掉拒答能力」的开放权重模型做成生意,托管清单里包含 Z.ai 不久前发布的 GLM-5.3。
TechCrunch 报道,Abliteration.ai 托管了一批被移除安全护栏的开放权重模型,用户既可以在网页里直接提问,也可以通过 API 接入。平台名来自 abliteration ——一种消除模型拒绝有害请求倾向的技术。托管清单中被点到名的包括 GLM-5.3。
需要区分的是:「让防守方拿到和攻击者同样的工具,最终有利于网络安全」是 Abliteration.ai 自己给出的论证,不是独立结论。本条可引用的证据只有 TechCrunch 这一篇报道。
来源:TechCrunch
Anthropic 以 Apache-2.0 开源电商智能体蓝图
Anthropic 把做购物与商家智能体时每次都要重造的那套脚手架打包开源,覆盖零售、旅行、电信和娱乐四类场景。
MarkTechPost 报道,Anthropic 发布 Claude Commerce Agents,许可证为 Apache-2.0。放出来的内容包括智能体主循环、覆盖商品目录的工具层、人工审批关卡以及一套评测集——这几件正是各家团队搭购物助手时反复重写的部分。
局限在证据面:本条可引用的证据只有 MarkTechPost 这一篇报道,报道中没有出现评测分数,也没有点名已经接入的商家。
来源:MarkTechPost
全球 AI 资讯
菜单上的 AI 假食物,暴露扩散模型画不好细结构
The Verge 拆解餐饮业 AI 宣传图为什么让人倒胃口,技术根因指向扩散模型生成细长、连续、有端点结构的能力。
The Verge 汇总了餐馆、咖啡馆和品牌用 AI 生成的宣传图:像虾的甜甜圈、蠕虫状的面条、拉丝的鸡肉,还有分不清是冰淇淋还是建材的东西,共同特征是肿块、孔洞和裂缝。文中引述的技术解释是,扩散模型在生成细长、连续、有终点的结构上出了名的弱。
这是现象观察加技术解释,报道没有给出使用 AI 出图的商家规模统计,也没有点名具体的生成模型或版本。
来源:The Verge
149 美元的 U 盘电脑,专门把智能体关在手机之外
TrustKernel 的 PlugClaw 于 9 月 4 日开始全球发货,把智能体和凭据关进一支 USB-C 棒里,需要更大模型时再走云端。
据 RuntimeWire 报道(一手材料为 PR Newswire 通稿),PlugClaw 是塞进 USB-C 形态的一台完整 Android 加 Ubuntu 电脑,起售价 149 美元,不强制订阅,随机附带云端模型额度,也允许用户填自己的 API key。机身尺寸 50×19×8 毫米,处理器为联发科 Helio G80,内存最高 6GB。该产品 8 月 12 日首次公布,9 月 4 日的发货公告把它从预售推向现货,并附赠新部署服务器上的机密推理额度。公司由操作系统安全研究者 Li Wenhao 创立,团队出自上海交通大学。
厂商称数据对自己和云服务商都不可见,这是公司说法,报道没有提供第三方审计;产品页写 14.3 克、发货公告写成 15 克,两处数字并不一致。
来源:RuntimeWire
英伟达 IFA 端侧包:本地推理最高 1.9 倍,RTX Spark 十月上市
英伟达在 IFA 2026 公布本地 AI 更新,llama.cpp 与 vLLM 优化把本地推理最高提到 1.9 倍,紧凑型 RTX Spark Windows PC 十月由联想和宏碁推出。
官方博客列出的更新包括:新的 llama.cpp 和 vLLM 优化即刻可用,也已通过 LM Studio 和 Ollama 提供,本地推理最高快 1.9 倍;Hermes Agent、OpenClaw 与 Perplexity Portable Computer 将获得针对英伟达 GPU 的简化本地 AI 支持;紧凑型 NVIDIA RTX Spark Windows PC 十月上市,机型来自联想和宏碁。博客还提到开放权重多模态 MoE 模型 Qwen3.8-Flash-Next 可在 DGX Spark 与 DGX Station 上本地运行,以及 270 亿参数的 Qwen3.8-27B——后者的定位是面向英伟达 GPU 上的本地智能体与编码负载优化。
1.9 倍是官方给出的上限值,博客没有说明测试模型、精度和硬件配置,RTX Spark 的价格与具体规格也尚未公布;本条只有英伟达一方的官方口径。

图片来源:NVIDIA Blog;已转存至九凤 R2。
来源:NVIDIA 官方博客 · Qwen3.8-27B
OpenAI 承诺 10 亿美元,向关键服务防守方开放网络安全 AI
OpenAI 发布 Daybreak for Frontline Defenders,以 10 亿美元扩大关键服务机构获取前沿网络安全 AI、培训与支持的渠道。
公告把这笔 10 亿美元的承诺定位为面向「一线防守方」:向承担关键服务的机构开放前沿网络安全 AI 能力,并配套培训和支持。
覆盖对象限定在承担关键服务的机构,OpenAI 把它表述为一项 10 亿美元的「承诺」;本条可引用的信息就是公告页面对该承诺的这段框架表述。
来源:OpenAI
AWS 放出两套 AgentCore 参考实现
AWS 用两个可运行样例把「AI 驱动开发生命周期」落成代码:一个把 SQL schema 转成 Mermaid 实体关系图,一个做多智能体代码安全分析。
官方博客给出的两套参考实现都基于 Amazon Bedrock AgentCore。第一套跑在 AgentCore Runtime 上,从 SQL schema 生成 Mermaid 实体关系图;第二套用 AgentCore Gateway 与 AgentCore Memory 组多智能体架构,做自动化代码安全分析。智能体本身用开源的 Strands 框架构建并容器化运行,客户端凭据存放在 AWS Systems Manager Parameter Store。
这是参考实现与架构讲解,不是新产品发布,博客没有给出耗时、成本或准确率数据,示例也默认绑定 Kiro 与 AgentCore 这一套栈。
来源:AWS Machine Learning Blog · Strands SDK
区域与早期信号
趋境接上摩尔线程 MTT S5000,PD 异构推理进生产
趋境科技的国产 PD 异构技术与摩尔线程 MTT S5000 结合,双方称方案已投入生产、承接头部模型厂商的真实 Token 流量。
量子位报道,9 月 3 日双方签署战略合作协议:由 MTT S5000 承担 Prefill 阶段的输入计算与 KV Cache 生成,再由高带宽 GPU 负责 Decode 阶段的 Token 生成;MTT S5000 支持原生 FP8,配 MUSA 软件栈,Prefill 由此被解耦成可独立供给、独立计费的算力池。稿件给出的生产运行数据是:生成速度平均超过 50 TPS、KV Cache 命中率超过 90%、稳定性 99.9%;当前项目里 4 至 5 台 MTT S5000 组成的 Prefill 资源池,输入 Token 处理性价比超过国际先进算力方案。
「性价比超过国际先进算力方案」是合作双方的说法,稿件没有给出对比机型和单价,首 Token 时延只被提及、没有具体数值,承接流量的模型厂商也没有点名;本条来源为中文单一媒体报道(Chinese-language source)。
来源:量子位
月之暗面据报最快年内赴港 IPO,拟融资 30 亿至 50 亿美元
彭博社援引知情人士称,Kimi 背后的月之暗面考虑最早今年在港上市,融资 30 亿至 50 亿美元,方案仍在讨论中。
IT之家转述彭博社 9 月 4 日的报道:月之暗面已聘请美国银行担任整体协调人,中金公司、德意志银行和高盛共同参与交易;拟融资 30 亿至 50 亿美元,上市时间最早定在今年年内。公司近期完成 35 亿美元融资、估值达到 350 亿美元,并在以 500 亿美元投前估值接触新一轮投资者。7 月发布的开源模型 Kimi K3 是其获得全球关注的起点。
全部信息来自匿名知情人士,报道明确写明最终融资规模与上市时间都可能调整,月之暗面没有公开确认;这属于资本动向,与模型能力无关,来源为中文媒体转述(Chinese-language source)。
来源:IT之家
获取九凤最新的 AI 模型洞察与教程。
了解更多


