本文目录
AI 热点资讯

Codex 新增 PR 看护,每 10 分钟自动修 CI 失败

核心速览
  • OpenAI 桌面版藏着「Watch and fix」开关,Codex 每 10 分钟检查一次 PR、修 CI 失败与冲突并推送
  • GLM-5.3 被摘掉护栏做成 API 生意,Anthropic 以 Apache-2.0 开源电商智能体蓝图,另有英伟达 IFA 端侧提速、149 美元智能体 U 盘电脑与国产 PD 异构推理进生产。
jiufeng
2026年9月4日
16 分钟阅读
Codex 新增 PR 看护,每 10 分钟自动修 CI 失败

概览

本期共 10 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · Codex 新增 PR 看护,每 10 分钟自动修 CI 失败
  2. 重点 · GLM-5.3 被摘掉护栏,做成可调用的 API 服务
  3. 重点 · Anthropic 以 Apache-2.0 开源电商智能体蓝图

全球 AI 资讯 4. 菜单上的 AI 假食物,暴露扩散模型画不好细结构 5. 149 美元的 U 盘电脑,专门把智能体关在手机之外 6. 英伟达 IFA 端侧包:本地推理最高 1.9 倍,RTX Spark 十月上市 7. OpenAI 承诺 10 亿美元,向关键服务防守方开放网络安全 AI 8. AWS 放出两套 AgentCore 参考实现

区域与早期信号 9. 趋境接上摩尔线程 MTT S5000,PD 异构推理进生产 10. 月之暗面据报最快年内赴港 IPO,拟融资 30 亿至 50 亿美元

2026-09-04 AI 热点信号地图
2026-09-04 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

Codex 新增 PR 看护,每 10 分钟自动修 CI 失败

OpenAI 生产版桌面应用里出现了一个 PR 自动看护开关,Codex 会每 10 分钟检查一次 PR 状态,修好 CI 失败与合并冲突再推回去。

RuntimeWire 在 OpenAI 桌面版 26.901.20858(build 7658)中发现名为「Watch and fix pull requests」的用户设置,同组还有「Auto-merge when ready」和可自定义的「Pull request watch instructions」。启用后会创建一个类型为 heartbeat、名为 Auto-fix PR #<编号> 的自动化任务,首次触发时给子任务的指令是「Begin automatically fixing PR #」,此后每 10 分钟继续检查该 PR 的实时状态,修复相关的 CI 失败与合并冲突并推送修复。心跳默认持续到任务完成或受阻,只有用户另行开启 Auto-merge when ready 授权后,才会一直持续到 GitHub 记录合并。OpenAI 此前已经上线了自动分析 PR 的 Codex 审查能力,并支持更新已有的 PR。

局限也很明确:这是 RuntimeWire 依据实测与文档做的原创报道,OpenAI 没有为该功能发布任何说明,功能虽然出现在生产版设置里,但官方并未宣布正式可用。

来源:RuntimeWire · OpenAI Codex 升级公告 · Codex 更新日志

GLM-5.3 被摘掉护栏,做成可调用的 API 服务

一家叫 Abliteration.ai 的初创公司把「去掉拒答能力」的开放权重模型做成生意,托管清单里包含 Z.ai 不久前发布的 GLM-5.3。

TechCrunch 报道,Abliteration.ai 托管了一批被移除安全护栏的开放权重模型,用户既可以在网页里直接提问,也可以通过 API 接入。平台名来自 abliteration ——一种消除模型拒绝有害请求倾向的技术。托管清单中被点到名的包括 GLM-5.3。

需要区分的是:「让防守方拿到和攻击者同样的工具,最终有利于网络安全」是 Abliteration.ai 自己给出的论证,不是独立结论。本条可引用的证据只有 TechCrunch 这一篇报道。

来源:TechCrunch

Anthropic 以 Apache-2.0 开源电商智能体蓝图

Anthropic 把做购物与商家智能体时每次都要重造的那套脚手架打包开源,覆盖零售、旅行、电信和娱乐四类场景。

MarkTechPost 报道,Anthropic 发布 Claude Commerce Agents,许可证为 Apache-2.0。放出来的内容包括智能体主循环、覆盖商品目录的工具层、人工审批关卡以及一套评测集——这几件正是各家团队搭购物助手时反复重写的部分。

局限在证据面:本条可引用的证据只有 MarkTechPost 这一篇报道,报道中没有出现评测分数,也没有点名已经接入的商家。

来源:MarkTechPost

全球 AI 资讯

菜单上的 AI 假食物,暴露扩散模型画不好细结构

The Verge 拆解餐饮业 AI 宣传图为什么让人倒胃口,技术根因指向扩散模型生成细长、连续、有端点结构的能力。

The Verge 汇总了餐馆、咖啡馆和品牌用 AI 生成的宣传图:像虾的甜甜圈、蠕虫状的面条、拉丝的鸡肉,还有分不清是冰淇淋还是建材的东西,共同特征是肿块、孔洞和裂缝。文中引述的技术解释是,扩散模型在生成细长、连续、有终点的结构上出了名的弱。

这是现象观察加技术解释,报道没有给出使用 AI 出图的商家规模统计,也没有点名具体的生成模型或版本。

来源:The Verge

149 美元的 U 盘电脑,专门把智能体关在手机之外

TrustKernel 的 PlugClaw 于 9 月 4 日开始全球发货,把智能体和凭据关进一支 USB-C 棒里,需要更大模型时再走云端。

据 RuntimeWire 报道(一手材料为 PR Newswire 通稿),PlugClaw 是塞进 USB-C 形态的一台完整 Android 加 Ubuntu 电脑,起售价 149 美元,不强制订阅,随机附带云端模型额度,也允许用户填自己的 API key。机身尺寸 50×19×8 毫米,处理器为联发科 Helio G80,内存最高 6GB。该产品 8 月 12 日首次公布,9 月 4 日的发货公告把它从预售推向现货,并附赠新部署服务器上的机密推理额度。公司由操作系统安全研究者 Li Wenhao 创立,团队出自上海交通大学。

厂商称数据对自己和云服务商都不可见,这是公司说法,报道没有提供第三方审计;产品页写 14.3 克、发货公告写成 15 克,两处数字并不一致。

来源:RuntimeWire

英伟达 IFA 端侧包:本地推理最高 1.9 倍,RTX Spark 十月上市

英伟达在 IFA 2026 公布本地 AI 更新,llama.cpp 与 vLLM 优化把本地推理最高提到 1.9 倍,紧凑型 RTX Spark Windows PC 十月由联想和宏碁推出。

官方博客列出的更新包括:新的 llama.cpp 和 vLLM 优化即刻可用,也已通过 LM Studio 和 Ollama 提供,本地推理最高快 1.9 倍;Hermes Agent、OpenClaw 与 Perplexity Portable Computer 将获得针对英伟达 GPU 的简化本地 AI 支持;紧凑型 NVIDIA RTX Spark Windows PC 十月上市,机型来自联想和宏碁。博客还提到开放权重多模态 MoE 模型 Qwen3.8-Flash-Next 可在 DGX Spark 与 DGX Station 上本地运行,以及 270 亿参数的 Qwen3.8-27B——后者的定位是面向英伟达 GPU 上的本地智能体与编码负载优化。

1.9 倍是官方给出的上限值,博客没有说明测试模型、精度和硬件配置,RTX Spark 的价格与具体规格也尚未公布;本条只有英伟达一方的官方口径。

NVIDIA GTC Berlin Registration Is Now Open
NVIDIA GTC Berlin Registration Is Now Open

图片来源:NVIDIA Blog;已转存至九凤 R2。

来源:NVIDIA 官方博客 · Qwen3.8-27B

OpenAI 承诺 10 亿美元,向关键服务防守方开放网络安全 AI

OpenAI 发布 Daybreak for Frontline Defenders,以 10 亿美元扩大关键服务机构获取前沿网络安全 AI、培训与支持的渠道。

公告把这笔 10 亿美元的承诺定位为面向「一线防守方」:向承担关键服务的机构开放前沿网络安全 AI 能力,并配套培训和支持。

覆盖对象限定在承担关键服务的机构,OpenAI 把它表述为一项 10 亿美元的「承诺」;本条可引用的信息就是公告页面对该承诺的这段框架表述。

来源:OpenAI

AWS 放出两套 AgentCore 参考实现

AWS 用两个可运行样例把「AI 驱动开发生命周期」落成代码:一个把 SQL schema 转成 Mermaid 实体关系图,一个做多智能体代码安全分析。

官方博客给出的两套参考实现都基于 Amazon Bedrock AgentCore。第一套跑在 AgentCore Runtime 上,从 SQL schema 生成 Mermaid 实体关系图;第二套用 AgentCore Gateway 与 AgentCore Memory 组多智能体架构,做自动化代码安全分析。智能体本身用开源的 Strands 框架构建并容器化运行,客户端凭据存放在 AWS Systems Manager Parameter Store。

这是参考实现与架构讲解,不是新产品发布,博客没有给出耗时、成本或准确率数据,示例也默认绑定 Kiro 与 AgentCore 这一套栈。

来源:AWS Machine Learning Blog · Strands SDK

区域与早期信号

趋境接上摩尔线程 MTT S5000,PD 异构推理进生产

趋境科技的国产 PD 异构技术与摩尔线程 MTT S5000 结合,双方称方案已投入生产、承接头部模型厂商的真实 Token 流量。

量子位报道,9 月 3 日双方签署战略合作协议:由 MTT S5000 承担 Prefill 阶段的输入计算与 KV Cache 生成,再由高带宽 GPU 负责 Decode 阶段的 Token 生成;MTT S5000 支持原生 FP8,配 MUSA 软件栈,Prefill 由此被解耦成可独立供给、独立计费的算力池。稿件给出的生产运行数据是:生成速度平均超过 50 TPS、KV Cache 命中率超过 90%、稳定性 99.9%;当前项目里 4 至 5 台 MTT S5000 组成的 Prefill 资源池,输入 Token 处理性价比超过国际先进算力方案。

「性价比超过国际先进算力方案」是合作双方的说法,稿件没有给出对比机型和单价,首 Token 时延只被提及、没有具体数值,承接流量的模型厂商也没有点名;本条来源为中文单一媒体报道(Chinese-language source)。

来源:量子位

月之暗面据报最快年内赴港 IPO,拟融资 30 亿至 50 亿美元

彭博社援引知情人士称,Kimi 背后的月之暗面考虑最早今年在港上市,融资 30 亿至 50 亿美元,方案仍在讨论中。

IT之家转述彭博社 9 月 4 日的报道:月之暗面已聘请美国银行担任整体协调人,中金公司、德意志银行和高盛共同参与交易;拟融资 30 亿至 50 亿美元,上市时间最早定在今年年内。公司近期完成 35 亿美元融资、估值达到 350 亿美元,并在以 500 亿美元投前估值接触新一轮投资者。7 月发布的开源模型 Kimi K3 是其获得全球关注的起点。

全部信息来自匿名知情人士,报道明确写明最终融资规模与上市时间都可能调整,月之暗面没有公开确认;这属于资本动向,与模型能力无关,来源为中文媒体转述(Chinese-language source)。

来源:IT之家