概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · GPT-6 Astra 幻觉更少,隐蔽注入失败率仍有 8.5%
- 重点 · Replit 在发布次日就把 GPT-6 Astra 跑起来
- 重点 · Lyria 3.5 进入 Gemini,能出数分钟完整歌曲
全球 AI 资讯 4. Gemini Spark 接手 Google Photos 图库 5. DeepSeek 拟在内蒙部署 16 万颗昇腾推理芯片 6. Roland 推出 Melody Flip,只给动机不给成品 7. Copilot 代码评审进入 Azure Repos,按次计费
区域与早期信号 8. 华为给鸿蒙 AI 编码搭双引擎:DevEco Code 与 CLI 9. 元点机器人放出 OpenBridge,全球招 200 名开发者

九凤根据本期已引用来源整理。
热门模型动态
GPT-6 Astra 幻觉更少,隐蔽注入失败率仍有 8.5%
直接提示注入被拦下 99.99%,但攻击一旦藏进模型要读的文档里,仍有 8.5% 会得手。
按 OpenAI 的系统卡,GPT-6 Astra 的事实性错误比前代 GPT-5.6 Sol 更少,测试样本取自用户标记过答案有误的 ChatGPT 对话,属于易错场景。直接提示注入攻击的拦截率为 99.99%;对于藏在模型读取文档里的间接提示注入,失败率从上一代的 27% 降到 8.5%。这部分由安全公司 Gray Swan 用 IPI Arena 的 1810 条精选攻击做外部测试。
局限也写在同一份材料里:Astra 抗越狱能力更强,但在多轮对话中持续施压的攻击者,大约每三次仍能拿到一次有问题的回答;8.5% 的间接注入失败率虽是大幅回落,绝对值依然偏高,对真正需要安全保障的智能体部署还不够可靠。
来源:The Decoder · OpenAI 系统卡 · IPI Arena
Replit 在发布次日就把 GPT-6 Astra 跑起来
OpenAI 9 月 3 日放出 Astra,Replit 9 月 4 日上线,抢在多数平台前面。
Replit 联合创始人兼 CEO Amjad Masad 于 9 月 4 日在 X 上确认「Astra on Replit」,并附上一位 Replit 用户的演示。OpenAI 在 9 月 3 日发布 GPT-6 Astra,定位复杂计算机操作、编程、研究与专业工作流,称其为迄今能力最强、可广泛部署的模型,并表示 ChatGPT 与 API 的更大范围访问会在随后几天开放。Replit 在 8 月 26 日上线了 Intelligent Model Routing,按任务自动分配模型;其 CTO Luis Hector Chavez 在微软 Foundry 的发布文章里也用了类似说法描述 Astra 的价值。
局限在于访问面:OpenAI 目前仍把初期访问限制在部分选定组织。RuntimeWire 同时指出,随着智能体自主性提高,Replit 的模型路由与沙箱控制承担的责任也在变大。
来源:RuntimeWire · OpenAI · Microsoft Foundry
Lyria 3.5 进入 Gemini,能出数分钟完整歌曲
谷歌把音乐模型从内部工具推向 Gemini 应用与 API,并分成 30 秒片段和完整歌曲两档。
谷歌 9 月 5 日公告,在 Gemini 应用和 Gemini API 上线音乐生成模型 Lyria 3.5。文档列出两款:Lyria 3 Clip(模型 ID lyria-3-clip-preview)固定生成 30 秒的循环与预览片段;Lyria 3.5(模型 ID lyria-3.5)可生成包含数段副歌、桥段的数分钟完整歌曲。两者默认输出 MP3,Lyria 3.5 另支持 WAV。开发者可在文本提示之外附最多 10 张图像,模型依据视觉内容作曲;调用经 Google AI Studio、Vertex AI 与 Gemini API 开放,全部生成内容由 Interactions API 统一调度,并嵌入 SynthID 隐形水印,该水印可抵抗压缩、重采样等常见音频处理,用于版权追踪与内容溯源。
局限:官方文档暂未给出定价信息;本条目前只见中文媒体对谷歌公告的转述,未见英文一手页面的对应细节。
来源:IT之家
全球 AI 资讯
Gemini Spark 接手 Google Photos 图库
谷歌的个人智能体现在能编辑图片、策划相册,还能把海报照片变成日历日程。
谷歌宣布个人智能体 Gemini Spark 可以管理 Google Photos 图库:按指令编辑图片、整理与策划相册、自动用精选照片创建共享相册、把演唱会传单照片转成日历安排,以及运行更长的工作流。Google Photos 负责人 Shimrit Ben-Yair 在周四晚间的一条 X 帖子里公布了这批能力。
局限:功能在接下来几周内逐步推送,且只面向美国地区、英语环境下符合条件的 Gemini AI Pro 与 Ultra 订阅用户,其他地区与语言暂未列入。
来源:TechCrunch · Shimrit Ben-Yair 的 X 帖
DeepSeek 拟在内蒙部署 16 万颗昇腾推理芯片
据彭博社,这批华为 Ascend-950DT 只跑推理,训练仍留在英伟达硬件上。
The Decoder 援引彭博社报道,DeepSeek 计划在内蒙古一座大型数据中心部署至少 16 万颗华为下一代 Ascend-950DT 芯片,用途限定为推理,不做训练;更重的训练负载 DeepSeek 仍使用英伟达硬件。若建成,这将是目前已知规模最大的华为芯片集群。
局限相当具体:受产能限制与内存芯片短缺影响,华为可能一年多都交不齐这笔订单。国内最大存储厂商 CXMT 首次小批量产出 HBM3E,但仍落后三星、SK 海力士与美光 3 到 5 年,后三家已在量产 HBM4。整件事目前是媒体报道,不是官方公告。
来源:The Decoder
Roland 推出 Melody Flip,只给动机不给成品
乐器厂商的首款生成式 AI 音乐工具做成 DAW 插件,输出的是循环素材而非完整歌曲。
Melody Flip 以数字音频工作站(DAW)插件形式提供,内置约 250 个称为「Palettes」的主题音乐创意集合,按流派分类。用户可以从零生成旋律、和弦进行、贝斯线或鼓组的任意组合,也可以喂进一段参考音轨,让它在那首曲子的旋律想法上继续构建。
局限写在产品定位里:与 Suno、Udio 不同,Melody Flip 不输出带人声和完整编曲的成品歌曲,只给简单的音乐循环,设计意图是充当创作火花而非交付物。
来源:The Verge
Copilot 代码评审进入 Azure Repos,按次计费
微软把 GitHub Copilot 的代码评审开放给全部 Azure DevOps 客户,用一次算一次钱。
微软向所有 Azure DevOps 客户开放了面向 Azure Repos 的 GitHub Copilot code review,此前公司承认许多客户并没有准备好迁移到 GitHub。评审按使用次数计费,账单走与之关联的 Azure 订阅。
局限:用量与计费报表滞后两天,团队看不到实时消费,预算控制只能事后追。
来源:InfoQ

九凤根据本期已引用来源整理。
区域与早期信号
华为给鸿蒙 AI 编码搭双引擎:DevEco Code 与 CLI
ArkTS 公开语料少,华为用 Coding Agent、原子命令行和技能市场三层结构去补模型的短板。
据 InfoQ 中文的技术分享报道,HarmonyOS 的编程语言 ArkTS 面世时间尚短、公开可得代码语料有限,同一个模型在鸿蒙场景下的表现会打折。华为的应对是三层结构:DevEco Code 是开箱即用的鸿蒙 Coding Agent,覆盖项目创建、需求设计、代码生成、功能验证、集成测试到运营维护全流程,预置智谱系列大模型服务,同时支持自定义配置与对接第三方模型;DevEco CLI 把 IDE 的集成能力拆成创建工程、语法检查、编译构建、获取设备、推包运行、获取模拟器、知识检索、Skills 管理等命令行原子工具,供 AI 工作流串联调用;格物市场则聚合官方、社区与合作伙伴的 Skills、MCP 工具与知识库。DevEco Code 的 Harness 由三个递进的验证循环组成,第一层是轻量级语法校验,先过滤明显语法问题。
对比数据方面,来源称在相同模型条件下叠加这套 Harness 后,DevEco Code 的鸿蒙任务完成率高于 OpenCode,对比覆盖 GLM5.1、DeepSeek-V4-Pro、MiniMax-M2.7 三种模型组合,各组合均占优;崩溃问题的修复成功率在 80% 以上。
局限:这组对比只给出定性结论,没有公布逐项数值,也没有第三方复现。文中还提到华为设备形态多(直板、双折叠、三折叠),同一份业务代码要在不同形态上差异化适配,这部分复杂度并没有被消除;材料本身来自厂商技术分享的中文报道。
来源:InfoQ 中文
元点机器人放出 OpenBridge,全球招 200 名开发者
人形机器人厂商把硬件设计和指令控制一起开源,冲的是「换个本体算法就归零」这件事。
据雷锋网报道,乐享科技旗下的元点机器人联合 CMU 发表了两篇论文:BRIDGE 是开源硬件设计方案,FlowMimic 是开源指令控制方案。在这两条工具链之上,公司正式发布开发者全开源生态 OpenBridge,并在全球范围招募 200 位开发者、研究者与极客,入围者可免费体验支持二次开发、全链路适配 OpenBridge 开源系统的 Bridge 极客版硬件。
局限:报道给出的行业背景是各家本体形态、关节配置、传感接口、运动学标定都不一样,A 公司花几年训练出的抓取策略换到 B 公司硬件上价值归零;这套生态目前只有厂商与单一中文媒体的表述,还没有第三方复现或采用规模的数据。
来源:雷锋网
获取九凤最新的 AI 模型洞察与教程。
了解更多


