概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · GLM-5.3 上架 Amazon Bedrock,面向编码与长周期智能体
- 重点 · OpenAI 将在欧盟给 ChatGPT 与 Codex 文本加隐形水印
- 重点 · Claude Opus 5.5 与 Sonnet 5.5 进入 AWS GovCloud
全球 AI 资讯
- JEPA-Anything:一个世界模型覆盖从物理到生物的 7 个领域
- SageMaker 推出 aws-ai-ml 技能,让编码智能体做推理调优
- HackerRank 的 AI 面试官 Chakra 正式上线,测试期做了 50 万场面试
区域与早期信号
- OpenAI 称 GPT-6 Astra 与 6.1 Sol 默认提速约 50%,用户实测未达标
- DeepSeek 新一轮融资据报至少 120 亿美元,宁德时代与腾讯领投
- Gemini「Call for Me」安装包线索:或可替用户给亲友打电话

九凤根据本期已引用来源整理。
热门模型动态
01/09
GLM-5.3 上架 Amazon Bedrock,面向编码与长周期智能体
智谱的 GLM-5.3 于 10 月 5 日在 Amazon Bedrock 上线,由 AWS 托管推理,但只向符合条件的企业客户开放。
据 AWS 的上线文章,GLM-5.3 已在 Amazon Bedrock 上线,以全托管 API 提供,用户不需要自建推理基础设施。Z.ai 于 10 月 6 日在 X 上发布了上线消息。
- 规模:AWS 文章引用 Hugging Face 上发布的版本,称它是 753B 参数的混合专家(MoE)模型;Bedrock 模型文档写的是总参数 744B、每个 token 约激活 40B
- 评测:AWS 文章列出了 Z.ai 公布的成绩,CyberGym 得分 84.5,在 Z.ai 内部编码基准上比 GLM 5.2 高 50%
- 定位:针对编码和长周期智能体任务优化
- 接口:兼容 OpenAI 的 API,支持 prompt caching、跨区域推理和服务分级
- 示例场景:AWS 用开源工具 Strix 演示了针对自有应用的授权安全测试流程
局限:Bedrock 上的 GLM-5.3 只向符合条件的企业客户开放。RuntimeWire 指出,各份上线材料给出的参数量不一致;该模型在 Bedrock 上只能走跨区域推理路由。上述评测分数都是 Z.ai 自己公布的,内部编码基准没有公开。

图片来源:huggingface;已转存至九凤 R2。
来源:AWS Machine Learning Blog · Bedrock 模型文档 · Z.ai on X · RuntimeWire · Hugging Face
02/09
OpenAI 将在欧盟给 ChatGPT 与 Codex 文本加隐形水印
为满足欧盟《AI 法案》的透明度要求,OpenAI 将在欧盟地区给 ChatGPT 和 Codex 生成的文本加入不可见的水印。
OpenAI 于 10 月 5 日发文说明了这项做法。据 TechCrunch,欧盟《AI 法案》的透明度规则已于 8 月 2 日生效,要求 AI 公司以其他系统可识别的方式标记 AI 生成内容。
局限:OpenAI 自己承认,编辑文本会让水印更难被检出。
来源:OpenAI · TechCrunch
03/09
Claude Opus 5.5 与 Sonnet 5.5 进入 AWS GovCloud
Claude Opus 5.5 和 Sonnet 5.5 已在 AWS GovCloud (US) 区域的 Amazon Bedrock 上提供,可配合 Claude Code 处理受 ITAR 等法规约束的工作负载。
AWS 介绍了如何在 GovCloud (US) 中通过 Bedrock 调用这两款模型,并接入 Claude Code 做 AI 辅助开发。下表是 AWS 文章列出的各模型在 Bedrock 上的认证情况:
| 模型 | FedRAMP | DoD IL4/IL5 |
|---|---|---|
| Claude Sonnet 5 | Class D(原 High) | 已授权 |
| Claude Opus 5.5 | Class D | 未列出 |
| Claude Sonnet 5.5 | Class D | 未列出 |
局限:AWS 注明这篇文章只供参考,方案不一定适用于所有组织和合规项目,读者需要自行核实模型当前的认证状态。
来源:AWS Machine Learning Blog · Claude Code IDE 集成文档
全球 AI 资讯
04/09
JEPA-Anything:一个世界模型覆盖从物理到生物的 7 个领域
PhAI Labs 牵头的团队把 Yann LeCun 提出的 JEPA 架构扩展成跨领域世界模型,并用它找到了一个肝癌治疗候选方案。
研究团队由 PhAI Labs 牵头,合作方包括 Stanford、Oxford 和 Princeton,模型名为 JEPA-Anything,覆盖机器人、生物医学等 7 个领域。过去每个领域通常需要单独训练一个世界模型,这项研究想证明一套共享原理就够用。方法上,它把未来状态拆成多个局部预测,而不是全部压进一个预测里,团队称这样能捕捉到标准模型漏掉的规律。模型找到的肝癌治疗候选方案,在实验室样本和小鼠中杀死的肿瘤细胞多于单独使用其中任一成分。
局限:这项工作目前是论文。肝癌方面的结果只来自实验室样本和小鼠实验,没有进入临床阶段。
来源:The Decoder · arXiv 论文
05/09
SageMaker 推出 aws-ai-ml 技能,让编码智能体做推理调优
AWS 通过 Agent Toolkit for AWS 发布 aws-ai-ml 技能,Kiro、Claude Code、Codex 等编码智能体装上后,可以做 SageMaker 推理部署的基准测试和配置推荐。
这项技能能接入任何支持 Model Context Protocol(MCP)的编码智能体。装好后,智能体可以测试推理端点的基准性能、推荐部署配置、对比多次性能测试,并生成可直接运行的 SageMaker Python SDK v3 代码。AWS 还提到,Kiro 和 Claude Code 的智能体可以在运行时通过 AWS MCP Server 搜索并加载技能。
局限:上述能力描述都来自 AWS 自己的博客,文章没有给出第三方测得的效果数据。
来源:AWS Machine Learning Blog · GitHub:agent-toolkit-for-aws
06/09
HackerRank 的 AI 面试官 Chakra 正式上线,测试期做了 50 万场面试
HackerRank 在 10 月 5 日向客户全面开放 AI 面试智能体 Chakra,此前已测试约 6 个月。
Chakra 会主持面试,在候选人做题时观察过程,评估时既看答案,也看候选人是怎么得出答案的。HackerRank 称,测试期间 Chakra 已完成超过 50 万场面试,Snowflake、Snorkel 和 Capgemini 等公司参与了试用,HackerRank 自己内部也用过。
局限:50 万场面试是公司自己的说法。报道没有披露评估准确率,也没有偏差方面的数据。
来源:TechCrunch
区域与早期信号
07/09
OpenAI 称 GPT-6 Astra 与 6.1 Sol 默认提速约 50%,用户实测未达标
Codex 负责人 Tibo 宣布未来 28 天每天要么交付一项改进、要么重置一次额度;首日官方称默认推理速度达到 50 TPS。
据量子位,无论是官方订阅,还是通过 Sign in with ChatGPT 接入的第三方工具(OpenCode、Pi、Amp、Devin 等),GPT-6 Astra 和 GPT-6.1 Sol 的默认推理速度都提高了约 50%,达到 50 TPS。此前用户普遍反映速度很慢。Tibo 公开道歉,解释是 GPT-6.1 Sol 前两天负载大幅增长,并宣布为付费账户重置额度。同一天,OpenAI 还宣布在 ChatGPT 生图过程中测试视觉广告。
局限:只有中文报道。量子位转述,用户 @stalkermustang 在 4 小时后测得的速度约为 35 TPS,低于 Tibo 所说的「2 小时内达到 50 TPS」。
来源:量子位
08/09
DeepSeek 新一轮融资据报至少 120 亿美元,宁德时代与腾讯领投
据 Bloomberg,DeepSeek 新一轮融资接近完成,金额至少 120 亿美元,可能接近 150 亿美元。
这轮融资原计划以约 750 亿美元估值募资约 75 亿美元,宁德时代(CATL)和腾讯出资份额最大。报道称投资者兴趣主要来自 V4-Flash 模型的成本与性能表现。融资完成后,DeepSeek 计划为 2027 年初上市进行重组,并在建设一座使用至少 16 万颗华为 AI 芯片的数据中心。创始人梁文锋希望继续开发开放权重模型。
局限:消息来自知情人士。CATL 拒绝置评,腾讯和 DeepSeek 没有回应。此前,梁文锋关于依赖英伟达芯片的言论传开后,这轮融资曾一度暂停。
来源:The Decoder
09/09
Gemini「Call for Me」安装包线索:或可替用户给亲友打电话
Android Authority 拆解 APK 时发现了「Gemini Calling」引导页,显示 Call for Me 可能从商家电话扩展到私人电话。
引导页里的示例包括「给妈妈打电话,告诉她我会晚 15 分钟」「打给 John 问他来不来吃晚饭」。Android Authority 还发现了一组细粒度权限设置。
局限:这只是安装包代码里的线索,Google 没有发布这项功能。The Verge 根据示例判断,即使功能上线,Gemini 大概也只能打类似短信的简单传话电话。
来源:The Verge
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

