AI 热点资讯

GLM-5.3 上架 Amazon Bedrock,面向编码智能体

核心速览
  • •智谱 753B 参数 MoE 模型 GLM-5.3 上架 Amazon Bedrock,仅向符合条件的企业客户开放
  • •OpenAI 将在欧盟给 ChatGPT 与 Codex 文本加隐形水印
  • •Claude 5.5 两款模型进入 AWS GovCloud
  • •另有 JEPA 通用世界模型研究、HackerRank AI 面试官正式上线等。
jiufeng
2026年10月6日
15 分钟阅读
本文目录

概览

本期共 9 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · GLM-5.3 上架 Amazon Bedrock,面向编码与长周期智能体
  2. 重点 · OpenAI 将在欧盟给 ChatGPT 与 Codex 文本加隐形水印
  3. 重点 · Claude Opus 5.5 与 Sonnet 5.5 进入 AWS GovCloud

全球 AI 资讯

  1. JEPA-Anything:一个世界模型覆盖从物理到生物的 7 个领域
  2. SageMaker 推出 aws-ai-ml 技能,让编码智能体做推理调优
  3. HackerRank 的 AI 面试官 Chakra 正式上线,测试期做了 50 万场面试

区域与早期信号

  1. OpenAI 称 GPT-6 Astra 与 6.1 Sol 默认提速约 50%,用户实测未达标
  2. DeepSeek 新一轮融资据报至少 120 亿美元,宁德时代与腾讯领投
  3. Gemini「Call for Me」安装包线索:或可替用户给亲友打电话
2026-10-06 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

01/09

GLM-5.3 上架 Amazon Bedrock,面向编码与长周期智能体

智谱的 GLM-5.3 于 10 月 5 日在 Amazon Bedrock 上线,由 AWS 托管推理,但只向符合条件的企业客户开放。

据 AWS 的上线文章,GLM-5.3 已在 Amazon Bedrock 上线,以全托管 API 提供,用户不需要自建推理基础设施。Z.ai 于 10 月 6 日在 X 上发布了上线消息。

  • 规模:AWS 文章引用 Hugging Face 上发布的版本,称它是 753B 参数的混合专家(MoE)模型;Bedrock 模型文档写的是总参数 744B、每个 token 约激活 40B
  • 评测:AWS 文章列出了 Z.ai 公布的成绩,CyberGym 得分 84.5,在 Z.ai 内部编码基准上比 GLM 5.2 高 50%
  • 定位:针对编码和长周期智能体任务优化
  • 接口:兼容 OpenAI 的 API,支持 prompt caching、跨区域推理和服务分级
  • 示例场景:AWS 用开源工具 Strix 演示了针对自有应用的授权安全测试流程

局限:Bedrock 上的 GLM-5.3 只向符合条件的企业客户开放。RuntimeWire 指出,各份上线材料给出的参数量不一致;该模型在 Bedrock 上只能走跨区域推理路由。上述评测分数都是 Z.ai 自己公布的,内部编码基准没有公开。

zai-org/GLM-5.3 · Hugging Face

图片来源:huggingface;已转存至九凤 R2。

来源:AWS Machine Learning Blog · Bedrock 模型文档 · Z.ai on X · RuntimeWire · Hugging Face

02/09

OpenAI 将在欧盟给 ChatGPT 与 Codex 文本加隐形水印

为满足欧盟《AI 法案》的透明度要求,OpenAI 将在欧盟地区给 ChatGPT 和 Codex 生成的文本加入不可见的水印。

OpenAI 于 10 月 5 日发文说明了这项做法。据 TechCrunch,欧盟《AI 法案》的透明度规则已于 8 月 2 日生效,要求 AI 公司以其他系统可识别的方式标记 AI 生成内容。

局限:OpenAI 自己承认,编辑文本会让水印更难被检出。

来源:OpenAI · TechCrunch

03/09

Claude Opus 5.5 与 Sonnet 5.5 进入 AWS GovCloud

Claude Opus 5.5 和 Sonnet 5.5 已在 AWS GovCloud (US) 区域的 Amazon Bedrock 上提供,可配合 Claude Code 处理受 ITAR 等法规约束的工作负载。

AWS 介绍了如何在 GovCloud (US) 中通过 Bedrock 调用这两款模型,并接入 Claude Code 做 AI 辅助开发。下表是 AWS 文章列出的各模型在 Bedrock 上的认证情况:

模型FedRAMPDoD IL4/IL5
Claude Sonnet 5Class D(原 High)已授权
Claude Opus 5.5Class D未列出
Claude Sonnet 5.5Class D未列出

局限:AWS 注明这篇文章只供参考,方案不一定适用于所有组织和合规项目,读者需要自行核实模型当前的认证状态。

来源:AWS Machine Learning Blog · Claude Code IDE 集成文档

全球 AI 资讯

04/09

JEPA-Anything:一个世界模型覆盖从物理到生物的 7 个领域

PhAI Labs 牵头的团队把 Yann LeCun 提出的 JEPA 架构扩展成跨领域世界模型,并用它找到了一个肝癌治疗候选方案。

研究团队由 PhAI Labs 牵头,合作方包括 Stanford、Oxford 和 Princeton,模型名为 JEPA-Anything,覆盖机器人、生物医学等 7 个领域。过去每个领域通常需要单独训练一个世界模型,这项研究想证明一套共享原理就够用。方法上,它把未来状态拆成多个局部预测,而不是全部压进一个预测里,团队称这样能捕捉到标准模型漏掉的规律。模型找到的肝癌治疗候选方案,在实验室样本和小鼠中杀死的肿瘤细胞多于单独使用其中任一成分。

局限:这项工作目前是论文。肝癌方面的结果只来自实验室样本和小鼠实验,没有进入临床阶段。

来源:The Decoder · arXiv 论文

05/09

SageMaker 推出 aws-ai-ml 技能,让编码智能体做推理调优

AWS 通过 Agent Toolkit for AWS 发布 aws-ai-ml 技能,Kiro、Claude Code、Codex 等编码智能体装上后,可以做 SageMaker 推理部署的基准测试和配置推荐。

这项技能能接入任何支持 Model Context Protocol(MCP)的编码智能体。装好后,智能体可以测试推理端点的基准性能、推荐部署配置、对比多次性能测试,并生成可直接运行的 SageMaker Python SDK v3 代码。AWS 还提到,Kiro 和 Claude Code 的智能体可以在运行时通过 AWS MCP Server 搜索并加载技能。

局限:上述能力描述都来自 AWS 自己的博客,文章没有给出第三方测得的效果数据。

来源:AWS Machine Learning Blog · GitHub:agent-toolkit-for-aws

06/09

HackerRank 的 AI 面试官 Chakra 正式上线,测试期做了 50 万场面试

HackerRank 在 10 月 5 日向客户全面开放 AI 面试智能体 Chakra,此前已测试约 6 个月。

Chakra 会主持面试,在候选人做题时观察过程,评估时既看答案,也看候选人是怎么得出答案的。HackerRank 称,测试期间 Chakra 已完成超过 50 万场面试,Snowflake、Snorkel 和 Capgemini 等公司参与了试用,HackerRank 自己内部也用过。

局限:50 万场面试是公司自己的说法。报道没有披露评估准确率,也没有偏差方面的数据。

来源:TechCrunch

区域与早期信号

07/09

OpenAI 称 GPT-6 Astra 与 6.1 Sol 默认提速约 50%,用户实测未达标

Codex 负责人 Tibo 宣布未来 28 天每天要么交付一项改进、要么重置一次额度;首日官方称默认推理速度达到 50 TPS。

据量子位,无论是官方订阅,还是通过 Sign in with ChatGPT 接入的第三方工具(OpenCode、Pi、Amp、Devin 等),GPT-6 Astra 和 GPT-6.1 Sol 的默认推理速度都提高了约 50%,达到 50 TPS。此前用户普遍反映速度很慢。Tibo 公开道歉,解释是 GPT-6.1 Sol 前两天负载大幅增长,并宣布为付费账户重置额度。同一天,OpenAI 还宣布在 ChatGPT 生图过程中测试视觉广告。

局限:只有中文报道。量子位转述,用户 @stalkermustang 在 4 小时后测得的速度约为 35 TPS,低于 Tibo 所说的「2 小时内达到 50 TPS」。

来源:量子位

08/09

DeepSeek 新一轮融资据报至少 120 亿美元,宁德时代与腾讯领投

据 Bloomberg,DeepSeek 新一轮融资接近完成,金额至少 120 亿美元,可能接近 150 亿美元。

这轮融资原计划以约 750 亿美元估值募资约 75 亿美元,宁德时代(CATL)和腾讯出资份额最大。报道称投资者兴趣主要来自 V4-Flash 模型的成本与性能表现。融资完成后,DeepSeek 计划为 2027 年初上市进行重组,并在建设一座使用至少 16 万颗华为 AI 芯片的数据中心。创始人梁文锋希望继续开发开放权重模型。

局限:消息来自知情人士。CATL 拒绝置评,腾讯和 DeepSeek 没有回应。此前,梁文锋关于依赖英伟达芯片的言论传开后,这轮融资曾一度暂停。

来源:The Decoder

09/09

Gemini「Call for Me」安装包线索:或可替用户给亲友打电话

Android Authority 拆解 APK 时发现了「Gemini Calling」引导页,显示 Call for Me 可能从商家电话扩展到私人电话。

引导页里的示例包括「给妈妈打电话,告诉她我会晚 15 分钟」「打给 John 问他来不来吃晚饭」。Android Authority 还发现了一组细粒度权限设置。

局限:这只是安装包代码里的线索,Google 没有发布这项功能。The Verge 根据示例判断,即使功能上线,Gemini 大概也只能打类似短信的简单传话电话。

来源:The Verge

用 JIUFENG 自己生成一张

在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。

免费生成图片