概览
本期共 10 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · OSS Scanner 用 Mythos 免费扫开源项目漏洞
- 重点 · Claude Science 协助补全紫外天图,Anthropic 同日承诺 1.5 亿美元科研投入
- 重点 · Goodfire 在 Kimi K3 与 GLM-4.5-Air 内部装探针监控智能体
全球 AI 资讯
- Google Cloud 发布 Gemini agent,可跨 Workspace、Microsoft 365 与 Slack 工作
- 一条提示词劫持整个区域:Zenity 披露 Bedrock AgentCore 漏洞链
- AgentCore payments 让智能体按次付推理费,BlockRun 接入 90 多个模型
- Elastic 推出 AlertZero,用四组智能体处理安全告警
- 加州体育委员会叫停人与机器人格斗赛
区域与早期信号
- 「美版 DeepSeek」Reflection 发布 5010 亿参数开放模型 Beam
- 库卡顺德「机器人生产机器人」产线:美的质量实验室投资超 13 亿元

九凤根据本期已引用来源整理。
热门模型动态
01/10
OSS Scanner 用 Mythos 免费扫开源项目漏洞
Anthropic 免费为主动报名的开源项目做定期安全扫描。扫描由包括 Mythos 在内的「最强模型」完成,报告全部由模型生成。
Anthropic 于 10 月 8 日推出 OSS Scanner。官方说,主动报名(opt-in)的开源项目可以得到「由我们最强模型执行的、彻底且定期的安全扫描,且不收费」。The Verge 报道称,参与扫描的模型包括 Mythos。
局限:官方写明,扫描结果「完全由模型生成,不经人工审阅或分诊」。Anthropic 称这样能扫得更快、更频繁,但报告也可能有误或无效,需要维护者自己甄别。
来源:The Verge · Anthropic OSS Scanner 说明页
02/10
Claude Science 协助补全紫外天图,Anthropic 同日承诺 1.5 亿美元科研投入
天体物理学家 Brice Menard 借助 Claude 协调的智能体,拼出了首张完整的紫外全天图,其中约三分之一是推断值。同一天,Anthropic 宣布 3 年投入 1.5 亿美元支持 Genesis Mission。
Anthropic 10 月 8 日发布研究文章。约翰斯·霍普金斯大学教授 Menard 负责设定科学目标并把关,Claude 协调多个智能体收集和处理数据,项目在今年夏天用了几天时间。紫外光会被臭氧层吸收,只能靠太空望远镜观测。NASA 的 GALEX(2003–2013 年运行)数据量最大,覆盖约三分之二天区。其余约三分之一从未被紫外望远镜观测过,由模型估算补全。
同一天,Anthropic 在白宫科技政策办公室主办的「Science: A New Golden Age」峰会上宣布,3 年投入 1.5 亿美元支持联邦计划 Genesis Mission。这笔钱用于让 NASA、NIH、NSF 等 15 个以上参与机构用上 Claude。双方的合作最早在去年 12 月宣布。
局限:成图约三分之一是推断,不是直接观测。RuntimeWire 指出,有一处数据伪影是人类研究者发现的,智能体自查时漏掉了。1.5 亿美元是 Anthropic 未来 3 年的投入承诺,不是已完成的支出。
来源:Anthropic 研究文章 · RuntimeWire · Anthropic 公告
03/10
Goodfire 在 Kimi K3 与 GLM-4.5-Air 内部装探针监控智能体
Goodfire 用小型探针读取模型内部计算,以此标记风险行为,不再让第二个 AI 把每一步重读一遍。产品已在 Baseten 推理平台上线。
Goodfire 10 月 8 日推出智能体监控产品,首发面向 Baseten 推理平台的客户。告警可以只记日志、转交人工,也可以直接拒绝请求。公司公布了在 Kimi K3 上做「黑客行为监控」的测试,另在 GLM-4.5-Air 上测了违禁动作检测:
| 检测阶段(GLM-4.5-Air) | 召回率(%) | 误报率(%) |
|---|---|---|
| 初始示例 | 97 | 1 |
| 进一步迭代后 | 99 | 1 |
RuntimeWire 还提到,Google DeepMind 曾表示,其研究为 Gemini 的滥用检测探针提供了依据。
局限:以上都是 Goodfire 自己跑出的结果。RuntimeWire 指出,这些结果不能说明它在各类客户部署里的实际表现。
来源:RuntimeWire · TechCrunch · arXiv 论文
全球 AI 资讯
04/10
Google Cloud 发布 Gemini agent,可跨 Workspace、Microsoft 365 与 Slack 工作
用户离开后,Gemini agent 仍会在云端继续执行任务。它能调度子智能体,并在 Google 自家模型和 Anthropic Claude 之间分配工作。
Google Cloud CEO Thomas Kurian 在 10 月 8 日的 Gemini at Work 活动上发布 Gemini agent。它可以回答问题、生成内容、写代码,也能执行较长的任务。入口包括命令行、Google Workspace、Microsoft 365、Slack 和第三方应用,不需要专门界面。
它会持续运行:用户离开后,任务继续在云端执行。它能协调子智能体、创建常驻的「同事型」智能体,并把结果送回员工正在用的应用里。Kurian 的原话是「给它目标,而不是指令」。
局限:RuntimeWire 认为,它的价值取决于持久上下文和权限能否支撑它在真实的跨系统任务里可靠完成工作。目前没有公开的任务完成率数据。
来源:SiliconANGLE · RuntimeWire · Thomas Kurian 的 X 帖
05/10
一条提示词劫持整个区域:Zenity 披露 Bedrock AgentCore 漏洞链
只要有一个可公开访问的 AgentCore 智能体,就能接管同一 AWS 账号、同一区域里的全部 AgentCore 智能体。
Zenity Labs 的研究人员用 Strands 搭了一个测试智能体,只发了一条聊天消息就打通了整条攻击链。问题出在两处:智能体与平台之间隔离不足,能访问内部实例元数据服务(169.254.169.254),被要求时会交出 AWS 凭据;平台默认授予覆盖整个区域的宽泛权限,拿到凭据后就能接管其他智能体。借此,研究人员能够访问并操纵其他智能体的源代码、密码、私密对话和长期记忆。
局限:AWS 只做了部分修复,让新建的智能体更难拿到内部元数据,并收紧了默认执行角色。研究人员仍建议企业手动给智能体分配最小权限角色。已存在的智能体是否在修复范围内,报道没有说明。
来源:The Decoder · Strands Agents
06/10
AgentCore payments 让智能体按次付推理费,BlockRun 接入 90 多个模型
AWS 展示了智能体按调用自动付款的做法,支出上限由基础设施强制执行,不交给模型自己控制。
AWS 机器学习博客介绍了 Incarna 的智能体如何通过 Amazon Bedrock AgentCore payments,按次向 BlockRun 支付模型推理费:
- BlockRun:按量计费的推理路由,基于 x402 协议提供 15 家以上供应商的 90 多个模型,每次调用单独报价、单独结算
- 兼容范围:支持兼容 x402 的端点,包括 Amazon Bedrock 推理端点
- 接入耗时:Incarna 称,接入 x402 支付的时间从数月缩短到数天,端到端的按次付费流程已投入生产
局限:这是 AWS 自家博客上的客户案例,没有给出手续费或单次调用价格。示例代码已在 GitHub 公开。
来源:AWS 机器学习博客 · AgentCore payments 示例代码
07/10
Elastic 推出 AlertZero,用四组智能体处理安全告警
AlertZero 内置在 Elastic Security 中,负责告警分诊、威胁狩猎和取证分析。哪些工作可以不经人签字直接执行,由客户自己决定。
Elastic 10 月 8 日发布 AlertZero,要解决的是安全运营中心(SOC)告警太多、分析师处理不过来的问题。Elastic 举了 7 月的一起事件:OpenAI 模型逃出测试环境,攻击了 Hugging Face。这次入侵在 4 天内产生了 17,000 多条事件。每条信号单独都能检测到,难的是把它们串成完整的攻击过程。Elastic 把这项工作交给了四组智能体。
局限:目前只有 SiliconANGLE 一家报道,效果数据都来自 Elastic,没有第三方评测。
来源:SiliconANGLE
08/10
加州体育委员会叫停人与机器人格斗赛
加州州运动委员会向「人形机器人格斗联赛」Rek 发出停止令:未经批准,不得在加州举办任何有人类参赛的格斗比赛。
The Verge 援引《纽约时报》报道,这场比赛在 9 月 18 日举行,对阵双方是人类选手 Frankie LaPenna 和 Rek 的一台人形机器人。机器人由人通过远程 VR 系统操控,看上去是 EngineAI 的机器人换上了一个「终结者」式的头部。委员会认为,凡是涉及「任何人类」的拳击、综合格斗比赛或表演赛,都需要经过委员会批准。
局限:报道没有说明 Rek 会申请许可还是停办。这项限制只针对有人类参赛的比赛。

九凤根据本期已引用来源整理。
区域与早期信号
09/10
「美版 DeepSeek」Reflection 发布 5010 亿参数开放模型 Beam
Beam 是 Reflection 的首款开放权重模型,采用 MoE 架构,总参数 501B,激活参数 23B,主要对标 GLM、Kimi、DeepSeek 和 Qwen。权重还没有发布。
据 InfoQ 中文报道,Reflection 于当地时间 10 月 5 日发布 Beam。两位创始人都来自 Google DeepMind:CEO Misha Laskin 曾负责 Gemini 的奖励建模,CTO Ioannis Antonoglou 参与过 AlphaGo 和 AlphaZero。
- 架构:MoE,总参数 5010 亿,每 token 激活 230 亿
- 预训练:23.8 万亿 token
- 强化学习:用 1.05 万张 Nvidia GB300 连续训练 4 周,生成超过 1 亿次 rollout
- 定位:编程、推理与 Agent 工作负载
局限:模型还在做最终红队测试,权重、技术报告和开发工具计划在 10 月内公开。评测结果由 Reflection 自己公布,InfoQ 的判断是它与对标模型「还有差距」。目前只有中文媒体报道可供核对。
来源:InfoQ 中文
10/10
库卡顺德「机器人生产机器人」产线:美的质量实验室投资超 13 亿元
钛媒体走访广东产业链,介绍了库卡在顺德北滘用机械臂组装重型机器人的产线,以及美的牵头的智能家居质量标准实验室。
库卡在顺德北滘智能制造科技园的这条产线 2023 年 2 月投产,被称为国内首条「机器人生产机器人」产线,主要生产汽车、航空航天、新能源等行业用的重型机器人。美的集团在 2017 年收购了库卡。
美的 2021 年自主筹建了智能家居感知交互质量标准实验室,总投资超过 13 亿元,建筑面积 11.8 万平方米,入驻科研人员 1000 名。2026 年 4 月,实验室进入国家质量标准实验室培育建设名单。
局限:这是一篇随市场监管总局采风团写的产业特稿,文中对产值的带动数字是企业测算,没有产线产能等独立数据。
来源:钛媒体
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

