概览
本期共 8 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · 阿里 Qwen 开源多模态插件库,适配六款智能体工具
- 重点 · Mistral 发布 Shieldstral,3B 开源多模态安全分类器
- 重点 · SaferAI:智谱 GLM-5.2 逼近前沿,安全护栏缺位
- Liquid AI 发布 LFM2.5-2.6B,主打端侧智能体
全球 AI 资讯 5. 亚马逊 Bedrock 上线联网搜索,为模型回答做实时接地 6. Anthropic 首设全球事务官,前加州最高法院法官加盟 7. 英伟达加入 NSF 州与区域 AI 枢纽计划
区域与早期信号 8. SpaceX 携手英伟达,把数据中心级算力送上卫星

九凤根据本期已引用来源整理。
热门模型动态
阿里 Qwen 开源多模态插件库,适配六款智能体工具
Qwen 把多模态能力打包成可安装插件,一套技能直接装进 Claude Code、Codex、Gemini CLI 等六款现成智能体。
阿里通义千问团队开源仓库 Qwen-MM-Plugins,以 Apache-2.0 许可证发布,把多模态能力做成可安装的「技能」,覆盖文件处理、媒体与设计软件等场景。仓库文档给出六款现成智能体工具的安装方式:Claude Code、Codex、Qoder、OpenClaw、Qwen Code 与 Gemini CLI。仓库最新 README 的更新者署名为 Shuai Bai,其此前参与过 Qwen-VL 等 Qwen 多模态工作。
按 RuntimeWire 说明,该仓库要验证的是「多模态工具能否装进现有智能体界面、而不必另起一套运行时」;但其兼容性、对外部 API 的依赖以及生产环境下的实际表现尚未经独立验证。

图片来源:GitHub;已转存至九凤 R2。
来源:RuntimeWire · GitHub Qwen-MM-Plugins · Qwen 团队
Mistral 发布 Shieldstral,3B 开源多模态安全分类器
Mistral 用一个 3B 开源模型做内容审核,官方称其效果超过体量 7 倍的模型。
Mistral 发布 Shieldstral-1.0-3B,一个 30 亿参数、Apache-2.0 开源权重的多模态安全分类器,可在 Hugging Face 下载。它把内容审核建模成「策略自适应的问答」:推理时直接接收自然语言写的策略,无需重新训练即可统一评估文本与图像安全,返回一个校准过的安全分数。Mistral 是 NVIDIA 等发起的 Open Secure AI Alliance 的首批成员之一。
「超过体量 7 倍模型」是 Mistral 在自家技术报告中的说法,尚无第三方复现;作为护栏/分类器,它本身不生成内容,实际拦截效果取决于所配置的策略。
来源:Mistral AI · 技术报告 · Hugging Face
SaferAI:智谱 GLM-5.2 逼近前沿,安全护栏缺位
开源的 GLM-5.2 在网安与生物能力上只落后头部模型几个月,但缺关键安全缓解措施。
AI 安全非营利机构 SaferAI 的新报告称,中国智谱(Z.ai)的开源权重模型 GLM-5.2 在网络安全与生物(cyber、bio)能力维度上,仅落后 OpenAI 的 GPT-5.5 和 Anthropic 的 Claude Opus 4.7 几个月。报告同时指出,GLM-5.2 缺少关键的安全缓解措施,前沿能力与安全实践之间的差距正在拉大。
该结论出自 SaferAI 单份报告、经 TechCrunch 报道,本条目前为单一报道来源;报告未公开逐项测评分数,「几个月」为其定性判断。
来源:TechCrunch
Liquid AI 发布 LFM2.5-2.6B,主打端侧智能体
26 亿参数端侧模型,官方给出工具调用/指令遵循基准分与本地吞吐数据。
Liquid AI 发布 LFM2.5-2.6B,一个 26 亿参数的小模型,定位是完全在设备端(on-device)运行的智能体:支持工具调用(tool calling)与多步工作流;官方称在工具调用、指令遵循与多步智能体任务上,可与体量 4 倍于己的模型竞争。官方博客给出的基准包括 AIME25 51.87、IFBench 59.17、BFCLv4 56.88、ToolSandbox 77.83;本地生成吞吐方面,官方给出 M5 Max 约 220 tok/s、Ryzen 约 113 tok/s、手机端约 30 tok/s。
上述基准与吞吐数据均出自 Liquid AI 官方博客,尚无第三方复现;「可与 4 倍体量模型竞争」未点名具体对比模型,不同硬件与量化下的端侧实测表现仍有待独立验证。
全球 AI 资讯
亚马逊 Bedrock 上线联网搜索,为模型回答做实时接地
AWS 把「联网搜索」做成 Bedrock 的服务端内置工具,正式可用(GA)。
AWS 宣布 Amazon Bedrock 的 Web Search 正式可用(general availability)。它是一个服务端内置工具,用当前网络知识为基础模型的回答「接地」(grounding),覆盖聊天机器人、编程助手、CLI 工具与企业应用等场景,官方称可回答训练数据之外的问题并减少幻觉。
这是 AWS 的平台运维能力,而非某个模型自身的进展;本条摘录未给出定价、延迟或检索质量的量化指标。
Anthropic 首设全球事务官,前加州最高法院法官加盟
Anthropic 把政策、国际事务与政府关系收归一名新设高管统管。
Anthropic 宣布 Mariano-Florentino(Tino)Cuéllar 加盟,出任公司首任首席全球事务官(Chief Global Affairs Officer),主管政策、战略性国际事务与全球政府关系。Cuéllar 曾任加州最高法院法官,由 Anthropic 联合创始人、总裁 Daniela Amodei 引入领导层。RuntimeWire 指此举发生在 Claude 进入更多大型企业与公共机构之际。
这是人事与政策层面的组织调整,非模型能力更新;职责范围与具体议程以官方公告为准。
来源:Anthropic · RuntimeWire
英伟达加入 NSF 州与区域 AI 枢纽计划
英伟达参与美国国家科学基金会新启动的州与区域 AI 基础设施枢纽计划。
英伟达宣布参与美国国家科学基金会(NSF)的「州与区域人工智能基础设施枢纽」(State and Regional AI Infrastructure Hubs)计划,该计划即日启动,目标是扩大高校在 AI 相关科研与教育所需的先进算力、数据、软件与专业支持的可及性。英伟达称计划与美国「创世纪使命」(Genesis Mission)的目标一致,将支持跨州的高校联合体协作。
这是面向科研教育的美国国家级项目,本条摘录未披露资金规模、参与机构名单与时间表等细节。
区域与早期信号
SpaceX 携手英伟达,把数据中心级算力送上卫星
SpaceX 与英伟达合研 Starmind AI1 卫星计算载荷,每颗卫星搭载英伟达 Rubin GPU 与 Vera CPU。
据第一财经、36 氪报道,北京时间 8 月 5 日,SpaceX 在社交媒体宣布正与英伟达合作,共同开发设计 Starmind AI1 卫星计算载荷;每颗 Starmind 卫星将搭载英伟达 Rubin GPU 与 Vera CPU,实现「数据中心级」的太空计算能力。英伟达在社交媒体确认合作,称这是「AI 基础设施的下一个篇章」。
证据边界:本条目前仅见中文媒体(第一财经、36 氪)报道,转述两家公司的社交媒体表态;载荷参数、部署时间与算力规模等细节尚未见官方技术文档或独立英文报道核实。
获取九凤最新的 AI 模型洞察与教程。
了解更多


