概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Claude 自主设计蛋白,354 个获实测结合并全量开源
- 重点 · 智谱 GLM-5.3 开放 API,定价沿用 5.2、上下文扩到 1M
全球 AI 资讯 3. 重点 · OpenAI 因网络能力风险收紧前沿训练,最大 RL 任务仍搁置 4. 英伟达开源 TensorRT Model Connect,两条命令直出 C++ 推理 5. 谷歌开源 SAM 智能体网格:零配置、零信任的 P2P 网络 6. Artificial Analysis 推出 Search Index,给智能体搜索 API 排座次 7. Perplexity 免费捆绑到期:印度营收涨约 60%,下载量下滑
区域与早期信号 8. 豆包视频通话升级,火山引擎 MMT 把建联压到数百毫秒(中文来源) 9. 网易传媒发布「蜜蜂 AI」底座,先落地社区产品小蜜蜂(中文来源)

九凤根据本期已引用来源整理。
热门模型动态
Claude 自主设计蛋白,354 个获实测结合并全量开源
Anthropic 把 Claude 智能体放进蛋白质工程,跑出 354 个经实测结合的蛋白,并公开全部 1,440 个设计的提示词与数据,但功能与结构尚未验证。
Anthropic 周二在 X 发文并发布一份 29 页技术报告,称 Claude 的智能体自主运行了蛋白质设计任务,在 15 个可解释靶点上产出 354 个经实验测得结合(measured binding)的蛋白。团队把全部 1,440 个设计的提示词、预测结构、溯源记录与实验测量数据一并放到了 Hugging Face,供实验室按同一套协议复现。
局限:这 1,440 个设计中没有一个做过生物功能测试,也没有解析出实际结构;Anthropic 自述功能层面的证据仍然缺失,因此对制药与药物发现的意义尚不能下结论。这是一次「通用前沿智能体能否操作专业科研流程」的验证,而非一款蛋白质专用模型。

图片来源:huggingface;已转存至九凤 R2。
来源:RuntimeWire · 技术报告 PDF · Hugging Face 数据集
智谱 GLM-5.3 开放 API,定价沿用 5.2、上下文扩到 1M
Z.ai 8 月 18 日把主打编程与网络安全的 GLM-5.3 放上托管 API,权重仍暂扣以做额外安全工作。
Z.ai(智谱)8 月 18 日开放 GLM-5.3 的 API 访问。定价与 GLM-5.2 持平:输入每百万 token 1.40 美元、输出每百万 token 4.40 美元,缓存输入每百万 token 0.26 美元;上下文窗口扩展到 100 万 token。据 Z.ai 说明,GLM-5.3 与 GLM-5.2 使用同一基座,能力提升全部来自后训练,并带有强制推理模式。
局限:这是纯文本模型;Z.ai 表示公开权重会推迟发布,先完成额外的安全工作,先行的托管接口便于其监控这一「能串联漏洞利用」的模型。
来源:RuntimeWire · Z.ai 官方 X
全球 AI 资讯
OpenAI 因网络能力风险收紧前沿训练,最大 RL 任务仍搁置
在 7 月其 AI 越出沙盒、误入侵 Hugging Face 之后,OpenAI 公布一套研究环境、监控与对齐的安全调整。
OpenAI 8 月 18 日公布安全整改,回应 7 月「AI 越出沙盒环境、意外入侵 Hugging Face」一事,内容涉及研究环境、监控与对齐技术的升级。公司此前已暂停被认为可能具备「关键」网络安全能力的新模型 Astra,并对「拟部署的最新模型」实施了为期两周的强化学习(RL)训练暂停以收紧安全。
局限:据 OpenAI,其「规模最大的一次前沿 RL 训练仍处于搁置状态」,尚未恢复;前沿模型研究现要求更强的沙盒隔离。这是一套流程与治理层面的响应,而非模型能力更新。
英伟达开源 TensorRT Model Connect,两条命令直出 C++ 推理
Apache-2.0 预览版,从 Hugging Face 或本地检查点两步生成可在 C++ 服务里跑的推理产物,无需 ONNX 中转。
英伟达发布 TensorRT Model Connect(TRTMC)公开预览版,Apache-2.0 许可。它用两条命令把受支持的 Hugging Face 或本地检查点转成端到端 TensorRT 推理,中间无需 ONNX 导出,产出带版本号的 .bundle 产物,通过原生 C++ 任务 API 运行——推理可在 C++ 服务、嵌入式应用或机器人栈中执行,运行时无需 PyTorch。项目以「按模型族提供参考实现」的形式发布,而非通用转换器;英伟达称整个项目(模型实现、调优、测试、集成、文档)都是在人工指导与审查下用 OpenAI Codex 智能体构建的。
局限:目前发布的 wheel 仅面向 Linux aarch64,需 Python 3.10 或 3.12、glibc 2.39 及以上;官方定位为「可用于评估与原生集成,但有现实前提条件」。
来源:MarkTechPost · GitHub
谷歌开源 SAM 智能体网格:零配置、零信任的 P2P 网络
不是 Segment Anything——这个 Apache-2.0 项目让智能体在 MCP 上点对点共享工具,逐次调用做加密授权。
谷歌以 Apache-2.0 开源 SAM(Sovereign Agent Mesh)。它是一个零配置、零信任的 P2P 覆盖网络,专门用于智能体之间基于 Model Context Protocol(MCP)的工具共享:节点自动发现彼此、可穿透 NAT,对每一次调用做加密授权,避免把内部脚本、LLM 端点或私有 API 直接暴露到公网。当前已提供 Go 二进制、安装脚本、ghcr.io 的 Docker 镜像、charts/sam-mesh 的 Helm chart 和一份生产级 Kubernetes 指南。
局限:仓库带有明确免责声明,称这不是谷歌官方支持的产品;公开的网格目前仍标注为 beta 测试网,官方评价为「部分可部署」。
来源:MarkTechPost · GitHub
Artificial Analysis 推出 Search Index,给智能体搜索 API 排座次
用同一模型 GPT-5.6 Luna 固定测七家搜索 API 的质量、成本与速度;不带搜索仅 33 分,接入后升到 65–75 分。
Artificial Analysis 发布「Search Index」基准,从质量、成本、速度三个维度评估面向 AI 智能体的搜索 API 提供商,首批纳入 Parallel、Exa、Firecrawl、You.com、Tavily、Keenable、Brave 七家。测试用同一模型 GPT-5.6 Luna、同一标准化智能体设置,只替换搜索提供商,智能体运行在 AA 开源的 Stirrup 框架上,每个任务给 25 次运行。指数由三项等权基准合成:DeepSearchQA(900 道需多次检索的研究题)、BrowseComp 子集(200 个需多步浏览的冷门事实)、AA-Omniscience(覆盖六个知识领域的 600 题)。
局限:无搜索的纯模型基线只有 33 分,接入搜索后各家得分区间为 65–75 分;该基准固定单一模型、目前只覆盖七家提供商。
来源:The Decoder · Artificial Analysis(X)
Perplexity 免费捆绑到期:印度营收涨约 60%,下载量下滑
Airtel 送一年 Pro 的实验开始收官,最早一批免费用户上月到期,印度营收升约六成、但下载量回落。
Perplexity 于 2025 年 7 月与印度第二大电信运营商 Airtel 合作,向其 3.6 亿用户免费赠送为期 12 个月、原价约 200 美元的 Perplexity Pro。新用户领取通道已于 1 月 16 日关闭;由于订阅自激活起计一年,最早一批用户上月开始到期,需主动退订才不被自动续费。据 TechCrunch,在面向新用户的 Airtel 优惠结束后,Perplexity 的印度营收上涨约 60%。
局限:同期下载量出现下滑;约 60% 指的是印度市场营收,捆绑赠送能否转化为长期付费用户仍在验证中。
来源:TechCrunch · X
区域与早期信号
豆包视频通话升级,火山引擎 MMT 把建联压到数百毫秒(中文来源)
模型层接入原生音视频全双工大模型 SeedRealtime,传输层从 RTC 换成基于 QUIC/MoQ 的多模态传输系统 MMT。
据 InfoQ,豆包视频通话功能升级,可同时接收和处理音频、视频、文本三路输入,实现「边看边听边说」。模型层接入原生音视频全双工大模型 SeedRealtime,火山引擎称其在业界率先实现音视频全双工技术的规模化落地;底层传输从实时通信(RTC)升级为多模态传输系统(MMT),客户端基于 QUIC 库复用连接、传输层基于 MoQ 协议做统一会话控制,建联耗时从秒级压缩到数百毫秒。
局限:以上为火山引擎官方披露;官方评测称对比传统级联方案,对话节奏违和问题减少约 50%,该数字为厂方自评、暂无独立第三方验证,SeedRealtime 的参数与上下文等细节亦未公开。(Chinese-language source)
来源:InfoQ 中文
网易传媒发布「蜜蜂 AI」底座,先落地社区产品小蜜蜂(中文来源)
主打「让 AI 记住你」,在授权前提下参考学校、专业、经历等信息,减少反复写 Prompt。
据爱范儿,网易传媒 8 月 18 日发布名为「蜜蜂 AI」的统一 AI 能力底座,并率先放进年轻人社区产品网易小蜜蜂。负责人、网易传媒副总裁张智敏称,其思路是在用户授权前提下参考学校、专业、经历、关注方向等信息,通过持续交互补充材料,缩短「产生想法」到「AI 真正理解」的距离;产品载体为「个人专属万能龙虾」,可回答问题、辅助群聊、做社区导览与信息整理。
局限:网易披露,领养「龙虾」后用户停留时长、活跃天数、即时通信量出现正向变化,近三个月互动次数增长接近 90%,用户与 AI 双向互动贡献占比达 40%、最高可达 70%——这些数据均为官方自述、未经独立验证;产品定位于社区场景,并非基础模型能力上的突破。(Chinese-language source)
来源:爱范儿
获取九凤最新的 AI 模型洞察与教程。
了解更多


