概览
本期共 10 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Grok Bot 隐藏选择器列出 33 款模型,横跨 xAI 与竞品
- 重点 · 微软 MAI Code 1.1 Flash 编程模型:价格与性能双输 DeepSeek
- 重点 · OpenArt 力推阿里 Qwen-Image-3.0,云端 API 仍限量预览
全球 AI 资讯 4. OpenAI 为 Linux 推出专用 ChatGPT 桌面应用 5. ONESTRUCTION 联合 AWS 造建筑 BIM 基础模型 Ishigaki-IDS 6. River AI 种子/A 轮融资 11 亿美元,xAI 联创押注个人智能体
区域与早期信号 7. 紫东太初提出 GMC 剪枝:免训练砍掉约 80% 视觉 Token 8. 阿里千问 App 生态扩张:荣耀 Robot Phone 首发、美的家电接入 9. iOS 27 测试版曝光:Apple 智能按 iCloud+ 档位分配用量 10. 豆包对酒店订单启用 12% 独立费率

九凤根据本期已引用来源整理。
热门模型动态
Grok Bot 隐藏选择器列出 33 款模型,横跨 xAI 与竞品
SpaceXAI 在 Grok Bot 0.16.0 里塞进一张隐藏的「Elon-Only Settings」卡片,其模型选择器拉取的账号级目录包含 33 款模型。
RuntimeWire 通过反编译 Grok Bot 的 Windows 安装包与 app.asar、从打包 source map 重建 TypeScript,确认这张标注「Elon-Only Settings」的隐藏设置卡内含可用的模型选择器;运行时测试返回 33 条 USER_AVAILABLE 目录项并在隐藏选择器中渲染。该目录横跨 xAI 自家的 Grok,以及 GPT、Claude、Gemini、Kimi、GLM 等竞品模型,走的是需鉴权、按账号隔离的持久化路径。RuntimeWire 指出,这意味着 Grok Bot 可以把常驻智能体在不同厂商模型间路由,让 SpaceXAI 与 Cursor 掌握模型之上的界面、账号与计费层。
局限:这张卡片目前处于休眠/隐藏状态,并非面向普通用户开放。RuntimeWire 同时发现 SpaceXAI 的公开文档对「如何选择模型」给出两套互相矛盾的说法,既与彼此冲突、也与实际发布的客户端不一致;第三方目前只能依据逆向结果,无法从官方文档核对完整名单。
来源:RuntimeWire · docs.x.ai
微软 MAI Code 1.1 Flash 编程模型:价格与性能双输 DeepSeek
微软给 GitHub Copilot 推出的 MAI Code 1.1 Flash 号称更省 token、更便宜,但在关键编程基准上被 DeepSeek-V4-Flash 大幅甩开。
微软发布面向 GitHub Copilot 的代码模型 MAI Code 1.1 Flash,称其比 6 月的前代 MAI-Code-1-Flash 省 25% token、成本降到四分之一,开发者多采纳了 4% 的输出;训练用到「GitHub Copilot 中数十万个强化学习环境」。基准上,它 SWE-bench Verified 得 72.6%(前代 71.6%、Haiku 4.5 为 69.8%、GPT-5.4 mini 为 69.2%),Terminal Bench 2.1 得 62.9%(前代 51.7%、Haiku 4.5 为 49.4%、GPT-5.4 mini 为 60.7%)。
局限:在 Terminal Bench 2.1 上,DeepSeek-V4-Flash-0731 拿到 82.7%,把 MAI Code 1.1 Flash 甩开近 20 个百分点;The Decoder 直言该模型「被 DeepSeek 碾压」,且价格虽比前代便宜,仍高于 DeepSeek。微软未公布 MAI Code 在 SWE-bench 上与 DeepSeek 的对比数据。
来源:The Decoder
OpenArt 力推阿里 Qwen-Image-3.0,云端 API 仍限量预览
创作平台 OpenArt 开始主推阿里 7 月 21 日发布的 Qwen-Image-3.0,主攻密集排版与多语种小字,但开发者要直连云端 API 仍需申请限量预览。
阿里的发布材料称 Qwen-Image-3.0 可接受最多 4,500 token 输入、渲染 12 种语言文字,能生成报纸、分镜、试卷、界面原型等版式,演示宣称约 10 像素的小字仍清晰可读。旧金山创作平台 OpenArt(由 Coco Mao 与 John Qiao 创办)上线了该模型的推广页,Qwen 官方 X 账号也引导用户去 OpenArt 试用。
局限:上述性能数字均来自阿里发布材料,RuntimeWire 复核的资料中未见独立测试验证;云端 API 目前仍处限量预览,需申请才能直连。所查资料也未说明 OpenArt 这次合作的具体日期与商业条款。
来源:RuntimeWire · Qwen 官方 X
全球 AI 资讯
OpenAI 为 Linux 推出专用 ChatGPT 桌面应用
ChatGPT 桌面端补上最后一块拼图,本周以预览版形式登陆 Linux。
OpenAI 本周为 Linux 系统推出专用的 ChatGPT 桌面应用。据 OpenAI 官方 X 帖,该预览版包含 ChatGPT、ChatGPT Work 与 Codex,以 .deb 与 .rpm 包分发,提供 x64 与 ARM64 两种架构,支持 Ubuntu 24.04/26.04 LTS、Debian 13、Fedora 43/44。此前部分开源开发者社区长期呼吁 OpenAI 把这款聊天机器人带到 Linux,此次正式补上桌面端这块拼图。
局限:当前发布的是预览版(preview),OpenAI 未给出转正为正式版的时间表;TechCrunch 报道也未对比该版本与 Windows/macOS 版的功能差异。
来源:TechCrunch · OpenAI 官方 X
ONESTRUCTION 联合 AWS 造建筑 BIM 基础模型 Ishigaki-IDS
建筑科技公司 ONESTRUCTION 在 AWS GenAIIC 协助下,基于 Qwen3 训练出面向建筑 BIM 工作流的专用基础模型。
作为日本 GENIAC(生成式 AI 加速挑战)第三期项目,ONESTRUCTION 在 AWS 生成式 AI 创新中心技术支持下构建了 Ishigaki-IDS,专攻 openBIM 里的 IDS(信息交付规范)。模型以开源的 Qwen3(8B/14B/32B)为底座,采用继续预训练(CPT)、监督微调(SFT)、可验证奖励强化学习(RLVR)三阶段训练管线,配合合成数据,并在 Amazon EC2 P5en 上做分布式训练;RLVR 阶段用面向结构化输出生成的可验证奖励做优化。
局限:这是面向数据稀缺的建筑垂直领域的案例,模型能力绑定 BIM/IDS 场景,AWS 博客未给出与通用模型横向可比的公开基准分数。
来源:AWS Machine Learning Blog · Qwen on Hugging Face
River AI 种子/A 轮融资 11 亿美元,xAI 联创押注个人智能体
xAI 联合创始人 Igor Babuschkin 的新公司 River AI 成立约两个月即拿下 11 亿美元。
River AI 由 xAI 联合创始人 Igor Babuschkin 创办,在由 General Catalyst 与 AMP PBC 领投的种子/A 轮中融资 11 亿美元,英伟达、AMD Ventures、Y Combinator、淡马锡跟投。AMP PBC 是前 a16z 合伙人 Anjney Midha 于 2026 年创立的 AI 投资机构,曾投资 Black Forest Labs、Mistral AI、LMArena 与 OpenRouter。
局限:公司成立仅约两个月,对外只给出「个人智能体」的愿景,尚无发布的产品或模型;TechCrunch 也未披露具体估值与产品路线。
来源:TechCrunch

九凤根据本期已引用来源整理。
区域与早期信号
紫东太初提出 GMC 剪枝:免训练砍掉约 80% 视觉 Token
中科院自动化所团队称新方法能在不训练的前提下删掉约 80% 视觉 Token 而保住多模态能力。(Chinese-language source)
中科院自动化所紫东太初大模型团队提出核心集剪枝方法 GMC(Grounded Message Coreset Pruning),针对视觉语言模型把图像编码成数百至上万 Token、拖慢推理并占满 KV Cache 的瓶颈。GMC 分两步:先做互补证据自适应筛选,兼顾显著区域与文字、数字、坐标轴等分散关键信息;再用「群体互补信息传输」(Population Transport)把待删除 Token 的隐藏状态转移到最合适的代表 Token 上,做真实序列压缩而非掩码隐藏。方法免训练、开箱即用,不需任务标签、参数更新、检测器或 OCR。团队在 TextVQA、ChartQA、MME、POPE、MMBench、GQA 等基准上测试:减少 80.2% 视觉 Token(仅保留 256 个)时保留 97.78% 的平均能力,减少 90.1%(仅保留 128 个)仍保留 99.11%;在 LLaVA-1.5-7B 上分别达到 99.76% 与 99.82%,并称性能与完整模型基线持平甚至略高。
局限:以上为紫东太初团队自述的方法与实测分数,量子位为其独家报道,「免训练即保真」的效果尚待第三方独立复现。
来源:量子位
阿里千问 App 生态扩张:荣耀 Robot Phone 首发、美的家电接入
阿里千问大模型一天内落地两处新场景——荣耀新机首发千问加持的 YOYO Pro,美的以独家家电伙伴身份接入千问 App。(Chinese-language source)
在荣耀 Robot Phone 全球新品发布会上,荣耀宣布该机搭载「Agentic OS」多模态智能操作系统,首发 YOYO Pro 模式,由阿里千问大模型深度加持,支持超长任务执行、跨生态联动;机身 9.59mm/248g、6.31 英寸屏、第五代骁龙 8 至尊版、7060mAh 电池。另据雷锋网,8 月 10 日美的作为独家家电合作伙伴,通过 A2A(Agent-to-Agent)协议接入千问 App,用户绑定美的「小美」AI Agent 后可在千问 App 内完成全品牌产品咨询、家庭环境监测、设备能耗查询与耗材维保。
局限:两条均为厂商发布口径,荣耀新机的千问能力以「深度加持」等表述为主、缺少可量化指标;美的接入侧重生态打通,尚未公布用户规模或调用数据。
iOS 27 测试版曝光:Apple 智能按 iCloud+ 档位分配用量
iOS 27 beta 5 里,Apple 智能的部分用量开始和 iCloud+ 套餐档位挂钩。(Chinese-language source)
据爱范儿援引内容创作者 Stephen Robles 的发现,iOS 27 beta 5 的「家庭」App 新增 Apple Intelligence 页面:2TB iCloud+ 支持 5 个摄像头使用 AI 摘要,12TB 档位增加到 15 个,页面并给出「升级 iCloud+ 获得更多 Apple Intelligence 使用量」的入口。苹果在 6 月 WWDC 已确认,包括图像生成在内的部分服务器模型功能会设每日上限,升级 iCloud+ 可提高额度。
局限:这是测试版中的观察,仅在家庭摄像头 AI 摘要上看到明确分档;图像生成等其他功能是否采用同样的分档方式,仍需后续版本确认。
来源:爱范儿
豆包对酒店订单启用 12% 独立费率
8 月 10 日起豆包渠道的酒店订单按独立费率结算,综合扣费约 12%。(Chinese-language source)
据钛媒体转载迈点报道,8 月 10 日起豆包渠道的酒店订单开始执行独立费率:11.4% 软件服务费加 0.6% 支付手续费,综合扣费 12%。报道认为,这标志着 AI 推荐从「概念化流量入口」变为平台单独核算、独立计费的标准化获客渠道。
局限:该报道来自酒店行业垂直媒体视角,酒店经营者对费率上涨看法不一;豆包侧未公布该渠道的订单量或抽佣的整体规模。
来源:钛媒体
获取九凤最新的 AI 模型洞察与教程。
了解更多


