概览
本期共 8 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Grok Build 向所有套餐开放,应用可发布到 X
- 重点 · LFM2.5-DSpark:投机解码把推理吞吐最高提到 3.18 倍
- 重点 · 研究者用加密指令让 Grok 外泄用户数据
全球 AI 资讯 4. Anthropic 上线 Claude Academy,把内部培训做成公开课 5. Mistral 推出 Agentic Search,主打复杂文档的多步检索 6. Google Discover 将上线可对话调校的 AI 信息流 7. OpenAI 把「Computer History」扩展到欧洲 Mac 用户
区域与早期信号 8. 豆包上线侧边工作台,对话与操作同屏进行(Chinese-language source)

九凤根据本期已引用来源整理。
热门模型动态
Grok Build 向所有套餐开放,应用可发布到 X
Grok Build 从付费功能升级为全平台产品:网页与移动端均可用,生成的应用可托管在 grok.me,并作为交互卡片嵌入 X 时间线。
SpaceXAI 于 8 月 19 日把基于提示词的应用生成器 Grok Build 开放给每一个 Grok 套餐,并将其从单一功能扩展为带自有托管、模型访问与 X 分发的网页 + 移动端产品。用户可在对话里描述一个游戏、网站、应用或仪表盘,看它在对话中成形,发布到 grok.me 地址,再作为可交互卡片放进 X 时间线。据 SpaceXAI 的产品公告,项目可直接调用 Grok 模型、无需单独的 API key。
RuntimeWire 指出,这一步把应用生成、托管、AI API 与 X 分发合进同一产品,为 SpaceXAI 铺出「从随手提示到持续调用模型」的路径;Musk 于 2023 年创立 xAI,并在 2 月 2 日的收购中将其并入 SpaceX。该公告为厂商一手信息,未详列各套餐的调用额度与定价档位。
来源:RuntimeWire · SpaceXAI
LFM2.5-DSpark:投机解码把推理吞吐最高提到 3.18 倍
Liquid AI 为 LFM2.5 三款模型发布 DSpark 草稿模型,用投机解码换来大幅提速且不改输出质量。
Liquid AI 8 月 20 日发布 DSpark 草稿模型检查点,覆盖 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 与 LFM2.5-8B-A1B 三款模型。DSpark 增加一条投机解码(speculative decoding)路径,以极小的显存增长换取解码提速、且不改变输出质量:GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍;对 LFM2.5-2.6B,函数调用时延平均降低 57%。官方称已在 llama.cpp 与 SGLang 上做到 day-one 支持,集成代码开源到上游。
Liquid AI 解释,LLM 解码阶段通常受显存带宽制约,多数时延来自把权重从 DRAM 流入 SRAM 而非计算本身,投机解码用一个轻量草稿模型先出候选来缓解。以上为 Liquid AI 自测数据,暂无独立复现;llama.cpp 侧的实现建立在官方代码库之上(PR #27383),提速幅度随硬件不同而变化。

图片来源:huggingface;已转存至九凤 R2。
来源:Hugging Face Blog · llama.cpp PR
研究者用加密指令让 Grok 外泄用户数据
安全披露:一种名为 Cryptographic Context Injection 的手法,可让 Grok 在收到加密的恶意指令时外泄用户数据。
Ars Technica 报道,安全研究披露了一种针对 Grok 的提示注入手法「Cryptographic Context Injection」:当恶意指令以加密形式送入时,可绕过模型的安全护栏,诱导 Grok 外泄用户数据。报道将其定性为又一种攻破 LLM 安全护栏的方式。
这属于安全研究层面的攻击演示。本条依据 Ars Technica 摘要,受影响的具体 Grok 版本、触发条件与厂商修复状态以原文报道为准,此处不做外推。
来源:Ars Technica
全球 AI 资讯
Anthropic 上线 Claude Academy,把内部培训做成公开课
免费课程目录混合通用 AI 素养与 Claude 产品教程,同时充当 Claude 产品线的上手引导。
Anthropic 于 8 月 20 日推出 Claude Academy,把公司内部培训员工的做法整理成免费公开目录。内容从通用「AI 素养」延伸到 Claude 专属工作流,为 Claude.ai、Cowork 智能体、Claude Code、团队频道工具 Claude Tag,以及包含 API、Console 与 MCP 工具的 Claude 平台提供专门教程。课程主张让用户判断哪些工作该交给 AI、审视模型在哪里出错、并对最终结果负责。
据 RuntimeWire,这既是 AI 教育也是产品上手引导,用免费课程降低 Claude 产品线的采用成本;该报道还并列举出 OpenAI Academy 与 Google AI Essentials 两个同类项目。
来源:RuntimeWire · Claude
Mistral 推出 Agentic Search,主打复杂文档的多步检索
Mistral 发布检索层 Agentic Search,用多步检索循环在复杂文档里查找、核对信息,官方称减少轮次、token 与时延。
Mistral 8 月 20 日发布 Agentic Search,一个让 AI 系统在复杂文档内导航、阅读与核实信息的检索层。它引入多步检索循环,跨数据源查找、检查并验证信息,通过 Mistral Search Toolkit 提供,并内置到 Studio 与 Vibe 的 Libraries 中。官方称在 FinanceBench 与 OfficeQA Pro 基准上,Agentic Search 在给出更准确结果的同时减少了轮次、token 使用与时延。
Mistral 强调其工具可移植、开放,支持在云端或本地处理敏感的领域数据而不跨越隔离边界。上述基准对比与提效幅度均为 Mistral 官方口径,未给出与具体对照系统的量化差值,也暂无第三方评测。
来源:Mistral AI
Google Discover 将上线可对话调校的 AI 信息流
用户很快能用聊天式界面描述想看什么,Google 用 AI 自动调整 Discover 信息流并记住偏好。
Google 宣布将在「未来几天」向 Google App 推出一项功能:用户可在 Discover 信息流的三点菜单里,用聊天式界面描述自己的偏好,AI 会据此自动调整信息流并「记住」偏好供后续访问使用。据 Google 演示,点开后会出现对话式界面,聊天机器人会确认你的选择并列出它将优先展示的内容类型;若理解有偏差,可补充信息,再点「刷新信息流」使改动生效。
功能尚未正式上线,Google 只给出「未来几天」的时间窗,具体地区与灰度范围未明确;The Verge 与 Google 官方博客均以演示与说明为主,实际效果有待放量后验证。
OpenAI 把「Computer History」扩展到欧洲 Mac 用户
OpenAI 的可选时间线记录桌面活动,为 ChatGPT 与 Codex 提供上下文,现扩至欧洲经济区、英国与瑞士。
OpenAI 于 8 月 20 日把 Mac 桌面应用的「Computer History」功能扩展到欧洲经济区、英国和瑞士的 Pro、Business 与 Enterprise 用户,比此前宣布的更大范围推送晚一周。这一可选功能会保留一条可搜索的时间线,记录来自应用与网站的选定活动,让 ChatGPT 与 Codex 无需用户从头解释就能恢复工作上下文;对企业账户,需管理员启用。
据 RuntimeWire,该功能把桌面活动变成智能体的上下文来源,欧洲这次是「选择加入」式采集的一次落地测试。功能为 opt-in,Pro 账户适用 OpenAI 消费者侧数据政策、Business 账户受企业隐私承诺约束;报道称此次区域发布甚至早于对应文档更新。
来源:RuntimeWire · OpenAI
区域与早期信号
豆包上线侧边工作台,对话与操作同屏进行(Chinese-language source)
豆包「工作任务模式」新增侧边工作台,以多标签统一承载任务资源,让对话与操作在同一屏完成。
据雷锋网,豆包围绕生产力场景更新「工作任务模式」,在对话页右侧新增侧边工作台,以多标签形式统一承载任务相关资源,让 AI 对话与实际操作同屏进行,无需在多窗口间切换。侧边工作台支持打开本地文件、飞书文档、在线网页,以及代码、应用与终端;长任务中生成的应用、文件、图片等以标签并排展示,每个对话拥有独立工作台,切换任务时自动恢复此前状态。应用开发场景下支持代码实时预览,网页生成后可点「编辑」局部调整;飞书文档、PPT、Excel 可在侧边工作台直接打开,模型生成内容即时更新至文档。
本条为中文来源单一媒体报道,功能覆盖范围、可用版本与放量进度以官方为准;豆包为字节跳动/火山引擎产品,此处为产品功能更新,非模型能力变化。
来源:雷锋网
获取九凤最新的 AI 模型洞察与教程。
了解更多


