概览
本期共 8 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Grok Build 向所有套餐开放,应用可发布到 X
- 重点 · LFM2.5-DSpark:投机解码把推理吞吐最高提到 3.18 倍
- 重点 · 研究者用加密指令让 Grok 外泄用户数据
全球 AI 资讯
- Anthropic 上线 Claude Academy,把内部培训做成公开课
- Mistral 推出 Agentic Search,主打复杂文档的多步检索
- Google Discover 将上线可对话调校的 AI 信息流
- OpenAI 把「Computer History」扩展到欧洲 Mac 用户
区域与早期信号
- 豆包上线侧边工作台,对话与操作同屏进行(Chinese-language source)

九凤根据本期已引用来源整理。
热门模型动态
01/08
Grok Build 向所有套餐开放,应用可发布到 X
Grok Build 从付费功能升级为全平台产品:网页与移动端均可用,生成的应用可托管在 grok.me,并作为交互卡片嵌入 X 时间线。
SpaceXAI 于 8 月 19 日把基于提示词的应用生成器 Grok Build 开放给每一个 Grok 套餐,并将其从单一功能扩展为带自有托管、模型访问与 X 分发的网页 + 移动端产品。用户可在对话里描述一个游戏、网站、应用或仪表盘,看它在对话中成形,发布到 grok.me 地址,再作为可交互卡片放进 X 时间线。据 SpaceXAI 的产品公告,项目可直接调用 Grok 模型、无需单独的 API key。
RuntimeWire 指出,这一步把应用生成、托管、AI API 与 X 分发合进同一产品,为 SpaceXAI 铺出「从随手提示到持续调用模型」的路径;Musk 于 2023 年创立 xAI,并在 2 月 2 日的收购中将其并入 SpaceX。该公告为厂商一手信息,未详列各套餐的调用额度与定价档位。
来源:RuntimeWire · SpaceXAI
02/08
LFM2.5-DSpark:投机解码把推理吞吐最高提到 3.18 倍
Liquid AI 为 LFM2.5 三款模型发布 DSpark 草稿模型,用投机解码换来大幅提速且不改输出质量。
Liquid AI 8 月 20 日发布 DSpark 草稿模型检查点,覆盖 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 与 LFM2.5-8B-A1B 三款模型。DSpark 增加一条投机解码(speculative decoding)路径,以极小的显存增长换取解码提速、且不改变输出质量:GPU 上吞吐最高提升 3.18 倍,端侧最高 2.87 倍;对 LFM2.5-2.6B,函数调用时延平均降低 57%。官方称已在 llama.cpp 与 SGLang 上做到 day-one 支持,集成代码开源到上游。
Liquid AI 解释,LLM 解码阶段通常受显存带宽制约,多数时延来自把权重从 DRAM 流入 SRAM 而非计算本身,投机解码用一个轻量草稿模型先出候选来缓解。以上为 Liquid AI 自测数据,暂无独立复现;llama.cpp 侧的实现建立在官方代码库之上(PR #27383),提速幅度随硬件不同而变化。

图片来源:huggingface;已转存至九凤 R2。
来源:Hugging Face Blog · llama.cpp PR
03/08
研究者用加密指令让 Grok 外泄用户数据
安全披露:一种名为 Cryptographic Context Injection 的手法,可让 Grok 在收到加密的恶意指令时外泄用户数据。
Ars Technica 报道,安全研究披露了一种针对 Grok 的提示注入手法「Cryptographic Context Injection」:当恶意指令以加密形式送入时,可绕过模型的安全护栏,诱导 Grok 外泄用户数据。报道将其定性为又一种攻破 LLM 安全护栏的方式。
这属于安全研究层面的攻击演示。本条依据 Ars Technica 摘要,受影响的具体 Grok 版本、触发条件与厂商修复状态以原文报道为准,此处不做外推。
来源:Ars Technica
全球 AI 资讯
04/08
Anthropic 上线 Claude Academy,把内部培训做成公开课
免费课程目录混合通用 AI 素养与 Claude 产品教程,同时充当 Claude 产品线的上手引导。
Anthropic 于 8 月 20 日推出 Claude Academy,把公司内部培训员工的做法整理成免费公开目录。内容从通用「AI 素养」延伸到 Claude 专属工作流,为 Claude.ai、Cowork 智能体、Claude Code、团队频道工具 Claude Tag,以及包含 API、Console 与 MCP 工具的 Claude 平台提供专门教程。课程主张让用户判断哪些工作该交给 AI、审视模型在哪里出错、并对最终结果负责。
据 RuntimeWire,这既是 AI 教育也是产品上手引导,用免费课程降低 Claude 产品线的采用成本;该报道还并列举出 OpenAI Academy 与 Google AI Essentials 两个同类项目。
来源:RuntimeWire · Claude
05/08
Mistral 推出 Agentic Search,主打复杂文档的多步检索
Mistral 发布检索层 Agentic Search,用多步检索循环在复杂文档里查找、核对信息,官方称减少轮次、token 与时延。
Mistral 8 月 20 日发布 Agentic Search,一个让 AI 系统在复杂文档内导航、阅读与核实信息的检索层。它引入多步检索循环,跨数据源查找、检查并验证信息,通过 Mistral Search Toolkit 提供,并内置到 Studio 与 Vibe 的 Libraries 中。官方称在 FinanceBench 与 OfficeQA Pro 基准上,Agentic Search 在给出更准确结果的同时减少了轮次、token 使用与时延。
Mistral 强调其工具可移植、开放,支持在云端或本地处理敏感的领域数据而不跨越隔离边界。上述基准对比与提效幅度均为 Mistral 官方口径,未给出与具体对照系统的量化差值,也暂无第三方评测。
来源:Mistral AI
06/08
Google Discover 将上线可对话调校的 AI 信息流
用户很快能用聊天式界面描述想看什么,Google 用 AI 自动调整 Discover 信息流并记住偏好。
Google 宣布将在「未来几天」向 Google App 推出一项功能:用户可在 Discover 信息流的三点菜单里,用聊天式界面描述自己的偏好,AI 会据此自动调整信息流并「记住」偏好供后续访问使用。据 Google 演示,点开后会出现对话式界面,聊天机器人会确认你的选择并列出它将优先展示的内容类型;若理解有偏差,可补充信息,再点「刷新信息流」使改动生效。
功能尚未正式上线,Google 只给出「未来几天」的时间窗,具体地区与灰度范围未明确;The Verge 与 Google 官方博客均以演示与说明为主,实际效果有待放量后验证。
07/08
OpenAI 把「Computer History」扩展到欧洲 Mac 用户
OpenAI 的可选时间线记录桌面活动,为 ChatGPT 与 Codex 提供上下文,现扩至欧洲经济区、英国与瑞士。
OpenAI 于 8 月 20 日把 Mac 桌面应用的「Computer History」功能扩展到欧洲经济区、英国和瑞士的 Pro、Business 与 Enterprise 用户,比此前宣布的更大范围推送晚一周。这一可选功能会保留一条可搜索的时间线,记录来自应用与网站的选定活动,让 ChatGPT 与 Codex 无需用户从头解释就能恢复工作上下文;对企业账户,需管理员启用。
据 RuntimeWire,该功能把桌面活动变成智能体的上下文来源,欧洲这次是「选择加入」式采集的一次落地测试。功能为 opt-in,Pro 账户适用 OpenAI 消费者侧数据政策、Business 账户受企业隐私承诺约束;报道称此次区域发布甚至早于对应文档更新。
来源:RuntimeWire · OpenAI
区域与早期信号
08/08
豆包上线侧边工作台,对话与操作同屏进行(Chinese-language source)
豆包「工作任务模式」新增侧边工作台,以多标签统一承载任务资源,让对话与操作在同一屏完成。
据雷锋网,豆包围绕生产力场景更新「工作任务模式」,在对话页右侧新增侧边工作台,以多标签形式统一承载任务相关资源,让 AI 对话与实际操作同屏进行,无需在多窗口间切换。侧边工作台支持打开本地文件、飞书文档、在线网页,以及代码、应用与终端;长任务中生成的应用、文件、图片等以标签并排展示,每个对话拥有独立工作台,切换任务时自动恢复此前状态。应用开发场景下支持代码实时预览,网页生成后可点「编辑」局部调整;飞书文档、PPT、Excel 可在侧边工作台直接打开,模型生成内容即时更新至文档。
本条为中文来源单一媒体报道,功能覆盖范围、可用版本与放量进度以官方为准;豆包为字节跳动/火山引擎产品,此处为产品功能更新,非模型能力变化。
来源:雷锋网
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

