本文目录
AI 热点资讯

Grok Bot测试Chrome登录态导入与本地出口

核心速览
  • Grok Bot测试Chrome登录态导入与本地出口路由
  • Gemini Omni新增4K视频控制,GPT-5.6在印度获得本地推理支持,六款购物智能体则暴露出推荐易受单一信源影响的问题。
jiufeng
2026年8月28日
12 分钟阅读
Grok Bot测试Chrome登录态导入与本地出口

概览

本期共 9 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · Grok Bot测试Chrome登录态导入与本地出口
  2. 重点 · Gemini Omni 1.1 Flash加入场景延展与4K输出
  3. 重点 · GPT-5.6在印度获得境内推理支持
  4. 单一外部信源可改变部分购物智能体的选择

全球AI资讯 5. OpenAI客户端出现订阅额度共享代码 6. Gemini Notebook可读取已购图书 7. 开源机器人Microduck售价399美元

区域与早期信号 8. GLM与Kimi配置出现相同KDA门限 9. WALL-SS模拟60秒机器人操作任务

2026-08-28 AI 热点信号地图
2026-08-28 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

Grok Bot测试Chrome登录态导入与本地出口

新设置可能把Chrome登录态复制到Grok Bot云端虚拟机,并让其网络流量经用户桌面设备转发。

RuntimeWire根据@blankspeaker发布的一张设置面板截图报道,界面包含“Import cookies from Chrome”和“Route egress through this desktop”两个控件,还可区分连接到智能体的本地计算机,并决定是否允许智能体在本机执行任务。Grok Bot此前已以早期测试形式上线,可在带浏览器、文件系统和终端的持久Linux虚拟机中工作。

这些控件仍处于测试阶段,尚无证据表明已向所有用户开放。导入Cookie会扩大云端计算机可访问的已认证会话范围,现有材料也未说明具体的加密、撤销和隔离机制。

来源:RuntimeWire · X原帖 · xAI文档

Gemini Omni 1.1 Flash加入场景延展与4K输出

Gemini Omni 1.1 Flash面向生成式视频增加首尾帧插值、场景延展和4K放大控制。

Google DeepMind称,该版本允许开发者延展已有场景、指定起始帧与结束帧生成过渡,并输出经过放大的4K视频。模型可通过Google AI Studio和Gemini Enterprise Agent Platform调用,这些新能力也已在Google Flow提供。

目前材料来自Google官方,未提供与其他视频模型对比的质量分数、生成时长、价格或失败率。所谓“studio-quality”属于厂商表述,现有证据不能独立验证其稳定性。

来源:Google DeepMind · Google Flow

GPT-5.6在印度获得境内推理支持

Amazon Bedrock开始通过印度地理跨区域推理提供GPT-5.6 Terra和Luna。

AWS称,具有本地数据处理要求的客户现在可以在印度使用这两款OpenAI模型,相关推理请求和数据将留在印度境内。

候选材料只有AWS官方快讯,未给出可用区域清单、价格、吞吐量或延迟数据,也没有独立报道核验其所述的数据驻留安排。

来源:AWS Machine Learning Blog

单一外部信源可改变部分购物智能体的选择

Wharton团队发现,仅增加一个外部推荐来源,就可能明显改变购物智能体的最终选择。

研究人员用ACES模拟器测试六款当前模型,让它们从固定商品网格中挑选健身手表;智能体先读取商品页截图,并可在决策前查看推荐来源。不同模型在无外部材料时已有不同偏好,而加入单一来源后,部分模型的推荐出现大幅摆动。

实验只覆盖固定商品集和健身手表任务,不能直接代表开放网络上的所有购物场景。论文材料没有证明某次推荐一定错误,但显示智能体的购买决定对检索上下文并不稳定。

来源:The Decoder · ACES论文

全球AI资讯

OpenAI客户端出现订阅额度共享代码

Codex桌面客户端内的休眠代码显示,OpenAI正在准备名为ChatPass的独立订阅共享计量系统。

RuntimeWire通过逆向分析发现,客户端会从GET /wham/usage读取可选的chatpass结构,并把其中的窗口显示为“Subscription sharing”用量表。代码可识别五小时、每日和每周窗口,样例中的limit_window_seconds为604800秒,并支持同时显示任意数量的计量窗口。

测试账户的服务器端尚未启用该功能,OpenAI也没有正式公布ChatPass的对象、费用或上线时间。现有插件架构与“Sign in with ChatGPT”只说明配套基础设施已经存在,不能单独证明外部应用最终能够消耗用户订阅额度。

来源:RuntimeWire · OpenAI插件文档 · OpenAI帮助中心

Gemini Notebook可读取已购图书

“Expert Intelligence”允许用户把Google Play Books中的已购图书直接导入Gemini Notebook进行问答和内容生成。

导入后,用户可以围绕书中材料提问,并生成计划、信息图和AI播客等内容。Google在演示中使用了Michael Pollan的《Food Rules》生成食谱,并用Kim Scott的《Radical Candor》回答管理问题。

该功能只适用于用户已经购买并可导入的图书,报道没有给出支持语言、单次可处理书目数量或完整推出范围。演示案例也不能替代对长书引用准确性和版权限制的系统评估。

来源:The Verge · Google官方博客

开源机器人Microduck售价399美元

Hugging Face推出身高约25厘米的鸭形机器人Microduck,售价399美元,计划在2026年圣诞节前发货。

Microduck可用喙举起最多800克的物体,并能行走、跌倒后起身、蹲伏和穿滚轮鞋移动。Hugging Face首席执行官Clem Delangue将其称为可通过强化学习教授新动作的“开源机器人”。

现有动作信息主要来自发布材料。公开材料没有说明具体开源范围与许可证、计算平台、续航时间或教授新动作所需的额外设备。

来源:TechCrunch · Clem Delangue

2026-08-28 AI 热点重点信号
2026-08-28 AI 热点重点信号

九凤根据本期已引用来源整理。

区域与早期信号

GLM与Kimi配置出现相同KDA门限

代码对比显示,GLM-5.3-Flash与Kimi K3均使用KDA线性注意力,并把遗忘门下界设为-5。

雷锋网称,月之暗面研究员陈广宇对比配置后发现,两款模型的KDA排布逻辑高度重合,核心参数gate_lower_bound均为-5。报道还称GLM-5.3-Flash采用混合架构,组合了稀疏注意力、KDA线性注意力和流形约束超连接,以控制长上下文中的计算与缓存成本。

这是一条基于配置文件观察的中文单源技术信号,没有训练代码、消融实验或团队说明证明两者采用相同参数的原因。报道提出线性注意力的稳定区间可能促使独立团队收敛到相近数值,因此参数一致本身不能证明技术来源关系。

来源:雷锋网

WALL-SS模拟60秒机器人操作任务

自变量机器人发布自回归世界模型WALL-SS,用于在虚拟环境中预演倒水和物品整理等长任务。

报道显示,WALL-SS可连续推演60秒,让机器人策略比较抓空、碰倒水杯或成功抓取等不同动作结果。团队共收集600对闭环虚实结果;另将30个“任务与策略版本”组合的聚合成功率进行比较,得到0.926的相关系数和0.062的平均绝对误差。600对结果中有527对的最终成败判断一致,对策略优劣关系的判断一致率为89%。

这是一条仅有中文区域媒体报道的早期信号,上述量化结果来自报道所述团队实验,尚缺少独立复现。模型在更多机器人平台、相机视角和非结构化环境中的泛化能力仍待验证。

来源:爱范儿