概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Grok Bot测试Chrome登录态导入与本地出口
- 重点 · Gemini Omni 1.1 Flash加入场景延展与4K输出
- 重点 · GPT-5.6在印度获得境内推理支持
- 单一外部信源可改变部分购物智能体的选择
全球AI资讯 5. OpenAI客户端出现订阅额度共享代码 6. Gemini Notebook可读取已购图书 7. 开源机器人Microduck售价399美元
区域与早期信号 8. GLM与Kimi配置出现相同KDA门限 9. WALL-SS模拟60秒机器人操作任务

九凤根据本期已引用来源整理。
热门模型动态
Grok Bot测试Chrome登录态导入与本地出口
新设置可能把Chrome登录态复制到Grok Bot云端虚拟机,并让其网络流量经用户桌面设备转发。
RuntimeWire根据@blankspeaker发布的一张设置面板截图报道,界面包含“Import cookies from Chrome”和“Route egress through this desktop”两个控件,还可区分连接到智能体的本地计算机,并决定是否允许智能体在本机执行任务。Grok Bot此前已以早期测试形式上线,可在带浏览器、文件系统和终端的持久Linux虚拟机中工作。
这些控件仍处于测试阶段,尚无证据表明已向所有用户开放。导入Cookie会扩大云端计算机可访问的已认证会话范围,现有材料也未说明具体的加密、撤销和隔离机制。
来源:RuntimeWire · X原帖 · xAI文档
Gemini Omni 1.1 Flash加入场景延展与4K输出
Gemini Omni 1.1 Flash面向生成式视频增加首尾帧插值、场景延展和4K放大控制。
Google DeepMind称,该版本允许开发者延展已有场景、指定起始帧与结束帧生成过渡,并输出经过放大的4K视频。模型可通过Google AI Studio和Gemini Enterprise Agent Platform调用,这些新能力也已在Google Flow提供。
目前材料来自Google官方,未提供与其他视频模型对比的质量分数、生成时长、价格或失败率。所谓“studio-quality”属于厂商表述,现有证据不能独立验证其稳定性。
来源:Google DeepMind · Google Flow
GPT-5.6在印度获得境内推理支持
Amazon Bedrock开始通过印度地理跨区域推理提供GPT-5.6 Terra和Luna。
AWS称,具有本地数据处理要求的客户现在可以在印度使用这两款OpenAI模型,相关推理请求和数据将留在印度境内。
候选材料只有AWS官方快讯,未给出可用区域清单、价格、吞吐量或延迟数据,也没有独立报道核验其所述的数据驻留安排。
单一外部信源可改变部分购物智能体的选择
Wharton团队发现,仅增加一个外部推荐来源,就可能明显改变购物智能体的最终选择。
研究人员用ACES模拟器测试六款当前模型,让它们从固定商品网格中挑选健身手表;智能体先读取商品页截图,并可在决策前查看推荐来源。不同模型在无外部材料时已有不同偏好,而加入单一来源后,部分模型的推荐出现大幅摆动。
实验只覆盖固定商品集和健身手表任务,不能直接代表开放网络上的所有购物场景。论文材料没有证明某次推荐一定错误,但显示智能体的购买决定对检索上下文并不稳定。
来源:The Decoder · ACES论文
全球AI资讯
OpenAI客户端出现订阅额度共享代码
Codex桌面客户端内的休眠代码显示,OpenAI正在准备名为ChatPass的独立订阅共享计量系统。
RuntimeWire通过逆向分析发现,客户端会从GET /wham/usage读取可选的chatpass结构,并把其中的窗口显示为“Subscription sharing”用量表。代码可识别五小时、每日和每周窗口,样例中的limit_window_seconds为604800秒,并支持同时显示任意数量的计量窗口。
测试账户的服务器端尚未启用该功能,OpenAI也没有正式公布ChatPass的对象、费用或上线时间。现有插件架构与“Sign in with ChatGPT”只说明配套基础设施已经存在,不能单独证明外部应用最终能够消耗用户订阅额度。
来源:RuntimeWire · OpenAI插件文档 · OpenAI帮助中心
Gemini Notebook可读取已购图书
“Expert Intelligence”允许用户把Google Play Books中的已购图书直接导入Gemini Notebook进行问答和内容生成。
导入后,用户可以围绕书中材料提问,并生成计划、信息图和AI播客等内容。Google在演示中使用了Michael Pollan的《Food Rules》生成食谱,并用Kim Scott的《Radical Candor》回答管理问题。
该功能只适用于用户已经购买并可导入的图书,报道没有给出支持语言、单次可处理书目数量或完整推出范围。演示案例也不能替代对长书引用准确性和版权限制的系统评估。
来源:The Verge · Google官方博客
开源机器人Microduck售价399美元
Hugging Face推出身高约25厘米的鸭形机器人Microduck,售价399美元,计划在2026年圣诞节前发货。
Microduck可用喙举起最多800克的物体,并能行走、跌倒后起身、蹲伏和穿滚轮鞋移动。Hugging Face首席执行官Clem Delangue将其称为可通过强化学习教授新动作的“开源机器人”。
现有动作信息主要来自发布材料。公开材料没有说明具体开源范围与许可证、计算平台、续航时间或教授新动作所需的额外设备。
来源:TechCrunch · Clem Delangue

九凤根据本期已引用来源整理。
区域与早期信号
GLM与Kimi配置出现相同KDA门限
代码对比显示,GLM-5.3-Flash与Kimi K3均使用KDA线性注意力,并把遗忘门下界设为-5。
雷锋网称,月之暗面研究员陈广宇对比配置后发现,两款模型的KDA排布逻辑高度重合,核心参数gate_lower_bound均为-5。报道还称GLM-5.3-Flash采用混合架构,组合了稀疏注意力、KDA线性注意力和流形约束超连接,以控制长上下文中的计算与缓存成本。
这是一条基于配置文件观察的中文单源技术信号,没有训练代码、消融实验或团队说明证明两者采用相同参数的原因。报道提出线性注意力的稳定区间可能促使独立团队收敛到相近数值,因此参数一致本身不能证明技术来源关系。
来源:雷锋网
WALL-SS模拟60秒机器人操作任务
自变量机器人发布自回归世界模型WALL-SS,用于在虚拟环境中预演倒水和物品整理等长任务。
报道显示,WALL-SS可连续推演60秒,让机器人策略比较抓空、碰倒水杯或成功抓取等不同动作结果。团队共收集600对闭环虚实结果;另将30个“任务与策略版本”组合的聚合成功率进行比较,得到0.926的相关系数和0.062的平均绝对误差。600对结果中有527对的最终成败判断一致,对策略优劣关系的判断一致率为89%。
这是一条仅有中文区域媒体报道的早期信号,上述量化结果来自报道所述团队实验,尚缺少独立复现。模型在更多机器人平台、相机视角和非结构化环境中的泛化能力仍待验证。
来源:爱范儿
获取九凤最新的 AI 模型洞察与教程。
了解更多


