AI 热点资讯

Muse 正式开放,每人配一台隔离的云虚拟机

核心速览
  • •Meta 上线个人智能体 Muse,每个用户分到一台隔离的云虚拟机,底层模型 Muse Spark 1.3 同日开放调用
  • •另有 DeepSeek V4.1 Flash 限时内测、GPT-6 Astra 上架 Amazon Bedrock、Cloudera 与 Mistral 的九位数合作,以及腾讯混元流式空间记忆、蚂蚁金融模型开源与京东物流机器人军团。
jiufeng
2026年9月9日
20 分钟阅读
本文目录

概览

本期共 11 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · Muse 正式开放,每人配一台隔离的云虚拟机
  2. 重点 · V4.1 Flash 开放限时内测,换上原生多模态架构
  3. 重点 · GPT-6 Astra 在 Amazon Bedrock 正式可用
  4. Cloudera 把 Mistral 前沿模型接进企业混合数据环境
  5. 2B 模型装上流式空间记忆,空间基准超过 GPT-5

全球 AI 资讯

  1. Chrome 开发者体验老将加入 Anthropic 做 Claude Code
  2. Anthropic 预训练研究员辞职,称两家实验室都不负责任
  3. SageMaker Feature Store 支持按特征写入

区域与早期信号

  1. 蚂蚁百灵开源金融增强模型,同时放出投研评测基准
  2. 京东物流亮出机器人军团,五款新品进仓储冷链药房
  3. 国产 AI4S 计算平台亮相外滩大会,加台风追踪系统
2026-09-09 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

01/11

Muse 正式开放,每人配一台隔离的云虚拟机

Meta 把个人智能体做成常驻服务:智能体、它的浏览器和全部凭据都关在用户专属的云虚拟机里。

Meta 推出个人 AI 智能体 Muse,定位是替用户动手而不是回答问题:可以发邮件、订行程、跟商家谈账单,也能接下长期目标。关掉 App 之后它继续跑,只在需要放行时回来找人。交互围绕消息进行——用户描述任务或目标,Muse 自行规划、打开自带浏览器、填表并代为交涉;Meta 给出的示例包括把车卖出更高的价、把账单谈下来。

  • 形态:消费级服务,现已在美国的 iOS、Android 与 muse.ai 铺开,分免费档和付费档
  • 隔离:每个用户分到一台专属云虚拟机 Muse Secure VM,智能体、浏览器和凭据都隔离在其中
  • 模型:底层模型 Muse Spark 1.3 即日起可经 Meta Model API 与 Muse Code 调用
  • 权重:开放权重被 Meta 列进了路线图

局限:Muse 本身是消费服务,开发者不能自行托管;开放权重只是路线图上的表述,没有时间表;目前只在美国上线;官方没有公布任务成功率、延迟或具体价格档位。

来源:MarkTechPost · Muse on X

02/11

V4.1 Flash 开放限时内测,换上原生多模态架构

DeepSeek 用一个带过期日期的 API ID 放出 V4.1 Flash 内测通道,正式版定在 9 月 10 日。

DeepSeek 开放了 V4.1 Flash 的限时内测:API ID 直接写成 deepseek-v4.1-flash-expires-on-0910,按 V4 Flash 的价格计费,并发上限 20;这一版换了新架构,并原生支持多模态。按官方公告的口径,V4.1 Flash 经过内外部测试后,在性能、成本、速度和任务完成时间等关键指标上均超过 V4 Pro;正式发布之后、V4.1 Pro 上线之前,所有发往 Pro 的请求都会被路由到 V4.1 Flash,并按 Flash 的价格结算。

局限:内测通道 9 月 10 日到期、并发只有 20,做不了压测;「均超过 V4 Pro」是官方自述,公告里没有给出榜单名称与分数;这份公告是用户转贴到 Hacker News 的版本,候选里没有对应的官网页面可比对。

来源:Pandaily · Hacker News

03/11

GPT-6 Astra 在 Amazon Bedrock 正式可用

既能直接调 Bedrock API,也能把 ChatGPT Work 和 Codex 指向跑在 Bedrock 上的 Astra。

AWS 宣布 OpenAI 的 GPT-6 Astra 在 Amazon Bedrock 正式可用。用法有两种:通过 Bedrock API 直接调用,或者把 ChatGPT Work 与 Codex 配置成使用 Bedrock 上的 GPT-6 Astra。随本次上线,OpenAI 还为 ChatGPT Work 推出面向企业的插件,把 Astra 的浏览器操作能力扩展到常见业务应用。安全方面,AWS 称 OpenAI 已按其 Preparedness Framework 对 GPT-6 Astra 做过评估,模型侧的防护与 Bedrock 的安全、治理控制配合使用。

局限:这是 AWS 官方博客的口径,全文没有基准分数、吞吐数据或 Bedrock 上的定价;「更深的推理、更准的判断」属厂商表述,未见第三方评测;博客也没有列出可用区域清单。

来源:AWS Machine Learning Blog · OpenAI Preparedness Framework

04/11

Cloudera 把 Mistral 前沿模型接进企业混合数据环境

九位数战略合作,Mistral 的模型跟着企业数据走进本地机房与混合环境。

Cloudera 在圣保罗举办的 EVOLVE26 大会上宣布与法国模型厂商 Mistral AI 达成九位数(nine-figure)战略合作:Mistral 将把自家大模型直接集成进 Cloudera 的混合数据与 AI 平台,让模型能在云上、本地机房或混合环境中就近处理数据。Cloudera 给出的问题定义是强监管行业——这些企业想用 AI,但要把最敏感的自有数据交给外部模型很难落地。

局限:报道只说金额是「九位数」,没有披露具体数字,也没说明接入哪些 Mistral 模型、何时可用、如何计价;目前只有这一家媒体的报道,未见双方联合公告。

来源:SiliconANGLE

05/11

2B 模型装上流式空间记忆,空间基准超过 GPT-5

清华、腾讯混元与南洋理工把测试时训练用在连续视频流上,让小模型边看边维护三维记忆。

论文《Spatial-TTT: Streaming Visual-based Spatial Intelligence with Test-Time Training》被 ECCV 2026 收录,作者来自清华大学、腾讯混元与南洋理工大学。报道称该方法给 2B 模型装上「流式空间记忆」,在空间基准上超过 GPT-5。研究针对的是两个工程限制:标准 Transformer 自注意力的计算量与 KV Cache 显存随序列长度呈二次方增长,几十分钟以上的连续视频在受限硬件上撑不住;而均匀抽帧、关键帧截取这类降采样,会破坏三维空间关系依赖的连续视差与几何线索,漏掉的信息事后补不回来。团队的做法是把重心从继续拉长注意力窗口,转向让模型在推理过程中实时整合并更新三维几何记忆。

报道给出两组消融对照,都在 VSI-Bench 上评测——一组把全部自注意力层换成纯 TTT,另一组去掉空间预测机制、退回逐点线性投影:

消融配置(VSI-Bench)指标完整方法消融后
自注意力全换成纯 TTT综合成绩64.4%53.9%
去掉空间预测机制数值空间推理64.0%60.7%

局限:两组消融改的部件和统计的指标都不一样,两行数字不能直接并排比较;报道未提到权重或代码的开放计划;「超过 GPT-5」目前只有这一篇中文报道支撑,未见第三方复现。(仅中文来源)

来源:雷锋网

全球 AI 资讯

06/11

Chrome 开发者体验老将加入 Anthropic 做 Claude Code

Addy Osmani 转投 Anthropic,主攻编码智能体的易用性与信任问题。

在 Google 做了约 14 年开发者工具的 Addy Osmani 宣布加入 Anthropic,参与 Claude Code。他在 X 上说,加入是为了把 Claude Code 对开发者做得更好。他此前在 Google 负责 Chrome 的开发者体验,后来出任 Google Cloud AI 总监,经手过 Chrome DevTools、Lighthouse、PageSpeed Insights、Puppeteer、Chrome Headless 和 Core Web Vitals,还参与创建了 TodoMVC、联合发起了 Yeoman。Anthropic 此前称 Claude Code 到 5 月的年化收入已超过 25 亿美元。

局限:Osmani 没有公布职位,也没说明自己具体负责 Claude Code 的哪一块;25 亿美元是 Anthropic 自己披露的 5 月口径数字,不是经审计的财务数据。

来源:RuntimeWire · Addy Osmani on X

07/11

Anthropic 预训练研究员辞职,称两家实验室都不负责任

Jacob Coxon 在 X 上发七条帖宣布离职,结论是私营实验室无法安全地协调减速。

参与过 OpenAI 与 Anthropic 预训练工作的研究员 Jacob Coxon 周二从 Anthropic 辞职。他在 UTC 时间 9 月 9 日 00:04 发布的七条帖中写道「两家公司都没有负责任地行事」,指控 OpenAI 与 Anthropic 正竞相冲向可自我改进的超级智能、「拿我们的性命下注」,理由是前沿实验室之间的竞争正把它们推向可能无法控制的系统。他的履历就在他批评的那条线上:OpenAI 把他列为 GPT-4o 的贡献者之一、GPT-4.5 的核心研究贡献者,他还合著过 OpenAI 关于权重稀疏 Transformer 的可解释性研究。《华尔街日报》此前报道,他在 2026 年早些时候离开 OpenAI 加入 Anthropic。报道提到,这次离职发生在一连串公开披露之后——7 月 30 日 Anthropic 曾公布对三起事件的调查。

局限:这是研究员个人的单方面表态,报道中未见 OpenAI 与 Anthropic 的回应;指控没有附具体的技术证据或内部材料;他离开 OpenAI 的原因转引自《华尔街日报》,属二手信息。

来源:RuntimeWire · Jacob Coxon on X · Anthropic 事件调查

08/11

SageMaker Feature Store 支持按特征写入

新的 UpdateRecord 接口让改一个特征值不必先把整条记录读回来再写回去。

AWS 为 Amazon SageMaker Feature Store 加入特征级写入:新的 UpdateRecord API 可以在一次调用里更新一个或多个特征值,不需要读取或重写整条记录。该能力对 Standard(由 Amazon DynamoDB 支撑)和 In-Memory(由 Amazon ElastiCache 支撑)两种在线存储层都可用。在此之前,哪怕只改一个特征值也要走完整的读-改-写:先用 GetRecord 读回全部特征,在应用侧合并新值,再用 PutRecord 整条写回。

局限:官方博客给的是接口能力说明,没有公布写入延迟、吞吐或成本的前后对比数字,也未说明可用区域与是否单独计费。

来源:AWS Machine Learning Blog

2026-09-09 AI 热点重点信号

九凤根据本期已引用来源整理。

区域与早期信号

09/11

蚂蚁百灵开源金融增强模型,同时放出投研评测基准

Ling-3.0-flash-Fin 对准投研工作流,配套开放金融搜索 Agent 基准 FinFIRST。

外滩大会前夕,蚂蚁集团百灵发布首个金融增强开放模型 Ling-3.0-flash-Fin 并已正式开源,同时开放金融搜索 Agent 评测基准 FinFIRST。模型基于 Ling-3.0-flash,通过金融语料持续预训练、领域后训练与工具使用优化,重点强化信息检索、研究推理、估值建模与研报撰写四项能力,对应的是从找资料、验信息到做计算、建模型、出研究成果的完整投研链路。

  • 参数:124B 总参数、5.1B 激活参数
  • 上下文:256K
  • 可用性:已正式开源
  • 配套:金融搜索 Agent 评测基准 FinFIRST 同步开放

局限:报道没有给出模型在 FinFIRST 或其他金融基准上的分数与对照模型,也未说明开源许可与权重地址;估值建模这类能力目前只有厂商自述,缺少第三方验证。(仅中文来源)

来源:量子位

10/11

京东物流亮出机器人军团,五款新品进仓储冷链药房

「超脑」大模型负责调度,「狼族」11 款机器人已覆盖仓储、分拣、配送。

9 月 9 日的 JDD 京东全球科技探索者大会上,京东物流展示了「超脑+狼族」机器人应用军团的全阵容:「超脑」大模型负责供应链复杂场景下的决策与调度,「狼族」已在仓储、分拣、配送等环节落地 9 款产品、11 款机器人,本次新推出 5 款产品与技术。京东物流同时提出 5 年内采购 300 万台机器人、100 万台无人车与 10 万架无人机。

三款新品的自评指标:

  • 仓狼(仓内移动拣选):称 2 周部署、无需改造现有仓库;拣选准确率 99.9%、整仓商品覆盖率超过 85%、UPPH 80 件
  • 低温版智狼(冷链料箱货到人):面向零下 20℃ 冷库,配主动除霜与 100% 无接触供电;称存储能力提升 100%、作业效率提升 200%、单均降本 10%
  • 母狼健康版(无人药房):支持混批次、混 SKU 存储,7×24 小时无人值守;称 100% 合规溯源、99.9% 发药准确率,每小时打包 90 单

局限:以上数字全部来自京东在自家大会上的披露,没有第三方验证;300 万台是 5 年采购计划而非已交付量;报道也未说明各机型已落地的仓库数量与规模。(仅中文来源)

来源:InfoQ 中文

11/11

国产 AI4S 计算平台亮相外滩大会,加台风追踪系统

太初元碁以自研异构众核 AI 芯片做底座,兼容龙芯、申威、飞腾与 x86。

9 月 9 日在上海举办的 2026 Inclusion·外滩大会上,太初(杭州)集成电路展出了今年 7 月上线的国产 AI4S 计算平台,面向气象预测、生物医药、量子力学、化学材料、流体力学等领域。平台以自研异构众核 AI 芯片为算力底座,覆盖硬件、基础组件、加速库、模型框架到开发套件的全链路,兼容龙芯、申威、飞腾与 x86 等 CPU,适配 PyTorch、JAX、飞桨、MindSpore 等框架,并配 DevKit 开发套件。此次首次公开的更新是 TecoWeatherNext 台风追踪系统,把气象数据获取、AI 预报与台风识别接成一条流程,适配国产气象大模型,可叠加台风轨迹与风场、海平面气压、温度、降水等图层。公司称已联合近 20 家高校、科研机构与企业发起「AI4S 国产算力创新生态校企共建倡议」。

局限:稿件是参展介绍,没有给出芯片型号、算力指标或与主流 GPU 的性能、成本对比;台风追踪系统也未公布预报精度或与业务气象系统的对照结果。(仅中文来源)

来源:量子位

用 JIUFENG 自己生成一张

在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。

免费生成图片