概览
本期共 12 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · Qwen-Image-2512 发布,官方称最强开源图像模型
- 重点 · Holo4 发布,27B 稠密与 35B-A3B 两档并行
- 重点 · Anthropic 与 Infosys 合作,把 Claude 接进受监管行业
- Mistral 系 4×7B MoE 的 GGUF 仓库上架 Hugging Face
全球 AI 资讯
- 英伟达开源智能体安全平台,把算力一并纳入管控
- Google Research 放出长视频联合导演,四个智能体框架接力
- 武汉法院首次把 token 用量算进侵权赔偿
- DeepSeek Harness 桌面预览包出现在官方下载站
区域与早期信号
- 16 岁研究员用 AI 机器人找出微软内部 API 认证漏洞
- 千问 App 打通夸克网盘,可在对话里查资料
- 腾讯 Marvis 改做 AI 管家,摆出四个智能体
- 豆包输入法补齐鸿蒙与 Windows,词库跨端同步

九凤根据本期已引用来源整理。
热门模型动态
01/12
Qwen-Image-2512 发布,官方称最强开源图像模型
千问在 Hugging Face 放出 Qwen-Image-2512,模型卡自述为 Qwen-Image 的 12 月更新,可在 Qwen Chat 直接试用。
模型卡把这一版定位为 Qwen-Image 的 12 月更新,列出三项改进:人物真实感、自然细节与文字渲染。官方称该版本在 AI Arena 上做了一万余轮盲测,并据此主张它是当前最强的开源图像模型。可用性方面,模型卡给出 Qwen Chat 的试用入口,并附上可直接运行的 diffusers DiffusionPipeline 调用代码。模型目录站 RuntimeWire 也记录到这个位于千问官方组织名下、任务标签为 text-to-image 的新仓库。
局限:一万余轮盲测与「最强开源模型」都是模型卡里的官方自述,没有第三方复现或独立榜单佐证。RuntimeWire 一侧只记录仓库存在,并注明这类条目描述的是公开仓库、不是推理端点。

图片来源:huggingface;已转存至九凤 R2。
来源:RuntimeWire · Hugging Face
02/12
Holo4 发布,27B 稠密与 35B-A3B 两档并行
H 公司放出新一代智能体模型 Holo4,两档规格开放权重并上线 H Models API,同步更新 Holotron4 Nano。
- 两档规格:27B 稠密模型与 35B-A3B 混合专家模型
- 可用性:官方把 Holo4 归为 open-weight,Get started 一栏同时给出可下载的模型仓库(Holo4-27B、Holo4-35B-A3B、Holotron4 Nano)与 FP16/FP8/GGUF 完整集合,H Models API 是其中一条途径
- 配套更新:同步放出 Holotron 3 的更新版本 Holotron4 Nano
- 评测口径:AutomationBench v1.0.6 上,Holo4、Qwen3.8 27B 与 Qwen3.6 35B-A3B 的分数与成本由 H 公司内部 harness 测得,其余模型用的是 AutomationBench 公开集分数
官方在 OSWorld 2.0 对比图里列出的成绩:
| 模型 | OSWorld 2.0 得分 |
|---|---|
| Holo4 27B | 61.7% |
| Holo4 35B-A3B | 30.9% |
| Opus 5.5 | 81.8% |
局限:两档 Holo4 在 OSWorld 2.0 上的成绩相差近一倍,且都低于同一张图里的 Opus 5.5。AutomationBench 上自家模型走内部 harness、别家模型用公开集分数,两组数据不能直接并排。
来源:Hugging Face Blog · AutomationBench
03/12
Anthropic 与 Infosys 合作,把 Claude 接进受监管行业
Claude 模型与 Claude Code 将接入 Infosys Topaz,覆盖电信、金融服务、制造与软件开发。
Anthropic 在官网公告中宣布与总部位于班加罗尔的 Infosys 合作开发企业级 AI 方案,技术上是把 Claude 模型和 Claude Code 接进 Infosys 的 Topaz —— 一套生成式与智能体 AI 的服务、方案与平台集合,目标是在受监管行业里加速软件开发并满足治理与透明度要求。公告给出的使用面数据是:印度是 Claude.ai 的第二大市场,当地近一半的 Claude 用量与构建应用、系统现代化、交付生产软件相关;Infosys 被列为 Anthropic 扩大印度布局后的首批伙伴之一。
局限:这一页公告标注的日期是 2026 年 2 月 17 日,今天是在 Anthropic 的新闻源里重新出现,时间点以官方页面为准。公告没有披露合同金额、分成方式或交付时间表,「受监管行业所需的治理与透明度」是双方给出的目标表述,不是已验证结果。这条目前只有 Anthropic 一方的口径。
04/12
Mistral 系 4×7B MoE 的 GGUF 仓库上架 Hugging Face
一个仓库名带 4X7B、24B 与 gguf 的 Mistral 系 MoE 模型出现在 Hugging Face,任务标签为 text-generation。
RuntimeWire 记录的仓库路径是 DavidAU/Mistral-MOE-4X7B-Dark-MultiVerse-Uncensored-Enhanced32-24B-gguf,任务标签为 text-generation,不在 mistralai 命名空间下。RuntimeWire 在条目里写明,这描述的是一个公开的模型仓库,不是可直接调用的推理端点,模型是在 Hugging Face 侧被发现的。
局限:RuntimeWire 明确标注,仓库出现并不能确定发布日期或推理可用性;它的条目只记录仓库与任务标签,不附评测、许可证或基座信息。「uncensored」只是仓库名里的字样,背后没有随附的公开安全评估数据。
来源:RuntimeWire · Hugging Face
全球 AI 资讯
05/12
英伟达开源智能体安全平台,把算力一并纳入管控
英伟达发布免费开源的 Open Agent Safety Platform,建在自家 OpenShell 之上,并集成 Sentry 管控智能体与其占用的硬件算力。
据 SiliconANGLE,英伟达在 9 月 28 日早间发布免费、开源的 Nvidia Open Agent Safety Platform,把一组工具打包给企业,用来加固智能体的安全性、加强控制权并改善治理。平台构建在英伟达开源的 OpenShell 之上,并集成 Nvidia Sentry,管控范围不止于智能体本身,还包括支撑它们运行的硬件与算力资源。报道把发布背景归为近来一连串智能体越界事件引发的警觉。
局限:目前公开的是平台构成与定位,没有第三方部署数据,也没有与既有智能体安全方案的对比。它要发挥作用的前提是企业把智能体连同底层算力一起接进这套控制面。
来源:SiliconANGLE
06/12
Google Research 放出长视频联合导演,四个智能体框架接力
面向分钟级长视频的 AI 联合导演由 4 个智能体框架组成,针对身份漂移与级联错误两类失败。
系统跑在 Gemini 与 Veo 之上,本身不生成画面,号称与底模无关、同一层可以驱动其他生成器,输出继承底模的 SynthID 水印。研究团队把长视频失败归为信用分配问题:多数智能体流水线用各自独立的手写提示串联模块,导致镜头之间服装或场景漂移,上游一个坏素材会污染之后的所有镜头。其中的 Co-Director 模块把创意规划建模成 bandit 问题。配套评测里,GenAD-Bench 覆盖 50 个品牌、200 个虚构产品下的 400 个广告场景,HardContinuityBench 专门压测场景重现与道具状态变化。
局限:这是研究框架而不是可直接调用的产品,配套基准由项目方自己给出,目前没有第三方复现。系统能力受限于底层的 Gemini 与 Veo,生成结果带 SynthID 水印。
来源:MarkTechPost
07/12
武汉法院首次把 token 用量算进侵权赔偿
在一起 AI 短剧著作权纠纷中,武汉法院把 token 消耗与 AI 工具授权费计入了损害赔偿的计算。
The Decoder 引述 National Law Review 报道:中国武汉一家法院在 AI 生成短剧的著作权纠纷中,首次把 token 用量与 AI 工具授权费纳入赔偿计算。案情是一家公司在 2026 年初用 AI 工具制作了一小时短剧并发布在微信等平台,一天后另一家公司复制该作品、换了标题并在其中插入广告。法院认定这部短剧属于受保护的视听作品,理由是员工从剧本、提示词设计、AI 输出筛选到最终剪辑每个环节都做了自己的创作判断,AI 只是工具。除 AI 相关成本外,法院还权衡了片长、传播范围与侵权持续时间,最终判赔 2 万元人民币(约 2900 美元)。
局限:这是一起地方法院的个案,赔偿额只有 2 万元;报道系转引,判决书原文未附。可版权性成立的前提是人在各环节有创作决定,不能推论成 AI 输出天然受保护。
来源:The Decoder
08/12
DeepSeek Harness 桌面预览包出现在官方下载站
download.deepseek.com 上出现了 DeepSeek Harness 的 Windows 与 macOS Electron 安装包,标注为 RC/nightly。
据 Pandaily,DeepSeek Harness 的桌面预览版在 2026 年 9 月 25 日前后出现在 download.deepseek.com,提供 Windows 与 macOS 两个平台的 Electron 打包版本。报道明确这些是 RC 或 nightly 性质的构建,而不是正式发布。
局限:目前能确认的只有下载页出现这一件事,没有官方公告、版本号、功能清单与正式发布时间;预览构建随时可能变动或下线。
来源:Pandaily
区域与早期信号
09/12
16 岁研究员用 AI 机器人找出微软内部 API 认证漏洞
微软内部分析平台 Titan 的一个查询接口不校验 JWT 签名,研究员伪造管理员令牌后可直接执行 SQL,微软赔付 5000 美元。
据 IT之家转述,16 岁安全研究员 Faav 在 9 月 25 日发博客披露:他写的 AI 机器人 Antares 于 8 月 25 日发现 Titan 的公开 API 接口,随后枚举子域名找到一台 Azure 环境的主机与对应的 Swagger/OpenAPI 文件。该文件列出 4 个路由,其中 3 个要求 Azure AD 认证,名为 /v2/Query 的接口不要求,且支持直接提交 SQL。他通过 Wayback Machine 找到 2023 年的 Titan 登录页快照,拿到含 56 个数据表定义的 Apache Superset 配置文件;Antares 又花 10 天探测 JWT 验证流程,发现服务器不校验令牌签名,于是伪造了一枚 alg 为 none、签名段为空、upn 改成 admin 的令牌,以管理员身份执行 SQL。9 月 5 日凌晨他确认可以访问 Titan 数据库,元数据规模如下:
| 记录类型 | 条数 |
|---|---|
| 账户与邮箱记录 | 约 25,000 |
| 员工邮箱记录 | 17,990 |
| 员工组织记录 | 15,001 |
| 数据库配置 | 355 |
| 虚拟数据集 SQL 定义 | 20,979 |
| 仪表盘 | 24,569 |
| 图表 | 425,891 |
他汇总多张表的记录数,估算可访问的数据规模约 17.33 万亿条。时间线上,微软在 9 月 6 日至 8 日要求他停止测试并提供 IP,以确认没有超出安全研究的行为;9 月 9 日锁定该接口;9 月 17 日发放 5000 美元赏金。微软在声明中感谢有机会调查 Faav 的发现,称协调披露有助于保护客户;报道并提到微软对他的博客内容做了编辑控制。
局限:全部技术细节来自 Faav 本人博客经中文媒体转述。17.33 万亿是他按多张表的记录数汇总出的估算,不是微软确认的数字;报道也没有提到这些数据是否曾被他人访问。
来源:IT之家
10/12
千问 App 打通夸克网盘,可在对话里查资料
授权之后,千问可以查询、整理和读取夸克网盘里的文件,并把生成内容存回网盘。
千问 App 在 9 月 28 日宣布与夸克网盘深度打通。用户在千问首页 @夸克网盘 即可调用夸克 Agent 技能处理网盘资料,比如只描述文件内容让千问去找;工作助理里也提供「夸克网盘管理」技能,可基于网盘资料完成更复杂的任务。官方给出的用法还包括用网盘照片生成海报、把对话中产生的新内容上传回网盘并生成可分享链接、按网盘里的课程讲义生成复习计划与进度看板。
局限:这些是官方介绍里的功能描述,转述报道未给出灰度范围、文件大小与调用频次限制,也没有检索准确率数据。使用前提是用户把网盘访问权限授权给千问。
来源:IT之家
11/12
腾讯 Marvis 改做 AI 管家,摆出四个智能体
腾讯把 Marvis 从 AI 助手升级为 AI 管家,围绕 PC、文件、浏览器与软件四个智能体组织,自述 PC 任务完成率约 92%。
据 Pandaily,腾讯把 Marvis 的定位从 AI 助手改为 AI 管家,功能围绕四个智能体展开:PC、文件、浏览器与软件。官方引用的数据是约 92% 的 PC 任务完成率。报道还提到后续计划让用户自行构建管家技能。
局限:92% 是厂商自述口径,报道没有给出测试任务集、样本量与对照方案。用户自建技能目前只是计划,没有时间表。
来源:Pandaily
12/12
豆包输入法补齐鸿蒙与 Windows,词库跨端同步
五平台覆盖完成,登录同一账号后个人词库实时对齐,文字和图片可在手机与电脑间直接互传。
随 HarmonyOS NEXT 与 Windows 版本补齐,豆包输入法现已覆盖 iOS、Android、HarmonyOS NEXT、macOS 与 Windows 五个平台,语音识别、大模型打字、智能文字整理与超级互传也覆盖多个平台。登录同一豆包账号后,人名、术语、项目代号、英文缩写等个人词库会在手机与电脑之间实时对齐;超级互传让文字和图片在两端直接复制粘贴,整个过程留在输入法内部,不必再开中转应用。
局限:这是单一媒体的体验稿,没有给出语音识别准确率、延迟或用户规模数据。词库同步与互传都依赖在各端登录同一个豆包账号。
来源:爱范儿
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

