概览
本期共 9 条,前 3 条为今日重点;正文按板块展开。
热门模型动态
- 重点 · jina-ocr-v1 开放权重,3.4B 总参每 token 激活 570M
- 重点 · Claude Code 认 AGENTS.md,仓库没有 CLAUDE.md 时兜底
- 重点 · Kimi K3 上架 Amazon Bedrock,2.8 万亿参数
- Grok Voice Transcribe 2.0 发布,Loom 全量转写接它
全球 AI 资讯
- Anthropic 请埃森哲进驻做嵌入式评估,双方各投至少 10 亿美元
- ChatGPT 桌面端内置浏览器支持 Chrome 扩展
- Meta 的 Muse 上 Mac,可直接动本机文件与邮件
区域与早期信号
- 微软内部备忘录被引入《纽约时报》诉讼简报
- 无问芯穹与华环电子签框架协议,做国产异构算力基建

九凤根据本期已引用来源整理。
热门模型动态
01/09
jina-ocr-v1 开放权重,3.4B 总参每 token 激活 570M
一句话结论:Jina AI 放出端到端文档解析模型,OmniDocBench v1.6 拿到 91.14,权重按 CC BY-NC 4.0 发布。
Jina AI(已并入 Elastic)发布 jina-ocr-v1,把 PDF、扫描件、表格、图表和发票一次转成 Markdown。模型在 DeepSeek-OCR 上做后训练,保留了后者的两个效率组件。具体规格:
- 参数:总参 3.4B,解码器每 token 约激活 570M;投机解码头直接打包在检查点里
- 视觉编码器:DeepEncoder 约 380M 参数,串起 SAM、16 倍卷积压缩器与 CLIP-L,把 1024×1024 的页面视图从 4096 个 patch 压到 256 个视觉 token
- 动态分辨率:在此之上最多再加 9 张局部图块,每块 100 token
- 部署:BF16 权重约 6.8 GB,可跑在 Transformers 或 vLLM 上,目标硬件是 NVIDIA L4 这类低预算 GPU

图片来源:huggingface;已转存至九凤 R2。
来源同时给出与其他解析模型的并排对比:
| 模型 | OmniDocBench v1.6 | olmOCR-Bench |
|---|---|---|
| jina-ocr-v1 | 91.14 | 83.4 |
| PaddleOCR-VL-1.6 | 96.34 | — |
| HunyuanOCR-1.5 | 94.74 | — |
| chandra-ocr-2 | — | 85.8 |
| dots.mocr | — | 83.9 |
局限:权重采用 CC BY-NC 4.0,只覆盖研究与非商业用途,商用需要先联系 Jina AI。来源明说这个模型的准确率并不领先——OmniDocBench v1.6 上 PaddleOCR-VL-1.6 与 HunyuanOCR-1.5 都排在它前面,olmOCR-Bench 上 chandra-ocr-2 与 dots.mocr 也都比它高;它的卖点在小体积与低成本部署,不是榜单第一。
来源:MarkTechPost · 技术报告 · 开放权重 · OmniDocBench
02/09
Claude Code 认 AGENTS.md,仓库没有 CLAUDE.md 时兜底
一句话结论:2.1.277 版起,仓库里找不到 CLAUDE.md 时 Claude Code 会改读 AGENTS.md,同一个仓库跑多个编码智能体不用再维护两份规则。
Anthropic 于 9 月 18 日给 Claude Code 加上 AGENTS.md 支持,Claude Code 团队工程师 Thariq Shihipar(@trq212)随 2.1.277 版本宣布了这项改动,官方发布说明确认 AGENTS.md 会在项目没有 CLAUDE.md 时作为回退,用户可以在 /config 的「Project instructions」设置里改这个行为。AGENTS.md 以标准 Markdown 给出构建命令、测试要求、代码规范等常驻指令;此前在同一个仓库里用 Codex、Cursor 或 Gemini CLI 的团队,得另外维护一份 CLAUDE.md、用 import 或别的绕法,才能把同一套规则喂给 Claude Code。
局限:已有的 CLAUDE.md 仍然优先,AGENTS.md 只在缺省时生效。报道同时提到,这次实现预告了 Anthropic 尚未正式推出的 mod 机制。
来源:RuntimeWire · 发布说明 · Thariq Shihipar 的 X 帖
03/09
Kimi K3 上架 Amazon Bedrock,2.8 万亿参数
一句话结论:月之暗面的 Kimi K3 在 Amazon Bedrock 可用,是该平台上第一个支持显式 prompt 缓存的开放权重模型。
AWS 宣布 Kimi K3 登陆 Amazon Bedrock,定位是编码与知识类工作的开放权重选项:
- 参数:Moonshot AI 称 K3 是其最强模型,也是首个达到 2.8 万亿参数的开放模型
- 上下文与模态:原生视觉能力,100 万 token 上下文窗口
- 效率:相对 Kimi K2,扩展效率约提升 2.5 倍
- 平台能力:Bedrock 上第一个支持显式 prompt caching 的开放权重模型,跨调用复用上下文时可降低延迟与输入成本
- 上手:AWS 同时放出 Moonshot AI on AWS 示例仓库
局限:参数量与 2.5 倍效率提升都是 Moonshot AI 的口径,AWS 的博文没有给出独立评测。prompt 缓存需要显式开启,不是默认行为。
来源:AWS Machine Learning Blog · Moonshot 官方说明 · 示例仓库
04/09
Grok Voice Transcribe 2.0 发布,Loom 全量转写接它
一句话结论:SpaceXAI 把语音转写模型升到 2.0,价格维持不变,Atlassian 的 Loom 已用它转写所有视频。
SpaceXAI 于 9 月 18 日发布 Grok Voice Transcribe 2.0,官方称语音识别准确率提升 2 倍。据发布说明,模型 9 月 17 日先通过 API 上线,次日才公开发布;已有的语音转文字集成不改代码即可切到 2.0。定价保持原样:
| 档位 | 每小时价格 |
|---|---|
| 批量转写 | $0.10 |
| 流式转写 | $0.20 |
局限:2 倍准确率是 SpaceXAI 自己的说法。来源里能对上的第三方依据只有 Artificial Analysis 的流式转写榜单——SpaceXAI 称在 32 个流式模型中准确率第一,而该榜单页面自述覆盖的是 33 个模型中的 27 个,按 WER 方法学排名;这个独立榜单最多支持「在这张榜上领先」,证实不了「比 1.0 准确两倍」。SpaceXAI 还计划在未来几周把 2.0 设为默认并弃用 1.0,开发者只能临时把模型 pin 在旧版本上。
来源:RuntimeWire · SpaceXAI 公告 · 发布说明
全球 AI 资讯
05/09
Anthropic 请埃森哲进驻做嵌入式评估,双方各投至少 10 亿美元
一句话结论:Anthropic 的第一家嵌入式评估方是埃森哲,由其今年 1 月收购的 Faculty 团队进场做红队与对齐评估。
Anthropic 于 9 月 18 日公告,与埃森哲合作开展前沿 AI 的独立评估,工作由埃森哲的专业 AI 业务 Faculty 牵头,内容包括评估与红队测试模型、做对齐评估、测试模型防护。双方各预计在未来五年为此投入至少 10 亿美元。Anthropic 把这件事定位为兑现其 CEO 文章《We Must Pace the Frontier》里的承诺:与今天的外部评估者不同,嵌入式评估者在 AI 公司内部工作,访问权限接近员工,能看到模型在训练中成形、跟进决定模型如何构建的决策。
局限:Anthropic 自己承认嵌入式评估是新事物,许多运作细节仍在敲定。TechCrunch 对承接方提出疑问,认为这将是这家技术咨询公司风险最高的一次咨询项目。
来源:Anthropic 公告 · TechCrunch
06/09
ChatGPT 桌面端内置浏览器支持 Chrome 扩展
一句话结论:OpenAI 让用户在 ChatGPT 桌面应用的内置浏览器里装 Chrome 扩展,但称智能体接触不到扩展及其数据。
James Sun(@JamesZmSun)称,9 月 18 日 ChatGPT 桌面应用内置的浏览器开始支持 Chrome 扩展,用户可以直接安装并固定扩展,不用把工作挪到另一个浏览器窗口。他举的例子是 1Password —— 把密码管理放进同一个窗口,用户在这里可以让 ChatGPT 浏览网页、跨标签页干活、完成任务。
局限:扩展必须在 ChatGPT 的浏览器里单独装一遍。OpenAI 的内置浏览器文档说明,它维护自己的浏览器状态,不继承用户 Chrome 的配置、cookie、已登录会话或扩展;Sun 在 X 上的回帖补充说,在内置浏览器里产生的 cookie 会保留。OpenAI 称 ChatGPT 的智能体不能与扩展或其数据交互,报道认为这条智能体—扩展边界会决定这项便利能不能通过企业安全评审。
来源:RuntimeWire · OpenAI 内置浏览器文档
07/09
Meta 的 Muse 上 Mac,可直接动本机文件与邮件
一句话结论:Muse 桌面版登陆 Mac,能在原生应用里操作文件、信息、日历、备忘录和邮件。
Meta 的 AI 助手应用 Muse 现已在 Mac 上可用。据 Alexandr Wang 9 月 17 日的 X 帖子,在 Mac 上 Muse 可以在文件、信息、日历、备忘录、邮件的原生应用内直接交互并代为执行操作。此前 Muse 在本月早些时候先上了移动端与网页版,当时迅速冲到美国 App Store 榜首。
局限:Muse 能碰哪些东西由用户按选择加入逐项授权;Meta 称在执行敏感操作前一定会先征求用户批准。报道没有给出 Mac 版的可用地区与系统要求。
来源:TechCrunch · Alexandr Wang 的 X 帖
区域与早期信号
08/09
微软内部备忘录被引入《纽约时报》诉讼简报
一句话结论:《纽约时报》申请简易判决时提交的法律摘要,引用了微软和 OpenAI 的内部材料,其中一份备忘录把训练数据的取用称作「人类历史上规模最大的劳动成果盗窃」。
据 Tom's Hardware 9 月 18 日报道(IT之家中文转述),在《纽约时报》起诉微软与 OpenAI 的版权纠纷中,原告已向法院申请简易判决并同时递交法律摘要。摘要引用微软应用科学总监 Brent Hecht 2023 年 1 月的内部备忘录,其中写道「全球数百万人很快就会认为,大型模型『吞噬』他们所有的劳动成果是一种前所未有的惊人盗窃」;另一份微软文件称「几乎没有人希望自己创作的内容被以这种方式使用,他们也没有因此获得任何补偿」。摘要还援引微软自身数据:与 Bing 搜索相比,Copilot 让《纽约时报》的点击率最高下降 93%。OpenAI 的 ChatGPT 负责人 Nick Turley 在内部沟通中称 AI 聊天机器人对出版商构成「生存威胁」,因为它们「在很大程度上是替代性的」。
局限:这些引文出自原告选择性提交的法律摘要,报道中没有被告方的回应。简易判决只是一种裁决程序,法院可以批准、驳回或部分批准,获批也不代表所有关联争议均已结束。本条只有中文来源转述英文媒体报道,原始法庭文件未给出公开链接。
来源:IT之家
09/09
无问芯穹与华环电子签框架协议,做国产异构算力基建
一句话结论:两家清华系公司签署战略合作框架协议,把异构算力调度与光传输网络拼成智算中心的端到端方案。
据量子位报道,9 月 17 日无问芯穹与华环电子签署战略合作框架协议:无问芯穹出异构算力管理与 AI 软件平台,华环电子出网络通信、硬件研发与工程实施运维,双方拟联合推进智算中心的方案设计、软硬件适配、集成交付与运行维护。报道给出的数字是:无问芯穹面向异构集群的大模型跨域训练系统已在全国部署触达超 37,000P 算力、覆盖 16 种主流芯片,其 Agentic MaaS 平台过去一年推动推理成本下降 10 倍;华环电子做光传输 30 余年,设备长期服务中国移动、中国电信、中国联通。
局限:这只是框架协议,公开信息里没有金额、时间表和首批落地项目。超 37,000P 算力、16 种芯片与成本下降 10 倍均为无问芯穹自述,报道没有第三方核验,「37,000P」也没有注明精度口径。本条只有中文来源。
来源:量子位
在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。
免费生成图片

