AI 热点资讯

Kolibri 开源:78GB FP8 权重的德英 MoE 模型

核心速览
  • •Aleph Alpha 开放德英混合模型 Kolibri
  • •本期同时关注本地运行千问、Muse DIY 硬件、游戏开发工具与 AI 智能体落地信号。
jiufeng
2026年10月4日
12 分钟阅读
本文目录

概览

本期共 9 条,前 3 条为今日重点;正文按板块展开。

热门模型动态

  1. 重点 · Kolibri 开放 78GB FP8 权重
  2. 重点 · Mac 与 iPhone 协同预填充千问
  3. 重点 · Strata 为 Qwen3.8-Flash-Next 提供本地规格选项
  4. OpenAI 前安全员工公开批评内部文化

全球 AI 资讯

  1. Muse Gadgets 开放 ESP32 固件与 Linux SDK
  2. Capcom 把 AI 纳入 RE Engine 开发流程
  3. Cotool 把安全调查封装为可复用智能体
  4. RuntimeWire 披露 AI 新闻编辑部 30 天数据

区域与早期信号

  1. 垂直 AI 被列为私营科技增长方向
2026-10-04 AI 热点信号地图

九凤根据本期已引用来源整理。

热门模型动态

01/09

Kolibri 开放 78GB FP8 权重

Aleph Alpha 发布了德英混合 MoE 模型 Kolibri,并以 Apache 2.0 提供权重。

Aleph Alpha 于 10 月 3 日发布 Kolibri,模型卡已在 Hugging Face 提供下载。该模型为德语和英语混合的 MoE 架构。

  • 总参数量:781 亿
  • 每 token 激活参数:34.6 亿
  • 权重占用:约 78GB FP8
  • 许可证:Apache 2.0

局限:模型卡给出的最低运行配置为两张 A100 80GB GPU,本地部署门槛较高。

『来源:RuntimeWire · Hugging Face model card』

Aleph-Alpha/Kolibri-1 · Hugging Face

图片来源:huggingface;已转存至九凤 R2。

02/09

Mac 与 iPhone 协同预填充千问

一名用户用 USB-C 连接 MacBook Pro 与 iPhone 17 Pro Max,运行 Qwen3.8-27B 时预填充最高快 44%。

测试使用 M4 Pro、24GB 统一内存的 MacBook Pro 和 iPhone 17 Pro Max:Mac 负责第 1 至 40 层,手机 A19 Pro GPU 负责第 41 至 64 层。在 16K 上下文下,预填充速度从每秒 109 token 提升至 157 token;8K 档从 132 提升至 177 token。

上下文长度Mac 单机(token/s)外接 iPhone(token/s)提升
8K13217735%
16K10915744%
32K10113029%

局限:该方案是 Reddit 用户的自制开源软件;在 64K 以内,文本生成仍全部由 Mac 承担,手机不加速生成阶段。

『来源:IT之家』

03/09

Strata 为 Qwen3.8-Flash-Next 提供本地规格选项

Strata 的文档列出 Qwen3.8-Flash-Next 多种压缩版本,并把内存容量作为安装选择依据。

文档称,32GB 内存设备可选择 Coder 版本;48GB 可选择 IQ2_XS 或 Q2_0;64GB 及以上可运行全部尺寸。Coder 版本保留 512 个专家中的 256 个,按代码数据筛选,因此文档提示其通用任务和非英语能力较弱。

  • 32GB RAM:Coder
  • 48GB RAM:IQ2_XS 或 Q2_0
  • 64GB RAM:IQ2_XS、IQ3_XXS 或 IQ3_S
  • Coder 专家数:256 / 512

局限:候选中的 Claude 对比来自社区测试线索,提供的项目页面未给出三项编码任务的逐项分数,不能据此确认模型排名。

『来源:Strata 模型文档 · Qwen3.8-Flash-Next』

04/09

OpenAI 前安全员工公开批评内部文化

曾负责 OpenAI 重大模型发布安全报告的 David Robinson 已辞职,并称行业文化存在更深层问题。

The Verge 报道称,Robinson 本周离开 OpenAI,并在《大西洋月刊》评论文章中公开发声。他表示问题不只是增加规则或监管措施,批评硅谷以“极端自信”推进 AI。

局限:报道所述为一名前员工的公开批评,不是 OpenAI 对具体模型发布流程的正式说明。

『来源:The Verge』

全球 AI 资讯

05/09

Muse Gadgets 开放 ESP32 固件与 Linux SDK

Meta 推出 Apache 2.0 许可的 Muse Gadgets,让开发者用 ESP32 自制可接入 Muse 的硬件。

项目包含 ESP32 板卡固件和 Linux SDK,可将自制设备连接到 Meta 的 AI 智能体 Muse。Meta 同时制作了 USB-C 设备 Muse Home Link,可通过 HTTPS 接口控制电视、音箱等家居设备;报道称首批生产 5,000 台。

  • 开源许可证:Apache 2.0
  • 支持硬件:ESP32
  • 首批设备:5,000 台
  • 连接方式:Linux SDK 与 HTTPS 接口

局限:Home Link 将在数周内向 Muse 订阅用户免费发放,数量受库存限制;项目尚未说明第三方硬件的兼容范围。

『来源:The Decoder · Muse Gadget SDK』

06/09

Capcom 把 AI 纳入 RE Engine 开发流程

Capcom 表示将把 AI 技术整合进游戏开发工作流,以处理大型游戏制作中的耗时环节。

在 Capcom Open Conference RE: 2026 上,程序员 Satoshi Ishida 介绍 REX Project 与下一代 RE Engine 的规划。他将大型游戏制作中的重复性、耗时任务列为挑战,并表示目标是把 AI 纳入开发流程。

局限:报道没有披露具体采用的模型、上线时间、覆盖的制作环节或可量化效率数据。

『来源:The Verge』

07/09

Cotool 把安全调查封装为可复用智能体

Cotool 面向安全团队提供可配置智能体,将跨工具收集告警上下文的流程做成可复用调查任务。

RuntimeWire 报道称,Cotool 由前 Material Security 团队成员创立,产品用于自动化重复的安全调查与响应工作。该公司称产品已在 Ramp 和 EliseAI 等客户处投入生产,并曾在 2026 年 3 月完成由 a16z 领投的 740 万美元种子轮。

局限:客户使用情况和节省时间的说法主要来自公司陈述,报道明确指出仍缺少更清晰的量化与独立验证。

『来源:RuntimeWire』

08/09

RuntimeWire 披露 AI 新闻编辑部 30 天数据

RuntimeWire 称其 AI 驱动编辑部在 30 天内发布 986 篇文章,故事入选到发布的中位耗时为 36 分钟。

该平台称同期处理了 9.57 亿 token,平均每篇文章引用 6.1 个来源,并监控 77 个信息源,包括 49 个 RSS、21 个公司新闻室与 7 个 X 账号。其统计还显示,发文前 24 小时有 886 个故事经过人工策展筛选。

指标披露数值
30 天发布量986 篇
中位周转时间36 分钟
平均引用来源6.1 个/篇
监控信息源77 个

局限:以上指标来自创始人和生产数据库的自报,尚未经过独立审计;流量与收入数据尚未公布。

『来源:RuntimeWire』

区域与早期信号

09/09

垂直 AI 被列为私营科技增长方向

一场私营科技会议的与会公司将专有数据、行业工作流和专用硬件视为垂直 AI 的竞争要素。

SiliconANGLE 对 Bank of America Private Tech Trailblazers Conference 的整理称,餐饮、建筑、医疗、跨境支付和国防等场景中的公司正围绕明确行业问题部署 AI。报道将差异化归因于专有数据、垂直整合、信任和规模化所需资本。

局限:这是会议与行业观察的汇总报道,没有提供统一的产品评测或各公司可比的经营数据。

『来源:SiliconANGLE』

用 JIUFENG 自己生成一张

在浏览器里输入提示词就能出图,支持 1K / 2K / 4K,可加最多 15 张参考图。注册即送 50 次免费生成,无需信用卡。

免费生成图片