📌 头条
1. 小米开源 MiMo-V2.6:Pro 版 46 分登顶最强开源模型,RL 训练路径全公开
小米 9 月 22 日正式发布并开源新一代原生多模态模型 MiMo-V2.6(Pro / Flash),基于可验证复杂任务放大强化学习(RL)算力,并探索递归自我改进(RSI)路径:
- 成绩:MiMo-V2.6-Pro 在 Artificial Analysis 综合智能指数拿到 46 分,超越 Kimi K3 与 Qwen3.8Max,成为当前最强开源模型;多数 Agent 基准接近 Claude Opus5、GPT-5.6Sol,但仍落后最强闭源模型。
- 训练成本透明:两个模型均在 不到 6 天内完成 Live RL 训练,成本约 85 万美元 / 262 万美元,合计约 75 万条轨迹;软件工程基准 DeepSWE v1.1 分别提升约 17 / 14 分。
- 新能力:新增 3D 空间推理与计算机操作(CUA),可完成 3D 建模、机械臂控制等任务。
- 价格:延续 V2.5 定价,同智能水平下约为海外模型的 1/20 至 1/60;Flash 缓存命中仅 0.02 元。
- 开源范围:同步开放模型权重、技术报告、7k+ RL 任务环境与端到端训练框架,把大规模 RL 的路径与成本透明化,为 Agentic RL 研究提供可复现公共基础。
2. SpaceXAI 发布 Grok 4.7:推理速度翻倍、价格减半
9 月 21 日 SpaceX AI 正式发布 Grok 4.7,官方卖点直指性价比:推理速度是同级模型的 2 倍,价格仅为竞品的 一半——输入 $2 / 百万 token、输出 $6 / 百万 token,在速度与成本两端同时抬升竞争门槛。
🚀 模型 / 开源 / 技术
3. OpenAI 成立数学与 AI 顾问组:神秘模型 24 天解开 100+ 世界级难题
9 月 22 日 OpenAI 宣布成立 「数学与人工智能顾问组」,常设于普林斯顿高等研究院,由 9 位数学家组成、独立于 OpenAI 运作、不领取 OpenAI 薪酬,有权提出公司未主动征询的建议并公开评论 OpenAI 对数学的影响。
更受关注的是 OpenAI 披露:一个自 8 月 28 日以来持续训练的神秘模型,已成功解出多个数学领域100 多个长期悬而未决的开放问题,其中包括争议极大的 Navier-Stokes 千禧年难题。消息称其进展速度令公司内部数学家震惊,甚至引发内部关于「如何告知学术圈」的讨论。
4. 腾讯混元图像 3.5 preview:文本渲染更准、5 图参考、2K 图仅 0.15 元
腾讯 9 月 22 日发布 混元图像 3.5(Hy Image3.5preview),主打「便宜好用」:图像质量、排版、修图能力全面升级,文本渲染能力较上代提升约 30%,避免「缺胳膊少腿」式错字;排版理解显著增强;修图支持同时输入最多 5 张参考图做风格/元素融合,最高输出 2K。
价格极具竞争力:腾讯云 API 生成一张 2K 图仅 0.15 元,且只对成品计费、失败图不收费。内测盲测中与 Seedream5.0pro 打平。灰度期间绘图需求增长超 50%,已在元宝、ima 等腾讯系产品上线。
5. 平头哥真武 V900:算力为 M890 三倍,单集群可扩 50 万卡
2026 云栖大会上,阿里平头哥发布自研 AI 芯片 真武 V900,算力为上代真武 M890 的 3 倍;基于真武 V900 的单个集群可扩展至 50 万卡,为前沿模型训练与推理提供大规模算力支撑。阿里方面还透露,自研 M890 AI 超节点已具备支持 2 万亿参数大模型推理的能力,并于本季度在阿里云数据中心正式上线;同时开源 Qwen 2.7B 模型、推出通义手机端 AI 方案,补全端侧生态。
🏭 行业 / 商业
6. 华为云「码道」全面升级:全球首个鸿蒙专用 AI 编码 Agent
华为云 CodeArts 代码智能体面向鸿蒙开发者一次性推出三大能力:鸿蒙编码大模型、CodeArts 鸿蒙智能体、鸿蒙开发者实践中心。官方定位为全球首个、目前唯一专门面向鸿蒙生态的 AI 编码智能体,相当于给鸿蒙开发者配一个从想法到发布全程跟随的数字伙伴。鸿蒙编码大模型依托增强训练体系,在训练数据、代码生成、编译通过率与 Token 消耗等维度占优,已可投入使用;配套智能体覆盖应用开发全流程,提供 DevEco CLI 等能力。
7. 阿里任命刘大一恒为通义千问项目负责人
据两名知情员工,阿里集团已任命资深 AI 研究者刘大一恒出任 Qwen(通义千问)大模型项目负责人。云栖大会官网演讲嘉宾列表中其个人画像位置靠前,仅次于集团负责人,并明确标注其为「通义千问大模型项目负责人」。此举被视为阿里在今年多轮组织调整后,进一步厘清 Qwen 核心模型业务的负责人架构。
8. FuriosaAI 发布第三代推理加速器:2nm、32 PFLOPS、576GB HBM4
韩国 AI 半导体初创 FuriosaAI 公布其第三代 AI 推理加速器技术细节:与博通合作开发,采用两颗 2nm 计算 die、一颗独立 I/O die、12 组 HBM4(E) 显存(每组 48GB),机架内采用 SUE 全互联拓扑,支持 PCIe Gen7。芯片物理面积约为上代 RGND 的 8 倍;算力达 32 PFLOPS(32 倍),HBM 容量 576GB(12 倍),HBM 带宽 48TB/s(32 倍)。
9. 福布斯美国 40 岁以下亿万富翁:7 人靠 AI 上榜,4 人来自 Anthropic
福布斯美国 400 富豪榜显示,今年入榜门槛升至历史新高 44 亿美元;40 岁以下亿万富翁从去年 4 人猛增到 10 人,其中 7 人财富来自 AI 热潮,且多为创始人。这 7 人中 4 人出自同一家公司 Anthropic——这家成立 5 年的 AI 公司二级市场估值达 1.5 万亿美元,其 7 位联合创始人均承诺今年将个人财富的 80% 捐给慈善。其余 3 人来自 Surge AI、OpenAI、Cognition。
10. AI 眼镜上半年出货同比 +263%:无屏成主流,AR 显示增速更猛
Counterpoint Research《智能眼镜市场追踪》显示,2026 上半年全球 AI 眼镜出货量同比 +263%,多数产品不带 AR 显示,靠麦克风与扬声器交互——以 Meta Ray-Ban 为代表的无屏 AI 眼镜出货增长 258%,是市场主力。带真正 AR 显示的眼镜份额仍小,但增速高达 449%(基数低):其中 Rokid 以 41% 份额领先,Meta 以 37% 紧随,中国市场占全球 AR / AI 显示眼镜出货的 45%。随着普及加速,零部件成本上涨、摄像头与隐私担忧或成近期变量,行业已出现「无摄像头」趋势。
🌐 观点 / 国际 / 其他
- RSI(递归式自我改进)成创投热词:36氪报道,上海西岸一场活动中,清华/上交教授与从业者围绕「RSI 究竟是什么」展开讨论;此前姚顺宇也曾称 Gemini 3.8 Flash 是「RSI 的一大步」。(36氪)
- 芒果 TV「用内容做 AI」:神话题材剧《后西游记》第一季在湖南卫视与芒果 TV 双平台播出,系「广电 21 条」后首部「边审边播」剧集,AIGC 长剧首次上星,带动股价连续涨停。(36氪)
- 苹果零售先驱质疑 AI 购物 Agent:早期负责苹果零售的 Ron Johnson 认为,消费者不会在毫无体验的情况下让 AI agent 直接下单 1000–2000 美元的笔记本;AI 更适合购买前缩小选择、提供信息。Google 正通过 Universal Commerce Protocol 推 agent 电商,OpenAI 也在把 ChatGPT 变成购物平台。(AIbase)
- 宇树发布 Dex5-S 灵巧手:单手 22 自由度、1:1 人手尺寸,39900 元起,单手负载 1kg / 最大 2kg,峰值功率 200W,支持 15–65V 宽压与千兆网口/USB/485 三种接口,掌部相机可直连。(AIbase)
- HN 热榜 AI 相关:小米 MiMo v2.6(635 分)、「Attention is all you have」(626 分)、MiMo 开源讨论、「Frontier AI on Your Own Hardware」(117 分)等。(Hacker News)
来源:AIbase、Hacker News、36氪、Counterpoint Research、Business Insider / Forbes、SpaceX AI 等。 本期 web_search 不可用,改由 opencli / web_fetch 多源聚合。