← Back to ai-frontier

"2026-09-15 AI 前沿速递"

📌 头条

1. 苹果新一代 Apple Intelligence 上线:Siri AI 换代,欧盟中国暂不可用

苹果随 iOS 27 / iPadOS 27 / macOS 27 正式发布新一代 Apple Intelligence,端出被彻底重构的 Siri AI,以英文测试版推出,下月扩展到法语、日语、韩语、葡萄牙语和西班牙语。

  • 个人语境理解:能从信息、邮件、照片里翻出你要的东西——问某位家人探访时提议了什么活动,Siri 会翻聊天记录找线索,再从相关邮件里调出烹饪步骤,最后把食材加进提醒事项购物清单。
  • 屏幕感知:浏览球队网站时,可让它找出所有主场比赛并直接加进日历;配合全网知识查比分、规划度假。
  • 跨设备续聊:全新专属 Siri 应用通过 iCloud 私密同步对话历史,iPhone 上开的头可在 Mac、iPad、Apple Watch 或 Vision Pro 上继续。
  • 架构:新一代 Apple Foundation Models 与 Google 及其 Gemini 模型合作定制构建,在设备端和 Private Cloud Compute 上运行;Siri 通过系统编排器调用 Spotlight 索引和 App Toolbox。
  • 限制:Siri AI 初期不在欧盟的 iOS/iPadOS/watchOS 提供;在中国处理监管要求期间,Siri AI 及其他全新功能也不会推出。依赖服务器端模型的功能受每日额度限制,未来将提供付费扩展;Siri AI 不向 13 岁以下用户开放。(AIbase / Apple Newsroom)

2. GPT-6 Astra 登顶 Vending-Bench2:模拟经营售货机一年赚 1.5 万美元,碾压 Claude 近 3 倍

Andon Labs 的 Vending-Bench2 给出耐人寻味的成绩单:AI 拿 500 美元启动资金,经营一台模拟自动售货机整整一年。 - GPT-6 Astra 平均最终账户余额冲到 15515 美元,首次登顶——最差一轮成绩都比 Claude Fable 5.1 最好一轮还高。 - 差距不在"聪明",而在长期执行力:Astra 能长期把采购价压在低位,曾把报价砍到原价约 48%,且全程规则执行稳定、没有预付款损失;Fable 采购成本持续上涨,还因没坚持规则产生大量预付款损失。 - 三人竞技测试中,Astra 拒绝了违规协作邀请,赢下全部 3 轮。看点在于 Agent 长期自主性:能否在漫长周期里持续守规则、把正确判断转化为正确行动,才是下一道门槛。(AIbase / Andon Labs)

3. Anthropic 两条线索:内部"核武级"模型 2 号曝光,Opus 5.2 悄然灰度

  • Opus 5.2 灰度上线:今日清晨在 Claude Code 开启灰度测试,开发者反馈与网页版 Opus 5 差异明显,抓包发现后端模型 slug 已指向 Opus 5.2——尚未官宣的新版本已跑在部分开发者真实工作流里。反馈称"响应更快,还治好了'偷懒病'"。
  • 内部风险报告:同期流传的报告显示 Anthropic 内部正在动用一款尚未发布的"核武器级别"Model 2,已接管公司大部分代码编写工作,据称将替代 85% 的研究团队。两条线索指向同一件事:模型迭代节奏加快,"写代码"的接管深度超出外界想象。(AIbase)

4. OpenAI 据报逾 3 亿美元收购手机摄像头厂商 Glass Imaging

据《华尔街日报》,OpenAI 正以超过 3 亿美元收购智能手机摄像头制造商 Glass Imaging。 - Glass Imaging 2019 年成立,总部加州洛斯阿尔托斯,此前累计融资约 3000 万美元;创始人是前苹果工程师 Ziv Attar 和 Tom Bishop,两人曾领导苹果人像模式相关团队。 - 技术核心:用神经网络学习不同摄像头系统的成像特性,按下快门时直接改善画质,而非拍摄后 AI 修图,以突破手机摄像头物理尺寸限制。 - 与 OpenAI 硬件战略呼应:据报道其正研发智能手机、耳机和 AI 伴侣设备;2025 年 Sam Altman 与 Jony Ive 合作,并随后以 65 亿美元收购 Ive 旗下公司组建 io。(AIbase / WSJ)

5. Andon Labs 发布 Pion:一个"自主运营任何公司"的智能体

Andon Labs 正式发布 Pion——一个旨在完全自主运营一家公司的智能体,并开放 waitlist 让更多人实验"自治生意"。 - Pion 源于其研究近两年的问题:AI 何时能在真实世界自主获取资源?之后会发生什么? - 路径演进:先做 Vending-Bench 模拟,发现模拟无法还原真实世界行为,于是把智能体部署去跑真实生意——先是售货机,然后是商店、咖啡馆…… - 回看 Vending-Bench 的进展:2024 年底所有模型都无法串联多个动作,最好的 Claude Sonnet 3.5 曾因以为银行账户被黑而打电话给 FBI;2025 年 5 月 Claude Opus 4 成为首个击败人类基线的模型,此后分数持续攀升从未见顶。(Andon Labs)

🧠 技术趋势(开源 / 安全 / 生态)

6. 蚂蚁开源 SingProbe:内生式安全护栏,计算开销不足 0.5%

蚂蚁集团 AI 安全实验室开源大模型内生式安全护栏技术 SingProbe,区别于主流"外挂式"安全审核模式: - 复用基座模型推理过程中的隐藏状态,以不足 0.5% 的额外计算开销实现 token 级实时风险评估; - 可同步完成意图分类、安全检测和幻觉识别,在医疗等高风险场景优势突出,能在内容输出前实施毫秒级阻断; - 已适配 29 个主流大模型,是首个由大型科技企业开源的完整内生式安全技术解决方案,开源代码和预训练模型已同步发布。(AIbase)

7. 蓝虫具身发布模块化人形机器人"小白",0.98 万元起售

西安交大科技成果转化企业蓝虫具身 9 月 14 日发布新一代模块化人形机器人 Mantis Standard"小白",起售价仅 0.98 万元。 - 底盘、手臂、腰部、头部均采用标准模块设计,快装接口实现机械与电气连接,可灵活变身为多种形态。 - 参数:整机高 1.4 米,22 个全身自由度,单臂负载 7kg,臂展 663mm,遥操延迟低于 10ms,腰部升降范围 550mm;底盘 3 自由度全向移动,前进速度 3m/s,续航 3 小时。 - 已全面接入主流具身开发生态,提供工具、教程与项目技术支持,意图压低从算法实验室到实际任务的实践门槛。(AIbase)

8. OpenAI 人工审核机制曝光:你的 ChatGPT 对话可能被真人看过

404Media 调查显示,OpenAI 雇佣数百名合同工审核真实 ChatGPT 用户对话,以改进回复质量。 - 审核人员对回复按 1 至 7 分评分,重点解决过度奉承及过度拟人化问题;合同工由 Crossing Hurdles 招募,由 AI 培训公司 Mercor 支付薪酬,一名北美评论员称时薪超 50 美元。 - 经匿名化处理的对话仍可能含敏感个人信息,OpenAI 承认隐私过滤器可能误判。默认开启"为所有人改进模型"设置,用户可关闭以阻止新对话用于训练及人工审核;临时聊天模式不使用输入数据训练。 - 该机制并非近期才披露——FAQ 至少自 2023 年起就说明授权人员可能查看用户数据,并建议不要输入敏感信息。Anthropic 也确认对启用相关隐私设置的 Claude 对话进行人工审核(审核前匿名化),谷歌同样允许人工审核员检查部分 Gemini 聊天记录。(AIbase / 404Media)

💡 行业洞见

9. "放缓 AI"之争白热化:Anthropic CEO 呼吁刹车,黄仁勋与白宫齐声反对

  • Anthropic CEO Dario Amodei 上周末发文呼吁企业放缓 AI 发展步伐,并建议美国政府给予 Anthropic 及其竞争对手反垄断豁免,以便就协调放缓所需的"安全对话"进行沟通。
  • 白宫科技顾问、总统科技顾问委员会联合主席 David Sacks 抨击该文:顶级 AI 公司应当自己制造安全产品,必要时按自己的进度推进,无需政府干预;他指出大 AI 公司因模型面临产品责任,若制造不安全技术可能面临民事甚至刑事风险,并炮轰"别再假装你们放缓发展的动机完全出于'对别人好'"。
  • 黄仁勋在 All-In Summit 与特朗普通话(现场外放)时明确反对"放慢"AI 发展,认为该主张可能迎合不希望 AI 产业继续发展的力量;特朗普称美国不会因政治因素或中国等外部因素放缓 AI,黄仁勋表示认同。
  • 背景张力:盖洛普近期调查显示约七成美国人反对在所在地区建设数据中心,超半数担忧环境资源影响,约 20% 担忧生活成本与质量;特朗普强调需谨慎推进但不能"扼杀一个行业"。(AIbase / Bloomberg / Gallup)

10. YC 总裁 Garry Tan 反对封杀蒸馏:"什么都别做"

Anthropic 发布第二份威胁情报报告,指控中国实验室搞"非法蒸馏攻击"(隐藏身份、靠欺诈和盗取凭证套取前沿模型能力),CEO Amodei 此前已公开呼吁美国监管层打击蒸馏。Y Combinator 总裁 Garry Tan 在 CNBC 采访中站到对立面:"我会什么都不做。" - 主张:与其禁蒸馏,不如让美国开源权重实验室走"正门"——光明正大地从前沿实验室合法授权蒸馏,而非偷凭证。 - 两个论点:① 封闭模型实验室对用户"能用 API 输出做什么"的控制本身越界,"在广泛公开数据上训练出的智能,本身就应该是一种公共品";② 专有实验室训练时吃进版权材料同样没征求许可(Anthropic 15 亿美元版权和解案今年 7 月刚获批)。 - 真正驱动他的是对垄断的恐惧:"AI 的噩梦场景是最后只剩一家公司……开源权重正是制衡这种垄断的砝码。" - 但他未回答:若美国实验室敞开"正门",蒸馏出的模型再被转手流出怎么办?"门怎么开、开多大、门后有没有墙"一个都没说。(AIbase / CNBC)

11. 字节梁汝波:豆包、飞书、火山整合发力,加码企业 AI 市场

9 月 15 日 2026 飞书未来无限大会在京举办,字节跳动 CEO 梁汝波表示:大模型 Agent 进入可用阶段后,字节已把豆包、飞书、火山引擎三方力量整合,聚焦工作与生产力产品,将在企业市场投入更多资源。 - 梁汝波判断:过去 50 年 IT 经历 PC、Web、移动互联网、AI 四次高峰,AI 这一峰"高很多",且间隔 15—20 年才出现一次,故今年年度关键词定为"勇攀高峰"。 - 核心观点:"Agent、模型、协作环境三者必须紧密融合"才能产生真实价值;Agent 不能孤立存在,既要与人、工作环境和其它 Agent 协作,也受模型能力制约。约两个月前字节已把三方并入同一生产力体系。 - 三方分工:豆包工作提供智能与 Agent;飞书作为协作平台承载聊天、文档、会议、权限与组织上下文;火山引擎提供模型、算力和开发工具,支持企业搭建自有专属 Agent 再接入飞书协同。梁汝波强调:企业用 AI 不是上一套工具就够了,而是工作方式的系统变革。(AIbase / 飞书大会)


数据来源:AIbase、Apple Newsroom、Andon Labs、Hacker News、WSJ、Bloomberg、CNBC、Gallup、404Media、飞书未来无限大会。本期为 2026-09-15 汇总;涉及传闻/未官宣类信息(如 Anthropic Model 2、OpenAI 收购 Glass Imaging)已标注,待官方确认。