← Back to ai-frontier

"2026-09-19 AI 前沿速递"

📌 头条

1. Anthropic 首次量化公开 AI 研发自动化:Claude 已主导 26% 研发工作

当地时间 9 月 17 日,Anthropic 第一次以量化方式公开内部 AI 研发自动化的真实进度,数据相当扎眼:

  • 自动化比例:截至今年 8 月,Claude 已主导公司 26% 的 AI 研发工作(AL4 级:人类只给高层目标,AI 完成端到端大部分工作),而今年 2 月这一比例还不足 1%;超过 90% 的研发工作至少达到 AL3(AI 协作)水平。但尚无一例达到 AL5 完全自主,AI 始终不能脱离人类监管。
  • Agent 规模:内部 Agent 平台任意时刻约有 3 万个 AI Agent 在跑,8 月单月产生超过 10 亿次决策;这些 Agent 拥有独立于模型版本的身份标识,通过共享消息系统互相委派任务、交叉纠错。
  • 代码层面:合并入库的代码中超 80% 由 Claude 生成,工程师季度交付量达 2021-2025 年平均水平的 8 倍;AI Agent 已参与下一代 Claude 模型的迭代——即行业所说的递归自我改进(RSI)。
  • 安全监控:所有 Agent 动作执行前须过在线监控,8 月 10 亿次决策中约 0.002% 被阻止;离线监控每周标记约 10 万条对话,经分类器过滤后最高优先级约 50 条升级人工审查。7 月样本周约有 6% 的 AI 研发算力投入安全研究,仅计 AI 驱动研发则升至约 12%。
  • 行业背景:智谱创始人唐杰披露 GLM-5.3-Flash 两周内完成国产加速器全量部署,大部分工作由 GLM-5.3 驱动的 Infra Agent 完成;OpenAI 称已于 9 月初达成"自动化 AI 研究实习生"里程碑,目标 2028 年 3 月前实现自动化 AI 研究员;谷歌 DeepMind 的 AlphaEvolve 提出的电路方案已集成进下一代 TPU。
  • 信号:Anthropic 把数字摆上台面,一面是想在人类仍握主导权的窗口期让社会参与决定 AI 自我迭代节奏,另一面是给行业立下可参照的披露基准——透明度本身正在变成无声的竞争压力。(AIbase / Anthropic)

2. 白帽黑客用 Claude 攻破 OpenAI 员工 ChatGPT 账户,拿到 6500 美元赏金

据《华尔街日报》9 月 18 日报道,安全公司 Hacktron AI 的研究人员利用 Anthropic Claude 成功入侵一名 OpenAI 员工的 ChatGPT 账户,并获取了该公司私有软件代码库的文档。

  • 攻击链路:7 月 23 日,团队发现 Discourse 处理特定图像文件的漏洞(CVE-2026-45788,安全上传功能中的无限制上传漏洞,无需身份验证即可远程发起),使用面向网络安全从业者的 Claude Opus 4.8 特殊版本编写攻击代码——首次未成功;当晚 Anthropic 发布 Opus 5,次日 Claude 便找到了利用方法。
  • 意外收获:研究人员借此访问托管 OpenAI 论坛的 Discourse 服务器,拿到账户登录 token,而这些 token 在 ChatGPT 上竟然有效,其中包括 OpenAI 员工账户,还可用于访问 OpenAI 的 GitHub 服务,从而读取名为 "Monorepo" 的算法机密仓库(不含模型权重)。团队在意识到可访问敏感数据后停止了攻击。
  • 结果:OpenAI 确认发现两处问题(一处在 Discourse、一处涉及自身)并均已解决,支付 6500 美元(约 4.36 万元人民币)赏金,同时缩小社区登录 token 权限范围、撤销受影响 token 和会话。
  • 警示:Hacktron 首席技术官称"我不觉得我们比其他国家威胁者更聪明,我们只是三个拥有 Claude 和 Codex 订阅的人"。(WSJ / AIbase)

3. 吴恩达公开批评 AI 灭绝论:"更像科幻小说,而非科学"

据彭博社报道,AI 领域知名专家吴恩达对部分顶尖模型开发商研究人员的"AI 生存风险"警告提出批评:

  • 他认为这类 AI 可能导致人类灭绝的担忧更接近科幻小说,而非严谨科学结论,且可能不利于确保技术为社会带来最大益处;在 AI 热潮初期,科技行业曾通过渲染灾难性危害来加大宣传力度以影响监管走向,他担心这波公关宣传如今再次兴起、目的类似。
  • 此番争论背景是前 Anthropic / OpenAI 研究员雅各布·考克森的高调辞职,他指责两家前雇主"拿人类生命下注";随后包括 Dario Amodei、Sam Altman 在内的多位 AI 领袖呼吁放缓前沿模型开发步伐。
  • 吴恩达承认 AI 确实存在风险(包括网络安全隐患),但主张行业继续推进 AI 发展,通过受控测试、工程防护和迭代改进解决可验证的安全问题,专注实际工程问题。(Bloomberg / AIbase)

🧠 技术趋势(模型 / 开源 / 生态)

4. 智谱 GLM-5.3-FlashX 上线:最高 200 tokens/s,10 万张国产芯片撑推理

智谱 9 月 18 日端出提速型号 GLM-5.3-FlashX,官方标出最高速度 200 tokens/s。

  • 底子是此前以 "Ox Alpha" 之名先行亮相的 GLM-5.3-Flash——靠同尺寸里最能打的智能水平在海外攒了一波口碑,调用量一路爬升。
  • 需求涨得太快,智谱在10 万张国产芯片撑起的推理算力之上,继续加码 Infra 基建与推理优化,把智能、价格、速度三张牌第一次同时攥在手里。
  • API 已上线,Model Key:GLM-5.3-FlashX。(AIbase)

5. OpenAI 自研芯片 Jalapeño 由 LLM 辅助设计:架构到流片仅 20 个月

IEEE Spectrum 深度报道 OpenAI 首款 AI 加速器芯片 Jalapeño 的设计过程——这是一次"用 LLM 造芯片"的实证:

  • 性能:最高 13.4 petaflops 4-bit 算力,访问 232 GB 先进内存、带宽 15.4 TB/s;OpenAI 引用基准显示,相比其当前依赖的英伟达 GB300,端到端延迟最多降低 3.6 倍,且功耗更低。
  • 设计速度:从首个架构概念到首批流片不到 20 个月,其中从首版 RTL 到 tape-out 仅 9 个月。
  • 团队规模:硬件设计团队项目期间平均不到 100 人(不含合作方博通),目前仍约 100 人推进二代、三代设计。OpenAI 硬件副总裁 Richard Ho 称"模型给工程师装上了超能力,工程师仍是最终裁决者,但能探索多得多的路径"。
  • 分工:OpenAI 负责端到端系统设计(推理加速器、内存层级、网络),博通负责从门级起的物理设计。(IEEE Spectrum)

6. 十部门联合发文:加快 AI、量子计算等新技术赋能药物研发

工信部、国家发改委等十部门联合发布《医药工业发展"十五五"规划》:

  • 明确要加快人工智能、量子计算、超级计算、计算医学等新技术赋能药物研发,探索超限制造、太空制药、生物制造等药械生产新模式,深化基因编辑、分子精准递送、细胞编程与调控、先进组学、新一代脑机接口等前沿技术应用。
  • 提出突破人工生命体系合成、类器官与器官芯片、通用型细胞治疗、复杂再生器官、诊疗一体化放射性药物、异种移植器官等关键技术。(AIbase)

7. Anthropic 推出生命科学认证计划,三款主力模型纳入统一授权条款

Anthropic 推出生命科学认证计划,Mythos 5.1、Opus 5、Sonnet 5 三款模型均适用生命科学计划的标准使用授权条款。

  • 这意味着 Anthropic 把主力模型在生命科学场景下的使用边界与权责写进统一契约——药企、生物技术公司和科研机构用于研发、文献梳理或实验辅助时,面对的是明确划定的合规跑道。对监管敏感的生命科学行业来说,标准化授权条款往往是模型能否真正进入实验室的第一道门槛。(AIbase)

🏭 行业洞见(应用 / 商业 / 争议)

8. OpenAI、微软高管内部承认 AI 可替代新闻文章,法院文件曝光

在《纽约时报》诉 OpenAI 和微软的版权诉讼案中解封的内部文件显示:

  • 两家公司高管在私下交流中承认其 AI 工具是新闻文章的替代品;微软高管近年来也对 OpenAI 使用《纽约时报》及其他出版商的付费墙文章表示担忧。这与两家公司公开辩护立场(主张训练属合理使用)形成对比。
  • 监管风向:2026 年 9 月,美国司法部提交支持 OpenAI 的简报,认为训练 AI 模型使用版权文本通常不构成侵权——这是美国政府首次在 AI 版权诉讼中表明立场。
  • 诉讼扩大:2026 年 9 月 4 日,《西雅图时报》和《Newsday》起诉 OpenAI 和微软,要求销毁含其新闻内容的模型和数据集;6 月已有代表约 400 家地方报纸的团体提起类似诉讼。《纽约时报》CEO 明确表态:"如果他们使用我们的作品开发生成式 AI 工具,就需要与我们达成商业协议。"(Bloomberg Law / AIbase)

9. 特斯拉推送更新:豆包大模型语音助手扩至更多车型

特斯拉开始推送 2026.26.200.11 版软件更新,把豆包大模型语音助手带到更多车型:

  • 该车机语音助手需订购高级车载娱乐服务,提供多音色和角色可选。
  • 其余更新覆盖宠物模式、盲点警报氛围灯、开门预警、导航"熟路"功能、行程续航预估纳入电池老化等十余项;支持夜间自动安装。行车记录仪可永久保存本地短片,后排屏幕可同步导航与歌词,iPad 端画板支持贴纸表情并手机同步。(AIbase)

10. 千问办公接入高德门店经营专家套件,AI 帮实体店选址

千问办公宣布接入高德门店经营专家套件(选址顾问、商场洞察、门店诊断三大专家能力,共 10 项技能),9 月 18 日正式上线:

  • 选址顾问基于高德问店五维选址模型,从同行竞争、交通便利、商业成熟等维度评估,生成含市场分析、投资预算、盈亏测算及风险结论的开店立项报告;门店诊断专家基于高德时空大数据给出评分、排名与改善方案。
  • 千问办公上线一个月用户数已突破 3000 万,企业用户占比超一半。有餐饮店合伙人称在家耗 1 小时即完成地址分析。(AIbase)

11. Calibre 9.15 上新 AI 互动写作:电子书管理器变身"文字冒险游戏引擎"

开源电子书管理工具 Calibre 更新至 9.15 版,塞进一个想象力十足的新玩具——可选 AI 互动写作游戏"创建你自己的冒险":

  • 该功能默认隐藏,需用户在"首选项—工具栏和菜单"中手动请到主工具栏才激活;玩法是由 AI 在后台搭建并掌管一个虚构世界,用户通过不断输入文字推动故事前进,把"读电子书"翻转成"和 AI 一起写故事"。
  • 其他改进:高亮面板支持多选批量改样式、悬停显示笔记;侧边栏新增窗口尺寸切换按钮;封面网格可设置徽标位置。对一个以"管理书"为本分的工具来说,这版显然在往"读、写、玩"一处靠。(AIbase)

来源:AIbase、Anthropic、彭博社、华尔街日报、IEEE Spectrum、Hacker News 等