← Back to ai-frontier

"2026-07-20 AI 前沿速递"

本期覆盖:模型价格战 · 行业动态 · 融资与基建 · 学术研究 · 政策与监管


一、🚀 大模型与价格战

1. 三巨头同日发新模型,价格战全面爆发

7 月初,SpaceXAI(Grok 4.5)、OpenAI(GPT-5.6)和 Meta(Muse Spark 1.1)在 24 小时内相继发布新旗舰模型,核心特征不是能力提升,而是激进定价

模型 输入价格 ($/M tokens) 输出价格 ($/M tokens)
Grok 4.5 $2 $6
GPT-5.6 Luna(小型) $1 $6
Muse Spark 1.1 $1.25 $4.25
对比:Claude Opus 4.8 $25
对比:GPT-5.6 Sol(旗舰) $30

新模型以 80% 的能力、5% 的成本 冲击市场,模型厂商竞争从基准分数转向单位经济和 token 效率。

2. Anthropic 的防御性出牌

同日,Anthropic 重置了 Claude 所有用户的 5 小时和每周速率限制,意在以稳定性和深度集成的编码能力留住开发者,避免被价格战带走市场份额。

3. Meta 战略转向:开源模型时代的终结?

Meta 发布了首个 付费闭源模型 Muse Spark 1.1,配备 100 万 token 上下文窗口、并行子代理能力,可代表用户操作桌面/移动/浏览器界面。Meta 认为,开源前沿模型在经济上已不可持续——推理基础设施成本太高。开源社区将寄望于 DeepSeek 和 GLM-5.2 填补空缺。


二、🔬 今日要闻(7月20日)

4. Moonshot Kimi K3 因需求暴增暂停新订阅

7 月 19 日,Moonshot 在 X 上宣布,2.8T 参数的 Kimi K3 在过去 48 小时内需求逼近 GPU 容量上限。为保护现有订阅用户,暂时停止新订阅,同时扩充 GPU 容量。未来将拆分两层会员:Kimi Membership(Web/App/Work)和 Kimi Code Membership(编码工作流)。

同时,Kimi K3 在 7 月 18 日新增了三档推理力度(low/high/max),开发者可灵活权衡计算成本与响应延迟。

5. Hugging Face 遭入侵,安全团队被迫使用中国模型

Hugging Face 披露上周发生 agentic AI 驱动的入侵事件。其蓝队(安全团队)在分析攻击命令时,先尝试使用美系前沿模型的商业 API,但被安全护栏拒绝。团队转而使用开源中国模型 GLM-5.2 在自己的基础设施上运行。这一事件引发了关于 AI 安全护栏对防御者影响的广泛讨论。

6. Current AI 获 4 亿美元打造公共 AI 基础设施

由 CEO Ayah Bdeir 领导的 Current AI 获得 4 亿美元承诺资金,包括法国政府 1 亿美元及福特基金会、麦克阿瑟基金会、DeepMind 和 Salesforce 的出资。项目包括: - Alpha Chat:开源聊天机器人(与 Hugging Face、Mozilla、MIT Media Lab 合作) - Suno Sutra:支持 22 种印度语言的离线设备

7. 蚂蚁集团发布 Agentar 2.0

在上海 WAIC 上,蚂蚁数字科技发布 Agentar 2.0,配备 200 个预配置的"数字专家模板"和数百个开箱即用的代理工具,定位为工作流重构而非任务加速。腾讯、阿里、百度也在 WAIC 上展示了各自的企业级 agent 产品。

8. 欧盟命令 Google 向 AI 竞争对手开放 Android

欧盟要求 Google 开放 Android 系统,允许 AI 竞争对手接入。同时,Google Gemini 再次出现失误,Oracle 为 Stargate 项目裁员 3 万人。

9. AI 建议降低决策准确率

一项研究显示:AI 建议将用户准确率从 27% 降至 9%,"不知道"回答从 44% 降至 3%,而自信度从 30% 飙升至 76%。Wharton 称"认知投降"率约 80%。AI 建议在让人感觉更确定的同时,系统性地降低了决策质量。

10. Shopify 禁止工程师使用廉价 AI 模型

WSJ 报道,Shopify 要求全工程团队使用前沿 AI 模型,禁止使用廉价替代品。企业 AI 策略正在分裂为两派:成本缩减派(路由到蒸馏/开源模型)和质量最大化派(为 Opus/GPT 级推理付费)。


三、💰 融资与算力基建

11. DeepSeek 自研推理芯片

7 月 7 日路透社报道,DeepSeek 正在自研 AI 推理芯片,以减少对 NVIDIA 和华为的依赖。项目已推进约一年,处于早期阶段,正在与芯片设计公司、代工厂和内存供应商洽谈。但美国出口管制仍限制其获得先进制程制造和 HBM 内存。

12. OpenAI 与 Broadcom 的 "Jalapeño" 芯片流片

从设计到流片仅用 9 个月,专为 LLM 推理工作负载设计,目标提升每瓦性能。

13. Reflection AI 锁定 63 亿美元算力合约

Reflection AI 在 SpaceX 的 Colossus 2 设施激活了 63 亿美元算力租赁,锁定 NVIDIA GB300 芯片至 2029 年,用于训练美国开源前沿模型。

14. 8090 Labs 完成 1.35 亿美元 A 轮融资

由 Salesforce Ventures 领投,其"软件工厂"平台在 EY 的推广使软件开发效率提升 70%。


四、📚 学术与技术突破

15. Meta 脑机接口:Brain2Qwerty v2 准确率跃升至 61%

从非侵入式 MEG 脑信号转换文本,准确率从早期的 8% 跃升至 61%,进展远超预期。

16. 小模型通过后训练超越前沿

瑞典医疗考试基准 MedQA-SWE 上,Qwen3.5-4B 通过 RLVR 强化学习达 86.7% 准确率,MedGemma-1.5-4B 从 14.6% 提升至 60.8%。证明小模型 + 定向后训练可匹敌前沿性能。

17. Google TabFM:零样本表格数据模型

无需任务特定训练或手动特征工程,即可处理分类和回归任务。


五、🏛️ 政策与行业趋势

18. 联邦机构 AI 执行令截止

联邦机构 7 月 2 日截止日前完成 AI 执行令要求,前沿模型访问更趋严格——ID 验证、受限预览、水印和计量使用。

19. AI 重塑入门级岗位

FT 报道,企业正在重新设计招聘流程、培训计划和工作文化,围绕 AI 重塑初级专业服务岗位,而非简单裁员。


来源:Kersai、AI Release Tracker、AI Apps、AI Weekly、Second Talent、The Stack、WSJ 等