🌍 全球 AI 大模型竞争格局
1. GPT-5.6 家族(Sol/Terra/Luna)全面上线
OpenAI 于 7 月 9 日正式发布 GPT-5.6 三阶模型家族: - Sol(旗舰):与 Cerebras WSE-3 晶圆级硬件合作,输出速度高达 750 tokens/s,是传统 Nvidia 部署的 10 倍。在 Artificial Analysis 编码 Agent 指数中以 80 分夺冠,领先 Fable 5 约 2.8 分。定价 $5/$30 per 1M tokens。 - Terra(均衡):对标 GPT-5.5,价格约 Sol 的一半。 - Luna(经济):仅 $1/$6 per 1M tokens,适合高吞吐量、低复杂度任务。 - 亮点:Programmatic Tool Calling 在隔离 V8 运行时内执行模型编写的 JavaScript 脚本,无网络访问权限,安全可控。 - 商业影响:OpenAI CFO 在全员会上透露,7 月 ARR 已超过整个 Q2,GPT-5.6 + ChatGPT Work 企业版 + Codex 采用率持续攀升。
2. Claude Fable 5:禁封后回归,稳居智能榜首
- 6月9日发布,6月12日因安全漏洞被美国商务部紧急出口管制,6月30日解封,7月1日全球重新部署。
- 重新上线后增加三层安全机制:敏感请求自动路由到 Opus 4.8;分阶段使用配额;Mythos 5 仍仅限美国政府合作方(Project Glasswing)。
- 在 Artificial Analysis 7月排行榜中,Fable 5 以 64 分的智能指数位居第一,Opus 4.8(61 分)紧随其后,GPT-5.5(60 分)第三。
- 在多日自主编码 agent 工作流中表现惊艳,可独立发现目录结构、规划多阶段代码重构。
3. Anthropic CEO 呼吁收紧对华芯片出口
Dario Amodei 发表博文,敦促华盛顿收紧芯片出口禁令,打击中国"蒸馏"行为,认为这对保持美国 AI 领先地位至关重要。
4. Grok 4.6 定档 8 月 7 日
Musk 公开路线图:Grok 4.6 将于 8月7日 发布,Grok 4.7 将拥有 2.1万亿参数,数周后跟进。xAI 正以极快节奏迭代模型。
5. 亚马逊调整 AI 战略,暂停 Nova 自研模型
亚马逊叫停大部分 Nova 系列自研大模型开发,转为"维护模式",资源转向 Peter Abel 团队的尖端模型研究,预计秋季发布新基础模型。亚马逊仍是 Anthropic 和 OpenAI 的最大投资者之一,累计投入超 1000 亿美元。
🇨🇳 中国 AI 动态
6. 中国模型全球霸榜:占全球 LLM 调用量的 63.5%
- 小米 MiMo-V2.5 在 OpenRouter 上以 10.5T tokens/周 排名全球第一,中国模型整体份额达 63.5%,美国仅 35.5%。
- Moonshot Kimi K3 开源发布,47 页技术报告揭示 KDA+Gated MLA 混合注意力、AttnRes 跨层检索、896 专家 Stable LatentMoE、5120 万 RL 沙箱等创新架构,引发硅谷关于是否应禁止中国开源模型的辩论。
- 国产大模型进入百万上下文原生时代,DeepSeek V4 和 Kimi K2.6 推动行业进入新阶段。
7. 360 发布企业智能体平台 NanoWork
周鸿祎发布新一代企业智能体工作平台,首批用户获 10 亿 Token 试用额度。通过多智能体引擎和多模型底座提升企业 AI 应用效率,内置安全能力。
8. 中国电信部署首个国产 TPU 集群
中国电信杭州分公司联合中兴通讯、中昊芯英部署 1024 芯片国产 TPU 集群,算力达 400 PFLOPS,计划扩至 10K PFLOPS。
9. 阿里 20+ 应用登鸿蒙
阿里巴巴在华为鸿蒙系统上推出 20+ 应用,50+ 创新功能,包括 Qwen 统一拖拽式 AI 分析、高德 AR 导航等。
10. 闲鱼 AI 服务半年近千万单
2026 上半年,闲鱼 AI 服务订单量达 981.6 万单,同比增长 157%。AI 编程建站订单增长 1732%,AI 漫画增长 1425%。四线城市卖家占比最高(32.2%),女性卖家占 62.4%。
🛠️ 工具与安全
11. OpenAI Codex Security CLI 开源
OpenAI 发布开源命令行安全扫描工具,让开发者直接在 CI/CD 流程中扫描代码仓库安全漏洞,支持 npm 安装和 TypeScript SDK。
12. Ruflo MCP 桥接漏洞 CVSS 10.0
开源 AI agent 平台 Ruflo(GitHub 67K+ star)的 MCP 桥接漏洞(CVE-2026-59726)被评最高严重级,暴露 233 个工具。24 小时内修复。
13. Onyx Security 获 1.13 亿美元 B 轮融资
以色列 AI Agent 安全治理平台 Onyx Security 获 1.13 亿美元 B 轮融资,估值 6.4 亿美元,已为 Anthropic 企业部署提供集成。
🔬 前沿研究
14. TurboVLA:32Hz 实时具身 AI
华中科技大学+华为提出 TurboVLA,去除 LLM 直接从视觉→语言→动作映射,0.2B 参数在 RTX 4090 上以 0.9GB VRAM 达到 97.7% 成功率。
15. Meta HumanCLAW:顶级 VLM 仅完成 16.8% 具身任务
Meta 联合多校发布 HumanCLAW 基准测试,9 个 SOTA 视觉语言模型在 1218 个物理交互任务中,最佳模型(Gemini 3.1)仅完成 16.8% 的"坐下"任务,主要失败原因:缺乏具身自我意识。
16. 百度 OmegaUse-OfficeVal:LLM 办公效率评估
百度 Agent Frontier 团队发布 100 个长时办公任务评估集,平均耗时 2.32 小时。结论:LLM 在成本和速度上远超人类,但交付质量尚未达到人类水平。
📊 行业数据
17. 三星 Q2 营业利润暴增 1814%
三星 Q2 财报显示,受益于 AI 内存(HBM)需求,营收约 1181 亿美元(同比+130%),营业利润约 614.6 亿美元(同比+1814%)。
18. 半数 AI 独角兽从未主导过学术论文
Science.org 分析显示,超半数 AI 独角兽从未主导过学术论文,Top 5% 的公司贡献了 90% 以上引用。OpenAI 独自贡献近 40% 引用。
来源:AI Weekly、Artificial Analysis、AIbase、SecondTalent、SCMP、Pandaily、RenovateQR、ZDNET、MarkTechPost 等