📌 今日头条
1. OpenAI:「研究加速」内幕 — 内部视角
OpenAI 最新博客文章《The view inside OpenAI》披露其研究加速机制。在近期组织调整(含裁员)背景下,OpenAI 强调以更专注的研究方法论驱动前沿模型迭代,聚焦长周期重大科研项目与工程化落地并重。
2. LLaDA-Image — 全新开源图生成 SOTA(HuggingFace 热榜第3)
阿里巴巴团队 LLaDA 系列推出 LLaDA-Image:6B Diffusion Transformer 从零训练 + 冻结的 LLaDA2.0-Mini 视觉-语言理解模块。 - 通过 纯图像预训练(220M 样本、98M 真实图像)建立视觉生成先验,不依赖初始配对图文数据 - 全程使用无参 RMSNorm + Muon 优化器,高效可扩展 - Qwen-Image-Bench 英/中双轨 53.53/53.38,登顶开源 SOTA - 蒸馏出 LLaDA-Image-Turbo,2-4 步快速采样 - 模型权重、训练代码、详细配方全部开源
3. Terminal-Universe — Agent 轨迹变训练环境(HF 热榜第2)
清华等团队提出的框架:鉴于终端代码 Agent 轨迹积压、而可执行训练环境稀缺,从工具执行历史中重建工作区,把每条轨迹变成可复用的环境,再合成新任务并支持多轮会话扩展。 - 产出 37.3k 个任务环境 - 对 Qwen3.5-27B 微调:Terminal-Bench 2.1 单轮 +11.9 分、EvoCode-Bench v2 MT@4 多轮 +13.8 分
🧠 论文与技术趋势(HuggingFace)
4. Random Attention — 重思 KV 缓存淘汰
论文提出「随机注意力」,重新审视高效 KV 缓存淘汰问题,为长上下文推理的效率优化提供新思路(HF 热榜第4,164 upvotes)。
5. 其他值得关注
- Compile by Training:把自然语言规格「训练即编译」,缩短从需求到代码的距离(热榜第1,355 upvotes)
- RoboTok:面向人形演示的大规模数据引擎,服务具身智能(热榜第6)
- LatentPress:超越文本与视觉的上下文压缩(热榜第7)
💼 行业与创投(36氪)
6. 中科世通亨奇完成近 5 亿元 B 系列融资
中科院孵化的国防 AI 企业,专注面向关键领域的智能决策基础设施,年营收数亿。本轮由中国兵器集团旗下南方德茂领投。
7. 阿法龙完成超亿元 B 轮融资 — AR + 半导体工艺
90 后 AR 连续创业者创办的阿法龙(北京),用半导体工艺制造光学芯片,主打大视场角方案。本轮由梅花创投领投,德阳国资、宁波国资跟投。
💡 编辑点评
今日信号集中在两个方向:一是开源图生成与可复现训练管线持续突破(LLaDA-Image 全链路开源堪称标杆);二是 Agent 训练数据从「轨迹」走向「可执行环境」(Terminal-Universe),行业的后训练范式正在从「喂示范」转向「搭沙盒」。国内侧,国防 AI 与硬科技光学持续获得国资加码,资金正流向高壁垒 AI 基础设施。
数据来源:HackerNews、HuggingFace Papers、36氪(2026-09-07)