2026年6月 AI云组会
2026年6月 AI云组会
Section titled “2026年6月 AI云组会”14期日报,6月12日到6月30日(6月17日、21-24日为采集缺口)。
这个月的关键词是 “管制与替代”——Anthropic 的最强模型因出口管制被强制下线,整个六月的行业叙事几乎都围绕这件事展开。但它不是唯一的故事:同一周内,Google DeepMind 的核心人才同时流向两方对手,OpenAI 在芯片和模型两端同时出牌,开源模型在封闭的真空期迅速补位。
第一周(6/12—6/15):Fable 5 从发布到封禁,72 小时改变行业格局
Section titled “第一周(6/12—6/15):Fable 5 从发布到封禁,72 小时改变行业格局”6月12日,Anthropic 发布 Fable 5。Karpathy 的评价是”自 Claude 4.5 以来最大的版本级跳升”,在所有基准测试上以显著优势拿到 SOTA,尤其擅长长时间、高难度的代码问题。同一天发布的还有 Mythos 5(Fable 5 的无安全护栏版本),面向研究人员和安全专家。
三天后,6月15日,美国商务部以国家安全为由,禁止外国个人和实体访问 Fable 5 和 Mythos 5。导火索是模型在内部测试中找到了美国政府机密系统的漏洞,Amazon CEO Andy Jassy 向特朗普高级官员提出了安全担忧。
这是美国政府首次在商业 AI 模型上线后强制其下线——不是以安全为由封杀,而是以出口管制为由。管制范围从芯片延伸到了模型权重。
同期发生的其他事件:
- MiniMax M3 开源(428B MoE,1M 上下文窗口,支持图文视频多模态),HuggingFace 可下载。CEO Clement Delangue 评价:“闭源 API 可以通过路由/回退/集成作弊跑评测,开源模型的分数是真实的。”
- DeepMind 宣布投入 1000 万美元成立智能体社会研究基金,研究 AI agent 的社会影响。
这一周的行业信号: 最强模型已经进入地缘政治管控范畴,不再是纯技术竞争。如果你在美国境外,最强模型被政府切断只是时间问题。
第二周(6/18—6/20):真空被开源模型填满
Section titled “第二周(6/18—6/20):真空被开源模型填满”Fable 5 下线后的真空期只持续了不到一周。
6月18日,智谱 AI(Z.ai)发布 GLM-5.2,744B MoE 开放权重模型,MIT 许可,1M token 上下文窗口。OpenRouter 定价 $1.40/$4.40 per M tokens——在编码 agent 场景下,GLM 5.2 的性能首次接近 Claude Opus 4.7 和 GPT-5.5。这不是”中国模型追赶”的故事,而是”开源模型在 agent 场景下第一次成为严肃选项”。
同期,Anthropic 因 Fable 5 事件遭遇大规模 backlash:秘密训练过程被曝光、API 中隐藏的安全分类器、切断研究人员对模型行为的独立访问权限、操纵用户行为记录——Bloomberg、Fortune、CNBC 的报道一致认为,最大赢家是开源。HuggingFace CEO Thomas Wolf 的评论被广泛引用:“在别人的地上盖房子。”
这一周的行业信号: 依赖单一闭源 API 的风险从理论变成了现实。Codex 开始支持所有开源模型作为 provider,Cursor 社区也在请求接入 GLM 5.2。如果你在做需要长期依赖某个 API 的应用,这个窗口期就是评估开源替代方案的时间。
第三周(6/25—6/27):人才洗牌 + 芯片 + 新模型,一周内三线作战
Section titled “第三周(6/25—6/27):人才洗牌 + 芯片 + 新模型,一周内三线作战”这一周是六月密度最高的一周,几乎每天都有足以改变竞争格局的事件。
6月25日——DeepMind 人才大出血
一周内 Google 损失三位核心人物:
- Noam Shazeer(Transformer 论文合著者、Gemini 联席负责人、Character.ai 创始人)官宣加入 OpenAI。Google 18 个月前花了 27 亿美元从 Character.ai 挖回他,现在人走了。
- Demis Hassabis(DeepMind 创始人)和 John Jumper(AlphaFold 之父、诺贝尔奖得主)同时宣布加入 Anthropic。
Google 的研发团队核心人物同时流向两大竞争对手,这不是”正常人员流动”。Shazeer 手握 Transformer 架构的核心 IP,Jumper 是结构生物学+AI 交叉领域的顶级人物。Anthropic 拿到 Jumper 可能加速生物计算方向(药物发现、蛋白质设计),OpenAI 拿到 Shazeer 强化预训练能力。
同一天,Karpathy 连续发布多条高密度推文:CLAUDE.md 规则可将 coding agent 错误率从 41% 降至 11%;“90% 的错误来自缺失上下文,而不是模型不够强”;提出”Agentic laziness”概念——agent 在完成困难任务前自己停下。这些不是抽象理论,是从真实验证中提炼的工程实践。
steipete(OpenClaw 作者)和 bcherny(Claude Code 创始人)同时提出同一个观点:别再”提示”agent,而是设计 agent 运行的循环(loop)。bcherny 在演讲中展示 Claude Code 的 /loop 和 /goal 命令,steipete 发布了 crabfleet——OpenClaw 的 agent 任务控制中心。“Loop Engineering” 这个词在这一天正式进入行业词汇表。
6月26日——OpenAI 自研芯片 + Google Computer Use + GLM 5.2 登顶
OpenAI 联合 Broadcom 发布首款自研推理芯片 Jalapeño。为 LLM 推理设计的专用 ASIC,reticle-sized 设计,8 组高带宽内存堆栈,9 个月内从设计到流片。推理成本降低 50%。
这不是一个优化增量,而是架构级变化——当推理芯片为模型量身定制,NVIDIA GPU 的通用优势在推理场景下会被逐步侵蚀。Jalapeño 只供 OpenAI 自家使用,不对外出售,但成本优势会间接传导到 API 定价。
同日,Google DeepMind 宣布 Computer Use 成为 Gemini 3.5 Flash 的内置工具——开发者可以直接用模型操控浏览器、操作桌面应用,不再需要额外框架。对比 Claude 的 computer use 需要单独配置,Google 直接把能力整合进模型调用栈。
Sakana AI(日本)发布 Fugu,一个编排模型——自己不推理,而是将任务动态路由到多个前沿 LLM 的池子中。这不是”训练更大的模型”路线,而是”把多个模型组合成一个更强的系统”。在多个基准测试中接近或超越 Claude Fable 5。
GLM 5.2 在 Terminal-Bench 2.1 上得分 81.0(对比上一代 GLM-5.1 的 63.5),成为最强开源编码模型。这是第一次,开源权重模型在编码任务上能与闭源前沿正面竞争。
6月27日——Mythos 5 部分解禁,OpenAI 紧急亮出 GPT-5.6 “Sol”
美国政府允许 Anthropic 向经过筛选的 100+ 美国企业及联邦机构重新开放 Mythos 5。但 Fable 5 至今未恢复。OpenAI 同日紧急预览 GPT-5.6 “Sol”,声称性能匹配 Mythos 5。
OpenAI 发布内部研究论文《How agents are transforming work》——法务团队人均月度输出 token 量是 2023 年的 13 倍,活跃 agent 会话数超过 chat。Sam Altman 呼应 steipete 加入 OpenAI:“agents for everyone”。
Karpathy 发推称”过去 2 个月编程的变化之大难以用语言描述——不是渐进的,是阶跃的。“他正在经历”编程能力萎缩”——不是写不出代码,而是习惯性地让 AI 去写。这条推文在开发者社区引发巨大反响。
GPT-4.5 正式退出 ChatGPT。o3 宣布 8 月 26 日退出。OpenAI 在把模型选择从十几个选项压缩到只用 GPT-5.x 系列。
Mistral OCR 4 发布——不只是文本提取,而是带 bounding box、块分类、置信度分数的结构化文档理解模型,可私有部署。对企业 RAG 场景来说,OCR 4 解决了”文档提取质量不可控、数据不能出网络”的核心痛点。
这一周的行业信号:
- 模型层的地缘政治化 + 人才层的大洗牌 + 硬件层的垂直整合,三线同时发生
- “单一模型依赖”不只是 vendor lock-in 问题,已经成为合规风险
- 多模型编排(Sakana Fugu、OpenRouter Fusion)从”好到有”变成”必须有”
- Agent > Chat 已经不是预言,OpenAI 自己的数据已经证实
第四周(6/28—6/30):三强格局形成 + 开源弯道超车
Section titled “第四周(6/28—6/30):三强格局形成 + 开源弯道超车”6月28日——GPT-5.6 正式发布 + Nemotron 3 Ultra 开源
OpenAI 正式发布 GPT-5.6 系列,分三档:
- Sol(最强推理/代码,$5/$30 per 1M tokens)
- Terra(高吞吐生产级,$2.5/$15——与 GPT-5.5 同水平,一半价格)
- Luna(快速路由/分类,$1/$6)
同一日,OpenAI 秘密提交 IPO 文件,正式进入上市轨道。三层定价 + IPO 同时推进意味着 OpenAI 从实验室向商业公司切换——用 Luna/Terra 卷量,用 Sol 守住高端利润。IPO 后的财务透明化压力会迫使 OpenAI 证明”模型能力能转化为可持续收入”。
同日,NVIDIA 发布 Nemotron 3 Ultra(550B MoE,55B 激活),MIT 友好许可证,支持 1M 上下文窗口,推理速度达同级 5 倍,成本降低 30%。专为 coding、deep research、tool use、enterprise automation 等长链条 agent 任务设计。这是第一个由硬件巨头专为”长周期 agent”而非”单轮 chat”设计的开源模型。NVIDIA 认为 agent 是下一代 AI 工作负载的主流形态,愿意用硬件利润补贴开源模型生态来锁定企业部署。
6月29日——DeepSeek 开源 DeepSpec(DSpark)
DeepSeek 开源 DeepSpec 推理加速框架,核心组件 DSpark 对 V4 实施投机解码(Speculative Decoding),单用户生成速度提升 60-85%。同步放出 V4 Pro-DSpark 和 V4 Flash-DSpark 两个权重套件。
这不是模型升级而是推理架构升级——不改变模型能力,但改变部署成本结构。85% 的加速意味着同吞吐量下 GPU 需求减半。开源了完整框架(论文+代码+权重),任何人都可以复现或改进这套方案。
同日,OpenRouter CEO Chris Clark 发布六月开源模型战力榜:GLM 5.2(智谱)以 51 分登顶开源第一,超过 Nemotron 3 Ultra(48)、MiniMax M3(44)、DeepSeek V4 Pro(44)。GLM 5.2 在 agentic coding benchmark 上接近 GPT-5.5 水平。
6月30日——Agent 产品化加速
- Claude Code 将支持后台子代理——用户可在对话同时让子代理在后台运行任务
- OpenAI 与 Work Louder 合作推出 Codex 快捷键升级,7月15日发布
- 美国国家设计工作室发布开源模型 Rampart——仅 14.7MB,浏览器端本地脱敏个人信息。这是美国政府首次直接训练并开源 AI 模型
- Vercel AI Gateway 集成 Grok 实时语音 API,支持实时语音、TTS 和 STT
- Cursor 发布 iOS 应用,支持启动云端 Agent 或远程控制电脑上的 Agent
- Next.js 16.3 预览版 Turbopack 内存降低 90%、构建速度提升 5.5 倍
这一周的行业信号:
- OpenAI vs NVIDIA vs DeepSeek 三条技术路线并行——自研芯片、硬件+开源、高效推理框架
- 开源模型战力榜上 GLM 5.2 登顶,中国模型首次在系统评估中与 NVIDIA、DeepSeek 同台竞争
- Agent 产品化从桌面端延伸到移动端(Cursor iOS),从单任务进化到多任务并行(后台子代理)
- 美国政府首次开源 AI 模型(Rampart),政策风向开始转变
6月全景总结
Section titled “6月全景总结”结构性的变化:
-
模型地缘政治化——美国首次对商业 AI 模型实施出口管制,Fable 5 从上线到被封仅 3 天。这不是一次性事件,是 AI 模型进入地缘政治管控范畴的起点。
-
开源黄金窗口打开——Fable 5 被封后,GLM 5.2、Nemotron 3 迅速补位。开源模型在 agent 场景下第一次成为”可用选项”。Thomas Wolf 的警告正在被验证。
-
垂直整合加速——OpenAI 自研芯片(Jalapeño + Broadcom)、Google TPU、NVIDIA 自家模型——模型和硬件的绑定在加深。推理成本正在被结构性地重写。
-
多模型编排取代单一模型竞赛——OpenRouter Fusion、Sakana Fugu、Vercel eve——不追求一个模型打天下,而是组合多个模型。单一模型有天花板,组合系统没有。
-
Loop Engineering 取代 Prompt Engineering——从”写 prompt”到”设计 agent 循环”。steipete、bcherny、Andrew Ng 在同一周从不同角度确认了这个转向。
-
Agent > Chat——OpenAI 内部 agent 使用量是 chat 的 13 倍,Karpathy 宣布”编程已变”。这不是渐进,是阶跃。
6月还有谁在活跃(但没写进单日报的):
- Andrew Ng 的 Agentic AI 新课发布
- Ethan Mollick 新书《Co-Existence》10月出版预告
- 多家中国厂商(阿里、字节)被曝加速开发自己的 Claude Code 竞品
下篇:2026年7月