TL;DR · TOP 5

AI 全景情报 Wednesday · June 3, 2026

1
⭐⭐⭐ Anthropic 完成 $650 亿 H 轮融资,估值 $9,650 亿——超越 OpenAI 成全球最有价值 AI 私有公司,$47B 年化营收跑道
Anthropic · CNBC
2
⭐⭐⭐ Microsoft Build 2026(6/2–3):发布 MAI-Thinking-1 首款推理模型 + Microsoft Scout 全天候 AI 自动驾驶智能体
Microsoft · Engadget
3
⭐⭐⭐ Claude Code 6/15 计费变革:Agent SDK / claude -p 程序化用量迁移至独立月度信用池(Pro $20 / Max 5x $100),额度耗尽即停
Anthropic · Codersera
4
⭐⭐⭐ Apple WWDC 2026 定档 6/8(本周日):全新情境感知 Siri 整合 Google Gemini,独立 Siri App + Extensions 跨应用控制
Apple · Newsweek
5
⭐⭐⭐ 特朗普签署 AI 安全行政令(6/2):发布前 30 天自愿提交强力模型供政府测试,由 Anthropic Mythos Preview 漏洞利用能力引发
白宫 · NPR
🤖

Claude Code 生态

9 条
BREAKING · 6月15日计费变革
Anthropic 将 Claude Code 订阅池拆分为两个独立池:交互对话池(不变)+ 程序化信用池(新增)。后者按 API 官方定价计费,月末不结转,不自动 overflow。
旗舰模型升级
Opus 4.8 成为 Max、Team Premium、Enterprise 及 API 用户默认模型,高努力(high-effort)模式开箱即开;Dynamic Workflows 单脚本编排多个 sub-agents;Fast Mode 2.5× 速度提升。
🔒 安全插件
官方插件,Claude 修改代码时实时扫描安全漏洞(而非事后审查),适合敏感业务代码库。
安全分类器自动处理权限提示,安全操作无中断,危险操作拦截。
☁️ 云端 Agent
Web 端通过定时、GitHub 事件或 API 调用触发模板化云端 Agent,无需本地运行。
⭐⭐ 移动端推送通知
长任务完成或 Claude 需要用户介入时推送到手机,异步工作流体验大升。
⚡ CLI 增强
官方推荐多数编程工作使用 xhigh;/effort 交互式滑块实时调节,无需重写 system prompt。
分类展示各类限额(对话 / Agent SDK / 工具调用)的实时用量细目。
🧩 生态 / 工具
社区插件爆发:6,700+ skills、11,200+ MCP 服务器;ccpi CLI 管理 425+ 插件。
Claude 可打开原生 App、点击 UI、从终端验证结果。
Native CLI 去掉 Node 依赖;Code Quest 第三方 Web UI 以 Interactive Mode 运行 Claude Code。
🌐

国际大厂动态

30 条
BREAKING · 融资
Altimeter Capital / Dragoneer / Greenoaks / Sequoia 联合领投。$47B 年化营收跑道,去年全年营收 $100 亿。
BREAKING · Microsoft Build 2026(6/2–3)
  • MAI-Thinking-1:微软首款自研专属推理模型(Mustafa Suleyman 发布)
  • Microsoft Scout:全天候在线个人 AI 智能体(Autopilot 类),跨 App 自动执行无需每步提示
  • Rayfin:Agent-first SDK,连接 Backend 服务与 Agent 网络
  • Copilot 超级 App 预告:统一所有 AI 助手(夏末预览)
BREAKING · AI 安全(6/2)
起因:Anthropic 4 月因 Mythos Preview 可自主发现并利用安全漏洞而主动限制发布。行政令要求企业自愿提交最强模型。
BREAKING · Apple WWDC 2026 定档 6/8
  • 独立 Siri App 带 Extensions 功能,支持文本/语音双模,完整对话历史
  • Apple 与 Google 合作:Siri chatbot 功能由双方联合定制 Gemini 模型支持
  • Apple Intelligence 扩展至 Wallet、Safari、Shortcuts
BREAKING · AI 视频格局重塑
OpenAI Sora 品牌终结,API 将于 9/24 退休。快手 Kling 3.0 Arena 2127 分登顶;Veo 3.1 单次推理生成 4K 60fps + 同步音频。
🤖 OpenAI
合并 Codex 与 GPT-5 训练堆栈,比前代快 25%,编程基准新高。
定价与 OpenAI 一致,用量计入 AWS 承诺额度,进入 AWS 安全治理体系。
⭐ 模型退休:GPT-4.5(6/27)/ o3(8/26)
GPT-4.5 从 ChatGPT 退休(30 天),o3 从 ChatGPT 退休(90 天日落期)。
🔷 Google / Gemini
Gemini Spark 个人 AI 智能体、Gemini Omni 视频模型、Daily Brief 功能;Gemini 3.1 系列(Pro / Deep Think / Flash)。
Gemini CLI 退出历史,Antigravity CLI 更强 Agent-first 架构接替,6/18 起停止对现有用户服务。
Chrome 内跨网页研究/摘要;Android 智能自动填写跨 App 文本字段。
📘 Meta AI / Llama
首批 MoE 架构 Llama,原生多模态,超长上下文,MIT 授权,Hugging Face 开放下载。
⭐⭐ Meta Superintelligence Labs + Muse Spark
Meta 成立超级智能实验室,释放 AGI 野心;Muse Spark 作为特定 Llama 能力替代产品。
⭐ Llama 4 Behemoth 预览(仍在训练)
Meta 最强版本,被称为"世界最智能 LLM 之一",作为教师模型使用。
🟢 NVIDIA
Vera Rubin MoE 推理成本较 Blackwell 降低 10x;AWS、Google Cloud、Microsoft 等 2026 年内部署。
20 核 Arm + Blackwell GPU + 128GB LPDDR5X 统一内存,Lenovo/HP/Dell/Surface 秋季出货。
🟠 Amazon / AWS
从 4/28 有限预览升级正式 GA;Bedrock 现支持近 100 个基础模型。
⭐⭐ Bedrock 多厂模型大扩充
新增 Mistral、MiniMax、Moonshot、Qwen 等,2026 年 Bedrock 成真正多厂 AI 超市。
🤗 Hugging Face
全面 PyTorch-first,模块化建模,量化一等公民;支持 400+ 架构,750K+ checkpoints。
⭐ 社区持续整合国内模型
DeepSeek V4、Qwen3.7、GLM-5.1、ERNIE 5.1 权重均已入驻 Hugging Face。
⚡ xAI / Grok
专为 Agentic 工作流训练,256K 上下文,支持文本+图像输入。
用户创建个性化可复用技能,每日自动执行。
⭐ Grok 5 预计 Q2 2026(6 万亿参数传言)
Polymarket 33% 概率 6/30 前发布;参数量约 GPT-4 估计值 6 倍。
🟣 Mistral AI
119B 总参数,仅激活 6B/token;单模型统一四项能力,无需切换。
首款开源 TTS 模型,面向企业语音智能体,9 种语言。
⭐ Nemotron 4 联合 NVIDIA 开发
Mistral 加入 NVIDIA Nemotron Coalition,联合开发下一代开源模型。
🎬 AI 视频 / 融资
Kling 3.0(快手)Arena 2127 第一;Veo 3.1 单次推理 4K 60fps + 音效/对白。
6/11 举办全球投资者活动,或成史上最大 AI 上市事件。
⭐⭐ Sierra $9.5 亿 E 轮(Tiger Global + Google GV)
企业级 AI 客服智能体,$150M ARR;OpenAI 收购 Hiro Finance(第 7 起 2026 acqui-hire)。
🇨🇳

国内 AI 动态

11 条
重磅 · DeepSeek V4 Preview(4/24)
  • V4 Pro:1.6T 总参数(49B 激活),目前最大开源权重模型
  • V4 Flash:284B 总参数,13B 激活,更快更经济
  • API 同步可用;旧 alias deepseek-chat / deepseek-reasoner 7/24 退休
  • V4 Pro 永久定价 $0.435/M 输入(较 GPT-5.5 低约 97%)
重磅 · 阿里云峰会(5/20)
  • SWE-bench 72.3%,国内第一,全球第三
  • 全域思考模式(文本+图像+代码统一推理)
🔷 DeepSeek
V4 Pro 1.6T 参数 / V4 Flash 284B;1M 上下文;384K 最大输出;production-stable。
75% 优惠期转为永久定价,较 GPT-5.5 低约 97%。
🟠 阿里 / 通义千问
Qwen3.7-Max(万亿参数 MoE)+ Qwen3.7-Plus;全域思考模式首发。
⭐⭐ SWE-bench 72.3%,国内第一
Agentic Coding 全球第三(仅次于 GPT-5.5 85.1%、Claude Opus 4.7)。
🌙 月之暗面 / Kimi
256K 上下文,300 Agent 群体,4,000 协调步骤;MoonViT 原生视觉编码器。
⭐⭐ 开源 Modified MIT,Cloudflare Workers AI 可用
Kimi API、Kimi Code CLI 全渠道同步上线。
🔴 百度 / 文心
全球 Arena 第 4,MoE 架构;相比 ERNIE 5.0 参数缩至 1/3,训练算力仅同量级 6%。
⭐ ERNIE 5.0(1/22):2.4T 参数,<3% 激活率
原生多模态,超稀疏 MoE,每次推理激活不足 3% 参数。
💎 智谱 / GLM
744B 总参数,40B 激活,200K 上下文;全程基于 Huawei Ascend 910B,验证无 NVIDIA 可行性。
⭐ THUDM/slime:RL 后训练框架,支持 GLM 4.5-5.1
Megatron + SGLang 深度集成,已在 GLM/Qwen/DeepSeek/Llama 生产验证。
📋 国内政策
1998 年来首次《商业秘密保护条例》重大修订,明确 AI 算法和数据属于商业秘密。
国务院立法工作计划:推进 AI 数据/算力/算法/知识产权/网络安全综合立法。