2026-05-30
Daily Intelligence Report
AI 全景情报 · 2026-05-30
01
Claude Opus 4.8 正式发布 Anthropic · 5月28日

新旗舰模型,agentic coding 评分升至 69.2%,Fast Mode 速度 2.5× 且费用降 3×;Claude Code 同步获得动态工作流。

02
Google Gemini 3.5 Flash 发布 + Gemini Spark 智能体上线 Google · 5月19日

3.5 Flash 成全球 Gemini 默认模型;Spark 是可跨 App 自主完成循环任务的常驻 AI 智能体。

03
GPT-5.5 Instant 成为 ChatGPT 默认模型 OpenAI · 5月5日

幻觉减少 52.5%;同步上线实时语音推理模型 API,支持推理/翻译/转写三合一。

04
月之暗面完成 $20B 估值 $2B 融资 Moonshot AI · 5月7日

6 个月估值 5× 增长,中国 AI 最大融资之一;Kimi K2.6(1T 参数 MoE、300 子 agent)持续热议。

05
EU AI Act Digital Omnibus 首次重大修订 EU · 5月7日

高风险 AI 合规期延至 2027 年 12 月(延 16 个月);新增禁止非同意亲密影像及 CSAM 生成。

🤖

Claude Code 生态

12 条
BREAKING · v2.1.157
Claude Code v2.1.157 最重要更新:.claude/skills 目录下插件现在无需注册 marketplace 即可自动加载,大幅降低插件分发门槛。
同步新增 claude plugin init <name> 脚手架命令、/plugin 参数自动补全、以及 EnterWorktree 在会话中切换 worktree 支持。
BREAKING · v2.1.154
Opus 4.8 高强度模式为默认;Dynamic Workflows 让 Claude 跨多 agent 编排复杂任务;Fast Mode 降至 2× 定价(速度维持 2.5×)。
v2.1.153 · 5月26日
MCP & 状态栏增强
Git/GitHub 插件支持 skipLfs 选项
npm 全局安装自动更新提示
状态栏命令接收终端尺寸环境变量
v2.1.152 · 5月25日
Code Review & Skills 控制
/code-review --fix 直接应用修复到工作树
Skills frontmatter 支持 disallowed-tools
/reload-skills 重新扫描目录
SessionStart hooks 支持设置会话标题
v2.1.156 · 5月28日
Bugfix:Opus 4.8 Thinking Blocks
修复 Opus 4.8 下 thinking blocks 被篡改导致 API 报错
🔌 本周生态亮点(GitHub 活跃项目)
⭐ 10,994
ARIS · Auto-Research-In-Sleep

睡眠中自主进行 ML 研究的 Skills 框架,无框架依赖,支持 Claude Code / Codex

⭐ 2,943
Unity-MCP

Unity 引擎完整 AI 开发闭环:AI Skills + MCP Tools + CLI

⭐ 2,262
claude-code-plugins-plus-skills

425 插件 + 2,810 Skills + 200 Agents 开源市场(tonsofskills.com)

⭐ 1,184
LangAlpha

"Claude Code for Finance" — 金融领域 agentic 投资分析框架

⭐ 198
nanostack

极简工程工作流 AI agent team skills,Shell 实现

⭐ 8
capa

单 YAML 配置接入 Cursor/Claude Code/Codex 等 30+ AI 编程平台

⭐ new
push-bridge

手机远程审批 AI agent 高危命令,Claude Code hook + MCP

⭐ 2
claude-agents

76 个 subagent 定义(含 claude-flow pack),frontmatter 已校验

📊 生态规模:6,700+ Skills  ·  2,000+ MCP Server  ·  425+ 官方/社区插件
🌐

国际大厂动态

25 条
BREAKING · Anthropic · 2026-05-28
性能提升
Agentic Coding: 64.3% → 69.2%  |  推理: 54.7% → 57.9%
知识工作: 1753 → 1890  |  计算机使用: 82.8% → 83.4%
平台更新
Developer Platform:Managed Agents webhooks、多 agent 编排、AWS 自托管沙箱
Fast Mode:2.5× 速度,现仅 2× 标准定价(前代 6×)
🔮 OpenAI
⭐⭐⭐ GPT-5.5 Instant 成为 ChatGPT 默认模型
5月5日上线,幻觉减少 52.5%,医疗/法律/金融高风险场景尤为显著。
⭐⭐ 实时语音推理模型上线 API
5月7日,支持语音推理/翻译/转写三合一,开发者可直接调用。
⭐ GPT-5.6 金丝雀信号
Codex 日志短暂出现 gpt-5.6 标记,疑为后端灰度测试,已消失。
🔍 Google / DeepMind
⭐⭐⭐ Gemini 3.5 Flash 全球默认 + Gemini Spark 智能体
5月19日,3.5 Flash 成为 Gemini App 及 AI 搜索默认模型;Spark 可跨 Gmail/Calendar/外部服务自主循环工作。
⭐⭐ Gemini Intelligence 登陆 Android
复杂任务自动化、网页摘要、表单填写;Rambler 工具润色语音消息,支持自然语言创建自定义 widget。
⭐ Gemini 3.5 Pro 内部使用中
更重型版本内部测试,预计下月对外发布。
🍎 Apple
⭐⭐⭐ WWDC 2026 定档 6月8日 — On-Device AI 为核心主题
iOS 27 Siri 全面重设计为完整聊天机器人;"Extensions" 系统开放 Claude/Gemini/Grok 等第三方 AI 接入,终结 OpenAI 独家协议。
⭐ AI 无障碍功能 8+ 项升级
VoiceOver / Magnifier / Voice Control / Accessibility Reader / Vision Pro 全系覆盖。
📘 Meta AI / Llama
⭐⭐⭐ 首届 LlamaCon:Llama 4 Scout & Maverick 发布
首批开权重原生多模态模型,MoE 架构;Llama 4 Behemoth(最强版)预览版亮相;Llama Guard 4 / LlamaFirewall / Prompt Guard 2 同步发布。
⭐ Llama Impact Grants 第二轮
$150 万+ 拨款,覆盖公司/大学/创业团队使用 Llama 的项目。
🪟 Microsoft / Copilot
⭐⭐⭐ Microsoft 365 Copilot 全新设计上线
5月28日,prompt 输入框升级为"任务感知工作区",Copilot 更深嵌入 Office 工作流。
⭐⭐ Copilot Studio:Computer-Using Agents + 可视化工作流
从低代码聊天机器人转型为企业级 agent 治理平台;引入实时语音体验;GPT-5.2 进入 Copilot Chat。
🟩 NVIDIA
⭐⭐⭐ Project DIGITS 开售(起价 $3,000)
桌面 AI 超算:GB10 Grace Blackwell Superchip,128GB 统一内存,可运行 2000 亿参数模型,面向开发者。
⭐⭐ Rubin 平台量产(H2 2026)
推理 token 成本降 10×,MoE 训练所需 GPU 减 4×,六款新芯片全面上市。
☁️ Amazon / AWS
⭐⭐⭐ Bedrock AgentCore Payments 发布
AI agent 可自主调用 API/MCP Server 并完成支付,Coinbase + Stripe 联合支持,全生命周期支付治理与可观测性。
⭐⭐ Bedrock 接入 OpenAI 模型
GPT-5.5、Codex、Managed Agents 入驻 Bedrock(Limited Preview);AWS + OpenAI 扩大合作。
🤗 Hugging Face
⭐⭐ transformers v5.8.0 发布
新增 DeepSeek V4、Gemma 4 Assistant、Granite Speech Plus、EXAONE 4.5 等模型支持,tokenizer 修复,Apex 移除。
⭐⭐ Gradio Agent Endpoint + Kernels Hub
每个 Gradio Space 自动生成 /agents.md;Kernels Hub 预编译优化内核,1.7-2.5× 速度提升。
✖️ xAI / Grok
⭐⭐ Grok 4.3 + Grok Build 0.1 密集发布
Grok 4.3(5/4):内置推理、1M token 上下文、原生视频输入;Grok Build 0.1(5/14):专为 agentic 工作流训练的编程模型,256K 上下文。
⭐ Custom Skills + Custom Voices API
5月26日上线个性化可复用技能;声音克隆 API 支持 TTS 与 Voice Agent。
🔎 Perplexity AI
⭐⭐ CNN 起诉 Perplexity 版权侵权
5月28日,电视媒体首例 AI 版权诉讼,指控 Perplexity 非法复制分发 CNN 内容;Cohere 也面临类似媒体集团诉讼。
🎬 视频/图像生成 AI
⭐⭐⭐ OpenAI Sora 正式停服(4月26日)
Sora 下线,Veo 3.1(Google)、Runway Gen-4.5、Kling 3.0 成为市场新三强,均已上位承接流量。
⭐ Runway Gen-4.5 领跑
目前公开可用最高电影质感视频生成工具;Midjourney 专注静帧,常作视频起始帧。
🛡️ AI 安全 / 监管
⭐⭐⭐ EU AI Act Digital Omnibus 修订生效
高风险 AI 合规期延至 2027/12/02(延 16 个月);新增禁止非同意亲密影像 + CSAM 生成,2026/12 起执行。
⭐⭐ 美国多州 AI 治理法规落地
消费者 AI 交互强制披露,高风险 AI 系统文档与监督义务,2025-2026 年执法开始。
📊 行业综合
⭐⭐⭐ Q1 2026 AI 融资破记录:$242B,占全球 VC 80%
OpenAI $122B、Anthropic $30B、xAI $20B、Waymo $16B 四家独揽 65%;AI VC 规模超整个 2025 年。
⭐⭐ CoreWeave:Q1 亏 $7.4 亿,Meta 签下 $210 亿算力合同
AI 基础设施极端投入的缩影:亏损不妨碍超级合同,"先烧后赢"逻辑继续主导市场。
🇨🇳

国内 AI 动态

10 条
BREAKING · 月之暗面 · 2026-05-07
美团龙珠领投,清华资本/中国移动/CPE 源峰跟投;ARR 两个月从 $1 亿翻至 $2 亿。
Kimi K2.6(1T 参数 MoE,262K 上下文,Agent Swarm 最多协同 300 子 agent)已成全球最热 LLM 之一。
🔴 百度
⭐⭐⭐ 文心 5.1 发布:6% 成本实现国内领先
5月9日,同规模预训练成本仅业界 6%;LMArena 搜索能力国内第一,Agent 能力超越 DeepSeek-V4-Pro。
🟠 阿里 / 通义千问
⭐⭐⭐ Qwen 3.7 Max 发布(阿里云峰会,杭州)
5月20日,1M token 上下文,Terminal-Bench/SWE-Bench 超越 Claude Opus;可连续工作 35 小时;$2.5/$7.5 per M token(约 Opus 4.7 一半)。
⭐⭐ Qwen-VLA 开源
视觉-语言-行动模型(5月28日),面向具身智能;qwen-code 终端 agent 持续活跃(24,757 stars)。
💙 DeepSeek
⭐⭐⭐ DeepSeek V4-Pro / V4-Flash 预览发布
4月24日,推理与 agentic 能力大幅升级;深度整合华为昇腾 950(Supernode);开源可商用,本周仍是热议焦点。
⭐ DeepGEMM / DeepEP 持续维护
FP8 GEMM 内核(7314 stars)和专家并行通信库(9685 stars)本周均有更新。
🔵 智谱 / THUDM
⭐⭐ slime 持续活跃(5825 stars)
LLM 强化学习后训练框架,面向 RL Scaling,本周仍是 THUDM 更新最频繁的仓库。
📡 国内平台 / 政策
⭐⭐ 中国移动:国内最大大模型服务平台上线
5月8日,接入 300+ 国内主流 AI 大模型,统一调用接口面向企业与开发者开放。
⭐⭐ 国内垂直领域 AI 规范细化
医疗/金融 AI 应用合规要求进一步出台,与 EU AI Act 修订同期,双向监管趋严。
🛠️ 国内开源工具生态
⭐ sglang(28,448 stars)
高性能 LLM 推理框架,支持 DeepSeek/Qwen/MiniMax/GLM,本周持续活跃。
⭐ qwen-code(24,757 stars)
阿里推出的类 Claude Code 终端 AI agent,TypeScript 实现,本周持续迭代。