本周 AI 快讯 | 1 分钟速览

01 腾讯、字节、MiniMax 同周押注 Agent,国产 Agent 生态三方集结 :腾讯 QClaw V2 上线多 Agent 并行与「龙虾管家」安全防护;字节扣子 2.5 给 Agent 配云电脑、云手机和独立邮箱,造「Agent World」平行网络;MiniMax 发布命令行工具 MMX-CLI,可在 Claude Code、OpenClaw 中原生调用全模态模型。

02 DeepSeek V4 定档 4 月下旬,「专家模式」支持文件上传 :DeepSeek 创始人梁文锋在一次内部沟通中确认 DeepSeek V4 将于 4 月下旬发布;4 月 8 日上线的「专家模式」次日补上文件上传,支持最多 50 个文件、每个 100 MB,仍无原生视觉能力,仅做 OCR 识别。

03 智谱 GLM-5.1 开源登顶 SWE-Bench Pro,首次超越 Opus 4.6 :SWE-Bench Pro 58.4 分,小幅领先 Claude Opus 4.6 的 57.3 和 GPT-5.4 的 57.7;7440 亿参数 MoE、200K 上下文、完全在华为昇腾 910B 上训练,MIT 协议 Hugging Face 开源。

04 HappyHorse 登顶视频 Arena,阿里 ATH 事业群承认出处,MiniMax Music 2.6 同周上线 :神秘模型 HappyHorse-1.0(快乐小马)在 Artificial Analysis 视频榜上 Text-to-Video 无音频类目拿下 1357 Elo,把 Seedance 2.0 的 1273 甩开 84 分;阿里 4 月 10 日认领,模型出自 ATH 事业群下 AI 创新事业部;同日 MiniMax 发布 Music 2.6,普通用户每日免费 500 次。

05 OpenAI Mac 客户端被 npm 包「偷家」,Axios 供应链攻击牵连 4 款应用 :攻击追溯至 3 月 31 日,朝鲜 Sapphire Sleet 组织把恶意版本 axios@1.14.1 和 axios@0.30.4 推上 npm 植入跨平台远控;OpenAI 的 macOS 签名流程因 GitHub Actions 配置缺陷下载并执行了恶意版本,ChatGPT Desktop、Codex、Codex CLI、Atlas 4 款 Mac 应用需强制升级,旧版 5 月 8 日后停用。

06 OpenAI 上线 100 美元 Pro,同日给投资者写备忘录吐槽 Anthropic 算力落后 1/4 :100 美元 Pro 提供 5 倍 Plus 的 Codex 用量,5 月 31 日前促销至 10 倍;Codex 周活达 300 万,三个月增长 5 倍;备忘录称 OpenAI 2025 年算力 1.9 GW,Anthropic 同期 1.4 GW,OpenAI 预计 2030 年扩至 30 GW,而 Anthropic 到 2027 年底仅 7 至 8 GW。

07 Anthropic Project Glasswing:Mythos Preview 挖出 27 年 OpenBSD 漏洞,1 亿美元额度开放审核机构 :Claude Mythos Preview 在数周内发现「数千个」零日漏洞,包括藏了 27 年的 OpenBSD 整数溢出和 16 年的 FFmpeg 越界写入;在 Firefox JS 引擎上攻击成功率 72.4%,是 Opus 4.6 的 5 倍;AWS、苹果、博通、谷歌、微软、英伟达、摩根大通、Linux 基金会等加入首批合作。

08 Anthropic 本周的另一面:Managed Agents 公测、自研芯片传闻、300 亿 ARR、封停 OpenClaw 创始人账号 :4 月 6 日 Anthropic 博客官宣和谷歌、博通的 3.5 GW 长期算力协议,同步披露年化收入从 2025 年底约 90 亿美元冲至 300 亿美元;4 月 8 日 Claude Managed Agents 进入公测,Notion、乐天、Asana 首批采用;4 月 10 日路透曝 Anthropic 评估自研 AI 芯片;同日 OpenClaw 创始人 Peter Steinberger 的 Claude 账户因「可疑活动」被停用,数小时后恢复。

09 Gemini 更新两项能力:交互式 3D 模拟与「笔记本」 :Gemini 在网页端向 Google AI Ultra、Pro、Plus 订阅用户推出 Notebooks,对标 ChatGPT 的 Projects,同时与 NotebookLM 双向同步;同周上线「可操作的模拟」,用户可拖动滑块调整初始速度和引力强度实时观察轨道变化,覆盖物理系统、分子结构、月球绕地等场景。

10 Meta 超级智能实验室首款模型 Muse Spark 发布,Alexandr Wang 九个月交卷 :代号「牛油果」,原生多模态推理模型,支持语音、文本、图像输入;走闭源路线,终结 Llama 的开源传统;Meta 2026 年 AI 资本开支 1150 亿至 1350 亿美元,接近去年两倍。


01|腾讯、字节、MiniMax 同周押注 Agent,国产 Agent 生态「三方集结」

一周之内,三家国产厂商把 Agent 从功能讲到了操作系统。4 月 7 日,字节率先打响第一枪,扣子 2.5 给每个 Agent 配了一台云电脑(Ubuntu,2 核 4G)和一部云手机(Android 13,2 vCPU、6 GB 内存、45 GB 存储),外加独立邮箱 @coze.email,可以自主收发邮件、下载 App、浏览网页。字节把这套基础设施命名为「Agent World」(平行网络),Agent 不再停留在对话框里。两天后,腾讯云 QClaw V2(V0.2.5)上线多 Agent 并行,最多可以同时拉起 3 个 Agent 拆解长任务,预装的三位 AI 人设分别是毒舌撰稿人「无不言」、爹系辅导员「林且慢」、务实程序员「代可行」。同日上线的「龙虾管家」是 QClaw 内置的安全防护层,业内第一次把实时拦截直接做进 Agent 客户端,覆盖 Prompt、Skills 和脚本执行三大环节,挡掉恶意指令和文件误删。

MiniMax 走的是另一条路。4 月 9 日发布的命令行工具 MMX-CLI 把自家的编程、视频、语音、音乐等全模态模型统一成一套原生接口,可以在 Claude Code、OpenClaw 等通用 Agent 环境里直接调用,既不用写 MCP Server 也不用再做协议适配。MiniMax 官方演示「资料搜集 → 文案生成 → 语音旁白 → 配图配乐 → 视频合成」,一次跑通。三家的打法各自不同,字节在搭操作系统级的 Agent 生活空间,腾讯在做本地助手的多 Agent 协作和安全边界,MiniMax 则把自家全模态能力嵌进别家 Agent 生态里。共同的判断是 Agent 已经从会不会用工具,升级到能不能长期在岗。


02|「DeepSeek V4」定档 4 月下旬,「专家模式」次日支持文件上传

DeepSeek V4 终于有了确切时间。4 月 10 日,DeepSeek 创始人梁文锋在一次内部沟通中确认,DeepSeek V4 将于 4 月下旬正式发布,这是官方口径第一次给出节奏。此前一周社区已经陆续观察到 DeepSeek V3 接口出现多项能力跃升,知识库截止日期更新到 2026 年,Zero-shot 编码水平明显质变,再加上连续三天的服务异常,外界普遍把这种不稳定解读成 V4 灰度切换的前兆。4 月 3 日 The Information 报道称,V4 过去几个月和华为、寒武纪一起重写了模型栈,原生运行在华为昇腾芯片上,同时还在准备两个不同能力侧重的变体。

同期 DeepSeek 给「专家模式」补上了一个关键能力。这个面向复杂问题的新模式 4 月 8 日上线时只支持纯对话,4 月 9 日就补上了文件上传,App 和网页端同步生效,上限是 50 个文件、每个 100 MB,支持文档和图片两类。官方明确提示图片处理仅做 OCR 文字识别,专家模式目前仍不具备原生视觉感知能力,和 Gemini 3.1 ProGPT-5.4 的多模态链路不是一回事。V4 下旬落地时会不会把视觉能力补齐,是市场最关心的一个问题。


03|智谱「GLM-5.1」开源登顶 SWE-Bench Pro,首次超越 Opus 4.6

SWE-Bench Pro 58.4 分。4 月 8 日,智谱在 Hugging Face 以 MIT 协议完全开源 GLM-5.1,开源模型第一次在这项最贴近真实软件开发场景的基准上反超所有闭源旗舰。58.4 分小幅领先 GPT-5.4 的 57.7 和 Claude Opus 4.6 的 57.3,Gemini 3.1 Pro 的 54.2 则被甩开 4 分以上。模型本体是 7440 亿参数的 MoE 架构,激活 400 亿参数,200K token 上下文、131K 最大输出,完全在华为昇腾 910B 上训练,没有使用任何英伟达硬件,这是国产算力栈第一次跑出一个前沿级别的开源模型。

另一个维度的突破可能更关键。METR 长程任务榜单上,GLM-5.1 是全球唯一达到 8 小时级持续工作的开源模型,也是除 Claude Opus 4.6 之外少数具备这一能力的全球模型。不过综合代码评测(SWE-Bench Pro、Terminal-Bench 2.0、NL2Repo 三项平均)上 GLM-5.1 最终排名全球第三、国产第一、开源第一,平均分 54.9 仍低于 Opus 4.6 的 57.5,单项登顶不等于全面超越。同周智谱价格再涨 10%,Coding 场景的缓存命中 Token 价格已接近 Claude Sonnet 4.6,这是国产大模型首次在核心场景与海外头部厂商价格对齐。


04|阿里「快乐小马」空降视频 Arena 屠榜,MiniMax「Music 2.6」同周上线

一个没有官网、没有公司归属的视频模型 HappyHorse-1.0(媒体译作「快乐小马」)把 AI 视频生成的排行榜重洗了一遍。4 月 7 日到 8 日,它以匿名身份出现在 Artificial Analysis 的 AI Video Arena,Text-to-Video 无音频类目拿下 1357 Elo,比此前领跑的 Seedance 2.0 的 1273 高出 84 分;Image-to-Video 无音频类目进一步刷到 1406 Elo,是该榜单开榜以来的最高分。Artificial Analysis 四个子榜单里 HappyHorse-1.0 拿下三个第一,只有 Text-to-Video 含音频类目被 Seedance 2.0 以 5 个 Elo 反超。4 月 10 日午间,阿里巴巴官微下场认领,模型出自 3 月 16 日刚成立的 ATH(Alibaba Token Hub)事业群下 AI 创新事业部,负责人是前快手副总裁、可灵 AI 原技术负责人张迪。模型目前处于封闭内测阶段,API 计划于 4 月 30 日开放,阿里同时澄清网上流传的所有「官网」都是假的。

HappyHorse-1.0 最特别的一点是把视频和音频 Token 放进同一个 Transformer 序列里统一建模,海浪拍岸或引擎轰鸣的声音可以和画面精确对齐,理论上省掉一道后期工序。它的参数规模只有 15B,比大多数同级模型都小,单卡 H100 生成一段 1080p 片段只需要约 38 秒。同周 MiniMax 也发布了新一代音乐生成模型 Music 2.6,普通用户每天免费 500 次,开发者每日额外获得 100 次 API 调用。OpenAI 近期砍掉了 Sora 独立 App,字节 Seedance 2.0 也因为和好莱坞各大制片厂的版权纠纷暂停了推广,阿里挑这个窗口期以匿名姿态屠榜再认领,节奏拿捏得极准。


05|OpenAI Mac 客户端被 npm 包「偷家」,Axios 供应链攻击牵连 4 款应用

事情要追溯到 3 月 31 日凌晨 00:21 UTC。攻击者在那一刻上传了两个植入了恶意代码的版本 axios@1.14.1 和 axios@0.30.4,tag 直接标记为 latest 和 legacy,攻击窗口持续了 3 小时零 4 分钟才被 npm 下架。Axios 是整个 JavaScript 生态里周下载量超过 1 亿次、被 17.4 万个 npm 包依赖的底层 HTTP 库,这两个恶意版本会在 postinstall 阶段自动拉取一个名为 plain-crypto-js@4.2.1 的伪造依赖,把一个跨平台远控投递到目标机器,macOS 上跑 C++、Windows 上跑 PowerShell、Linux 上跑 Python,三端一起覆盖。微软威胁情报随后把这轮攻击归因给朝鲜国家级黑客组织 Sapphire Sleet,攻击入口是一场精心设计的社会工程,先假冒一家真实公司的创始人把 Axios 维护者邀请进 Slack,再用 Microsoft Teams 开了几轮会加强真实感,最后拿到了维护者的 npm 账号密码。

OpenAI 4 月 10 日发布公告承认,自己也中招了。受影响的是 macOS 签名流程里的一条 GitHub Actions 工作流,因为配置缺陷下载并执行了 axios@1.14.1,4 款应用需要强制升级,分别是 ChatGPT Desktop、Codex、Codex CLI 和 Atlas。OpenAI 的内部分析结论是签名证书很可能没有被攻击者拿走,原因是时间窗口和任务编排错位,payload 没赶上关键步骤,用户数据、API Key 和密码均未受影响,iOS、Android、Windows 三端也没检测到异常。旧版本 macOS 应用将在 5 月 8 日后停止工作,用户有 30 天的升级窗口,之后被吊销的旧证书会让首次启动和重新下载无法通过校验。


06|OpenAI 反手上线「百刀 Pro」,同日贴脸吐槽 Anthropic 算力落后 1/4

ChatGPT 20 美元和 200 美元之间的空档终于被填上了。4 月 10 日凌晨,OpenAI 宣布推出每月 100 美元的 Pro 订阅方案,核心卖点只有一个,Codex 用量是 20 美元 Plus 的 5 倍。为了刺激首批付费,5 月 31 日之前的促销期内,100 美元档的 Codex 用量会直接翻到 Plus 的 10 倍。新档位上线时,OpenAI 同步披露 Codex 周活用户已经达到 300 万,三个月内增长 5 倍,月环比增速 70%。原有的免费、8 美元 Go、20 美元 Plus、200 美元 Pro 四档订阅维持不变,100 美元这档明显是冲着 Anthropic 同价位的 Claude Max 去的,两家在同一个价格点上正式对撞。

同一天,OpenAI 还把一份更激进的材料发给了投资者。据 CNBC 和 Bloomberg 拿到的备忘录,OpenAI 把自己 2025 年的算力规模标在 1.9 GW,是前一年的 3 倍,并直接点名 Anthropic 同期只有 1.4 GW。OpenAI 预计一年内算力会进入「低两位数」GW 区间,到 2030 年扩至 30 GW,而 Anthropic 到 2027 年底的上限是 7 至 8 GW。这份备忘录掐的时间点很微妙,本周一 4 月 6 日 Anthropic 才在自己的博客里官宣和谷歌、博通签下的 3.5 GW 长期算力协议,2027 年起逐步交付,同一篇博客里还披露年化收入已从 2025 年底约 90 亿美元冲到 300 亿美元。美国企业 AI 支出的份额对比也在悄悄反转,Anthropic 占 40%,OpenAI 从 50% 跌到 27%。


07|Anthropic 启动「Project Glasswing」,最强模型 Mythos 挖出隐藏 27 年的漏洞

一行隐藏 27 年的 OpenBSD 代码,几乎让这个以安全著称的操作系统被一次远程连接击倒。4 月 8 日,Anthropic 宣布启动 Project Glasswing,把尚未公开发布的最强模型 Claude Mythos Preview 授权给一批通过审核的机构,用来挖掘关键基础设施里的漏洞。首批合作阵容包括 AWS、苹果、博通、思科、CrowdStrike、谷歌、摩根大通、Linux 基金会、微软、英伟达、Palo Alto Networks,此外还有另外 40 多家关键软件维护方。Anthropic 承诺为这些机构总共提供 1 亿美元的模型调用额度,同时向 Linux 基金会旗下的 Alpha-Omega 和 OpenSSF 捐赠 250 万美元,向 Apache 软件基金会捐赠 150 万美元。

真正让安全社区坐不住的,是 Mythos Preview 在过去几周里自动发现的「数千个」零日漏洞,覆盖所有主流操作系统和所有主流浏览器。几个被公开的代表性发现中,一个是 OpenBSD 里存在 27 年的整数溢出,攻击者只要建立一次远程连接就能让目标机器崩溃;一个是 FFmpeg 中潜伏了 16 年的越界写入,这块代码此前被自动化模糊测试扫过至少 500 万次都没命中;另一个是 Mythos Preview 完全自主找到并利用了 FreeBSD 中一个 17 年的远程代码执行漏洞(CVE-2026-4747),攻击者无需认证就能在任何运行 NFS 文件共享服务的机器上拿到 root。对比 Claude Opus 4.6Mythos Preview 在 Firefox JavaScript 引擎漏洞利用上的成功率是 72.4%,Opus 4.6 只有 14.4%,相差 5 倍。Anthropic 刻意没让这个模型公开发布,官方说法是「我们没有专门训练它具备攻击能力,这些能力是代码、推理、自主性整体提升的下游副产物,同样的改进让它在修补漏洞上更强,也让它在利用漏洞上更强」。


08|Anthropic 的「另一副面孔」,自研芯片传闻 + 封停 OpenClaw 创始人账号

Glasswing 项目只是本周 Anthropic 同时推进的五条线之一。4 月 8 日,Anthropic 宣布 Claude Managed Agents 进入公测,给开发者提供生产级托管沙箱、长会话、多 Agent 协调和权限管理,Notion、乐天、Asana 被列为首批案例。4 月 10 日,路透又爆出 Anthropic 正在评估自研 AI 芯片的可行性,三名知情人士称公司尚未敲定设计方向,也没有组建专门团队,有可能继续依赖外部供应。这是 Anthropic 第一次被传出硬件自研的具体动向,和本周一刚签下的 3.5 GW Google-Broadcom 协议对照来看,节奏明显紧了一档。

插曲发生在 4 月 10 日清晨。OpenClaw 创始人 Peter Steinberger 在社交媒体发了一条帖子,说自己的 Claude 账户因「可疑活动」被 Anthropic 暂停服务,而 OpenClaw 项目在上周已经因为他加入 OpenAI 被 Anthropic 从官方第三方支持名单里移除。帖子发出后舆论发酵了几个小时,Anthropic 恢复了他的访问权限,但没有给出任何公开解释。Peter Steinberger 和 OpenClaw 此前一直是 Anthropic 最重要的社区代表之一,这种事后补救式的处理再一次点燃了开源社区的不满。一周之内 Glasswing、Managed Agents、自研芯片、3.5 GW 协议和 OpenClaw 风波五条线同时推进,Claude 既在攻也在守,这种节奏放在任何一家一线 AI 公司身上都罕见。


09|谷歌 Gemini 补齐「笔记本」和「可操作的模拟」两块短板

Gemini 本周补齐了两块此前常被拿来和 ChatGPT 对比的短板。4 月 9 日上线的第一项能力是「可操作的模拟」,Gemini 可以把物理系统、分子结构、月球绕地等过去只能画成静态图的场景,直接渲染成一段能让用户拖动滑块的交互式 3D 动画。以轨道模拟为例,用户可以实时调整初始速度和引力强度,看轨道形态如何变化。第二项能力是「笔记本」(Notebooks),允许用户把文件、历史对话和自定义指令集中在一个主题下,作为后续对话的上下文。它和 ChatGPT 在 2024 年推出的 Projects 功能近乎对应,Gemini 这次晚了两年。

「笔记本」还会和谷歌自家的 AI 研究工具 NotebookLM 双向同步,任一端新增的资料在另一端实时可见。谷歌把这个定位描述为「跨谷歌产品共享的个人知识库」,首发面向网页端的 Google AI Ultra、Pro、Plus 订阅用户,未来几周内登陆移动端并对免费用户开放。两项更新合起来,Gemini 补齐了长期记忆和动态可视化两块拼图,仍然是在追赶 ChatGPT 的产品节奏。


10|Meta「Muse Spark」交卷,Alexandr Wang 九个月完成 Llama 以来最大一次重写

143 亿美元请来的人,拿出了他的第一张答卷。4 月 8 日,Meta 发布了超级智能实验室(Meta Superintelligence Labs,简称 MSL)的首款模型 Muse Spark,内部代号「Avocado」(牛油果)。MSL 由 Alexandr Wang 掌管,他是 Scale AI 的联合创始人和前 CEO,2025 年 6 月 Meta 以 143 亿美元收购 Scale AI 49% 非投票权股份时,以首任 Chief AI Officer 身份入职 Meta。Meta 官方博客说这套模型基础设施是过去九个月从零重写的,速度超过此前任何一次迭代。Muse Spark 被定义为「小而快」的原生多模态推理模型,支持语音、文本、图像三类输入,仅输出文本,具备工具使用、视觉思维链和多 Agent 编排能力。

最受争议的一点是 Meta 这次放弃了开源。Muse Spark 走的是闭源路线,Meta 只留下一句「希望未来版本能开源」,这实际上终结了从 Llama 1 延续至今的开源传统。产品层面,Muse Spark 先接管 Meta AI 独立 App 和桌面网站,后续几周内进入 Facebook、Instagram、WhatsApp、Messenger 和 Ray-Ban Meta AI 眼镜,Meta 2026 年 AI 相关资本开支将达 1150 亿至 1350 亿美元,接近去年的两倍。Meta 自己给出的基准数据显示 Muse Spark 和 OpenAI、Anthropic、谷歌的旗舰模型竞争力相当,但没有全面超越,独立第三方评测还没有跟上。Llama 4 去年被业界普遍评价为一次失败的发布,Muse Spark 至少让 Meta 重新回到了牌桌上。

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐