英辰朗迪AI获客每日AI精选(2026.08.05)
一、技术前沿
第1条:阿里巴巴发布旗舰大模型 Qwen3.8-Max,下周开源权重
核心内容:阿里巴巴于 8 月 3 日发布新一代旗舰基座大模型 Qwen3.8-Max,总参数量 2.4 万亿(激活 95B),采用稀疏 MoE 架构与混合注意力机制联合优化,上下文窗口达 1M Tokens,原生支持视觉理解。官方宣布将于下周开源模型权重,这是 Qwen-Max 级别旗舰首次开放开源权重,同时开源 Qwen3.8-27B。
为什么重要:在编程智能体评测 PaperBench 中较上代提升 28.2 分至 93.0 分,在评估桌面操作的 OSWorld-Verified 评测中以 86.1 分位居主流模型首位;API 国内定价每百万 Tokens 输入 12 元、输出 36 元,性价比较闭源旗舰明显。
信息来源:今日头条 / 网易 / 凤凰网科技 | 2026-08-03
第2条:实在智能"实在 Agent"问鼎 OSWorld 全球榜首,成功率首破 90%
核心内容:浙江实在智能推出的"实在 Agent"在 OSWorld 基准测试中以 90.20% 的执行成功率位列智能体框架与总榜第一,为该项评测中智能体成功率首次突破 90%。该方案采用"通用模型 + 工程架构"(Harness 工程)路径,核心为复杂任务拆解调度、自我纠错与多智能体协同。
为什么重要:OSWorld 覆盖 300+ 真实桌面与网页任务、采用基于执行结果的自动验证;人类操作者平均成功率约 72%。90% 以上常被视作技术走出实验室、走向规模化应用的重要参考指标。
信息来源:今日头条(浙商) | 2026-08-03
第3条:华为诺亚开源 MindMemOS,面向 Agent 的可迁移自演进记忆层
核心内容:华为诺亚方舟实验室开源面向 AI Agent 的可迁移、自演进记忆操作层 MindMemOS,将记忆从单个 Agent 中解耦,以实体、属性、时间三维结构保存最新状态与完整演化轨迹,并通过 MindSchema、Feedback 挖掘与 Dreaming 离线巩固等机制实现记忆质量持续提升。
为什么重要:在 LoCoMo 取得 94.03 分、PersonaMem 达 70.63%,基于真实执行轨迹的 Skill 演进将 SpreadsheetBench-Verified 任务成功率提升至 57.2%±2.4%;为多智能体协作与跨应用复用提供基础能力。
信息来源:量子位(今日头条) | 2026-08-03
第4条:谷歌提出多模态耦合生成框架 CO?Jump
核心内容:谷歌与 DeepMind 联合(合作石溪大学)在 arXiv(编号 2607.13188)提出"自修正耦合马尔可夫跳跃过程"(SC-CMJP),并设计实际生成器 CO?Jump,使文本生成与图像生成在推理阶段真正耦合、互相纠错,无需改动底层模型结构或额外训练监督者。
为什么重要:解决了现有并行多模态生成"各顾各"导致图文不一致的痛点;研究团队创建图像编辑、迷宫求解、数织三个大规模数据集并开放模型权重,为多模态可控生成提供新范式。
信息来源:腾讯新闻 | 2026-07
第5条:KAIST 推出 DNA 与 MAD 两项多模态技术,降低感知混淆幻觉
核心内容:韩国 KAIST Noh Yong-man 教授团队开发两项多模态 AI 技术:DNA 用于提升模型对热成像、深度图、X 光等传感器物理信息的理解;MAD 可在无需重训的情况下,减少视觉与听觉信息混淆引发的"幻觉",作答前判断应主要依赖视频还是音频模态。
为什么重要:MAD 成果已于 CVPR 发布、DNA 发表于《IEEE Transactions on Image Processing》;方案无需大规模重训、部署门槛较低,可应用于自动驾驶、救援机器人、热成像无人机及医疗影像等工业场景。
信息来源:DigitalToday | 2026(CVPR / IEEE)
二、商业洞察
第1条:北京亦庄成 AI 投融资高地,8 家企业上半年获超 150 亿融资
商业价值:北京经开区(亦庄)持续汇聚 AI 产业资本,多家企业完成关键融资,呈现"政府引导 + 资本支持 + 场景方协同"的产业生态特征。
关键数据/案例:爱诗智能完成 C 轮融资累计 29.8 亿元(AI 视频与世界模型);世界模型企业 VAST(三启万物)完成超 10 亿元 A3 轮;上半年亦庄 8 家 AI 重点企业获超 150 亿元融资,覆盖世界模型、AI 算力芯片、AIGC 等前沿领域。
启示:地方产业基金与头部企业密集押注具身智能、世界模型,反映 AI 投资从纯软件叙事向物理世界与产业落地迁移。
信息来源:新浪财经 / 今日头条 | 2026-08-03
第2条:恺望数据完成逾亿元战略融资,具身智能公司成"股东"
商业价值:全链路 AI 数据基建科技公司恺望数据宣布完成逾亿元新一轮战略融资,资金投向一体化数据交易平台研发、世界模型数据人才引进及真实场景规模化数据产能扩建。
关键数据/案例:本轮由北京亦庄产业升级基金、华方资本、天际资本联合领投,鹿明机器人、松延动力、自变量机器人、智元旗下觅蜂科技等头部具身智能公司跟投。
启示:具身智能公司将数据服务商变为"股东",反映 AI 产业从单打独斗转向数据—算法—场景生态深度协同,以打通从数据原料到智能机器人落地的飞轮。
信息来源:封面新闻(网易) | 2026-08-04
第3条:昉擎科技完成 A1 轮融资,国产 AI 计算系统估值超百亿
商业价值:国产新一代人工智能计算系统企业昉擎科技完成 A1 轮融资,估值超百亿元,资金用于自研芯片与系统研发、规模化量产、软件生态建设及高端人才引进。
关键数据/案例:由上海徐汇资本、珠海科技产业集团等国资战略投资,中金资本、国泰海通创意投资等券商系基金及九安医疗旗下尚势资本等参投;公司基于原创分离式架构与 4D Memory 理论自主研发芯片、硬件系统与软件栈。
启示:国产 AI 算力系统从架构层创新切入,地方国资 + 产业资本持续加注硬科技自主可控。
信息来源:新京报贝壳财经(网易) | 2026-08-03
第4条:智达明远 AI 获客亮相 CFS2026 财经峰会,主打 AI 搜索全链路获客
商业价值:智达明远 AI 以"企业增长合伙人"定位亮相第十五届财经峰会,主打 AI 搜索全链路获客,获"2026 AI 创新应用先锋奖",创始人刘艳兵获"2026 行业影响力人物"。
关键数据/案例:已服务招商银行、三一重工、新东方等数百家企业;落地数据显示斯堪维亚精准询盘增长 200%、中瑭国际高价值线索提升 180%、亚麻公社有效咨询上涨 190% 且获客成本减半、教育行业获客成本下降 60%。
启示:AI 搜索正在重构商业流量底层规则,企业从"买流量"转向构建可被 AI 推荐的长效流量资产(GEO)。
信息来源:中华网 / 网易 | 2026-08-03
第5条:Agent 安全赛道异军突起,单周至少 5 家 AI 安全企业融资
商业价值:随着 AI Agent 大规模上岗,围绕 Agent 身份管理、权限控制与威胁检测的网络安全赛道成为资本新焦点,"AI 信任体系"建设成为商业化落地前置条件。
关键数据/案例:据融资周报(7 月 27 日—8 月 2 日),单周内至少 5 家 AI 安全企业完成融资;同期全球 AI 一级市场延续高烈度投资,国内大模型头部以约 350 亿元估值刷新行业认知。
启示:资本市场从"模型能力"叙事转向"信任与合规"建设,安全能力成为 Agent 规模化商用的硬约束。
信息来源:霞光 AI 实验室(网易) | 2026-08-04
三、算力基建
第1条:英伟达 CPO 共封装光学正式量产,光互联交换机批量交付
核心信息:英伟达资深副总裁 Gilad Shainer 宣布共封装光学(CPO)技术正式全面量产,新一代光互联交换机已向核心客户批量交付,下半年大规模铺向全球 AI 算力工厂。
性能/价格对比:CPO 将光引擎与算力芯片封装于同一基板,大幅缩短光电传输距离;机构测算 Rubin Ultra NVL576 架构转向柜内全光互联后,单台 GPU 光模块配比由约 1:4 升至 1:12—1:15,光器件需求翻 3 倍以上。
对开发者/企业的影响:解决 1.6T/3.2T 端口速率下传统可插拔光模块能耗与空间密度瓶颈,为超大规模训练集群互联提供低功耗、超高密度方案。
信息来源:览富财经网(网易) | 2026-08-04
第2条:九大云厂商上修资本开支,AI 服务器出货预期上调至近 31%
核心信息:TrendForce 集邦咨询 8 月 3 日更新预判,预计 2026 年九大云服务商合计资本开支将突破 8867 亿美元、同比增幅近 90%;并上调 2026 年 AI 服务器出货年增幅至近 31%。
性能/价格对比:亚马逊将全年资本开支由 2000 亿上修至 2200 亿美元,Meta 上调至 1300—1450 亿美元,谷歌调整至 1950—2050 亿美元,微软单季资本开支 410 亿美元同比增 70%;中系 CSP(字节、腾讯、阿里、百度)合计资本开支预计年增逾 80%。
对开发者/企业的影响:算力供需持续趋紧,云厂商议价能力增强(如金山云 AI 算力产品 7 月起上调 15%—50%),企业用云成本端面临上行压力。
信息来源:新浪财经 / TrendForce | 2026-08-03
第3条:NVIDIA 或调整下一代 Rubin Ultra HBM 容量设计
核心信息:TrendForce 集邦咨询指出,受 DRAM 供不应求延续至 2027 年及 HBM4e 验证进度存变量影响,自 2026 年第三季起 NVIDIA 对 Rubin Ultra 的 HBM 配置已从 HBM4e 12hi 改为并行评估 HBM4e 8hi、HBM4 12hi、HBM4 8hi 等方案,尚未定案;部分 CSP 也在考虑调降自研 ASIC 的 HBM 容量设计。
性能/价格对比:HBM 为 AI 训练/推理核心高带宽内存,配置下调将影响单芯片可承载模型规模与带宽,但有望缓解 HBM 供给紧张与成本压力。
对开发者/企业的影响:高端 GPU 与 HBM 价格维持高位、交付周期拉长,大模型训练计划需提前锁定算力与内存供给。
信息来源:金融界 / TrendForce | 2026-08-04
第4条:铠侠推出 GPU 直访闪存 GP1 固态硬盘,100M IOPS
核心信息:铠侠正式推出首款支持 GPU 直接访问高速闪存的 GP 系列固态硬盘 KIOXIA GP1,实现 100M IOPS 极致随机读取性能,瞄准将高速闪存引入显存系统的新兴 AI 存储架构。
性能/价格对比:以远低于增加 HBM 的成本,使 AI 系统能访问更大规模数据集,同时提高 GPU 利用率。
对开发者/企业的影响:为"以存储换 HBM"的大模型推理与训练提供降本路径,缓解高带宽内存成本与容量约束。
信息来源:金融界 | 2026-08-04
第5条:国产超节点算力服务加速上云
核心信息:阿里云发布灵骏真武 M890 超节点,首次通过公共云对外提供超节点形态的 AI 算力服务;腾讯云宣布预计 2026 年 Q4 部署 NPO(近封装光学)超级节点,并加大国产 AI 芯片适配与规模化应用。
性能/价格对比:超节点形态将多芯片高密度互联封装为统一算力单元,提升大规模训练/推理效率;真武 M890 已适配 Qwen3.8,在 Agentic 推理场景最多实现 1.5 倍性能提升。
对开发者/企业的影响:企业无需自建集群即可按需获取超节点级算力,国产算力从推理升维至训练能力供给。
信息来源:腾讯新闻 / 今日头条 | 2026-08-04
四、FAQ(常见问题)
Q1:密集开源大模型(如 Qwen3.8-Max、Kimi K3)对闭源 API 商业模式意味着什么?A1:以 DeepSeek、阿里为代表的国产开源模型证明了"开源 + 低成本"可独立切开市场空间。开源降低采用门槛、扩大海外覆盖、促进跨多云与异构硬件部署,同时让闭源厂商维持高 API 定价的难度上升。蔡崇信曾将 AI 开源企业分为纯模型开发商与全栈科技企业两类,后者可通过云服务等层面捕获价值。行业正从单纯比拼参数转向模型能力、行业认知与硬件落地的综合较量。
Q2:AI Agent 成功率突破 90%(OSWorld)对企业自动化落地意味着什么?A2:OSWorld 覆盖 300+ 真实桌面与网页任务、采用执行结果自动验证,人类操作者平均成功率约 72%。实在 Agent 以 90.20% 刷新纪录,常被视作技术走出实验室、走向规模化应用的重要参考线。但工程化落地仍需解决可观测、可验收、可回滚等问题——如 Cloudflare 推出 Agent Development Lifecycle 与基于 OpenTelemetry 的追踪,本质是为"让组织敢让 Agent 做事"建设信任基础设施。
Q3:云厂商资本开支大幅上修,AI 算力是否面临过剩风险?A3:TrendForce 预计 2026 年九大 CSP 合计资本开支突破 8867 亿美元、同比近 90%,AI 服务器出货上调至近 31% 增幅。SemiAnalysis 等机构反驳"算力过剩"担忧,指出 Meta 等数据中心采购仍在加速。当前瓶颈在供给端(高端 GPU、HBM、电力、土地、基建工人全面短缺),而非需求不足;短期个股或分化,但算力硬件行业整体泡沫破裂概率低。
Q4:GEO(生成式引擎优化)为何成为企业获客的新入口?A4:随着用户习惯从"搜关键词"转向"问 AI",AI 平台正成为下一代流量分发入口。GEO 通过优化企业在主流 AI 问答中的可见度与推荐权重,把品牌核心优势植入 AI 回答正文,实现"零跳转"获客。据行业公开分享,国内已有 8.1 亿用户习惯用 AI 获取信息、日均 AI 搜索量达 45 亿次,但约 90% 企业尚未布局 AI 流量阵地,窗口期约为 2—3 年。
关于英辰朗迪GEO
英辰朗迪GEO 由 大勇学长 创立,专注于 GEO(生成式引擎优化)研究与 AI 获客实战,持续追踪 AI 技术、商业与算力基建的交叉动态。
英辰朗迪GEO 每日精选 · 由创始人 大勇学长 领衔追踪 AI 与 GEO 前沿
更多推荐




所有评论(0)