杀疯了!Claude Opus 4.5横空出世:降价2/3碾压人类编程,AI争霸格局已定

2025年11月25日,Anthropic推出旗舰AI模型Claude Opus 4.5,价格较前代降约三分之二,编程性能号称业界顶尖。此举加剧了其与OpenAI、谷歌的竞争,也引发了对白领职业变革的讨论。该公司由亚马逊投资,此次定价为每百万输入令牌5美元、输出25美元,远低于前代的15美元和75美元。
当前AI赛道竞争激烈:OpenAI刚发布GPT-5.1和可自主工作24小时的Codex Max,谷歌也在上周推出Gemini 3,令OpenAI都倍感压力。
核心性能:
编程准确率超80%,碾压人类求职者
Claude Opus 4.5在软件工程基准测试SWE-bench Verified中准确率达80.9%,超过OpenAI GPT-5.1(77.9%)、谷歌Gemini 3 Pro(76.2%)等竞品。更值得关注的是,它在Anthropic内部2小时限时工程招聘测试中,得分高于所有人类候选人;无时限下,表现与公司史上最优秀人类工程师持平。
Anthropic开发者关系负责人亚历克斯·艾伯特表示,模型判断力和直觉显著提升,能理解现实任务的核心需求。员工测试显示,如今可放心让其完成信息汇总、优先级排序等完整任务,无需反复校验。

效率革命:
令牌用量最高减76%
该模型效率大幅提升:中等负载下,性能追平前代Sonnet 4.5,输出令牌却少76%;高负载下性能提升4.3个百分点,令牌仍省48%。新增“努力参数”可让用户平衡性能、延迟与成本。
企业客户已验证其优势:Replit称其解决相同问题令牌更少,规模应用时效率复利明显;GitHub表示其编程性能领先,令牌用量减半,尤其适配代码迁移、重构场景。

功能升级:
自我进化+无限对话,覆盖多场景
模型支持“自我改进”,通过迭代优化工具和方法提升任务表现。乐天测试显示,其代理仅4次迭代就达最佳性能,而其他模型10次仍不达标;金融建模公司Fundamental Research Labs称内部评估准确率提20%,效率升15%。

产品端新增多项实用功能:“无限对话”通过自动总结消除上下文限制;Claude for Excel支持数据透视表、图表等,Chrome插件向Max用户开放;开发者可使用“程序化工具调用”,Claude Code新增“计划模式”并支持多代理并行。
行业格局:
降价抢市场,AI重塑专业工作
Anthropic 2025年一季度年化收入达20亿美元,较上季度翻倍,年消费超10万美元客户增8倍。此次降价虽可能压缩利润,但有望扩大用户群。其加速迭代部分得益于用Claude辅助研发,9月至今已连发Sonnet、Haiku、Opus三款4.5系列模型。
OpenAI、谷歌也在紧追:前者全年发布多款GPT-5变体,后者推出Gemini 3。Cursor、Cognition等企业均认可Opus 4.5的性能提升。行业分析指出,AI性能逼近甚至超越人类专家,对专业工作的影响已从理论走向现实。艾伯特直言:“这一信号值得所有人重视。”
从当前竞争态势不难看出,AI赛道的竞赛格局已基本确定,形成了Anthropic、OpenAI、谷歌等大厂主导的局面。前沿AI模型的研发需要巨额算力投入、顶尖技术人才储备以及持续的资金支持,例如Anthropic背后有亚马逊的算力与资金加持,OpenAI和谷歌更是拥有深厚的技术积累与资源整合能力。这些门槛对于小型创业公司而言难以逾越,使其很难在核心模型研发领域与大厂抗衡,更多小型企业或将转向基于大厂模型的垂直场景应用开发,而非正面参与基础模型的竞争。
更多推荐



所有评论(0)