“这可能是第一个能把复杂想法‘想透’的AI。”

谷歌凌晨官宣的Gemini 3,把AI圈聊爆了。作为谷歌目前的“王牌模型”,它不光在专业测试里拿第一,连OpenAI CEO奥特曼都在X上点赞转发演示视频。

图片

现在Gemini 3 Pro已经全球上线,Gemini App和AI Studio里都能用到。

 九章智算云⾯向AI开发者和AI应⽤⽅,提供⾼性能GPU算⼒,⽀持主流⼤模型⼀键部署、GPU弹性调度,让AI开发真正‘所想即所算’。

我们的核⼼使命:降低⼤模型训练与推理的算⼒⻔槛,实现算⼒普惠

已⽀持场景:⼤模型训练和微调,模型推理、科研实验、Agent开发与部署等。

高效、稳定、成本可控的AI算力,从这里开始:https://www.alayanew.com/?utm_source=online&utm_campaign=csdn

01 不是“刷题机器”!这推理能力,堪比理科生解题

Gemini 3这次除了“答得快”,还“想得深”。谷歌特意加了个Deep Think模式(目前还没完全开放,后续给Ultra订阅用户先用),就像给AI开了“学霸buff”,专啃那些绕弯子的难题。

先上干货数据,都是官方实打实的测试结果,比空吹靠谱多了:

  • 综合能力第一:LMArena排行榜(测AI答复杂问题稳不稳)拿了1501分

图片

  • 逻辑推理逼近博士级:GPQA测试(全是专业领域逻辑题)考了91.9%,开Deep Think模式能冲到93.8%,这个分数已经达到博士研究的推理水平了;Humanity’s Last Exam也从37.5%涨到41.0%,全是不考死记硬背的“活题”。

图片

图片

  • “通用智能”有苗头:ARC-AGI-2测试(让AI自己找规律解题)第一次拿到45.1%,要知道这题超过30%就算大突破,它快摸到50%的坎儿了。

图片

  • 数学终于不拖后腿:MathArena Apex(公认最难的数学测试)考了23.4%,虽然看着不高,但已是目前所有AI里的最高分——以前问它微积分可能绕弯子,现在能一步步写推导过程,跟做例题似的。

02 图文音视频全拿捏!生成式界面太香了

学习党的福音:或者如果你想学习一个新话题,可以给它学术论文、长视频讲座或教程,它还能生成交互式抽认卡、可视化或其他格式的代码,帮助你掌握这些内容。它几乎能帮你学习任何东西。

论文:

“这可能是第一个能把复杂想法‘想透’的AI。”

谷歌凌晨官宣的Gemini 3,把AI圈聊爆了。作为谷歌目前的“王牌模型”,它不光在专业测试里拿第一,连OpenAI CEO奥特曼都在X上点赞转发演示视频。

图片

现在Gemini 3 Pro已经全球上线,Gemini App和AI Studio里都能用到。

01 不是“刷题机器”!这推理能力,堪比理科生解题

Gemini 3这次除了“答得快”,还“想得深”。谷歌特意加了个Deep Think模式(目前还没完全开放,后续给Ultra订阅用户先用),就像给AI开了“学霸buff”,专啃那些绕弯子的难题。

先上干货数据,都是官方实打实的测试结果,比空吹靠谱多了:

  • 综合能力第一:LMArena排行榜(测AI答复杂问题稳不稳)拿了1501分

图片

  • 逻辑推理逼近博士级:GPQA测试(全是专业领域逻辑题)考了91.9%,开Deep Think模式能冲到93.8%,这个分数已经达到博士研究的推理水平了;Humanity’s Last Exam也从37.5%涨到41.0%,全是不考死记硬背的“活题”。

图片

图片

  • “通用智能”有苗头:ARC-AGI-2测试(让AI自己找规律解题)第一次拿到45.1%,要知道这题超过30%就算大突破,它快摸到50%的坎儿了。

图片

  • 数学终于不拖后腿:MathArena Apex(公认最难的数学测试)考了23.4%,虽然看着不高,但已是目前所有AI里的最高分——以前问它微积分可能绕弯子,现在能一步步写推导过程,跟做例题似的。

02 图文音视频全拿捏!生成式界面太香了

学习党的福音:或者如果你想学习一个新话题,可以给它学术论文、长视频讲座或教程,它还能生成交互式抽认卡、可视化或其他格式的代码,帮助你掌握这些内容。它几乎能帮你学习任何东西。

论文:

比赛分析:

更复杂的主题内容,如 RNA 聚合酶如何与生成式 UI 在搜索中的 AI 模式中工作。

生活中的小救星:如果你想学习家族传统烹饪,它可以解读并翻译不同语言的手写食谱,制作成可共享的家庭食谱。

氛围编程进入next-level:你现在可以在 Google AI Studio、Vertex AI、Gemini CLI 以及Google刚刚发布的全新代理开发平台 Google Antigravity 中使用 Gemini 3 进行构建 。它还支持第三方平台,如 Cursor、GitHub、JetBrains、Manus、Replit 等。

有开发者演示用它从零做了款复古3D飞船游戏,全程没手动改一行代码,现在公测期免费能用。

稍微介绍一下Google Antigravity。这是Google发布的全新的代理式开发平台,使开发者能够在更高层次、以任务为导向的水平上作。

虽然 Google Antigravity 的核心是熟悉的 AI 集成开发环境体验,但其代理被提升到专用表面,并获得了直接访问编辑器、终端和浏览器的权限。现在,代理可以自主规划并执行复杂的端到端软件任务,同时验证自己的代码。

除了 Gemini 3 Pro,Google Antigravity 还紧密配合Google最新的 Gemini 2.5 电脑使用浏览器模型,以及之前评价很高的图像编辑模型 Nano Banana(Gemini 2.5 图像)。

03 重点:靠谱不胡编,普通人怎么用最划算?

对咱们来说,AI再牛,“不胡说八道”才是刚需。Gemini 3在这方面进步明显,官方数据里SimpleQA Verified测试拿了72.1分,意味着“编答案”的概率大幅降低。

更贴心的是它能“盯长期任务”。Vending-Bench 2测试里,AI要模拟管一年自动售货机,应对断货、调价各种问题,Gemini 3 Pro最终收益排第一——以后说不定可以帮你盯你的“三个月减肥计划”“年度读书清单”,再也不用担心它半途而废。

图片

如何使用?

这里必须说清楚大家最关心的使用门槛和费用,别被“免费”噱头绕晕:

  • 普通用户免费够用:Gemini App和Google AI Studio里用Gemini 3 Pro完全免费,日常做笔记、剪视频、查资料都够;美国的大学生还能免费领一年Google AI Pro,国内暂时没这个活动,但基础功能不影响。

  • 开发者注意API收费:如果用API调用(比如做自己的小程序),没有免费额度,输入200k字符以内是2美元/百万字符,输出是12美元/百万字符,超过200k字符会贵一点,具体可以看谷歌的官方定价页。

  • 高级功能要订阅:Deep Think模式、Gemini Agent(帮你订机票、整理邮箱的智能助手)这些,只有Google AI Ultra订阅用户能用,目前美国网页版先上,国内得等后续更新。

还有个小提醒:用的时候别乱调“temperature”参数,官方建议保持默认1.0,改低了反而可能让AI逻辑混乱,这点和之前的模型不一样。

最后:一点小感想。

从Gemini 1到3,能明显感觉到AI的变化:以前是“我问你答”,现在是“我给目标,你给结果”。它不再是炫技的工具,而是真能帮你省时间、解决麻烦的“帮手”。

现在Gemini 3 Pro已经全量开放,不管是学生、职场人还是程序员,都能直接去体验。不用怕学不会,它对指令的理解特别直接,越简单的要求反而做得越好。

你最想用它解决啥问题?是帮你整理考研笔记,还是做菜谱、写代码?你可以在评论区大开脑洞。

实操入口:手机端直接更Gemini App,选“Thinking”模式;电脑端去Google AI Studio(ai.google/dev/studio),不用注册就能试。

高效、稳定、成本可控的AI算力,从这里开始:https://www.alayanew.com/?utm_source=online&utm_campaign=csdn

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐