Gemini 3 Pro 刚刚发布,就做到 Vibe Coding 遥遥领先了?
Google 于 2025 年 11 月 18 日宣布 Gemini 3 Pro 正式集成到 Gemini CLI,开发者可以直接在终端使用目前最强大的 AI 编程模型之一。
Gemini CLI 简介
Gemini CLI 是 Google 开源的命令行 AI 工具(Apache 2.0 协议),通过 npm 全局安装即可使用:
npm install -g @google/gemini-cli@latest
安装完成后,在终端输入 gemini 或简写 g 即可开始使用。
使用限制
-
• 免费账户:60 次/分钟,1000 次/天
-
• Gemini 3 Pro 访问:需要 Google AI Ultra 订阅或付费 API key
-
• 其他用户可加入 waitlist 或在 GitHub 追踪进度
核心能力
技术基础
Gemini 3 Pro 的优势在于大上下文(最多 100 万 token)、原生多模态理解和高级工具调用能力,可以执行复杂的多步骤任务。
在 Terminal-Bench 2.0 测试中,Gemini 3 Pro 得分 54.2%,这是一个专门测试模型通过终端操作计算机能力的基准测试。
CLI 专属优势
客户端和服务器端 bash 工具:
-
• 客户端 bash 工具:模型可以提出 shell 命令作为 agentic workflows 的一部分
-
• 服务器端 bash 工具:用于多语言代码生成和安全原型设计
-
• 支持本地文件系统导航、开发流程驱动、系统操作自动化
Google Search 和 URL context grounding:
可以与结构化输出结合使用,特别适合构建需要获取和提取数据的 agentic 用例。
"Vibe Coding":
自然语言是唯一需要的语法,Gemini 3 Pro 解锁了这一能力的真正潜力。
1. 一句话生成生产级 3D 应用
# 提示词示例
"使用 Three.js 创建金门大桥的 3D voxel 仿真,生成单个 HTML 文件"
输出包含 InstancedMesh、自定义 GLSL shader 和性能优化的完整应用。
2. 手绘草图转可用 UI
拖拽图片到终端,Gemini 3 Pro 分析布局后生成像素级精确的 HTML、Tailwind CSS 和 React/Vue 代码。
3. 自然语言转复杂 Shell 命令
# 提示词示例
"使用 git bisect 找到把编辑器默认主题改为深色的 commit"
自动生成 bisect 脚本、执行并解释结果。
4. 自动生成可搜索文档
指向代码仓库,输出包含架构图、使用示例和搜索组件的 Markdown 文档。
5. 自主调试生产服务
连接 Cloud Run 和 Snyk,识别内存泄漏、提出修复方案、编写补丁、运行测试并部署——全程无需人工干预。
安装和配置
启用 Gemini 3 Pro
# 1. 更新到最新版本
npm install -g @google/gemini-cli@latest
# 2. 认证(需要 Ultra 或付费 API key 的 Google 账号)
gemini
# 3. 在 CLI 内开启预览功能
/settings # 切换 previews 为 on
# 4. 切换到 Gemini 3 Pro 模型
gemini --model gemini-3-pro-preview
基本使用
# 直接提问
gemini "帮我重构这个 Python 文件"
# 拖拽文件/图片到终端作为输入
gemini # 然后拖拽文件
与竞品对比
|
特性 |
Gemini 3 Pro CLI |
OpenAI Codex / Copilot |
|---|---|---|
|
多模态输入 |
✅ 支持图片、PDF、终端输出 |
❌ 仅文本 |
|
上下文窗口 |
最高 100 万 token |
较小 |
|
Terminal-Bench 2.0 |
54.2% |
未公开 |
|
工具编排 |
ReAct loop + MCP 服务器 |
有限 |
|
Bash 工具 |
客户端 + 服务器端 |
❌ |
|
终端原生 |
✅ 无需 IDE |
❌ 主要在 IDE 中 |
|
自主调试能力 |
✅ 可完成完整修复流程 |
⚠️ 需要更多人工介入 |
|
Extensions 生态 |
✅ 开放生态系统 |
❌ |
|
文档理解 |
Best-in-class,超越 OCR |
基础 |
|
免费限额 |
60/分钟,1000/天 |
较低 |
早期用户反馈显示,Gemini 3 Pro 在整文件生成、大型代码库重构和项目架构理解方面优于 Copilot。
实际应用场景
从草图到代码
-
1. 手绘 App UI,扫描后拖拽到 Gemini CLI
-
2. 生成 Flutter 或 React Native 代码(含导航、状态管理、API 调用占位符)
-
3. 要求实现后端(FastAPI/Node.js + JWT + PostgreSQL)
-
4. 输出完整服务代码、Dockerfile 和 OpenAPI spec
配合 API 开发工具
生成的 OpenAPI spec 可导入 Apidog 等工具:
-
• 立即创建 mock 服务供前端使用
-
• 自动化契约测试
-
• 可视化文档自动同步
-
• 一键性能和安全扫描
Extensions 生态系统
Gemini CLI 支持扩展系统,可以连接外部工具和服务:
官方合作伙伴扩展
-
• Dynatrace:实时应用性能洞察和根因分析
-
• Elastic:Elasticsearch 数据搜索和分析
-
• Figma:设计平台集成
-
• Harness:CI/CD 流程
-
• Postman:API 测试和开发
-
• Shopify:电商平台集成
-
• Snyk:安全漏洞扫描
-
• Stripe:支付服务集成
安装和使用
# 查看可用扩展
gemini /extensions
# 安装扩展(示例)
gemini install @dynatrace/gemini-cli-extension
所有扩展均可在 Gemini CLI Extensions 页面 查看和安装。
高级特性
文档理解
Gemini 3 Pro 在文档理解方面达到最佳水平,超越简单的 OCR,能够智能处理复杂文档的理解和推理。
空间推理
改进的空间理解能力支持:
-
• 桌面、移动和操作系统屏幕的智能理解
-
• 指向、轨迹预测和任务进度
-
• 自动驾驶、XR 设备和机器人等具身推理任务
模型还能基于鼠标移动和屏幕注释理解用户操作意图。
GitHub Actions 集成
Gemini CLI 0.1.18+ 支持 GitHub Actions,作为仓库的 AI 编程队友:
# 设置 GitHub Actions
gemini /setup-github
可用工作流:
-
• 🤖 智能 issue 分类:自动管理新 issue
-
• 📝 Pull Request 审查:自动化代码审查流程
-
• 🔄 多文件任务自动化:跨文件的复杂任务
GitHub Action 可在 google-github-actions/run-gemini-cli 获取。
注意事项
-
• 预览状态:偶尔出现限流或区域可用性问题
-
• Token 消耗:完整 agentic 模式比简单补全消耗更多 token,免费用户更易达到限制
-
• 隐私:开源特性允许自托管或审计
-
• 企业用户:与 Gemini Code Assist 相同的数据保护级别
总结
Gemini 3 Pro 集成到 CLI 后,提供了多模态、终端优先的 AI 编程体验,在 Terminal-Bench 2.0 测试中得分 54.2%。核心优势包括:
-
• 客户端和服务器端 bash 工具支持完整的 agentic workflows
-
• Extensions 生态系统连接 Dynatrace、Elastic、Figma、Snyk 等主流工具
-
• GitHub Actions 集成实现自动化 issue 分类和 PR 审查
-
• Best-in-class 文档理解和强大的空间推理能力
-
• Vibe Coding - 自然语言即代码
配合专业化工具(如 API 管理平台)可显著提升开发效率。Google 在开发者工具领域与 OpenAI 的差距已大幅缩小,终端已成为最强大的 IDE 之一。
更多推荐



所有评论(0)