Google 于 2025 年 11 月 18 日宣布 Gemini 3 Pro 正式集成到 Gemini CLI,开发者可以直接在终端使用目前最强大的 AI 编程模型之一。

Gemini CLI 简介

Gemini CLI 是 Google 开源的命令行 AI 工具(Apache 2.0 协议),通过 npm 全局安装即可使用:

npm install -g @google/gemini-cli@latest

安装完成后,在终端输入 gemini 或简写 g 即可开始使用。

使用限制

  • • 免费账户:60 次/分钟,1000 次/天

  • • Gemini 3 Pro 访问:需要 Google AI Ultra 订阅或付费 API key

  • • 其他用户可加入 waitlist 或在 GitHub 追踪进度


核心能力

技术基础

Gemini 3 Pro 的优势在于大上下文(最多 100 万 token)、原生多模态理解和高级工具调用能力,可以执行复杂的多步骤任务。

在 Terminal-Bench 2.0 测试中,Gemini 3 Pro 得分 54.2%,这是一个专门测试模型通过终端操作计算机能力的基准测试。

CLI 专属优势

客户端和服务器端 bash 工具:

  • • 客户端 bash 工具:模型可以提出 shell 命令作为 agentic workflows 的一部分

  • • 服务器端 bash 工具:用于多语言代码生成和安全原型设计

  • • 支持本地文件系统导航、开发流程驱动、系统操作自动化

Google Search 和 URL context grounding:
可以与结构化输出结合使用,特别适合构建需要获取和提取数据的 agentic 用例。

"Vibe Coding":
自然语言是唯一需要的语法,Gemini 3 Pro 解锁了这一能力的真正潜力。

1. 一句话生成生产级 3D 应用

# 提示词示例
"使用 Three.js 创建金门大桥的 3D voxel 仿真,生成单个 HTML 文件"

输出包含 InstancedMesh、自定义 GLSL shader 和性能优化的完整应用。

2. 手绘草图转可用 UI

拖拽图片到终端,Gemini 3 Pro 分析布局后生成像素级精确的 HTML、Tailwind CSS 和 React/Vue 代码。

3. 自然语言转复杂 Shell 命令

# 提示词示例
"使用 git bisect 找到把编辑器默认主题改为深色的 commit"

自动生成 bisect 脚本、执行并解释结果。

4. 自动生成可搜索文档

指向代码仓库,输出包含架构图、使用示例和搜索组件的 Markdown 文档。

5. 自主调试生产服务

连接 Cloud Run 和 Snyk,识别内存泄漏、提出修复方案、编写补丁、运行测试并部署——全程无需人工干预。


安装和配置

启用 Gemini 3 Pro

# 1. 更新到最新版本
npm install -g @google/gemini-cli@latest

# 2. 认证(需要 Ultra 或付费 API key 的 Google 账号)
gemini

# 3. 在 CLI 内开启预览功能
/settings  # 切换 previews 为 on

# 4. 切换到 Gemini 3 Pro 模型
gemini --model gemini-3-pro-preview

基本使用

# 直接提问
gemini "帮我重构这个 Python 文件"

# 拖拽文件/图片到终端作为输入
gemini  # 然后拖拽文件

与竞品对比

特性

Gemini 3 Pro CLI

OpenAI Codex / Copilot

多模态输入

✅ 支持图片、PDF、终端输出

❌ 仅文本

上下文窗口

最高 100 万 token

较小

Terminal-Bench 2.0

54.2%

未公开

工具编排

ReAct loop + MCP 服务器

有限

Bash 工具

客户端 + 服务器端

终端原生

✅ 无需 IDE

❌ 主要在 IDE 中

自主调试能力

✅ 可完成完整修复流程

⚠️ 需要更多人工介入

Extensions 生态

✅ 开放生态系统

文档理解

Best-in-class,超越 OCR

基础

免费限额

60/分钟,1000/天

较低

早期用户反馈显示,Gemini 3 Pro 在整文件生成、大型代码库重构和项目架构理解方面优于 Copilot。


实际应用场景

从草图到代码

  1. 1. 手绘 App UI,扫描后拖拽到 Gemini CLI

  2. 2. 生成 Flutter 或 React Native 代码(含导航、状态管理、API 调用占位符)

  3. 3. 要求实现后端(FastAPI/Node.js + JWT + PostgreSQL)

  4. 4. 输出完整服务代码、Dockerfile 和 OpenAPI spec

配合 API 开发工具

生成的 OpenAPI spec 可导入 Apidog 等工具:

  • • 立即创建 mock 服务供前端使用

  • • 自动化契约测试

  • • 可视化文档自动同步

  • • 一键性能和安全扫描


Extensions 生态系统

Gemini CLI 支持扩展系统,可以连接外部工具和服务:

官方合作伙伴扩展

  • • Dynatrace:实时应用性能洞察和根因分析

  • • Elastic:Elasticsearch 数据搜索和分析

  • • Figma:设计平台集成

  • • Harness:CI/CD 流程

  • • Postman:API 测试和开发

  • • Shopify:电商平台集成

  • • Snyk:安全漏洞扫描

  • • Stripe:支付服务集成

安装和使用

# 查看可用扩展
gemini /extensions

# 安装扩展(示例)
gemini install @dynatrace/gemini-cli-extension

所有扩展均可在 Gemini CLI Extensions 页面 查看和安装。


高级特性

文档理解

Gemini 3 Pro 在文档理解方面达到最佳水平,超越简单的 OCR,能够智能处理复杂文档的理解和推理。

空间推理

改进的空间理解能力支持:

  • • 桌面、移动和操作系统屏幕的智能理解

  • • 指向、轨迹预测和任务进度

  • • 自动驾驶、XR 设备和机器人等具身推理任务

模型还能基于鼠标移动和屏幕注释理解用户操作意图。


GitHub Actions 集成

Gemini CLI 0.1.18+ 支持 GitHub Actions,作为仓库的 AI 编程队友:

# 设置 GitHub Actions
gemini /setup-github

可用工作流:

  • • 🤖 智能 issue 分类:自动管理新 issue

  • • 📝 Pull Request 审查:自动化代码审查流程

  • • 🔄 多文件任务自动化:跨文件的复杂任务

GitHub Action 可在 google-github-actions/run-gemini-cli 获取。


注意事项

  • • 预览状态:偶尔出现限流或区域可用性问题

  • • Token 消耗:完整 agentic 模式比简单补全消耗更多 token,免费用户更易达到限制

  • • 隐私:开源特性允许自托管或审计

  • • 企业用户:与 Gemini Code Assist 相同的数据保护级别


总结

Gemini 3 Pro 集成到 CLI 后,提供了多模态、终端优先的 AI 编程体验,在 Terminal-Bench 2.0 测试中得分 54.2%。核心优势包括:

  • • 客户端和服务器端 bash 工具支持完整的 agentic workflows

  • • Extensions 生态系统连接 Dynatrace、Elastic、Figma、Snyk 等主流工具

  • • GitHub Actions 集成实现自动化 issue 分类和 PR 审查

  • • Best-in-class 文档理解和强大的空间推理能力

  • • Vibe Coding - 自然语言即代码

配合专业化工具(如 API 管理平台)可显著提升开发效率。Google 在开发者工具领域与 OpenAI 的差距已大幅缩小,终端已成为最强大的 IDE 之一。

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐