零基础入门:如何用星图平台快速搭建Qwen3-VL飞书机器人

1. 学习目标与前置说明

1.1 你能学会什么

这是一篇真正面向零基础用户的实操指南,不假设你懂飞书开发、不预设你熟悉机器人配置、也不要求你会写代码。学完本教程,你将能:

  • 5分钟内完成飞书企业自建应用创建,拿到 App ID 和 App Secret
  • 跳过所有复杂配置——Clawdbot 镜像已预装飞书插件,无需手动编译或调试
  • 通过3条命令plugins installchannels addgateway)完成全部接入流程
  • 看到飞书工作台里自己的机器人实时响应图片+文字混合提问
  • 理解为什么 Qwen3-VL 能看懂截图里的表格、识别PPT中的图表、甚至分析产品原型图

整个过程不需要公网IP、不暴露服务器、不改防火墙,所有操作都在星图AI云平台内闭环完成。

1.2 你需要准备什么

别担心“环境配置”四个字——这次真的不用你动手装任何东西。只需确认以下三点:

  • 一个飞书企业账号(管理员或有应用创建权限的成员)
  • 一台已成功运行 Qwen3-VL:30B 私有化镜像 的星图云服务器(上篇已完成)
  • 一部手机或电脑,能打开飞书App和浏览器即可

提示:如果你还没部署 Qwen3-VL:30B,建议先阅读《上篇》;但即使没读,本篇也完全可独立操作——因为 Clawdbot 镜像已内置完整推理服务,你只需要“接上线”。

2. 核心逻辑一句话讲清:为什么这个方案特别适合新手

2.1 不是“从零造轮子”,而是“把轮子装上车”

很多教程教你从头写飞书机器人SDK、配WebSocket心跳、处理签名验证……但本方案完全不同:

  • Clawdbot 是一个开箱即用的多模态Agent网关,它已经封装好了:
    • 飞书事件解析(消息/卡片/图片/文件上传)
    • 模型调用路由(自动把图文请求转发给本地 Qwen3-VL)
    • 响应格式转换(把模型输出转成飞书支持的富文本+卡片)
  • 星图平台提供的是预置好驱动、CUDA、模型权重、依赖库的一体化镜像,不是裸机。
  • 所以你做的不是“开发”,而是“连接”——就像把打印机USB线插进电脑,按一下“添加设备”按钮。

2.2 Qwen3-VL 的多模态能力,才是飞书机器人的真正价值点

普通大模型只能读文字,而 Qwen3-VL:30B 可以:

  • 看懂你发来的带公式的Excel截图,直接回答“第三列平均值是多少”
  • 分析产品需求文档PDF的第一页扫描图,总结核心功能点
  • 解读手机拍的模糊白板照片,还原会议讨论要点
  • 理解UI设计稿截图中的按钮布局和文案,生成对应前端代码建议

这才是企业级助手该有的样子——不是聊天玩具,而是能处理真实办公素材的“数字同事”。

3. 第一步:在飞书开放平台创建你的专属机器人

3.1 进入后台,三步建应用

打开 飞书开放平台,用企业管理员账号登录。

  1. 点击左上角 “创建企业自建应用”
  2. 填写应用名称(例如:Clawd助教)、描述(例如:基于Qwen3-VL的多模态办公助手
  3. 点击“创建”

小技巧:图标建议上传一张简洁的蓝色系logo(尺寸256×256),飞书会自动裁剪为圆形。不要用文字图,小图标上看不清。

3.2 开启机器人能力,获取关键凭证

创建完成后,进入应用管理页:

  • 左侧菜单 → “添加应用能力” → 搜索“机器人” → 点击“添加”
  • 左侧菜单 → “凭证与基础信息” → 找到并复制两行关键信息:
    • App ID(一长串字母数字组合)
    • App Secret(另一长串,带下划线)

注意:这两串字符就是你机器人的“身份证+密码”,请务必保存好。它们只在此页面显示一次,后续无法再查看明文。

3.3 提交第一个版本(1.0.0),为后续配置铺路

  • 左侧菜单 → “版本管理” → 点击右上角 “新建版本”
  • 版本号填 1.0.0,描述写“初始版本,用于配置机器人凭证”
  • 点击“提交”

为什么必须做这一步?因为飞书要求“有版本才能配置事件订阅和权限”。这不是多余步骤,而是系统强制流程。

4. 第二步:在星图服务器上完成飞书插件绑定

4.1 插件已就位,只需一键启用

回到你的星图云服务器终端(SSH 或 Web Terminal),执行:

# 安装飞书专用通信插件(镜像已预装,此命令仅激活)
clawdbot plugins install @m1heng-clawd/feishu

你会看到类似这样的输出:

✔ Plugin @m1heng-clawd/feishu installed successfully
→ Available commands: clawdbot feishu:setup, clawdbot feishu:status

说明:这个插件不是从网络下载的,而是从镜像内置包加载的。所以即使服务器断网,也能安装成功。

4.2 把飞书App ID 和 Secret 填进 Clawdbot

继续在终端输入:

# 启动交互式配置向导
clawdbot channels add

按提示依次输入:

  1. Channel Type:选择 feishu(回车确认)
  2. App ID:粘贴你刚复制的 App ID(回车)
  3. App Secret:粘贴你刚复制的 App Secret(回车)
  4. Bot Name:输入你想在飞书里显示的名字(如 Clawd助教,回车)

完成后你会看到:

 Feishu channel added successfully
→ Channel ID: feishu-abc123def456
→ Status: ready

小贴士:如果输错了,可以随时用 clawdbot channels list 查看已配置渠道,并用 clawdbot channels remove <id> 删除重来。

5. 第三步:在飞书后台完成事件与权限联动

5.1 先让 Clawdbot 网关跑起来

在星图服务器终端,执行:

# 启动或重启网关服务(自动加载最新配置)
clawdbot gateway

你会看到日志开始滚动,其中包含:

[INFO] Gateway started on ws://localhost:8080
[INFO] Feishu channel connected: feishu-abc123def456
[INFO] Model backend ready: qwen3-vl-30b (local)

这表示:Clawdbot 已准备好接收飞书消息,并能调用本地 Qwen3-VL 模型。

5.2 配置事件订阅:告诉飞书“把哪些消息发给我”

回到飞书开放平台,进入你的应用 → 左侧菜单 “事件订阅”

  • 订阅模式:选择 “长连接(WebSocket)”(推荐!无需公网IP)
  • WebSocket 地址:填入 ws://<你的星图服务器公网IP>:8080
    • 如何查IP?在星图控制台 → 云服务器列表 → 找到你的实例 → “公网IP”列
  • 点击“保存”

如果提示“未建立长链接”,请检查:

  • 星图服务器是否运行着 clawdbot gateway(用 ps aux | grep clawdbot 确认)
  • 飞书填写的IP和端口是否与 clawdbot gateway 日志中一致
  • 星图安全组是否放行了 8080 端口(默认已开放)

5.3 订阅核心事件,让机器人“能听懂话”

在“事件订阅”页面 → 点击 “添加事件” → 勾选以下两项:

  • im.message.receive_v1(接收消息)
  • contact.user.add_v1(用户添加机器人时触发,用于欢迎语)

为什么只选这两个?因为这是最精简的“能对话”组合。其他事件(如群聊、文件上传)可在后续按需开启。

5.4 开通必要权限,让机器人“有权限做事”

左侧菜单 → “权限管理” → 点击 “添加权限”

权限名称 勾选项 为什么需要
获取基础用户信息 contact:user.base:readonly 识别谁在提问,显示昵称
接收与发送消息 im:message 下全选 最核心权限,否则连消息都收不到

勾选后点击“确定”,再点击右上角 “发布新版本”(版本号可填 1.0.1)。

发布后,飞书才会把权限同步给你的机器人。不发布=没权限=收不到消息。

6. 第四步:真机测试——发一张图+一句话,看它怎么回答

6.1 在飞书里找到你的机器人

打开手机或电脑版飞书 → 点击底部 【工作台】 → 顶部搜索框输入你的应用名(如 Clawd助教)→ 点击进入。

你会看到一个干净的聊天窗口,顶部显示机器人头像和名字。

6.2 发送第一张测试图

  • 点击输入框右侧的「+」→ 选择「图片」→ 上传一张含文字的截图(比如微信聊天记录、Excel表格、PPT页面)
  • 在输入框里打一行字,例如:
    这张图里第三列的总和是多少?

发送。

6.3 观察三处实时反馈,确认链路畅通

  1. 飞书端:几秒后,机器人会回复一段文字,可能还附带一张分析后的标注图(取决于模型输出)
  2. 星图终端clawdbot gateway 日志中会出现类似:
    [INFO] Received image message from user_abc123
    [INFO] Forwarding to Qwen3-VL:30B (48GB GPU in use)
    [INFO] Response generated in 4.2s → sending back to Feishu
    
  3. 星图控制台:GPU监控图表会明显跳升,显存占用从 idle 状态冲到 30%~50%

成功标志:三处反馈时间差小于2秒,且飞书收到的回答内容与图片内容强相关。

7. 实用技巧与避坑指南(来自真实踩坑现场)

7.1 图片传不上去?试试这三个办法

现象:飞书提示“图片上传失败”或机器人无响应
解决方案:

  • 用手机截屏后直接发(避免微信二次压缩)
  • 电脑端用快捷键 Win+Shift+S(Windows)或 Cmd+Shift+4(Mac)截图,再拖入飞书
  • 如果必须传原图,在飞书聊天窗口点「+」→「文件」→ 上传 .png 格式(比 .jpg 更保真)

7.2 回答太慢?调整这一个参数

Qwen3-VL:30B 默认启用高精度推理,对单张图分析较慢。如需提速:

# 进入 Clawdbot 配置目录
cd /opt/clawdbot/config

# 编辑模型配置(用 nano/vi)
nano model.yaml

找到 qwen3-vl-30b 区块,把 precision: fp16 改为:

precision: fp8

然后重启网关:clawdbot gateway
效果:响应时间缩短约35%,对办公场景图片质量无明显下降。

7.3 想让它记住上下文?加一句 system prompt

Clawdbot 支持全局 prompt 设置。编辑 /opt/clawdbot/config/prompt.yaml

system_prompt: |
  你是一名专注办公提效的AI助手,擅长从截图中提取结构化信息。
  用户每次发送的图片都是当前任务的唯一依据,请严格基于图片内容回答,不编造、不猜测。
  如果图片模糊或信息不全,请如实说明,不要强行解读。

保存后重启:clawdbot gateway
效果:回答更聚焦、更严谨,减少“幻觉”。

8. 总结

8.1 你刚刚完成了什么

你不是在“搭一个机器人”,而是在为企业构建了一条私有化的多模态智能流水线

  • 底层:Qwen3-VL:30B 在星图云上安静运行,数据不出内网
  • 中层:Clawdbot 作为智能网关,把飞书协议翻译成模型能懂的语言
  • 顶层:飞书工作台成为统一入口,员工用最熟悉的方式(发图+打字)调用AI能力

整套链路没有一行自定义代码,没有一次公网暴露,没有一次手动编译——全是开箱即用的工程化封装。

8.2 下一步你可以做什么

  • 扩展场景:把机器人拉进部门群,设置关键词自动响应(如“帮我写周报”→调用Qwen3-VL生成草稿)
  • 提升体验:上传公司Logo和品牌色,定制机器人头像与欢迎卡片
  • 深化集成:用 Clawdbot 的 @m1heng-clawd/airtable 插件,让机器人自动把分析结果存入Airtable数据库
  • 升级模型:星图镜像支持一键切换 Qwen3-VL:72B(需更高配GPU),获得更强图文理解力

真正的AI落地,从来不是比谁模型参数大,而是比谁能让一线员工在30秒内用上。

---

> **获取更多AI镜像**
>
> 想探索更多AI镜像和应用场景?访问 [CSDN星图镜像广场](https://ai.csdn.net/?utm_source=mirror_blog_end),提供丰富的预置镜像,覆盖大模型推理、图像生成、视频生成、模型微调等多个领域,支持一键部署。
Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐