零基础入门:如何用星图平台快速搭建Qwen3-VL飞书机器人
零基础入门:如何用星图平台快速搭建Qwen3-VL飞书机器人
1. 学习目标与前置说明
1.1 你能学会什么
这是一篇真正面向零基础用户的实操指南,不假设你懂飞书开发、不预设你熟悉机器人配置、也不要求你会写代码。学完本教程,你将能:
- 在5分钟内完成飞书企业自建应用创建,拿到 App ID 和 App Secret
- 跳过所有复杂配置——Clawdbot 镜像已预装飞书插件,无需手动编译或调试
- 通过3条命令(
plugins install、channels add、gateway)完成全部接入流程 - 看到飞书工作台里自己的机器人实时响应图片+文字混合提问
- 理解为什么 Qwen3-VL 能看懂截图里的表格、识别PPT中的图表、甚至分析产品原型图
整个过程不需要公网IP、不暴露服务器、不改防火墙,所有操作都在星图AI云平台内闭环完成。
1.2 你需要准备什么
别担心“环境配置”四个字——这次真的不用你动手装任何东西。只需确认以下三点:
- 一个飞书企业账号(管理员或有应用创建权限的成员)
- 一台已成功运行 Qwen3-VL:30B 私有化镜像 的星图云服务器(上篇已完成)
- 一部手机或电脑,能打开飞书App和浏览器即可
提示:如果你还没部署 Qwen3-VL:30B,建议先阅读《上篇》;但即使没读,本篇也完全可独立操作——因为 Clawdbot 镜像已内置完整推理服务,你只需要“接上线”。
2. 核心逻辑一句话讲清:为什么这个方案特别适合新手
2.1 不是“从零造轮子”,而是“把轮子装上车”
很多教程教你从头写飞书机器人SDK、配WebSocket心跳、处理签名验证……但本方案完全不同:
- Clawdbot 是一个开箱即用的多模态Agent网关,它已经封装好了:
- 飞书事件解析(消息/卡片/图片/文件上传)
- 模型调用路由(自动把图文请求转发给本地 Qwen3-VL)
- 响应格式转换(把模型输出转成飞书支持的富文本+卡片)
- 星图平台提供的是预置好驱动、CUDA、模型权重、依赖库的一体化镜像,不是裸机。
- 所以你做的不是“开发”,而是“连接”——就像把打印机USB线插进电脑,按一下“添加设备”按钮。
2.2 Qwen3-VL 的多模态能力,才是飞书机器人的真正价值点
普通大模型只能读文字,而 Qwen3-VL:30B 可以:
- 看懂你发来的带公式的Excel截图,直接回答“第三列平均值是多少”
- 分析产品需求文档PDF的第一页扫描图,总结核心功能点
- 解读手机拍的模糊白板照片,还原会议讨论要点
- 理解UI设计稿截图中的按钮布局和文案,生成对应前端代码建议
这才是企业级助手该有的样子——不是聊天玩具,而是能处理真实办公素材的“数字同事”。
3. 第一步:在飞书开放平台创建你的专属机器人
3.1 进入后台,三步建应用
打开 飞书开放平台,用企业管理员账号登录。
- 点击左上角 “创建企业自建应用”
- 填写应用名称(例如:
Clawd助教)、描述(例如:基于Qwen3-VL的多模态办公助手) - 点击“创建”
小技巧:图标建议上传一张简洁的蓝色系logo(尺寸256×256),飞书会自动裁剪为圆形。不要用文字图,小图标上看不清。
3.2 开启机器人能力,获取关键凭证
创建完成后,进入应用管理页:
- 左侧菜单 → “添加应用能力” → 搜索“机器人” → 点击“添加”
- 左侧菜单 → “凭证与基础信息” → 找到并复制两行关键信息:
App ID(一长串字母数字组合)App Secret(另一长串,带下划线)
注意:这两串字符就是你机器人的“身份证+密码”,请务必保存好。它们只在此页面显示一次,后续无法再查看明文。
3.3 提交第一个版本(1.0.0),为后续配置铺路
- 左侧菜单 → “版本管理” → 点击右上角 “新建版本”
- 版本号填
1.0.0,描述写“初始版本,用于配置机器人凭证” - 点击“提交”
为什么必须做这一步?因为飞书要求“有版本才能配置事件订阅和权限”。这不是多余步骤,而是系统强制流程。
4. 第二步:在星图服务器上完成飞书插件绑定
4.1 插件已就位,只需一键启用
回到你的星图云服务器终端(SSH 或 Web Terminal),执行:
# 安装飞书专用通信插件(镜像已预装,此命令仅激活)
clawdbot plugins install @m1heng-clawd/feishu
你会看到类似这样的输出:
✔ Plugin @m1heng-clawd/feishu installed successfully
→ Available commands: clawdbot feishu:setup, clawdbot feishu:status
说明:这个插件不是从网络下载的,而是从镜像内置包加载的。所以即使服务器断网,也能安装成功。
4.2 把飞书App ID 和 Secret 填进 Clawdbot
继续在终端输入:
# 启动交互式配置向导
clawdbot channels add
按提示依次输入:
- Channel Type:选择
feishu(回车确认) - App ID:粘贴你刚复制的 App ID(回车)
- App Secret:粘贴你刚复制的 App Secret(回车)
- Bot Name:输入你想在飞书里显示的名字(如
Clawd助教,回车)
完成后你会看到:
Feishu channel added successfully
→ Channel ID: feishu-abc123def456
→ Status: ready
小贴士:如果输错了,可以随时用
clawdbot channels list查看已配置渠道,并用clawdbot channels remove <id>删除重来。
5. 第三步:在飞书后台完成事件与权限联动
5.1 先让 Clawdbot 网关跑起来
在星图服务器终端,执行:
# 启动或重启网关服务(自动加载最新配置)
clawdbot gateway
你会看到日志开始滚动,其中包含:
[INFO] Gateway started on ws://localhost:8080
[INFO] Feishu channel connected: feishu-abc123def456
[INFO] Model backend ready: qwen3-vl-30b (local)
这表示:Clawdbot 已准备好接收飞书消息,并能调用本地 Qwen3-VL 模型。
5.2 配置事件订阅:告诉飞书“把哪些消息发给我”
回到飞书开放平台,进入你的应用 → 左侧菜单 “事件订阅”:
- 订阅模式:选择 “长连接(WebSocket)”(推荐!无需公网IP)
- WebSocket 地址:填入
ws://<你的星图服务器公网IP>:8080- 如何查IP?在星图控制台 → 云服务器列表 → 找到你的实例 → “公网IP”列
- 点击“保存”
如果提示“未建立长链接”,请检查:
- 星图服务器是否运行着
clawdbot gateway(用ps aux | grep clawdbot确认)- 飞书填写的IP和端口是否与
clawdbot gateway日志中一致- 星图安全组是否放行了 8080 端口(默认已开放)
5.3 订阅核心事件,让机器人“能听懂话”
在“事件订阅”页面 → 点击 “添加事件” → 勾选以下两项:
im.message.receive_v1(接收消息)contact.user.add_v1(用户添加机器人时触发,用于欢迎语)
为什么只选这两个?因为这是最精简的“能对话”组合。其他事件(如群聊、文件上传)可在后续按需开启。
5.4 开通必要权限,让机器人“有权限做事”
左侧菜单 → “权限管理” → 点击 “添加权限”:
| 权限名称 | 勾选项 | 为什么需要 |
|---|---|---|
| 获取基础用户信息 | contact:user.base:readonly |
识别谁在提问,显示昵称 |
| 接收与发送消息 | im:message 下全选 |
最核心权限,否则连消息都收不到 |
勾选后点击“确定”,再点击右上角 “发布新版本”(版本号可填 1.0.1)。
发布后,飞书才会把权限同步给你的机器人。不发布=没权限=收不到消息。
6. 第四步:真机测试——发一张图+一句话,看它怎么回答
6.1 在飞书里找到你的机器人
打开手机或电脑版飞书 → 点击底部 【工作台】 → 顶部搜索框输入你的应用名(如 Clawd助教)→ 点击进入。
你会看到一个干净的聊天窗口,顶部显示机器人头像和名字。
6.2 发送第一张测试图
- 点击输入框右侧的「+」→ 选择「图片」→ 上传一张含文字的截图(比如微信聊天记录、Excel表格、PPT页面)
- 在输入框里打一行字,例如:
这张图里第三列的总和是多少?
发送。
6.3 观察三处实时反馈,确认链路畅通
- 飞书端:几秒后,机器人会回复一段文字,可能还附带一张分析后的标注图(取决于模型输出)
- 星图终端:
clawdbot gateway日志中会出现类似:[INFO] Received image message from user_abc123 [INFO] Forwarding to Qwen3-VL:30B (48GB GPU in use) [INFO] Response generated in 4.2s → sending back to Feishu - 星图控制台:GPU监控图表会明显跳升,显存占用从 idle 状态冲到 30%~50%
成功标志:三处反馈时间差小于2秒,且飞书收到的回答内容与图片内容强相关。
7. 实用技巧与避坑指南(来自真实踩坑现场)
7.1 图片传不上去?试试这三个办法
现象:飞书提示“图片上传失败”或机器人无响应
解决方案:
- 用手机截屏后直接发(避免微信二次压缩)
- 电脑端用快捷键
Win+Shift+S(Windows)或Cmd+Shift+4(Mac)截图,再拖入飞书 - 如果必须传原图,在飞书聊天窗口点「+」→「文件」→ 上传
.png格式(比.jpg更保真)
7.2 回答太慢?调整这一个参数
Qwen3-VL:30B 默认启用高精度推理,对单张图分析较慢。如需提速:
# 进入 Clawdbot 配置目录
cd /opt/clawdbot/config
# 编辑模型配置(用 nano/vi)
nano model.yaml
找到 qwen3-vl-30b 区块,把 precision: fp16 改为:
precision: fp8
然后重启网关:clawdbot gateway
效果:响应时间缩短约35%,对办公场景图片质量无明显下降。
7.3 想让它记住上下文?加一句 system prompt
Clawdbot 支持全局 prompt 设置。编辑 /opt/clawdbot/config/prompt.yaml:
system_prompt: |
你是一名专注办公提效的AI助手,擅长从截图中提取结构化信息。
用户每次发送的图片都是当前任务的唯一依据,请严格基于图片内容回答,不编造、不猜测。
如果图片模糊或信息不全,请如实说明,不要强行解读。
保存后重启:clawdbot gateway
效果:回答更聚焦、更严谨,减少“幻觉”。
8. 总结
8.1 你刚刚完成了什么
你不是在“搭一个机器人”,而是在为企业构建了一条私有化的多模态智能流水线:
- 底层:Qwen3-VL:30B 在星图云上安静运行,数据不出内网
- 中层:Clawdbot 作为智能网关,把飞书协议翻译成模型能懂的语言
- 顶层:飞书工作台成为统一入口,员工用最熟悉的方式(发图+打字)调用AI能力
整套链路没有一行自定义代码,没有一次公网暴露,没有一次手动编译——全是开箱即用的工程化封装。
8.2 下一步你可以做什么
- 扩展场景:把机器人拉进部门群,设置关键词自动响应(如“帮我写周报”→调用Qwen3-VL生成草稿)
- 提升体验:上传公司Logo和品牌色,定制机器人头像与欢迎卡片
- 深化集成:用 Clawdbot 的
@m1heng-clawd/airtable插件,让机器人自动把分析结果存入Airtable数据库 - 升级模型:星图镜像支持一键切换 Qwen3-VL:72B(需更高配GPU),获得更强图文理解力
真正的AI落地,从来不是比谁模型参数大,而是比谁能让一线员工在30秒内用上。
---
> **获取更多AI镜像**
>
> 想探索更多AI镜像和应用场景?访问 [CSDN星图镜像广场](https://ai.csdn.net/?utm_source=mirror_blog_end),提供丰富的预置镜像,覆盖大模型推理、图像生成、视频生成、模型微调等多个领域,支持一键部署。
更多推荐


所有评论(0)