基于FastAPI的智能会议系统开发(二)
·
目录
一.语音转文字
prompt如下:
开发语音转文字功能,ASR 模型使用 Qwen3‑ASR‑Flash, 参考文档如下: https://bailian.console.aliyun.com/cn-beijing?spm=5176.29597918.0.d_primary.632e133cWcDLR5&tab=doc#/doc/?type=model&url=2979031
创建多个脚本来管理不同的功能:
clients.py 用于获取这个客户端,连接云服务
asr.py 用于将本地上传的文件转成 data url
config 加 DASHSCOPE_API_KEY、DASHSCOPE_WORKSPACE_ID、asr_model (默认 qwen3‑asr‑flash)
最后的话呢,再创建一个 pipeline 啊,然后专门去转写内容就可以了。
这几个功能都放到routers文件里。
二.Agent结构化分析
开发Agent功能,脚本名是app/agent_service.py 将文本内容提炼出需要的内容:包含摘要、代办、紧急标记并入库
使用阿里云百炼的语音模型Qwen3-ASR-Flash,会议视频里的语句转文字,这属于非实时语音识别,生成api key,如下将相应信息填入环境配置文件中:

三.综合测试
直接让ai帮忙改bug。
四.生成前端
在frontend文件夹中创建前端项目,技术选型用Vue3,样式方案TailwindCSS 注意:功能要根据当前后端的接口和业务功能来进行开发。
最后按照ai的步骤启动项目,


把会议视频拖进去,就自动生成这个会议对应的摘要和待办事项等要素了。
这项目开发的没啥含金量,算是先开个头体验一下AI开发吧。
更多推荐



所有评论(0)