01

项目技术栈

前后端分离

后端:FastAPI + Uvicorn + Tortoise ORM(异步)+ LangChain 1.x + LangGraph + PyJWT + sse-starlette(Python 3.11)

前端:Vue3 + Vite + Element-Plus + Vue-Router + Axios + ECharts(SSE 流式问答、召回结果对比、评测柱状图、Agent 执行时间线)

AI 技术:混合检索(向量 + BM25 + RRF 融合)+ Rerank 重排 + 查询改写(多查询扩展 / 指代消解 / HyDE)+ 父子分块与父块回填 + 元数据过滤 + Agentic RAG(LangGraph 状态图自主决策)+ Function Calling 工具中心 + 多轮流式问答 + LLM-as-judge 四指标评测

文档处理:PyMuPDF + pdfplumber(PDF 与表格)+ python-docx + openpyxl + RapidOCR(扫描件识别,纯 CPU)+ jieba(中文分词)

数据库:MySQL(业务库)+ PostgreSQL 18 & PGVector(向量库)

版本要求:Python 不低于 3.11,MySQL 8,PostgreSQL 16 及以上并安装 PGVector 扩展,node.js 版本 18 以上,navicat 建议不低于 16

02

项目功能描述

  1. 管理员
  • 登录、个人资料、修改密码
  • 用户管理:管理系统所有用户

知识库管理

  • 知识库管理:企业资料的一级分类,绑定向量模型与切分策略
  • 切分策略:维护递归分块与父子分块两类策略及其参数
  • 检索策略:维护七个检索开关(向量、BM25、RRF、重排、查询改写、父块回填、两档阈值)
  • 文档管理:上传 PDF / Word / Excel / Markdown / TXT,解析、切分、向量化
  • 片段管理:查看与人工修正切歪了的片段
  • 检索测试:输入一个问题,看这套策略每一阶段召回了多少条、耗时多久、分数是什么量纲
  • 召回调试台:同一个问题最多四套策略并排跑,结果与耗时摆在一起对比

AI 配置

  • AI模型配置:三类模型的接入配置与连通性测试
  • Prompt模板:所有发给模型的提示词在页面维护,改完立刻生效
  • 工具中心:登记 Agent 可调用的工具,启用开关是真开关
  • 工具调用日志:查看每次工具调用的入参、返回与耗时
  • Agent执行:手动触发一次 Agentic RAG,观察模型自主决策的全过程
  • Agent运行记录:查看 Agent Run 与 Agent Step,执行过程时间线可视化

问答应用

  • 应用管理:配置问答应用绑定的知识库、检索策略与回答 Prompt
  • 问答测试:管理端直接测试问答效果
  • 对话日志与反馈:查看完整对话记录,用户点踩的问题进入优化清单

效果评测

  • 评测集管理:手工录入、从文档自动生成、从点踩沉淀三种方式维护评测用例,支持核对来源片段原文
  • 批量评测:选定评测集与检索策略跑一轮,用 LLM-as-judge 给出四项指标
  • 策略对比看板:多份报告并排,柱状图横向对比每一步优化带来的分数变化
  1. 用户
  • 登录、注册、个人资料、修改密码、头像上传
  • AI 知识问答:选择问答应用后用自然语言提问,答案 SSE 流式逐字返回
  • 引用溯源:每条回答下方列出引用的知识片段,可展开查看原文与来源文档
  • 多轮对话:同一会话内追问,"那它呢"这类指代由系统自动补全成完整问题
  • 会话管理:新建、切换、删除历史会话
  • 点赞点踩:对回答做反馈,点踩可填写原因

03

项目创新点

  1. 混合检索 + RRF 融合解决"专有名词检索不到":向量检索认识同义词但认不出 GTE-3000 这类精确型号,BM25 认得型号却听不懂同义表达,两路一起跑再用 RRF 按名次融合。融合不能直接加分数——向量给的是 0~1 的余弦相似度,BM25 没有上界,两者量纲不同,RRF 只看名次不看分数正是为此设计。中文分词还额外把 GTE3000 拆出 gte 和 3000,否则文档里写 GTE-3000 时两边一个词都对不上。
  2. 自写 LangChain 重排组件解决"答案排在后面":向量检索是双塔模型,问题和片段分开编码,存片段时并不知道用户会问什么,只能判断"整体像不像",判断不了"这段能不能回答这个问题"。重排把问题和片段拼在一起送进模型做交叉编码,准得多但慢,只能用在粗筛之后。百炼的重排接口不在 OpenAI 兼容模式下,因此把它包装成 LangChain 的 BaseDocumentCompressor,作为标准组件接进检索链路。
  3. 分数量纲显式化,阈值按量纲分开配:score 这一个字段在管线里被反复覆盖,每覆盖一次量纲就换一次——余弦相似度(相关片段实测 0.46-0.77)、BM25 分数(无上界)、RRF 名次分(0.016-0.033)、重排相关分(相关片段实测 0.14~0.20)。四种量纲取值范围差一个数量级,用同一个阈值去卡会把结果整片砍掉。所以量纲作为显式信息跟着结果一路传下去,策略表里给余弦相似度和重排相关分各配一个阈值,RRF 名次分只表示名次先后、不做阈值过滤且在页面上明确标注"本次不适用"。
  4. 父子分块解决"找得准"与"答得全"的矛盾:片段小则语义集中命中准、但上下文不全;片段大则上下文完整、但一段混多个主题难命中。两个要求对尺寸的需求是反的,于是切两遍:只把子块向量化参与检索,命中后回填整个父块给模型生成——小块用来找,大块用来答。
  5. Agentic RAG:调用次数由模型决定,而不是写死在代码里:用 LangGraph 把"检索 → 评估 → 改写 → 再检索 → 生成 → 自查"编成状态图,检索几轮、改写几次、答案不合格要不要重来,全由模型每一轮的判断决定,代码只设循环上限。同一个问题问两次,走出来的步数和检索次数可能完全不同,这是 Agent 与固定流程编排的本质区别。这套 Agent 的自主性不在「调哪个工具」而在「自己的产出够不够好」,状态图上只用检索一个工具,属于 Agentic RAG(Self-RAG / CRAG 一系)范式,其中「答案没支撑就回去重写」一环是 Reflection 的简化形态。
  6. 执行过程全程落库,自主决策可复盘:模型自主决策的副作用是过程像黑盒,所以每一步都落成 agentstep(节点名、输入、输出、状态、耗时),配合 agentrun 主记录和前端执行时间线,能完整回放"这一次模型为什么这样答"。
  7. 实现 LLM-as-judge 四指标:Context Recall 看该找的资料找回来没有、Context Precision 看有用的资料排在前面没有、Faithfulness 看答案有没有编、Answer Relevancy 看有没有跑题。四个指标把 RAG 拆成"找资料"和"写答案"两段各测两项,分数低时先看它属于哪一段,就知道该去调检索策略还是调 Prompt。裁判模型 temperature 必须为 0,否则两次评测的差异分不清是策略变了还是裁判抖了。
  8. 评测用例带来源片段,Context Recall 不靠模型判断:从文档自动生成用例时,要求模型逐条标出答案来自哪一个片段,这个片段 ID 回写到用例上。算 Context Recall 时直接做集合运算,比让模型判断更准也更省钱。参照必须精确到单条——记成整篇文档的全部片段会把分母撑大,答案明明只在一段里却要求整篇都召回才算满分,top_k=5、文档 9 段时理论上限只有 5/9,这个指标就废了。
  9. 优化效果用数据证明,不靠"我觉得变好了":同一套评测集换不同检索策略反复跑,报告并排进对比看板。实测同一批用例:基线纯向量检索综合 0.7988,完整策略(混合检索 + 重排 + 改写 + 父块回填)0.9616,其中一条问题在基线下召回排第 12 位拿不到、重排后被顶到第 1 位。前面所有检索优化的价值,就落在这张对比图上。

04

关键页面截图

AI行业迎来前所未有的爆发式增长:从DeepSeek百万年薪招聘AI研究员,到百度、阿里、腾讯等大厂疯狂布局AI Agent,再到国家政策大力扶持数字经济和AI人才培养,所有信号都在告诉我们:AI的黄金十年,真的来了!

在行业火爆之下,AI人才争夺战也日趋白热化,其就业前景一片蓝海!

我给大家准备了一份全套的《AI大模型零基础入门+进阶学习资源包》,包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。😝有需要的小伙伴,可以VX扫描下方二维码免费领取🆓

在这里插入图片描述

人才缺口巨大

人力资源社会保障部有关报告显示,据测算,当前,****我国人工智能人才缺口超过500万,****供求比例达1∶10。脉脉最新数据也显示:AI新发岗位量较去年初暴增29倍,超1000家AI企业释放7.2万+岗位……

单拿今年的秋招来说,各互联网大厂释放出来的招聘信息中,我们就能感受到AI浪潮,比如百度90%的技术岗都与AI相关!
图片

就业薪资超高

在旺盛的市场需求下,AI岗位不仅招聘量大,薪资待遇更是“一骑绝尘”。企业为抢AI核心人才,薪资给的非常慷慨,过去一年,懂AI的人才普遍涨薪40%+!

脉脉高聘发布的《2025年度人才迁徙报告》显示,在2025年1月-10月的高薪岗位Top20排行中,AI相关岗位占了绝大多数,并且平均薪资月薪都超过6w!

在去年的秋招中,小红书给算法相关岗位的薪资为50k起,字节开出228万元的超高年薪,据《2025年秋季校园招聘白皮书》,AI算法类平均年薪达36.9万,遥遥领先其他行业!

图片

总结来说,当前人工智能岗位需求多,薪资高,前景好。在职场里,选对赛道就能赢在起跑线。抓住AI风口,轻松实现高薪就业!

但现实却是,仍有很多同学不知道如何抓住AI机遇,会遇到很多就业难题,比如:

❌ 技术过时:只会CRUD的开发者,在AI浪潮中沦为“职场裸奔者”;

❌ 薪资停滞:初级岗位内卷到白菜价,传统开发3年经验薪资涨幅不足15%;

❌ 转型无门:想学AI却找不到系统路径,83%自学党中途放弃。

他们的就业难题解决问题的关键在于:不仅要选对赛道,更要跟对老师!

我给大家准备了一份全套的《AI大模型零基础入门+进阶学习资源包》,包括AI大模型入门学习思维导图、精品AI大模型学习书籍手册、视频教程、实战学习等录播视频免费分享出来。😝有需要的小伙伴,可以VX扫描下方二维码免费领取🆓

在这里插入图片描述

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐