FastGPT 是国内最适合”开箱即用搭问答机器人”的 RAG 工具——配置最少,10 分钟跑起来,下面用 Qwen2.5 搭一个客服 FAQ 系统。下面按”为什么选 FastGPT → 怎么搭 → 接 Qwen/DeepSeek → 调优”讲清楚。
我自己 2024 年帮一个跨境电商团队搭过 FastGPT 客服 FAQ——以前用 Excel + 人工回复,处理一次客户问题 5-15 分钟;改用 FastGPT + Qwen 后 80% 问题 30 秒内自动答,剩下 20% 转人工。FastGPT 的好处是”配置即用、不折腾”。

为什么选 FastGPT
FastGPT(项目名 labring/FastGPT)2023 年起开源,是国内早期 RAG 平台之一。定位开箱即用的知识库问答机器人。优势:
- 配置最少:Docker Compose 一行起、知识库导入、模型对接、对话测试一气呵成
- 国内社区成熟:中文文档、中文论坛、问题响应快
- 模型对接完整:DeepSeek / Qwen / GLM / OpenAI 都支持
- 知识库管理 UI 直观:拖拽上传、批量导入、问答对编辑
劣势:复杂工作流编排弱于 Dify、文档解析一般(复杂 PDF 用 RAGFlow 更好)。
FastGPT 适合:客服 FAQ、产品问答、内部知识库、企业简单 RAG 应用。不适合:复杂多步 agent 流程、复杂文档解析。
部署前准备
- VPS:2 核 2G 起步(推荐 萤光云香港 CN2 VPS 体验型 ¥80/月,国内访问快)
- API key:DeepSeek 或 Qwen 任一
FastGPT 比 Dify / RAGFlow 轻很多,2 核 2G 起步够用。

Docker Compose 部署
- SSH 到 VPS
- 装 Docker + Docker Compose
- 拉 FastGPT:
git clone https://github.com/labring/FastGPT.git - 进入 docker 目录:
cd FastGPT/deploy/docker - 复制环境变量:
cp .env.example .env - 编辑
.env,设置 CHAT_API_KEY(DeepSeek/Qwen key) - 启动:
docker compose up -d - 浏览器访问 3000 端口,初始化 admin
5-10 分钟跑起来。
配置国内大模型
登录 FastGPT 后台 → 模型设置 → 添加:
DeepSeek 配置:
- 模型类型:OpenAI-API-compatible
- API base:
https://api.deepseek.com/v1 - API key:你的 DeepSeek key
- 模型名:
deepseek-chat
Qwen 配置:
- API base:
https://dashscope.aliyuncs.com/compatible-mode/v1 - 模型名:
qwen-plus(客服 FAQ 性价比最高)
FastGPT 配置比 Dify 简单,模型列表里直接选添加。
创建第一个知识库
- FastGPT 后台 → 知识库 → 新建
- 上传文档(PDF / Word / Markdown / 纯文本)
- 配置文档切块策略(默认就行,复杂文档再调)
- 配置 Embedding(推荐 m3e 或 bge-large-zh,免费本地)
- 点”开始训练”——文档解析 + Embedding 入库,几分钟到几小时
- 训练完成后,对话界面测试问问题
创建客服 FAQ 应用
- FastGPT 后台 → 应用 → 新建简易应用
- 关联上面创建的知识库
- 配置提示词模板(”你是 XX 品牌的客服助手,请基于以下知识库回答用户问题…”)
- 选择模型(Qwen-Plus 或 DeepSeek-Chat)
- 配置对外 API(可以接入自己网站、微信群、客服系统)
客服 FAQ 系统 30 分钟搭完。
常见问题 FAQ
Q1:FastGPT 跑 2 核 2G 够吗?
够用。1000 文档以内的知识库 + 100 QPS 并发都跑得动。文档量超 10 GB 升 4 核 8G。
Q2:FastGPT 一定要接 DeepSeek / Qwen 吗?
不一定。FastGPT 是 OpenAI 兼容接口,能接 GPT-4 / Claude / Gemini / Ollama 本地模型。推荐国内用 DeepSeek / Qwen,海外用 OpenAI / Anthropic。
Q3:FastGPT vs Dify 选哪个?
客服 FAQ / 简单问答选 FastGPT(最快上手)。复杂工作流 / 多模型切换 / Agent 编排选 Dify。两者经常组合——FastGPT 做知识库、Dify 做应用。
Q4:FastGPT 数据安全吗?
自托管版数据完全在你 VPS 上,包括知识库文档、对话历史、用户配置。接的 LLM API 只是推理(实际查询时调用),文档不传给模型方训练。
Q5:FastGPT 能做多轮对话吗?
能。FastGPT 支持多轮对话上下文、变量提取、问题分类。客服场景常用多轮确认用户问题再调用知识库。
总结
FastGPT 是国内 RAG 工具里配置最少、上手最快的——10 分钟跑起来,30 分钟搭出客服 FAQ。配置关键是接 Qwen-Plus 或 DeepSeek-Chat 作 Chat 模型 + bge-large-zh / m3e 作 Embedding(本地免费)。
如果刚开始做客服 FAQ 自动化,从”萤光云香港 CN2 2 核 2G + FastGPT Docker + Qwen-Plus API”这个最小组合入手——2 核 2G ¥80/月够用,Qwen API 几十块每月,自动回复 80% 常见问题。
需要海外 VPS?萤光云香港 CN2 VPS 2 核 2G 体验型 ¥80/月起,日本 VPS 也是好选择。







