Dify 装好后第一件事是接哪个模型?——这是 2025 年 Dify 私有化部署后最常见的问题。Dify 默认接 OpenAI,但国内用 OpenAI 麻烦(需海外通道),接 Qwen2.5 / DeepSeek-V3 / GLM-4 反而最稳。下面按”为什么接国内模型 → 怎么接 → 模型选择 → 性能调优”讲清楚。
我自己帮 3 个跨境卖家团队搭过 Dify——第一次默认 OpenAI 出问题、换成 DeepSeek 后稳定跑了半年、再换 Qwen2.5-Max 跑中文场景更顺。模型选择直接决定 Dify 的实际效果。

为什么要接国内大模型
Dify 是模型无关的(OpenAI 兼容接口),但默认接 OpenAI 在国内有三个问题:
- 访问:OpenAI 国内访问需要海外通道,企业账号稳定但个人不便
- 中文:GPT 在中文场景效果一般,不如 Qwen/GLM 训练数据多
- 成本:DeepSeek 性价比高于 GPT-4 几倍,Qwen2.5-Max 也不贵
结论:国内用 Dify 必接国内开源大模型,DeepSeek 和 Qwen 是首选。
部署前准备
两件事:
- VPS:2 核 4G 起步(推荐 萤光云美西 VPS 体验型 ¥80/月,Dify 跑 Web + 数据库 + Redis);企业级数据量大升 4 核 8G + 数据库分离
- API key:先注册阿里云百炼(Qwen)或 DeepSeek 开放平台,拿 API key
国内模型 API 平台选择:
- DeepSeek 开放平台:
https://platform.deepseek.com——性价比最高,R1 推理强 - 阿里云百炼:
https://bailian.console.aliyun.com——Qwen 全系列,中文最强 - SiliconFlow:
https://siliconflow.cn——多模型聚合,便宜

Docker Compose 部署
- SSH 到 VPS(推荐美西)
- 装 Docker + Docker Compose
- 拉 Dify 仓库:
git clone https://github.com/langgenius/dify.git - 进入 docker 目录:
cd dify/docker - 复制环境变量:
cp .env.example .env - 启动:
docker compose up -d - 浏览器访问
http://your-vps-ip:80,初始化 admin
5 分钟跑起来。
配置国内大模型
登录 Dify 后台 → 设置 → 模型供应商 → 添加:
DeepSeek 配置示例:
- 供应商类型:OpenAI-API-compatible
- API key:你的 DeepSeek key
- API endpoint URL:
https://api.deepseek.com/v1 - 模型名称:
deepseek-chat(或deepseek-reasoner)
Qwen 配置示例:
- API endpoint URL:
https://dashscope.aliyuncs.com/compatible-mode/v1 - 模型名称:
qwen-max(或qwen-plus、qwen-turbo)
配好后到”工作室”创建一个聊天应用或工作流,模型下拉选刚配的 Qwen 或 DeepSeek 即可。
模型选择策略
不同任务选不同模型:
- 通用问答 / 客服:Qwen2.5-Plus 或 DeepSeek-V3——性价比 + 通用能力
- 深度推理 / 复杂任务:DeepSeek-R1(deepseek-reasoner)——推理最强
- 代码生成:Qwen2.5-Coder 或 DeepSeek-Coder-V2
- 长文本:Qwen 上下文长(128K)
- 中文为主:Qwen 优先
- 英文为主:DeepSeek-V3 优先
建议在 Dify 里同时配 DeepSeek 和 Qwen 两套模型,按任务类型切换。
常见问题 FAQ
Q1:Dify 跑 4 核 8G 能撑多少用户?
20-50 个并发用户,100+ 文档知识库。50+ 用户升 8 核 16G + 数据库分离到独立机器。
Q2:Dify 必须接 OpenAI 吗?
不必须。Dify 是模型无关的,OpenAI 兼容接口都能接,包括 DeepSeek、Qwen、GLM、Ollama 本地模型。推荐 DeepSeek + Qwen 国内用。
Q3:Dify 数据本地化吗?
自托管版 Dify 数据完全在你 VPS 上,包括用户上传的文档、对话历史、知识库配置。接的 LLM API 只是推理,文档数据不传给模型方(除了实际查询时)。
Q4:Dify + Qwen 跑中文 RAG 效果如何?
2025 年起 Qwen2.5-Max 在中文 RAG 场景效果接近 GPT-4,价格 1/10。复杂文档解析用 RAGFlow + Qwen 组合最佳。
Q5:怎么从 Dify 切到其他框架?
Dify 的工作流和应用可以导出 JSON 格式。但知识库文档需要重新上传。RAGFlow 应用配置不能直接迁移,需要重新搭。建议从一开始就选好主框架不要反复切。
总结
Dify 私有化 + 国内大模型(DeepSeek / Qwen)是 2025-2026 国内最稳定的私有 AI 应用平台方案。配置 5 分钟:拉镜像、起服务、改 base_url + api_key。模型选择按任务类型——通用 Qwen-Plus、推理 DeepSeek-R1、代码 Qwen-Coder。
如果刚开始做 Dify 自托管,从”萤光云美西 2 核 4G + Dify Docker + DeepSeek API + Qwen2.5-Max”这个组合入手——每月 VPS 80 块 + API 几十到几百块,比 ChatGPT Team 团队版便宜 90%。
需要海外 VPS?萤光云美西 VPS 2 核 4G 体验型 ¥80/月起。







