首页
/
工具详情
RAGFlow 全使用指南
一、平台介绍
1.1 基本信息
- 名称:RAGFlow (ragflow.io)
- 开发团队:Infiniflow 团队
- 开源协议:Apache2.0
- 定位:为 AI Agent 打造优质上下文层、一站式 RAG+Agent 一体化平台
- 开源时间:2024 年 4 月正式开源
- 官网链接:https://ragflow.io
1.2 产品形态
RAGFlow 提供两种主要使用形式,用户可根据需求选择:
- 开源自部署版:免费开源源码,支持私有化部署,适合技术用户与企业私有环境。
- 官方云端服务:
- 云端 SaaS:cloud.ragflow.io,免部署,按需订阅。
- Demo 体验站:demo.ragflow.io,用于体验基础功能(数据定期清空)。
1.3 核心优势
- 深度文档理解:区别于普通 RAG 的文本切块,主打结构化文档还原。
- 内置向量库:底层内置 Infinity 向量数据库。
- 解析能力强:深度优化 PDF、扫描件、表格解析。
- 可溯源 AI 问答:提供文档来源页码/段落引用,解决大模型幻觉与合规痛点。
二、核心主要功能
2.1 全格式文档深度解析(王牌能力)
- 支持格式:PDF、Word、Excel、PPT、TXT、Markdown、图片 (JPG/PNG/TIF)、扫描影印件、网页、CSV 等。
- 结构化处理:自动识别表格、图片、页眉页脚、目录、公式。
- OCR 识别:支持图片文字识别,保留原文排版结构。
- 多引擎切换:支持 MinerU/PaddleOCR 多解析引擎切换。
2.2 可控化知识库分块(Chunk)
- 切片模板:内置通用、问答、手册、表格、手动 5 大类切片模板,按需选用。
- 分块可视化:在线预览所有文档切块结果,双击可手动修改/补充关键词,优化检索权重。
- 嵌入模型绑定:单个知识库选定 Embedding 模型后不可修改,保证向量空间统一。
2.3 混合检索 + 答案溯源(降幻觉)
- 混合检索机制:稠密向量检索 + 关键词检索 + 重排序 (Rerank) 三合一。
- 答案溯源:AI 回复附带原文片段引用快照,点击可溯源原文页码/段落。
- 应用场景:满足金融、法律等对合规性要求高的行业需求。
2.4 全品类大模型接入
- 模型兼容性:兼容本地私有化模型 (Ollama/Xinference/vLLM) + API 商用模型 (OpenAI、通义千问、百川、MiniMax、Azure OpenAI、硅基流动)。
- 自由配置:LLM、Embedding、Rerank、图生文全类型模型自由配置。
- 配置方式:支持全局默认模型或单助手单独指定模型。
2.5 AI 对话助手 + Agent 智能体
- 问答机器人:快速创建,绑定单个/多个同嵌入模型知识库,自定义提示词与兜底回复。
- Agentic RAG:低代码搭建自动化智能体,实现文档摘要、数据提取、多文档对比、批量查询等任务。
2.6 开放 API 与二次开发
- 接口支持:提供 HTTP/Python 全套 API(文档上传、知识库管理、检索问答、批量删除)。
- 集成能力:支持嵌入自有系统(如企业 OA、客服系统)。
- 源码开放:源码全开放,支持二次定制开发。
2.7 企业级配套
- 管理功能:多租户、成员权限管理、文档版本、解析日志、任务监控。
- 部署支持:Docker 一键部署,适配私有化本地/服务器环境。
三、适用人群
3.1 个人用户
- 学生/科研:自建私人知识库(论文、文献、课程),进行文献智能问答与快速检索。
- 职场白领:管理合同、项目文档、读书笔记,打造私人 AI 知识库助手。
3.2 中小团队/开发者
- AI 开发工程师:低成本快速落地私有化 RAG 项目,免去从零开发检索链路。
- 产品/运营:搭建 FAQ 客服知识库、产品手册智能问答机器人。
3.3 中大型企业(刚需行业)
- 法律/金融:合同、法条、财报、尽调文档解析,实现合规检索。
- 医疗/制造:病历、设备手册、技术规范知识库、售后智能客服。
- 政企单位:内部规章制度、招投标资料、公文知识库私有化部署(数据不出内网)。
3.4 AI 服务商
- 基于 RAGFlow 封装 SaaS 知识库产品,对外提供私有知识库搭建服务。
四、免费 & 付费明细
方式一:开源自托管(永久免费,推荐技术用户)
- 软件授权:100% 免费。Apache2.0 开源,无版权费、无功能阉割,全功能开放,商用免费。
- 源码地址:https://github.com/infiniflow/ragflow
- 隐性成本:硬件/云服务器费用需自费。
- 最低硬件配置:x86 CPU ≥ 4 核、内存 ≥ 16GB、磁盘 ≥ 50GB(Nvidia GPU 可加速解析)。
- 备注:ARM 架构无官方 Docker 镜像需自行编译。
方式二:官方云端 SaaS(免部署)
- 注册网址:cloud.ragflow.io
- 免费额度:注册赠送少量知识库空间与模型调用额度,可体验基础功能。
- 付费模式:按存储空间 + 模型调用 Token 计费。
- 企业定制:提供专属运维、私有部署服务及定制化开发(按需报价)。
方式三:第三方托管 SaaS
- Elestio 托管:起步 55 美元/月,全包服务器、自动备份、运维升级。
- 腾讯云应用市场:RAGFlow 软件免费,仅收取云服务器资源费。
注意:模型费用分开计算。本地 Ollama 模型零费用;商用 API(OpenAI 等)按各厂商 Token 计费。
五、分步使用教程
路径 A:在线快速试用(零安装)
- 访问 Demo:打开 demo.ragflow.io,免注册直接体验基础上传、建库、问答。
- 数据说明:Demo 数据定期清空,不可长期存储文件。
- 正式使用:注册 cloud.ragflow.io 账号进行云端正式使用。
路径 B:本地 Docker 部署(完整功能,永久自用)
1. 前置条件
- 安装 Docker ≥ 24.0 + Docker Compose ≥ v2.26。
- 架构要求:x86 架构(ARM 需手动编译镜像)。
2. 启动步骤
bash
git clone https://github.com/infiniflow/ragflow.git cd ragflow/docker docker compose up -d git clone https://github.com/infiniflow/ragflow.git cd ragflow/docker docker compose up -d
- 浏览器访问:
http://localhost:80 - 默认账号:
admin@ragflow.io,密码:admin
3. 关键配置流程
- 配置全局模型(必做):
- 右上角头像 → 模型设置。
- 添加模型服务商(Ollama/OpenAI/硅基流动等)。
- 配置 API Key 或本地地址,设置默认 Embedding、LLM、Rerank 模型。
- 创建知识库:
- 顶部【知识库】→ 新建。
- 填写库名,选定切片模板 + 嵌入模型(选定后永久不可改)。
- 确认创建。
- 上传与解析文档:
- 知识库详情页 → 添加文件 → 本地上传。
- 重要:上传完成后必须点击文件右侧播放图标启动解析(不解析无法检索)。
- 解析完成后双击切块,手动修改分块、补充关键词优化检索。
- 使用【检索测试】输入问句验证效果。
- 创建 AI 对话助手:
- 顶部【聊天】→ 创建助手。
- 填写名称,绑定1 个或多个同 Embedding 知识库。
- 自定义提示词 + 无答案兜底回复 → 保存。
- 进阶:Agent 配置:
- 助手设置开启 Agent,选择官方 Agent 模板(如文档摘要/数据提取)。
六、高频避坑指南
1. 知识库模型致命坑
- ❌ 禁止:同一聊天助手绑定不同嵌入模型的知识库,向量空间不一致会导致检索失效。
- ✅ 对策:多库混用前,务必统一所有库的 Embedding 模型;建库慎重选嵌入,一旦创建无法更换。建议前期用小文件测试模型效果再批量上传。
2. 文件解析卡死或失败
- 卡在 1%:大概率网络无法访问 HuggingFace 模型。国内用户需配置 HF 镜像地址,点击叉号终止任务后重启解析。
- 解析 99% 崩溃:通常因服务器内存不足(16G 以下常见)。需修改 docker/.env 的 MEM_LIMIT 扩容,执行
docker compose restart重启容器。 - PDF 扫描件乱码:需开启 OCR(PaddleOCR/MinerU)解析;普通文本 PDF 可关闭 OCR 节省资源。
3. 问答答案空或答非所问
- 原因 1:文档未完成解析或切块不合理。需手动打开切块页面拆分大块文本、补充关键词。
- 原因 2:Rerank 模型未配置或精度低。务必配置 BGE/BCE 等重排序模型。
- 原因 3:知识库内容与提问无关。需缩小检索范围或补充相关文档。
4. 硬件与部署坑
- ARM 芯片:苹果 M 系列或国产 ARM 服务器无官方 Docker 镜像,不要直接 docker 部署,需源码自行编译,避免依赖缺失。
- 磁盘不足:解析后的向量 + 原文档占用空间大,需预留 ≥ 50G 空闲磁盘。
- 容器异常:Elasticsearch 组件挂掉会导致索引失败,执行
docker logs 容器名查看日志排查 ES 故障。
5. 成本与模型避坑
- API 成本:商用 API 模型 Embedding 消耗 Token 量大。测试优先选硅基流动新用户免费 2000 万 Token 或 Ollama 本地模型以省成本。
- 本地连接:Docker 部署 RAG 需要填写
host.docker.internal:11434(不能填 localhost),否则连不上本地 Ollama 模型服务。
6. 数据安全
- 涉及敏感合同或涉密文档,建议优先选择本地私有化部署,避免企业机密上传至第三方云服务器。
七、官方参考地址
- 官方网站:https://ragflow.io
- 官方文档:https://ragflow.io/docs
- Demo 试用:https://demo.ragflow.io
- 云端 SaaS:https://cloud.ragflow.io
- GitHub 开源:https://github.com/infiniflow/ragflow
暂无评论