首页 / 详情
Site icon

Ragflow

基本信息

  • 工具类别: 自动化
  • 收录时间: 2026-06-04
  • 访问次数: 68
  • 评分: 4.8
  • 官网: https://ragflow.io/
Ragflow 网站截图预览

工具详情

RAGFlow 全使用指南

一、平台介绍

1.1 基本信息

  • 名称:RAGFlow (ragflow.io)
  • 开发团队:Infiniflow 团队
  • 开源协议:Apache2.0
  • 定位:为 AI Agent 打造优质上下文层、一站式 RAG+Agent 一体化平台
  • 开源时间:2024 年 4 月正式开源
  • 官网链接:https://ragflow.io

1.2 产品形态

RAGFlow 提供两种主要使用形式,用户可根据需求选择:

  1. 开源自部署版:免费开源源码,支持私有化部署,适合技术用户与企业私有环境。
  2. 官方云端服务:
  • 云端 SaaS:cloud.ragflow.io,免部署,按需订阅。
  • Demo 体验站:demo.ragflow.io,用于体验基础功能(数据定期清空)。

1.3 核心优势

  • 深度文档理解:区别于普通 RAG 的文本切块,主打结构化文档还原。
  • 内置向量库:底层内置 Infinity 向量数据库。
  • 解析能力强:深度优化 PDF、扫描件、表格解析。
  • 可溯源 AI 问答:提供文档来源页码/段落引用,解决大模型幻觉与合规痛点。

二、核心主要功能

2.1 全格式文档深度解析(王牌能力)

  • 支持格式:PDF、Word、Excel、PPT、TXT、Markdown、图片 (JPG/PNG/TIF)、扫描影印件、网页、CSV 等。
  • 结构化处理:自动识别表格、图片、页眉页脚、目录、公式。
  • OCR 识别:支持图片文字识别,保留原文排版结构。
  • 多引擎切换:支持 MinerU/PaddleOCR 多解析引擎切换。

2.2 可控化知识库分块(Chunk)

  • 切片模板:内置通用、问答、手册、表格、手动 5 大类切片模板,按需选用。
  • 分块可视化:在线预览所有文档切块结果,双击可手动修改/补充关键词,优化检索权重。
  • 嵌入模型绑定:单个知识库选定 Embedding 模型后不可修改,保证向量空间统一。

2.3 混合检索 + 答案溯源(降幻觉)

  • 混合检索机制:稠密向量检索 + 关键词检索 + 重排序 (Rerank) 三合一。
  • 答案溯源:AI 回复附带原文片段引用快照,点击可溯源原文页码/段落。
  • 应用场景:满足金融、法律等对合规性要求高的行业需求。

2.4 全品类大模型接入

  • 模型兼容性:兼容本地私有化模型 (Ollama/Xinference/vLLM) + API 商用模型 (OpenAI、通义千问、百川、MiniMax、Azure OpenAI、硅基流动)。
  • 自由配置:LLM、Embedding、Rerank、图生文全类型模型自由配置。
  • 配置方式:支持全局默认模型或单助手单独指定模型。

2.5 AI 对话助手 + Agent 智能体

  • 问答机器人:快速创建,绑定单个/多个同嵌入模型知识库,自定义提示词与兜底回复。
  • Agentic RAG:低代码搭建自动化智能体,实现文档摘要、数据提取、多文档对比、批量查询等任务。

2.6 开放 API 与二次开发

  • 接口支持:提供 HTTP/Python 全套 API(文档上传、知识库管理、检索问答、批量删除)。
  • 集成能力:支持嵌入自有系统(如企业 OA、客服系统)。
  • 源码开放:源码全开放,支持二次定制开发。

2.7 企业级配套

  • 管理功能:多租户、成员权限管理、文档版本、解析日志、任务监控。
  • 部署支持:Docker 一键部署,适配私有化本地/服务器环境。

三、适用人群

3.1 个人用户

  • 学生/科研:自建私人知识库(论文、文献、课程),进行文献智能问答与快速检索。
  • 职场白领:管理合同、项目文档、读书笔记,打造私人 AI 知识库助手。

3.2 中小团队/开发者

  • AI 开发工程师:低成本快速落地私有化 RAG 项目,免去从零开发检索链路。
  • 产品/运营:搭建 FAQ 客服知识库、产品手册智能问答机器人。

3.3 中大型企业(刚需行业)

  • 法律/金融:合同、法条、财报、尽调文档解析,实现合规检索。
  • 医疗/制造:病历、设备手册、技术规范知识库、售后智能客服。
  • 政企单位:内部规章制度、招投标资料、公文知识库私有化部署(数据不出内网)。

3.4 AI 服务商

  • 基于 RAGFlow 封装 SaaS 知识库产品,对外提供私有知识库搭建服务。

四、免费 & 付费明细

方式一:开源自托管(永久免费,推荐技术用户)

  • 软件授权:100% 免费。Apache2.0 开源,无版权费、无功能阉割,全功能开放,商用免费。
  • 源码地址:https://github.com/infiniflow/ragflow
  • 隐性成本:硬件/云服务器费用需自费。
  • 最低硬件配置:x86 CPU ≥ 4 核、内存 ≥ 16GB、磁盘 ≥ 50GB(Nvidia GPU 可加速解析)。
  • 备注:ARM 架构无官方 Docker 镜像需自行编译。

方式二:官方云端 SaaS(免部署)

  • 注册网址:cloud.ragflow.io
  • 免费额度:注册赠送少量知识库空间与模型调用额度,可体验基础功能。
  • 付费模式:按存储空间 + 模型调用 Token 计费。
  • 企业定制:提供专属运维、私有部署服务及定制化开发(按需报价)。

方式三:第三方托管 SaaS

  • Elestio 托管:起步 55 美元/月,全包服务器、自动备份、运维升级。
  • 腾讯云应用市场:RAGFlow 软件免费,仅收取云服务器资源费。
注意:模型费用分开计算。本地 Ollama 模型零费用;商用 API(OpenAI 等)按各厂商 Token 计费。

五、分步使用教程

路径 A:在线快速试用(零安装)

  1. 访问 Demo:打开 demo.ragflow.io,免注册直接体验基础上传、建库、问答。
  2. 数据说明:Demo 数据定期清空,不可长期存储文件。
  3. 正式使用:注册 cloud.ragflow.io 账号进行云端正式使用。

路径 B:本地 Docker 部署(完整功能,永久自用)

1. 前置条件

  • 安装 Docker ≥ 24.0 + Docker Compose ≥ v2.26。
  • 架构要求:x86 架构(ARM 需手动编译镜像)。

2. 启动步骤

bash

git clone https://github.com/infiniflow/ragflow.git
cd ragflow/docker
docker compose up -d
git clone https://github.com/infiniflow/ragflow.git
cd ragflow/docker
docker compose up -d
  • 浏览器访问:http://localhost:80
  • 默认账号:admin@ragflow.io,密码:admin

3. 关键配置流程

  1. 配置全局模型(必做):
  • 右上角头像 → 模型设置。
  • 添加模型服务商(Ollama/OpenAI/硅基流动等)。
  • 配置 API Key 或本地地址,设置默认 Embedding、LLM、Rerank 模型。
  1. 创建知识库:
  • 顶部【知识库】→ 新建。
  • 填写库名,选定切片模板 + 嵌入模型(选定后永久不可改)。
  • 确认创建。
  1. 上传与解析文档:
  • 知识库详情页 → 添加文件 → 本地上传。
  • 重要:上传完成后必须点击文件右侧播放图标启动解析(不解析无法检索)。
  • 解析完成后双击切块,手动修改分块、补充关键词优化检索。
  • 使用【检索测试】输入问句验证效果。
  1. 创建 AI 对话助手:
  • 顶部【聊天】→ 创建助手。
  • 填写名称,绑定1 个或多个同 Embedding 知识库。
  • 自定义提示词 + 无答案兜底回复 → 保存。
  1. 进阶:Agent 配置:
  • 助手设置开启 Agent,选择官方 Agent 模板(如文档摘要/数据提取)。

六、高频避坑指南

1. 知识库模型致命坑

  • ❌ 禁止:同一聊天助手绑定不同嵌入模型的知识库,向量空间不一致会导致检索失效。
  • ✅ 对策:多库混用前,务必统一所有库的 Embedding 模型;建库慎重选嵌入,一旦创建无法更换。建议前期用小文件测试模型效果再批量上传。

2. 文件解析卡死或失败

  • 卡在 1%:大概率网络无法访问 HuggingFace 模型。国内用户需配置 HF 镜像地址,点击叉号终止任务后重启解析。
  • 解析 99% 崩溃:通常因服务器内存不足(16G 以下常见)。需修改 docker/.env 的 MEM_LIMIT 扩容,执行 docker compose restart 重启容器。
  • PDF 扫描件乱码:需开启 OCR(PaddleOCR/MinerU)解析;普通文本 PDF 可关闭 OCR 节省资源。

3. 问答答案空或答非所问

  • 原因 1:文档未完成解析或切块不合理。需手动打开切块页面拆分大块文本、补充关键词。
  • 原因 2:Rerank 模型未配置或精度低。务必配置 BGE/BCE 等重排序模型。
  • 原因 3:知识库内容与提问无关。需缩小检索范围或补充相关文档。

4. 硬件与部署坑

  • ARM 芯片:苹果 M 系列或国产 ARM 服务器无官方 Docker 镜像,不要直接 docker 部署,需源码自行编译,避免依赖缺失。
  • 磁盘不足:解析后的向量 + 原文档占用空间大,需预留 ≥ 50G 空闲磁盘。
  • 容器异常:Elasticsearch 组件挂掉会导致索引失败,执行 docker logs 容器名 查看日志排查 ES 故障。

5. 成本与模型避坑

  • API 成本:商用 API 模型 Embedding 消耗 Token 量大。测试优先选硅基流动新用户免费 2000 万 Token 或 Ollama 本地模型以省成本。
  • 本地连接:Docker 部署 RAG 需要填写 host.docker.internal:11434(不能填 localhost),否则连不上本地 Ollama 模型服务。

6. 数据安全

  • 涉及敏感合同或涉密文档,建议优先选择本地私有化部署,避免企业机密上传至第三方云服务器。

七、官方参考地址

  1. 官方网站:https://ragflow.io
  2. 官方文档:https://ragflow.io/docs
  3. Demo 试用:https://demo.ragflow.io
  4. 云端 SaaS:https://cloud.ragflow.io
  5. GitHub 开源:https://github.com/infiniflow/ragflow


评论

暂无评论