分类导航
发现更多优质 AI 工具
LobeHub
LobeHub 全指南一、平台基础介绍LobeHub(官网:https://lobehub.com/zh)是一款开源全链路多 Agent 智能体管理平台。项目背景:前身是 Lobe Chat,GitHub 开源项目(Star 数约 59K+),采用 TypeScript 开发,单元测试覆盖率高达 93%。核心定位:主打多 AI 智能体组队协同、7×24 小时云端自动运行 AI 团队。区别于普通单聊 AI(如 ChatGPT/GPTs),核心功能是利用 CAO(首席智能体指挥官) 自动招聘、排班、调度不同专业 Agent 分工并行完成长周期任务。部署模式:支持云端网页使用 + 本地私有化部署双模式。模型兼容:兼容全球主流大模型(DeepSeek、Claude、GPT、通义千问、火山引擎等)。升级理念:从单点 AI 聊天工具升级为 AI 团队工作台,无需人工逐个配置 Agent,系统自动组建专项 AI 工作组,任务完成后通过 Slack/Discord/邮件推送工作报告。二、五大核心功能1. CAO 首席智能体调度(平台王牌功能)自动招募与排班:CAO 自动从 27 万+技能市场 按需招募专业 Agent、排班、7×24 云端轮班运行。批量任务处理:支持批量处理海量任务(例:500 条未处理 Issue,一键派 50 个 Agent 批量清理)。自动总结:任务结束自动生成总结报表,人类仅需查看结果,无需全程值守。定时任务:支持自定义每日/每 30 分钟定点自动启动 AI 工作组(如凌晨 3 点自动复盘行业数据)。2. Agent 智能体全生命周期搭建与市场一键创建 Agent:输入角色名称、岗位、技能、指令(和 GPTs 使用同一套 Prompt 规则,可直接复用 GPTs 配置文案),系统自动初始化参数。Agent 市场:提供 33 万+ 现成技能、6.2 万+ MCP 服务端,开箱即用,涵盖数据分析、编程、文案、OCR、视频解析等。群组协作:支持多 Agent 组队并行作业(如研发组、投研组、论文精读组),共享同一上下文知识库,跨角色配合完成全链路任务。3. 原生 RAG 知识库&多模态能力文件管理:支持 PDF/Word/Excel/Markdown/视频/图片拖拽上传,自动分块向量化构建私有知识库,按需挂载到任意 Agent。多模态输出:生成 SVG 动态图表、交互式 HTML 页面、多格式文档、学术分镜漫画、视频参考图适配,支持无字幕视频转录总结。4. 工作空间&项目管理独立 Workspace:团队共享工作区,任务、文件、Agent 归属清晰,区分个人/项目资产。项目文件夹分类:按项目归档代码、文档、素材,支持版本草稿留存,区分正式稿/速记草稿。5. 白盒记忆+第三方应用互联结构化可编辑记忆:给 Agent 配置用户个人档案(职业、使用习惯、偏好),AI 持续学习使用者工作模式,记忆可手动删除/修改。IM 网关:对接 LINE、Discord、企业微信等聊天软件,在常用通讯工具里直接调用 Agent 执行任务。三、适用人群✅ 优先推荐使用独立创业者/超级个体:适合自媒体、跨境电商、独立产品经理,用于搭建文案 + 选品 + 数据复盘 AI 团队,自动化日常琐事。科研/高校师生:适合批量文献精读、论文总结、实验数据整理、文献综述 AI 小组。产品&研发工程师:适合 Bug 批量排查、需求文档撰写、前端页面生成、代码调试 Agent 小组,批量处理项目 Issue。数据/金融从业者:适合搭建股票/行业研报 AI 分析团队,自动抓取数据、生成风险简报。中小团队运营:适合 Discord 社群运营、简历筛选、会议纪要自动整理、周报生成。AI 爱好者/开源玩家:适合本地私有化部署、自定义 MCP 技能,二次开发定制专属 AI 工具。❌ 不适合人群仅需要单次闲聊问答、无批量/长期任务需求的普通用户(此类需求使用 ChatGPT 更轻量化)。四、免费与付费收费规则(云端版 + 本地开源版分开)1. 本地私有化部署:永久全免费(核心优势)协议:项目完全开源(MIT 协议),GitHub 代码免费下载。部署:Windows/Mac/Linux 一键 Docker 部署。费用:无功能阉割、不限 Agent 数量、无算力扣费,仅消耗用户自备的大模型 API 密钥费用(OpenAI/DeepSeek 等 API 自费)。适用:适合技术玩家、企业私有化使用。2. 官方云端网页版(lobehub.com/zh):免费额度 + 订阅付费 + 算力点数(1)免费版(注册即享)基础权限:创建≤5 个自定义 Agent、每日少量免费算力点数、基础 RAG(单知识库≤20 个文档)、普通文本对话、社区免费 MCP 技能。限制:无法使用 CAO 自动组队、不能定时任务、云端 Agent 无法 7×24 挂机、超大文件上传受限。(2)付费订阅(Premium/Ultra 两档订阅 + 按需算力点数)月度会员订阅Premium:解锁 CAO 指挥官、不限 Agent 数量、全量定时任务、大容量 RAG 知识库、优先调用付费 MCP 技能。Ultra:企业级权限、多团队工作区、超大文件批量解析、专属客服、API 接入平台。算力点数(通用消耗项)消耗场景:云端运行 Agent 组队、视频解析、图片生成、长文档批量 RAG 消耗点数。计费逻辑:免费额度用完后按需充值点数,不同模型消耗点数不同(GPT4 > DeepSeek > 开源模型)。省钱提示:本地部署无算力点数消耗,只收第三方大模型 API 费,长期重度使用优先本地部署省钱。五、分步使用教程(两种使用方式:云端网页 + 本地部署)方式一:云端在线使用(小白首选,无需装软件)注册登录:打开官网 https://lobehub.com/zh,邮箱注册账号。绑定大模型 API 密钥(必须):侧边栏→模型设置,填入 DeepSeek/Claude/OpenAI 任意一家 API Key(API 密钥去对应模型官网申请充值),没有密钥只能试用平台内置免费小额模型。创建单个 Agent:点击 Agent→新建智能体,填写名称 + 岗位描述 + 技能(例:论文分析师:精读 PDF、提炼摘要、梳理研究方法),一键生成。进阶:用 CAO 组建 AI 团队:左侧点击【Your Chief Agent Operator】→新建任务,输入需求(组建 5 人研报小组,每日抓取新能源行业资讯并汇总),CAO 自动从技能市场招募对应 Agent、设置执行时间。知识库挂载 RAG:知识库→新建库,拖拽 PDF/Excel,完成切片后,编辑 Agent→关联知识库,实现 AI 基于自有文档回答。查看结果:定时任务完成后,平台消息中心 + 绑定的 Discord/邮箱自动接收 Agent 工作报告。方式二:本地私有化部署(长期免费,适合有电脑)环境准备:电脑安装 Docker(Windows/Mac 均有一键安装方案)。部署执行:终端执行官方一键部署命令(参考官网文档:https://lobehub.com/docs/self-hosting/start)。浏览器访问:打开本地 localhost 地址。配置操作:后续配置 API、创建 Agent 和云端操作完全一致,数据全部存在本地,不上传平台服务器。六、高频避坑清单(新手必看,减少踩雷)1. API 密钥相关坑(最高频)❌ 坑 1:直接把大额余额 API 密钥填入陌生第三方 MCP 技能,部分非官方技能会偷偷消耗 API 额度。✅ 对策:优先用官方市场技能,陌生技能先新建小额测试密钥试用。❌ 坑 2:混淆「平台算力点数」和「大模型 API 费」:云端平台点数≠模型 API 余额,两个分开扣费,容易双重超额扣费。✅ 对策:重度使用优先本地部署,仅付 API 费。2. Agent & CAO 组队避坑❌ 坑 1:一次性组建数十个 Agent 超大团队,短时间大量并发调用 API,瞬间耗空 API 余额。✅ 对策:从 3~5 个 Agent 小团队起步,调试稳定再扩容。❌ 坑 2:Agent 指令写得模糊,CAO 招募的智能体技能不匹配,任务产出不合格。✅ 对策:复用 GPTs 成熟指令文案,精准定义岗位边界。3. RAG 知识库文件坑❌ 坑 1:一次性上传上百个超大 PDF(单文件>200MB),云端免费额度直接耗尽、本地部署卡顿。✅ 对策:拆分文档分批上传,优先精简 PDF 内容。❌ 坑 2:私密合同/企业财报上传云端版知识库,存在数据泄露风险。✅ 对策:涉密文件只用本地私有化部署,不上官方云端。4. 付费避坑❌ 坑 1:盲目开通 Ultra 会员,实际只用基础功能,浪费订阅费。✅ 对策:先用免费版试用 7 天,确认 CAO/定时任务刚需再开 Premium。❌ 坑 2:自动续费忘记关闭,连续扣费。✅ 对策:订阅后在账单页关闭自动续费。5. 部署 & 安全坑❌ 坑 1:本地部署后直接把端口暴露公网,被恶意调用盗刷 API。✅ 对策:本地仅内网访问,如需外网用 SSH 加密通道 + 强密码。❌ 坑 2:随意安装来源不明的社区自定义 Skill 插件,恶意脚本窃取本地文件。✅ 对策:只下载官方审核上架的 MCP 技能包。6. 功能预期坑❌ 坑 1:指望 Agent 团队 100% 全自动落地复杂商业项目,忽略人工微调。✅ 对策:AI 输出初稿,关键决策人工复核修正。七、常用落地使用案例参考文献小组:由 5 个 Agent(OCR+ 精读 + 总结 + 数据提取 + 排版)组成,自动批量解析几十篇论文生成综述。会议助理组:转录会议录音→提炼决议→生成待办清单→分配责任人。自媒体内容组:资讯爬虫→文案撰写→配图生成→标题优化全流程自动化。
Ragflow
RAGFlow 全使用指南一、平台介绍1.1 基本信息名称:RAGFlow (ragflow.io)开发团队:Infiniflow 团队开源协议:Apache2.0定位:为 AI Agent 打造优质上下文层、一站式 RAG+Agent 一体化平台开源时间:2024 年 4 月正式开源官网链接:https://ragflow.io1.2 产品形态RAGFlow 提供两种主要使用形式,用户可根据需求选择:开源自部署版:免费开源源码,支持私有化部署,适合技术用户与企业私有环境。官方云端服务:云端 SaaS:cloud.ragflow.io,免部署,按需订阅。Demo 体验站:demo.ragflow.io,用于体验基础功能(数据定期清空)。1.3 核心优势深度文档理解:区别于普通 RAG 的文本切块,主打结构化文档还原。内置向量库:底层内置 Infinity 向量数据库。解析能力强:深度优化 PDF、扫描件、表格解析。可溯源 AI 问答:提供文档来源页码/段落引用,解决大模型幻觉与合规痛点。二、核心主要功能2.1 全格式文档深度解析(王牌能力)支持格式:PDF、Word、Excel、PPT、TXT、Markdown、图片 (JPG/PNG/TIF)、扫描影印件、网页、CSV 等。结构化处理:自动识别表格、图片、页眉页脚、目录、公式。OCR 识别:支持图片文字识别,保留原文排版结构。多引擎切换:支持 MinerU/PaddleOCR 多解析引擎切换。2.2 可控化知识库分块(Chunk)切片模板:内置通用、问答、手册、表格、手动 5 大类切片模板,按需选用。分块可视化:在线预览所有文档切块结果,双击可手动修改/补充关键词,优化检索权重。嵌入模型绑定:单个知识库选定 Embedding 模型后不可修改,保证向量空间统一。2.3 混合检索 + 答案溯源(降幻觉)混合检索机制:稠密向量检索 + 关键词检索 + 重排序 (Rerank) 三合一。答案溯源:AI 回复附带原文片段引用快照,点击可溯源原文页码/段落。应用场景:满足金融、法律等对合规性要求高的行业需求。2.4 全品类大模型接入模型兼容性:兼容本地私有化模型 (Ollama/Xinference/vLLM) + API 商用模型 (OpenAI、通义千问、百川、MiniMax、Azure OpenAI、硅基流动)。自由配置:LLM、Embedding、Rerank、图生文全类型模型自由配置。配置方式:支持全局默认模型或单助手单独指定模型。2.5 AI 对话助手 + Agent 智能体问答机器人:快速创建,绑定单个/多个同嵌入模型知识库,自定义提示词与兜底回复。Agentic RAG:低代码搭建自动化智能体,实现文档摘要、数据提取、多文档对比、批量查询等任务。2.6 开放 API 与二次开发接口支持:提供 HTTP/Python 全套 API(文档上传、知识库管理、检索问答、批量删除)。集成能力:支持嵌入自有系统(如企业 OA、客服系统)。源码开放:源码全开放,支持二次定制开发。2.7 企业级配套管理功能:多租户、成员权限管理、文档版本、解析日志、任务监控。部署支持:Docker 一键部署,适配私有化本地/服务器环境。三、适用人群3.1 个人用户学生/科研:自建私人知识库(论文、文献、课程),进行文献智能问答与快速检索。职场白领:管理合同、项目文档、读书笔记,打造私人 AI 知识库助手。3.2 中小团队/开发者AI 开发工程师:低成本快速落地私有化 RAG 项目,免去从零开发检索链路。产品/运营:搭建 FAQ 客服知识库、产品手册智能问答机器人。3.3 中大型企业(刚需行业)法律/金融:合同、法条、财报、尽调文档解析,实现合规检索。医疗/制造:病历、设备手册、技术规范知识库、售后智能客服。政企单位:内部规章制度、招投标资料、公文知识库私有化部署(数据不出内网)。3.4 AI 服务商基于 RAGFlow 封装 SaaS 知识库产品,对外提供私有知识库搭建服务。四、免费 & 付费明细方式一:开源自托管(永久免费,推荐技术用户)软件授权:100% 免费。Apache2.0 开源,无版权费、无功能阉割,全功能开放,商用免费。源码地址:https://github.com/infiniflow/ragflow隐性成本:硬件/云服务器费用需自费。最低硬件配置:x86 CPU ≥ 4 核、内存 ≥ 16GB、磁盘 ≥ 50GB(Nvidia GPU 可加速解析)。备注:ARM 架构无官方 Docker 镜像需自行编译。方式二:官方云端 SaaS(免部署)注册网址:cloud.ragflow.io免费额度:注册赠送少量知识库空间与模型调用额度,可体验基础功能。付费模式:按存储空间 + 模型调用 Token 计费。企业定制:提供专属运维、私有部署服务及定制化开发(按需报价)。方式三:第三方托管 SaaSElestio 托管:起步 55 美元/月,全包服务器、自动备份、运维升级。腾讯云应用市场:RAGFlow 软件免费,仅收取云服务器资源费。注意:模型费用分开计算。本地 Ollama 模型零费用;商用 API(OpenAI 等)按各厂商 Token 计费。五、分步使用教程路径 A:在线快速试用(零安装)访问 Demo:打开 demo.ragflow.io,免注册直接体验基础上传、建库、问答。数据说明:Demo 数据定期清空,不可长期存储文件。正式使用:注册 cloud.ragflow.io 账号进行云端正式使用。路径 B:本地 Docker 部署(完整功能,永久自用)1. 前置条件安装 Docker ≥ 24.0 + Docker Compose ≥ v2.26。架构要求:x86 架构(ARM 需手动编译镜像)。2. 启动步骤bashgit clone https://github.com/infiniflow/ragflow.git cd ragflow/docker docker compose up -d git clone https://github.com/infiniflow/ragflow.git cd ragflow/docker docker compose up -d 浏览器访问:http://localhost:80默认账号:admin@ragflow.io,密码:admin3. 关键配置流程配置全局模型(必做):右上角头像 → 模型设置。添加模型服务商(Ollama/OpenAI/硅基流动等)。配置 API Key 或本地地址,设置默认 Embedding、LLM、Rerank 模型。创建知识库:顶部【知识库】→ 新建。填写库名,选定切片模板 + 嵌入模型(选定后永久不可改)。确认创建。上传与解析文档:知识库详情页 → 添加文件 → 本地上传。重要:上传完成后必须点击文件右侧播放图标启动解析(不解析无法检索)。解析完成后双击切块,手动修改分块、补充关键词优化检索。使用【检索测试】输入问句验证效果。创建 AI 对话助手:顶部【聊天】→ 创建助手。填写名称,绑定1 个或多个同 Embedding 知识库。自定义提示词 + 无答案兜底回复 → 保存。进阶:Agent 配置:助手设置开启 Agent,选择官方 Agent 模板(如文档摘要/数据提取)。六、高频避坑指南1. 知识库模型致命坑❌ 禁止:同一聊天助手绑定不同嵌入模型的知识库,向量空间不一致会导致检索失效。✅ 对策:多库混用前,务必统一所有库的 Embedding 模型;建库慎重选嵌入,一旦创建无法更换。建议前期用小文件测试模型效果再批量上传。2. 文件解析卡死或失败卡在 1%:大概率网络无法访问 HuggingFace 模型。国内用户需配置 HF 镜像地址,点击叉号终止任务后重启解析。解析 99% 崩溃:通常因服务器内存不足(16G 以下常见)。需修改 docker/.env 的 MEM_LIMIT 扩容,执行 docker compose restart 重启容器。PDF 扫描件乱码:需开启 OCR(PaddleOCR/MinerU)解析;普通文本 PDF 可关闭 OCR 节省资源。3. 问答答案空或答非所问原因 1:文档未完成解析或切块不合理。需手动打开切块页面拆分大块文本、补充关键词。原因 2:Rerank 模型未配置或精度低。务必配置 BGE/BCE 等重排序模型。原因 3:知识库内容与提问无关。需缩小检索范围或补充相关文档。4. 硬件与部署坑ARM 芯片:苹果 M 系列或国产 ARM 服务器无官方 Docker 镜像,不要直接 docker 部署,需源码自行编译,避免依赖缺失。磁盘不足:解析后的向量 + 原文档占用空间大,需预留 ≥ 50G 空闲磁盘。容器异常:Elasticsearch 组件挂掉会导致索引失败,执行 docker logs 容器名 查看日志排查 ES 故障。5. 成本与模型避坑API 成本:商用 API 模型 Embedding 消耗 Token 量大。测试优先选硅基流动新用户免费 2000 万 Token 或 Ollama 本地模型以省成本。本地连接:Docker 部署 RAG 需要填写 host.docker.internal:11434(不能填 localhost),否则连不上本地 Ollama 模型服务。6. 数据安全涉及敏感合同或涉密文档,建议优先选择本地私有化部署,避免企业机密上传至第三方云服务器。七、官方参考地址官方网站:https://ragflow.io官方文档:https://ragflow.io/docsDemo 试用:https://demo.ragflow.io云端 SaaS:https://cloud.ragflow.ioGitHub 开源:https://github.com/infiniflow/ragflow
AstrBot
AstrBot全指南:AstrBot 是开源免费一站式 AI 聊天智能体基础设施(当前版本 v4.5.0),核心功能是一键在 QQ、企业微信、飞书、Telegram、Discord 等聊天软件中搭建 AI 机器人。它集成了大模型、RAG 知识库与海量插件,个人、社团及小微企业均可落地智能机器人。一、平台基础介绍1. 项目背景上线时间:2022 年底由开发者 Soulter 开源上线。社区影响力:GitHub 拥有 14.3k+ Star,1100+ Fork,120+ 贡献者。生态规模:社区拥有 640+ 官方插件、800+ 扩展插件;7 天活跃部署实例 8600+,活跃用户 25 万+,Docker 镜像拉取超 227 万次。官方网站:https://astrbot.app开源仓库:GitHub商用合作邮箱:community@astrbot.app2. 产品定位AstrBot 定位为IM 即时通讯原生 AI 智能体底座。用户无需从零写代码,通过图形化 WebUI 可视化配置,即可将主流大模型对接进各类聊天软件。主要应用场景包括群机器人、智能客服、私人 AI 助手及知识库问答机器人。3. 支持接入平台官方原生支持即时通讯:QQ (OneBot v11)、Telegram、Discord、Slack企业通讯:企业微信(应用/客服/机器人)、飞书、钉钉、Satori、Misskey其他:微信公众号、微信客服社区拓展支持平台包括:KOOK、Bilibili、VoceChat 等聊天平台。二、核心主要功能1. 多模型接入(全主流大模型兼容)原生 API 直连:支持 OpenAI、Google Gemini、Anthropic Claude。兼容接入:支持 Kimi、DeepSeek、GLM 智谱、Minimax、Ollama、LMStudio(本地离线大模型)。LLMOps 平台对接:支持 Dify、Coze 扣子、阿里云百炼等平台。音视频能力:集成 Whisper 语音转文字、Minimax TTS 文字转语音,支持机器人语音聊天。2. 原生 RAG 知识库(Beta 功能)文档格式:支持 PDF、DOCX、Markdown 等,基于 Markitdown 解析文档。检索方案:采用稠密向量检索与 BM25 稀疏检索多路混合召回方案。多库绑定:单个机器人会话可挂载多个知识库,聊天时自动引用文档内容作答。后台统计:可视化管理文档与分块数量、嵌入模型及访问统计。3. Agent 智能体与 MCP 协议内置 Agent 沙箱:支持子智能体编排。工具调用:AI 可联网查资料,调用插件完成复杂任务。生态拓展:支持 MCP 协议拓展自定义能力。4. 640+ 海量插件生态(社区免费)所有插件均可通过 WebUI 一键安装,无需手动编码。群聊交互:如“心流(主动回复)”,实现群聊根据上下文自动主动说话。资源工具:如"Pixiv_Search",用于搜索插画、漫画、排行榜,含内容风控过滤。记忆系统:如"LivingMemory",模拟类人脑长期记忆,机器人可记住用户历史对话。娱乐工具:如"AI 自动匹配表情包”,包含云端表情库管理功能。模型测评:如"LMArena",提供免费调用多款开源模型进行对话测试。5. Web 可视化管理后台提供图形化面板,功能包括:新建机器人配置适配器绑定聊天平台管理知识库与插件安装查看运行日志权限白名单配置(零代码配置机器人)三、适用人群1. 个人用户(学生/AI 爱好者)私人助手:搭建 QQ 或 TG 私人 AI 助手、专属知识库机器人(导入笔记/书籍进行提问)。群聊娱乐:群聊娱乐机器人(表情包、搜图、闲聊)。本地部署:本地 Ollama 部署离线 AI,无需联网即可使用。2. 社团/社群运营(QQ 群/飞书群)社群服务:社群自动答疑、新人欢迎、关键词自动回复。文档管理:群文档知识库问答,方便群友查找资料。3. 中小企业/个体户智能客服:在企业微信或微信公众号部署智能客服,导入产品手册作为知识库,自动回复客户咨询,降低人工成本。内部知识库:员工在企业微信内查询规章制度、产品资料。4. 开发者/运维二次开发:定制开发自定义插件、对接自研大模型。SaaS 服务:搭建 SaaS 机器人服务,对外提供部署方案。四、免费与付费详情✅ 永久免费项目AstrBot 本体软件:100% 开源免费商用,无授权费、无部署数量限制、无机器人数量上限。插件生态:全部官方及社区 640+ 插件免费下载使用。基础功能:WebUI 后台、RAG 基础知识库、Agent 基础功能全免费。安装资源:Docker、pip、Windows 一键安装包全部免费下载。⚠️ 按需自费项目(非平台收费,第三方费用)大模型 API 资费:使用 OpenAI、Claude、Kimi 等商用 API 需按 token 计费;若使用 Ollama 本地模型则完全免费(电脑本地跑模型,无 API 费用)。服务器成本:自建部署需要云服务器或本地电脑,云主机费用需自行支付;也可选择雨云、硅基流动、UCloud 等合作算力服务商按需选购。第三方平台开通费用:企业微信机器人、微信公众号认证等部分渠道需要平台官方收取认证费(如腾讯/飞书官方收取,与 AstrBot 无关)。付费增值:社区少量定制化付费插件、企业定制部署服务(非强制)。总结:纯个人用户若使用 Ollama 本地大模型配合免费插件,零成本落地完整机器人。五、三种安装使用步骤(从易到难)方式 1:Windows 一键安装(小白首选)访问官网 astrbot.app 下载 Windows 一键安装器。双击安装,自动配置运行环境,浏览器会自动打开 Web 管理后台(默认本地端口)。配置流程:①添加模型:填入 API Key(或选择 Ollama 本地)。②新建机器人。③选择平台(如 QQ、企业微信)。④按指引完成平台机器人授权对接。⑤上传知识库、安装插件、聊天测试。方式 2:Docker 部署(服务器/云主机首选,推荐)在服务器上放行 2333 端口。执行以下命令一键拉取并启动:bashdocker run -d -p 2333:2333 astrbot/astrbot:latest docker run -d -p 2333:2333 astrbot/astrbot:latest 浏览器访问 服务器 IP:2333 进入 WebUI。后续配置同 Windows:添加模型→新建机器人→适配器对接平台。方式 3:Pip 源码部署(开发者)执行安装命令:bashpip install astrbot pip install astrbot 运行程序:bashastrbot run astrbot run 适合需要二次开发、自定义源码的用户。基础使用流程(通用 5 步)准备模型:云端:去 OpenAI、DeepSeek 等官网获取 API Key。本地:安装 Ollama,下载 Qwen、Llama 等开源模型(零 API 费)。Web 后台添加模型:在后台添加模型提供商,粘贴 Key 或填写本地 Ollama 地址。创建机器人实例:选择要接入的聊天平台(如 QQ、企微、TG)。配置平台适配器:按平台指引获取机器人 token/密钥完成绑定。完善功能:可选上传知识库、安装插件,完成后在聊天窗口@机器人对话。六、部署与使用避坑大全1. 部署环境坑数据持久化:Docker 部署时必须挂载数据目录,否则重启容器配置与知识库会全清空。端口连通:云服务器需在安全组放行 2333 端口,否则外网无法打开 WebUI。系统版本:CentOS 低版本或老旧 Windows 容易依赖报错,建议优先使用 Win10+ 或 Ubuntu 22.04+。2. 大模型接入坑Key 错误:机器人无回复时,优先核对 API Key、接口地址及模型名称;国内接口注意填写自定义 base_url。Ollama 连接:本地 Ollama 需开启远程访问,服务器部署需填写本机内网 IP,并放行 11434 端口。模型兼容:小众模型优先选择「OpenAI 兼容格式」接入。3. 聊天平台对接坑QQ OneBot:QQ 官方风控严格,个人号极易风控封号,建议优先使用机器人框架或官方 QQ 机器人渠道,避免使用私人大号。企业微信/飞书:机器人应用权限需勾选“通讯录”、“消息接收/发送”权限,否则收不到群消息。Telegram/Discord:通常需要科学环境才能获取机器人 token、收发消息,无代理适配器可能无法连通。4. 知识库 RAG 坑文档解析:PDF 加密或损坏文件无法上传,需转成非加密 PDF 或 Markdown 再上传。检索效果:检索答非所问时,优先选择 OpenAI_Embedding 等模型,自建向量库需核对分块大小。绑定缺失:创建机器人后必须在机器人配置页绑定对应知识库,否则 AI 不会调用文档。5. 插件与运行坑安装失败:插件安装失败可能是版本不匹配,建议更新 AstrBot 本体到最新 v4.5.0 再尝试。不主动发言:心流等主动回复插件需要配置双模型并开启群聊监听白名单。隐私安全:不要把 API Key、企业密钥随意分享或上传到公网配置,避免 API 被盗刷扣费。6. 合规提醒腾讯协议:QQ 个人号机器人违反腾讯用户协议,商用客服优先选择企业微信/公众号官方机器人渠道。网络法规:对接境外 TG、Discord 需遵守国内网络法规,合规使用网络环境。
Coze
Coze全指南重要提示:coze.com 为国际版 Coze(扣子),字节跳动旗下零代码 AI 智能体开发 SaaS 平台;国内合规访问优选coze.cn。coze.com 属于境外站点,国内无法直连访问。下面分平台介绍、核心功能、适用人群、免费&付费、使用步骤、避坑指南6 部分整理。一、平台介绍Coze 中文名扣子,是字节自研的一站式零代码/低代码 AI Agent(智能体)搭建平台,分为国内版 coze.cn、国际版 coze.com两套独立体系:国际版 coze.com面向对象:海外用户。接入模型:GPT-4o、Claude、Gemini 等海外大模型。计费方式:使用 Credits 点数。访问限制:国内网络环境无法直接打开(报错提示境外网页无法访问)。国内版 coze.cn面向对象:中国大陆用户。接入模型:内置豆包系列大模型。访问限制:合规可直接浏览器打开,是国内用户首选入口。产品定位核心能力:不用编程,通过拖拽和自然语言即可自建 AI 机器人、自动化工作流。发布渠道:支持一键发布到网页、小程序、第三方 IM、API 对接。对标对象:对标海外 GPTs,但在多端部署、工作流自动化能力上更强。开源情况Coze 底层引擎于 2025 年 7 月开源(Apache2.0 协议,可商用私有化部署),GitHub 可下载本地部署版。二、主要功能1. 智能体(Bot/Agent)搭建(核心功能)自然语言配置:配置人设、回答规则、对话边界,自定义 AI 角色(如客服、文案、学习助手、数据分析机器人)。知识库 RAG:上传 PDF/DOCX/TXT/Markdown/网页链接,AI 读取自有文档精准问答,支持自动文本分块与向量化存储。协作模式:支持单 Agent(简单问答)与多 Agent 协同(多个 AI 分工完成复杂任务,如调研→写稿→排版)。2. 可视化工作流自动化零代码画布:全拖拽方式串联 AI 模型与 200+ 官方插件。插件能力:涵盖网页爬取、文件解析、邮件推送、飞书/钉钉通知、表格处理等。逻辑设定:支持分支判断、定时触发,实现自动批量处理任务(如每日数据汇总、自动客服工单)。3. 插件与技能商店现成技能:海量现成技能一键安装(文案生成、翻译、数据提取、PPT 生成等)。技能复用:可自建技能上架售卖或复用他人成熟方案。4. 多渠道一键发布发布形态:建好的智能体可快速生成独立网页链接、内嵌 SDK、API 接口。应用渠道:支持接入微信、飞书机器人、小程序,可对外分享或嵌入自有产品。5. 配套辅助功能跨端同步:支持 PC 网页与手机 App 管理智能体,远程操控电脑文件。团队协作:支持多人共同编辑 Bot,具备精细化权限管控。扣子编程:提供代码平台(code.coze.cn),支持少量 Python/JS 低代码扩展高阶能力。三、适用人群个人用户(学生/自媒体/职场白领)适合场景:做备考答疑 Bot、文案生成助手、个人知识库机器人,提升学习与写作效率。中小企业运营/电商适合场景:搭建 7×24 小时智能客服、订单查询机器人、产品知识库,降低人工客服成本。内容创作者/博主适合场景:多 Agent 协作批量选题、写稿、短视频脚本生成。产品/开发人员适合场景:不用自研大模型,快速落地 AI 功能、快速开发 AI 小工具,通过 API 对接自有系统。教育/培训机构适合场景:搭建学科答疑机器人、课程知识库助手。四、免费&付费详情(一)国际版 coze.com(Credits 点数计费)1. 免费套餐 Free($0/月)赠送额度:每日赠送 10 Credits。协作人数:支持 5 位协作成员。Bot 数量:最多 3 个协作 Bot/工作流。模型消耗:GPT-3.5 / Claude Haiku:0.1 Credits/次(日均≈100 次免费调用)。GPT-4o:2 Credits/次(每日仅 5 次额度)。资源限制:基础知识库存储、少量免费插件可用,额度用完次日刷新。2. 付费订阅 Premium升级权益:按月订阅升级每日 Credits 额度、扩容 Bot 数量、增加协作人数。充值点数:额外可充值 Credits 点数包,超额消耗直接扣充值点数。API 调用:API 调用单独结算 Coze Token(区别于网页消耗的 Credits)。(二)国内版 coze.cn(人民币订阅,资源点计费)通用规则:免费额度用完,可单独购买资源包加餐,无需升级全套餐。1. 免费版月费:0 元。每日资源点:500 点/天。核心权益:豆包 3.5 基础模型、基础知识库、3 个 Bot,额度耗尽次日重置。2. 个人进阶月费:39.9 元。每日资源点:1000 点/天。核心权益:扩容知识库、高级插件、更多 Bot 数量。3. 个人高阶月费:99 元。每日资源点:3000 点/天。核心权益:豆包 4.0、超大知识库、优先算力。4. 企业版月费:498 元起/席位。核心权益:私有部署、数据隔离、SSO、专属客服。五、使用步骤1. 国内用户(推荐 coze.cn,可直连)注册登录:浏览器打开 coze.cn,使用手机号或抖音一键登录。新建项目:进入左侧【工作室→新建】,可选选三种类型(智能体/工作流/多 Agent 项目),新手优先选择【单智能体】。基础配置:填写 Bot 名称、简介、头像,编写角色提示词(明确 AI 能干什么、禁止做什么)。赋能能力:①添插件(翻译、搜索、文件读取);②上传知识库(产品文档/学习资料)。调试测试:在对话框输入问题,反复微调提示词和知识库,直至效果满意。发布上线:点击右上角发布,生成网页链接、API 或第三方机器人接入码。2. 海外用户(coze.com)网络与注册:需境外网络打开 coze.com,使用邮箱或谷歌账号注册。操作流程:操作逻辑和国内版一致,区别仅在于可选模型(GPT/Claude/Gemini 等),消耗 Credits 点数。注意:国内无法直接访问,国内业务直接选择 coze.cn。六、避坑指南(新手高频踩坑汇总)1. 计费&额度避坑国际版免费额度少:coze.com 免费每日仅 10 Credits,GPT-4/Claude 高端模型耗点极高,不要无节制测试,优先用 GPT-3.5 省点数。国内版测试策略:国内免费版每日资源点固定,大额批量测试建议先小额测试用量,避免浪费。API 扣费规则:API 调用扣费规则与网页测试不同(API 扣 Token、网页扣 Credits/资源点),批量对接前务必小流量测账单,避免超额扣费。2. 智能体配置避坑提示词要具体:不要只写“你是全能助手”,提示词写得模糊会导致 AI 答非所问。需明确角色、能力、字数限制、禁用内容(例:你是手表售后,只解答产品问题,不懂不乱编)。知识库大小控制:超大文档不要一次性全上传知识库,超百页 PDF 应拆分分批次上传,避免向量化失败、AI 检索错乱。3. 功能&部署避坑复杂任务拆分:复杂自动化任务不要全部塞在一个 Bot 里,拆分为工作流 + 多 Agent 分工,防止卡顿、调用超额耗资源。数据安全:不要上传身份证、合同隐私文件到公共云端知识库,敏感数据优先本地私有化部署版(Coze 开源版)。版本选择:coze.com 国内无法直连,不要浪费时间反复尝试访问,国内业务直接用 coze.cn,功能基本对齐。4. 插件使用避坑注意额外扣费:部分插件单独扣费,安装前务必查看插件计费说明,默认优先勾选免费官方插件。补充官方文档:国内 docs.coze.cn、国际 coze.com/docs。遇到问题:优先查阅官方手册或社区讨论解决。
OpenClaw
OpenClaw全指南一、平台介绍OpenClaw 是 MIT 开源、可自托管的自主式 AI 智能体(Agent)网关框架。其核心区别于普通对话 AI:不仅限于问答,更能主动操控软件、浏览器、系统及第三方应用以完成落地任务,将大模型封装成 7×24 小时在线的私人助理。1. 开源属性零费用:代码全开源,无软件授权费。社区活跃:GitHub 超 6 万星标,社区持续迭代更新。2. 底层架构三模块Model(大脑):自主绑定 GPT/Claude/Gemini/DeepSeek/Ollama 本地模型,支持随时切换。Skills(技能手):ClawHub 插件市场拥有 3200+ 开源技能,支持一键安装扩展能力。Channels(通讯入口):接入 Telegram/WhatsApp/飞书/Slack/Discord/内置 Web 页面,聊天框直接使唤 AI 干活。3. 数据安全隐私可控:自托管部署时,所有数据存储在自己设备/服务器上,不上传平台云端。二、核心功能1. 自动化办公(高频刚需)邮件管理:自动收发、邮件摘要汇总、垃圾邮件分拣、定时批量发商务邮件(支持 Gmail/企业邮箱)。文件处理:PDF/Word/Excel 解析、批量改名、格式转换、本地文件检索、分类归档、数据提取制表。日程安排:日历管理、会议预约、待办提醒、周报/文案自动生成、多平台消息自动回复。2. 系统与浏览器自动化终端控制:执行 Windows CMD/Linux Shell 命令、进程启停、服务器监控、定时脚本(支持 Cron 定时)。浏览器操作:自动填表、网页爬虫、数据抓取、页面截图、批量下载、表单批量提交。3. 第三方生态打通200+ 软件互联:支持 Notion、GitHub、Stripe、智能家居、CRM、理财软件、社交账号,一句话指令跨软件联动数据。4. 记忆系统(核心亮点:Lossless-Claw)三层记忆架构:短期会话上下文长期用户偏好记忆向量知识库优势:可检索数月历史指令与文档内容,超长上下文不丢失信息。5. 多渠道交互多端同步:手机 Telegram/飞书、电脑 Web 面板、Discord 多端同步操控同一个 AI 助理。6. 自定义扩展专属技能:支持自研专属 Skill 插件。隔离空间:可创建多隔离工作空间(如工作/生活/学习分开)。多智能体:支持多智能体分组管理。三、适用人群与价值职场白领/行政使用价值:处理重复邮件、报表、周报,每日节省 1~3 小时办公时间。程序员/运维使用价值:自动化脚本、代码审查、GitHub 工单管理、服务器巡检、CI/CD 监控。自媒体/内容创作者使用价值:选题搜集、素材爬虫、多平台文案批量生成、账号发布排期。自由职业/个体户使用价值:客户跟进、账单记账、收支统计、报价文档自动化。学生/科研使用价值:文献爬取整理、论文资料搜集、知识点归纳、批量整理学习资料。极客/硬件玩家使用价值:树莓派本地部署、智能家居语音远程控制、7×24 小时设备监控。注意:不适合完全零基础、不想折腾配置、零服务器/本地算力预算的纯小白(此类用户可选官方托管版)。四、免费与付费明细核心原则:软件本体永久免费,花钱只在算力 + 服务器 + 模型 API。1. 自托管开源版(软件 0 元)零成本方案:本地电脑/闲置笔记本部署 + Ollama 本地开源大模型(Llama/Qwen)。无 API 费用,仅耗本机硬件,适合轻度日常使用。低成本云部署:VPS 云服务器月租$5 起(约 35 元)+ 低价 DeepSeek/Kimi 按量 API。轻度月总花费 8~13 美元(约 60 元内)。中重度方案:Claude/GPT 付费 API + 高配 VPS。月 25~60 美元(约 180~430 元),适合自动化任务量大、高频调用大模型场景。2. 官方一键托管版(openclawlaunch)适用对象:小白首选,云端免部署。入门套餐:$3/月,含基础 AI 调用额度、单机器人、Telegram 接入。标准版:$12~30/月,全渠道接入、更多 token 额度、优先维护。企业定制:按需报价,多账号、私有化运维、专属技术支持。3. 国内云厂商定制版(百度/阿里/腾讯 Claw 衍生)学生 Lite:9.9 元/月。标准版:39.9~49 元/月,内置国产大模型免单独申请 API Key。总结:想白嫖=本地+Ollama;想省心=托管订阅;性价比=低配 VPS+ 国产低价 API。五、分步使用教程方案 A:小白一键云端部署(5 分钟上手,不用代码)访问 openclaw.ai → Launch 一键部署页面。选择托管服务商(如 Ampere 免费试用),挑选模型(Kimi/DeepSeek 省钱,Claude 能力强)。绑定通讯渠道:输入 Telegram 机器人 Token/飞书应用密钥。点击 Deploy,10 秒生成专属 AI 助理。打开 Telegram 给机器人发消息,直接下达指令(如:“整理昨天全部邮件生成日报”)。方案 B:本地自托管部署(开源完整版,推荐技术用户)前置环境:Node.js≥22.16(推荐 Node24),Windows 可用 WSL2、Mac/Linux 原生终端。全局安装:终端执行 npm install -g openclaw。初始化配置:执行 openclaw onboard,跟随向导填入模型 API Key(GPT/Claude/Ollama)。启动网关:执行 openclaw gateway start,查看状态 openclaw gateway status。新增聊天渠道:执行 openclaw channels add,绑定 Telegram/飞书。Web 控制面板:浏览器打开本地端口地址,可视化管理技能与配置。安装插件:执行 clawhub install 技能名(如 mail、browser、excel)。日常使用指令(聊天框快捷命令)/reset:重置当前会话。/status:查看 token 消耗与运行状态。/skills:管理已装插件。六、避坑清单(新手高频踩坑汇总)1. 部署安装坑路径规范:安装路径禁用中文/空格,必须纯英文目录(如 D:\AI\OpenClaw),否则启动崩溃、文件读写异常。杀毒软件:Windows 临时关闭杀毒/Defender,程序需要读写文件、模拟浏览器,易被安全软件误隔离核心程序。磁盘空间:预留≥2GB 磁盘空间,避免解压损坏、运行闪退。数据安全:主力办公电脑不裸奔部署,Agent 拥有全文件访问权限,新手优先虚拟机/闲置电脑安装,防止误删本地工作文件。2. 成本与计费坑API 超支风险:GPT/Claude 按量 API 极易超支,开启用量监控(/status 查消耗),重度自动化优先 Ollama 本地模型零 API 费或 DeepSeek 低价模型。云机配置:不要盲目上高配 VPS,个人日常任务 1 核 2G 低配云机足够,高配只适合 7×24 小时批量爬虫场景。3. 配置与功能坑开启沙盒:新手必开沙盒 Sandbox 模式,限制 AI 系统读写权限,杜绝 AI 误删系统文件、篡改配置。精简 Prompt:System Prompt 控制在 500 字以内,过长指令导致 AI 记忆失效、逻辑错乱。禁止乱动配置:禁止让 AI 自行修改 config 配置文件,极易参数错乱导致服务宕机。模型固定:工作/生活空间绑定固定模型,不要频繁切换模型,减少会话错乱、重复执行任务。定期备份:定期备份记忆库向量文件,重装部署避免数月调教数据丢失。4. 渠道对接坑Telegram 无响应:确认 Bot 已发送 /start、Token 无误、网关正常在线。飞书对接:区分国内飞书/国际 Lark 域名,AppID、AppSecret 核对大小写。七、新手入门最优路线纯小白:先买 3 美元官方托管试用 → Telegram 体验 1 周,确认需求再考虑自建。轻度省钱:闲置电脑+Ollama 本地模型本地部署,0 花费体验全部功能。重度办公:9.9 元国内云托管版,免 API、免运维直接使用。
Gumloop
Gumloop 全指南一、平台基础介绍Gumloop 是 2023 年由加拿大团队创立的企业级 SaaS 平台,由 Y Combinator 孵化。该平台于 2026 年 3 月完成 5000 万美金 B 轮融资,由 Benchmark 领投。1. 核心定位产品属性:无代码(No-code)AI Agent 企业自动化 SaaS 平台。对标产品:AI 版 Zapier。目标用户:非技术员工,主打零编程快速搭建专属 AI 智能体。核心能力:自动化企业全链路业务流程,生成能对接 CRM、数据库、邮箱、协作软件的自主 AI 员工。落地客户:Gusto、Instacart、Shopify、Samsara、Ramp 等海外中大型企业。2. 三大核心架构Agent 智能体层功能:一键生成行业专用 AI 智能体。使用方式:嵌入 Slack/Teams/邮箱,员工@即可下达指令。可视化画布层功能:拖拽式编排多 Agent 协同工作流。特点:内部共享复用建好的自动化流程,支持循环与判断分支逻辑。Gumstack AI 网关定位:企业安全底座。管控:管控模型权限、API 调用、全链路日志。部署:支持私有化部署,具备 SOC2 Type II+GDPR 认证。案例说明:在用户注册漏斗分析中,Gumloop 可自动算出注册→集成环节 46% 的流失率,帮助定位具体流失原因。二、平台核心功能(一)5 类预制标准化 AI Agent(开箱即用)平台提供五类预制智能体,用户可直接调用或微调。数据分析 Agent核心用途:连接 BigQuery/数仓,自动执行 SQL 查询、漏斗分析及数据可视化。落地场景:新用户注册漏斗监控、渠道转化率复盘。能力:自动定位流失环节,如分析注册到集成的 46% 流失率。售后工单 Agent核心用途:自动分类 BUG、生成工单、提炼客诉规律、汇总高频问题。落地场景:对接 Freshdesk/Zendesk 实现售后自动化。CRM 销售 Agent核心用途:线索挖掘、商机跟进、自动更新 Salesforce/HubSpot、客户调研。落地场景:销售线索培育、商机台账自动维护。会前筹备 Agent核心用途:跨工具抓取客户资料,会前自动生成拜访简报。落地场景:销售拜访、客户谈判资料汇总。通话分析 Agent核心用途:解析通话录音,提炼客户异议、竞品情报、销售辅导要点。落地场景:电销团队质检与话术优化。(二)自定义无代码搭建能力画布拖拽编排可视化画布支持拼接工具节点、AI 节点、触发条件。可搭建多步骤自动化(定时任务/表单触发/消息触发)。支持循环、判断分支逻辑配置。全平台生态对接原生接入超 50+ 主流 SaaS,包括 Gmail、GitHub、Stripe、Shopify、Airtable、Dropbox、Asana、Salesforce、Linear、Webflow、BigQuery 等。支持一键授权连接数据源。多模型自由调度内置 OpenAI、Anthropic、Gemini、DeepSeek 等模型。企业端可管控可用模型、设置调用预算、用量阈值预警。支持自带 API Key 接入自有大模型。定时 & 事件触发器支持固定周期(如每日/每周早 8 点)。支持表单提交、新增商机、报错告警触发 Agent 自动运行。团队协作与分享建好的 Agent 可一键分享给部门成员。支持复用/二次修改。提供精细化角色权限管控(RBAC)。(三)企业级安全 & 运维(Gumstack)零数据留存(ZDR):平台承诺不用企业业务数据训练 AI,签署 GDPR/DPA 合规协议。部署可选:提供 SaaS 公有云、企业私有 VPC 部署、本地私有化部署三选一。全链路审计日志:记录每一次工具调用、SQL 查询、AI 对话,溯源数据流向。SSO 单点登录:支持 Okta 等身份系统打通,SCIM 成员同步、密钥集中托管。三、适用人群1. 首选人群(高落地价值)企业销售团队/销售运营:负责 CRM 自动化、线索筛选、通话分析、客户跟进提醒;优化 Paid 广告投放线索与渠道转化数据分析。市场/增长运营:负责渠道获客漏斗分析、落地页流失定位、社媒评论监测、表单线索自动归档。客户成功/售后:负责工单自动分拣、客诉数据汇总、产品 BUG 统计。财务/HR 行政:负责薪酬数据对账、入职流程自动化、费用单据汇总。数据分析师:负责免写 SQL 自动拉取数仓数据、生成报表,解放重复取数工作。2. 次要适用人群中小初创企业创始人:无技术团队,需低成本搭建自动化替代基础人力。独立顾问/自由从业者:用于个人客户资料管理、项目台账自动化。IT 运维:负责告警自动工单、系统巡检、第三方工具数据同步。3. 不适合人群深度私有化定制需求:需深度开发的企业。国内无外网环境:国产内网环境下的本地化部署成本偏高。纯国内软件用户:企业微信、钉钉等无原生对接,需强行通过邮箱中转。四、免费 & 付费套餐Gumloop 采用免费试用 + 订阅制 + 按量计费(Credit 点数)的模式,按席位及 AI 调用额度双计费。1. Free 免费版(永久试用)适用对象:个人或小团队。额度:每月固定免费 Credit 算力点数。Agent 数量:最多创建 3 个自定义 Agent。对接软件:支持 5 款主流软件对接(如 Gmail、Slack 基础版)。限制条件:无法私有化、无团队协作功能、无高级数据分析 Agent、不支持 SOC2 合规、单次工具调用上限。用途:个人测试、验证单一场景自动化可行性。2. Starter 团队版(中小企业)计费方式:席位订阅 + 额外 Credit 按需充值。海外参考价格:约 $99 ~$199/席位/月。权益包含:不限 Agent 数量、20+ 应用接入、基础团队协作、定时任务、标准报表。适用规模:10 人以内销售/运营小团队。3. Enterprise 企业定制版(中大型公司)计费方式:商务一对一报价(对标 Gusto/Instacart 同款方案)。权益包含:私有化部署(Gumstack 全功能)。SOC2 合规认证。专属客户成功。定制 API 对接。无限 Credit 打包。私有云部署、SSO、自定义模型白名单、全量审计日志、技术驻场支持、不限席位扩容。4. 计费逻辑Credit 消耗构成:AI 推理消耗 + 第三方工具调用消耗(如 SQL/API 请求)。超额处理:超额需单独购买点数包。五、详细使用步骤(5 步快速上手)Step1 注册账号访问官网:https://www.gumloop.com。使用邮箱注册,支持谷歌/微软快捷登录。免费额度会自动到账。Step2 对接业务工具进入左侧「Connections」页面。搜索需要的软件(如 Salesforce、Gmail、BigQuery)。点击 OAuth 一键授权绑定账号,完成数据源接入。Step3 两种创建 Agent 方式快捷预制:首页选择预制 Agent(如数据分析、CRM)。输入自然语言指令(例:“帮我查新用户注册漏斗流失”)。AI 自动生成流程。画布自定义:新建 Canvas 画布。拖拽【触发节点→工具节点→AI 推理节点→输出节点】。用自然语言配置每个节点指令(例:表单提交→拉取表单数据→AI 分类线索→自动录入 HubSpot)。Step4 设置触发规则定时触发:每周一 8 点自动运行报表 Agent。事件触发:Salesforce 新增商机→自动发邮件提醒销售。手动触发:Slack/@Gumloop 指令即时执行。Step5 调试上线 & 团队共享单次试运行:查看工具调用日志,修正指令、调整分支逻辑。测试无误:开启后台自动运行。团队共享:分享 Agent 至团队空间,成员直接启用或二次编辑。Step6 用量监控后台进入「Usage」。查看 Credit 消耗及各 Agent 调用频次。设置 75% 额度阈值告警,避免超额扣费。六、避坑指南(高频踩坑点)1. 计费成本坑双扣机制:AI 模型推理 + 第三方工具调用均会扣 Credit。建议:BigQuery 全表查询、GPT4o 大模型推理消耗极高,新手优先用 DeepSeek/GPT3.5 降低成本。免费额度管理:免费额度用完若设置自动充值会扣费,务必提前在后台设置额度上限或关闭超额自动充值。第三方费用:Salesforce 高级 API、Stripe 付费接口调用会额外产生软件侧费用,非 Gumloop 收费。2. 功能落地坑集成适配问题:国内企业微信、钉钉、飞书无官方原生对接,强行用邮箱中转易出现数据延迟。AI 幻觉风险:数据分析 Agent 直接生成 SQL 前,关键报表建议加「人工复核节点」,避免 AI 错误查询导致数据失真(如漏斗统计口径错乱)。集成步骤流失:参考案例中付费广告用户 46% 卡在集成步骤。自建 Agent 时分步拆分对接逻辑,不要一次性绑定多个工具,降低用户/系统报错概率。3. 部署&合规坑数据合规:云端 SaaS 版数据存储海外,国内企业若涉及敏感经营数据,优先选私有化部署,避免跨境数据合规风险。模型管控:企业版务必开启模型白名单,禁用高成本大模型防止员工滥用消耗预算。数据留存:免费版无 ZDR 协议,敏感财务/客户数据不要在免费 Agent 处理,建议改用企业版零留存方案。4. 流程搭建坑流程复杂度:复杂工作流不要一步搭建,拆分成多个小型 Agent 再联动,单一流程节点过多易触发调用超时。渠道数据区分:做转化分析时按 Referral/付费广告/自然搜索分渠道配置 Agent,避免全量数据混淆(如付费广告转化率仅 4.7% 是高频踩坑盲区)。七、补充:和 Zapier 区别Zapier核心:纯固定规则自动化。局限:只能预设固定字段映射,无 AI 推理能力。Gumloop核心:AI 自主决策 + 自动化。优势:可自主分析数据、提炼规律、动态调整执行逻辑(例如自动定位流失环节、识别客户异议、自动计算转化率等)。
Bardeen
Bardeen.ai 全攻略一、平台整体介绍Bardeen.ai 是一款基于 Chrome 浏览器插件的无代码 AI 自动化平台。核心定位:主打「网页数据抓取 + AI 线索挖掘 + 跨工具自动化流转」,是销售/市场 GTM 全链路自动化工具。对标产品:轻量级的 Zapier + 网页爬虫组合,无需编程即可搭建自动化工作流。底层优势:依托浏览器运行,数据优先本地存储,拥有 SOC2 Type II、GDPR、CASA Tier2/3 合规认证,确保企业数据安全合规。落地成效:累计拥有 30 万 + 用户、服务上千家付费企业(如 Deel、GitFlash、Kearney 等知名公司)。核心逻辑:抓取网页数据 → AI 清洗富集信息 → AI 线索分级筛选 → 自动导出至 Google Sheets/Notion/Airtable/Slack 等办公软件。二、五大核心功能1. Search Result Scraper|网页结构化爬虫(核心)功能描述:支持自定义爬虫与官方预制模板。支持平台:可抓取 LinkedIn、企业官网、行业榜单、人才搜索页。处理能力:自动处理分页、点击翻页、多链接深度爬取。提取字段:包括头像链接、姓名、所在地、职位、个人简介、公司主页。示例场景:批量抓取湾区创始人、全球 AI 研发人才清单等。一键落地:抓取结果自动写入 Google Sheets 或 Airtable,替代人工复制粘贴。2. AI Web Search|AI 智能企业调研驱动方式:AI 驱动全网搜索。功能描述:批量查询目标公司融资轮次、投资方、营收、团队信息。操作提示:输入 Prompt 即可批量生成企业调研报告。示例 Prompt:Give me an overview Company's latest funding rounds and their investors。3. Enrichment|线索信息富集功能描述:基于已有姓名/公司,AI 反向补齐详细信息。补全内容:验证邮箱、手机号、任职时间、公司融资、办公地址。合规保障:内置邮箱有效性校验、空号/一次性手机号筛查,输出合规可触达线索库。4. AI Qualification|AI 线索智能打分筛选功能描述:自定义理想客户画像,AI 自动判定线索合格与否。输出结果:标记 Is Qualified(Yes/No)并标注筛选理由。价值:批量剔除无效线索,减少人工筛选成本。案例:文档中的 10 条线索 AI 分级案例展示。5. 自动化&数据导出&定时任务预制模板:拥有 300+ 行业自动化模板(拓客、招聘、房产、音乐人挖掘、周报汇总等),开箱即用。导出格式:支持 CSV、Google Sheets、Airtable、Notion。Schedule Run:支持定时自动运行爬虫(每日/每周定点抓取新数据)。批量执行:Actions 一键批量执行全链路流程。细分行业落地应用销售/GTM:批量挖掘创始人线索 → 补全联系方式 → AI 分级 → 自动入 CRM/表格。房产中介:抓取房源信息、房东信息,自动更新客户台账。音乐经纪:抓取博主/音乐人社交主页,富集联系方式挖掘新人。招聘:爬取 LinkedIn 候选人,汇总简历信息入招聘表格。市场研究/分析师:批量企业融资、行业数据搜集。三、适用人群分析✅ 最适配人群SDR 销售拓客团队/市场部(GTM 团队):获客线索挖掘是核心场景,Deel、EASYDMARC 等企业销售每周可节省 15~75 小时拓客工时,线索搭建效率提升 75%+。运营/增长岗:负责竞品数据监测、社媒博主搜集、行业榜单汇总。猎头/招聘专员:批量挖取候选人信息,自动整理人才库(KEARNEY 猎头单次爬虫节省 5 小时)。个体创业者(Solopreneurs):低成本自动化替代付费拓客工具,不用 Clay 等高价线索软件也能批量获客。市场研究员/分析师:需要批量收集企业融资、行业数据。❌ 不适合人群海量爬虫需求者:高强度海量全站爬虫(百万级数据爬取),Bardeen 浏览器算力受限。国内用户:国内无谷歌生态用户,重度依赖 Google Sheets、Chrome,国内环境集成受限。云端服务器爬虫需求:纯后端服务器爬虫需求,云端爬虫优先选 Octoparse。四、免费&付费套餐明细平台采用 Freemium 免费增值模式,分免费个人版、Pro 个人、团队版、企业定制版,计价单位:AI 点数/爬虫额度(抓取、富集、AI 筛选消耗点数)。1. Free(免费永久版)额度:每月有限爬虫次数、少量 AI 富集点数(线索补邮箱/电话)。限制:无法定时任务。单次抓取上限 10 条数据。导出仅限 CSV。无官方技术支持。适用对象:个人试用、偶尔少量数据搜集。2. Pro Plan(个人高级,$10/月起,年付优惠)核心权益:无限基础爬虫。每月足量 AI 富集额度。全格式导出(Google Sheets/Airtable/Notion)。开启 Schedule 定时运行。基础客服支持。功能解锁:全行业预制模板、邮箱/手机号批量校验。3. Team 团队套餐($99+/月,多人协作)核心权益:多账号共享点数。团队数据看板。批量团队权限管理。专属客服。适用对象:适合 3~10 人销售小组。4. Enterprise 企业定制(定制报价)服务内容:SOC2 专属运维、私有化部署、API 对接自有 CRM(Hubspot/Salesforce)。额度支持:大额爬虫额度、定制爬虫开发。价格参考:报价 299$+/月起,中大型企业选用。五、分步使用指南(新手 5 步快速上手)步骤 1:安装入口打开 Chrome 浏览器,进入 Chrome 网上应用商店搜索 Bardeen AI。一键添加插件。打开官网 https://www.bardeen.ai/,用 Google 账号注册登录(必备,全工具依赖谷歌账号)。步骤 2:选择工作流方式 A(新手首选):在模板市场搜索行业模板(如「LinkedIn Founder Scraper 创始人爬虫」),一键启用预制工作流。方式 B(自定义):新建 Automation → 依次串联:爬虫 (Scraper)→AI 调研→Enrich 线索富集→AI 资质筛选→导出表格 四大模块。步骤 3:配置爬虫规则打开目标网页(LinkedIn 搜索页/企业列表页)。在 Bardeen 面板勾选需要抓取字段(姓名、地址、职位、主页)。开启分页抓取(Pagination),设置翻页规则,支持批量多 URL 导入爬取。步骤 4:配置 AI 富集&筛选Enrich 模块:勾选「验证邮箱、校验手机号、企业融资信息」。AI Qualification:输入理想线索规则(例:筛选旧金山 B 轮以上 AI 公司 CTO),AI 自动标记合格/不合格线索。步骤 5:导出+定时执行Export:选择目标平台(Google Sheets/Airtable),一键自动同步数据。Schedule Run:开启定时自动运行,设置每日固定时间自动跑爬虫更新数据。六、避坑指南(高频踩坑点 + 解决方案)1. 爬虫相关坑❌ 坑点:单次抓取大量页面被网站反爬(LinkedIn/官网风控封禁)。✅ 解决方案:拆分抓取批次,单次≤50 条,开启随机抓取间隔,避免短时间高频请求。❌ 坑点:网页改版后爬虫失效(网站 DOM 结构变更,字段抓取为空)。✅ 解决方案:优先用 Bardeen 内置 AI 智能抓取(自动适配页面改版),少用固定选择器爬虫。2. 额度&资费坑❌ 坑点:免费版不知不觉用完点数,自动扣费开通会员。✅ 解决方案:后台开启额度提醒,富集手机号/邮箱是高消耗功能,免费额度优先留关键线索。❌ 坑点:盲目升级企业版,团队用不完额度浪费。✅ 解决方案:先用 Pro 版试用 1~2 个月,统计团队月消耗点数再升级团队套餐。3. 合规&法律坑(重中之重)❌ 坑点:批量抓取个人手机号/邮箱用于垃圾营销,违反 GDPR、当地隐私法。✅ 解决方案:仅抓取公开合规信息,不滥用联系方式群发骚扰,Bardeen 合规认证仅限合法商务拓客。❌ 坑点:抓取付费会员/隐私受限网站内容(需登录权限的内网数据)。✅ 解决方案:仅抓取公网公开数据,登录后私有内容抓取有法律风险。4. 国内使用坑❌ 坑点:国内网络无法打开 Chrome 商店、Google Sheets 同步失败。✅ 解决方案:使用海外网络环境,导出优先选 CSV 本地存储,放弃谷歌生态联动。5. 功能预期坑❌ 坑点:指望替代专业云端爬虫(Octoparse)做百万级全站爬取。✅ 解决方案:Bardeen 是浏览器轻量化自动化,海量爬虫选用专业爬虫工具,Bardeen 聚焦线索精细化拓客。七、典型实操案例场景描述:批量抓取 10 位海外 AI 创始人。 执行流程:AI 查企业融资。补全邮箱。AI 筛选合格线索。自动写入谷歌表格。 效果:整套自动化 5 分钟完成,替代原本 3~4 小时人工整理工作。
Skyvern
Skyvern 全指南一、平台介绍1. 核心定位Skyvern 是 Y Combinator 孵化、开源 AGPL-3.0 协议 的 AI 浏览器智能体自动化平台。它依托 LLM 大模型 + 计算机视觉双引擎 实现网页自动化,对标 Selenium/Playwright/RPA,旨在解决传统自动化依赖 DOM 选择器、网页改版后脚本直接失效的痛点。核心能力:支持自然人话描述生成浏览器自动化流程,无需编写 XPath/CSS 选择器,不用频繁修改代码。模拟操作:能够模拟真人操作浏览器,完成登录、填写表单、爬取数据、下载票据等任务。2. 基础数据与合规社区影响力:GitHub 星标数 21800+,拥有 3 万 + 政企用户,500+ 付费企业,累计运行 1000 万 + 自动化任务,可用性 SLA 高达 99.9%。安全合规:具备 SOC2 Type II 认证,HIPAA 医疗合规 资质,提供全链路数据加密服务。3. 部署模式提供三种灵活的部署方式,适应不同需求:云端 SaaS:在线使用,无需维护。Docker 自托管:私有化部署,数据本地留存。本地 SDK:通过 Python/TypeScript 调用,适合集成开发。4. 与主流工具对比对比维度传统工具 (Selenium/Playwright/传统 RPA)Skyvern 优势维护成本绑定 DOM 选择器,页面微调导致脚本报废,需持续运维视觉识别元素,页面改版自动适配,几乎免维护登录能力复杂登录/验证码易崩,定制化强但复用差LLM 自主规划步骤,原生过验证码 +2FA,登录更稳健智能程度纯规则驱动,灵活性低视觉 + 代码 + 大模型三合一,全链路鉴权适配,具备自主规划能力二、核心功能1. 底层核心能力(平台内置)原生验证码破解:内置 AI 识别引擎,无需第三方打码平台,自动处理图文/滑块验证。双因子登录支持:全自动接收并填入 2FA/TOTP 验证码,打通网银、企业后台、厂商供应商系统的全账号登录链路。代理 IP 支持:提供精准到国家/城市/邮编级的住宅或机房代理,解决 IP 封禁与地域访问限制。可解释 AI 日志:每一步操作留存 AI 决策说明、运行快照及全页面截图,便于快速排查报错。OCR 文档解析:支持 PDF/图片票据的自动识别与结构化输出。2. 落地业务功能数据结构化提取:任意网页抓取产品价目、财报、供应商数据,直接导出 JSON/CSV,无需网站开放 API。应付账款自动化:批量登录几百家供应商后台,自动下载发票 PDF 并进行分类归档,解决财务手动下载痛点。批量表单填报:自动化处理注册、资质申报、招商表单的大批量提交(适用于销售线索、企业报备)。线索挖掘拓客:抓取目录网站联系人信息,自动发表单触达。UI 自动化测试:适应前端改版,替代不稳定的传统自动化测试用例。文档处理流水线:实现门户下载→解析→分类→推送企业内部系统的全链路自动化。3. 搭建自动化工作流方式(4 种模式)Copilot 对话(小白首选):使用自然语言描述任务,AI 一键生成流程。示例指令:“登录 vendor.acme.com,输入账号密码,下载当月所有发票。”上传 SOP 文档:上传 PDF/Word 业务操作手册,平台自动转为可运行脚本。浏览器录制:手动操作一遍网页,平台录制并生成永久复用流程。可视化拖拽:在画布中拖拉组件,精细化编辑流程。SDK 开发(程序员):提供 Python/TypeScript 接口,支持 Docker 私有化部署。4. 生态集成原生对接 Zapier、n8n、Workato、Make、Clay 等低代码平台。支持 Webhook 与事件流触发任务。三、适用人群与场景1. 适用人群企业财务/AP 应付团队:大批量收取供应商发票、对账、票据归集(最主流用户)。市场/销售团队:拓客爬虫、批量表单注册、线索搜集。测试工程师:WEB 自动化测试、回归测试。数据分析师/爬虫从业者:全网站结构化数据采集、竞品监控。HR 行政:批量招聘投递、社保系统填报。开发工程师:私有化自研系统集成、替代 Selenium 爬虫。中小创业者:低成本自动化重复网页工作,替代人工。2. 不适用场景超简单固定页面:单页面纯文本抓取,传统爬虫成本更低。高频极速请求:毫秒级接口请求,AI 思考存在毫秒级延迟,不适合极高频交易场景。四、定价方案(3 种使用渠道)1. 云端 SaaS(官网在线使用)免费版(Free Tier):新用户赠送免费任务步数额度,额度用完停止运行。无时间限制,额度按月重置。按量付费(Cloud 按需):按自动化步骤计费(AI 每一步点击/输入算 1 步)。适合企业大批量任务,阶梯降价。企业订阅版:固定包月包年。包含专属客服、专属代理 IP、私有化部署对接、SLA 故障赔付、SOC2 企业安全服务。2. 开源自托管(Docker 部署)费用:代码全开源(GitHub: Skyvern-AI/skyvern),永久免费无任务上限。成本:仅需自备服务器硬件成本(云主机/VPS)。优势:数据全部本地留存不外流,适合敏感财务、涉密业务。硬件建议:最低 2 核 8G 内存 VPS(约 60~110 元/月)。3. SDK 本地开发策略:免费调用测试,上线生产按需购买云端 API 额度或自建私有化服务。选择建议:个人试用选云端免费额度;敏感数据/大批量任务选 Docker 自托管;企业省心运维选云端企业订阅。五、详细使用步骤指南1. 零代码网页端(新手首选)访问官网 https://www.skyvern.com/,注册账号并领取免费额度。进入 Copilot Chat 对话框,使用自然语言(中英文均可,英文效果最优)写任务指令。示例:“打开 https://xxx.com,输入账号 xxx、密码 xxx 登录,进入账单页下载所有 10 月发票,导出 CSV 数据。”AI 自动生成工作流,点击【试运行】,查看云端浏览器执行日志及截图。流程无误后保存任务,设置每日/每周定时自动运行。2. 录制浏览器生成流程平台打开可视化录制窗口,启动内置浏览器。手动完整走一遍全流程(登录→找数据→下载/填表单)。停止录制,AI 自动优化流程,后续可一键重复运行。3. Python 代码接入(开发者)官网后台获取 API_KEY。安装 SDK:pip install skyvern-sdk。复制以下示例代码并修改网址和任务描述:pythonfrom skyvern import Skyvern skyvern = Skyvern(api_key="你的 API_KEY") page = await skyvern.use_cloud_browser().get_working_page() await page.goto("https://www.saucedemo.com/") # 自动凭据登录 await page.agent.login(credential_type=CredentialType.skyvern,credential_id="cred_123") # 自然语言下达任务 await page.agent.run_task("使用 John Snow、邮编 12345 完成订单结算") await page.screenshot(path="screenshot4.png", full_page=True) from skyvern import Skyvern skyvern = Skyvern(api_key="你的 API_KEY") page = await skyvern.use_cloud_browser().get_working_page() await page.goto("https://www.saucedemo.com/") # 自动凭据登录 await page.agent.login(credential_type=CredentialType.skyvern,credential_id="cred_123") # 自然语言下达任务 await page.agent.run_task("使用 John Snow、邮编 12345 完成订单结算") await page.screenshot(path="screenshot4.png", full_page=True) 私有化部署:拉取 Docker 镜像,本地启动服务对接 SDK。4. SOP 文档导入上传 Excel/Word 操作手册,平台自动解析文档步骤,直接生成自动化流程,无需手动描述。六、避坑指南1. 成本避坑云端步数控制:开启平台缓存机制,重复页面不重复 AI 推理,可节省 80% 步数费用。余额预警:云端开启余额预警,避免任务无限制跑超支。长期策略:频繁大批量任务优先自托管,长期比云端付费省钱。2. 数据安全避坑(最重要)敏感数据隔离:账号密码、财务密钥、供应商敏感账单必须使用 Docker 自托管私有化部署,数据不出自己服务器。代理安全:企业隐私数据禁用公共代理 IP,建议采购专属静态住宅代理。3. 任务稳定性避坑流程拆分:超过 10 步的长流程拆分成多个子任务,减少 AI 幻觉和步骤跑偏。反爬应对:网站反爬严格时,配置对应地区代理,避免短时间高频访问被封号。指令语言:非英文小众网站优先使用英文指令描述任务,中文复杂指令 AI 识别准确率稍低。4. 选型避坑页面类型选择:固定极简页面别用 Skyvern,纯静态网页抓取用 Playwright 成本更低、速度更快。Skyvern 优势在于动态登录 + 验证码 + 多表单场景。服务器配置:自托管服务器低于 2 核 4G 运行会卡顿,OCR 和视觉识别可能超时,推荐 2 核 8G 起步。5. 合规避坑版权与隐私:禁止用于爬虫抓取受版权保护、隐私受法律保护的内容(如用户隐私数据、付费版权数据)。遵守协议:遵循目标网站的 robots 协议,避免批量注册或恶意薅羊毛导致 IP 封禁。七、补充小贴士指令语言优化:优先使用英文写任务描述,模型原生训练英文,自动化成功率比中文高 15%+。失败排查:调试失败时打开 可解释 AI 日志,查看 AI 每一步决策失败原因,优化指令。版本更新:定期更新开源代码,官方持续迭代视觉模型,新版本能提升验证码、复杂页面识别率。
Pipedream
Pipedream 全指南重要备注:2025 年 11 月 Pipedream 已被 Workday 正式收购。平台主体服务不变,重点强化 AI Agent + 企业 ERP/HR 系统打通能力。目前全球已有超 100 万开发者活跃使用。一、平台基础介绍1. 核心定位Pipedream 是一款云端零代码/低代码 API 自动化 + AI Agent 开发集成平台。主要功能:主打跨 SaaS 应用、API、数据库的自动化工作流搭建。部署方式:无需自建服务器,不用运维基础设施。交互方式:可视化拖拽 + 支持 Python/Node.js/Go/Bash 自定义代码。核心价值:一站式打通上千款软件接口。2. 平台优势海量预制集成:支持 3000+ 主流应用连接器,拥有 10000+ 预制工具(触发器 + 动作)。兼容 Google、Slack、Notion、Shopify、AWS、Salesforce、Anthropic 等全生态。MCP 协议原生支持:Pipedream MCP 可对接 Claude 等 AI 模型,快速给 AI Agent 挂载上万第三方工具和数据源,是目前主流 AI Agent 的外接生态方案。合规安全:通过 SOC2 Type II、HIPAA、GDPR 合规认证。托管统一鉴权,敏感数据全加密存储,满足企业数据合规要求。云原生托管:平台托管队列、数据存储、私有网络,工作流云端自动运行,支持秒级部署 AI 智能体。二、五大核心功能1. 可视化工作流自动化(平台基础)触发器(Trigger):支持定时(秒/分/时/日/周/月)、Webhook、新邮件、表单提交、GitHub 新增 Issue、新订单等事件触发工作流。执行动作(Action):自动写入 Google Sheets、发送 Gmail 邮件、推送 Slack 消息、同步 Notion 数据、新增 CRM 客户、调用 AWS 接口等。典型场景:邮箱自动分类汇总、每日日程周报自动生成、电商上新自动发推文、商机线索入库 CRM。2. AI Agent 一键搭建(平台最新主力功能)AI Agent Builder:通过自然语言 Prompt 即可生成、调试、部署智能体,AI 自动生成对接 API 代码,几分钟上线可用。业务场景:财报电话纪要总结、每日日历 AI 摘要、新品开售监控(如耐克上新提醒)。开发场景:AI 模型运行监控、第三方 API 批量调用、文档自动解析入库。3. Pipedream Connect(开发者 SDK 集成)功能:提供一套 SDK 快速给自有 App/自研 AI 嵌入第三方应用对接能力。优势:几分钟集成任意 API,不用单独对接各平台 OAuth 鉴权,统一由 Pipedream 托管账号授权。4. MCP 服务(AI 生态专属)Pipedream MCP Server:开发者/用户可一键给大模型(如 Claude、Cursor 等)接入 3000+ 应用及 1 万工具。能力:AI 可读写表格、查数据库、操作企业 SaaS 系统。5. 自定义代码扩展灵活性:任意节点插入 Python/JS/Bash 代码。用途:灵活处理数据转换、异常捕获、定制逻辑,兼顾小白零代码与程序员深度定制。三、适用人群1. 个人/自媒体/运营(零代码小白)适合需求:新媒体自动化(上新提醒、推文批量生成)、个人日程管理、邮箱自动化、表单数据汇总。 特点:不会编程也能用,满足低频个人自动化需求。2. 产品/运维/IT 工程师(中小团队)适合需求:快速打通内部系统(如 Jira→飞书/Slack、数据库→CRM)、监控 API 异常告警、服务器日志自动汇总、低成本搭建内部自动化。3. AI 开发者/大模型调参师适合需求:给 Claude、自研 Agent 外接外部工具、数据源,快速落地联网 AI、业务型智能体(客服机器人、数据助手),MCP 刚需工具。4. 企业/中大型公司(财务、HR、销售)适合需求:跨 Workday、Salesforce、HubSpot、ERP 系统数据同步,财务账单自动归集、员工数据跨系统流转。 特点:Workday 收购后深度适配企业人事财务场景。5. SaaS 创业者适合需求:用 Connect 快速为自家产品做第三方生态对接,不用重复开发各平台授权接口,缩短产品开发周期。四、免费&付费资费方案1. Free(永久免费版|Hobby)免费权益:每月10 万次执行事件;单工作流单次运行时长≤30 秒;不限工作流数量,基础 3000+ 连接器全免费使用;基础 AI Agent 简易搭建,免费 MCP 试用;平台托管鉴权、基础日志查看、社区技术支持。限制条件:无 SLA 保障、无企业级私有网络、不支持自定义域名、高级运行时长扩容不可用、无专属客服。适用对象:个人学习、小型测试、低频自动化需求。2. Pro 专业版(订阅付费)订阅价格:$29/月/账号(年付享 8 折优惠)。主要权益:每月1000 万执行额度;单步运行最长5 分钟;完整 AI Agent 开发,全量 MCP 商用权限;自定义私有网络,优先技术支持,详细运行报表,SLA 运行保障。适用对象:高频自动化、AI 创业、中小型商业化项目。3. Enterprise 企业版(定制报价)对接方式:对接 Workday 商务获取报价。主要权益:无限执行次数;专属集群部署,SSO 单点登录,DPA 合规协议;定制连接器开发,7×24 专属售后,私有化部署可选;Workday 生态深度打通(HR/财务系统原生联动)。适用对象:中大型集团、上市公司、强合规行业(医疗、金融,需 HIPAA/GDPR)。五、分步使用教程(新手 5 分钟上手)步骤 1:注册登录访问 pipedream.com,使用邮箱注册。支持 Google 账号快捷登录。无需绑卡,免费版直接开通。步骤 2:新建工作流(Workflow)进入创建界面:在首页点击「Create Workflow」。配置触发器(Trigger):例:选择「New Email in Gmail」(收到新邮件触发)。完成 Gmail OAuth 授权(平台托管登录,不用手动拿 API Key)。添加动作(Action):搜索 Google Sheets 选择「Add Row」。授权表格账号,把邮件标题、发件人自动填入表格对应单元格。添加代码逻辑(可选):新增 Code 节点,用 JS/Python 清洗数据(例如过滤垃圾邮件)。部署生效:点击右上角 Deploy 部署,收到新邮件自动写入表格。步骤 3:AI Agent 快速创建进入首页→AI Agent Builder。输入自然语言指令(例:每天抓取 Notion 周报,汇总后发 Slack 日报)。AI 自动生成全链路工作流,一键部署即可。步骤 4:MCP 对接大模型(开发者)在终端执行:npx @pipedream/mcp。配置密钥后在 Claude/Cursor 挂载 Pipedream MCP。AI 即可调用 3000+ 外部应用。六、新手避坑清单(高频踩坑点)1. 额度相关坑(最常见)风险:免费版触发次数用完工作流直接暂停,频繁轮询浪费额度。解决方案:提前拆分高频工作流,定时任务调低频率(不要每秒轮询)。高频轮询建议改用 Webhook 触发(API 主动推送数据,替代定时拉取,节省额度)。2. 应用授权坑风险:部分第三方应用(如 Google/Notion)权限 90 天过期,批量工作流会突然中断。解决方案:企业项目用 Pro/Enterprise 托管长效 OAuth,定期在 Pipedream 凭据中心批量刷新授权。3. 运行超时坑风险:免费版单步 30 秒上限,大数据处理直接报错终止。解决方案:大任务拆分成多节点分步执行,超长任务升级 Pro(最长 5min 单步)或拆分多工作流接力。4. 数据合规&隐私坑风险:直接明文传输身份证、患者数据(医疗),违反 HIPAA/GDPR。解决方案:敏感字段在 Code 节点加密处理,企业业务选用企业版签署 DPA 协议。5. Workday 收购后续变动坑风险:企业用户混用 Workday 自研 HR 系统 + Pipedream,接口版本不兼容。解决方案:对接商务获取 Workday 原生连接器,优先使用官方预置 Workday 节点。6. MCP 使用坑风险:MCP 密钥泄露导致第三方 API 被盗刷扣费。解决方案:密钥存入 Pipedream 内置数据仓库,不在代码明文写密钥,开启 IP 白名单。7. 调试坑风险:上线前不测试直接部署,报错后反复触发消耗额度。解决方案:用 Test 按钮单次测试节点,查看事件日志,确认全流程正常再 Deploy 上线。七、实用落地案例参考运营自动化Shopify 新订单 → 自动新增 Google Sheet → 触发 Gmail 给客户发收货提醒。AI 办公每日抓取全团队 Notion 日报 → AI 汇总 → 定时推送 Slack 群。开发监控GitHub 新建 Issue → 自动创建 Linear 工单 + 钉钉推送告警。
AutoGen
Microsoft AutoGen 全指南重要提示:AutoGen 现已进入维护模式,微软新项目迭代转向 Microsoft Agent Framework。存量项目可继续使用 AutoGen,新项目建议优先考虑迁移至新版框架。一、平台介绍1. 项目基础信息开发背景:由微软研究院、宾州州立大学、华盛顿大学联合研发,2023 年 10 月首发于 GitHub。开源协议:MIT 开源协议,全球 Star 超 5.4 万。开发语言:以 Python 为主力,同时支持 .NET 双语言生态。版本现状:稳定版:v0.4 版本。维护模式:自 2025 年 10 月起停止新增功能,仅进行 BUG 维护。核心思想:拆分角色 Agent(如程序员、分析师、审核员等),AI 之间通过自主对话沟通、分工协作落地任务,支持人工随时介入干预。2. 三大核心原生 AgentAutoGen 框架的基石由以下三种核心 Agent 构成:AssistantAgent定位:思考生成大脑。核心用途:绑定大语言模型(LLM),负责写代码、分析、生成方案及逻辑推理。UserProxyAgent定位:执行端 + 人机接口。核心用途:运行 Agent 生成的代码,接收人类指令,控制终止逻辑,支持沙箱安全运行代码。GroupChatManager定位:群聊管理员。核心用途:多 Agent 群组对话调度,自动分配发言顺序、管控会话流程。二、主要功能1. 核心能力AutoGen 具备以下六大核心能力:多智能体自由协作支持单/多 Agent 组队聊天,可自定义角色分工(如产品 + 开发 + 测试 AI 协同开发)。支持串行或并行任务调度。自动代码生成 + 安全执行内置 Docker 沙箱隔离运行 Agent 输出的 Python/Shell 代码。支持自动报错、迭代修复,避免恶意代码污染本机。本地调试时可关闭沙箱直接运行代码。全品类大模型兼容原生支持 OpenAI、Azure OpenAI、Claude、通义千问、Llama3/Ollama 本地开源大模型。统一配置格式,可灵活切换模型。AutoGen Studio 无代码可视化自带 Web 拖拽 UI,无需编写 Python 代码。可视化搭建 Agent 工作流、调试对话,一键导出代码。灵活人在回路(Human-in-the-loop)ALWAYS:每次执行前必须人工确认(适用于金融/敏感业务)。TERMINATE:仅任务结束时人工确认。NEVER:全自动无人值守执行(适用于自动化流水线)。扩展生态支持工具调用(爬虫、数据库读写、文件处理)。支持会话持久化、链路日志追踪、多机分布式部署。2. 落地场景开发自动化:AI 团队自主写代码、调试、生成爬虫/数据分析脚本。数据分析:多 Agent 分工清洗数据、可视化、输出业务分析报告。企业 RPA:自动化报销、入职审批、合同审阅等跨部门流程。科研教育:AI 多智能体课题实验、编程教学、学术数据处理。复杂推理:多步骤理财测算、行业市场研判、方案拆解落地。三、适用人群AI/后端开发工程师:快速落地 Agent 应用、私有化 AI 工作流、企业内部 AI 自动化工具。算法/科研人员:进行多智能体学术实验、LLM 协作机制研究。产品/业务分析师:利用 AutoGen Studio 零代码搭建自动化业务流程。学生/AI 爱好者:低成本学习多 Agent、LLM 应用开发,本地 Ollama 跑开源模型零成本试错。中小企业数字化:低成本搭建内部自动化 AI 助理,替代重复人工工作。四、免费与付费详情1. 框架本体(永久免费)费用情况:无授权费、无软件订阅费、无商用限制。协议说明:MIT 协议,个人/企业均可免费修改、二次开发、商业化落地。资源:社区文档、开源代码全免费,仅社区技术支持,无官方付费版软件授权。2. 使用者实际自费项目(非框架收费)大模型 API 费用(最大开销)商用 API:GPT-3.5/GPT4、Claude、Azure OpenAI 按 Token 计费。多 Agent 对话 Token 消耗通常是单 Agent 的 2~5 倍。零成本方案:本地 Ollama 部署 Llama3、Qwen 等开源大模型,完全不用 API 付费。服务器/部署成本本地调试:个人电脑即可运行,零硬件开销。生产部署:云服务器 + Docker 容器,按需付费;使用 Azure 托管沙箱环境额外收取云资源费。可选增值付费Azure AI Foundry 托管服务:企业需要官方运维、专属技术支持、合规部署,按需订阅付费(非 AutoGen 强制收费)。第三方商业托管平台:部分服务商推出 AutoGen 云托管订阅(99 美元/月起),非原生官方收费,按需选择。五、分步使用指南(Python 环境,主流落地方式)1. 环境准备Python 版本:3.8~3.13,推荐 3.10。操作命令:bash# 1. 创建虚拟环境(隔离依赖,必做) conda create -n autogen_env python=3.10 conda activate autogen_env # 2. 安装 AutoGen 核心包 + OpenAI 扩展 pip install -U "autogen-agentchat" "autogen-ext[openai]" -i https://pypi.tuna.tsinghua.edu.cn/simple # 可选:安装可视化 AutoGen Studio(无代码界面) pip install autogenstudio # 启动可视化页面:终端输入 autogenstudio ui --port 8080,浏览器打开 localhost:8080 # 1. 创建虚拟环境(隔离依赖,必做) conda create -n autogen_env python=3.10 conda activate autogen_env # 2. 安装 AutoGen 核心包 + OpenAI 扩展 pip install -U "autogen-agentchat" "autogen-ext[openai]" -i https://pypi.tuna.tsinghua.edu.cn/simple # 可选:安装可视化 AutoGen Studio(无代码界面) pip install autogenstudio # 启动可视化页面:终端输入 autogenstudio ui --port 8080,浏览器打开 localhost:8080 2. 基础配置配置 LLM 密钥,避免代码明文写 Key。方式一:环境变量配置(推荐,安全性高)bash# Linux/Mac 终端 export OPENAI_API_KEY="你的 API 密钥" # Windows PowerShell $env:OPENAI_API_KEY="你的 API 密钥" # Linux/Mac 终端 export OPENAI_API_KEY="你的 API 密钥" # Windows PowerShell $env:OPENAI_API_KEY="你的 API 密钥" 方式二:代码内配置(仅本地测试)pythonimport autogen config_list = [{"model":"gpt-3.5-turbo","api_key":"sk-xxx"}] import autogen config_list = [{"model":"gpt-3.5-turbo","api_key":"sk-xxx"}] 3. 最简双 Agent 示例(AI 写代码 + 自动运行)python# 1. 配置模型 llm_config = {"config_list":config_list,"temperature":0.1} # 2. 创建程序员 Agent(负责写代码) coder = autogen.AssistantAgent( name="Python 工程师", llm_config=llm_config, system_message="编写 Python 代码,代码用```python```包裹,完成任务回复 TERMINATE 结束对话" ) # 3. 创建执行 Agent(自动运行代码) executor = autogen.UserProxyAgent( name="代码执行器", human_input_mode="NEVER", # 全自动不人工确认 max_consecutive_auto_reply=10, # 最大连续对话 10 轮防死循环 is_termination_msg=lambda x:x.get("content","").find("TERMINATE")>=0 ) # 4. 发起任务:让 AI 生成股票数据分析代码 executor.initiate_chat(coder, message="帮我写 Python 代码,生成随机数据并绘制折线图") # 1. 配置模型 llm_config = {"config_list":config_list,"temperature":0.1} # 2. 创建程序员 Agent(负责写代码) coder = autogen.AssistantAgent( name="Python 工程师", llm_config=llm_config, system_message="编写 Python 代码,代码用```python```包裹,完成任务回复 TERMINATE 结束对话" ) # 3. 创建执行 Agent(自动运行代码) executor = autogen.UserProxyAgent( name="代码执行器", human_input_mode="NEVER", # 全自动不人工确认 max_consecutive_auto_reply=10, # 最大连续对话 10 轮防死循环 is_termination_msg=lambda x:x.get("content","").find("TERMINATE")>=0 ) # 4. 发起任务:让 AI 生成股票数据分析代码 executor.initiate_chat(coder, message="帮我写 Python 代码,生成随机数据并绘制折线图") 4. 无代码使用(AutoGen Studio)安装后执行命令:autogenstudio ui --port 8080。网页端拖拽创建 Agent、填写角色提示词、填入 API Key。输入任务指令,一键运行多 Agent 协作,调试完成后导出 Python 代码。六、高频避坑点(生产与调试必看)1. 对话死循环(最常见问题)问题现象:Agent 来回重复对话、无限闲聊不结束,疯狂消耗 Token。解决方案:配置 max_consecutive_auto_reply 限制最大自动轮次(建议 ≤ 15)。必须设置 is_termination_msg 终止关键词(如 "TERMINATE")。System Prompt 中明确任务结束标准。2. API 密钥明文泄露问题现象:代码硬编码 API Key 上传代码仓库,密钥被盗刷扣费。解决方案:统一用系统环境变量或本地 yaml 配置文件加载密钥,严禁明文写入代码。3. 代码执行安全风险问题现象:NEVER 全自动模式下 Agent 生成删文件、联网恶意代码,破坏本机。解决方案:生产环境强制 Docker 沙箱运行。金融/敏感业务改为 human_input_mode="ALWAYS" 人工确认。限制容器读写权限。4. 成本失控(Token 超支)问题现象:多 Agent 群聊对话超长,GPT4 费用暴涨。解决方案:简单任务切换廉价 gpt3.5 或本地开源模型,复杂任务用 GPT4。配置对话上下文缓存,减少重复 Token 消耗。单轮对话设置 Token 上限。5. 版本升级踩坑问题现象:v0.2 旧代码无法直接在 v0.4 新版本运行,API 大改。解决方案:新项目直接用 autogen-agentchat 新包,老项目参考官方迁移文档升级;新项目优先调研 Microsoft Agent Framework。6. 本地开源模型对接失败问题现象:Ollama 本地大模型无法接入 AutoGen。解决方案:安装 autogen-ext[ollama] 扩展,修改 config_list 适配 Ollama 本地接口地址。7. 生产环境会话丢失问题现象:服务重启后 Agent 对话记录、任务状态全部清空。解决方案:生产环境用 Redis+MySQL 持久化会话,不要只用内存存储状态。
CrewAI
CrewAI 全指南:一、平台介绍1. 基础定位CrewAI 是主打多 AI 智能体(Multi-Agent)团队协作的开源 + 企业级商用一体化平台。官网地址:https://crewai.com核心设计逻辑:把 AI 拟人化为企业员工,分工组建 AI 团队(Crew),不同角色 Agent 各司其职、协同完成全链路复杂业务自动化。区别于单一大模型单点任务处理,适合处理全链路复杂业务。市场认可度:目前63% 世界 500 强企业落地使用(如 Docusign、百事、Experian 等),覆盖销售、HR、运维、财税、客服全场景自动化。2. 产品矩阵平台主要分为两大产品线:开源 Python 框架版:GitHub 开源、MIT 协议,支持本地代码部署,适合开发者与个人使用。CrewAI Enterprise 企业云端平台:SaaS 可视化平台(地址:app.crewai.com),支持零代码 + 代码双模式,提供企业管控、集成数百款商用 SaaS 工具。二、五大核心功能(Enterprise 企业平台 + 开源框架通用)1. Discovery 引擎(自动化机会挖掘)这是平台核心入口功能,用于解决“不知道哪些业务能 AI 自动化”的痛点。功能描述:自动扫描企业现有业务系统、工单、聊天记录、工作流。基于数十亿次 Agent 运行数据匹配业务痛点,自动生成可落地的自动化清单。排序维度:按投入成本、落地收益、实现难度排序。输出结果:一键生成汇报文档,包含销售线索挖掘、简历筛选、工单自动处理等方案。用法:录入企业在用软件清单 → AI 分析 → 输出自动化方案。2. Crew Studio:可视化多 Agent 搭建支持零代码 + 代码双构建模式,实现灵活部署。无代码可视化编辑器:拖拽式创建 AI 员工(Agent)、分配任务(Task)、组建 AI 团队(Crew),自动生成可导出 Python 代码。代码优先 API:面向开发,全自定义 Agent 逻辑,支持 CLI 命令行部署。双执行流程:Sequential(顺序执行):任务逐个流转(如:调研→分析→撰写)。Hierarchical(层级管理):设置 AI 项目经理 Agent,自主拆分任务、分配成员、统筹全流程。内置资源:提供现成 AI 角色模板(如销售调研、简历筛选、客服分类、数据分析师)。3. 全平台工具集成(20+ 主流软件原生对接)原生打通企业主流办公/业务系统,开箱即用无需二次开发。CRM/销售类:HubSpot、DocuSign 电子签。项目协作类:Asana、ClickUp、Confluence。数据存储类:BigQuery、Box、Dropbox、Databricks。HR 人事类:BambooHR、Greenhouse 招聘系统。研发运维类:GitHub、GitLab、Datadog 监控。办公/客服套件:Google Workspace、Intercom 在线客服、Freshdesk 工单。工作机制:通过「STEP2 工具录入」收集企业软件栈,自动推荐适配自动化方案。4. Control Plane 企业管控运维(付费企业专属)全生命周期 Agent 管控面板,解决大规模 AI 集群失控问题。全链路追踪(Traces):实时记录每一次 LLM 调用、工具调用、消耗 Token 成本,实现完整账单核算。权限与审计(RBAC+IAM):分级成员权限、不可篡改操作审计日志,满足合规要求。人工介入(Human-in-the-loop):关键节点强制人工审批,防止 Agent 误操作。数据脱敏:运行时自动屏蔽手机号、身份证等 PII 隐私信息。5. Optimize 智能迭代优化利用每次运行数据训练 Agent,实现越用越精准。微调模式:支持自动 + 人工双模式微调 Agent 模型。动态切换:运行中一键替换 GPT-4o、DeepSeek、Gemini、本地 Ollama 开源模型。效果评测:对接 Arize、Datadog 等评测工具,自动生成 Agent 效果报表,推荐优化方向。落地实例(客户落地数据)Docusign:AI 自动汇总多系统线索,线索首次触达效率提升75%。General Assembly:课程内容 AI 生成,课程研发时间减少90%。Piracanjuba:AI 客服替代传统 RPA,工单回复准确率95%。三、适用人群1. 个人/自由从业者(免费开源版)目标人群:自媒体、独立顾问、小创业者、AI 爱好者。应用场景:批量内容创作、竞品调研、资料整理、简历筛选,低成本搭建个人 AI 助理团队。2. 中小企业(SaaS 标准版)目标人群:销售公司、人力外包、小型服务商。应用场景:自动化线索挖掘、招聘筛简历、售后工单处理,替代大量重复性人力。3. 中大型企业/集团(Enterprise 定制版)目标人群:世界 500 强、政企、互联网大厂。应用场景:全部门流程自动化(财务对账、运维巡检、法务审合同、市场投放分析),多部门统一 Agent 管控、合规审计。4. 开发者/AI 工程师目标人群:技术团队。应用场景:基于开源框架二次开发,自研私有化多 Agent 系统,嵌入自有产品(SaaS、ERP、内部系统)。四、免费&付费价格明细(开源+云端 SaaS 双版本)(一)开源本地部署版(永久免费)费用:完全免费。GitHub 开源代码 pip install crewai 本地部署,无平台服务费。自费项:自行承担 LLM 接口费(OpenAI/DeepSeek 等)、第三方工具 API(Serper 搜索、Tavily),平台不抽成。功能限制:无可视化面板、无企业管控、无官方技术支持、无 Discovery 自动化挖掘引擎。(二)CrewAI 云端 SaaS(app.crewai.com)所有云端版本LLM 模型费用单独结算,可自选自备 API Key 或平台代付。免费试用版(Free Tier)额度:每月限定少量 Agent 运行次数、有限 LLM 调用额度。功能:基础 Crew Studio 搭建、少量工具集成。缺失:无 Discovery、无 Control Plane 管控。适用:新手体验、小体量测试。Pro 专业版(中小团队订阅)权益:全量可视化编辑器、基础 Discovery、10+ 软件集成、基础运行日志。计费:按 Agent 运行用量 + 订阅月费(官网报价按需询价,主流区间$99~$299/月)。Enterprise 企业定制版(大客户)适用:500 人+企业。权益:完整 Discovery 引擎、Control Plane 管控、全软件集成、专属客户经理、私有化部署可选、SLA 技术保障、定制化 Agent 开发。报价:按企业规模、月度 Agent 调用量定制报价(500 强主流年费数万~数十万美元)。五、分步使用指南方式 1:企业云端平台零代码(新手首选:app.crewai.com)Step1:注册账号 打开 app.crewai.com,邮箱注册,免费开通试用。Step2:Discovery 业务摸排(第一步必做)进入「Discovery New session」。勾选企业在用工具(如 HubSpot、Google Workspace 等)。填写业务痛点(如:销售线索慢/招聘筛简历耗时)。AI 自动扫描生成自动化清单,一键导入推荐自动化模板。Step3:Crew Studio 搭建 AI 团队创建 Agent(AI 员工):填写 Role(角色)、Goal(目标)、Backstory(从业背景)、绑定工具(如谷歌搜索、HubSpot)。创建 Task(任务):写明任务描述、预期输出格式(Markdown/JSON)、绑定对应 Agent。组建 Crew 团队:勾选多个 Agent+ 任务,选择顺序/层级执行模式。Step4:配置 LLM 与环境 在 LLM Connections 填入自有 OpenAI/DeepSeek API 密钥,环境变量统一管理密钥,避免明文泄露。Step5:启动运行&查看结果 点击 Kickoff 运行,Traces 面板查看全流程日志、Token 消耗,结果自动导出文档。Step6:优化迭代 进入 Optimize,基于历史运行数据微调 Agent 参数,持续优化输出质量。方式 2:本地开源 Python 部署(开发者)Step1:安装依赖bashpip install crewai crewai-tools python-dotenv pip install crewai crewai-tools python-dotenv Step2:配置.env 文件 在项目中创建 .env 文件存入 API 密钥。envOPENAI_API_KEY=xxx SERPER_API_KEY=xxx OPENAI_API_KEY=xxx SERPER_API_KEY=xxx Step3:编写代码逻辑 最简示例:1 研究员 +1 撰稿人双 Agent 协作。python# 定义智能体 researcher = Agent(role="行业研究员", goal="搜集 AI 行业热点", backstory="资深产业分析师", tools=[SerperDevTool()]) writer = Agent(role="专栏作者", goal="基于调研写行业文章", backstory="科技专栏撰稿人") # 定义任务 task1 = Task(description="搜集 2026AI 行业 3 大热点", expected_output="要点清单", agent=researcher) task2 = Task(description="基于调研写 1500 字行业稿", expected_output="Markdown 文稿", agent=writer) # 组建团队执行 crew = Crew(agents=[researcher, writer], tasks=[task1, task2], process=Process.SEQUENTIAL) crew.kickoff() # 定义智能体 researcher = Agent(role="行业研究员", goal="搜集 AI 行业热点", backstory="资深产业分析师", tools=[SerperDevTool()]) writer = Agent(role="专栏作者", goal="基于调研写行业文章", backstory="科技专栏撰稿人") # 定义任务 task1 = Task(description="搜集 2026AI 行业 3 大热点", expected_output="要点清单", agent=researcher) task2 = Task(description="基于调研写 1500 字行业稿", expected_output="Markdown 文稿", agent=writer) # 组建团队执行 crew = Crew(agents=[researcher, writer], tasks=[task1, task2], process=Process.SEQUENTIAL) crew.kickoff() Step4:运行程序 执行 python main.py 即可启动。六、高频避坑指南(新手 90% 踩坑汇总)1. Agent 配置类坑(输出空洞、答非所问)问题:角色描述模糊,如只写「分析师」,没限定从业年限、行业,导致输出泛泛。✅解决:Role+Backstory 写细,例如「10 年 SaaS 销售分析师,专注制造业线索挖掘,擅长从工商信息判断客户需求」。问题:Goal 目标太笼统,如「做市场分析」。✅解决:改成具体指令,例如「输出 3 条客户痛点 + 潜在成交机会,每条附带企业营收数据」。问题:Max Iter 未限制。✅解决:固定单任务最大迭代≤3 次,防止 Token 暴增。2. 工具&参数坑(调用失败、报错)问题:工具名称使用中文描述。✅解决:LLM 优先英文匹配,所有 Tool 的 name、description 全英文书写。问题:文件路径使用反斜杠 \。✅解决:系统识别异常,统一用正斜杠 /。问题:超大文本直接传入 Agent。✅解决:超长表格/全文直接喂入会触发上下文超限,只传文件路径字符串,由 Agent 调用工具读取文件。3. 协作逻辑坑(死循环、互卡)问题:审核+撰写双 Agent 无终止条件。✅解决:设置循环上限、设置妥协规则(3 轮未达标自动定稿)。问题:任务分工重叠。✅解决:一个 Agent 只负责单一职能(调研只搜集、撰写只写作)。4. 成本&安全坑(高额账单、隐私泄露)问题:未管控 LLM 密钥,单 Agent 月度调用无上限。✅解决:企业版在 Control Plane 设置单 Agent 月度调用上限、分密钥管控。问题:未开启 PII 脱敏。✅解决:企业版 Runtime 钩子开启自动脱敏,防止 Agent 自动读取客户身份证、手机号等隐私外泄。问题:免费版盲目跑大批量任务。✅解决:试用阶段先小批量测试用量,避免免费额度耗尽后自动扣费。5. 格式输出坑(JSON 幻觉)问题:强制输出 JSON 时,模型额外附带前言文字(“以下是 JSON:”)导致下游解析崩溃。✅解决:开启模型 response_format=json_object,任务示例里附加标准 JSON 样例,禁止多余话术。七、补充:适用&不适用场景✅ 适合场景重复性信息搜集。多角色流水线工作。跨系统数据汇总。销售线索自动化。招聘筛选。内容批量生产。❌ 不适合场景实时硬件控制。超高精度数学运算。实时工业自动化(非信息类业务)。
LangChain
LangChain 全指南一、平台介绍LangChain 是 2022 年创立、基于 MIT 开源协议的大模型应用开发生态框架。官网地址:https://www.langchain.com核心定位:主打模型无关、模块化积木式开发,是 RAG 知识库、AI 智能体行业的通用开发底座。开发语言:支持 Python 和 JavaScript 双语言。生态规模:全球集成 700+ 生态组件。1. 四大核心产品LangChain:高封装的链式框架,适合快速搭建线性流程应用(如 RAG、普通对话机器人)。LangGraph:底层有向图框架,适合构建带循环/分支/断点续跑的复杂智能体(生产级自主 Agent)。LangSmith:云端观测调试平台(唯一付费模块),用于追踪调用链路、评测 Agent 效果。LangServe:一键部署工具,将开发好的 Chain/Agent 转为 HTTP 接口,开源免费。二、核心主要功能1. 统一模型接入(模型 I/O)多模型支持:一套代码可对接国内外 100+ 大模型。包含模型:OpenAI/GPT、Claude、Gemini、文心一言、通义千问、ChatGLM、Ollama 本地开源模型等。优势:切换模型仅需修改一行配置,无厂商锁定。2. Prompt 提示词工程内置模板:提供基础模板、少样本 FewShot、对话 Chat 模板、多级流水线模板。管理功能:统一管理提示词、动态变量填充。优化工具:配套 LangSmith PromptHub 在线调试优化提示词。3. Memory 对话记忆管理短时记忆:使用内存缓存、滑动窗口(仅保留最近 N 轮对话)。长时记忆:对话落库至向量库,实现跨会话检索历史,解决大模型上下文窗口限制。4. Chain 链式编排(LCEL 语法)核心语法:prompt | llm | parser 管道式写法。原生支持:流式输出、异步处理、批处理、失败重试。编排类型:支持顺序链、并行链、路由分支链。应用场景:快速搭建 RAG、文档摘要、数据解析流水线。5. RAG 检索增强生成落地知识库核心:开箱即用的全流程组件。全链路处理:文档加载 (PDF/Word/网页/数据库) → 文本切块 → Embedding 向量化 → 存入向量库 (Chroma/Pinecone/FAISS) → 检索 → 拼接上下文喂给大模型。优势:无需自研文档解析与向量逻辑。6. Agent 自主智能体LangChain Agent:零样本 Agent、ReAct 思考 + 工具调用(联网查资料、调用计算器/API)。LangGraph Agent:有状态 Agent,支持循环、自主规划、人工介入、断点保存(适合自动化办公、数据分析机器人)。7. 生态集成(700+ 插件)覆盖范围:文档加载器、全品类向量数据库、搜索引擎 (谷歌/SerpAPI)、第三方 API、SQL 数据库、代码解析工具。三、适用人群AI 个人开发者/学生:自学大模型落地、快速做知识库问答、小型 AI 工具原型,低成本验证想法。算法/后端工程师:企业落地 RAG 知识库、智能客服、内部 AI 助手,避免重复封装大模型接入代码。产品/创业团队:快速 MVP 验证 AI 产品,低成本搭建 Agent 产品,缩短开发周期。政企数字化团队:私有知识库落地、业务系统嵌入 AI 能力、自动化流程 Agent。AI 科研人员:快速组合模型 + 工具,验证 Agent 算法、RAG 优化方案。注意:不适合纯无代码小白(需要 Python 基础)、只想要现成成品 AI 软件的用户。四、免费与付费详情1. 核心规则开源库:LangChain、LangGraph、LangServe 永久免费(MIT 协议,商用无限制)。云服务:仅 LangSmith 云端服务分级收费。第三方成本:大模型 API、商用向量库由第三方单独计费,框架不抽成。2. 开源代码(永久全免费)包含内容:LangChain Core、LangChain、LangGraph、LangServe 本地部署。权益:无版权费、无功能阉割,代码开源在 GitHub,可二次修改私有化部署。3. LangSmith 云端服务套餐Developer(免费个人版)费用:$0/月额度:1 个账号,每月 5000 条 Trace 调用日志限制:超出收费 0.5 美元/千条,数据存 14 天场景:个人开发、原型测试、学生学习Plus(团队版)费用:39 美元/账号/月额度:单账号每月 10000 条 Trace,最多 10 个账号赠送:1 个 LangGraph 云部署、邮件客服场景:中小团队生产项目、多人协作开发Enterprise(企业定制)费用:报价面议权益:自定义 Trace 额度、私有化部署、SSO 单点、专属技术支持、SLA 保障场景:中大型企业、合规私有化需求、大批量 Agent 上线4. 额外隐性成本大模型 API:调用 OpenAI/通义千问等第三方模型按 token 计费。商用向量库:如 Pinecone 等云向量数据库按需付费。服务器:项目部署上线的云主机成本。五、完整使用步骤(Python 主流)步骤 1:环境安装bash# 安装核心包 pip install langchain langchain-core langchain-community langchain-openai # RAG 额外依赖(文档 + 本地向量库) pip install pypdf faiss-cpu chroma python-dotenv # 安装核心包 pip install langchain langchain-core langchain-community langchain-openai # RAG 额外依赖(文档 + 本地向量库) pip install pypdf faiss-cpu chroma python-dotenv 步骤 2:配置模型密钥推荐方式:新建 .env 文件,禁止硬编码 Key。配置内容:envOPENAI_API_KEY=sk-xxx OPENAI_API_BASE=https://api.openai.com/v1 # 国内代理接口必填 LANGSMITH_API_KEY=ls_xxx # 如需使用 LangSmith LANGSMITH_TRACING=true # 如需开启追踪 OPENAI_API_KEY=sk-xxx OPENAI_API_BASE=https://api.openai.com/v1 # 国内代理接口必填 LANGSMITH_API_KEY=ls_xxx # 如需使用 LangSmith LANGSMITH_TRACING=true # 如需开启追踪 代码加载:pythonfrom dotenv import load_dotenv load_dotenv() from dotenv import load_dotenv load_dotenv() 步骤 3:快速入门经典案例案例 ① 基础对话(LCEL 链式)pythonfrom langchain_openai import ChatOpenAI from langchain.prompts import ChatPromptTemplate # 初始化模型 llm = ChatOpenAI(model="gpt-3.5-turbo") # 定义 Prompt prompt = ChatPromptTemplate.from_template("回答问题:{question}") # 串联链条 chain = prompt | llm # 调用 res = chain.invoke({"question":"LangChain 是什么"}) print(res.content) from langchain_openai import ChatOpenAI from langchain.prompts import ChatPromptTemplate # 初始化模型 llm = ChatOpenAI(model="gpt-3.5-turbo") # 定义 Prompt prompt = ChatPromptTemplate.from_template("回答问题:{question}") # 串联链条 chain = prompt | llm # 调用 res = chain.invoke({"question":"LangChain 是什么"}) print(res.content) 案例 ② 最简 RAG 本地知识库python# 加载 PDF → 切块 → 存 Chroma → 检索问答 from langchain.document_loaders import PyPDFLoader from langchain.vectorstores import Chroma from langchain_openai import OpenAIEmbeddings loader = PyPDFLoader("xxx.pdf") docs = loader.load_and_split() # 创建向量数据库 vectordb = Chroma.from_documents(docs, OpenAIEmbeddings(), persist_directory="./chroma_db") # 创建检索器 retriever = vectordb.as_retriever() # 加载 PDF → 切块 → 存 Chroma → 检索问答 from langchain.document_loaders import PyPDFLoader from langchain.vectorstores import Chroma from langchain_openai import OpenAIEmbeddings loader = PyPDFLoader("xxx.pdf") docs = loader.load_and_split() # 创建向量数据库 vectordb = Chroma.from_documents(docs, OpenAIEmbeddings(), persist_directory="./chroma_db") # 创建检索器 retriever = vectordb.as_retriever() 案例 ③ LangGraph 简易自主 Agent文档参考:参考官网 QuickStart 指南 (https://www.langchain.com/quickstart-agents)实现方式:使用 Graph 节点 + 状态实现循环工具调用。步骤 4:接入 LangSmith 调试开启追踪:运行代码自动在 LangSmith 后台查看全链路调用日志。环境变量:确保 LANGSMITH_TRACING=true。步骤 5:项目部署上线工具:使用 LangServe 一键封装为 API。代码示例:pythonfrom langserve import add_routes # 假设 app 为你的 FastAPI 实例 add_routes(app, runnable=chain) from langserve import add_routes # 假设 app 为你的 FastAPI 实例 add_routes(app, runnable=chain) 配合 FastAPI:对外提供 HTTP 服务。六、高频避坑清单(实战总结)1. 版本大坑(最高发)问题:网上旧教程代码导入报错(路径失效),LangChain 从 0.x 到 1.0 重构了包结构(拆分 langchain-core/community/openai)。解决:固定依赖版本,使用 requirements.txt 锁定,优先看官网最新文档,不照搬 2023 年前的旧代码。2. API 密钥与代理配置问题:国内调用 OpenAI 报错连接失败,OPENAI_API_BASE 地址配置错误。解决:统一在 .env 配置 base_url,不用代码硬写,国内转发接口务必核对域名,排查网络代理。3. RAG 问答效果差误区:认为框架问题导致答案不准。真相:90% 问题出在文档切块不合理、Embedding 模型不匹配中文、检索 TopK 参数、Prompt 未约束模型。解决:优化 chunk_size=300~800、添加重排 Rerank、提示词强制“仅参考提供文档回答”。4. Agent 乱调用工具问题:Agent 频繁错选工具、编造参数、无限循环调用。解决:完善 Tool 描述文案、强制入参 Schema 校验、调低模型 temperature=0(降低随机性)、添加工具调用次数上限。5. 内存与上下文溢出问题:多轮对话超长触发 ContextWindowExceededError 超限。解决:改用滑动窗口 Memory(只保留最近 5 轮)、长对话摘要压缩、超长内容分段检索。6. 向量库异常问题:Chroma 数据库损坏、加载失败。解决:异常时删除 chroma_db 文件夹重新入库,生产环境不用本地 Chroma,改用 PGVector 或云向量库。7. LangSmith 计费踩坑问题:免费额度用完超额扣费,忘记关闭调试追踪。解决:开发环境开启 LANGSMITH_TRACING=true,生产环境关闭追踪避免 Trace 计费;免费版注意 14 天日志过期无法回溯排查问题。七、官方学习入口快速上手:https://www.langchain.com/quickstart-agents(一键跑通 Agent 示例)LangGraph 文档:https://www.langchain.com/langgraph定价页:https://www.langchain.com/pricing-langsmith完整文档:https://python.langchain.com/docs/introduction