首页 / 详情
Site icon

Skyvern

基本信息

Skyvern 网站截图预览

工具详情

Skyvern 全指南

一、平台介绍

1. 核心定位

Skyvern 是 Y Combinator 孵化、开源 AGPL-3.0 协议 的 AI 浏览器智能体自动化平台。它依托 LLM 大模型 + 计算机视觉双引擎 实现网页自动化,对标 Selenium/Playwright/RPA,旨在解决传统自动化依赖 DOM 选择器、网页改版后脚本直接失效的痛点。

  • 核心能力:支持自然人话描述生成浏览器自动化流程,无需编写 XPath/CSS 选择器,不用频繁修改代码。
  • 模拟操作:能够模拟真人操作浏览器,完成登录、填写表单、爬取数据、下载票据等任务。

2. 基础数据与合规

  • 社区影响力:GitHub 星标数 21800+,拥有 3 万 + 政企用户,500+ 付费企业,累计运行 1000 万 + 自动化任务,可用性 SLA 高达 99.9%。
  • 安全合规:具备 SOC2 Type II 认证,HIPAA 医疗合规 资质,提供全链路数据加密服务。

3. 部署模式

提供三种灵活的部署方式,适应不同需求:

  • 云端 SaaS:在线使用,无需维护。
  • Docker 自托管:私有化部署,数据本地留存。
  • 本地 SDK:通过 Python/TypeScript 调用,适合集成开发。

4. 与主流工具对比

对比维度传统工具 (Selenium/Playwright/传统 RPA)Skyvern 优势维护成本绑定 DOM 选择器,页面微调导致脚本报废,需持续运维视觉识别元素,页面改版自动适配,几乎免维护登录能力复杂登录/验证码易崩,定制化强但复用差LLM 自主规划步骤,原生过验证码 +2FA,登录更稳健智能程度纯规则驱动,灵活性低视觉 + 代码 + 大模型三合一,全链路鉴权适配,具备自主规划能力

二、核心功能

1. 底层核心能力(平台内置)

  1. 原生验证码破解:内置 AI 识别引擎,无需第三方打码平台,自动处理图文/滑块验证。
  2. 双因子登录支持:全自动接收并填入 2FA/TOTP 验证码,打通网银、企业后台、厂商供应商系统的全账号登录链路。
  3. 代理 IP 支持:提供精准到国家/城市/邮编级的住宅或机房代理,解决 IP 封禁与地域访问限制。
  4. 可解释 AI 日志:每一步操作留存 AI 决策说明、运行快照及全页面截图,便于快速排查报错。
  5. OCR 文档解析:支持 PDF/图片票据的自动识别与结构化输出。

2. 落地业务功能

  1. 数据结构化提取:任意网页抓取产品价目、财报、供应商数据,直接导出 JSON/CSV,无需网站开放 API。
  2. 应付账款自动化:批量登录几百家供应商后台,自动下载发票 PDF 并进行分类归档,解决财务手动下载痛点。
  3. 批量表单填报:自动化处理注册、资质申报、招商表单的大批量提交(适用于销售线索、企业报备)。
  4. 线索挖掘拓客:抓取目录网站联系人信息,自动发表单触达。
  5. UI 自动化测试:适应前端改版,替代不稳定的传统自动化测试用例。
  6. 文档处理流水线:实现门户下载→解析→分类→推送企业内部系统的全链路自动化。

3. 搭建自动化工作流方式(4 种模式)

  • Copilot 对话(小白首选):使用自然语言描述任务,AI 一键生成流程。
  • 示例指令:“登录 vendor.acme.com,输入账号密码,下载当月所有发票。”
  • 上传 SOP 文档:上传 PDF/Word 业务操作手册,平台自动转为可运行脚本。
  • 浏览器录制:手动操作一遍网页,平台录制并生成永久复用流程。
  • 可视化拖拽:在画布中拖拉组件,精细化编辑流程。
  • SDK 开发(程序员):提供 Python/TypeScript 接口,支持 Docker 私有化部署。

4. 生态集成

  • 原生对接 Zapier、n8n、Workato、Make、Clay 等低代码平台。
  • 支持 Webhook 与事件流触发任务。

三、适用人群与场景

1. 适用人群

  1. 企业财务/AP 应付团队:大批量收取供应商发票、对账、票据归集(最主流用户)。
  2. 市场/销售团队:拓客爬虫、批量表单注册、线索搜集。
  3. 测试工程师:WEB 自动化测试、回归测试。
  4. 数据分析师/爬虫从业者:全网站结构化数据采集、竞品监控。
  5. HR 行政:批量招聘投递、社保系统填报。
  6. 开发工程师:私有化自研系统集成、替代 Selenium 爬虫。
  7. 中小创业者:低成本自动化重复网页工作,替代人工。

2. 不适用场景

  • 超简单固定页面:单页面纯文本抓取,传统爬虫成本更低。
  • 高频极速请求:毫秒级接口请求,AI 思考存在毫秒级延迟,不适合极高频交易场景。

四、定价方案(3 种使用渠道)

1. 云端 SaaS(官网在线使用)

  • 免费版(Free Tier):新用户赠送免费任务步数额度,额度用完停止运行。无时间限制,额度按月重置。
  • 按量付费(Cloud 按需):按自动化步骤计费(AI 每一步点击/输入算 1 步)。适合企业大批量任务,阶梯降价。
  • 企业订阅版:固定包月包年。包含专属客服、专属代理 IP、私有化部署对接、SLA 故障赔付、SOC2 企业安全服务。

2. 开源自托管(Docker 部署)

  • 费用:代码全开源(GitHub: Skyvern-AI/skyvern),永久免费无任务上限。
  • 成本:仅需自备服务器硬件成本(云主机/VPS)。
  • 优势:数据全部本地留存不外流,适合敏感财务、涉密业务。
  • 硬件建议:最低 2 核 8G 内存 VPS(约 60~110 元/月)。

3. SDK 本地开发

  • 策略:免费调用测试,上线生产按需购买云端 API 额度或自建私有化服务。
选择建议:个人试用选云端免费额度;敏感数据/大批量任务选 Docker 自托管;企业省心运维选云端企业订阅。

五、详细使用步骤指南

1. 零代码网页端(新手首选)

  1. 访问官网 https://www.skyvern.com/,注册账号并领取免费额度。
  2. 进入 Copilot Chat 对话框,使用自然语言(中英文均可,英文效果最优)写任务指令。
  • 示例:“打开 https://xxx.com,输入账号 xxx、密码 xxx 登录,进入账单页下载所有 10 月发票,导出 CSV 数据。”
  1. AI 自动生成工作流,点击【试运行】,查看云端浏览器执行日志及截图。
  2. 流程无误后保存任务,设置每日/每周定时自动运行。

2. 录制浏览器生成流程

  1. 平台打开可视化录制窗口,启动内置浏览器。
  2. 手动完整走一遍全流程(登录→找数据→下载/填表单)。
  3. 停止录制,AI 自动优化流程,后续可一键重复运行。

3. Python 代码接入(开发者)

  1. 官网后台获取 API_KEY。
  2. 安装 SDK:pip install skyvern-sdk
  3. 复制以下示例代码并修改网址和任务描述:

python

from skyvern import Skyvern
skyvern = Skyvern(api_key="你的 API_KEY")
page = await skyvern.use_cloud_browser().get_working_page()
await page.goto("https://www.saucedemo.com/")
# 自动凭据登录
await page.agent.login(credential_type=CredentialType.skyvern,credential_id="cred_123")
# 自然语言下达任务
await page.agent.run_task("使用 John Snow、邮编 12345 完成订单结算")
await page.screenshot(path="screenshot4.png", full_page=True)
from skyvern import Skyvern
skyvern = Skyvern(api_key="你的 API_KEY")
page = await skyvern.use_cloud_browser().get_working_page()
await page.goto("https://www.saucedemo.com/")
# 自动凭据登录
await page.agent.login(credential_type=CredentialType.skyvern,credential_id="cred_123")
# 自然语言下达任务
await page.agent.run_task("使用 John Snow、邮编 12345 完成订单结算")
await page.screenshot(path="screenshot4.png", full_page=True)
  1. 私有化部署:拉取 Docker 镜像,本地启动服务对接 SDK。

4. SOP 文档导入

  • 上传 Excel/Word 操作手册,平台自动解析文档步骤,直接生成自动化流程,无需手动描述。

六、避坑指南

1. 成本避坑

  1. 云端步数控制:开启平台缓存机制,重复页面不重复 AI 推理,可节省 80% 步数费用。
  2. 余额预警:云端开启余额预警,避免任务无限制跑超支。
  3. 长期策略:频繁大批量任务优先自托管,长期比云端付费省钱。

2. 数据安全避坑(最重要)

  1. 敏感数据隔离:账号密码、财务密钥、供应商敏感账单必须使用 Docker 自托管私有化部署,数据不出自己服务器。
  2. 代理安全:企业隐私数据禁用公共代理 IP,建议采购专属静态住宅代理。

3. 任务稳定性避坑

  1. 流程拆分:超过 10 步的长流程拆分成多个子任务,减少 AI 幻觉和步骤跑偏。
  2. 反爬应对:网站反爬严格时,配置对应地区代理,避免短时间高频访问被封号。
  3. 指令语言:非英文小众网站优先使用英文指令描述任务,中文复杂指令 AI 识别准确率稍低。

4. 选型避坑

  1. 页面类型选择:固定极简页面别用 Skyvern,纯静态网页抓取用 Playwright 成本更低、速度更快。Skyvern 优势在于动态登录 + 验证码 + 多表单场景。
  2. 服务器配置:自托管服务器低于 2 核 4G 运行会卡顿,OCR 和视觉识别可能超时,推荐 2 核 8G 起步。

5. 合规避坑

  1. 版权与隐私:禁止用于爬虫抓取受版权保护、隐私受法律保护的内容(如用户隐私数据、付费版权数据)。
  2. 遵守协议:遵循目标网站的 robots 协议,避免批量注册或恶意薅羊毛导致 IP 封禁。

七、补充小贴士

  1. 指令语言优化:优先使用英文写任务描述,模型原生训练英文,自动化成功率比中文高 15%+。
  2. 失败排查:调试失败时打开 可解释 AI 日志,查看 AI 每一步决策失败原因,优化指令。
  3. 版本更新:定期更新开源代码,官方持续迭代视觉模型,新版本能提升验证码、复杂页面识别率。


评论

暂无评论