分类导航

发现更多优质 AI 工具

全部 编程代码 创作写作 视频音频 图像视觉 学习辅导 办公效率 设计创意 大模型 提示词 Skills 自动化 知识库 开源 副业
DeerFlow图标

DeerFlow

DeerFlow 使用指南1. 平台介绍定位:由字节跳动(ByteDance)开源的 超级 AI Agent 运行框架。该框架也被定义为 "SuperAgent Harness",旨在解决复杂任务下的自动化执行难题。版本演进:已从最初的“深度研究(Deep Research)”工具升级为最新推出的 DeerFlow 2.0 全栈智能体执行环境。核心思想:为 AI Agent 提供一台独立的 “虚拟计算机”(基于 Docker 沙盒),使其能够打破文本生成的局限,支持以下能力:自主搜索与代码编写。程序运行与环境管理。生成网页或多媒体内容。文件系统管理与长流程任务执行(持续时间可从几分钟到数小时)。2. 主要功能特性渐进式技能系统(Skills System):支持按需动态加载特定领域的任务技能,例如深度研究、前端设计或代码部署等。这一机制避免了将海量提示词一次性注入导致的上下文膨胀问题(Context Rot),保持 Agent 思维清晰度。AIO 全功能沙盒(Docker Sandbox):集成了浏览器接口、Shell 终端环境、文件系统访问、MCP 协议以及 VSCode Server。Agent可以在该安全隔离环境中自主安装 Python 包、运行复杂代码逻辑并部署 Web 界面应用,无需依赖外部基础设施。多智能体协作与长任务拆解(Sub-Agents & Planning):主 Agent 负责将超复杂的长任务自动拆解为若干子任务,然后分发给不同专业领域的子 Agent 进行并行或串行处理,极大提升了执行效率。长短期记忆与上下文压缩:具备跨会话持久化能力,能够记录用户偏好、项目结构及历史上下文;系统会自动识别并压缩冗余的对话内容,优化 Token 消耗。多模型与工具扩展支持:原生兼容 Doubao(豆包)、DeepSeek、OpenAI、Gemini 等主流大模型接口;同时开放了 MCP (Model Context Protocol) 协议标准及自定义 Tools 的接入能力。3. 适用人群分析开发者 / AI 工程师:适用于需要搭建自动化代码生成流水线、执行数据清洗流程、实现服务自动部署以及构建智能体工作流的场景人员。科研人员 / 行业分析师:适合需要利用全网多源信息进行自动化检索、整理学术文献,并自动生成包含可视化图表的研究报告的人员。数据分析师 / 产品经理:适用于需自主完成探索性数据分析(EDA)、即时生成分析图表、制作 Demo 网页或现场演示 Slide 展示场景的专业人士。4. 免费付费情况说明开源政策:DeerFlow 项目采用完全免费的 MIT 协议。软件本身及包含的所有功能源码均对用户开放,官方无售卖平台亦无专属付费定价页面。自备成本(运行费用):虽然软件免费,但以下资源需用户自行准备或按量计费:API Key 消耗:使用 OpenAI、DeepSeek 或字节豆包等第三方大模型 API,以及 Tavily、Brave Search 等搜索引擎时产生的 Token 与调用费。算力成本:本地运行无需额外费用;若部署在云服务器(如 K8s 集群),需承担云主机的硬件租赁费用。官方资源链接:用户可前往以下地址获取最新代码库、安装说明及社区支持:官方网站:https://deerflow.tech/GitHub 仓库:https://github.com/bytedance/deer-flow5. 如何使用(快速上手指南)方式一:向 AI 编程助手发送指令若已配置好 Cursor、Claude Code 等 AI 编程辅助工具,可直接输入以下一键指令进行环境搭建与引导:bashHelp me clone DeerFlow if needed, then bootstrap it for local development by following https://raw.githubusercontent.com/bytedance/deer-flow/main/Install.md Help me clone DeerFlow if needed, then bootstrap it for local development by following https://raw.githubusercontent.com/bytedance/deer-flow/main/Install.md 方式二:命令行手动部署(推荐 Docker)前提准备:请确保系统已安装 Python (版本 >= 3.11)、Node.js (版本 >= 22) 、Docker 及 Git 环境。克隆项目并配置密钥:执行以下命令拉取代码,并将示例配置文件复制并重命名为 .env,填入您的 API Key:bashgit clone https://github.com/bytedance/deer-flow.git cd deer-flow cp .env.example .env # 填入 LLM API Key 和搜索 API Key git clone https://github.com/bytedance/deer-flow.git cd deer-flow cp .env.example .env # 填入 LLM API Key 和搜索 API Key 运行交互式配置向导:执行以下命令进入设置界面:bashmake setup make setup 向导将引导您选择 LLM 供应商、搜索引擎类型(如 Tavily/DuckDuckGo/Arxiv)及沙盒安全偏好。启动服务:配置完成后,运行容器化部署命令以拉起后端进程与前端界面:bashdocker compose up -d docker compose up -d 访问管理端:等待初始化完成后,在浏览器中打开 http://localhost:3000,即可通过 Web UI 下发复杂的 Agent 任务指令。6. 注意事项与风险提示沙盒安全隔离(高危):DeerFlow 在沙盒内部拥有代码及终端的完全执行权限。必须运行在 Docker 隔离环境中。切勿在宿主机裸机上直接开放未经限制的 Bash 写入权限,否则可能导致系统被恶意控制或文件泄露。API Token 消耗监控:复杂的研究类任务涉及多轮 Agent 思考、代码调试及高频信息检索,Token 消耗速度极快。建议为 API 账户设置配额上限,避免账单异常突增。硬件资源要求:部署节点内存需保持在 8GB 以上(考虑 Docker 沙盒负载);若面向生产环境或多人并发使用,建议使用 16GB+ 内存。版本迁移说明:DeerFlow 2.0 为全架构重构版本。注意旧版项目基于 1.x 架构,与 2.0 代码不兼容。建议在新分支独立部署 2.0,避免混合运行导致的不稳定性。

Drafted图标

Drafted

Drafted.ai 平台指南1. 平台简介Drafted.ai(官网:www.drafted.ai)是由 Y Combinator 孵化的 AI 建筑与平面图设计平台。它旨在通过 AI 技术加速住宅设计的前期概念探索阶段(Schematic Design)。传统的房屋设计耗时极长且费用高昂,该平台允许用户通过简单的参数配置,在几秒钟内自动生成结构化的2D 平面图、3D 外观渲染图以及专业级 CAD/BIM 导出文件。2. 适用人群购房者 / 个人业主 (Homebuyers):在寻找建筑师或施工方前,将抽象的想法可视化,明确空间排布与预算需求。建筑师 (Architects):在方案前期快速探索多种户型排布与空间关系,节省打底时间,便于与客户高效沟通。建造商 / 施工方 (Builders):在预施工与估算成本阶段,快速将客户诉求转化为清晰的平面备选方案。地产开发商 (Developers):快速评估不同地块与户型组合的适配度及规划概念。绘图员与室内设计师 (Drafters & Interior Designers):生成概念模型后直接导出 DXF/IFC 格式,迅速导入 AutoCAD、Revit 等专业软件深化。房产中介 (Real Estate Agents):向买家展示空地建房或旧房改造的户型布局可能性。3. 主要功能结构化 AI 平面图生成:非单纯依靠文字 Prompt 随意生成,而是基于具体的房间清单(卧室/卫浴数)、占地面积、房屋轮廓等空间约束,生成逻辑合理的平面布局图。3D 外观渲染与风格样式:生成平面图的同时自动输出高质量 3D 外观效果图,并提供多种设计风格(如 Cozy、Bright、Industrial、Natural 等)。专业 CAD / BIM 导出:生成的方案支持一键导出为 PDF 概念图、CAD 矢量图(DXF 格式)以及 BIM 模型(IFC 格式),无缝衔接主流建筑软件。交互式微调与图纸扫描:支持在画布上调整房间相对位置,并正在陆续上线识别现存 PDF/草图并转为可编辑平面图的功能。4. 免费与付费情况当前资费状态:截至目前,Drafted 完全免费(100% Free)。用户可以免费浏览库内设计、无限次生成自定义平面图,并免费下载 PDF、CAD (DXF) 和 BIM (IFC) 导出文件。5. 如何使用(操作步骤)访问平台:打开 Drafted 官网 并登录或注册账号。选择身份与单位:进入后选择您的角色(如 Homebuyer、Architect 等)及单位偏好(默认 Imperial 英制)。输入设计约束 (Create):进入创建界面,设置目标需求,包括房间清单(卧室、浴室数量及功能房)、地块尺寸与房屋外形轮廓以及视觉与建筑风格选项。生成与预览:系统在数秒内输出 2D 平面图及 3D 外观 Render。交互调整与迭代:根据需要微调空间流线或更换风格,直到布局满足预期。导出文件:点击导出,选择需要的格式(PDF / DXF / IFC),用于汇报交流或导入 CAD/BIM 软件进一步建模。6. 注意事项不可直接用于施工与报建:Drafted主要服务于前期概念设计与方案沟通。实际建房仍需由注册建筑师、结构工程师等专业人员绘制符合当地建规的施工图并提交报批。楼层限制(目前主打单层):当前版本重点聚焦于单层(Single-level)住宅设计,多层建筑与地下室设计功能目前处于研发或陆续推出阶段。生成逻辑为参数化控制:输入时应尽量准确地填写房间与地块参数,参数越贴近实际,AI 生成的布局流线越合理。

Img2threejs图标

Img2threejs

img2threejs 使用指南这是一个将单张参考图片重构为纯代码化、程序化且可直接动画交互的 Three.js 3D 模型的开源工具。它属于非传统网格导出或摄影测量,而是采用 “以代码重建(Reconstruction-by-Code)” 的创新方式。一、平台介绍定位清晰:项目不是传统网格导出(Mesh Extraction)或摄影测量,而是 “以代码重建(Reconstruction-by-Code)” 的图像转 3D 工具。核心机制独特:通过 Python 脚本与 AI 视觉模型结合,解析图片后生成干净的 TypeScript / JSON 规范代码,利用 Three.js 原生几何体与材质程序化拼接出 3D 模型。二、主要功能纯代码生成(Zero External Mesh):生成的结果为可直接在浏览器运行的 TypeScript 代码,无须下载大型 .gltf / .obj 静态模型文件。AI 视觉自我纠错与质量把关(Quality-Gated Loop):在生成过程中自动生成对比图,由 AI 判定渲染结果与原图的匹配度,自动迭代修复材质、光照与几何结构。带层级结构的动态模型:输出的模型包含完整的层级树、碰撞体(Colliders)、挂载点(Sockets)与旋转轴(Pivots),原生支持动画与拆解功能。Token 节省机制:逻辑校验与状态封装由本地 Python 脚本处理,消耗 AI Token 仅用于视觉比对与代码编写部分。三、适用人群Web 前端 / Three.js 开发者:适合快速构建轻量化、可代码操控的 3D 网页组件。独立游戏开发者:可用于生成硬表面道具,如武器、机械、小桌宠、场景小元素等资产。AI Agent 技能使用者:可在 Claude Code、Codex CLI 或 OpenCode 等终端工具中直接调用的专业开发人员。四、免费 / 付费情况完全免费且开源:项目采用开源协议,代码托管于 GitHub 仓库 github.com/hoainho/img2threejs。不存在官方订阅费:作为开源工具,不存在付费订阅或官方定价页面。成本说明:使用时消耗的仅为您自己调用的 AI 模型 LLM API / Token 成本。五、如何使用安装 Skill:将仓库克隆至 AI 助手(如 Claude Code)的技能目录,运行如下命令进行部署:bashgit clone https://github.com/hoainho/img2threejs.git ~/.claude/skills/img2threejs git clone https://github.com/hoainho/img2threejs.git ~/.claude/skills/img2threejs 环境要求:本地需具备 Python 3.10+(无需额外安装第三方库)。运行生成命令:在终端或 AI 助手对话框中提供图片路径并输入指令,例如重建特定物体为模型并保持比例与颜色。自动构建流程:Skill 会自动完成“图像分析 → 编写 Spec 规范 → 分步代码生成 → 比对校准”的全过程,最终输出 TypeScript 源码。六、注意事项适用主体类型限制:目前对 “硬表面物体(Hard-surface props)” (如枪械、刀具、耳机、低多边形建筑等)效果最好;复杂人体或生物模型的重构功能仍在陆续完善中。原图质量要求:请提供轮廓清晰、主体明确的单张参考图片,背景越干净重构精度越高。代码体积与性能考量:虽然不依赖外部 3D 资产,但非常复杂的模型会生成较长的 TS 代码,建议在项目中进行按需打包处理。

VibeVoice图标

VibeVoice

📌 VibeVoice:微软开源语音大模型指南一、平台介绍VibeVoice 是由 微软(Microsoft Research) 推出的前沿文本转语音(TTS)研究框架。该模型突破了传统 TTS 在合成时长与多角色对话上的限制,专门用于生成 高质量、高情感表现力、长达数十分钟的多人对话音频。其典型应用场景包括播客录制、对话剧制作以及有声书出版等长内容创作任务。Hugging Face : https://huggingface.co/collections/microsoft/vibevoice⚡️ 主要功能特性超长文本与多说话人合成:模型支持单次生成长达 90 分钟 的连续音频,最多可同时包含 4 位不同说话人 的自然对话交替切换。极强的情感与自然交互:具备上下文感知情感能力(Context-Aware Expression),能自然呈现叹气、笑声及情绪起伏,甚至支持自发吟唱功能。超低帧率连续 Tokenizer:采用 7.5 Hz 超低帧率的声学/语义连续分词器,大幅降低长音频推理的计算开销同时保留高保真音质。Next-Token Diffusion 架构:结合 LLM 的大语言建模能力(负责理解上下文对话流)与扩散模型扩散头(负责渲染细腻声学细节),实现生成式语音合成。👥 适用人群范围音频与播客创作者:可快速将多人对话剧本或长文章转化为媲美真人出演的长篇播客、广播剧内容,极大提高制作效率。语音与 AI 领域研究者:适合探索基于 LLM(大语言模型)+ Diffusion(扩散模型)架构的长文本语音合成技术与多说话人建模的研究人员使用。开发者与应用团队:面向开发 NPC 交互系统、多角色 AI 助手或互动剧本生成高质量对话音轨的技术团队,提供底层框架支持。💰 免费/付费情况说明完全开源项目:VibeVoice 是微软的学术与研究级开源项目(Open-Source Research Framework),目前处于全免使用状态,无需支付任何费用即可获取与部署。无商业化方案:该项目官方无专门的定价页面或订阅计划,因此不存在任何形式的付费购买路径或服务费用。🛠️ 如何使用 / 操作指南资源准备阶段:访问其 GitHub 仓库及 Hugging Face 平台获取最新的源码文件与预训练模型权重(请注意查看代码库状态说明)。构建结构化文本:在 Prompt/输入文件中准备好标注好角色标识(如 Speaker 1, Speaker 2)的对话脚本,并添加必要的语气描述信息。运行推理流程:第一步:模型通过 LLM 模块理解上下文语意与角色轮替逻辑;第二步:利用扩散模型头(Diffusion Head)逐步渲染生成高保真音频流;第三步:导出最终的完整长音频文件供后续使用。⚠️ 注意事项及风险提示项目状态暂停:2025年9月,官方公示由于发现部分超出预期用途的滥用行为,基于责任 AI(Responsible AI)原则,微软已暂时关停/下架了该开源代码库,直至完善相关安全合规措施。Deepfake 禁令与风险:鉴于其极其逼真的声音克隆与多角色合成能力,用户严禁将该技术用于未经授权的声音冒用、欺诈或 Deepfake 等违法行为,请务必遵守法律法规。硬件算力要求:由于架构融合了 LLM 与 Diffusion 模型,本地部署和推理对 GPU 显存容量及计算算力有较高要求,需评估环境条件后再行启动。

DeepTutor图标

DeepTutor

DeepTutor:Agent 原生个性化 AI 学习与家教平台📖 一、平台介绍核心架构: 与传统单轮对话的 AI 聊天框不同,DeepTutor 采用 双环多智能体(Dual-Loop Multi-Agent)架构与 多层记忆机制。它不仅能将用户上传的教材、论文和课件构建为专属知识库,还能通过多个协同 Agent 进行深度推理。主要能力:深度推理:分步解题、自动测验与研究报告生成。知识管理:基于个人文献或教材进行精准内容检索(RAG)。视觉化展示:数学公式动画推导与动态图表渲染,降低理解门槛。✨ 二、核心功能详解深度解题 (Deep Solve) 🔢 采用“分析环”(检索 + 笔记整理)与“解决环”(规划 + 执行 + 校验)的双重 Multi-Agent 机制。擅长复杂数学题、物理题及编程逻辑推理,给出带精确引用的步骤级解答,非简单直接回答。知识库与 RAG 问答 (Knowledge Base) 📂 支持批量上传多种格式的本地资料文件(如 PDF, DOCX, PPTX, Excel)。基于个人文献或教材进行精准内容匹配,确保答案来源可查,减少幻觉产生。自适应出题与测验 (Deep Question) 📝 根据上传的资料自动生成知识点测试题。AI 会根据答题情况实时调整题目难易度,智能避免重复出相同的题目,从而最大化学习效果。深度研究报告 (Deep Research) 🧪 输入课题后,系统自动拆解为多个子任务,跨网络、学术数据库及本地文档同时搜索信息,直接输出结构化的专业研究报告初稿。动态可视化 (Math Animator & Visuals) 🎬 集成 Manim 动画引擎及 Chart.js/SVG 渲染技术。将抽象的数学公式、物理概念与算法推导转化为流畅的动态视频或交互式图表。多端伴侣与技能扩展 (Partners & Skills) 🤖 支持创建具备独立人设(Persona)与长期记忆的 TutorBot,可无缝接入 Discord、Telegram、Slack 等外部平台;内置 Excel、Word、PPT 读写处理及 MCP 技能,实现文件直接编辑与管理。👥 三、适用人群与应用场景学生群体适用阶段:高中 / 大学 / 考研 / 竞赛。主要应用:上传教材和课件,进行知识点梳理、疑难题目深度拆解与自我测验;适合准备各类考试或学科竞赛的学习者。科研人员 & 学者核心需求:高效处理文献资源。主要应用:快速研读海量论文、自动整理复杂的文献笔记摘要、利用系统生成课题相关的深度研究报告以节省时间成本。开发者 & 终身学习者应用场景:自主构建私有技术知识库,避免知识断层。核心工具:利用 Agent 进行编程指导(Code Tutor)与长期的个人技能树管理;适合需要定制化学习路径的技术人员。💰 四、免费 / 付费情况说明软件授权模式 DeepTutor 本身遵循 Apache-2.0 / MIT 开源协议,属于完全免费的开源项目。用户可自由下载源码或镜像进行部署与二次开发。GitHub 源码仓库地址:https://github.com/HKUDS/DeepTutor运行成本构成 AI 对话、解题及报告生成需要调用大语言模型(LLM)能力,实际费用取决于您的部署模式:云端 API 消耗费(有门槛但便捷):用户需填入自备的 OpenAI、Claude、DeepSeek 等 API Key。产生的费用由对应服务商收取。建议优先选择性价比高的模型 API 以控制成本。零成本本地部署方案:搭配本地大模型运行,例如通过 Ollama 启动 Qwen / Llama 版本。此方式可实现 100% 免费且完全离线/隐私安全。🛠️ 五、快速开始:部署与启动指南⚙️ 前置环境准备 请确保您的系统已安装 Python 3.11+ 及 Node.js 20+ (前端依赖)。若需本地运行,建议使用 Docker 或直接克隆源码。以下提供三种常用方式:🔹 方案 A:命令一行安装(最简体验)适合只想快速启动并测试基本功能的用户。执行完此流程后,直接访问浏览器即可使用服务界面。bash# 1. 从 PyPI 下载安装包 pip install -U deeptutor # 2. 初始化配置 (按提示设置端口、API Key/LLM 提供商) deeptutor init # 3. 启动服务 (会自动拉起前端与后端进程) deeptutor start # 1. 从 PyPI 下载安装包 pip install -U deeptutor # 2. 初始化配置 (按提示设置端口、API Key/LLM 提供商) deeptutor init # 3. 启动服务 (会自动拉起前端与后端进程) deeptutor start ✅ 访问地址:http://127.0.0.1:3782。(注意:首次启动需在设置中配置大模型,否则对话无法响应)🔹 方案 B:Docker 一键运行(适合容器化环境)无需在宿主机安装 Python 环境,直接拉取官方镜像即可无缝部署数据目录到本地硬盘。bashdocker run --rm --name deeptutor \ -p 127.0.0.1:3782:3782 \ -v ~/deeptutor-data:/app/data \ ghcr.io/hkuds/deeptutor:latest docker run --rm --name deeptutor \ -p 127.0.0.1:3782:3782 \ -v ~/deeptutor-data:/app/data \ ghcr.io/hkuds/deeptutor:latest ⚡ 操作提示:浏览器打开 http://127.0.0.1:3782,进入设置 -> Models (Settings → Models) 填入 API Key。💾 数据持久化:挂载的 -v ~/deeptutor-data:/app/data 确保您的本地教材、笔记在服务重启后不丢失。🔹 方案 C:源码克隆部署(适合开发者)需要深度定制模型、修改前端代码或进行二次开发时使用此方式,以便管理依赖库和环境变量。bashgit clone https://github.com/HKUDS/DeepTutor.git cd DeepTutor # 创建虚拟环境并激活 (建议) python3 -m venv .venv && source .venv/bin/activate pip install -e . # (可选) 前端依赖安装,需联网下载 npm packages (cd web && npm ci --legacy-peer-deps) deeptutor init deeptutor start git clone https://github.com/HKUDS/DeepTutor.git cd DeepTutor # 创建虚拟环境并激活 (建议) python3 -m venv .venv && source .venv/bin/activate pip install -e . # (可选) 前端依赖安装,需联网下载 npm packages (cd web && npm ci --legacy-peer-deps) deeptutor init deeptutor start ⚠️ 六、注意事项与最佳实践模型配置必填:首次启动后务必在 Web 端 Settings (设置 → Models) 中配置大模型(推荐 DeepSeek, OpenAI, Ollama)。若无连接,推理功能将无法正常工作。Token 消耗预期管理:Deep Solve 和 Deep Research 会触发多轮交互与并发检索,单次问答消耗的 Token 量远高于普通聊天。**建议优先配置高性价比的 API Key(如 DeepSeek)**以控制长期成本。动画依赖环境检查:如需使用 Manim 数学公式动态视频功能,本地环境必须安装 ffmpeg (Linux/Mac) 或相应系统组件 (Sudo apt-get install ffmpeg) 及 LaTeX 基础库;若仅需普通图表渲染则无需此配置。数据隐私与存储建议:若您选择云端 API 模式,请确保您了解相关服务商的数据策略;本地部署模式下,所有数据处理均在您的设备内完成,更适合处理敏感的学术资料或个人私有教材,同时利用 Docker 方案可更好地保护数据安全(挂载目录)。

Unlimited-OCR图标

Unlimited-OCR

Unlimited-OCR 使用指南Unlimited-OCR 是百度(Baidu)开源的一款针对长文本/多页文档解析的端到端 OCR 大模型。该模型旨在推动“单次长序列文档解析”的技术发展,能够高效处理复杂的 PDF、报表及论文等结构化文件。一、平台与开源信息许可证协议采用 MIT 开源协议。允许免费商业使用及二次开发。获取地址GitHub:https://github.com/baidu/Unlimited-OCRHugging Face仓库名:baidu/Unlimited-OCR(可在 HuggingFace Pages 查看)演示空间ModelScope / HuggingFace Spaces 提供部署 Demo。二、主要功能特性单图高精识别能力支持对高分辨率复杂图像进行结构化识别。长上下文连续解析最高支持 32,768 tokens。可直接输入多张图片或自动将 PDF 转图后,一次性完成整份文档的解析输出。针对重复生成优化内置专门的 DeepseekOCRNoRepeatNGramLogitProcessor 逻辑处理。有效解决传统视觉语言模型在长文档识别中容易出现的内容循环、文本重复输出的问题。多推理引擎支持提供多种接入方式(Hugging Face Transformers, vLLM, SGLang)。包含 Docker 镜像与多线程并发处理脚本 infer.py。三、适用人群与场景AI 开发者 / 算法工程师需要处理复杂 PDF、电子报表或论文的团队,希望实现文档电子化与 Markdown 结构化抽取的技术人员。RAG / 知识库搭建者RAG(检索增强生成)系统的核心前置需求是长文本高效 Parsing,此模型能显著提升准确性。企业与科研机构寻找高精度、可私有化部署且无需支付高额授权费用的开源 OCR 解决方案的用户。四、免费与付费情况说明本地开源方案(推荐)MIT 协议,模型权重和代码完全免费。自建 GPU 节点部署无任何额外费用。云端托管服务现已上线百度智能云(千帆大模型平台)。如不想自行搭建环境,可使用其提供的 API 或托管算力服务。五、核心使用流程1. 基础 Python 依赖安装推荐环境:Python 3.12 + CUDA (建议版本 12.x/13.x)关键库列表:需包含 torch, transformers, Pillow 等常用深度学习及图像处理库。2. Python 代码推理示例(Hugging Face Transformers)此脚本使用 gundam 模式对单图进行切片增强解析,请确保替换为本地图片路径:pythonimport torch from transformers import AutoModel, AutoTokenizer model_name = 'baidu/Unlimited-OCR' # 1.加载 Tokenizer 和 Model (建议开启 safetensors) tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True) model = AutoModel.from_pretrained( model_name, trust_remote_code=True, use_safetensors=True, torch_dtype=torch.bfloat16 ).eval().cuda() # 2.执行单图解析 (使用 gundam 切片模式提升复杂排版识别率) model.infer( tokenizer=tokenizer, prompt='<image>document parsing.', # Prompt image_file='your_image.jpg', # 输入图片路径 output_path='./output', # 结果输出目录 base_size=1024, # Base Size (大图模式) image_size=640, # Image Resize (切片大小) crop_mode=True, # True=gundam模式,False=base模式 max_length=32768, # 最大输出 Token 数 save_results=True # 保存结果文件 ) import torch from transformers import AutoModel, AutoTokenizer model_name = 'baidu/Unlimited-OCR' # 1.加载 Tokenizer 和 Model (建议开启 safetensors) tokenizer = AutoTokenizer.from_pretrained(model_name, trust_remote_code=True) model = AutoModel.from_pretrained( model_name, trust_remote_code=True, use_safetensors=True, torch_dtype=torch.bfloat16 ).eval().cuda() # 2.执行单图解析 (使用 gundam 切片模式提升复杂排版识别率) model.infer( tokenizer=tokenizer, prompt='<image>document parsing.', # Prompt image_file='your_image.jpg', # 输入图片路径 output_path='./output', # 结果输出目录 base_size=1024, # Base Size (大图模式) image_size=640, # Image Resize (切片大小) crop_mode=True, # True=gundam模式,False=base模式 max_length=32768, # 最大输出 Token 数 save_results=True # 保存结果文件 ) 3. PDF 批量解析与命令行工具借助官方内置的 infer.py 脚本配合 SGLang 服务,可直接开启多线程并发处理:命令说明:解析整个 PDF 文件并指定输出目录。参数设置建议:PDF 连续解析通常建议使用 base 模式(对应代码中的 crop_mode=False)。运行示例:bash# python infer.py --pdf ./document.pdf \ # (请确认实际脚本文件名) --output_dir ./outputs \ # PDF 文件路径与结果输出目录映射 --concurrency 8 # GPU并发处理设置 --image_mode base # mode: gundam(单图/复杂), base (多页/PDF) # python infer.py --pdf ./document.pdf \ # (请确认实际脚本文件名) --output_dir ./outputs \ # PDF 文件路径与结果输出目录映射 --concurrency 8 # GPU并发处理设置 --image_mode base # mode: gundam(单图/复杂), base (多页/PDF) 六、注意事项与配置建议模式选择指南gundam 模式:适用于单图或排版复杂的图片(对应参数 image_size=640, crop_mode=True)。base 模式:适用于多图批量解析或 PDF 连续解析(通常不启用切片裁剪,图像尺寸较大如 1024)。硬件资源要求显存推荐:模型上下文长度高达 32k,建议在 NVIDIA A100, H100, RTX 4090 等算力充足的设备上运行。精度设置:强烈建议使用 torch.bfloat16 混合精度推理以节省显存并保证速度。防重复生成配置 (Repetition Penalty)长文本生成的循环问题需要通过参数抑制,避免模型“复读”。多页文档建议:设置较大的 ngram_window=1024(如适用)。普通单图/短文:可设为较小的窗口值以平衡生成流畅度与重复抑制。

SkillPay图标

SkillPay

SkillPay.me 使用指南⚠️ 特别声明:本平台为 OpenClaw / QClaw 生态系统组件,与腾讯 SkillHub 的 SkillPay 完全独立无关。请开发者及用户注意区分。🌐 官网地址:skillpay.me🔗 API 接口:https://skillpay.gpupulse.dev/api/v1📂 一、平台核心定位SkillPay.me 是面向 AI Agent / Skill 开发者的按调用付费结算中台。它打通了「用户充值积分 → Agent 调用技能自动扣费 → 开发者提现」的链路,原生适配 OpenClaw、QClaw、WorkBuddy 等环境。核心目标:实现自定义 AI 技能的快速计费接入与小额按量付费结算。货币基准:1 Credit ≈ 1 USDC(平台抽成模式)。💡 二、主要功能模块👤 用户侧能力注册账户:基于邮箱完成实名认证/绑定。API Key:生成并获取 User API Key(一次性展示,需妥善保存)。资金管理:支持充值 Credit、实时查询余额、导出消费账单。🛠️ 开发者侧能力技能上架:创建付费 Skill,自定义名称与 Slug 标识。定价策略:设定单次调用价格(Credit)及收益规则。财务对账:查看订单流水、确认平台抽成后的实际收入。资金提现:满足门槛后提出现金 USDC。🔌 技术集成能力核心接口:涵盖鉴权验证、余额校验、自动扣费调用、技能目录查询。兼容范围:所有支持外部付费 Skill 调用的 Agent 客户端(如 QClaw)。🎯 三、适用人群评估✅ 推荐使用AI 技能开发者:希望为封装的私有/公共 Skill 实现按量收费。工具链重度用户:QClaw / WorkBuddy 的高级使用者,需接入第三方付费能力。独立项目搭建者:正在构建小型商业化 Agent 工作流或测试环境。❌ 不建议使用纯 API 调用场景:无友好网页可视化对话面板的普通用户难以操作充值流程。国内支付需求方:不支持微信/支付宝直充,仅支持加密货币(USDC)等境外渠道。高并发生产环境:平台尚未提供正式 SLA(服务等级协议),不建议作为核心商业系统的唯一依赖。💰 四、费用与结算规则接入成本:永久免费。注册账号、技能上架及基础接口调用无订阅费。交易抽佣:平台每笔订单抽取 2.5%,开发者实收比例约为 97.5%。📢 费率说明:官方未提供公开定价网页,且不存在动态调价页面(除控制台公告外)。请密切关注 SkillPay 账户内的费率变更通知。支付货币:USDC。充值与提现均需基于该稳定币进行流转。🚀 五、操作指南速查👨‍💼 场景 A:使用者(调用方)流程访问 skillpay.me 完成邮箱注册登录。进入个人中心,获取 User API Key(生成后请立即截图或私钥保存)。通过境外渠道充值 Credit 积分至账户余额。在您的 Agent / QClaw 配置中填入 SkillPay 凭证,即可直接调用付费技能。👨‍💻 场景 B:开发者(提供方)流程注册开发者账号并完善信息。创建新 Skill:填写名称、描述及 slug 标识符。代码集成:在 Agent 调用逻辑中植入扣费接口验证逻辑。📝 示例 JSON(请求体结构):json{ "user_key": "sp_usr_xxxxxxxxxxxx", "skill_slug": "market-data-query" } { "user_key": "sp_usr_xxxxxxxxxxxx", "skill_slug": "market-data-query" } 发布技能,用户调用后资金自动入账开发者账户。⚠️ 六、风险规避与注意事项在接入平台前,请务必知晓以下潜在风险点:⛓️ 网络延迟问题服务器部署于海外,国内直连大概率超时或丢包。API 调用建议通过代理进行。🔑 密钥安全风险User API Key 拥有极高权限(可直接扣费)。禁止硬编码、严禁上传至公开代码库。建议账户余额不长期留存大量积分。⏱️ 缺失消费确认机制Skill 代码可发起直接扣费,部分技能调用流程中可能存在无弹窗主动确认。授权密钥给陌生/未审核的 Skill 存在被动扣款风险。💸 资金渠道限制无国内支付通道。充值需购买 USDC,提现亦走加密钱包链路,若涉及合规问题可能影响账户封禁。🛡️ 售后维权困难属于去中心化/小型生态项目,无人工客服或工单系统。出现扣费争议订单时,申诉与追回难度大。⚙️ 消费上限限制缺失原生不支持设置单日消费限额。自动化 Agent 若陷入死循环调用,可能快速耗尽余额。需在应用层做好熔断逻辑。📝 数据保存不确定性历史账单建议定期导出本地备份。平台不承诺永久保存订单流水,随时存在服务调整风险。

Penpot图标

Penpot

Penpot.app 使用指南一、平台介绍Penpot 是一款开源网页端的 UI/UX 设计协作工具。其基于 MPL2.0 开源协议,在 GitHub 上已拥有超过 53k+ Stars,是 Figma 的主要对标产品之一。核心优势:布局标准原生化:支持原生 CSS Flex/Grid 布局,与设计稿直接复用前端参数。设计交付便捷:支持设计稿直出 CSS/HTML/SVG 代码,Inspect 检查面板可一键导出样式,尺寸、色值及间距无翻译误差。开放与去中心:采用云端 SaaS / 本地自托管双模式,彻底打破厂商锁定;文件使用标准格式(SVG/JSON),便于交接与管理。跨平台兼容:全浏览器运行,支持 Windows/macOS/Linux 通用环境。📌 官方入口:https://penpot.app 🎨 在线编辑地址:https://design.penpot.app二、核心功能UI 绘图与原型设计矢量绘图能力,支持页面组件/变体管理。内置交互原型制作工具及响应式画布调整。原生 CSS 布局引擎Flex/Grid 完全对齐前端开发标准。设计参数可被代码直接复用,减少还原成本。专业级 Inspect 面板选中图层可直接查看属性细节(间距、色值)。一键导出 CSS/HTML/SVG 片段,零误差对接前端资源文件。设计与管理系统原生 Design Tokens(设计令牌)支持。建立共享组件库及全局样式统一管理规范。实时多人协同多用户同页编辑、即时评论批注功能完善。具备版本回溯与历史记录查看能力。强大的扩展生态开放插件系统与 API 接口支持开发定制。对接 MCP AI 代理及自定义字体管理方案。灵活的部署架构官方云 SaaS(开箱即用)。Docker/K8s私有服务器自托管,适合特定数据需求场景。三、适用人群分析✅ 推荐使用UI/UX设计师与前端开发人员组成的协作团队。预算有限的创业初期产品小团队或学生群体。金融 / 政务 / 医疗等对数据合规敏感,需私有化部署的企业。需要长期维护设计系统、高频进行“设计转代码”交付的团队。❌ 需谨慎使用重度依赖海量 Figma 专属插件或商业模板团队(迁移成本高)。弱网环境或低配电脑用户:网页端首屏加载偏大,流畅度受设备影响明显。追求极致多人实时协同性能的团队:当前同步效率在极端复杂场景下仍略逊于 Figma。四、免费与付费定价方案👉 官方定价页:https://penpot.app/pricing/self-host1. 云端 SaaS 版(官方托管)适合希望无需运维,直接使用稳定服务的个人或小团队用户。Free (永久免费)✅ 无限用户数、无限文件数量、全量设计功能。✅ 无人数与工程限制支持。⚠️ 限制:历史版本存储周期较短,无法提供专属客服及官方活动折扣。Unlimited ($7 / 用户/月)🔒 解锁更长周期的文件版本回溯。🌟 优先获取新功能更新权限、参与官方社区活动享5折优惠。💾 扩容存储容量,月度账单上限为 $175(不限人数)。2. 自托管版(本地私有部署)适合拥有服务器资源,要求数据完全掌握在自己手中的企业用户。基于 Docker/K8s 一键拉起服务。Professional (永久免费)✅ 包含所有设计与协作功能。✅ 不限制文件与人数,享有社区技术支持。❌ 限制:无 SSO、审计日志等多组织管理权限,需自行维护运维成本。Enterprise ($950 / 月 固定费用)🔐 包含多组织架构管理及精细化权限控制。✅ 支持 SSO单点登录与详细的审计日志记录。🛡️ 提供 180 天文件恢复服务、官方技术支持及插件白名单管控(含 AI代理)。五、快速使用步骤方式 A:云端在线模式(零部署,新手首选)注册登录:打开 https://design.penpot.app,通过邮箱完成账号注册。新建项目:创建 Workspace(团队空间),随后建立新项目或画布。开始设计:使用 / 快捷插入组件,利用 Flex/Grid进行绘图布局。获取代码:选中任意图层,打开右侧 Inspect 面板复制 CSS/HTML/SVG 片段。分享协作:点击右上角生成链接即可邀请团队成员共同编辑。方式 B:本地自托管模式(企业 / 隐私需求)准备环境:安装 Docker 及 docker-compose 工具。启动服务:拉取官方配置,执行命令 docker-compose up -d 即可自动拉起后台服务。访问使用:本地浏览器通过指定 IP+9001端口直接访问网页版编辑界面。六、注意事项🌐 网络痛点:服务器位于海外,国内直连可能存在加载慢、上传卡顿及协同延迟问题。建议刚需用户优化环境或选择自托管方案。🧩 生态短板:目前的第三方插件数量与设计模板远少于 Figma,成熟素材库相对较少。⚡ 性能限制:基于 Web 架构运行,超大文件(如百图层以上)的画布容易出现卡顿现象;低配设备用户体验不佳。💾 免费版数据风险:云端 Free版历史版本保存周期短,若操作失误导致误删,找回难度较大。重要工程建议付费或定期本地备份。🛠️ 自托管维护成本:免费自托管无官方售后支持,服务器的搭建、日常运维及系统升级均需团队自行负责。🔀 文件兼容性:导入 Figma 源文件时,部分复杂插件效果会丢失;导出格式仅包含 SVG/CSS/HTML,不支持专有私有格式迁移。💳 支付限制:云端订阅服务目前主要面向海外信用卡用户,国内微信/支付宝直接支付渠道暂未打通。👥 协同体验差异:多人同时编辑时,复杂页面的冲突概率高于 Figma。建议团队在复杂页面上分图层进行协作管理。

StaffDeck图标

StaffDeck

StaffDeck 使用指南一、平台介绍主体背景:由清华 THUNLP + 面壁智能 OpenBMB 联合开源的企业数字员工 Agent 操作系统。 官方网站:https://staffdeck.openbmb.cn核心定位把 AI 封装成带岗位、工号、权限、SOP(标准作业程序)、绩效的标准化数字员工,旨在解决通用大模型存在的“无流程、无溯源、不可控”问题。基础信息开源协议:AGPLv3代码开放度:源码全开放部署方式:支持网页云端预览、桌面客户端、Docker 私有化本地部署底层兼容:所有 OpenAI 标准接口大模型(如 MiniCPM、通义千问、DeepSeek 等)系统集成:原生打通企业 OA/ERP/CRM,基于 MCP 协议二、核心主要功能1. 🏢 数字员工岗位管理人员属性配置:给 AI 分配工号、岗位、权限及职责边界。独立台账与审计:拥有独立工作台账,支持操作留痕及全链路审计。内置模板:提供 5 套现成岗位模板(财务报销、人事助理、法务顾问、IT 运维、行政管家)。2. 🔄 可视化 SOP 状态机编排零代码流程配置:业务人员通过自然语言一句话生成业务流程,或拖拽进行可视化编辑。高级流程控制:支持分支判断条件、断点续跑机制、异常自动拦截处理。替代提示词工程:复杂逻辑无需编写长 Prompt,直接转化为可执行的业务流。3. 📚 OKF 结构化企业知识库分层检索:文档按层级进行精准检索与匹配。强制溯源机制:回答内容必须标注原文章节出处,确保信息可信度。知识管理:区分硬性制度(高权重)/参考案例;支持知识分桶、检索调试及全链路日志追踪。4. 🔗 企业系统集成 (MCP)协议对接:基于 MCP 协议无缝对接内部 OA、CRM、表单系统。自动作业能力:数字员工可自动填写表格、发起审批流、调取业务数据。即时通讯入口:支持飞书/企业微信等 IM 工具的对话接口接入,实现移动端触达。5. 📊 运行监控与迭代闭环全链路 Trace 日志:记录每一次调用细节,便于排查问题。绩效统计:提供对话质量及任务完成率的统计数据。自我进化机制:自动沉淀错误案例用于优化数字员工判断规则;支持批量导出审计记录合规归档。6. 🖥️ 多端部署载体提供多种运行环境以适应不同场景需求:网页控制台:可视化操作界面(无需安装)。桌面客户端:Windows/macOS 原生应用体验。Docker 包:一键私有化容器镜像。Python SDK:便于二次开发及嵌入自有业务系统接口。三、适用人群分析✅ 适配人群企业 IT/数字化负责人:搭建内部标准化 AI 数字员工,满足金融、央国企、医疗等领域的数据不出域合规要求。业务主管(财务/人事/法务):实现自动化重复咨询、审批流转及合规核查工作。AI 开发者/算法工程师:快速搭建可落地的企业 Agent,复用 SOP/知识库工程框架。中小企业 & 创业团队:低成本替代重复人工客服咨询,分流工单压力。高校 NLP 实验室:适合进行企业级 Agent 架构研究及行业 POC(概念验证)开发。❌ 不适配人群纯个人日常聊天者:平台侧重流程化与企业管理场景,非轻量笔记或闲聊工具。仅需求开箱即用 SaaS 用户:无付费托管云订阅服务,需具备一定的本地部署能力或愿意购买线下实施服务。四、免费 & 付费情况详解💰 1. 免费资源(永久无限制)以下功能与服务均对开源社区及自行搭建者完全开放:网页预览端:访问 staffdeck.openbmb.cn,支持全部可视化编排、岗位模板加载、知识库构建功能的试用。GitHub 完整源码:地址为 https://github.com/OpenBMB/StaffDeck,商用可自由修改部署,无席位或流量限制。客户端工具包:桌面安装程序及 Docker 镜像均免费下载使用。配套资源:内置行业 SOP 模板、调试工具、SDK 文档等技术资料无任何收费门槛。💎 2. 付费服务(线下定制)平台无线上 SaaS 订阅套餐,无公开网页定价页面。付费主要面向企业级定制化需求:私有化部署实施:提供驻场技术人员进行环境搭建与调试。行业专属开发:针对特定业务逻辑的 AI 数字员工深度定制(需签订合同)。高级技术支持:7×24 小时企业级售后、专属大模型微调服务。旧系统对接:协助解决老旧 ERP/OA 无 API 接口的定制化连接方案。💡 获取报价方式:请访问官网底部商务联系入口,直接对接 OpenBMB 商务合作团队询价(非标准产品定价)。五、快速使用步骤指南🟢 方式一:网页在线试用(无需安装)注册登录:访问 https://staffdeck.openbmb.cn,通过邮箱进行账号注册与登录。配置模型:填写任意 OpenAI 兼容模型的 API 地址 + Key(推荐 MiniCPM、通义千问等国内或开源模型)。创建员工:点击“新建数字员工”,选择预置岗位模板(如财务)或从零自定义。构建知识库:上传企业内部制度文档,系统将自动解析并建立 OKF 知识索引。编排流程:进入可视化编辑器,拖拽节点编辑 SOP 逻辑,发布后直接输入问题进行测试。查看日志:在控制台运行监控面板中,调整规则与优化判断路径。🟡 方式二:本地私有化部署(数据完全离线)获取镜像/源码:从 GitHub Release 下载最新 Docker Compose 文件或拉取源码仓库。一键启动:在服务器执行 docker compose up -d,自动拉起服务集群。配置内网模型:本地部署 Qwen、Llama 或调用私有 API Key。访问控制台:在内网浏览器输入 IP 端口访问 Web 管理后台,确保核心数据不出域。🔵 方式三:二次开发集成若需深度定制功能,可查阅 Python SDK 文档,通过 REST API 接口将 Agent 能力嵌入到现有业务系统流程中(如钉钉、企业微信机器人)。六、注意事项与避坑点模型依赖限制⚠️ 注意:平台仅作为 Agent 调度层,不内置大模型。必须自备外部 API Key 或本地模型服务,无 Key=无法运行。开源协议约束🔒 AGPLv3:若修改代码并对外提供网络服务(公网),必须公开源码;纯内部私有化部署则无需遵守公开义务。请务必注意合规风险。网页预览性能局限🏠 生产建议:在线网页端仅适合测试与配置,企业生产环境务必使用 Docker 本地私部署,云端预览不适合承载正式业务流量以防数据泄露或限流。网络访问问题🌐 现状说明:国内直连官网及 GitHub 仓库通常正常;若调用境外模型 API(如 GPT-3.5),需解决超时与合规墙,优先推荐国产本地部署模型。集成对接门槛🔗 现实困难:对接 ERP/OA 需要业务系统开放标准 API;老旧无接口系统通常需要定制开发中间件,无法通过“一键连接器”完成。云托管服务现状☁️ 服务模式:平台不提供按年/按月付费的云端托管订阅服务(SaaS),只能自行部署或采购线下实施服务支持,请提前做好运维准备。数据备份策略💾 安全建议:网页预览端数据存储于 OpenBMB 测试服务器,严禁上传涉密/核心业务文档;生产环境请定期导出知识库文件进行本地冷备。版本差异说明🔄 更新机制:Preview 线上版迭代较快,功能可能与 GitHub Release 源码包存在细微差异。生产部署请以 GitHub 稳定版本为准。

Mirofish图标

Mirofish

MiroFish 使用指南一、平台介绍与核心功能MiroFish 是一款基于多智能体(Multi-Agent)技术的 AI 预测与推演引擎。它通过注入现实世界的“种子信息”,在数字沙盘中构建成千上万个具备独立人格和长期记忆的智能体,模拟其交互与社会演化以推演未来趋势。🌱 主要功能亮点📝 种子材料解析支持上传数据分析报告、政策草案、突发新闻甚至小说故事等素材。利用 GraphRAG(图谱检索增强)技术,自动构建底层知识图谱与记忆库。🤖 社会仿真模拟自动生成智能体的人设及实体关系网络。让大量智能体在数字世界中自由交互、协作或竞争进行推演。🕹️ 动态干预(上帝视角)在模拟过程中,用户可随时注入新变量或突发事件。精准观测群体行为涌现的连锁反应与蝴蝶效应。📊 多维报告与深度互动模拟结束后由 ReportAgent 自动解析并生成详尽预测报告。支持直接与数字世界中的任意智能体或报告助手进行对话交互。二、适用人群与应用场景MiroFish 适用于需要进行推演分析、内容创作及 AI 研究的各类角色:🏛️ 决策者与公关团队应用场景: 政策出台前的影响模拟、社会热点与突发舆情事件的演化推演。核心价值: 实现“零风险试错”,预判潜在舆论走向。💹 金融与时政分析师应用场景: 基于宏观金融信号或时政要闻数据,推演市场走势与趋势变化。核心价值: 辅助投资决策,识别系统性风险。🖋️ 内容创作者与编剧应用场景: 导入小说前序章节(如示例中的《红楼梦》前 80 回)。核心价值: AI 推演失传结局或生成新的脑洞故事线。👨‍💻 AI 开发者与研究员应用场景: 探索多智能体协同机制、群体智能涌现现象及社会仿真学实验。三、费用说明:开源免费 vs. 服务成本项目本身完全开放,但运行所需的算力或 API 消耗需按需付费。💰 软件授权状态: ✅ 完全开源免费模式: 允许直接获取源码本地部署或使用 Docker 容器化运行。⚠️ 第三方服务成本(必须配置)MiroFish 作为 AI 引擎,其核心能力依赖于外部大模型服务和记忆存储层四、快速上手:源码部署指南项目支持源码或 Docker 两种方式,推荐新手通过源码部署。请严格遵循以下步骤:📋 步骤一:配置环境变量这是最关键的初始化步骤。进入项目根目录后执行复制并重命名配置文件:bashcp .env.example .env cp .env.example .env 编辑 .env 文件并填入必要参数(如 LLM API Key):LLM_API_KEY: 阿里百炼或其他平台的 Token 密钥。ZEP_API_KEY: Zep Cloud 的记忆层接口密钥。🔧 步骤二:一键安装依赖环境要求: Node.js (v18+) | Python (3.11-3.12) | uv在根目录下执行以下命令,自动完成所有虚拟环境及前端/后端的依赖安装:bashnpm run setup:all npm run setup:all 注:该命令将同时处理 python 后端与 node 前端的依赖库。🚀 步骤三:启动服务并访问在根目录下执行以下启动命令,确保前后端同步运行:bashnpm run dev npm run dev 控制台提示成功后,打开浏览器访问沙盘界面: 👉 http://localhost:3000五、避坑指南初次部署与使用 MiroFish 时,请务必注意以下关键问题:⚡ Token 消耗预警现象: 智能体密集交互会导致 LLM Token 飞速耗尽。建议: 初次测试务必将模拟轮数控制在 40 轮以内。防止账户余额瞬间被刷空,后续可再逐步增加规模。🐍 Python 版本锁死现象: setup 命令或运行后端时直接报错。原因: 依赖库对版本极其敏感,不兼容过新或过旧版本。要求: 严格锁定在 Python >= 3.11 且 <= 3.12。❌ 避免使用 Python 3.10(太老)或 Python 3.13/3.14+(可能缺失依赖)。🐢 Docker 网络加速现象: docker compose up -d 时长时间卡在拉取镜像阶段。原因: 国内网络连接速度较慢。解决: 记得修改 .env.yml 或 docker-compose.yml,启用官方提供的Gitee/Mirrors 加速镜像地址。

Sync-in图标

Sync-in

Sync-in 使用指南一、平台介绍Sync-in (sync-in.com) 是一款开源自托管型私有文件同步与团队协作平台。它采用 AGPL-3.0 开源协议,核心设计思想是强调数据主权。用户可以自由决定将文件存储在自有服务器上,无需担心数据上传至第三方公有云。该平台的主要定位包括:替代方案:可作为 Nextcloud、企业网盘等商业软件的开源免费替代品;也适合有私有化部署需求的团队使用。跨平台支持:内置网页端访问、Windows/macOS/Linux 桌面客户端,以及命令行工具 (CLI)。核心安全理念:无数据追踪,无文件上传至第三方服务器。二、核心功能详解📂 多端文件同步三种模式:支持双向实时同步、仅客户端向服务器上传、仅从服务器下载;此外还支持定时同步策略(单向/双向)。高级管理:提供模拟预校验检查数据完整性,查看详细的同步日志。单台桌面客户端可同时连接多台 Sync-in 服务实例进行分片存储或灾备备份。🛡️ 协作空间 Spaces层级隔离:区分个人私有空间和团队/组织公共空间(如按部门、项目划分)。独立配额:不同团队可设置独立的存储空间额度与访问权限;支持文件锚定技术,确保同一份大文件不被重复占用物理存储。🔐 精细化共享权限用户分级:严格区分内部员工账号与普通外部访客账号。加密外链:生成的分享链接可设置有效期、访问密码;支持配置下载权限或只读模式,部分文件甚至开启“不可编辑”状态以防篡改。冲突保护:内置机制防止多人同时编辑导致的关键数据丢失(配合锁定功能)。📝 在线文档协同双引擎兼容:无缝集成 OnlyOffice 与 Collabora Online,提供 Office (Word, Excel) 及 ODF 格式文件的在线多人实时编辑体验。协作记录:支持文件评论功能、操作历史追溯,便于团队协作审核流程。🔒 安全与系统集成认证强化:集成双因素认证 (2FA/MFA)、LDAP/OIDC 单点登录;生成应用专用密码用于第三方工具接入。本地挂载:支持将文件直接映射到 WebDAV,轻松挂载为系统本地磁盘目录(Windows 资源管理器、macOS Finder)。检索能力:内置全文检索功能,并集成 OCR 技术以识别图片内文本;提供 CLI 脚本用于自动化同步任务。⚙️ 配套管理功能存储控制:支持设置用户或团队的存储空间配额限制(防止单用户占满)。日常运维:包含批量文件操作、标签分类管理、大文件分片上传机制以及活动通知推送。三、适用人群分析✅ 推荐使用场景 (适合)企业/机构合规部门:特别是律所、政府机关、教育机构及医疗单位,对数据隔离有严格要求,拒绝数据流出内网或公有云。技术极客/NAS 玩家:拥有群晖 Synology、威联通 QNAP 等硬件用户,希望自行搭建私有云替代商业网盘服务者。远程办公团队:具备本地机房服务器条件的外网/内外网安全文件交换需求团队。运维与开发者:需要编写脚本进行定时自动备份、CLI 自动化管理同步策略的人员。❌ 不推荐使用场景 (不适合)零基础设施用户:没有独立服务器、NAS 或云服务器资源,无法自行部署软件的用户。Docker 新手/小白:缺乏 Docker Compose 命令执行能力或不熟悉反向代理配置的用户。追求“开箱即用”的普通大众:仅想通过网页浏览即有公有云体验(类似百度网盘)且不愿维护系统的用户。注意:目前无官方提供的公有云托管服务,仅提供自托管方案。四、免费与付费方案说明🆓 基础代码 (完全开源)功能完整性:源代码永久免费开放。所有核心同步、在线文档协作、权限管理等功能均无任何阉割。部署成本:用户可自行在 Docker、NAS 或 VPS 上免费部署,仅消耗硬件资源(不限用户数、存储容量)。获取地址:源码托管于 GitHub (https://github.com/Sync-in/Sync-in)。💰 付费增值服务 (技术支持类)服务内容:仅提供企业级的官方技术支援团队对接服务。包含定制部署方案、合规性二次开发协助及专属维护工单支持。获取方式:无公开的标准订阅定价页面。如需采购技术支持,请直接通过官网底部 Support 联系方式咨询商务报价。五、快速使用步骤指南🟢 方式 1: 自托管部署(主流方案)此方法适用于拥有服务器/NAS 的用户。准备环境:确保主机系统运行 Docker 或准备好 Docker Compose 配置目录;安装 SSL 证书以启用 HTTPS(生产环境必须)。一键镜像拉取:执行官方提供的 Docker Compose up 命令,自动拉起后端服务、数据库及文件存储服务。初始化管理员:进入网页后台界面 (http://你的IP:端口),设置管理员账号并配置域名绑定;可选勾选启用 OnlyOffice/Collabora Online 编辑器容器(也可后续单独部署)。分配空间与权限:在管理端创建团队/个人 Spaces,并为成员设置存储配额。🔵 方式 2: 桌面客户端同步适合需要在本地电脑自动备份或离线访问数据的用户 (Windows/macOS/Linux)。下载软件:前往官网下载对应的 Windows、macOS 或 Linux .deb/.rpm/AppImage 安装包;也可在应用商店搜索 Syncthing-like 风格的管理器(注:Sync-in 客户端多为独立分发包,非套件)。配置连接信息:填入自建服务的域名/IP、管理员账号及密码进行设备授权验证。挂载文件夹:选择本地需要同步的特定文件夹;设置同步方向(如仅上传至云端或全量双向)并设定定时周期后启动后台服务。🟠 方式 3: 网页端在线协作适合无需下载客户端,直接使用浏览器访问的场景。登录入口:直接在浏览器访问自建域名 (https://你的域名) 即可登录;支持扫码或账号密码验证(需开启 HTTPS)。文件操作:上传文件、创建文件夹结构;右键点击目标文件或分享链接设置权限给成员/外部访客。在线编辑:对于 Office 文档,直接打开即进入编辑器界面,可邀请多人同时编辑或添加评论批注。🟣 方式 4: WebDAV 挂载本地磁盘适合希望在资源管理器中像操作本地文件一样管理云文件的用户 (Windows/macOS)。获取地址:在系统设置中生成 WebDAV 连接链接,格式通常为 https://你的域名/webdav。添加位置:Windows -> “网络”>“添加网络位置”,输入上述链接;macOS -> Finder > "Go" > Connect to Server (使用 AFP/FTP/SMB/WebDAV)。连接验证:在弹出的窗口中输入账号密码即可挂载,后续操作等同于本地硬盘。🟤 方式 5: CLI 命令行自动化适合 Linux/Server运维脚本化场景。获取工具:下载官方的 CLI Client 二进制文件或源码包;编译安装至服务器指定路径。绑定服务与脚本:配置连接密钥,编写定时同步脚(例如配合 cron 任务),用于在离线备份场景下将数据推送到主节点或进行归档操作。六、注意事项🌐 网络访问限制Sync-in 无国内官方云服务器。所有部署必须基于用户自有的硬件(NAS/云服务器)。若在国内公网使用,需完成域名备案及配置 HTTPS;否则内网环境虽稳定但外部无法访问。🛠️ 部署门槛说明必须具备 Docker/Kubernetes、反向代理 (Nginx)、SSL 证书管理能力等基础运维知识。无官方公有云试用。如果缺乏硬件资源,不建议尝试此方案。💸 编辑器额外成本OnlyOffice/Collabora Online 通常需独立安装或部署第三方实例(如使用社区版免费版)。若用于企业正式商用且对功能有严格要求,需注意商业授权许可费用;轻量级用户仅开启文件同步可忽略此项。⚠️ 双向冲突规则若两台设备同时修改同一文件并尝试保存双向模式,系统会生成“冲突副本”以防丢失数据。重要核心文件建议手动使用锁定功能防止编辑冲突。🔒 安全硬性要求WebDAV 访问和客户端登录强制依赖 HTTPS (TLS)。若未配置 SSL/HTTPS,WebDAV 连接与部分移动端同步可能失败或出现认证错误;生产环境必须开启双因素认证 (2FA/MFA)。📞 服务支持范围开源版仅提供社区论坛答疑。遇到复杂故障无官方技术人员远程协助修复(除非购买付费企业级技术支持包)。🍏 移动端体验短板目前没有官方独立的手机 App。手机端文件同步仅能依靠网页访问或第三方 WebDAV 客户端连接,操作便捷性相对较弱。💾 数据备份责任Sync-in 不提供云端冗余存储功能。所有数据存储在用户自有的物理硬盘上。请务必自行配置 RAID、快照或多节点异地备份策略以防范硬件故障导致的数据丢失风险。

Emil图标

Emil

emilkowalski.ski/skill由前 Vercel、Linear 资深设计工程师 Emil Kowalski 开发的本地化命令行工具(CLI)。它将多年在高级动效、微互动和高质感 UI 领域的经验“硬编码”为规则,专门赋予你的 AI Agent(如 Claude Code)顶级的审美与纠错能力。🚀 核心定位:让 AI 拥有设计品味普通的 AI 代码助手能写出“可以跑”的动画,但往往缺乏直觉——分不清场景该快还是慢、缓动曲线选错等。本项目并非独立 SaaS,而是通过注入规则(Skills),让你的本地前端环境中的 AI 编程助手具备:✅ 设计品味 (Taste):理解高级 UI/UX 规范。✅ 物理直觉:掌握正确的动画时序与曲线。✅ 自动纠错:拦截低级动效错误,减少手动微调时间。🧠 五大核心 AI 技能包 (Skills)该项目包含一套可组合的技能指令,直接在你的 Prompt 或 CLI 中生效:1. emil-design-eng | 👨‍💻 设计工程专家作用:在编写 React、CSS、Framer Motion 动画时提供专业建议。价值:指导 AI 做出符合物理直觉的动效决策(如阻止高频操作使用冗长动画)。2. review-animations | 🧐 动效严格审查作用:对前端动画代码进行像素级“硬核审查”。价值:揪出低级错误,例如误用淡入、超长时长等不符合规范的参数。3. improve-animations | 🔍 全库动效重构计划作用:扫描整个代码库进行审计。维度覆盖:动效目的、缓动曲线、物理特性、可中断性、性能优化及无障碍(Accessibility)。输出:生成一份可让低成本 AI 自动执行的重构行动计划。4. find-animation-opportunities | ✨ 寻找动效契机作用:分析 UI 界面,精准定位适合加入微互动的区域。反向约束:明确指出哪些地方绝对不要加动画(避免廉价感)。5. apple-design | 🍎 苹果动效哲学 (WWDC)作用:将 iOS/Apple 的界面设计与流体动效原则提炼为 Web 端规范。价值:让 AI 能够写出类似 iOS 系统级的细腻交互质感。👥 适用人群角色痛点与需求独立开发者 / 全栈工程师缺乏 UI/UX 设计师配合,希望用低成本工具获得 Linear/Vercel 级别的产品质感。设计工程师 (Design Engineer)使用 AI 提效重构,需要产出物直接符合高审美标准,减少手动调整 cubic-bezier 的时间。深度 AI 使用者高频用户 Claude Code / Cursor,希望解决其写前端代码“缺乏品味”的问题。💰 免费与付费详情✅ 核心工具:完全开源且免费当前 Skill 技能包:0 元。可直接通过终端安装到你的 AI 代理中运行。使用方式:集成到本地项目,无后台、无 API Token 限制(取决于基座模型)。💳 进阶内容:知识付费课程本 Skill 是 Emil 的付费在线课程的“AI 衍生品”。若需深入学习底层物理理论及代码实践,可购买其正课。课程名称:Animations on the Web参考价格:$199 USD 起(官网以最新为准)。详情页面:animations.dev⚙️ 快速上手指南由于其本质是注入 AI Prompt/技能包,通常配合支持自定义 Skills 的系统使用。📥 安装步骤 (以 Claude Code / Cursor 为例)在项目根目录下运行以下命令:bash# 将 Emil 的设计工程师技能包添加到本地 AI 代理中 npx skills add emilkowalski/skill # 将 Emil 的设计工程师技能包添加到本地 AI 代理中 npx skills add emilkowalski/skill ⚠️ 提示:确保你使用的是支持安装第三方 Skill/Plugin 的 CLI 环境或 IDE(如 Cursor, Claude Code)。📝 交互指令示例 (Prompt Examples)安装后,你可以直接在对话框下达以下指令:审计这个全局的代码库,看看哪些动效需要被优化 -> (调用 improve-animations)帮我把这个下拉菜单的缓动曲线调整得更符合物理直觉 -> (调用 emil-design-eng)检查我这里的动画是否触发了重排问题?🛑 核心避坑点:如果你打算使用此技能,或在开发精细动画时,请务必遵守这些由该工具提炼出的硬核规范。这是 AI 审查的重点拦截项:⏱️ 1. 控制时长 (Timing)规则:普通的 UI 微交互动画绝对不要超过 300ms。原因:速度快往往能显著提升用户的“感知性能”,慢动作会让用户觉得网站卡顿。📉 2. 慎用 ease-in (淡入)规则:元素进入屏幕的动画,永远首选 ease-out(淡出)或自定义弹簧效果。原因:ease-in 会让动画快结束时达到最快速度,视觉上感觉像是在“撞墙”,极其不自然。🚫 3. 高频操作别加动画场景示例:表格行切换、频繁点赞按钮、普通的键盘输入响应等。规则:能不加就不加。动效是用来引导视觉或增加趣味的,高频场景加动画只会让用户烦躁。📐 4. 严格属性限制白名单:只允许 AI 修改 transform 和 opacity(性能消耗低)。黑名单:绝对禁止用动画改变 height、width 或 margin。这会导致浏览器频繁触发重排 (Layout Thrashing),造成严重的掉帧卡顿。