分类导航

发现更多优质 AI 工具

全部 编程代码 创作写作 视频音频 图像视觉 学习辅导 办公效率 设计创意 大模型 提示词 Skills 自动化 知识库 开源 副业
Anthropic图标

Anthropic

Anthropic Claude 平台使用指南一、平台概况创立背景:Anthropic 于 2019 年由前 OpenAI 成员创立,是一家公共利益公司。核心产品:以 Claude 系列大模型 为核心。核心优势:主打 安全优先、长上下文 与 强推理能力。数据能力:训练数据截至 2022 年 12 月,可提供较新的信息检索能力。二、主要功能核心对话:无广告干扰。支持日常问答、内容创作、头脑风暴。长文本处理:上下文窗口最高可达 200K(约 15 万字)。支持格式:PDF、Word、TXT、CSV 等。限制:单文件≤10MB,一次最多上传 5 个文件。代码开发:Claude Opus 4.7:擅长编程、调试及复杂工程任务。Claude Code:专用的编程助手工具。多模态与智能体:支持视觉理解。可构建 AI 智能体(例如 NASA 火星车辅助驾驶场景)。安全合规:基于“宪法 AI"机制降低有害输出。强调模型回答的可解释性。三、适用人群个人用户:涵盖学生、创作者、普通办公人群。免费版额度通常已满足基本需求。专业人士:涵盖程序员、研究员、律师、顾问等。主要需求:长文档分析、深度推理任务。企业/团队:涵盖中小企业、研发团队、内容工作室。主要需求:Team 版协作功能、隐私保护。开发者:涵盖应用开发、API 集成、模型微调。计费模式:按 token 计费。四、免费与付费情况1. 个人订阅Free(免费):使用模型:Claude Sonnet。权益:基础聊天、文件分析。限制:有限额度,无优先访问权限。Pro($20/月):使用模型:全模型(包含 Opus)。权益:5 倍额度,高峰优先、新功能早体验、Projects 进阶功能。Max($100/$200/月):额度:5 倍/20 倍不等。特权:无限速率,专属客服支持,适合重度用户。2. 团队/企业Team($25/用户/月):适用条件:≥5 人。权益:Pro 全权益 + 协作空间 + 管理员面板 + 企业级隐私。Enterprise:模式:定制化。权益:私有部署、专属算力、高级安全合规。3. API 计费Opus 模型:输入$5/百万 token,输出$25/百万 token。Sonnet 模型:输入$3/百万 token,输出$15/百万 token。Haiku 模型:输入$1/百万 token,输出$5/百万 token(轻量低成本)。五、如何使用1. 网页端(新手推荐)访问官网:前往 https://claude.ai/ 进行注册或登录(支持 Google 账号或邮箱)。操作内容:新建对话,输入问题或直接上传文件进行分析。订阅升级:点击右上角头像,选择 "Subscribe to Pro"。2. 客户端Claude Desktop:支持 Claude Code 功能。适合本地编程环境及处理长任务。iOS App:在 App Store 搜索 "Claude"。提供免费使用版本。3. API 调用(开发者)Python 示例代码:pythonfrom anthropic import Anthropic client = Anthropic(api_key="你的 API 密钥") response = client.completions.create( model="claude-3-opus-20240229", prompt="Hello, Claude!", max_tokens=100 ) from anthropic import Anthropic client = Anthropic(api_key="你的 API 密钥") response = client.completions.create( model="claude-3-opus-20240229", prompt="Hello, Claude!", max_tokens=100 ) 六、避坑点1. 账号风控(国内用户高频踩坑)IP 稳定性:避免使用公共代理及频繁切换 IP,建议使用干净的美国或加拿大 IP。支付合规:优先使用实体银行卡。账单地址需与 IP 所在州保持一致。禁用虚拟卡或礼品卡。养号策略:新号前 2 周保持低频,仅使用网页端或 Desktop,严禁高频调用 API 或 CLI。行为自然度:避免 24 小时高负载、批量任务、共享账号或异地登录。2. 使用限制与优化额度管理:免费版:约 8 小时可用 100 条消息。Pro/Max 版:按周期重置,超出额度会限速。长对话技巧:单轮提问清晰,合并相似问题。尽量复用上下文,减少重复输入。文件处理:单文件≤10MB,一次≤5 个文件。超大文档建议先进行分拆再上传。3. 安全与隐私数据留存:对话内容可能用于模型训练。敏感信息需提前脱敏 后发送。KYC 验证:可能不定期触发身份证 + 自拍验证。注意:即使验证后,账号仍有被封风险。重要内容需提前进行本地备份。

Google DeepMind图标

Google DeepMind

DeepMind 模型广场使用指南DeepMind 官网模型页集中展示其Gemini 全系、Gemma 开源系列、音视频生成(Nano Banana/Lyria/Veo/Imagen)、世界模型(Genie)、机器人模型等,定位为“下一代 AI 系统探索入口”。一、核心模型与主要功能1. Gemini 3.5(2026.5 最新旗舰)定位:前沿智能 + 行动能力,含 3.5 Pro/Flash 两版。功能:文本/图像/音频/视频全模态理解。长上下文支持(1M 输入/65K 输出)。代码生成、工具调用、实时联网搜索、企业级智能体。Gemini 3.5 Flash:4 倍速、低成本、高吞吐,适合实时对话/批量处理。2. Gemini Omni(2026.5 新)定位:原生全模态“任意输入→任意输出”,首发视频生成。功能:文本/图/音/视频输入→视频输出。对话式视频编辑(改场景/换对象/调光照)。物理模拟(重力/流体)。未来支持图像/音频输出。3. Gemma 4(开源最强)定位:Apache 2.0 开源,高智能/参数比,支持本地部署。功能:文本/图像/音频(小模型)。256K 上下文。推理/代码生成/多模态任务、可商用无版权费。4. Nano Banana 2(图像生成)定位:Pro 级画质+Flash 级速度,4K 商用级。功能:文生图/图生图/编辑。实时联网(RAG)、4K 输出、多角色/物体一致性(5 角色/14 物体)。文字渲染/信息图/数据可视化。5. Lyria 3(音乐生成)定位:带人声的音乐创作,24-bit 高保真。功能:文本/图生音乐、带歌词人声。多风格(流行/古典/电子)、短视频 BGM。AI 封面生成。6. Veo(视频)/ Imagen(图像)Veo:顶尖文生视频,电影级画质。Imagen:顶尖文生图,高细节/艺术感。7. Genie 3(世界模型)/ Gemini RoboticsGenie 3:3D 世界模拟、环境交互、物理引擎,可与 Google 街景联动。Gemini Robotics:视觉 - 语言 - 动作(VLA)模型,实体机器人控制。二、适用人群C 端用户:创意生成(图文/视频/音乐)、学习辅助、日常对话、内容编辑(Gemini App)。创作者/设计师:Nano Banana 2(4K 商用图)、Veo(视频)、Lyria(音乐)、Omni(视频编辑)。开发者/企业:开源:Gemma 4(本地部署/隐私优先/商用)。云端:Gemini API/AI Studio(智能体/RAG/批量处理)。平台:Enterprise Agent Platform(企业级智能体)。科研/教育:Genie(世界模拟)、Gemini(长文档分析)、Gemma(定制研究)。机器人/工业:Gemini Robotics(实体控制)、Genie(数字孪生)。三、免费与付费1. 免费Gemma 4:完全开源(Apache 2.0),权重免费下载,本地运行零成本,可商用。基础试用:Gemini App 免费版(基础对话/简单生成)、Google AI Studio 免费额度(API 试用)。部分工具:如 Gemini 基础嵌入、简单提示词模板。2. 付费(API/订阅)Gemini 3.5 Flash(API):$1.50/百万输入 token,$9.00/百万输出 token;缓存输入 $0.15/百万。Gemini Omni:仅限 Google AI Plus/Pro/Ultra 订阅,API 暂未开放。Nano Banana 2/Veo/Lyria:订阅制(Gemini App 高级版)+ API 按用量计费。企业版:Gemini Enterprise Agent Platform、Vertex AI 定制定价。四、如何使用(快速上手)1. C 端(直接用)访问 Gemini App(gemini.google.com)或移动端 App。登录 Google 账号,免费版直接用;高级功能(Omni/4K/长视频)需订阅 Plus/Pro/Ultra。选择功能:对话(Gemini)、生图(Nano Banana)、生视频(Omni/Veo)、生音乐(Lyria)。2. 开发者(API/开源)云端 API(推荐)进入 Google AI Studio(aistudio.google.com)。创建项目→获取 API Key→选择模型(Gemini 3.5/Omni/Nano Banana 2)。调用 API:支持文本/图像/音频/视频输入,返回生成结果。开源本地部署(Gemma 4)下载权重(Hugging Face/Google)。本地运行:需 GPU(推荐 RTX 4090+),支持笔记本/边缘设备。3. 企业(智能体/定制)Gemini Enterprise Agent Platform:构建/部署/管理企业级智能体,支持私有数据集成。Google Antigravity:AI 原生开发平台,低代码构建应用。五、避坑点(重要提醒)地区限制:Gemini/Omni/Nano Banana 2 等部分地区不可用(含中国大陆),需合规网络环境。版权风险:生成内容(图像/视频/音乐)可能涉及版权/商标侵权,商用需版权审核;SynthID 水印用于溯源。提示词质量:Omni/Nano Banana 2:需详细提示词(风格/分辨率/细节),模糊描述易出低质结果。长文本:Gemini 3.5 支持 1M 上下文,但超长输入易降质,建议分段。成本控制:API 按 token 计费,批量任务易超预算;优先用 Flash 版(低成本高速)、缓存输入降成本。开源限制(Gemma 4):Apache 2.0 免费,但不可用于非法/侵权用途;本地部署需硬件门槛。生成稳定性:Omni 视频:长视频(>1 分钟)易卡顿/失真,建议 30 秒内。Lyria 音乐:中文歌词发音不准、曲风有限,适合短视频 BGM。数据隐私:云端 API 输入数据可能被 Google 用于训练,敏感数据优先用 Gemma 4 本地部署。

Inflection AI图标

Inflection AI

Inflection AI(Pi)使用指南一、产品定位Inflection AI 是一家主打**情感智能(EQ)**的 AI 公司。其核心产品为个人 AI 助手 Pi(Personal Intelligence)。Pi 区别于 ChatGPT 等任务导向型 AI,专注于提供“人性化陪伴与情感支持”,旨在成为用户的“有温度的朋友”。二、主要功能情感化对话提供高共情回应,擅长倾听与共情。能够进行情绪疏导,缓解心理压力。交互风格自然,像朋友一样聊天。个人记忆长期记住用户偏好、过往对话与关键信息。跨会话保持上下文连贯,无需重复解释。多模态交互支持文字与语音输入。具备 6 种自然语音 实时对话功能。兼容多平台:iOS/Android 手机、网页、桌面端、WhatsApp/SMS 关联使用。轻量生产力辅助头脑风暴、日常规划、日记反思。提供语言练习、决策辅助等支持。多语言支持流利处理多语言对话。在跨语言沟通中保留情感细节。企业级方案(Inflection Insights)面向企业的对话式数据分析。支持自然语言查询、自动生成分析与可视化报告。三、适用人群与禁忌✅ 适合人群情感陪伴需求者:需要倾听、情绪疏导、深夜聊天或无压力倾诉的用户。创作者/自由职业者:需要头脑风暴、创意打磨、写作辅助及灵感激发的人群。语言学习者:希望进行低压力口语练习、获取对话反馈及多语言交流实践的用户。个人成长用户:关注自我反思、目标梳理、决策分析及生活规划的用户。普通日常用户:用于闲聊、解闷、轻度问答及打发时间。❌ 不适合人群技术开发者:重度代码开发需求。数据分析师:复杂数据分析、高精度工具集成需求。专业作者:专业论文写作、高精度学术需求。四、免费与付费情况1. 个人版(Pi)核心策略:完全免费且无限制。功能权限:包含全功能聊天、6 种语音交互、记忆功能、跨设备同步、基础提醒/待办。支付政策:无订阅费、无额度上限、无需绑定信用卡。开发者 API:面向集成需求的开发者提供付费接口。输入 Token 价格:$2.50/百万。输出 Token 价格:$10.00/百万。2. 企业版(Inflection Insights)服务模式:定制化报价。适用对象:面向企业数据对话分析需求。部署方式:支持私有部署/VPC。定价方式:按企业具体需求定价。五、快速上手指南访问入口网页端:访问 https://pi.ai(直接聊天,无需注册)。移动端:在 iOS/Android 应用商店搜索"Pi"下载 App。桌面端:下载 Mac/Windows 客户端;或绑定 WhatsApp/SMS 使用。开始对话注册机制:无需注册即可直接聊天;创建账号后可实现跨设备同步记忆与对话。交互方式:输入文字或点击麦克风进行语音对话,并可切换偏好语音。核心操作反馈:点赞/点踩功能,帮助优化回复。管理:复制回复、继续对话、查看历史记录。设定:设置提醒、待办事项、日记功能,长期保持个性化交互。六、使用避坑指南能力边界限制不擅长代码编写。不擅长复杂数学计算。不支持文件上传、图片分析、专业数据处理。容易出现幻觉,在复杂领域易出错。隐私风险对话数据经过云端处理。无端到端加密(E2EE)。隐私政策允许将对话数据用于模型训练。敏感信息(如隐私、机密)需谨慎输入。事实准确性复杂学术知识、专业数据、冷门知识易出现虚构。关键信息需用户进行交叉验证。集成与生态个人版无 API 集成。无法接入第三方工具或自动化流程,仅限独立使用。无 PDF/Excel 处理、图表生成功能,插件生态较弱。在重度生产力场景(如批量处理文档)表现受限。七、核心差异化对比(Pi vs ChatGPT)为清晰展示两款产品的差异,以下从关键维度进行对比:核心优势Inflection AI(Pi):侧重情感共情、人性化陪伴、记忆能力强。ChatGPT(GPT-4):侧重任务处理、生产力工具集成、专业能力。免费策略Inflection AI(Pi):完全免费,无限制使用。ChatGPT(GPT-4):免费版功能有限制,高级版 Plus 需付费订阅。语音交互Inflection AI(Pi):拥有 6 种自然语音,对话流畅且情感自然。ChatGPT(GPT-4):支持语音,但情感自然度相对较弱。隐私保护Inflection AI(Pi):云端处理,无端到端加密。ChatGPT(GPT-4):云端处理,企业版可选私有部署。适合场景Inflection AI(Pi):情感支持、闲聊、个人成长、语言练习。ChatGPT(GPT-4):工作办公、学习科研、内容创作、开发调试、数据分析。

日日新图标

日日新

商汤日日新-使用指南商汤「日日新」是商汤科技推出的原生多模态大模型体系与开发平台,主打“理解与生成统一”,面向办公、创作、开发等场景,提供模型调用、应用工具与开源生态。官网地址: https://www.sensenova.cn/一、核心功能与模型能力1.1 核心模型能力SenseNova U1定位:新一代原生多模态模型。核心优势:图文理解与生成统一,支持 32K 上下文。适用场景:擅长图文交错创作、风格一致的图像生成。SenseNova 6.7 Flash-Lite定位:轻量级多模态智能体。核心优势:直接看懂网页、文档、图表;Token 消耗降低 60%;毫秒级响应。适用场景:适合复杂办公流。专项模型体系覆盖空间智能(SI):空间感知。推理(MARS):动态视觉推理。嵌入(Piccolo):向量检索。时序(Kairos):时序预测。1.2 原生应用办公小浣熊功能:AI 办公助手,支持数据分析、PPT/信息图生成、任务规划。特性:支持私有部署与安全定制。Seko 多模态短片创作功能:通过图文直接生成短视频。AgentSkills功能:封装办公技能(数据分析、PPT、调研)。特性:支持智能体框架快速集成。1.3 开发与开源生态API 调用:模型即服务,支持 OpenAI 兼容接口。开源组件:GitHub 开放模型权重、Agent Pack 一键部署包、Skills 技能库。微调与部署:支持模型微调、端侧/私有化部署。二、适用人群企业/团队:需要自动化办公、数据分析、智能体应用的中大型企业与创业公司。开发者/创业者:构建多模态应用、AI 助手、内容生成工具的个人或团队。内容创作者:从事图文创作、短视频制作、PPT/信息图设计的自媒体、设计师、运营人员。办公人群:高频处理报表、PPT、文档的职场人(主要使用小浣熊)。三、费用与计费政策3.1 免费政策(Token Plan 限时活动)额度:注册首月,每 5 小时可刷新1500 次调用(涵盖 U1、U1 Fast、6.7 Flash-Lite 等模型)。限制:额度刷新周期为5 小时(非每日刷新)。单账号最多支持20 个API Key。免费期结束后自动转为付费。其他免费资源:开源模型权重(如 U1 等)、基础 Skills 组件、非商用测试额度。3.2 付费定价基础版(Lite)计费方式:按需付费。输入价格:约 0.0015 元/千 Token。输出价格:约 0.0045 元/千 Token。专业版(Pro)定位:企业定制,提供更高 RPS、专属集群、SLA 保障。输入价格:约 0.003 元/千 Token。输出价格:约 0.009 元/千 Token。套餐:后续将推出月付/年付套餐,包含固定额度及专属支持。四、快速上手指南4.1 注册与开通访问官网:https://www.sensenova.cn/。使用手机号进行注册并验证。进入控制台→点击「立即体验」开通服务。完成个人/企业实名认证(未认证用户仅可使用代金券额度)。4.2 获取 API Key进入控制台→「API Keys」菜单。点击创建 Key(建议按不同应用独立创建)。保存以 sk- 开头的密钥字符串。绑定 Token Plan,领取免费额度。4.3 三种调用方式方式 1:API 直接调用(兼容 OpenAI 接口)适合开发者通过代码集成。bashcurl https://token.sensenova.cn/v1/chat/completions \ -H "Authorization: Bearer sk-xxx" \ -d '{"model":"sensenova-6.7-flash-lite","messages":[{"role":"user","content":"分析这份财报"}]}}' curl https://token.sensenova.cn/v1/chat/completions \ -H "Authorization: Bearer sk-xxx" \ -d '{"model":"sensenova-6.7-flash-lite","messages":[{"role":"user","content":"分析这份财报"}]}}' 方式 2:Agent Pack 一键部署适合快速构建智能体环境。bashgit clone https://github.com/OpenSenseNova/agent_pack cd agent_pack && ./install.sh openclaw onboard --api-key sk-xxx git clone https://github.com/OpenSenseNova/agent_pack cd agent_pack && ./install.sh openclaw onboard --api-key sk-xxx 方式 3:办公小浣熊 Web 端适合零代码用户,直接在浏览器中上传文件、输入指令即可使用。五、新手避坑指南免费额度规则注意刷新周期为每 5 小时,并非每日刷新。超量立即计费,建议在前端或代码中进行调用限流控制。Token 换算1 Token ≈ 1.2 汉字。中文处理比英文更划算。长文档或包含图表解析的任务消耗更高,需提前预估成本。模型选择策略轻量任务:选择 6.7 Flash-Lite(便宜且快)。图文创作:选择 U1 Fast(生成质量高)。复杂推理:选择 U1(支持 32K 上下文)。安全与密钥管理API Key 泄露会导致盗刷计费风险。务必按应用独立创建 Key,定期轮换,并启用 IP 白名单。能力边界认知图像生成:风格一致性强,但复杂场景细节有限。文档解析:PDF 扫描件(图片型)的解析精度低于原生 PDF。免费模型:商用存在配额限制,正式业务场景建议升级付费。开源限制开源模型权重仅限非商用/研究用途。若需商用,必须联系商汤获取授权。

MiMo图标

MiMo

小米 MiMo 使用指南一、产品定位MiMo 是小米自研的通用智能基座大模型,其核心定位与优势如下:核心能力:主打智能体(Agent)能力、长文本理解、多模态交互与语音技术。智能闭环:强调构建“数据压缩—物理链接—预测协助”的智能闭环。二、主要功能MiMo 模型涵盖了从基础对话到复杂任务处理的多种能力,具体包括:对话与推理支持通用问答、逻辑推理。具备长文本摘要与创作能力,支持多轮深度对话。智能体(Agent)支持复杂任务规划与长时间自主执行。具备多步推理能力,支持工具调用(如旅行规划、预订、生成报告等)。多模态理解(V2.5)支持文本、图像、视频、音频跨模态理解。语音能力(TTS/ASR)TTS(语音合成):支持中英双语、情感合成、唱歌音高控制,限时免费。ASR(语音识别):开源语音识别,支持方言、歌词识别及嘈杂环境。代码与生产力支持代码生成与调试、数据分析、文档处理、创意写作。长上下文(V2.5‑Pro)提供百万级上下文窗口,可处理整本小说或大型代码库。三、适用人群根据不同需求,MiMo 适配以下四类用户:普通用户:适合日常聊天、信息查询、文案创作及生活助手场景。开发者/独立工程师:适合 API 集成、Agent 开发、代码辅助及模型微调(MIT 开源)。企业/小团队:适用于智能客服、自动化流程、内容生产、数据分析及长文档处理。语音/多模态创作者:适合配音、播客、视频字幕制作及语音交互产品开发。小米生态用户:适用于手机、车机、家居系统级智能助手(需设备支持)。四、免费与付费情况✅ 免费权益网页端体验:官网直接对话,永久免费。新用户福利:注册送10 元 API 体验金(有效期 40 天)。开源模型:V2.5/V2.5‑Pro 权重开源(MIT 协议,可商用/微调)。算力激励:申请可获免费算力,最高16 亿 Credits。TTS 服务:MiMo‑V2‑TTS永久免费调用。免费额度:每周提供100 万 tokens(限非商用)。💰 付费服务(API 调用,官网对话免费)按量计费(V2.5 系列,永久降价 99%)输入(缓存命中):0.025 元/百万 tokens。输入(未命中):3 元/百万 tokens。输出:6 元/百万 tokens。订阅套餐(Token Plan,加量不加价)Lite:39 元/月 → 41 亿 Credits。Standard:99 元/月 → 110 亿 Credits。Pro:329 元/月 → 380 亿 Credits。Max:659 元/月 → 820 亿 Credits。优惠活动夜间0–8 点调用享受8 折优惠。支持连续包月/包年折扣。五、如何使用1. 网页端(免费体验)访问官网链接:https://mimo.xiaomi.com/zh。直接进入对话界面即可使用,无需登录即可体验基础功能。2. API 接入(开发者)注册:访问开放平台 https://platform.xiaomimimo.com 进行注册。验证:完成手机验证,创建并获取 API Key。安装:安装 SDK 库,命令为 pip install xiaomi-ai-sdk。调用示例:pythonimport requests api_key = "你的 API Key" url = "https://api.mi.ai/v2/chat/completions" headers = { "Authorization": f"Bearer {api_key}", "Content-Type": "application/json" } data = { "model": "mimo-v2.5-pro", "messages": [{"role": "user", "content": "你的问题"}] } response = requests.post(url, headers=headers, json=data) print(response.json()) import requests api_key = "你的 API Key" url = "https://api.mi.ai/v2/chat/completions" headers = { "Authorization": f"Bearer {api_key}", "Content-Type": "application/json" } data = { "model": "mimo-v2.5-pro", "messages": [{"role": "user", "content": "你的问题"}] } response = requests.post(url, headers=headers, json=data) print(response.json()) 3. 小米设备(封测中)支持机型:小米 17 系列等。使用方法:升级 HyperOS 系统后,长按电源键或“小爱同学”唤醒。4. 本地部署(开源模型)模型下载:ModelScope/HuggingFace 搜索 XiaomiMiMo。推理框架:推荐使用 vLLM、Transformers 等框架。六、避坑要点在使用 MiMo 服务时,请注意以下关键细节:缓存命中差异API 调用时,缓存命中/未命中价差约 120 倍。建议:高频重复查询场景下,缓存命中更划算。免费额度限制网页端免费使用无门槛。API 免费额度仅限非商用,商用场景需订阅付费套餐。模型选择建议长文本/复杂 Agent:选择 V2.5‑Pro。多模态交互:选择 V2.5。语音合成需求:选择 V2.5‑TTS(免费)。开源合规要求MIT 协议允许商用,但需保留版权声明。严禁商标侵权,需严格遵守协议。额度重置规则老用户订阅额度可全量重置。已用额度清零,但有效期不变。时段优惠夜间0–8 点调用享受8 折,适合批量任务调度。

盘古大模型图标

盘古大模型

华为云盘古大模型使用指南一、核心定位与架构华为云盘古大模型是面向 B 端的企业级行业大模型,具备以下核心特征:架构体系:采用 L0 基础模型 + L1 行业模型 + L2 场景模型的三层架构。核心优势:主打中文理解、多模态处理能力、行业深度适配。落地领域:已在政务、金融、气象、制造等多个垂直行业实现规模化落地。二、五大基础模型功能详解1. 语言大模型(LLM)参数规模:超千亿参数。核心能力:中文预训练,支持对话问答、文案生成、阅读理解、代码生成及插件调用。应用场景:数字员工、会议/邮件总结、材料撰写。2. 视觉大模型技术特性:包含 MoE(混合专家)结构。核心能力:图像与视频的理解、生成及检测。应用场景:智慧城市(城管、交通、水务)、证件审核。3. 多模态大模型核心能力:融合语言与视觉,支持图像理解/生成、视频生成、OCR 及图文创作。4. 预测大模型技术特性:基于 Triplet Transformer 架构。核心能力:结构化数据量化预测、趋势分析、决策辅助。应用场景:智慧配煤、生产优化、质量预测。5. 气象大模型学术背景:发表于《Nature》杂志。核心能力:全球中期预报(1–7 天),涵盖降水、台风及污染物预报。性能表现:精度超越传统数值预报,速度大幅提升。6. 行业垂直能力提供政务(公文生成、政策问答)、金融(风控、投顾)、矿山、能源等垂直领域专属模型。三、适用人群与场景企业/组织(核心客户):政务、金融、制造、能源、气象、矿山等行业客户。开发者/ISV:基于 API/SDK 进行二次开发,构建行业应用。政企 IT 团队:负责数字化转型、智能办公及智慧城市建设。科研机构:专注于气象、环境、地理等科学计算与预测研究。个人用户(受限):仅开放部分免费基础能力,不面向个人提供完整商业服务。四、计费模式与资源情况1. 免费额度说明(长期有效)NLP 服务:每月 80 万 tokens,新用户额外赠送 20 万,认证开发者赠送 50 万。CV/多模态:每月 50 万 tokens。基础模型:模型广场中标注“免费”的模型可直接调用,无订阅费。开源版本:提供 70 亿参数稠密模型、720 亿参数 ProMoE 模型,可本地部署(需昇腾硬件)。2. 企业级付费模式按量计费:商用模型(如 Pangu 4.0)按 token 计费,调用量越大单价越低。包年包月:气象、政务等行业专业版,采用固定周期订阅。私有化部署:Pangu E 企业版,支持离线部署与数据不出境,按节点或授权收费。微调服务:行业数据微调定制,费用根据训练数据量与模型大小计算。五、快速上手指南1. 准备工作账号注册:注册华为云账号并完成企业实名认证(个人仅能使用免费基础版)。服务开通:开通盘古大模型服务及 ModelArts Studio 开发平台。凭证获取:创建 IAM 角色并生成 AK/SK(API 调用凭证)。2. 控制台操作(零代码)进入平台:进入盘古大模型控制台 → 模型广场 → 选择模型(如 Pangu NLP)→ 创建推理实例。在线调试:输入提示词查看结果,支持对话、生成、摘要等功能。应用搭建:使用提示词工程、知识库及工作流快速搭建数字员工或智能问答应用。3. API/SDK 调用(开发集成)获取接入点:选择模型获取 Endpoint。调用方式:使用 AK/SK 签名调用 REST API,支持 Python/Java/Go 等 SDK 或直接 HTTP 请求。示例代码:httpPOST https://pangu.cn-north-4.myhuaweicloud.com/v1/chat/completions Authorization: Bearer {AK/SK 生成的 Token} Content-Type: application/json { "model": "pangu-4", "messages": [{"role": "user", "content": "写一篇华为云盘古大模型介绍"}] } POST https://pangu.cn-north-4.myhuaweicloud.com/v1/chat/completions Authorization: Bearer {AK/SK 生成的 Token} Content-Type: application/json { "model": "pangu-4", "messages": [{"role": "user", "content": "写一篇华为云盘古大模型介绍"}] } 4. 行业定制(微调)数据准备:准备行业数据集并上传至 OBS。任务配置:在 ModelArts 创建微调任务,选择预训练模型并配置参数。部署上线:训练完成后部署为专属行业模型。六、避坑指南与关键注意事项身份限制:完整商业服务仅对企业开放,个人无法使用付费或微调功能;实名认证必须使用企业资质。免费额度限制:免费版无并发保障、限速且优先级较低,高峰期可能排队;超出额度需付费,注意监控用量。语言强弱项:核心优势为中文理解与生成,英文能力弱于海外模型,英文场景需评估。硬件绑定:开源或私有化部署必须使用华为昇腾 AI 芯片,不支持英伟达 GPU;硬件成本高,需提前规划。数据依赖:通用模型效果有限,行业深度能力需微调;数据质量直接决定效果,需准备高质量行业数据。合规安全:金融、政务等敏感行业需数据本地化与隐私保护;务必开启 VPC、IP 白名单、TLS 加密,定期轮换 AK/SK。成本陷阱:微调、存储、网络流量单独计费,并非仅模型调用费;需设置预算告警,避免意外高额账单。七、核心总结盘古大模型是企业级中文行业大模型,免费额度适合测试与轻量场景,付费版提供高可用与行业定制能力;具备强中文、强行业、强安全优势,但存在个人受限、英文弱、硬件绑定等限制。

阶跃星辰图标

阶跃星辰

阶跃星辰 StepFun 开放平台使用指南一、平台总结阶跃星辰 StepFun 开放平台(platform.stepfun.com)是由上海阶跃星辰智能科技推出的自研多模态大模型开放平台。该平台提供千亿/万亿参数语言、视觉、图像、语音、视频等全系模型 API 与在线体验。核心优势:主打极速推理、低成本、长上下文(256K)、强 Agent 能力。服务对象:支持开发者构建 AI 应用与智能体,同时面向普通用户提供对话、生图、文档分析等工具。二、主要功能1. 核心模型能力语言大模型:Step 3.5 Flash:Agent 旗舰模型,永久免费,支持工具调用。Step‑2:万亿参数模型。Step‑1:千亿参数模型。通用能力:支持256K 上下文、代码/数学/长文本理解、工具调用。多模态大模型:Step‑1V/1o turbo:支持视觉理解、图文生成、OCR、图表解析。Step Image Edit 2:支持文生图/图生图/局部编辑,0.7–2 秒出图。语音/视频模型:StepAudio:支持语音对话/合成。Step‑Video:支持文生视频/图生视频。2. 开发与应用工具API 开放:提供 RESTful 接口,支持 Python/Node.js 等多语言接入,涵盖模型调用、图像生成、语音合成等接口。Agent 开发(Step Plan):提供智能体构建框架,支持Coding 到 Agent 全流程、多模型路由、主流 Agent 框架适配。在线体验中心:无需代码,可直接对话、生图、解析文档、体验模型能力。知识库与搜索:支持长文档问答、联网搜索、知识库私有部署。三、适用人群开发者/AI 创业者:需要低成本、高性能大模型 API来构建应用(如聊天机器人、内容生成、数据分析)。Agent 智能体开发者:专注于自动化工作流、任务型 AI、企业流程自动化场景。内容创作者:包括文案/海报/漫画/视频创作者,用于快速生图、文案生成、视频制作。企业用户:需要私有知识库、长文档分析、智能客服、内部工具的企业团队。普通用户:需要日常 AI 对话、信息查询、简单创作、学习辅助的用户。四、免费与付费情况1. 免费资源(长期有效)Step 3.5 Flash 模型:永久免费,无调用次数/Token 上限,支持256K 上下文、工具调用、Agent 能力。新用户注册:赠送通用免费额度,可用于全系模型。V0 免费层:限制为 5 RPM(每分钟请求数)、10 QPM(每分钟查询数)、500 万 TPM(每月 Token 数)。图像模型公测:Step Image Edit 2 限时免费调用。2. 付费方案定位:面向开发者的包月 Token 订阅,支持 Step 3.5 Flash 等模型。档位权益:Flash Mini:49 元/月(社区半价 25 元/月)。Flash Plus:99 元/月。Flash Pro:199 元/月。Flash Max:399 元/月。包含权益:全档位高速推理(无限速区分)、额度复用、优先调度、技术支持。3. 按量付费(API 调用)语言模型:输入约0.004 元/千 Token,输出约0.012 元/千 Token。图像模型:Step Image Edit 2 收费约0.02 元/张。企业定制:涉及私有部署、专属模型、高并发支持,需联系商务定价。五、如何使用(快速上手)1. 注册与获取 API Key访问官网 **https://platform.stepfun.com**。使用手机号进行注册或登录。进入账户管理→API Key,创建并复制 Key(用于接口调用)。进入体验中心,可直接在线对话、生图、解析文档。2. 在线体验(无代码)进入模型体验→对话,选择 Step 3.5 Flash,开始聊天、写文案或写代码。进入图像生成,输入提示词,生成图片(支持尺寸/风格调整)。上传文档或图片,获取总结、解析、问答结果。3. API 调用(Python 示例)pythonimport requests url = "https://api.stepfun.com/v1/chat/completions" headers = { "Authorization": "Bearer YOUR_API_KEY", "Content-Type": "application/json" } data = { "model": "step-3.5-flash", "messages": [{"role": "user", "content": "什么是阶跃星辰?"}] } response = requests.post(url, headers=headers, json=data) print(response.json()) import requests url = "https://api.stepfun.com/v1/chat/completions" headers = { "Authorization": "Bearer YOUR_API_KEY", "Content-Type": "application/json" } data = { "model": "step-3.5-flash", "messages": [{"role": "user", "content": "什么是阶跃星辰?"}] } response = requests.post(url, headers=headers, json=data) print(response.json()) 4. Agent 开发(Step Plan)进入Step Plan→创建 Agent。选择模型、配置工具(如搜索/知识库/代码)。定义任务流程、触发条件、输出格式。一键部署为 API 或 Web 应用。六、避坑点(关键注意事项)免费模型限制:Step 3.5 Flash 免费但禁止商用/对外提供服务。若涉及商用场景,必须订阅 Step Plan 或按量付费,否则可能封禁账号。Token 消耗管控:长文本、多轮对话、图像生成Token 消耗快,免费额度有限。建议分批处理、精简提示词、监控用量。图像生成短板:中文汉字渲染易出错。复杂空间指令理解较弱、风格迁移稳定性一般。建议使用英文提示词 + 明确风格参数。API 调用频率:免费层RPM/QPM 限制严格。高频调用需升级订阅,避免短时间大量请求导致限流。数据安全与幻觉:公开对话/上传文档可能被模型学习。敏感信息需用私有知识库隔离。模型存在幻觉,关键结果需二次验证。模型选择适配:简单对话用Step 3.5 Flash(免费)。长文本/复杂推理用Step‑2/1。图像用Step Image Edit 2。避免大材小用或模型不匹配。

腾讯混元图标

腾讯混元

腾讯混元 AI Studio 平台使用指南简介腾讯混元 AI Studio(aistudio.tencent.com)是腾讯自研的多模态 AI 创作与开发平台,集成文本、图像、视频、3D、语音等能力,面向创作者、开发者与企业提供从创意生成到应用落地的全链路工具与服务。一、主要功能1. 多模态生成文本交互:支持对话、创作、摘要、翻译、代码生成,具备长文本上下文处理能力(Hy3 preview 达 256K)。图像生成:支持文生图、图生图、风格化、高清修复;混元生图 3.0 支持毫秒级响应与高精度输出。视频生成:支持文生视频、图生视频、镜头优化、自动配乐;涵盖写实/动漫/CGI 风格。3D 创作(混元 3D Studio):支持文生 3D、图生 3D、组件拆分、自动拓扑、UV 展开、纹理生成、骨骼绑定;支持人形/道具生成,3.0 模型精度提升 3 倍。语音与音频:支持 AI 播客生成、多语种语音合成、实时语音转写。2. 开发与定制工具LoRA 训练:利用自有数据训练个性化小模型,快速定制风格或领域能力。可视化工作流:提供拖拽式节点编辑工具,组合模型模块构建自动化 AI 流水线。知识库问答:支持上传文档构建私有知识库,实现精准问答与内容检索。开源模型库:开放语言、图像、视频、3D、动作(HY-Motion 1.0)等开源模型,支持本地部署与二次开发。3. 特色能力联网搜索:实时获取信息并整合回答,增强内容时效性。数字人分身:创建个性化 AI 数字人,支持表情驱动与动作生成。多语种翻译:Hy-MT2 模型支持 33 种语言互译,轻量版 440MB 可手机本地部署。二、适用人群内容创作者:适用于设计师、插画师、视频博主、文案写手,用于快速生成创意素材与内容。开发者/研究者:适用于 AI 工程师、算法研究员、学生,用于模型调用、二次开发、学术实验。游戏/影视从业者:适用于美术师、建模师、动画师,用于 3D 资产、角色、场景、特效的快速制作。企业/团队:适用于市场、运营、客服、教育团队,用于内容批量生成、智能客服、数字人直播、课件制作。普通用户:适用于爱好者、学习者,用于日常创意、娱乐、学习辅助。三、免费与付费情况1. 免费额度(需实名认证)文本(Hy3 preview 等):首次开通赠 100 万 tokens(有效期 1 年);日常 1 万 tokens/天,学生认证 5 万 tokens/天。图像(混元生图):50 次免费调用(有效期 1 年)。视频:每日标准模式 4 次/2K 高清 1 次免费生成额度。3D Studio:申请通过后每日 30 点,每功能消耗 1 点。知识库:开通赠 300 万字符免费容量(有效期 6 个月)。联网搜索:首次开通赠 5000 次免费调用(有效期 2 个月)。2. 付费模式(免费耗尽后)文本:按 tokens 阶梯计费,Hy3 preview 输入 0.002 元/千 tokens、输出 0.008 元/千 tokens;支持预付费资源包/后付费日结。图像:混元生图 3.0 0.5 元/张,轻量版 0.09 元/张;支持资源包/后付费。视频/3D:按调用次数/算力消耗计费,具体以控制台为准。3. 重要规则不自动扣费:免费/资源包耗尽后不自动转后付费,需手动开通。调用失败不计费:需排查错误原因(如参数错误、网络问题)。四、如何使用(快速上手)1. 注册登录访问 https://aistudio.tencent.com/。使用微信/QQ 登录,完成腾讯云实名认证(个人/企业)。2. 开通服务进入控制台,按需开通“混元大模型”“生图”"3D Studio"等服务。领取免费额度。3. 在线体验(推荐新手)文本:直接在首页对话框输入问题/指令。图像:进入“生图”页,输入提示词→生成→下载。3D:申请“混元 3D Studio"权限,通过后进入创作,支持文生 3D/图生 3D/模型编辑。4. API 调用(开发者)获取 API 密钥:腾讯云控制台→访问管理→API 密钥→创建 SecretId/SecretKey。集成 SDK:用 Python/Java 等调用接口,支持高并发批量生成。5. 训练与定制进入“工具箱”→LoRA 训练/工作流搭建。上传数据配置参数,快速定制模型。五、避坑点(常见问题与注意事项)1. 账号与权限必须实名认证:未认证无法开通服务、领取免费额度,API 调用会返回 403 错误。3D Studio 需申请:默认未开放,提交申请后审核约 1–3 个工作日,每日 30 点需合理分配。避免多账号滥用:同一身份证限注册 1–2 个账号,频繁换 IP/代理易触发风控封号。2. 生成质量与稳定性提示词需精准:文本/图像生成避免模糊描述,3D 生成需明确风格、比例、细节(如“写实风格,女性角色,全身,8K 高清”)。3D 模型限制:复杂模型(如机械、多层结构)易破面/生成失败,拓扑面数不可控;人形生成稳定性高于道具。图像/视频瑕疵:高速生成可能出现细节错误(如人脸变形、肢体异常),需多次生成筛选或后期修复。3. 计费与额度免费额度有有效期:文本 100 万 tokens/图像 50 次均为 1 年有效期,到期清零不补发。不自动扣费:免费耗尽后调用报错(429 限流),需手动购买资源包或开通后付费,避免影响业务。API 调用失败不计费:但需排查错误原因(如参数错误、网络问题),避免频繁无效调用浪费额度。4. 版权与合规生成内容版权:免费/付费生成内容仅限个人非商用;商用需购买企业授权,否则面临侵权风险。禁止违规内容:生成色情、暴力、政治敏感、侵权内容会被限流/封号,甚至追究法律责任。六、总结腾讯混元 AI Studio 是国内领先的一站式多模态 AI 平台。优势:功能全面、免费额度友好、上手门槛低,兼顾普通用户创意需求与开发者定制开发场景。使用建议:使用时需注意实名认证、提示词优化、额度管理、版权合规。目标:避开常见坑点,最大化利用平台能力提升创作与开发效率。

讯飞星火图标

讯飞星火

讯飞星火官网功能与使用指南总结01 平台概览讯飞星火是科大讯飞自研的国产认知智能大模型平台。该平台主要聚焦于中文理解、多模态交互及办公提效。截至最新信息(2026 年 5 月),V4.0 版本已全面免费开放核心能力,其性能对标 GPT-4 Turbo,尤其在语音交互与本地化场景落地方面具有显著优势。02 核心功能体系平台构建了七大核心能力,并覆盖多种场景工具,具体包括:多模交互能力多模理解:支持图片识别、视觉问答以及 PDF、Word 等文档的深度解析。多模生成:具备文生图、虚拟人视频生成及语音合成功能(支持 74 种语种/方言)。语音优势:具备高识别率与免切换特性,支持长语音转写与实时对话。文本与知识能力内容创作:可一键生成文案、报告、论文、小说及 PPT。知识问答:涵盖百科、行业知识查询、长文摘要及多语种翻译。逻辑与数学:提供逻辑推理、题目解题、代码生成与纠错服务。星火个人空间知识库管理:支持上传多类型文件(文档/音视频/图片),实现对话式问答。智能处理:提供智能总结、AI 润色、一键生成 PPT 及会议纪要、周报等功能。格式支持:支持多种文件格式导出,方便工作流整合。星火智能体开箱即用:提供 36000+ 垂直应用,覆盖办公、教育、医疗、金融、政务等场景专用助手。自定义创建:支持可视化编排与结构化指令,帮助用户快速搭建专属 AI 工具。开发者与企业服务API 接入:全平台(Web/Android/iOS/Windows)支持,具备流式响应与毫秒级首帧能力。私有化部署:提供企业级定制服务、数据加密及等保三级合规方案。03 适用人群根据用户身份与需求,平台主要服务于以下四类人群:个人用户学生群体(作业辅助/备课/学习)。职场人士(文案撰写/PPT 制作/周报整理)。创作者(自媒体内容/文案创意)。普通用户(日常聊天/知识问答/生活助手)。专业人士教师(教案编写/出题/教学辅助)。程序员(代码生成/调试/文档注释)。设计师(文生图/创意灵感/素材处理)。咨询师(报告撰写/方案规划)。企业/团队办公提效(会议纪要/文档自动化处理)。客服团队(智能问答/客户支持)。内容团队(批量创作/多语言处理)。开发者与技术团队个人开发者、中小企业及大型技术团队。需求包括 API 调用、模型微调及私有化部署集成。04 免费与付费政策平台采用“基础免费 + 高阶付费”的模式,具体内容如下:免费服务范围(永久免费)基础体验:网页版、App 及小程序的核心功能无需注册即可使用。免费内容:包含基础对话、文本生成、语音输入、图片理解、PPT 生成及长文摘要。免费 API 额度:新用户赠送 500 万 Tokens(价值约 1–3 万元),有效期 7–30 天;Lite API 永久免费(QPS=1–3,上下文≤8K)。付费服务范围高阶模型:X 系列(深度推理)、视频生成、私有化部署及模型微调需付费。API 付费:Pro/Ultra 版本价格为 0.21 元/万 Tokens,提供更高分 QPS、更长上下文及流式输出。企业方案:定制化部署、专属模型构建及技术支持,价格需面议。05 快速使用指南通过三个步骤即可快速上手使用:入口与登录网页端:访问 xinghuo.xfyun.cn,无需注册即可对话。移动端:在 App Store 下载“讯飞星火”App,或在微信小程序搜索“讯飞星火”。登录建议:建议使用手机号验证码注册登录,以解锁个人空间、历史记录及企业认证功能。核心操作对话提问:在输入框输入问题或指令,可点击麦克风进行语音输入;支持直接上传图片/PDF/Word 文件进行问答。功能导航:点击首页“新建对话”、“个人空间”(文件管理)、“智能体”(场景助手)或“开发者中心”(API 接入)。提示词技巧:遵循“角色 + 任务 + 要求 + 输出”原则,例如:“你是职场导师,帮我写一份 300 字周报,风格简洁专业”。进阶玩法个人空间:上传文档→利用智能总结/问答/润色功能→一键生成 PPT 或报告。智能体:搜索特定场景(如"PPT 生成助手”)直接使用;或自定义创建专属智能体。API 开发:注册开发者账号→创建应用→获取 APPID/APIKey/APISecret→在线调试或直接集成。06 注意事项与避坑指南在使用过程中,请注意以下高频问题与限制:免费额度限制降级响应:深度任务(如连续追问、长文档解析、完整项目代码)在免费账户下易出现响应降级或提示“负载高”。API 限制:免费 API 的 QPS(每秒查询率)较低,上下文较短,不支持流式输出,不适合批量或实时场景。功能边界说明高级功能:视频生成、深度推理(X 系列)、私有化部署在免费版中不可用,需通过付费或企业方案解锁。代码生成:免费版偶尔会出现变量错误或缩进问题,建议对生成代码进行人工复核。数据与安全合规数据隐私:免费版对话数据可能用于模型训练,涉及商业机密或隐私数据时,建议切换至企业私有化部署。渠道安全:警惕非官方镜像站或代充渠道,存在数据泄露与账号封禁的高风险。使用体验建议高峰期错峰:工作日上午 9–18 点为高峰时段,可能出现响应慢或排队现象,建议错峰使用。多模态质量:免费版在文生图/视频生成方面的画质与速度一般,对高阶效果有要求时建议付费升级。

MiniMax图标

MiniMax

MiniMax 指南一、公司概览1. 基本背景成立时间:2022 年初公司定位:通用 AI 公司官网地址:minimaxi.com核心产品:M2.7 大模型与 Agent 智能体覆盖模态:文本、语音、视频、图像、音乐五大领域2. 核心优势自我进化能力:模型具备持续学习与优化机制。编程与办公自动化:强编程能力,擅长复杂 Office 操作。多智能体协作:支持多 Agent 并行处理复杂任务。二、核心功能与模型1. 模型矩阵(全栈多模态)M2.7 文本模型上下文长度:支持 200K 超长上下文。核心能力:自我进化,强编程(SWE 评测 56.22%),复杂 Office 自动化(Excel/Word/PPT 多轮编辑)。M2-her 角色扮演多角色沉浸扮演,适配长轮次复杂对话。Speech 2.8 语音模型具备拟人化语音合成与识别能力。Hailuo 2.3 视频模型支持动态视频生成,分辨率达 768P,时长 6 秒。Music 2.6 音乐模型支持翻唱与器乐生成。2. Agent 智能体(核心产品)自主组队:根据任务复杂度自动召集 Agent 小队并行解决问题。记忆与个性化:自动沉淀用户习惯,越用越默契。全场景指令:在对话框中可直接创建技能、管理记忆、设置定时任务。桌面端集成:支持全局唤起(快捷键 Alt+A / Option+A)。可直接操作本地文件与系统,无需打开浏览器。3. 开发与企业服务MCP Server:开放视频、图像、语音生成及声音克隆 API。API 平台:提供 Token 套餐,支持高并发调用。企业定制:提供私有部署、模型微调及行业解决方案。三、适用人群个人用户:适合日常聊天、内容创作、学习辅助及简单办公自动化。职场人士:白领、运营、分析师等,用于处理复杂的 Excel/PPT/Word 任务、数据处理及报告生成。开发者/程序员:用于代码生成、调试、工程化开发及 API 集成。创作者:适合进行视频/音频/音乐生成、文案创作及多模态内容制作。企业/团队:用于客服自动化、内部知识库管理、办公流程提效及定制化 AI 应用开发。四、免费与付费情况更新时间:2026 年 5 月1. 免费版(基础体验)初始额度:注册赠送 1000 免费积分。日常限额:每日提供有限的免费请求次数。功能权限:基础对话、简单文本生成、有限文件上传(≤100MB)、基础语音/图像生成。主要限制:请求频率低、输出长度受限、无高级 Agent 组队、无优先算力。2. 付费套餐(个人/API)Starter(入门版)首月价格:¥26.1 / 连续包月:¥29请求额度:每月 24000 次性能指标:TPS=50包含模型:含 M2.7 基础权限Plus(进阶版)首月价格:¥44.1 / 连续包月:¥49请求额度:每月 60000 次性能指标:TPS=50增强功能:额外增加 Speech 与图像生成额度Max(专业版)年付价格:$500特点:高请求量、高 TPS、全模型权限、视频生成额度充足API 定价输入成本:$0.30 / 百万 token输出成本:$1.20 / 百万 token优势:性价比高,适合批量开发3. 企业版定制方式:定制化报价服务内容:私有部署、专属算力、数据隔离、专属技术支持。五、如何使用(快速上手)1. 网页端操作(agent.minimaxi.com)注册登录:通过手机号或邮箱完成注册/登录。下达指令:进入 Agent 对话框,输入自然语言指令(例如:“生成季度销售 PPT")。文件处理:上传文本、Excel、图片等文件,Agent 会自动解析并执行任务。结果管理:查看生成结果,支持多轮修改与文件导出。2. 桌面端操作(推荐高效)下载安装:从官网下载对应系统的安装包(支持 Windows/macOS/Linux)。配置权限:安装后登录,设置工作目录与隐私权限。快捷键唤起:使用快捷键(Alt+A / Option+A)直接唤起 Agent。本地操作:直接对本地文件进行读取与编辑操作。3. API 接入(开发者)获取密钥:注册平台账号,获取 API Key。选择套餐:按需选择 Token 套餐。集成应用:调用 M2.7 或各多模态模型 API,集成至自有应用,支持高并发与自定义开发。六、避坑指南(重要提醒)额度规划:免费版额度有限,高频使用易触发限流,建议合理规划请求量或及时升级。指令精准:避免模糊指令(如“做个报告”),需明确格式、字数、风格及参考文件,以减少结果偏差。文件限制:免费版单文件上传≤100MB,付费版额度更大;上传敏感文件前建议先进行脱敏处理,注意隐私保护。任务拆解:超长任务(如万字文档分析)建议分批次处理,避免超时或输出截断。算力波动:高峰时段(工作日 9-18 点)响应可能变慢,付费版享有优先算力更稳定。模型能力边界:M2.7 自我进化需依赖高质量数据,专业领域关键结果仍需人工校验。合规风险:生成内容需遵守版权法,商业使用需确保素材授权,避免侵权风险。七、总结MiniMax 以 M2.7 自我进化模型 与 Agent 智能体 为核心竞争力,具备全模态处理能力。其服务模式兼顾了免费体验与高性价比付费方案,能够满足个人提效、职场办公、开发创作及企业服务等多种场景。使用建议:遵循指令精准原则。合理规划免费额度与算力需求。严格遵守隐私合规要求。复杂任务分步执行可显著提升任务成功率。

Moonshot AI图标

Moonshot AI

Moonshot AI使用指南一、产品核心定位Moonshot AI(月之暗面)是一家聚焦于通用人工智能(AGI)研发的科技公司。核心产品:Kimi 智能助手。主打优势:拥有 200 万字无损长上下文 处理能力,具备 原生多模态理解 能力。官方网站:https://www.moonshot.cn/二、主要功能特点超长文本处理支持单篇 200 万字 文档的深度解析。兼容格式包括 PDF/Word/Excel/PPT/图片等。具备摘要生成、多文件对比分析及多文档整合分析能力。原生多模态理解(K2.6)支持图文深度解析。实现视觉内容转代码。提供多语言精准翻译服务。超强代码与 Agent 能力提供代码生成与代码解释服务。支持自主规划与任务执行。配备 Agent Swarm 集群,可实现多智能体并行处理复杂任务。智能创作与办公提效支持长文内容生成。可自动编辑 PPT 与表格。擅长学术文献分析、合同审查及财报解读。联网搜索增强具备实时信息检索能力。确保回答内容的时效性与准确性。Kimi Claw 智能体服务支持云端托管。拥有长期记忆功能。支持自动化工作流搭建与定时任务推送。三、适用人群知识工作者科研人员:文献综述与资料整理。律师:合同审查与法律条文分析。分析师:行业报告生成与财报解读。内容创作者自媒体:长文写作与脚本生成。视频创作者:视频脚本创作。文案策划:多轮次内容创作。开发者/技术团队代码开发与 Debug。数据处理与自动化工作流搭建。API 调用集成需求。企业用户金融/法律/科研机构定制化服务。智能客服搭建。批量文档处理需求。普通用户日常问答。学习辅助。简单内容创作。四、价格与订阅体系1. 个人免费版(永久免费)基础权益:提供基础对话功能、20 万字上下文支持、文件解析(限制≤20 万字)、基础搜索及多端同步。使用限制:每日消息限额(约 30–50 条)、高峰时段可能有响应延迟、无法使用高级 Agent 功能。2. 个人付费订阅(Coding Plan)提供按月或按年付费的订阅服务,包含不同等级的 Token 配额与功能权益。Andante(¥49/月)搭载 K2.5 模型。包含 5 小时 Token 配额。提供 AI 建站、AI 文档、AI PPT 制作权益。Moderato(¥99/月)提供更大的 Token 配额。支持多设备共享账号权益。支持使用 Kimi CLI 命令行工具。Allegretto(¥199/月)提供 20 倍代码额度。提供 4 倍 Agent 额度。解锁 Agent Swarm 集群 功能。可使用 Kimi Claw 智能体服务。Allegro(¥699/月)提供企业级算力支持。提供无限 Token 额度。配备专属技术支持。单次打赏(高峰优先)¥5.2(4 天优先)、¥9.9、¥20.8、¥399(年包会员)。非强制性,用于缓解算力紧张时的排队延迟。3. API 接口计费(按量付费)K2.6 模型输入:¥6.5 / MTok。输出:¥27 / MTok。缓存命中:¥1.1 / MTok。K2.5 模型输入:¥4.0 / MTok。输出:¥21 / MTok。缓存命中:¥0.7 / MTok。五、使用指南1. 访问入口(多端同步)网页端:直接访问 https://kimi.moonshot.cn/。手机 APP:前往 iOS 或安卓应用商店搜索“Kimi 智能助手”。桌面客户端:通过官网下载 Mac 或 Windows 版本客户端。微信:在微信搜索“Kimi 智能助手”小程序。2. 基础操作步骤注册登录:使用手机号完成注册并登录(免费版即可使用)。输入指令:在输入框中提出问题,或点击“上传文件”按钮添加文档、图片及链接。获取结果:等待 AI 处理完成,获取结果后可进行追问、细化指令或调整格式。3. 进阶使用技巧自定义指令:在提问时指定输出格式,例如“分条列出核心要点,每条≤30 字”。多文件对比:同时上传多篇文档,例如指令“对比这 3 篇文章的选题与结构”。Agent 集群任务:输入复杂任务,例如“盘点 10 个领域顶级 AI 工具并制表”,系统会自动调度多智能体并行处理。六、避坑与注意事项1. 性能与速度高峰延迟:免费版在算力紧张时响应较慢,建议错峰使用或升级付费计划。上下文管理:免费版会话上下文累积超限(20 万字)后需新建会话重置;超出上限需拆分内容或升级。2. 功能限制创意能力:模型擅长逻辑处理与信息检索,在纯诗歌、小说等创意领域表现较弱,建议搭配专用创意工具。付费解锁:Kimi Claw、Agent Swarm 集群及 200 万字上下文功能需在 Allegretto 及以上订阅档位获取。3. 技术与安全API 配置:官方 Base URL 为 https://api.moonshot.cn/v1,配置时勿写错后缀。若密钥无效需重新生成。合规风险:避免上传侵权或敏感内容,平台拥有内容审核权限,违规可能导致服务流或封号。

百度AI图标

百度AI

百度大脑百度大脑是百度推出的产业级 AI 开放平台,汇聚语音、图像、NLP、大模型等 270+ 项核心能力。平台提供 API/SDK 与低代码工具,助力个人与企业快速落地 AI 应用。一、主要功能体系1. 视觉能力文字识别:通用/手写文字识别(OCR)、身份证/行驶证/增值税发票识别。生物识别:人脸实名认证。内容分析:图像增强、视频内容分析。2. 语音技术语音识别:短/长语音识别(ASR)。语音合成:大模型语音合成(多情感/多方言)、语音转文本(TTS)。声音技术:声音复刻、端到端语音语言大模型。3. 自然语言与大模型文心大模型:知识增强千亿级模型、千帆大模型平台。应用场景:智能写作、合同预审、机器翻译等。4. 开发与低代码工具模型训练:EasyDL(零门槛模型训练)。开发支持:API 在线调试、多语言 SDK。行业方案:智能客服、数字员工、安全生产等行业解决方案。二、适用人群个人开发者/学生用于学习 AI 技术、进行练手项目开发。场景:小型工具开发(如语音笔记、图片文字提取)。中小企业/创业者需要低成本集成 AI 能力,无需自研算法。场景:发票验真、人脸核验、智能客服等。行业用户需要场景化赋能的垂直领域。场景:金融(单据识别)、教育(作业批改)、政务(实名认证)、制造(安全生产)。合作伙伴/服务商基于平台能力开发垂直应用。入驻 AI 市场获客。三、免费与付费情况1. 免费额度(新用户/基础版)免费额度按日重置,领取后约 30 分钟生效。文字识别:通用 OCR 约 500 次/天。手写识别:约千次(单价低至 3.8 元)。语音服务:短/长语音识别、语音合成各约 500 次/天。声音复刻:1 次免费调用。人脸识别:500 次免费调用。大模型:文心一言基础版免费体验,高级模型按量计费。2. 付费模式(按量/套餐)高精度 OCR:约 8 元/千次。身份证识别:约 7.6 元/千次。语音合成:约 4 元/千次。声音复刻:约 4 元/次。发票验真:约 0.15 元/次。企业级服务:千帆平台定制化报价,支持包年/包月。四、如何使用(5 步快速上手)注册登录使用百度账号登录 ai.baidu.com,进入控制台。创建应用选择技术分类(如文字识别)→ 创建应用 → 生成 API Key/Secret Key。领取免费额度在概览页领取对应接口的免费资源(注意生效延迟)。开通接口在服务列表中勾选需调用的接口并开通。注意:仅获取 Key 无法调用,不用的接口建议关闭。调用测试使用 API 调试工具或 SDK 集成,填入 Key 即可调用。可在监控报表中实时查看用量。五、避坑要点与注意事项额度与计费风险免费额度按日重置,但调用失败(如鉴权错误)也可能消耗额度。额度用完后若未及时付费会报错,建议提前购买套餐或套餐包。接口启用机制创建应用后必须手动开通接口,否则无法使用。建议关闭不用的接口,防止误扣费。生效延迟领取免费额度后,通常约 30 分钟生效,刚领取就调用可能会失败。数据合规要求涉及人脸/身份证识别时,需确保用户授权,遵守《个人信息保护法》,避免违规收集。并发性能限制免费版并发通常较低(≤5 ),高并发需求需提工单申请扩容。模型版本管理个人开发用基础版足够;企业高精度需求选企业版/定制模型。请勿混用不同版本,以免计费或效果异常。