分类导航

发现更多优质 AI 工具

全部 编程代码 创作写作 视频音频 图像视觉 学习辅导 办公效率 设计创意 大模型 提示词 Skills 自动化 知识库 开源 副业
万相图标

万相

通义万相是阿里云通义大模型旗下的多模态生成平台,主打 AI 视频与图像创作。核心亮点为人声生视频,仅凭一张图和一段音频,即可生成人物动态表演视频,支持卡通、动物等泛化形象,音频能驱动面部与肢体的生动表达。其最新版(Wan2.6)具备文生视频、图生视频、角色扮演、多镜头叙事及音画同步等能力,可生成 15 秒 1080P 高清短片。平台还提供文生图、图像编辑等功能,适合短视频、影视、广告等创意场景,助力用户高效实现电影级创作。

度加创作图标

度加创作

度加是百度推出的一站式 AI 创作平台,主打全流程 AI 赋能,大幅提升内容创作效率。平台功能丰富,涵盖 AI 成片、生文、故事、剧本、动漫视频、高光剪辑、数字人、声音克隆等,覆盖图文、短视频、动漫等多类内容创作需求。它能精准匹配热点、智能生成素材、优化剪辑流程,支持从创作到发布一站式服务,适配美食、科技、动画、美妆等多领域创作者,帮助用户高效产出高质量内容,降低创作门槛。

讯飞听见图标

讯飞听见

讯飞听见是科大讯飞旗下专注 AI 语音转写与多语种翻译的智慧办公 SaaS 平台。依托讯飞星火大模型与 20 余年语音技术积累,其中文识别准确率最高达 98%,支持 11 种语言、多方言及 17 个专业领域优化。平台提供实时录音转写、音频文件快速处理(1 小时音频最快 5 分钟出稿)、说话人区分、AI 会议纪要生成等核心功能,兼具 9 国语言同传、音视频翻译配音及声音克隆能力。广泛服务于会议、教育、媒体、跨境办公等场景,是冬奥会、大运会官方语音服务供应商,兼具高效办公与信息无障碍价值。

即梦AI图标

即梦AI

即梦 AI是字节跳动旗下剪映团队推出的一站式 AI 创意平台,定位 “AI 片场”,主打中文语境创作,2024 年正式上线。平台核心为文生视频 / 图生视频与AI 绘画,支持首尾帧精准控制、流畅运镜与电影级画质,适配国风文化与亚洲人脸特征。集成智能画布,提供局部重绘、一键扩图、图像消除与抠图等功能,满足多场景创作。界面极简易上手,每日登录可获免费积分,降低使用门槛。

Voicemod图标

Voicemod

面向全球用户的实时 AI 变声与音效工具平台,主打低延迟、高还原的语音变换体验,适配 Windows 与 macOS 系统。网站提供丰富语音效果,涵盖机器人、卡通、游戏角色等百余种预设,支持通过 VoiceLab 自定义专属声线,搭配可快捷触发的 Soundboard 音效板,满足直播、游戏开黑、视频聊天等场景需求。平台兼容 Discord、Zoom、主流游戏及直播软件,操作简便,免费版可体验基础功能,付费版解锁全部 AI 音效与高级编辑能力,是玩家、主播打造趣味互动的常用音频工具,官网可直接下载客户端并查看教程与常见问题。

Rasl AI图标

Rasl AI

Rask AI 是一款 AI 驱动的音视频本地化工具,获 340 万用户信赖、G2 评分 4.7/5,支持 130 多种语言,覆盖营销、教育、媒体等场景。核心功能含 AI 翻译配音、唇形同步、语音克隆、多发言人识别、自动字幕生成,可一键完成音视频转写、翻译、配音与字幕制作。平台提供 API 与团队协作,通过 SOC 2 Type II 认证,安全合规,助力企业高效实现内容全球化,降低本地化成本,提升国际传播效率。

Luma AI图标

Luma AI

Luma Labs(lumalabs.ai)是美国加州的 AI 生成内容科技公司,2021 年成立,专注多模态生成与 3D 视觉技术。平台以 NeRF 三维重建、Ray 系列视频模型、Uni‑1 统一多模态模型为核心,提供文生视频、图生视频、3D 建模与渲染等服务。旗下 Dream Machine 可快速生成超写实、运动连贯的电影级视频,支持镜头控制、场景替换、角色一致性生成,广泛用于影视、电商、游戏与内容创作。平台面向普通用户与开发者,提供网页端、移动端及 API 服务,兼顾易用性与专业级效果,大幅降低高质量视觉内容制作门槛。

Tencent Hunyuan 3D图标

Tencent Hunyuan 3D

腾讯混元 3D 使用指南平台简介:腾讯自研混元 3D 3.0 网页端在线 AI 建模平台。 连接方式:国内可直连,无需翻墙。 核心能力:支持文生 3D、图生 3D、草图生 3D。 技术特性:内置 PBR 材质、自动绑骨、拓扑优化。 输出格式:生成 GLB/FBX/STL 通用工业格式。 使用体系:分网页在线创作端 + 腾讯云 API 商用调用两套体系。一、主要功能1. 三大生成入口文生 3D:输入文字 Prompt 即可直接生成道具、角色、载具。图生 3D:支持单图或 8 张多视图照片还原立体模型(原稿名称“唐恩 3D"对应图生功能)。草图 3D:手绘线稿可一键转化为三维资产。2. 专业后处理(Studio 内测)智能工具:包含智能低模拓扑、UV 展开、PBR 全套贴图、人形自动绑骨。动画支持:兼容 Mixamo 动画、文生动作动画、组件拆分。3. 导出格式GLB(推荐):保留材质与拓扑,适合通用使用。FBX:适合动画制作或 Blender 导入。OBJ:通用 3D 格式。STL:专用于 3D 打印(注意:会丢失贴图与 UV 信息)。4. 素材管理个人资产仓库:支持模型预览旋转。材质控制:提供材质开关功能。生成历史:支持生成记录回溯。二、适用人群✅ 适合使用个人群体:设计师、3D 爱好者、学生、手办/3D 打印玩家。内容创作者:游戏独立开发者、短视频/电商美工、AR 物料创作者。企业用户:中小企业美术、快速原型验证、低成本资产批量生产。❌ 不适合高精度需求:电影级高精度影视资产。复杂场景:超大场景地形。工业精密:高精度工业机械建模。三、免费与付费方案(双端区分)1. 网页端在线平台(3d.hunyuan.tencent.com)免费规则:每日 20 次 免费生成额度。次日自动刷新。无需充值即可导出完整模型。无时长限制,仅限制每日生成次数。无网页端月度会员订阅。高频商用:额度用完次日重置,建议走腾讯云 API 积分。2. 腾讯云 API 商用付费(企业/批量调用)入口地址:https://cloud.tencent.com/product/ai3d计费单位:积分(1 积分 = 1 次标准生成)。新用户福利:一次性赠送 100 免费积分,有效期 1 年(需手动控制台领取)。预付费积分包:1000 积分 = 100 元(单价 0.1 元/次)10000 积分 = 980 元(单价 0.098 元/次)50000 积分 = 4750 元(单价 0.095 元/次)100000 积分 = 9000 元(单价 0.09 元/次)后付费模式:按量实时扣费,适合弹性高频业务。四、快速使用步骤登录平台:打开官网 3d.hunyuan.tencent.com,使用微信/QQ 一键登录。选择入口:在首页选择“文生 3D"、“图生 3D"或“草图 3D"。输入参数:输入提示词或上传图片(多视图最多支持 8 张),建议勾选 PBR 材质。调整风格:选择写实/卡通/赛博/陶瓷/金属等风格,点击生成(耗时约 1–7 分钟)。预览与导出:生成完成后预览模型,进入资产页下载对应格式。进阶管线:如需使用拓扑/绑骨/UV 工具,需申请“混元 3D Studio 内测”资格。五、注意事项与避坑指南1. 图片上传规范(关键)光线:使用自然光,避免强光反光。构图:物体占据画面 60%-70%,背景需干净。角度:多视图相邻夹角建议 ≤45°。材质:专业打光的金属图易生成破损模型,需留意。2. 额度与版权红线(⚠️ 重要)额度限制:网页端每日 20 次固定,不可叠加购买。当日耗尽需次日再来。额度独立:网页在线额度与腾讯云 API 积分 互不通用,两套额度独立计算。商用限制:每日免费额度产出仅允许 个人非商用。商业使用:电商、游戏、广告等商业使用 必须 购买腾讯云 API 积分并获取商用授权。3. 生成失败解决方案模型碎裂:降低提示词细节复杂度、减少生成步数。加载空白:清除浏览器缓存、切换 Chrome 浏览器。人脸崩坏:3.0 版本开启“人像优化”开关,关闭“材质增强”选项。预览卡顿:建议缩小浏览器窗口查看大模型。4. 网络与存储稳定性:国内直连稳定。存储安全:模型永久保存在个人资产库,不主动清理。5. 格式导出优先级第一选择:优先使用 GLB(保留材质与拓扑)。特殊用途:STL 仅用于 3D 打印(注意会丢失贴图与 UV 信息)。6. 高级功能获取Studio 工具:高级拓扑、自动绑骨、组件拆分等工具需主动申请内测资格。内测状态:未开通内测时,网页端无相关入口。

HeyGen图标

HeyGen

HeyGen 是全球领先的 AI 数字人视频生成平台,2020 年成立,总部位于美国洛杉矶。平台无需拍摄设备与专业剪辑技能,输入文本即可快速生成专业级视频,广泛用于营销、销售、培训等场景。它提供百余种 AI 数字人形象,支持照片定制、语音克隆、多语言翻译与精准口型同步,适配多场景模板。平台操作简单、生成高效,兼顾个人创作者与企业用户,提供免费及付费套餐,已助力全球大量用户低成本制作高质量视频。

VEED图标

VEED

VEED.IO 中文站(https://www.veed.io/zh-CN)是一款AI 驱动的一站式在线视频编辑平台,主打轻量化、高效率、零门槛创作,无需下载安装,浏览器即可使用。平台提供自动字幕、AI 配音、文本转视频、智能剪辑、画面优化等功能,支持多语种字幕与翻译,适配短视频、企业宣传、课程讲解等多种场景。内置海量免版权素材库,搭配拖拽式操作与协作工具,个人与团队均可快速产出专业视频。平台兼顾免费基础功能与付费高阶能力,界面简洁、上手快,适合内容创作者、自媒体、职场人士高效完成视频制作与二次加工,是轻量化视频创作的实用工具。

ElevenLabs图标

ElevenLabs

ElevenLabs 是 2022 年成立于伦敦的全球顶尖 AI 语音技术平台,专注超逼真语音合成、克隆与多语言配音。平台核心优势是语音自然度行业领先,告别机械感,可精准呈现情感、语气与呼吸细节,适配讲述、对话、角色演绎等场景。支持 70 余种语言,含中文,提供海量预设音色,也可 1 分钟样本克隆声音、自定义声线。功能覆盖文本转语音、语音转语音、多语言配音、AI 音乐与音效生成,适配有声书、播客、视频、游戏、广告等创作。面向创作者、企业与开发者,提供在线工具与开放 API,兼顾个人使用与规模化集成,是 AI 音频创作与全球化内容分发的高效解决方案。

ImagineArt图标

ImagineArt

是一款全球流行的多模态 AI 创意创作平台,主打文本一键生成图像、视频、语音等内容,助力普通用户与创作者高效产出高质量视觉作品。平台集成 Kling、Runway Gen‑4、FLUX 等多款前沿 AI 模型,支持文生图、图生视频、局部重绘、AI 扩图、背景替换、高清放大等专业功能,兼顾写实渲染、艺术插画、角色动画等多元风格。界面简洁易上手,无需专业技能即可快速创作,同时提供网页端与移动端,支持团队协作与内容分享。凭借稳定效果与丰富工具,它广泛用于短视频制作、品牌宣传、个人创意表达等场景,已积累海量用户,是一站式 AI 内容创作的实用选择。