MotionSound MotionSound 是一款基于深度神经网络技术的在线语音合成工具,支持文字转换语音、TTS 播音及多音字处理,可提供自然流畅的语音效果,并支持方言和局部变速合成,适用于配音、播报及人机交互等场景。 AI配音 # TTS # 免费语音合成软件
言之画 言之画(魔音工坊)是一款在线文字转语音与AI配音工具,支持将输入文本快速合成为自然语音,提供不同性别、口音及童声等音色选择。适用于短视频配音、广告配音、宣传片配音、课文朗读、课件配音、有声小说及语音通知等场景。 AI配音 # 在线文字转语音 # 在线配音
酷音 酷音是一款在线 AI 配音与语音合成工具,支持将文字转换为自然语音,适用于短视频解说、步骤提示、课件朗读、有声书及虚拟客服等场景。平台提供普通话、方言和多种外语音色,满足不同内容创作与朗读需求。 AI配音 # AI配音 # 文字转语音
MaskGCT MaskGCT 是 OpenMMLab Amphion 音频、音乐与语音生成工具包中的文本转语音(TTS)模型项目,提供相关模型代码与研究资源,面向语音生成研究、开发及复现使用。平台主管理支持研究人员和工程师快速了解与实践语音合成技术。 AI开发平台 # Amphion # OpenMMLab
Text To Speech Text To Speech 是一款在线文字转语音(TTS)工具,支持文本朗读、语音合成、配音和视频配音等应用。平台提供来自 147 种语言及变体的 456 种语音,涵盖微软 TTS、自然神经语音等能力,适用于语音播报、AI 配音、语音技术开发及语音 SDK 集成。 AI配音 # text to speech # TTS
思必驰 DFM-2 大模型 思必驰 DFM-2 大模型依托 DUI 开放平台,提供智能语音产品开发、对话能力构建与行业定制服务,支持语音识别、语音合成、语义理解、自然语言处理、智能问答及人机交互等功能,适用于语音助手、智能客服等人工智能应用场景。 AI开发平台 # AIspeech # 人工智能定制
ElevenLabs ElevenLabs 是一款 AI 语音生成与语音智能代理平台,支持生成自然逼真的语音内容,提供 5,000 多种声音和 70 多种语言选择。平台配备安全的 API 与 SDK,适用于配音、有声内容、语音应用及智能语音代理开发。 AI智能体 # AI语音生成 # 多语言语音
花生AI 花生AI是一款面向视频创作者的智能语音工具,支持将文字文稿转换为自然语音,适用于口播、短视频配音等场景。用户只需准备好文稿,即可使用花生AI完成文字转语音(Text to Voice)创作,提升视频制作效率。 AI配音 # text to voice # ttv
FunAudioLLM FunAudioLLM 是一个专注于音频与语音大模型的开源项目,提供语音识别、语音合成及相关音频智能技术的项目介绍、模型资源与使用信息,适合开发者了解和应用语音人工智能技术。 AI配音 # 开源项目 # 模型资源
TextToSpeech TextToSpeech 是一款在线 AI 文本转语音工具,支持将文本转换为自然流畅的语音,并可下载生成的高质量音频。适用于内容创作、视频配音、有声读物及多媒体制作等场景,操作便捷,可免费使用。 AI配音 # AI配音 # 文本转语音
Reecho Reecho(悟声 AI)是一款 AI 语音合成与声音克隆平台,提供文本转语音(TTS)、瞬时声音克隆、拟真配音及情感语音生成等功能,适用于视频配音、内容创作、有声读物和多媒体制作等场景。 AI配音 # AI dubbing # AI voice
逗哥配音神器 逗哥配音神器是一款面向短视频创作、广告宣传、有声内容制作等场景的 AI 配音工具,支持在线文字转语音、语音合成、童声配音、宣传片配音、课文朗读、课件配音、自定义语音通知和有声小说配音等功能。平台还提供文案提取、人声分离等短视频常用辅助工具,适合需要快速生成配音素材的个人创作者和内容团队使用。 AI配音 # AI配音 # 人声分离
CosyVoice2.0 CosyVoice2.0 是 FunAudioLLM 团队推出的语音生成与语音合成相关项目页面,主要展示 CosyVoice2.0 的技术介绍、模型能力、示例效果和使用资源。该项目面向语音合成、声音克隆、多语种语音生成等应用场景,适合研究人员、开发者及语音 AI 应用团队了解模型进展、体验演示并获取相关文档与代码资源。 AI配音 # FunAudioLLM # 声音克隆
Voicebox Voicebox 是 Meta AI 展示的文本引导多语言通用语音生成研究项目,聚焦大规模语音合成与编辑能力。网站介绍 Voicebox 在跨语言语音生成、文本到语音、语音修复和内容编辑等方向的技术思路与示例,适合关注生成式 AI、语音合成、多语言语音处理和人工智能研究的用户参考。 AI学习资源 # Meta AI # 多语言语音
Dubbing大饼AI声音 Dubbing大饼AI声音是一个面向音频与视频内容制作的 AI 声音工具平台,提供在线语音合成、配音生成等相关能力。用户可通过网页端访问服务,用于短视频配音、内容解说、课程音频、广告旁白等场景,帮助提升音频制作效率。该网站适合需要 AI 配音、智能声音生成和多场景语音制作工具的用户参考使用。 AI配音 # AI配音 # 声音生成
Audiobox Audiobox 是 Meta 推出的一款 AI 音频生成平台,支持通过文本描述、语音输入和音频示例等多种方式创建音频内容。该工具基于深度学习模型,能够生成语音、音效和环境声音,适用于音频创作、配音制作、声音设计等场景。用户可以通过自然语言描述所需音频效果,系统会自动生成相应的声音内容。Audiobox 提供灵活的控制选项,允许用户调整音频风格、音色特征和声 AI配音 # Meta # 声音设计
讯飞智作-AI配音 讯飞智作-AI配音是科大讯飞旗下的在线配音与视频制作平台,提供文字转语音、语音合成、短视频配音、数字人配音、AI虚拟人主播和虚拟人视频制作等服务,适用于内容创作、宣传视频、课程讲解、直播等场景,帮助用户快速生成配音与视频内容。 AI配音 # AI虚拟人 # 在线配音
魔珐星云 魔珐星云是面向开发者与企业的 3D 具身智能体基础设施平台,提供 AI 数字人实时驱动、数字人视频生成、语音合成等能力。平台支持通过 API 构建超写实 3D 数字人应用,适用于智能客服、内容创作、虚拟主播、交互展示等场景,帮助用户实现低延时、多模态的数字人交互与生成服务。 AI开发平台 # 3D数字人 # 3D数字人API
NaturalReader NaturalReader 是一款专业的文本转语音(Text to Speech)工具,支持在线使用、移动应用和商业授权。该平台采用先进的 AI 语音技术,能够将文字内容转换为自然流畅的语音朗读,适用于个人学习、教育教学和商业场景。 NaturalReader 提供多种语音选项和语言支持,用户可以上传文档、PDF、网页文本等多种格式进行语音转换。平台既有免费 AI配音 # AI朗读 # TTS
IBM Watson文字转语音 IBM Watson 文字转语音是 IBM Cloud 提供的语音合成服务,支持将文本转换为自然语音,适用于应用程序、客服系统、无障碍阅读、内容播报等场景。该服务提供多语言和多种声音选项,可通过 API 集成到网站、移动应用或企业系统中,并支持云端 SaaS 使用及相关部署方案。IBM Watson Text to Speech 适合需要语音交互、自动播报和 AI开发平台 # AI配音 # API集成
刺鸟配音 刺鸟配音是一款在线文字转语音与 AI 智能配音工具,提供多种合成声音选择,适用于短视频配音、影视解说、课文朗读、有声小说、广告旁白等场景。平台支持用户将文字快速生成语音,包含部分热门声音可免费使用,适合内容创作者、教育学习和日常音频制作需求。 AI配音 # AI智能配音神器 # AI配音
Dubverse.ai Dubverse.ai 是一个基于生成式人工智能的视频本地化与语音生成平台,提供 AI 视频配音、AI 文本转语音、自动字幕生成及 API 接入等功能。平台面向内容创作者、企业和开发者,帮助用户将视频内容转换为多语言版本,提升内容传播效率和跨语言覆盖能力。Dubverse.ai 适用于视频翻译、字幕制作、语音合成和内容国际化等场景。 AI配音 # AI配音 # 文本转语音
VALL-E VALL-E 是微软研究院推出的神经编解码语言模型项目,将文本转语音视为条件语言建模任务,可基于离散音频编码生成语音。其特点是具备上下文学习能力,能够使用未见说话人的短音频提示合成个性化语音。扩展版本 VALL-E X 支持多语言语音生成,可在目标语言中保留说话人的声音特征、情感和声学环境,适合关注语音合成、AI 配音和多语言 TTS 技术的用户了解。 AI配音 # AI配音 # TTS
SpeechEasy SpeechEasy 是一款基于 AI 和机器学习的文本转语音工具,可将文字内容转换为清晰自然的音频。平台提供高质量合成语音,适合在通勤、居家或办公场景中收听文章、文档等文本内容。SpeechEasy 注重易用性与可理解性,帮助用户更便捷地进行信息获取和音频内容生成。 AI配音 # AI语音 # TTS