ChatMusician ChatMusician 是一个与音乐生成和音乐理解相关的开源项目页面,面向关注 AI 音乐、音乐语言模型与智能创作工具的用户。网站提供项目介绍、相关资料与在线入口信息,适合用于了解 ChatMusician 的功能定位、研究背景和使用方式。 大语言模型 # AI音乐 # 开源项目
FunClip FunClip 是魔搭社区(ModelScope)上的视频语音识别与片段裁剪工具,基于 FunASR 等模型能力,可自动识别视频中的语音内容并生成文字结果。用户可根据识别文本选择需要的片段,实现按文字定位和裁剪视频,适用于访谈、课程、会议、短视频素材整理等场景,帮助提升视频内容处理效率。 视频编辑 # FunASR # ModelScope
WellSaid labs WellSaid Labs 是一款专注于 AI 语音生成与文本转语音(TTS)的在线工具,面向内容创作者、企业培训、营销视频、产品演示和多媒体制作等场景。用户可将文本快速转换为自然流畅的英文语音,并选择不同声音风格用于音频、视频或课程内容制作。平台强调高质量合成语音、在线编辑与团队协作能力,适合需要提升配音效率、降低录音成本的个人和企业用户参考使用。 AI配音 # AI语音生成 # AI配音
Veed AI Voice Generator Veed AI Voice Generator 是 VEED 提供的在线 AI 语音生成工具,可将文本转换为自然语音,适用于视频配音、旁白、社交媒体内容、教学材料和营销视频制作。用户可在浏览器中输入文本,选择不同语言、口音和语音风格生成音频,并结合 VEED 的在线视频编辑功能进行字幕、剪辑和导出。该工具面向创作者、企业和教育用户,帮助提升文本转语音和视频配 AI配音 # AI语音生成 # 在线剪辑
CosyVoice2.0 CosyVoice2.0 是 FunAudioLLM 团队推出的语音生成与语音合成相关项目页面,主要展示 CosyVoice2.0 的技术介绍、模型能力、示例效果和使用资源。该项目面向语音合成、声音克隆、多语种语音生成等应用场景,适合研究人员、开发者及语音 AI 应用团队了解模型进展、体验演示并获取相关文档与代码资源。 AI配音 # FunAudioLLM # 声音克隆
歌者AI 歌者AI是一个面向音乐与内容创作场景的 AI 工具网站,提供与歌曲生成、歌词创作、音乐灵感辅助等相关的智能化服务。用户可通过平台快速获取创作参考,提升音乐内容制作效率。网站适合音乐创作者、自媒体运营者、短视频制作者及对 AI 音乐创作感兴趣的用户访问使用。 文案创作 # AI音乐 # 内容创作
Krisp Krisp 是一款面向远程会议、跨国沟通和呼叫中心场景的语音 AI 工具,提供实时降噪、AI 会议记录、口音优化和 Call Center AI 等功能。它可帮助用户在 Zoom、Google Meet、Teams 等通话环境中降低背景噪声、提升语音清晰度,并自动整理会议内容,适合远程团队、销售客服、产品访谈和海外协作等高频沟通场景使用。 会议助手 # 会议记录 # 口音优化
录咖 录咖(RecCloud)是一款在线 AI 音视频处理平台,提供语音转文字、AI 字幕、文字转语音、视频翻译等功能,适用于视频创作、课程整理、会议记录、内容剪辑与多语言传播等场景。用户可通过网页在线完成音视频转写、字幕生成、配音及翻译处理,操作流程相对简单,适合个人创作者、教育培训、办公协作和新媒体内容生产使用。 AI配音 # AI字幕 # 会议记录
麦耳会记 麦耳会记是思必驰旗下的语音转写与会议记录工具,提供实时录音转文字、实时翻译、AI字幕、AI摘要等功能,适用于办公会议、在线网课、客户访谈、远程会议等场景。软件支持边录音边转写,录音结束后音频与文本可同步至 PC 端和手机端,并通过云端存储便于跨设备查看与管理文档、音频资料。 会议助手 # AI字幕 # AI摘要
通义听悟-音视频转文字 通义听悟是阿里云推出的音视频内容处理 AI 助手,面向会议、学习、访谈、课程等场景,提供音视频转文字、智能笔记、会议记录整理、内容摘要与语音翻译等功能。平台依托大模型能力,帮助用户更高效地记录、整理和分析音视频信息,适合需要处理录音、视频资料和文档沉淀的个人与团队使用。 会议助手 # AI助手 # 会议记录
摩尔线程数字人 摩尔线程数字人 DigitalME 是面向数字人应用的国产全栈解决方案,支持音色快速复刻、语音识别、AIGC 内容创作加速、低成本形象定制及全双工交互等能力。该方案可用于虚拟客服、数字员工、内容生成、品牌展示等场景,帮助企业构建具备语音、形象和交互能力的数字人服务。 AI配音 # AIGC # 全双工交互
云蝠智能 云蝠智能是面向企业电话沟通场景的 AI 语音智能体服务平台,提供基于大模型的智能呼叫、电话机器人、语音交互与 VoiceAgent 相关能力。平台可用于客户通知、线索跟进、回访调研、营销外呼等业务环节,帮助企业提升电话沟通效率与自动化水平。网站介绍了云蝠智能在 AI 呼叫、智能体呼叫和语音智能服务方面的产品能力与应用方向。 AI智能体 # AI语音智能体 # VoiceAgent
Translate.Video Translate.Video 是一款基于 AI 的视频翻译与配音平台,提供视频字幕翻译、自动配音、旁白生成等功能,支持 75+ 种语言,适用于内容创作者、营销团队、教育机构和企业进行多语言视频本地化。平台通过生成式 AI 提升视频翻译效率,帮助用户更快制作面向全球受众的本地化视频内容。 AI配音 # AI视频 # 多语言本地化
Fireflies.ai Fireflies.ai 是一款面向团队协作的 AI 会议助手,支持自动记录会议、转录语音、生成摘要、提取会议纪要,并可对团队对话进行搜索与分析。它适用于多种视频会议平台,帮助用户集中管理会议内容、查找关键信息、跟进任务与决策。Fireflies.ai 适合远程团队、销售、客户成功、产品和管理等场景,用于提升会议记录效率和信息复用能力。 会议助手 # AI Agent # AI Assistant
网易见外 网易见外是网易人工智能事业部研发的 AI 智能语音转写与听翻平台,提供视频听翻、直播听翻、语音转写、文档直翻、双语字幕、自动切轴、字幕投屏等功能。平台结合语音识别、机器翻译和字幕制作能力,适用于会议记录、演讲授课、视频翻译、直播字幕、文档翻译、商务外贸等场景,帮助用户提升转写翻译效率并降低内容处理成本。 视频编辑 # NMT机器翻译 # 人工翻译视频
Stable Audio Stable Audio 是一款基于人工智能的音乐与音效生成工具,面向初学者、创作者和专业用户。用户可通过文本提示生成原创音乐、背景配乐和声音效果,适用于视频制作、游戏开发、播客、社交媒体内容及其他多媒体项目,帮助提升音频创作效率。 音乐生成 # AI音乐 # 创作者工具
Cassette Cassette 是一个面向音乐创作与音频生成的 AI 工具网站,提供基于人工智能的音乐生成与编辑能力,适用于创作者、制作人及内容团队快速构思旋律、节奏和背景音乐。用户可通过文本提示或创作需求生成音频素材,用于视频、播客、游戏、广告等内容场景。网站聚焦 AI 音乐创作流程,帮助提升音乐制作效率,并为不同类型的数字内容提供可定制的音频方案。 音乐生成 # AI音乐 # 文本生成音乐
Text-To-Song Voicemod Text-To-Song 是一款在线 AI 音乐生成工具,可将用户输入的文本快速转换为完整歌曲。该工具支持多种音乐风格选择,包括流行、摇滚、电子、说唱等类型,用户只需输入歌词或文本内容,AI 即可自动生成带旋律和编曲的音频作品。平台操作简单,无需音乐制作经验,适合内容创作者、社交媒体用户及音乐爱好者快速制作个性化歌曲。生成的音频可用于视频配 音乐生成 # AI音乐 # Voicemod
Uberduck Uberduck 是一个面向音乐、配音和视频创作的 AI 语音工具平台,提供 AI Vocals、文本转语音、声音转换和声音克隆等功能。用户可通过其在线工具生成 AI 人声、制作旁白配音,或将语音应用于歌曲、短视频及内容创作流程。网站适合需要 AI voice、AI generated music、text to speech、voice conversio AI配音 # AI generated music # AI vocals
MochiAni MochiAni(麻薯动画)是一款在线 AI 动画制作平台,面向新手、自媒体创作者和动画短视频用户,提供文字生成动画、剧本转动画、AI 自动配音、口型同步等功能。平台内置动画素材和网页制作引擎,可用于沙雕动画、搞笑动画、简笔画动画、漫剪及小说改动画等内容创作,帮助用户降低动画制作门槛。 AI配音 # AI动画 # MochiAni
曦灵数字人 曦灵数字人是百度推出的AI数字人视频制作与直播平台。平台提供数字员工播报、电商短视频批量生成、智能脚本创作、多语言翻译配音等功能,支持零剪辑基础用户快速完成视频制作。核心能力包括数字员工营销短视频制作、AI智能直播、一站式数字人资产管理,适用于电商带货、企业宣传、内容创作等场景。平台操作简便,提供免费试用,帮助用户降低视频制作门槛,提升内容生产效率。 AI配音 # AI直播 # AI直播平台
NaturalReader NaturalReader 是一款专业的文本转语音(Text to Speech)工具,支持在线使用、移动应用和商业授权。该平台采用先进的 AI 语音技术,能够将文字内容转换为自然流畅的语音朗读,适用于个人学习、教育教学和商业场景。 NaturalReader 提供多种语音选项和语言支持,用户可以上传文档、PDF、网页文本等多种格式进行语音转换。平台既有免费 AI配音 # AI朗读 # TTS
IBM Watson文字转语音 IBM Watson 文字转语音是 IBM Cloud 提供的语音合成服务,支持将文本转换为自然语音,适用于应用程序、客服系统、无障碍阅读、内容播报等场景。该服务提供多语言和多种声音选项,可通过 API 集成到网站、移动应用或企业系统中,并支持云端 SaaS 使用及相关部署方案。IBM Watson Text to Speech 适合需要语音交互、自动播报和 AI开发平台 # AI配音 # API集成
Buzz Buzz 是一款开源的音频转文字工具,项目托管于 GitHub。它基于 OpenAI Whisper 等语音识别技术,支持将音频或视频内容转录为文本,适用于会议记录、字幕制作、播客整理、学习笔记等场景。Buzz 提供桌面端使用方式,强调本地转录与便捷操作,适合需要离线语音识别、音频转写和多语言转录功能的用户参考与使用。 会议助手 # Whisper # 多语言转录