ViiTorVoice-NAR:开源本地AI语音克隆与音频局部编辑工具
ViiTorVoice-NAR是viitor-ai开源非自回归语音生成工具,支持零样本音色克隆、文本局部音频修改、60ms超低延迟推理,提供Gradio可视化、gRPC微服务、Docker容器部署,原生中...
ViiTorVoice-NAR是viitor-ai开源非自回归语音生成工具,支持零样本音色克隆、文本局部音频修改、60ms超低延迟推理,提供Gradio可视化、gRPC微服务、Docker容器部署,原生中...
声咔AI配音是一站式AI语音合成平台,拥有1000+发音人,支持3秒声音克隆、40+语种、多情绪配音、自助调音、AI文案生成、自动字幕下载、海量音效,适合短视频、有声书、知识课...
ChatTTS 是当前对话交互赛道极具优势的开源 AI 语音合成工具,核心优势是专为 LLM 对话场景优化、完整开源可本地部署、双语免费在线试用,兼顾普通创作者轻量化配音与技术人...
VoiceCanvas是网页端一站式AI TTS平台,支持50+语种文本转语音、10秒人声克隆、AI自定义音色、故事多角色配音与自动播客生成,免费试用,支持微信支付宝,适配自媒体、教育...
ControlFoley是小米开源的可控视频音效生成框架,支持文本引导、文本控制、参考音频控制三大配音任务,通过联合视觉编码、时间-音色解耦等技术,实现高可控、高同步、高音质...
Magnific是由原知名素材平台Freepik升级更名的一体化AI创意生产平台,整合图像、视频、音频、3D全品类AI创作能力,内置2.5亿+正版商用素材库,集成Flux 2、Runway Gen 4.5等...
百音工坊是一站式AI音频创作全流程平台,集文本转语音、声音克隆、语音转文字、音频编辑、视频编辑、AI文案等核心功能于一体,覆盖从文案创作到音视频生成的全链路需求。平...
MuseTalk是腾讯音乐娱乐集团Lyra Lab开源的实时高保真音频驱动唇形同步模型,基于latent空间修复技术,支持中文/英文/日语等多语言音频输入,可对256×256人脸区域精准唇形...
StepAudio 2.5 TTS是阶跃星辰推出的新一代AI文本转语音模型,以全局语境控制、文中语境精细调节、零样本音色复刻为核心能力,支持自然语言描述式情感与风格调控,延迟低、音...
趣丸千音是由广州趣丸网络科技有限公司推出的一站式视频翻译与AI配音平台。平台集成了从字幕识别与擦除、多语种AI翻译、高拟真情感配音到后期合成与交付的完整工作流。
悦音配音是深圳制片帮网络科技有限公司研发的AI智能配音工具,主打AI仿真人情感配音功能,提供网页端与APP端双平台服务,平台依托自研ANN-Turb训练引擎,实现高度拟人化的语...
Listnr AI是一款基于生成式人工智能技术的在线文本转语音(Text-to-Speech)与语音生成平台。该平台的核心功能是将用户输入的文字内容,转换为高度拟人化、自然流畅的语音音...
逗哥配音是一款集智能配音、音频处理与短视频创作辅助于一体的全流程AI语音合成工具平台。其核心功能是将用户输入的文字文本,通过先进的语音合成大模型技术,转化为高度拟...
万象有声是AI赋能的一站式有声内容创作平台,其核心主张是“让每一个故事轻松成声”。其并非一个单点的AI配音工具,而是定位为工业级的AIGC音频基建平台,旨在通过技术、产...
SonificaLabs是一个基于人工智能技术的专业音频内容生产平台。该平台的核心功能是,用户通过输入自然语言描述,即可在无需任何录音设备或专业音频制作技能的情况下,生成适...