SenseVoice:开源多任务音频基础模型,支持语音识别与声学事件分析
SenseVoice是由阿里通义实验室开源的一款具备强大音频理解能力的音频基础模型,致力于为各类语音及声学相关场景提供高效、精准的技术支撑。该模型基于深度学习技术构建,采...
SenseVoice是由阿里通义实验室开源的一款具备强大音频理解能力的音频基础模型,致力于为各类语音及声学相关场景提供高效、精准的技术支撑。该模型基于深度学习技术构建,采...
ZipVoice是一款基于流匹配技术的零样本语音合成TTS模型,核心定位是在保证高质量语音输出的同时,实现轻量化模型架构与快速推理性能的平衡。支持通过少量参考语音(提示音频...
Mini-o3(或称为o3-mini)是OpenAI于2025年2月推出的低成本高性能推理模型,属于其“推理系列”模型中的最新成员,定位为旗舰模型o3的经济版。它的核心目标是在STEM领域(科...