Music v2:ElevenLabs推出的AI智能音乐生成模型
Music v2是英国伦敦AI音频独角兽企业ElevenLabs 发布的第二代文生全链路AI音乐生成大模型,是品牌从TTS语音赛道跨界深耕AI作曲的迭代旗舰产品,主打分段模块化编曲、单曲内...
Music v2是英国伦敦AI音频独角兽企业ElevenLabs 发布的第二代文生全链路AI音乐生成大模型,是品牌从TTS语音赛道跨界深耕AI作曲的迭代旗舰产品,主打分段模块化编曲、单曲内...
MiniMax M3是国内AI企业稀宇科技(MiniMax)发布的旗舰级混合专家大模型,也是全球首款同时集齐前沿编程能力、100万Token超长上下文、原生全模态三大Frontier核心能力的国产...
OpenClacky是由clacky-ai团队开源发布、基于MIT开源协议授权的轻量化开源本地AI智能体(Agent)框架项目,项目托管于GitHub开源平台,主打本地私有化部署、多厂商大模型API...
Gamma-World(γ-World)是NVIDIA联合清华、多伦多大学推出的生成式多智能体世界模型,通过单纯形旋转智能体编码与稀疏枢纽注意力两大创新,解决传统模型对称性缺失、算力爆...
Cosmos 3是英伟达(NVIDIA)完全开源的全模态物理AI基础模型,采用创新混合Transformer架构,原生集成视觉推理、世界生成与动作预测能力,可理解并生成文本、图像、视频、环...
Polar是由NVIDIA NeMo团队开发的强化学习训练框架,专为真实世界智能体(Agent)工具箱(Harness)设计。其核心理念是“将工具箱视为环境”,允许开发者将现有智能体评估框...
OmniVoice Studio 是一个完全开源、本地运行的 AI 语音工具集,定位为 ElevenLabs 的替代品。它支持 646 种语言的零样本语音克隆、语音设计(多参数调节)、全流程视频配音...
Webwright是微软开源的终端原生Web智能体框架,核心采用代码驱动范式,让大模型自动生成Playwright脚本操控浏览器,摒弃传统点击预测模式。框架极简轻量(约1000行代码),...
Qwen‑VLA是阿里通义千问推出的开源通用视觉‑语言‑动作统一具身智能模型,基于Qwen多模态基座构建,通过四阶段训练实现视觉感知、语言理解与连续动作生成的端到端融合,单...
Qwen3.7-Plus是由阿里达摩院通义千问团队自研、依托Qwen3.7原生基座迭代升级的多模态通用智能体大模型,主打视觉+文本+代码三位一体的自主智能体闭环能力,Qwen3.7-Plus从底...