阿里发布两款语音新模型,可定制角色及模拟背景音
3 月 2 日
阿里发布两款语音新模型:基于参考音频的声音克隆模型 Fun-CosyVoice3.5 和无参考音频的音色设计模型 Fun-AudioGen-VD。两款模型均有「指令遵循」能力,适用于多场景。Fun-CosyVoice3.5 在 Seed-TTS 基准测试中文「困难案例」指标表现佳,降低了生僻字句错率,支持自由风格模式指令控制,解决传统克隆模型痛点。Fun-AudioGen-VD 专注「从无到有」的音色设计,能定制音色、情感,模拟复杂听觉环境。编辑杨娟娟,校对陈荻雁。
2026-07-15
阿里发布实时语音交互对话模型 Qwen-Audio-3.0-Realtime2026-05-28
ASR、TTS、Chat 均为第一,阿里语音大模型拿下「大满贯」2026-04-20
阿里发布 Qwen3.6-Max 预览版2026-03-02
阿里发布两款语音新模型,可定制角色及模拟背景音2025-12-23
阿里发布端到端语音交互模型 Fun-Audio-Chat2025-12-15
阿里通义百聆推出语音模型新版本2025-12-11
阿里巴巴发布 Qwen3-Omni-Flash 全模态大模型支持实时流式响应2025-03-27
阿里开源首个全模态大模型 Qwen2.5-Omni,7B 尺寸可在手机上部署运行2025-03-27
通义千问发布新一代端到端旗舰模型 Qwen2.5-Omni查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。