Wan2.7-Video 全新上线,更可控 、 更全能!
支持文本、图像、视频、音频全模态输入,覆盖生成、编辑、复刻、重塑、驱动、续写、参考全链路;最多支持 5 个视频主体参考,实现外观和音色锁定。
支持文本、图像、视频、音频全模态输入,覆盖生成、编辑、复刻、重塑、驱动、续写、参考全链路;最多支持 5 个视频主体参考,实现外观和音色锁定。
通义语音发布 Fun-CosyVoice3.5 与 Fun-AudioGen-VD 双模型,支持自然语言指令控制语音生成;新增泰语、印尼语、葡萄牙语、越南语四种语言,生僻字读错率从 15.2% 降至 5.3%。