在 Amazon SageMaker AI 上部署 Qwen3-TTS 实现实时个性化语音
Qwen3-TTS-12Hz-1.7B-Base 现可通过 Amazon SageMaker JumpStart 部署到全托管实时推理端点,实现基于数秒参考音频的语音克隆,无需重新训练模型。该模型支持 10 种语言及跨语言克隆,输出 24 kHz 音频,适用于教育、媒体等场景,并支持流式生成。部署后数据保留在 AWS 环境中,可通过 CloudWatch 监控端点规模。
Qwen3-TTS-12Hz-1.7B-Base 现可通过 Amazon SageMaker JumpStart 部署到全托管实时推理端点,实现基于数秒参考音频的语音克隆,无需重新训练模型。该模型支持 10 种语言及跨语言克隆,输出 24 kHz 音频,适用于教育、媒体等场景,并支持流式生成。部署后数据保留在 AWS 环境中,可通过 CloudWatch 监控端点规模。