Qwen-声音复刻
复制成功!
立即体验加入对比
语音合成
概述
语音合成
千问voice-enrollment模型是千问语音模型的声音复刻系列模型,仅需5s以上的音频,即可迅速复刻高相似度声音。结合qwen3-tts-vc-realtime模型使用,可将一个人的声音高保真复刻,输出10个语种的语音。且合成音频可以根据文本自适应调节语气,对复杂文本合成也有较好的处理能力。
输入
音频
输出
文本
功能
定价
- 声音复刻及声音设计¥0.01次
速率限制
- RPM每分钟请求数180
API 参考
获取 API Key复制成功!
1234567891011121314151617181920212223242526272829303132333435363738394041
import os
import requests
import base64, pathlib
target_model = "qwen3-tts-vc-realtime-2025-11-27"
preferred_name = "guanyu"
audio_mime_type = "audio/mpeg"
file_path = pathlib.Path("input.mp3")
base64_str = base64.b64encode(file_path.read_bytes()).decode()
data_uri = f"data:{audio_mime_type};base64,{base64_str}"
api_key = os.getenv("DASHSCOPE_API_KEY")
url = "https://dashscope.aliyuncs.com/api/v1/services/audio/tts/customization"
payload = {
"model": "qwen-voice-enrollment",
"input": {
"action": "create",
"target_model": target_model,
"preferred_name": preferred_name,
"audio": {
"data": data_uri
}
}
}
headers = {
"Authorization": f"Bearer {api_key}",
"Content-Type": "application/json"
}
resp = requests.post(url, json=payload, headers=headers)
if resp.status_code == 200:
data = resp.json()
voice = data["output"]["voice"]
print(f"voice name is: {voice}")
else:
print("Failed: ", resp.status_code, resp.text)