实时语音识别及翻译V1.0
复制成功!
立即体验加入对比
实时语音翻译
概述
实时语音翻译
多语言语音转写及翻译的多模态大模型。本模型提供长时间、高准确率、实时转写中/英/日/韩等10个混合语种的服务。同时支持中英日韩互译,以其他6个语种翻译成中文或英文。
输入
音频
输出
文本
功能
前缀补全
函数调用
缓存
结构化输出
批量任务
联网搜索
微调
定价
- 音频时长¥0.00015每秒
速率限制
- RPM每分钟请求数600
API 参考
获取 API Key复制成功!
1234567891011121314151617181920212223242526272829303132333435
import requests
from http import HTTPStatus
import dashscope
from dashscope.audio.asr import *
# 若没有将API Key配置到环境变量中,需将your-api-key替换为自己的API Key
# dashscope.api_key = "your-api-key"
r = requests.get(
"https://dashscope.oss-cn-beijing.aliyuncs.com/samples/audio/paraformer/hello_world_female2.wav"
)
with open("asr_example.wav", "wb") as f:
f.write(r.content)
translator = TranslationRecognizerRealtime(
model="gummy-realtime-v1",
format="wav",
sample_rate=16000,
translation_target_languages=["en"],
translation_enabled=True,
callback=None,
)
result = translator.call("asr_example.wav")
if not result.error_message:
print("request id: ", result.request_id)
print("transcription: ")
for transcription_result in result.transcription_result_list:
print(transcription_result.text)
print("translation[en]: ")
for translation_result in result.translation_result_list:
print(translation_result.get_translation('en').text)
else:
print("Error: ", result.error_message)