通义多模态向量
复制成功!
向量
概述
向量
Embedding-Vision是基于LLM底座的视觉多模态表征模型,具有以视觉为中心、领域性能优异(电商、 安防、相册/图库、自驾等)、高性价比的特点。兼容文本、图像、视频3种模态,可应用于以图搜图、以文搜图、以文搜视频,以视频搜视频等下游任务场景。
输入
文本图像视频
输出
功能
定价
- 图片输入¥0.5/M tokens
- 文本输入¥0.5/M tokens
速率限制
- RPM每分钟请求数600
- TPM每分钟 Token 数200K
API 参考
获取 API Key复制成功!
1234567891011
import dashscope
text = "通用多模态表征模型示例"
input = [{'text': text}]
resp = dashscope.MultiModalEmbedding.call(
model="tongyi-embedding-vision-plus",
input=input
)
print(resp)