Vanchin DeepSeek
复制成功!
视觉理解文本生成
概述
视觉理解文本生成
DeepSeek-OCR以 “探索视觉 - 文本压缩边界” 为核心目标,从大语言模型(LLM)视角重新定义视觉编码器的功能定位,为文档识别、图像转文本等高频场景提供了兼顾精度与效率的全新解决方案。
输入
文本图像
输出
文本
功能
前缀补全
函数调用
缓存
结构化输出
批量任务
联网搜索
微调
定价
- 输入¥0.216/M tokens
- 输出¥0.216/M tokens
上下文
上下文
8.19K
最大输入
8.19K
最大输出
8.19K
速率限制
- RPM每分钟请求数500
- TPM每分钟 Token 数1M
API 参考
开通模型开通后即可体验并通过 API 调用该模型。复制成功!
12345678910111213141516171819202122232425262728293031
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="vanchin/deepseek-ocr",
messages=[
{
"role": "user",
"content": [
{
"type": "image_url",
"image_url": {
"url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241108/ctdzex/biaozhun.jpg",
"detail": "high",
},
},
{
"type": "text",
"text": "Read all the text in the image.",
},
],
}
],
)
print(completion.choices[0].message.content)