Kimi
复制成功!
文本生成推理视觉理解
概述
文本生成推理视觉理解
Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。
输入
文本图像视频
输出
文本
功能
定价
- 输入¥6.5/M tokens
- 输出¥27/M tokens
- 输入(缓存命中)¥1.1/M tokens
速率限制与上下文
- 最大输入262.14K
- 最大输出262.14K
- RPM每分钟请求数500
- TPM每分钟 Token 数3M
- 最大输入(思考模式)262.14K
- 最大输出(思考模式)262.14K
- 上下文262.14K
API 参考
开通模型开通后即可体验并通过 API 调用该模型。复制成功!
1234567891011121314151617181920212223242526
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="kimi/kimi-k2.6",
messages=[
{
"role": "user",
"content": [
{
"type": "image_url",
"image_url": {
"url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241108/ctdzex/biaozhun.jpg"
},
},
{"type": "text", "text": "请仅输出图像中的文本内容。"},
],
},
],
)
print(completion.choices[0].message.content)