视觉问答
使用自部署视觉语言模型对图像进行理解与问答。
使用 模型目录 中的视觉模型 ID 在对话补全中理解图像。参数与限制见 视觉指南。
Python
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api-inference.bitdeer.ai/v1",
api_key=os.environ["BITDEER_API_KEY"],
)
response = client.chat.completions.create(
model="moonshotai/Kimi-K2.6",
messages=[
{
"role": "user",
"content": [
{
"type": "image_url",
"image_url": {"url": "https://example.com/photo.jpg"},
},
{"type": "text", "text": "描述你在图中看到的内容。"},
],
}
],
max_tokens=512,
)
print(response.choices[0].message.content)JavaScript
import OpenAI from 'openai';
const client = new OpenAI({
apiKey: process.env.BITDEER_API_KEY!,
baseURL: 'https://api-inference.bitdeer.ai/v1',
});
const response = await client.chat.completions.create({
model: 'moonshotai/Kimi-K2.6',
messages: [
{
role: 'user',
content: [
{ type: 'image_url', image_url: { url: 'https://example.com/photo.jpg' } },
{ type: 'text', text: '描述你在图中看到的内容。' },
],
},
],
max_tokens: 512,
});
console.log(response.choices[0]?.message?.content);最后更新于