ZvenoAI
Руководства

Мультимодальность

Vision — отправка изображений на вход модели через ZvenoAI API.

Эта страница — про приём изображений моделью (vision). Про генерацию изображений моделью — отдельное руководство:

Vision (анализ изображений)

response = client.chat.completions.create(
    model="openai/gpt-4o",
    messages=[{
        "role": "user",
        "content": [
            {"type": "text", "text": "Что на этом изображении?"},
            {"type": "image_url", "image_url": {"url": "https://example.com/image.jpg"}}
        ]
    }]
)
const response = await client.chat.completions.create({
  model: 'openai/gpt-4o',
  messages: [{
    role: 'user',
    content: [
      { type: 'text', text: 'Что на этом изображении?' },
      { type: 'image_url', image_url: { url: 'https://example.com/image.jpg' } }
    ]
  }]
})
Поддерживаемые форматы: PNG, JPEG, GIF, WebP.

Модели с поддержкой vision

МодельVisionАудио
openai/gpt-4oYesYes
anthropic/claude-sonnet-4-20250514YesNo
google/gemini-2.5-proYesYes

On this page