Görsel Anlama (Vision)
Görsel destekleyen modeller (örn. spook-vision, spook-ocr, spook-detect) bir görseli "görüp" hakkında soru yanıtlayabilir. Görseli, sohbet mesajının içine çok parçalı içerik olarak eklersiniz.
Görseli gönderme yöntemleri
İki yol vardır:
- Genel URL — Görsel internette erişilebilir bir adreste.
- Base64 data URL — Görseli
data:image/jpeg;base64,...olarak gömün (yerel dosyalar için).
Örnek (base64 ile)
python
import os, base64
from openai import OpenAI
client = OpenAI(api_key=os.environ["QEVRON_API_KEY"], base_url="https://app.qevron.ai/v1")
with open("foto.jpg", "rb") as f:
b64 = base64.b64encode(f.read()).decode()
resp = client.chat.completions.create(
model="spook-vision",
messages=[
{
"role": "user",
"content": [
{"type": "text", "text": "Bu görselde ne görüyorsun?"},
{"type": "image_url", "image_url": {"url": f"data:image/jpeg;base64,{b64}"}},
],
}
],
)
print(resp.choices[0].message.content)Örnek (URL ile)
json
{
"model": "spook-vision",
"messages": [
{
"role": "user",
"content": [
{ "type": "text", "text": "Bu görseli açıkla." },
{ "type": "image_url", "image_url": { "url": "https://ornek.com/foto.jpg" } }
]
}
]
}Görsel görevleri için modeller
| Model | Görev |
|---|---|
spook-vision | Görseli açıklama / hakkında soru-cevap |
spook-ocr | Görseldeki metni çıkarma (OCR) |
spook-detect | Görseldeki nesneleri tespit etme |
İpuçları
Görsel boyutunu küçültün
Çok büyük görseller hem yavaştır hem de istek boyutu sınırına (413 hatası) takılabilir. Göndermeden önce görseli makul bir boyuta (örn. en fazla 1280 piksel) küçültün ve JPEG olarak sıkıştırın.
- Yalnızca metin soruları için görsel eklemeyin; görsel desteklemeyen modellere (örn.
verinova) görsel gönderirseniz hata alırsınız. - Tek mesajda birden fazla görsel gönderebilirsiniz (içerik dizisine birden çok
image_urlekleyin).
İlgili: Chat API — Vision.