verinova-large
Bu model nedir?
Qwen3-30B-A3B-Instruct (Q8) tabanlı, kendi GPU altyapımızda çalışan yüksek kapasiteli sohbet (LLM) modelidir. Daha zorlu görevler ve daha uzun bağlam için verinova-stable'a göre daha güçlüdür. Sohbet (/v1/chat/completions) yanında klasik tamamlama (/v1/completions) da destekler.
Yetenek ve tür
| Yetenek | Sohbet (LLM) — Yetenek sayfası |
| Model türü | Dil modeli (LLM) (type=1) |
| Temel model | Qwen3-30B-A3B-Instruct-2507 (Q8) |
| Sağlayıcı | arpanet (yerel / self-hosted) |
| Akış | ✓ destekleniyor |
Uç nokta
POST /v1/chat/completionsİkincil uç noktalar:
POST /v1/completions
Base URL: https://app.qevron.ai/v1
Kimlik doğrulama
Tüm istekler Authorization: Bearer <ANAHTAR> başlığı ister.
Authorization: Bearer <KEY>İstek şeması ve parametreler
| Parametre | Tip | Zorunlu | Açıklama |
|---|---|---|---|
model | string | ✓ | verinova-large |
messages | array | ✓ | OpenAI rol/içerik mesaj listesi |
stream | bool | — | true → SSE akışı |
max_tokens | int | — | Üretilecek azami token |
temperature | number | — | 0–2 |
Yanıt şeması
json
{
"id": "chatcmpl-...",
"object": "chat.completion",
"choices": [{"index": 0, "message": {"role": "assistant", "content": "..."}, "finish_reason": "stop"}],
"usage": {"prompt_tokens": 0, "completion_tokens": 0, "total_tokens": 0}
}Akış (streaming)
"stream": true ekleyin; sunucu Server-Sent Events ile parça parça yanıt verir.
Kod örnekleri
curl
bash
curl https://app.qevron.ai/v1/chat/completions \
-H "Authorization: Bearer $QEVRON_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "verinova-large",
"messages": [{"role": "user", "content": "Hello, world"}]
}'Python
python
from openai import OpenAI
client = OpenAI(api_key="$QEVRON_KEY", base_url="https://app.qevron.ai/v1")
resp = client.chat.completions.create(
model="verinova-large",
messages=[{"role": "user", "content": "Hello, world"}],
)
print(resp.choices[0].message.content)JavaScript
javascript
import OpenAI from "openai";
const client = new OpenAI({ apiKey: process.env.QEVRON_KEY, baseURL: "https://app.qevron.ai/v1" });
const resp = await client.chat.completions.create({
model: "verinova-large",
messages: [{ role: "user", content: "Hello, world" }],
});
console.log(resp.choices[0].message.content);Fiyatlandırma
| Girdi | Çıktı | Birim |
|---|---|---|
| $0.0005 | $0.001 | 1K token |
Hız limitleri
RPM/TPM grubunuzun kotasına bağlıdır. Mevcut kotanızı görmek için: GET /v1/dashboard/billing/quota.
Notlar ve özellikler
- Bu, Qevron'un varsayılan önerilen sohbet modelidir (
GET /v1/capabilities→LLM_CHAT). verinova(emekli takma ad) istekleri bu modele yönlendirilir.
Sınırlar ve kısıtlar
- Bağlam penceresi: 32K token (sunucu varsayılanı).
İlgili
- Yetenek sayfası: Sohbet (LLM)
- Tüm yerel modeller: Yerel Modeller