Skip to content

verinova-stable

Bu model nedir?

Gemma 4 12B tabanlı, kendi GPU sunucumuzda çalışan hızlı bir sohbet (LLM) modelidir. verinova-large'a göre daha hafiftir; düşünme (thinking) modu varsayılan olarak KAPALIDIR, böylece yanıtlar anında döner. Genel amaçlı API kullanımı için uygundur.

Yetenek ve tür

YetenekSohbet (LLM) — Yetenek sayfası
Model türüDil modeli (LLM) (type=1)
Temel modelGemma 4 12B Instruct (Q8)
Sağlayıcıarpanet (yerel / self-hosted)
Akış✓ destekleniyor

Uç nokta

POST /v1/chat/completions

İkincil uç noktalar:

  • POST /v1/completions

Base URL: https://app.qevron.ai/v1

Kimlik doğrulama

Tüm istekler Authorization: Bearer <ANAHTAR> başlığı ister.

Authorization: Bearer <KEY>

İstek şeması ve parametreler

ParametreTipZorunluAçıklama
modelstringverinova-stable
messagesarrayOpenAI rol/içerik mesaj listesi
streambooltrue → SSE akışı
max_tokensintÜretilecek azami token
temperaturenumber0–2

Yanıt şeması

json
{
  "id": "chatcmpl-...",
  "object": "chat.completion",
  "choices": [{"index": 0, "message": {"role": "assistant", "content": "..."}, "finish_reason": "stop"}],
  "usage": {"prompt_tokens": 0, "completion_tokens": 0, "total_tokens": 0}
}

Akış (streaming)

"stream": true ekleyin; sunucu Server-Sent Events ile parça parça yanıt verir.

Kod örnekleri

curl

bash
curl https://app.qevron.ai/v1/chat/completions \
  -H "Authorization: Bearer $QEVRON_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "verinova-stable",
    "messages": [{"role": "user", "content": "Hello, world"}]
  }'

Python

python
from openai import OpenAI
client = OpenAI(api_key="$QEVRON_KEY", base_url="https://app.qevron.ai/v1")
resp = client.chat.completions.create(
    model="verinova-stable",
    messages=[{"role": "user", "content": "Hello, world"}],
)
print(resp.choices[0].message.content)

JavaScript

javascript
import OpenAI from "openai";
const client = new OpenAI({ apiKey: process.env.QEVRON_KEY, baseURL: "https://app.qevron.ai/v1" });
const resp = await client.chat.completions.create({
  model: "verinova-stable",
  messages: [{ role: "user", content: "Hello, world" }],
});
console.log(resp.choices[0].message.content);

Fiyatlandırma

GirdiÇıktıBirim
$0.0005$0.0011K token

Hız limitleri

RPM/TPM grubunuzun kotasına bağlıdır. Mevcut kotanızı görmek için: GET /v1/dashboard/billing/quota.

Notlar ve özellikler

Düşünme (thinking) modu — istek başına

verinova-stable varsayılan olarak düşünmeden, doğrudan yanıt verir (hızlı). Adım adım muhakeme istiyorsanız istek başına açın:

json
{
  "model": "verinova-stable",
  "messages": [{"role": "user", "content": "17 * 23 kaçtır?"}],
  "chat_template_kwargs": {"enable_thinking": true}
}

Açıkken model, görünür yanıttan önce muhakemesini ayrı bir reasoning_content alanında üretir — küçük bir max_tokens verirseniz görünür content boş gelebilir, bu yüzden yeterli bütçe ayırın.

Sınırlar ve kısıtlar

  • Bağlam penceresi: 16K token (sunucu varsayılanı).
  • verinova (emekli takma ad) bu modele değil, verinova-large'a yönlenir.

İlgili

Qevron — AI gateway. Arpanet / OpenAI / Anthropic / Gemini uyumlu.