Skip to content

blab-pro

Bu model nedir?

VoxCPM2 tabanlı, nano-vllm ile kendi GPU altyapımızda servis edilen premium metinden-sese modelidir. 48 kHz stüdyo kalitesinde, bağlama duyarlı doğal okuma üretir; 30 dil destekler (Türkçe dahil). Referans klipten anında ses klonlama, metin tarifiyle ses tasarımı ve doğal dille stil yönlendirme sunar.

Yetenek ve tür

YetenekMetinden Sese (TTS)
Model türüMetinden sese (TTS) (type=7)
Temel modelVoxCPM2 (nano-vllm)
Sağlayıcıarpanet (yerel / self-hosted)
Akış✓ destekleniyor

Uç nokta

POST /v1/audio/speech

Base URL: https://app.qevron.ai/v1

Kimlik doğrulama

Tüm istekler Authorization: Bearer <ANAHTAR> başlığı ister.

Authorization: Bearer <KEY>

İstek şeması ve parametreler

ParametreTipZorunluAçıklama
modelstringblab-pro
inputstringSeslendirilecek metin
voicestringSes kimliği
response_formatstringwav

Yanıt şeması

audio/wav (binary) — the response body is the audio stream.

Akış (streaming)

"stream": true ekleyin; sunucu Server-Sent Events ile parça parça yanıt verir.

Kod örnekleri

curl

bash
curl https://app.qevron.ai/v1/audio/speech \
  -H "Authorization: Bearer $QEVRON_KEY" -H "Content-Type: application/json" \
  -d '{"model": "blab-pro", "input": "Merhaba dünya", "voice": "default", "response_format": "wav"}' \
  --output speech.wav

Python

python
from openai import OpenAI
client = OpenAI(api_key="$QEVRON_KEY", base_url="https://app.qevron.ai/v1")
r = client.audio.speech.create(model="blab-pro", input="Merhaba dünya", voice="default")
r.stream_to_file("speech.wav")

Fiyatlandırma

GirdiÇıktıBirim
$0.00121K token

Hız limitleri

RPM/TPM grubunuzun kotasına bağlıdır. Mevcut kotanızı görmek için: GET /v1/dashboard/billing/quota.

Notlar ve özellikler

  • Stil yönlendirme: instruction alanına doğal dilde kısa bir tarif verin (örn. "cheerful, slightly faster"). Sayısal duygu parametresi yoktur.
  • Ses tasarımı: voice_description ile referans ses olmadan sıfırdan bir ses üretin; seed aynı adayı yeniden üretilebilir kılar.
  • Anında klonlama: POST /v1/audio/voices?model=blab-pro (multipart label+file, opsiyonel transcript) — saniyeler içinde hazır. Birebir transcript verilirse klon, prompt-devamı ("ultimate") moduna geçer ve benzerlik keskinleşir.
  • Akış: stream: true SSE speech.audio.delta üretir; response_format: "pcm" 24 kHz int16 akışıdır (gerçek zamanlı ajanlar).
  • Aynı istek aynı çıktıyı üretir (istekten türetilen deterministik seed); farklı bir okuma için seed değiştirin.

Sınırlar ve kısıtlar

  • Dosya çıkışları wav/mp3 (48 kHz); opus/aac/flac desteklenmez.
  • Klon referansı 3–60 sn olmalıdır; aşırı işlenmiş/jingle'lı kayıtlar kalite sondasında reddedilebilir.
  • blab-expressive ve blab-tts kimlikleri kalıcı takma ad olarak bu modele yönlenir.

İlgili

Qevron — AI gateway. Arpanet / OpenAI / Anthropic / Gemini uyumlu.