blab-pro
Bu model nedir?
VoxCPM2 tabanlı, nano-vllm ile kendi GPU altyapımızda servis edilen premium metinden-sese modelidir. 48 kHz stüdyo kalitesinde, bağlama duyarlı doğal okuma üretir; 30 dil destekler (Türkçe dahil). Referans klipten anında ses klonlama, metin tarifiyle ses tasarımı ve doğal dille stil yönlendirme sunar.
Yetenek ve tür
| Yetenek | Metinden Sese (TTS) |
| Model türü | Metinden sese (TTS) (type=7) |
| Temel model | VoxCPM2 (nano-vllm) |
| Sağlayıcı | arpanet (yerel / self-hosted) |
| Akış | ✓ destekleniyor |
Uç nokta
POST /v1/audio/speechBase URL: https://app.qevron.ai/v1
Kimlik doğrulama
Tüm istekler Authorization: Bearer <ANAHTAR> başlığı ister.
Authorization: Bearer <KEY>İstek şeması ve parametreler
| Parametre | Tip | Zorunlu | Açıklama |
|---|---|---|---|
model | string | ✓ | blab-pro |
input | string | ✓ | Seslendirilecek metin |
voice | string | — | Ses kimliği |
response_format | string | — | wav |
Yanıt şeması
audio/wav (binary) — the response body is the audio stream.
Akış (streaming)
"stream": true ekleyin; sunucu Server-Sent Events ile parça parça yanıt verir.
Kod örnekleri
curl
bash
curl https://app.qevron.ai/v1/audio/speech \
-H "Authorization: Bearer $QEVRON_KEY" -H "Content-Type: application/json" \
-d '{"model": "blab-pro", "input": "Merhaba dünya", "voice": "default", "response_format": "wav"}' \
--output speech.wavPython
python
from openai import OpenAI
client = OpenAI(api_key="$QEVRON_KEY", base_url="https://app.qevron.ai/v1")
r = client.audio.speech.create(model="blab-pro", input="Merhaba dünya", voice="default")
r.stream_to_file("speech.wav")Fiyatlandırma
| Girdi | Çıktı | Birim |
|---|---|---|
| $0.0012 | — | 1K token |
Hız limitleri
RPM/TPM grubunuzun kotasına bağlıdır. Mevcut kotanızı görmek için: GET /v1/dashboard/billing/quota.
Notlar ve özellikler
- Stil yönlendirme:
instructionalanına doğal dilde kısa bir tarif verin (örn."cheerful, slightly faster"). Sayısal duygu parametresi yoktur. - Ses tasarımı:
voice_descriptionile referans ses olmadan sıfırdan bir ses üretin;seedaynı adayı yeniden üretilebilir kılar. - Anında klonlama:
POST /v1/audio/voices?model=blab-pro(multipartlabel+file, opsiyoneltranscript) — saniyeler içinde hazır. Birebirtranscriptverilirse klon, prompt-devamı ("ultimate") moduna geçer ve benzerlik keskinleşir. - Akış:
stream: trueSSEspeech.audio.deltaüretir;response_format: "pcm"24 kHz int16 akışıdır (gerçek zamanlı ajanlar). - Aynı istek aynı çıktıyı üretir (istekten türetilen deterministik seed); farklı bir okuma için
seeddeğiştirin.
Sınırlar ve kısıtlar
- Dosya çıkışları
wav/mp3(48 kHz);opus/aac/flacdesteklenmez. - Klon referansı 3–60 sn olmalıdır; aşırı işlenmiş/jingle'lı kayıtlar kalite sondasında reddedilebilir.
blab-expressiveveblab-ttskimlikleri kalıcı takma ad olarak bu modele yönlenir.
İlgili
- Tüm yerel modeller: Yerel Modeller