Sesten Metne (STT)
Bir ses kaydını metne dökün (transkripsiyon). Toplantı kayıtları, sesli notlar veya altyazı üretimi için kullanışlıdır.
Temel kullanım
python
import os
from openai import OpenAI
client = OpenAI(api_key=os.environ["QEVRON_API_KEY"], base_url="https://app.qevron.ai/v1")
with open("kayit.wav", "rb") as f:
resp = client.audio.transcriptions.create(
model="solab-stt",
file=f,
language="tr",
)
print(resp.text)curl ile
bash
curl https://app.qevron.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $QEVRON_API_KEY" \
-F "model=solab-stt" \
-F "file=@kayit.wav" \
-F "language=tr"Ayrıntılı çıktı (zaman damgaları)
response_format=verbose_json ile dil, süre ve zaman damgalı parçalar (segments) alırsınız:
bash
curl https://app.qevron.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $QEVRON_API_KEY" \
-F "model=solab-stt" \
-F "file=@kayit.wav" \
-F "response_format=verbose_json"json
{
"task": "transcribe",
"language": "tr",
"duration": 12.4,
"text": "Merhaba, bu bir test kaydıdır...",
"segments": [
{ "start": 0.0, "end": 3.2, "text": "Merhaba, bu bir test kaydıdır" }
]
}İpuçları
languagebelirtin: Dili önceden vermek doğruluğu artırır (örn.tr,en).- Çeviri: Sesi İngilizceye çevirmek için
/v1/audio/translationsuç noktasını kullanın. - Desteklenen formatlar: wav, mp3, m4a vb. (modele bağlı).
İlgili: Audio API — STT.