OpenAI, GPT‑Realtime‑2 ve yalnızca API üzerinden erişilebilen iki yeni sesli varyantı tanıttı

OpenAI, GPT‑Realtime‑2 ve yalnızca API üzerinden erişilebilen iki yeni sesli varyantı tanıttı

14 hardware

OpenAI ses API'sini genişletiyor

Şirket, geliştiricilerin daha “canlı” ses uygulamaları oluşturmasını sağlayacak yeni özellikleri duyurdu: kullanıcılarla konuşabilir, sesi metne dönüştürebilir ve sohbetleri anında çevirebilirler.

Yeni Realtime modelleri
Realtime arayüzü üzerinden şu anda üç model mevcuttur:

ModelİşlevAna ÖzellikleriGPT‑Realtime‑2 Gerçek zamanlı ses etkileşimi Sorguları analiz eder, araçları çağırır, düzeltmeleri işler ve diyalogun akıcı devamını sağlar. GPT‑5 mantığına dayalıdır, bu da GPT‑Realtime‑1.5’e göre daha karmaşık görevleri işleyebilmesini sağlar.GPT‑Realtime‑Translate Gerçek zamanlı çeviri 70+ giriş dili ve 13 çıkış dilini destekler. Bağlam değişikliği, bölgesel aksanlar veya özel terminoloji olsa bile anlamı korur.GPT‑Realtime‑Whisper Ses transkripsiyonu Düşük gecikmeli akış modeli, sesi hemen metne dönüştürür.
> “Yeni modellerimiz, basit bir diyalogdan sesli arayüzlere gerçek zamanlı olarak ses çevirisi yapıyor; gerçekten çalışabilir: dinleyebilir, düşünebilir, çevirebilir, transkripte edebilir ve sohbet ilerledikçe eylemler alabilir,” dedi şirket.

Maliyet
ModelFiyatGPT‑Realtime‑2$32 / 1 milyon giriş ses tokeni, $0.40 / 1 milyon önbelleğe alınmış token ve $64 / 1 milyon çıkış ses tokeniGPT‑Realtime‑Translate$0.034 dakikadaGPT‑Realtime‑Whisper$0.017 dakikada

Nasıl denersiniz
Geliştiriciler yeni modelleri OpenAI Playground çevrimiçi platformunda test edebilir ve gerçek zamanlı olarak nasıl çalıştığını hemen görebilirler

Yorumlar (0)

Düşüncenizi paylaşın — lütfen kibar olun ve konu dışına çıkmayın.

Henüz yorum yok. Yorum bırakın ve düşüncenizi paylaşın!

Yorum bırakmak için lütfen giriş yapın.

Yorum yapmak için giriş yapın