Kısa cevap
Ses yapay zekâsı şirketi ElevenLabs, daha fazla dil desteği ve ifade kontrolü sunan yeni nesil konuşma modellerini duyurdu. Yeni mimari, çok daha kısa bir ses örneğiyle ses klonlamaya, uzun metinlerde ses kimliğini daha tutarlı korumaya ve sesli asistanlarda daha akıcı, düşük gecikmeli konuşmaya olanak tanıyor. Model, müşteri hizmetleri gibi kullanım senaryoları için özellikle geliştirildi.
Öne çıkanlar
- Yeni model, önceki sürümün desteklediği dillere ek olarak toplam 90 dili kapsıyor.
- Kullanıcılar artık yalnızca 10 saniyelik bir ses örneğiyle ses klonlayabiliyor.
- ElevenLabs'ın yıllıklandırılmış geliri, yılın başındaki seviyeden bu yana belirgin biçimde arttı.

1 dk okumaYayın yönetmeni: Uğur Deniz İlhanYazılım →
ElevenLabs, TechCrunch'ın haberine göre, ElevenLabs v4 ve v4 Turbo adlı iki yeni konuşma modelini duyurdu. Yeni sürümler daha fazla ifade kontrolü, ses ajanları için daha düşük gecikme ve 90'dan fazla dil desteği getiriyor.
Yenilikler neler?
Şirket geçen yıl v3 modelini duyurmuştu; v4 nesli için tamamen yeni bir mimariye geçildi. Bu sayede kullanıcılar artık yalnızca 10 saniyelik bir ses örneğiyle ses klonlayabiliyor. Model, uzun metin parçalarında ses kimliğini daha tutarlı koruyor ve metnin bağlamını okurken ifadeyi buna göre ayarlıyor. v3 ile tanıtılan satır içi ifade etiketleri v4'te genişletildi; kullanıcılar artık birden çok etiketi art arda kullanabiliyor.
Hangi diller güçlendi?
Önceki sürüm 70 dili destekliyordu; ElevenLabs bu sayıyı 90'a çıkardığını açıkladı. Şirket, en büyük kalite sıçramasının Japonca, Brezilya Portekizcesi, Mandarin ve Kantonca'da gözlemlendiğini belirtti. Yeni model ayrıca LLM yanıt üretmeye başlar başlamaz sesi de üretmeye başlayabiliyor; bu da sesli asistanlarda bekleme süresini kısaltıyor.
Türkiye'deki ürün ekipleri ne yapmalı?
Çağrı merkezi otomasyonu ve sesli asistan ürünleri geliştiren Türkiye merkezli ekipler için düşük gecikme ve daha kısa ses örneğiyle klonlama, özellikle çok dilli müşteri hizmeti senaryolarında maliyeti düşürebilecek bir gelişme. ElevenLabs'ın kurumsal çağrı işinin hızla büyümesi, rakip modellerin de benzer yönde ilerleyeceğine işaret ediyor; ekiplerin ses sağlayıcısı seçiminde yalnızca dil desteğine değil, gecikme ve konuşma kesintisi yönetimi gibi konuşma kalitesi kriterlerine de bakması öneriliyor.
Sık sorulanlar
- v4 modeliyle ses klonlamak için ne kadar ses örneği gerekiyor?
- ElevenLabs'a göre yeni mimari sayesinde kullanıcılar artık yalnızca 10 saniyelik bir ses örneğiyle bir sesi klonlayabiliyor.
Kaynaklar
- TechCrunch ·
UNIT Journal'ı takip edin
Arama, yapay zekâ ve yeni teknolojilerdeki gelişmeler her gün akışınızda.


