Karşımızda yeni bir zorluk var.
Yıllar boyunca, Metni Konuşmaya Dönüştürme (Text-to-Speech) teknolojisindeki temel zorluk, yapay zekanın daha insansı duyulmasını sağlamaktı.
Şimdiyse bazı müşterilerimiz, kendi kullanıcılarının karşılarındakini gerçek bir insan sanması nedeniyle yapay zeka görüşmelerinde geri bildirimler almaya başladı.
Ben buna “İlerleme” derim.
Son iki yıldır yapay zeka sektörü modeller üzerine yoğunlaşmış durumda. Daha büyük modeller. Daha akıllı modeller. Daha hızlı modeller.
Ancak yapay zeka asistanları yaygınlaştıkça hepimizin bir gerçeği fark etmeye başladığına inanıyorum: Artık asıl mücadele alanı zeka değil, deneyim.
Günümüzdeki yapay zeka modellerinin çoğu zaten son derece yetenekli. Bir yapay zeka deneyimini diğerinden ayıran şey, modelin ne bildiğinden öte etkileşimin nasıl bir his uyandırdığı…
İşte ses teknolojisi, tam da burada devreye giriyor.
İşin ilginç tarafı, SESTEK'in hikayesi zaten sesle başlamıştı. İlk günden itibaren Konuşma Tanıma ve Metni Konuşmaya Dönüştürme teknolojilerine yatırım yaptık. Bunun arkasında şu inanç yatıyordu: İnsanların teknolojiyle etkileşime geçmesinin en doğal yolu konuşmaktır.
Yirmi beş yıl sonra bugün geldiğimiz noktada, yapay zeka asistanları dünya genelinde müşteri deneyimlerini dönüştürürken, o ilk vizyon her zamankinden daha anlamlı hale geldi.
Bir yapay zeka asistanı ne kadar zeki olursa olsun, robotik, doğal olmayan veya insan konuşmasından kopuk bir sesle konuştuğu anda deneyim bozuluyor.
Yapay zekanın geleceği yazılı değil, sözlü olacak.
Biz SESTEK olarak son birkaç yılda, ses teknolojimizi sıfırdan yeniden yapılandırmak için büyük yatırımlar yaptık. Ortaya çıkan sonuç, şaşırtıcı derecede doğal bir konuşma deneyimi sunan yeni nesil bir Metni Konuşmaya Dönüştürme teknolojisi oldu. Hatta o kadar gerçekçi hale geldi ki, bazı müşterilerimiz karşılarında gerçek bir insan olduğunu sanmaya başladı. Hatta bazıları, bunun aslında yapay zeka olduğunu öğrendikten sonra şikayet bile etti.
Bir an için düşünün…
On yıllar boyunca zorluk, yapay zekanın daha insansı duyulmasını sağlamaktı. Şimdiyse zorluk, onun bir insan olmadığını açıklamak.
Beni daha da heyecanlandıran nokta ise bunu, büyük ölçekli yapay zeka uygulamalarını ticari açıdan sürdürülebilir kılan bir maliyet yapısını koruyarak başarmış olmamız.
Bugün, milyarlarca dolar yatırım almış şirketlerin çözümleriyle yarışan ve birçok durumda onları geride bırakan bir ses kalitesi sunuyoruz. Bunu yaparken çok daha cazip bir maliyet avantajı da sunuyoruz.
Dün başlamadık. Çünkü 25 yıldır ses teknolojisi üzerine çalışıyoruz.
Dışarıdan bakınca yapay zeka devrimi bir anda patlamış gibi görünebilir. Bizim içinse bu, 25 yıllık bir emeğin ürünü.
Ve inanıyorum ki henüz yolun başındayız.
Yeni nesil seslerimizi kendiniz deneyimleyin: TTS demosunu deneyin
.avif)







