İçeriğe geç
Türkçe
FikirPilot içeriği

Kendimin etkileşimli bir dijital avatarını oluşturdum; onunla konuşabilirsiniz

Güncellendi: 03.10.2026 · 3 dk okuma · 435 kelime

Yayımlandı: · Haber bize ulaştı: · İşlenme süresi: 101 sa 46 dk

Kendimin etkileşimli bir dijital avatarını oluşturdum; onunla konuşabilirsiniz
Bilgisayar ekranında dijital avatar

Synthesia’nın kurumsal ilişkiler başkanı Alexandru Voica, şirket hakkında basın sorularını yanıtlamak üzere kendi görüntüsü ve sesiyle oluşturulmuş etkileşimli bir avatar kullanıyor. Birleşik Krallık merkezli şirket, dijital avatar alanında D-ID, HeyGen ve Colossyan gibi girişimlerle birlikte faaliyet gösteriyor. Synthesia’nın bu yılın başında $4 billion değerlemeye ulaştığı, geçen yıl ise $100 million ARR seviyesini aştığını açıkladığı belirtildi.

Şirket, işletmelerin yapay zekâ avatarlarıyla eğitim videoları hazırlamasını sağlıyor. Yeni Roleplay Sessions ürünüyle çalışanlar, satış sunumları gibi senaryoları etkileşimli avatarlarla prova edebiliyor; avatarlar yanıtları değerlendirip puanlayabiliyor.

TechCrunch yazarı Dominic-Madori Davis, Synthesia’nın New York’taki ofisinde kendi dijital avatarını oluşturdu. Bunun için çok sayıda fotoğrafı çekildi ve sesinden iki dakikalık kayıt alındı. Şirket, gözlüklü ve gözlüksüz iki kişisel avatar ile iki etkileşimli avatar hazırladı. Kişisel avatar verilen metni okurken, etkileşimli avatar dinleyip yanıt verebiliyor. Davis’in etkileşimli avatarı, girişim destekli startup’ların diğer startup’lara kıyasla neden daha fazla sahtekârlık yaptığına ilişkin yazısıyla eğitildi ve yalnızca bu konu hakkındaki soruları yanıtlayacak şekilde tasarlandı.

Avatarın teknolojik işleyişi dört aşamadan oluşuyor:

  • Ses-metin modeli, kullanıcının söylediklerini metne dönüştürüyor.
  • Etmen tabanlı dil modeli, metni anlamlandırıp buna göre işlem yapıyor.
  • Metin-ses modeli, yanıtı sese çeviriyor.
  • Synthesia tarafından geliştirilen video modeli, avatarı konuşurken canlandırıyor.

Synthesia’nın ürünleri üç ana gruba ayrılıyor:

  • Kullanıcının yazdığı metni avatarın okuduğu video oluşturma ve dağıtım platformu.
  • Anket ve rol yapma gibi etkileşimler sağlayan Sessions adlı etmen tabanlı platform.
  • Şirketin video ve ses modellerinin başka hizmetlerle birleştirilmesine olanak veren API platformu.

Şirket, kendi modellerinin yanı sıra Cartesia, ElevenLabs, Google ve OpenAI modellerine de izin veriyor; işletmeler avatarları istedikleri bulutta barındırabiliyor veya Synthesia’nın barındırma hizmetini kullanabiliyor.

Avatarların hazırlanması birkaç gün sürdü. Davis, kişisel avatarın sesini oldukça başarılı bulurken, arkadaşları etkileşimli avatarın görünümünü ve sesini biraz rahatsız edici buldu. Avatar yalnızca eğitildiği girişim sahtekârlığı hikâyesiyle ilgili sorulara yanıt verdi; Davis’in ailesinin kişisel sorularını da yanıtsız bıraktı.

Davis, bu deneyimin gazetecilikte güvenin yapay zekâya devredilip devredilemeyeceği sorusunu gündeme getirdiğini belirtti. Dijital kopyaların tatil sırasında kullanıcı adına soruları yanıtlamasının çekici olabileceğini, ancak kendi avatarlarıyla ilgili karmaşık duygular taşıdığını aktardı.

Neden önemli

Bu gelişme, şirketlerin eğitim ve prova süreçlerinde yalnızca izlenen videolar yerine çalışanla karşılıklı iletişim kuran sistemleri kullanabileceğini gösteriyor. Böylece satış sunumu gibi uygulamalarda değerlendirme ve puanlama işlevleri, eğitmenin her aşamada sürece dahil olmasına duyulan ihtiyacı azaltabilir; ancak avatarın yalnızca önceden belirlenen konu çerçevesinde yanıt verebilmesi, kullanım alanlarının hâlâ sınırlı olduğunu ortaya koyuyor. Teknolojinin gazetecilikte kullanılması ise bir kişinin dijital kopyasının bilgi aktarımındaki rolünü ve izleyicinin bu kopyaya ne ölçüde güveneceğini gündeme getiriyor. Kişisel avatarların farklı bulutlarda barındırılabilmesi ve çeşitli model seçenekleri sunulması, işletmeler için teknik tercih alanı yaratırken verilerin ve temsil yetkisinin nasıl yönetileceği sorusunu açık bırakıyor.

Kaynak: TechCrunch AI