- Katılım
- 30 Kasım 2014
- Mesajlar
- 152
- Tepki puanı
- 68
Google, 24 Eylül 2026'da Gemini 3.8 Live için "Live Avatar" özelliğini duyurdu: Model artık sesli ve görüntülü sohbette animasyonlu bir yüzle, gerçek zamanlı yanıt veriyor. Özellik şimdilik yalnızca kurumsal müşterilere açık.
Avatar özelliği, Google'ın yaklaşık bir hafta önce tanıttığı ve "görsel girdileri neredeyse gerçek zamanlı işleyen" Gemini 3.8 Live modelinin üzerine geliyor.
Sesli asistanlar yıllardır hayatımızda ama hep "görünmez" kaldılar. Yüz ifadesi eklenince kullanım senaryoları değişiyor: online eğitim, müşteri karşılama, satış sunumu, erişilebilirlik (işitme engelliler için dudak okuma). Aynı zamanda yeni bir etik boyut açılıyor; sentetik bir yüzün kurumsal marka adına konuşması ve bu içeriğin ayırt edilebilir olması gerekiyor. Google'ın SynthID filigranı tam bu noktaya cevap veriyor.
Dikkat
Buradaki teknik iddialar (97 dil, gerçek zamanlı görüntü, kalite kaybı olmaması) Google'ın kendi açıklamasına dayanıyor; bağımsız ölçüm henüz yok. Enterprise dışındaki kullanıcılar için çıkış tarihi belirsiz. Ayrıca yüz klonlama içeren özelliklerde rıza ve telif konuları ülkeye göre değişiyor.
Kaynaklar:
Sonuç
Yapay zekâ arayüzleri metinden sese, sesten yüze doğru ilerliyor. Kurumsal tarafta "yüzü olan asistan" ciddi bir fark yaratabilir; ancak erişim şimdilik sınırlı ve iddialar üretici kaynaklı. Takip edilmesi gereken bir gelişme.
Ne Oldu?
- Live Avatar, konuşurken dudak senkronizasyonu yapıyor ve yüz ifadelerini değiştiriyor.
- Google'a göre avatar, desteklediği 97 dil arasında geçiş yaparken video kalitesi bozulmuyor.
- Konuşma sırasında ekranda bilgi gösterebiliyor; yani sadece konuşmuyor, veriyi de görselleştiriyor.
- Şu an yalnızca Gemini Enterprise müşterileri kullanabiliyor.
- Hazır avatar kitaplığı sunulacak; kurumlar kendi avatarlarını da oluşturabilecek.
- Çıktılarda SynthID görünmez filigranı ve "kimliğe saygı" korumaları bulunuyor.
Avatar özelliği, Google'ın yaklaşık bir hafta önce tanıttığı ve "görsel girdileri neredeyse gerçek zamanlı işleyen" Gemini 3.8 Live modelinin üzerine geliyor.
Neden Önemli?
Sesli asistanlar yıllardır hayatımızda ama hep "görünmez" kaldılar. Yüz ifadesi eklenince kullanım senaryoları değişiyor: online eğitim, müşteri karşılama, satış sunumu, erişilebilirlik (işitme engelliler için dudak okuma). Aynı zamanda yeni bir etik boyut açılıyor; sentetik bir yüzün kurumsal marka adına konuşması ve bu içeriğin ayırt edilebilir olması gerekiyor. Google'ın SynthID filigranı tam bu noktaya cevap veriyor.
Nasıl Kullanılıyor?
- Bireysel kullanıcılar şu an özelliği göremiyor; erişim kurumsal planla sınırlı.
- Kurumsanız Google'ın kurumsal kanallarından erişim talep etmeniz gerekiyor.
- Kendi avatarınızı üretmek isterseniz şirket içi marka kurallarınızı ve rıza süreçlerini önceden planlayın.
- Müşteriye dönük kullanımda, çıktının yapay zekâ üretimi olduğunu belirtmek hem etik hem yasal açıdan gerekli.
Dikkat
Buradaki teknik iddialar (97 dil, gerçek zamanlı görüntü, kalite kaybı olmaması) Google'ın kendi açıklamasına dayanıyor; bağımsız ölçüm henüz yok. Enterprise dışındaki kullanıcılar için çıkış tarihi belirsiz. Ayrıca yüz klonlama içeren özelliklerde rıza ve telif konuları ülkeye göre değişiyor.
Kaynaklar:
Sonuç
Yapay zekâ arayüzleri metinden sese, sesten yüze doğru ilerliyor. Kurumsal tarafta "yüzü olan asistan" ciddi bir fark yaratabilir; ancak erişim şimdilik sınırlı ve iddialar üretici kaynaklı. Takip edilmesi gereken bir gelişme.