Yapay zekâ ile görüntülü görüşme genellikle sırayla konuşan iki taraf hissi verir. Tavus, Griffin modelini tanıtırken bu bekleme aralığını azaltmaya odaklanıyor: Sistem karşısındakini dinleyip izlerken kendi yanıtını da üretebiliyor. Teknoblog’da ele aldığımız Gemini Live Avatar gibi canlı yüz üreten çözümlerle aynı alana giren Griffin, şirketin anlatımına göre konuşma sırasını, bakışları ve kısa tepkileri tek bir etkileşim içinde yönetiyor. Şimdilik herkesin kullanabileceği bir hizmet değil.
Tavus, Griffin’i “İnsan Etkileşim Modeli” olarak adlandırıyor. Buradaki temel fikir, sesi yazıya çevirip metin yanıtı hazırlayan ve ardından ayrı bir görüntü motorunu çalıştıran parçalı zinciri kısaltmak. Şirketin açıklamasında modelin gelen ses ve videoyu sürekli değerlendirdiği, ne zaman konuşacağına veya susacağına küçük zaman aralıkları içinde karar verdiği belirtiliyor. Böylece karşı taraf söze girdiğinde yanıtını durdurabiliyor; kullanıcı düşünürken baş hareketiyle dinlediğini gösterebiliyor.
Şirketin paylaştığı bir dakikalık canlı görüşme çalışmasında katılımcıların yüzde 48’i karşılarında gerçek bir insan bulunduğunu düşündü. Bu oran dikkat çekici olsa da çalışmanın koşulları ve örneklemi sonucu gündelik kullanımdaki her görüşmeye taşımaya yetmiyor. Tavus’un “gerçek zamanlı video Turing testini geçen ilk model” nitelemesi de kendi değerlendirmesine dayanıyor. Görüntü kalitesi kadar ağ gecikmesi, konuşma dili ve beklenmedik sorulara verilen yanıtlar da kullanıcı deneyimini belirleyecek.
İLGİNİZİ ÇEKEBİLİR
Griffin’in mimarisinde konuşmanın akışını izleyen bir karar sistemi ile ses ve görüntüyü üreten ikinci bir bölüm birlikte çalışıyor. Tavus, bunları aynı anda işleterek klasik soru-cevap düzenindeki sessiz boşlukları azaltmak istiyor. Bunun yanında yüz ifadesi veya duraksama gibi söz dışı işaretlerin yorumlanması, müşteri desteği ve uzaktan eğitim gibi alanlarda daha doğal bir görüşme sunabilir. Bu kullanım örnekleri henüz ürünün geniş ölçekte başarısını kanıtlamıyor; şirketin öngördüğü olasılıkları gösteriyor.
Griffin’e kimler erişebilecek?
Tavus, ilk erişimi Griffin-Lite adlı araştırma önizlemesiyle sınırlı bir test grubuna açtı. Daha güçlü bir sürümün ileride sunulacağını söylüyor, fakat genel kullanıma açılma tarihi veya fiyat paylaşmıyor. Bu nedenle tanıtım videolarını bugün herkesin başlatabileceği bir görüntülü görüşme hizmeti gibi değerlendirmemek gerekiyor. Geliştiricilerin modeli kendi uygulamalarına hangi koşullarda ekleyebileceği de sonraki duyurularla netleşecek.
Günün Öne Çıkan Fırsatları

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.
Şirket, NVIDIA’nın görüntülü görüşme modellerini değerlendiren VideoFDB ölçümlerinde Griffin-Lite’ın bazı karşılaştırmalarda öne çıktığını da aktarıyor. Bu sonuçlar özellikle tepkinin zamanlaması ve üretilen yüzün akıcılığı açısından anlamlı. Öte yandan bir kıyaslamada yüksek puan almak, farklı ışık koşullarında, zayıf bağlantıda veya uzun görüşmelerde aynı deneyimin korunacağını tek başına göstermiyor. Bağımsız kullanıcı denemeleri bu noktada daha açıklayıcı olacak.
Gerçeğe yakın dijital bir yüzün nerede kullanıldığı da teknik başarı kadar önemli. Tavus, modelin insanla karıştırılabilecek düzeyde etkileşim kurabildiğini öne sürerken, görüşmenin başında yapay zekâ kimliğinin açıkça belirtilmesi ve kişilerin görüntü ile ses verilerinin nasıl işlendiğinin anlatılması gerekecek. Özetleyecek olursak Griffin, canlı konuşmanın ritmini iyileştirmeyi hedefleyen bir araştırma adımı; asıl sınavını sınırlı önizleme dışındaki gerçek kullanımda verecek.











