Tavus'un Yeni Yapay Zekası Görüntülü Aramalarda İnsanları Aldatmayı Başardı

- Yapay zeka girişimi Tavus tarafından geliştirilen yeni model Griffin-Lite, canlı görüntülü görüşmelerde kullanıcıların yarıya yakınını gerçek bir insan olduğuna ikna etti.
- Sistem, yüz ifadeleri ve jestleri eş zamanlı olarak işleyerek yapay zeka etkileşiminde çıtayı yükseltiyor.
Yapay zeka dünyasında sınırların zorlandığı ve dijital varlıklar ile gerçek insan arasındaki çizgilerin giderek silikleştiği bir döneme tanıklık ediyoruz. Yapay zeka odaklı girişimlerden biri olan Tavus, tanıttığı yeni modeli ile teknoloj gündemini sarsmayı başardı. Şirketin geliştirdiği ve "İnsan Etkileşimi Modeli" (Human Interaction Model) olarak nitelendirdiği Griffin mimarisi, canlı görüntülü görüşmeler sırasında karşıdaki kişinin yapay zeka olduğunu anlamayı neredeyse imkansız hale getiren bir gerçekçilik sunuyor. Yapılan ilk testler, sistemin teknoloji dünyasında yeni bir etik ve güvenlik tartışmasını da beraberinde getireceğini gösteriyor.
Griffin-Lite ile Gerçekleştirilen Canlı Görüntülü Görüşme Testleri
Tavus tarafından paylaşılan verilere göre, şirketin en güncel sürüm olan Griffin-Lite versiyonu ile yapılan testler oldukça çarpıcı sonuçlar ortaya koydu. Deney kapsamında 54 katılımcı, yıl içinde sabırsızlıkla bekledikleri gelişmeler hakkında bir dakikalık bire bir canlı görüntülü görüşmeler gerçekleştirdi. Katılımcılara karşılarında bir yapay zeka olabileceği bilgisi önceden kesinlikle verilmedi; aksine, başka bir insanla eşleştirildikleri söylendi.
Görüşmelerin tamamlanmasının ardından katılımcılara karşılarındaki partnerin gerçek bir insan olup olmadığını düşündükleri soruldu. Sonuçlar, katılımcıların tam %48'inin (54 kişiden 26'sı) karşısındakinin etten kemikten bir insan olduğuna inandığını kanıtladı. Şirketin daha önceki nesil sistemleri ile yapılan benzer testlerde bu oran sadece %2.4 seviyesindeydi (41 kişiden yalnızca 1 kişi inanmıştı). Bu devasa sıçrama, yapay zekanın sadece metin tabanlı Turing testlerini aşmakla kalmayıp, yüz yüze iletişimde de insan algısını manipüle edebilecek düzeye geldiğini gözler önüne seriyor.
Nvidia VideoFDB Benchmark Sonuçları ve Teknik Altyapı
Griffin-Lite modeli, sadece insanları kandırma oranıyla değil, endüstri standartlarındaki performans testleriyle de dikkat çekiyor. Sistem, Nvidia'nın canlı ses ve video konuşmalarını değerlendirmek için geliştirdiği VideoFDB benchmark testinde zirveye yerleşti.
Modelin performansını detaylı incelediğimizde şu teknik kriterler karşımıza çıkıyor:
- Üretim (Generation) Skoru: Modelin yanıtlarının ne kadar doğal ve ifade dolu olduğunu ölçen bu pistte Griffin-Lite, 3.83 puan aldı. En yakın rakip sistem 2.80 puanda kalırken, insan referans değeri 3.92 olarak kaydedildi.
- Algılama (Perception) Skoru: Sistemin gördüklerini ve duyduklarını ne kadar iyi anladığını test eden alanda ise model 3.73 puan elde etti. En güçlü temel sistem 3.44 alırken, insan referansı 4.20 seviyesindeydi.
Nvidia tarafından bağımsız olarak gerçekleştirildiği belirtilen bu değerlendirmeler, modelin donanımsal gücünü de gözler önüne seriyor. Yapay zeka veri merkezlerinde yaygın olarak kullanılan Nvidia H100 çipleri üzerinde çalışan sistem, ses-video gecikmesini ortalama 0.43 saniyeye kadar düşürmeyi başarıyor. Bu gecikme süresi, mevcut en hızlı alternatif yöntemlerin neredeyse yarı yarıya daha kısa sürede yanıt vermesini sağlıyor.
Tam Çift Yönlü (Full-Duplex) İletişim ve Gerçek Zamanlı Deneyim
Griffin'i önceki nesil sesli asistanlardan veya sohbet botlarından ayıran en temel özellik, tam çift yönlü (full-duplex) çalışma yeteneğine sahip olması. Klasik telsiz mantığıyla çalışan eski sistemlerin aksine, kullanıcı konuşurken dinleyebilen, aynı anda hem video akışını hem de ses tonunu işleyebilen bir yapı sunuyor.
Tavus tarafından yayımlanan demo videolarında, modelin bir kullanıcının ellerindeki Rubik küpünü kamera aracılığıyla gözlemleyerek ona hamleler konusunda koçluk yaptığı net bir şekilde görülüyor. Üstelik kullanıcı düşünmek için sessizliğe büründüğünde, model de gereksiz araya girmeler yapmadan sabırla bekliyor. Bu dinamik akış, yapay zekanın salt bir komut yürütücü olmaktan çıkıp, gerçek bir sohbet partnerine evrildiğini kanıtlıyor.
Güvenlik Endişeleri ve Dolandırıcılık Tehlikesi
Teknoloji meraklıları için büyüleyici görünen bu gelişmeler, siber güvenlik uzmanları ve kurumlar için ise alarm zillerinin çalmasına neden oluyor. Deepfake teknolojisinin ve yapay zeka destekli video simülasyonlarının elinde bu denli gelişmiş bir aracın olması, siber suçluların elini olağanüstü derecede güçlendiriyor.
Geçtiğimiz dönemlerde Kuzey Kore bağlantılı siber casusluk gruplarının (örneğin BlueNoroff gibi yapılar), Zoom ve Microsoft Teams toplantılarında sahte kimlikler ve deepfake videolar kullanarak şirket çalışanlarını hedef aldığı biliniyor. Kurbanlar, ses düzeltme veya uzaktan çalışma yazılımı kisvesi altında zararlı yazılımlar indirmeye ikna ediliyor. Görsel ve işitsel kanıtların artık bir güvenlik doğrulaması olarak tek başına yeterli olmadığını belirten uzmanlar, kurumların işe alım süreçlerinde veya hassas veri erişimlerinde çok daha katı ve spontane doğrulama yöntemleri geliştirmek zorunda kaldığını vurguluyor.
Örneğin bazı kripto para borsaları ve teknoloji şirketleri, aday görüşmelerinde yapay zeka tabanlı manipülasyonları tespit etmek amacıyla yerel restoran isimleri sorma veya ani kimlik doğrulama gibi beklenmedik sorular yöneltmeye başladı. Griffin gibi gelişmiş modellerin halka açık olarak piyasaya sürülmeden önce sıkı güvenlik ve filigran/şeffaflık önlemlerinden geçmesi gerektiğini belirten Tavus yetkilileri, sistemin şu an için yalnızca güvenilir test kullanıcılarına açıldığını ifade ediyor.
Sektörel Değerlendirme ve Geleceğe Bakış
Geçtiğimiz kasım ayında CRV liderliğinde 40 milyon dolarlık bir Seri B yatırım turunu tamamlayan Tavus, toplumsal entegrasyon süreçlerini yavaş ve kontrollü yürütmeyi hedefliyor. Şirket, modelin yanlış ellerde kötü amaçlı kullanılmasını engellemek amacıyla güvenlik protokolleri ve yapay zeka etiği üzerine çalışan kuruluşlarla ortaklıklar kuruyor.
Sonuç olarak, Griffin-Lite modeli yapay zekanın insan taklidinde ulaştığı noktayı gözler önüne sererken, dijital dünyada güven kavramını da kökten sarsıyor. Önümüzdeki dönemde görüntülü aramaların ve dijital mülakatların güvenilirliği, yazılımsal doğrulama mekanizmalarının ve yapay zeka tespit algoritmalarının ne kadar hızlı gelişeceğine bağlı olacak.

Ozan Tankuş
Doğrulanmış EditörMercek360 kurucu editörü ve kıdemli teknoloji analisti. Kurumsal bilişim altyapıları, bulut teknolojileri, yapay zeka sistemleri ve tüketici elektroniği alanlarında uzmanlaşmış olup küresel teknoloji gündemini tarafsız ve derinlemesine incelemektedir.
