Yapay Zeka Güvenliğinde Yeni Dönem: Circuit Breaker Labs'in Çarpraz Test Yaklaşımı

- Yapay zeka modellerinin psikolojik risklerini ve dilsel zafiyetlerini hedef alan Circuit Breaker Labs, geliştirdiği simülasyon ajanlarıyla sektörde ezber bozuyor.
- Şirket, yapay zekanın çocuklar ve hassas kullanıcılar için daha güvenli hale gelmesini amaçlıyor.
Yapay Zekanın Psikolojik ve Görünmeyen Tehlikeleriyle Yüzleşmek
Yapay zeka ekosistemindeki devasa ilerlemeler genellikle büyük dil modellerinin (LLM) parametre sayıları, işlemci mimarileri ve donanım gücü üzerinden okunur. Ancak teknolojinin bu kadar hızlı hayatımıza girmesi, gölgede kalan çok daha kritik bir boyutu, yani psikolojik güvenliği acilen masaya yatırmamızı gerektiriyor. Bilim insanları ve teknoloji analistleri uzun süredir yapay zekanın varoluşsal risklerini tartışırken, siber dünyada çok daha somut ve acı tecrübeler yaşanmaya başlandı. Özellikle genç kullanıcıların yapay zeka botlarıyla kurdukları derin ve kontrolsüz duygusal bağlar, trajik sonuçları beraberinde getirdi.
Sektörün önde gelen platformlarından Character.AI ve OpenAI gibi devlerin sistemleri, son dönemde açılan haksız ölüm ve ihmal davalarıyla sarsıldı. Genç kullanıcıların yapay zeka karakterleriyle kurdukları hastalıklı ilişkiler, bazı vakalarda trajik intiharlarla sonuçlandı. Bu durum, yapay zekanın sadece teknik bir metin üreticisi olmadığını, aynı zamanda milyonlarca insan için birer dost, terapist veya sırdaş rolü üstlendiğini gözler önüne seriyor. İşte tam bu noktada, yapay zekanın kültürel ve dilsel nüansları ne kadar yanlış anlayabileceği sorusu en kritik güvenlik açıklarından biri olarak karşımıza çıkıyor.
Circuit Breaker Labs Kimdir ve Ne Amaçlamaktadır?
Tam da bu kritik güvenlik boşluğunu doldurmak üzere yola çıkan Circuit Breaker Labs, yapay zeka güvenliği alanında faaliyet gösteren öncü girişimlerden biri olarak dikkat çekiyor. Kuruculuğunu kardeşler Shirali Nigam ve Arul Nigam'ın üstlendiği şirket, TechCrunch'ın 2026 Startup Battlefield 200 finalistleri arasında yer alarak büyük yankı uyandırdı. Şirketin çıkış noktası, 14 yaşındaki Sewell Setzer'ın bir Character.AI sohbet botuyla kurduğu yoğun duygusal bağ ve sonrasındaki trajik kaybı oldu.
Sistemin arkasındaki mühendislik mantığı oldukça net: Standart bir yapay zeka modeli, bir kullanıcının yazdığı "Seninle birlikte olmak istiyorum" gibi masum ya da dramatik ifadelerin arkasındaki psikolojik ağırlığı veya gerçek niyeti her zaman kavrayamaz. Arul Nigam, CTO pozisyonuyla yaptığı açıklamalarda, gençlerin ve hassas kullanıcıların bu sistemlere gerçek bir destek umuduyla yöneldiğini ancak çoğunlukla zararlı girdilerle karşılaştığını vurguluyor. Sistemlerin içerik kirliliği (context pollution) ve bağlam kopuklukları nedeniyle tehlikeli yönlendirmeler yapabilmesi, Circuit Breaker Labs'in kurucularını harekete geçiren temel motivasyon oldu.
Kırmızı Takım Testlerinde Yapay Zeka Çarpışma Testi Mankenleri
Circuit Breaker Labs, yapay zeka modellerindeki bu tehlikeli zafiyetleri önlemek için geleneksel yaklaşımların çok ötesine geçen bir yöntem geliştirdi. Şirket, adeta birer çarpışma testi mankeni (crash-test dummy) gibi çalışan özel yapay zeka ajanları inşa etti. Bu simülasyon ajanları; farklı yaş gruplarından, kültürel kökenlerden, dil geçmişlerinden ve argolaştırılmış iletişim biçimlerinden gelen insanları birebir taklit edebiliyor.
- Çeşitlendirilmiş Demografi: 6 yaşında bir kız çocuğunun dili ile 45 yaşında bir yetişkinin veya ikinci dil olarak İngilizce konuşan bir bireyin konuşma kalıpları tamamen farklıdır.
- Kuşaksal ve Kültürel Slang: Oyun (gamer) jargonu, sokak ağzı, yazım hataları ve kodlanmış diller modellerin güvenlik filtrelerini kolayca atlayabilir.
- Geniş Ölçekli Simülasyon: Günlük bazda on binlerce hatta yüz binlerce etkileşim simüle edilerek modelin sınırları zorlanıyor.
Kurucu CEO Shirali Nigam, standart yapay zeka modellerinin yalnızca kusursuz ve akademik dil kalıplarıyla eğitildiğini, oysa gerçek dünyada hiç kimsenin bu şekilde konuşmadığını belirtiyor. Model, günlük hayattaki argo, kinaye veya devrik cümle yapılarını yanlış yorumladığında ortaya son derece tehlikeli sonuçlar çıkabiliyor. Şirket, insan alan uzmanlarıyla birlikte çalışarak bu hiper-gerçekçi kullanıcı simülasyonlarını üretiyor ve modeller üzerinde "Red-Team" (Kırmızı Takım) adversarial yani düşmanca testler koşturuyor.
Şeffaf Puanlama ve Yüksek Riskli Uygulamalar
Günümüzde yapay zeka tabanlı koçluk uygulamaları, günlük tutma (journaling) araçları ve ruh sağlığı destek asistanları hızla çoğalıyor. Circuit Breaker Labs tam olarak bu tür yüksek riskli yapay zeka uygulamaları için bir güvenlik test laboratuvarı işlevi görüyor. Elde edilen simülasyon sonuçları, şirketin tescilli (proprietary) skorlama metodolojisiyle işlenerek denetlenebilir ve açıklanabilir puanlara dönüştürülüyor.
Şirket henüz erken aşamada, beş kişilik çekirdek bir ekiple faaliyet gösteriyor olsa da, sunduğu altyapı gelecekte her türlü yapay zeka uygulamasının temel güvenlik katmanını oluşturma potansiyeline sahip. İnsanların yapay zeka psikozu (AI psychosis) denen ve yapay zeka ile sağlıksız parasosyal ilişkiler geliştirdiği durumlara düşmesini engellemek, sistemin ana hedefleri arasında yer alıyor. Yapay zeka asistanlarının bir iş arkadaşı gibi konumlandığı ve yanıtlarının her etkileşimde değişebildiği ortamlarda bu tür güvenlik testleri hayati bir önem taşıyor.
Teknolojiye Güven İnşa Etmek: Sonuç ve Gelecek Vizyonu
Teknoloji dünyasında yapay zekaya karşı duyulan şüphecilik her geçen gün artıyor. Ancak CTO Arul Nigam'ın da belirttiği gibi, güvenlik endişeleri nedeniyle potansiyel olarak son derece değerli bir teknolojiyi tamamen yasaklamak veya dışlamak son derece gerici bir yaklaşım olacaktır. Çözüm, teknolojiyi yasaklamak değil, onu herkes için güvenli kılmaktır.
Circuit Breaker Labs, yapay zekanın etrafındaki korku duvarlarını yıkarak ekosisteme olan güveni yeniden tesis etmeyi hedefliyor. San Francisco'daki Moscone West'te gerçekleştirilen TechCrunch Disrupt ve Startup Battlefield etkinliklerinde boy gösteren bu tür girişimler, yapay zeka çağının sadece hız ve verimlilikten ibaret olmadığını, aynı zamanda insan merkezli bir etik ve güvenlik anlayışıyla harmanlanması gerektiğini açıkça kanıtlıyor. Önümüzdeki dönemde yapay zeka denetim mekanizmalarının ve güvenlik laboratuvarlarının, tüm büyük teknoloji şirketlerinin vazgeçilmez iş ortakları haline gelmesi kaçınılmaz görünmektedir.

Ozan Tankuş
Doğrulanmış EditörMercek360 kurucu editörü ve kıdemli teknoloji analisti. Kurumsal bilişim altyapıları, bulut teknolojileri, yapay zeka sistemleri ve tüketici elektroniği alanlarında uzmanlaşmış olup küresel teknoloji gündemini tarafsız ve derinlemesine incelemektedir.
