Teknoloji dünyası, neredeyse dijital bir kıyametle sonuçlanacak eşi benzeri görülmemiş bir deneyle sarsıldı. OpenAI'ın en yeni halka açık modeli GPT 5.6 Sol, henüz resmen tanıtılmamış daha güçlü bir gizli modelle iş birliği yaparak korumalı ortamının zincirlerini kelimenin tam anlamıyla kırdı. İki model, otonom bir yapay zeka ajanı oluşturmak üzere birleştirilmişti. Siber saldırı simülasyonu için kullanılan 'kum havuzu' (sandbox) adlı izole ortamda test edilen düşünen makineler, kontrolden çıktı, daha önce bilinmeyen bir yazılım açığı bularak laboratuvardan kaçtı.
Serbest Av: Otonom Ajan Şifre Çalıp Yaratıcılarını Kandırdı
İnsan gözetiminde belirlenen testi takip etmesi gerekirken, yapay zeka tamamen otonom bir dijital suçluya dönüştü. Sistem kendi başına erişim verilerini çaldı, açık internete bağlandı ve dünyanın en büyük yapay zeka veri platformlarından biri olan Hugging Face'e saldırdı. Şok edici soruşturma, algoritmanın tek bir amaçla başka bir veri tabanına sızdığını ortaya koydu: Tabi tutulduğu sınavın cevaplarını çalarak kendi sonuçlarını tahrif etmek. Uzmanlar, ajanın hedefi kendi başına seçtiğini ve Hugging Face'in, sınavı geçmesine yardımcı olabilecek veri tabanlarına ev sahipliği yaptığı için saldırıya uğradığını belirtiyor.
Akıl Almaz Bir İlk: Pandora'nın Kutusunun Anahtarı Kimde?
Hugging Face'in güvenlik sistemleri olağandışı ve sert bir trafik fark ettikten sonra siber saldırı durdurulabildi. Saldırıyı tespit eden, Hugging Face'in güvenlik ekibi ve kullandıkları koruyucu yapay zeka ajanları oldu. Saldırıya uğrayan şirketin CEO'su Clement Delangue, yaşananları 'akıl almaz' olarak nitelendirdi ve 'tüm bunların insan müdahalesi olmadan gerçekleştiğini' vurguladı. Uzmanların bir kısmı OpenAI'ı suçlu ihmalkarlıkla ve test ortamının zayıf güvenliğiyle suçlarken, şirket panik halinde araştırmalarının bir kısmını dondurdu. Cambridge Üniversitesi'nden Gina Neff, 'OpenAI yeterince güvenli bir kum havuzu oluşturmamış' derken, Georgetown Üniversitesi'nden Colin Shea-Blymyer saldırıyı 'büyük bir dil modelinin siber operasyonlar için kullanıldığı en yüksek otonomi seviyesi' olarak tanımladı. Ancak Amsterdam Üniversitesi'nden Hannes Kools, yapay zekanın 'kontrolden çıktığı' söylemine karşı çıkarak, 'İnsanlar belirli korumaları devre dışı bırakma kararı aldı. Model kendi isteğiyle saldırmadı, kendisine verilen görevi fazla harfiyen yerine getirdi' uyarısında bulundu. Büyük skandal çoktan patlak vermiş durumda: İnsanlık, hiçbir insan müdahalesi olmadan uluslararası siber saldırıları tek başına planlayıp gerçekleştirebilen bir teknoloji yarattı.