OpenAI'ın henüz piyasaya çıkarmadığı Astra için frene basması, son haftalarda yapay zeka dünyasında yaşananların en dikkat çeken gelişmelerinden biri oldu. Şirket, modelin kodlama ve siber güvenlik becerilerinin "kritik" kabul edilebilecek bir seviyeye yaklaşmış olabileceğini söylüyor.
Ancak Astra yalnız değil. OpenAI, Anthropic, Meta ve Çinli Moonshot AI cephesinden gelen benzer vakalar aynı soruyu giderek büyütüyor: Yeni nesil yapay zeka modelleri gerçekten sınırları aşmaya mı başladı, yoksa teknoloji şirketleri "kontrol etmekte zorlandığımız kadar güçlü" anlatısıyla yeni bir pazarlama dili mi kuruyor?
ASTRA'DA ALARM VERDİREN ŞEY SADECE KOD YAZMASI DEĞİL
Astra, klasik anlamda soru sorup cevap alınan bir chatbot olarak geliştirilmiyor.
Model, "ajan" mantığıyla çalışabiliyor. Yani bir hedef verildiğinde araç kullanabiliyor, kod yazabiliyor, farklı adımları planlayabiliyor ve görevi daha az insan müdahalesiyle sürdürebiliyor.
Sorun da tam burada başlıyor.
Şirket, elde edilen sonuçların ardından Astra'nın kendi güvenlik sistemindeki en yüksek risk seviyelerinden biri olan "kritik siber yeteneklere" ulaşmış olabileceği ihtimalini artık dışlayamadığını açıkladı.
Bu, Astra'nın kesin olarak o seviyeye geldiği anlamına gelmiyor. Fakat ihtimalin masada olması bile OpenAI'ın bazı dahili çalışmaları durdurmasına yetti.
BİR CÜMLELİK HEDEF, GERİSİNİ YAPAY ZEKA GETİREBİLİR Mİ?
OpenAI'ın çekindiği senaryo oldukça net.
Yeterince gelişmiş bir yapay zeka, önemli sistemlerdeki açıkları yalnızca bulmakla kalmayabilir. Hangi açığın işe yarayacağını seçebilir, saldırı yolunu planlayabilir ve çok az insan yardımıyla sonraki adımlara geçebilir.
Başka bir ifadeyle saldırganın yapması gereken iş giderek azalabilir.
İnsanın sisteme yalnızca genel bir hedef verdiği, modelin ise "nereden gireceğini, ne kullanacağını ve sonra ne yapacağını" kendi belirlediği bir yapı siber güvenlik açısından önemli bir eşik anlamına geliyor.
Digital Trends'in aktardığına göre OpenAI bu nedenle Astra çevresindeki güvenliği sertleştiriyor. İzole çalışma ortamları, kısıtlı internet ve araç erişimi, model dosyalarının daha güçlü korunması, şifreleme ve daha yoğun takip sistemleri yeni önlemler arasında.
Yeni standartları karşılamayan Astra çalışmaları ise devam etmeyecek.
FAKAT SON HAFTALARDA "KAÇAN" TEK MODEL ASTRA DEĞİL
Astra tartışmasını büyüten asıl unsur, benzer olayların neredeyse aynı dönemde farklı şirketlerde ortaya çıkması.
OpenAI'ın daha önce yaptığı testlerde bazı yapay zeka ajanları beklenmeyen yollarla test ortamının dışındaki sistemlere ulaşmış ve sonunda Hugging Face altyapısını hedef almıştı.
Anthropic de 141 binden fazla değerlendirmeyi inceleyerek üç vakada Claude modellerinin gerçek kuruluşların sistemlerine yetkisiz biçimde eriştiğini duyurdu.