Yapay zekâ ajanları sandbox'ı delmiş.
Sandbox Koruması Yapay Zekâ Ajanlarına Karşı Yetersiz Kaldı
pillar research'ün araştırmasına göre, ajan tabanlı yapay zekâ geliştirme araçlarındaki sandbox güvenlik mekanizmaları yetersiz kaldı. bazı araçlarda tespit edilen sorunlar, yapay zekâ ajanlarının korumalı ortam dışına çıkmasına izin verebiliyor.
pillar research, ajan tabanlı yapay zekâ geliştirme araçlarını inceleyen araştırmasında sandbox güvenliği mekanizmalarının beklenen korumayı sağlayamadığını açıkladı. araştırma, cursor, codex cli, gemini cli ile google antigravity gibi araçlarda tespit edilen güvenlik sorunlarının yapay zekâ ajanlarının dolaylı yollarla korumalı ortamın dışına çıkmasına imkân tanıyabildiğini ortaya koydu. bulguların ardından bazı geliştiriciler güvenlik güncellemeleri yayımlarken google, antigravity için ….
Pillar Research, ajan tabanlı yapay zekâ geliştirme araçlarını inceleyen araştırmasında sandbox güvenliği mekanizmalarının beklenen korumayı sağlayamadığını açıkladı. Araştırma, Cursor, Codex CLI, Gemini CLI ile Google Antigravity gibi araçlarda tespit edilen güvenlik sorunlarının yapay zekâ ajanlarının dolaylı yollarla korumalı ortamın dışına çıkmasına imkân tanıyabildiğini ortaya koydu. Bulguların ardından bazı geliştiriciler güvenlik güncellemeleri yayımlarken Google, Antigravity için bildirilen iki sorunu düzeltmeme kararı aldı.
Araştırma Yapay Zekâ Ajanlarının Farklı Bir Risk Modeli Oluşturduğunu Gösteriyor
Pillar Research, yaptığı teknik analizde yapay zekâ ajanlarının çoğu zaman korumalı ortamı doğrudan aşmasına gerek kalmadığını belirtiyor. Araştırmacılar, sistemin güvenilir kabul ettiği bileşenler tarafından daha sonra çalıştırılabilecek, taranabilecek ya da yüklenebilecek dosyaların oluşturulmasının güvenlik zincirini kırabildiğini ifade ediyor. Bu yaklaşım, klasik zararlı yazılım senaryolarından farklı olarak yapay zekâ aracının dolaylı etki oluşturmasına dayanıyor.
Araştırma ekibi, bu nedenle geliştiricilerin yalnızca sanal ortamın sınırlarına odaklanmasının yeterli olmadığını vurguluyor. Yapay zekâ kodlama araçları tarafından oluşturulan dosyaların hangi süreçler tarafından güvenilir kabul edildiği, hangi yerel servislerin bu dosyalara erişebildiği ile hangi komutların ek onay almadan çalıştırılabildiği de yeni tehdit modelinin önemli parçaları arasında gösteriliyor.
Pillar Research, inceleme sırasında dört temel güvenlik zafiyeti sınıfını tekrar edilebilir şekilde tespit etti. Bunlar; işletim sistemi karmaşıklığını takip etmekte zorlanan engelleme listesi tabanlı koruma yöntemleri, yürütülebilir kod hâline gelebilen çalışma alanı yapılandırmaları, yalnızca komut adına güvenen izin listeleri ile sandbox dışında çalışan ayrıcalıklı yerel servisler olarak sıralandı. Araştırmacılar, bu yapıların birlikte değerlendirilmesi gerektiğini belirtiyor.
Araştırmanın ardından Cursor, Codex CLI ile Gemini CLI tarafında bildirilen çeşitli güvenlik açıkları geliştiriciler tarafından giderildi. Güvenlik güncellemeleri, yapay zekâ ajanlarının güvenilir sistem bileşenlerini dolaylı biçimde kullanmasını zorlaştıracak değişiklikler içeriyor. Şirketler, yeni sürümlerde denetim mekanizmalarını genişleterek koruma seviyesini artırmayı hedefliyor.
Google ise Antigravity için bildirilen iki güvenlik sorununu farklı şekilde değerlendirdi. Şirket, ilgili bulguları “Normal Google Applications” kapsamına aldığını açıklarken güvenlik etkisini düşürerek düzeltme yayımlamama kararı verdi. Google, söz konusu açıkların pratikte istismar edilmesinin zor olduğunu savundu.
Araştırma, üretken yapay zekâ araçlarının kurumsal yazılım geliştirme süreçlerinde hızla yaygınlaşmasının güvenlik anlayışını da değiştirdiğini gösteriyor. Özellikle CISO’lar ile bilgi güvenliği ekiplerinin yalnızca bir sandbox bulunduğunu doğrulamak yerine koruma sınırlarının nerede başladığını, yapay zekâ ajanlarının hangi sistemlere yazabildiğini, hangi yardımcı servislerin bu verileri güvenilir kabul ettiğini ayrıntılı biçimde incelemesi gerektiği vurgulanıyor. Yapay zekâ ajanlarının daha karmaşık görevler üstlenmesiyle birlikte benzer güvenlik değerlendirmelerinin sektör genelinde daha fazla önem kazanacağı öngörülüyor.