Anthropic ve OpenAI, onaylanmış güvenlik ekiplerinin çoğu güvenlik filtresinden arındırılmış yapay zeka modelleriyle çalışmasına olanak tanıyan yeni bir araştırma yolu açtı. Anthropic'in “Cyber Verification Program” ve OpenAI'ın “Trusted Access for Cyber” programları, onaylanmış araştırmacılara kısıtlanmamış kod, istem (prompt) ve talimatlar üretebilen güçlü dil modellerine doğrudan erişim sağlıyor. Bu hamle önemlidir çünkü yapay zeka tedarik zincirinde net bir ayrım yaratıyor: Bir avuç içerideki kişi en zayıf sürümleri inceleyebilirken, dünyanın geri kalanı daha güçlü koruma bariyerlerinin arkasında kalıyor.
Programlar neden ortaya çıktı
Her iki firma da bu girişimlerin, kendi hizmetlerine karşı silah olarak kullanılabilecek güvenlik açıklarının keşfini hızlandırmayı amaçladığını belirtiyor. Kontrollü bir uzman grubuna daha az kısıtlamaya sahip bir sandbox sunarak, kötü niyetli aktörler bulmadan önce saldırı vektörlerini ortaya çıkarmayı umuyorlar. Bu yaklaşım, geliştiricilerin seçilmiş bir kitleye “bug-bounty” (hata ödülü) sürümleri sunduğu geleneksel yazılım güvenliğini yansıtıyor.
Savunmacılar için yeni risk hesabı
Madalyonun diğer yüzünde ise her kuruluşu “araştırmacı” ve “hacker” arasında bir çizgi çekmeye zorlayan iki kademeli bir erişim modeli bulunuyor. Bu çizgi artık potansiyel bir saldırı yüzeyi haline geliyor. Eğer bir saldırgan kimlik bilgilerini çalarsa, bir içerideki kişinin erişimini istismar ederse veya inceleme sürecini aldatırsa, çoğu kullanıcıyı koruyan güvenlik bariyerlerini aşabilir. İçeri sızıldığında, kısıtlanmamış model şunları yapmaya zorlanabilir:
- Tespit edilmekten kaçınan kimlik avı (phishing) betikleri oluşturmak
- Detaylı kod parçacıklarıyla sıfırıncı gün (zero-day) açıkları hazırlamak
- Belirli hedeflere göre uyarlanmış, ikna edici sosyal mühendislik istemleri üretmek
Savunmalarını yapay zeka çıktılarının her zaman filtrelendiği varsayımı üzerine kuran güvenlik ekipleri, bu önermeyi yeniden düşünmelidir.
Savunmacılar nasıl yanıt verebilir
- Programları bir tehdit vektörü olarak değerlendirin. Saldırganların inceleme sürecine sızmaya çalışacağını varsayın ve yapay zeka platformlarındaki anormal giriş modellerini izleyin.
- Tespiti bulutun ötesine taşıyın. Özellikle ayrıcalıklı hesaplardan gelen giden trafikte yapay zeka tarafından oluşturulmuş kod veya metinleri arayın.
- Politika kontrollerini sisteme entegre edin. Harici yapay zeka hizmetlerinin her türlü dahili kullanımı için katı “en az ayrıcalık” (least-privilege) kurallarını uygulayın ve ele geçirilmiş bir kimlik bilgisiyle erişilebilecek ortamları segmente edin.
- Tedarikçilerle iş birliği yapın. Erişim kriterlerindeki değişiklikler veya keşfedilen suistimaller hakkında uyarılar almak için Anthropic ve OpenAI'ın güvenlik irtibat kanallarıyla iletişimde kalın.
Karşı görüş
Destekleyenler, derinlemesine inceleme için güvenli bir kanal olmazsa, güvenlik açıklarının gerçek dünyada istismar edilene kadar gizli kalacağını savunuyor. Bu nedenle programlar, kusurları erkenden ortaya çıkararak genel saldırı yüzeyini azaltabilir. Buradaki ödün ise, “daha az korunan” bir kademenin fırsatçı suistimallere davetiye çıkarmasıdır.
Takip edilmesi gerekenler
- Her iki şirketin inceleme sürecindeki güncellemeler
- Programlardan kaynaklanan suistimal raporları
- Yapay zeka ile ilgili saldırı yüzeylerinin nasıl kataloglandığına dair sektör genelindeki değişimler
Özetle: Yeni araştırma yolları güvenlik araştırmacılarına güçlü araçlar veriyor, ancak aynı araçları kapıdan sızabilen herkese de teslim ediyor. Savunma ekipleri, bu programları hem bir içgörü kaynağı hem de yeni bir saldırı yolu olarak değerlendirmelidir.
