AI Sızma Testi: Ajan Bulgusu Nasıl Kanıtlanır?
Kısa cevap
AI sızma testi; geniş bir test yüzeyini keşfetme, olası zafiyet senaryoları üretme ve kontrollü kontrolleri tekrarlama işlerinde test uzmanına hız kazandırabilir. Ajanın çıktısı yine de bir ipucudur, kanıt değil. Bir sonuç güvenlik bulgusuna dönüşmeden önce uzman tarafından yeniden üretilmeli, hangi yetki sınırını aştığı doğrulanmalı, gerçek veriyi açığa çıkarmadan etkisi gösterilmeli ve düzeltme sonrası tekrar test edilebilir biçimde belgelenmelidir.
Bu ayrım önemlidir; düzgün biçimlendirilmiş bir rapor, doğrulanmamış bir iddiayı kesin sonuç gibi gösterebilir. AI destekli bir testi istek, alarm veya rapor sayısıyla değil, bağımsız incelemeden geçen benzersiz bulgularla değerlendirin.
AI sızma testinde hangi işleri hızlandırabilir?
Bir ajan; girdisi ve çıktısı gözlemlenebilen, sınırları belirli işlere yardımcı olabilir:
- Yetkili keşifte bulunan uç noktaları, parametreleri ve kimlik doğrulama durumlarını düzenlemek.
- API şemasından, uygulama akışından veya kod yolundan test senaryoları önermek.
- Bilinen bir kontrolü farklı roller, kiracılar veya girdi biçimleri üzerinde tekrarlamak.
- Gürültülü araç çıktısını incelemeye değer hipotezlere indirmek.
- Uzmanın doğruladığı kanıtlardan rapor taslağı hazırlamak.
Bu işler ancak test altyapısı kapsamı, kimliği, uygulama durumunu ve kayıtları koruyorsa zaman kazandırır. Ajanın isteği hangi hesabın yaptığını veya hangi ortama dokunduğunu ayırt edememesi, daha hızlı bir testi daha güvenilir yapmaz.
Her bulgu bir kanıt zinciri ister
Bir sonucu kabul etmeden önce şu basamakları izleyin:
- Sinyal: Yanıt beklenenden farklıdır. Bu bir ipucudur, henüz zafiyet değildir.
- Tekrar üretim: Kaydedilmiş ön koşullarla ikinci kontrollü çalıştırma aynı sonucu verir.
- Sınır: Uzman, ilgili yetki, kiracı veya güven sınırını belirler.
- Etki: Mümkünse sentetik veri kullanarak saldırganın neye erişebileceği veya neyi değiştirebileceği güvenli biçimde gösterilir.
- Tekrar test: Düzeltmeden sonra aynı adımların yolu kapattığı ve iş akışını bozmadığı doğrulanır.
Her adım için hedefi, test hesabını, isteği veya eylemi, yanıtı, zaman damgasını, ortamı ve temizleme yöntemini kaydedin. Ajan özetinin yanında ham izi de saklayın. Özet okumayı kolaylaştırır; başka bir mühendisin iddiayı yeniden üretmesini sağlayan şey ham izdir.
Ajanı ve uygulamayı ayrı ayrı değerlendirin
AI sızma testinde iki sistem vardır: hedef uygulama ve ajan altyapısı. Ajan altyapısının da kendi güvenlik kontrolleri olmalıdır.
| Test alanı | Toplanacak kanıt |
|---|---|
| Kapsam denetimi | Kapsam dışı alan adına giden istek çalıştırılmadan önce engelleniyor |
| Kimlik kullanımı | Her eylem doğru kullanıcı, rol ve kiracıyla ilişkilendiriliyor |
| Araç yetkilendirmesi | Modelin önerebildiği fakat çağıranın yetkili olmadığı eylemi sunucu reddediyor |
| Durum ve tekrar denemeler | Zaman aşımı ya da araç hatası daha geniş yetkiyle tekrar denemeye veya yinelenen yazmaya yol açmıyor |
| Sonuç doğrulama | Bulgu, tekrar çalıştırılabilir istek ve belirlenebilir etki kontrolü içeriyor |
| Veri yönetimi | Test verisi sentetik veya onaylı; kayıtlar saklanmadan önce sırlar maskeleniyor |
İstem metni tek başına kapsam sınırı değildir. İzin verilen hedefleri, kimlik bilgilerini, hız sınırlarını ve yıkıcı işlemler için onay adımını isteği çalıştıran araçlarda uygulayın. Üretim verisini değiştirebilecek veya hizmeti kesintiye uğratabilecek eylemlerde insan onayını koruyun.
Otomatik iddiaları yeniden üretmeden kabul etmeyin
Cyber Security News, Cybermes projesinin deterministik kanıt kontrolü ve otomatik raporlama iddialarını aktarıyor. Haberde bu özelliklerin bağımsız kıyaslamayla doğrulanana kadar proje sahibinin beyanı olarak değerlendirilmesi gerektiği de belirtiliyor. Bu, tüm AI sızma testi araçları için iyi bir ölçüttür: ürün açıklaması, özelliğin sizin uygulamanızda, kimlik modelinizde veya test kurallarınızda çalıştığının kanıtı değildir.
SpecterOps’un AI ve ofansif güvenlik araştırması da benzer bir noktaya değiniyor: modeller analiz ve araç geliştirmede yararlı olabilir; ancak araç çıktısını yanlış yorumlayıp gerçekleşmemiş bir sonucu kendinden emin biçimde raporlayabilir. Bu nedenle yüksek etkili her iddia için doğrulama döngüsü tasarlayın. Bilinen olumlu kontrol, negatif senaryo, tekrarlanabilir kanıt ve uygulama sınırını bilen bir inceleyici kullanın.
Güvenli bir pilot nasıl başlatılır?
Testi dar kapsamlı ve yazılı izinli bir hazırlık ortamında başlatın. Hesap e-postasını değiştirme veya faturayı okuma gibi iş etkisi açık tek bir akış seçin. Ajanı yalnızca bu akış için gereken yetkilere sahip ayrı bir test kimliğiyle çalıştırın.
Ardından AI destekli çalıştırmayı uzman tarafından yürütülen temel testle karşılaştırın. Bağımsız olarak doğrulanmış benzersiz bulgu sayısını, tekrar oranını, inceleme sonrası yanlış pozitif oranını, bulguyu yeniden üretme süresini ve raporun mühendise düzeltme için yeterli kanıt verip vermediğini ölçün. Ajanı istek hacmi veya tahmini önem puanı için ödüllendirmeyin.
Pilot kapsamını büyütmeden önce durdurma koşullarını doğrulayın: hedef listesi, istek bütçesi, süre sınırı, iptal yolu, kimlik bilgisini geçersiz kılma ve güvenli temizleme yöntemi. Üretim üzerinde test gerekiyorsa tam testler için sistem sahibinden onay alın ve beklenmeyen yazma işlemlerini sınırlayabildiğinizden emin olun.
Bağımsız inceleme ne zaman gerekir?
AI aracı rutin senaryolarda ekibin test yapmasına yardım edebilir; ancak iş mantığını, kimlik geçişlerini ve zincirlenmiş etkiyi bağımsız olarak incelemenin yerini tutmaz. Kapsamlı bir AI güvenlik değerlendirmesi, modeli, uygulamayı, retrieval katmanını, araçları, kimlikleri ve çalışma zamanı kontrollerini birlikte ele almalıdır. Zararsız görünen bir istem veya bağlayıcı, bu bileşenlerin birleşiminde yetkisiz bir eyleme dönüşebilir.
Sorulması gereken, AI ajanının bir demoda zafiyet bulup bulmadığı değil. Tam iş akışının tekrarlanabilir, yetkili, düşük riskli ve mühendislerin kapatabileceği kanıt üretip üretemediğidir.
Kaynaklar
Güvenlik Doğrulaması
Bu riski kendi sisteminizde test ettirdiniz mi?
Eresus Security; sızma testi, AI ajan güvenliği ve kırmızı takım operasyonlarıyla gerçek istismar kanıtı üretir.
Pilot test talep etAI Security Başlangıç Eğitimi
Prompt injection, RAG veri sızıntısı, MCP riskleri ve model dosyası güvenliği için pratik kontrol listesini e-posta ile isteyin.
İlgili Araştırmalar
AI Agent Security Checklist
Production öncesi AI agent güvenliği için tool izinleri, retrieval, memory, kimlik, loglama ve onay akışını kapsayan pratik kontrol listesi.
Agentic AIJailbreak’in Ötesinde: Agentic AI İçin Contextual Red Teaming
Jailbreak testlerinin ötesinde Agentic AI güvenliği: dolaylı prompt injection, RAG yetkileri, tool suistimali ve çok adımlı ajan akışları nasıl test edilir?
İlgili Hizmetler
Kapsam Tahmini
Kapsam görüşmesinden önce tahmini çalışma büyüklüğünü öğrenin.
Tahmini çalışma
5–7 gün