EresusSecurity
Araştırmalara Dön
AI Güvenliği

AI Sızma Testi: Ajan Bulgusu Nasıl Kanıtlanır?

Eresus Security Research TeamGüvenlik Araştırmacısı
7 Ekim 2026
4 dk okuma

Kısa cevap

AI sızma testi; geniş bir test yüzeyini keşfetme, olası zafiyet senaryoları üretme ve kontrollü kontrolleri tekrarlama işlerinde test uzmanına hız kazandırabilir. Ajanın çıktısı yine de bir ipucudur, kanıt değil. Bir sonuç güvenlik bulgusuna dönüşmeden önce uzman tarafından yeniden üretilmeli, hangi yetki sınırını aştığı doğrulanmalı, gerçek veriyi açığa çıkarmadan etkisi gösterilmeli ve düzeltme sonrası tekrar test edilebilir biçimde belgelenmelidir.

Bu ayrım önemlidir; düzgün biçimlendirilmiş bir rapor, doğrulanmamış bir iddiayı kesin sonuç gibi gösterebilir. AI destekli bir testi istek, alarm veya rapor sayısıyla değil, bağımsız incelemeden geçen benzersiz bulgularla değerlendirin.

AI sızma testinde hangi işleri hızlandırabilir?

Bir ajan; girdisi ve çıktısı gözlemlenebilen, sınırları belirli işlere yardımcı olabilir:

  • Yetkili keşifte bulunan uç noktaları, parametreleri ve kimlik doğrulama durumlarını düzenlemek.
  • API şemasından, uygulama akışından veya kod yolundan test senaryoları önermek.
  • Bilinen bir kontrolü farklı roller, kiracılar veya girdi biçimleri üzerinde tekrarlamak.
  • Gürültülü araç çıktısını incelemeye değer hipotezlere indirmek.
  • Uzmanın doğruladığı kanıtlardan rapor taslağı hazırlamak.

Bu işler ancak test altyapısı kapsamı, kimliği, uygulama durumunu ve kayıtları koruyorsa zaman kazandırır. Ajanın isteği hangi hesabın yaptığını veya hangi ortama dokunduğunu ayırt edememesi, daha hızlı bir testi daha güvenilir yapmaz.

Her bulgu bir kanıt zinciri ister

Bir sonucu kabul etmeden önce şu basamakları izleyin:

  1. Sinyal: Yanıt beklenenden farklıdır. Bu bir ipucudur, henüz zafiyet değildir.
  2. Tekrar üretim: Kaydedilmiş ön koşullarla ikinci kontrollü çalıştırma aynı sonucu verir.
  3. Sınır: Uzman, ilgili yetki, kiracı veya güven sınırını belirler.
  4. Etki: Mümkünse sentetik veri kullanarak saldırganın neye erişebileceği veya neyi değiştirebileceği güvenli biçimde gösterilir.
  5. Tekrar test: Düzeltmeden sonra aynı adımların yolu kapattığı ve iş akışını bozmadığı doğrulanır.

Her adım için hedefi, test hesabını, isteği veya eylemi, yanıtı, zaman damgasını, ortamı ve temizleme yöntemini kaydedin. Ajan özetinin yanında ham izi de saklayın. Özet okumayı kolaylaştırır; başka bir mühendisin iddiayı yeniden üretmesini sağlayan şey ham izdir.

Ajanı ve uygulamayı ayrı ayrı değerlendirin

AI sızma testinde iki sistem vardır: hedef uygulama ve ajan altyapısı. Ajan altyapısının da kendi güvenlik kontrolleri olmalıdır.

Test alanı Toplanacak kanıt
Kapsam denetimi Kapsam dışı alan adına giden istek çalıştırılmadan önce engelleniyor
Kimlik kullanımı Her eylem doğru kullanıcı, rol ve kiracıyla ilişkilendiriliyor
Araç yetkilendirmesi Modelin önerebildiği fakat çağıranın yetkili olmadığı eylemi sunucu reddediyor
Durum ve tekrar denemeler Zaman aşımı ya da araç hatası daha geniş yetkiyle tekrar denemeye veya yinelenen yazmaya yol açmıyor
Sonuç doğrulama Bulgu, tekrar çalıştırılabilir istek ve belirlenebilir etki kontrolü içeriyor
Veri yönetimi Test verisi sentetik veya onaylı; kayıtlar saklanmadan önce sırlar maskeleniyor

İstem metni tek başına kapsam sınırı değildir. İzin verilen hedefleri, kimlik bilgilerini, hız sınırlarını ve yıkıcı işlemler için onay adımını isteği çalıştıran araçlarda uygulayın. Üretim verisini değiştirebilecek veya hizmeti kesintiye uğratabilecek eylemlerde insan onayını koruyun.

Otomatik iddiaları yeniden üretmeden kabul etmeyin

Cyber Security News, Cybermes projesinin deterministik kanıt kontrolü ve otomatik raporlama iddialarını aktarıyor. Haberde bu özelliklerin bağımsız kıyaslamayla doğrulanana kadar proje sahibinin beyanı olarak değerlendirilmesi gerektiği de belirtiliyor. Bu, tüm AI sızma testi araçları için iyi bir ölçüttür: ürün açıklaması, özelliğin sizin uygulamanızda, kimlik modelinizde veya test kurallarınızda çalıştığının kanıtı değildir.

SpecterOps’un AI ve ofansif güvenlik araştırması da benzer bir noktaya değiniyor: modeller analiz ve araç geliştirmede yararlı olabilir; ancak araç çıktısını yanlış yorumlayıp gerçekleşmemiş bir sonucu kendinden emin biçimde raporlayabilir. Bu nedenle yüksek etkili her iddia için doğrulama döngüsü tasarlayın. Bilinen olumlu kontrol, negatif senaryo, tekrarlanabilir kanıt ve uygulama sınırını bilen bir inceleyici kullanın.

Güvenli bir pilot nasıl başlatılır?

Testi dar kapsamlı ve yazılı izinli bir hazırlık ortamında başlatın. Hesap e-postasını değiştirme veya faturayı okuma gibi iş etkisi açık tek bir akış seçin. Ajanı yalnızca bu akış için gereken yetkilere sahip ayrı bir test kimliğiyle çalıştırın.

Ardından AI destekli çalıştırmayı uzman tarafından yürütülen temel testle karşılaştırın. Bağımsız olarak doğrulanmış benzersiz bulgu sayısını, tekrar oranını, inceleme sonrası yanlış pozitif oranını, bulguyu yeniden üretme süresini ve raporun mühendise düzeltme için yeterli kanıt verip vermediğini ölçün. Ajanı istek hacmi veya tahmini önem puanı için ödüllendirmeyin.

Pilot kapsamını büyütmeden önce durdurma koşullarını doğrulayın: hedef listesi, istek bütçesi, süre sınırı, iptal yolu, kimlik bilgisini geçersiz kılma ve güvenli temizleme yöntemi. Üretim üzerinde test gerekiyorsa tam testler için sistem sahibinden onay alın ve beklenmeyen yazma işlemlerini sınırlayabildiğinizden emin olun.

Bağımsız inceleme ne zaman gerekir?

AI aracı rutin senaryolarda ekibin test yapmasına yardım edebilir; ancak iş mantığını, kimlik geçişlerini ve zincirlenmiş etkiyi bağımsız olarak incelemenin yerini tutmaz. Kapsamlı bir AI güvenlik değerlendirmesi, modeli, uygulamayı, retrieval katmanını, araçları, kimlikleri ve çalışma zamanı kontrollerini birlikte ele almalıdır. Zararsız görünen bir istem veya bağlayıcı, bu bileşenlerin birleşiminde yetkisiz bir eyleme dönüşebilir.

Sorulması gereken, AI ajanının bir demoda zafiyet bulup bulmadığı değil. Tam iş akışının tekrarlanabilir, yetkili, düşük riskli ve mühendislerin kapatabileceği kanıt üretip üretemediğidir.

Kaynaklar

Güvenlik Doğrulaması

Bu riski kendi sisteminizde test ettirdiniz mi?

Eresus Security; sızma testi, AI ajan güvenliği ve kırmızı takım operasyonlarıyla gerçek istismar kanıtı üretir.

Pilot test talep et

AI Security Başlangıç Eğitimi

Prompt injection, RAG veri sızıntısı, MCP riskleri ve model dosyası güvenliği için pratik kontrol listesini e-posta ile isteyin.

Prompt injection ve koruma kuralı atlatma kontrolleri.
RAG veri sızıntısı ve izin sınırı incelemesi.
MCP kimlik, taşıma ve komut riski kontrolleri.

Spam yok. Yalnızca kaynağı ve ilgili güvenlik notlarını paylaşmak için kullanılır.

İlgili Araştırmalar

İlgili Hizmetler

Kapsam Tahmini

Kapsam görüşmesinden önce tahmini çalışma büyüklüğünü öğrenin.

Tahmini çalışma

5–7 gün

Kesin kapsam talebi