EresusSecurity
AI Security

LLM, ajan ve MCP sistemlerini gerçek saldırı akışlarıyla test edin.

Eresus; prompt injection, indirect prompt injection, RAG sızıntısı, araç suistimali, MCP kayıt/transport riskleri, ajan yetkilendirme sınırları ve model dosyası kabul süreçlerini ofansif bakışla doğrular.

Kimin için uygun

Bu program en çok aşağıdaki ekiplerde hızla değer üretir.

Yapay zeka ürün ve platform ekipleri

LLM, RAG, MCP, ajan veya model kabul akışlarını iç ya da müşteri yüzüne taşıyan ekipler.

Yapay zeka alanına genişleyen güvenlik ekipleri

Sızma testi programı çalıştırıp şimdi koruma kuralı, prompt ve araç suistimali doğrulamasına ihtiyaç duyan organizasyonlar.

Açıklanabilir sertleştirme isteyen ekipler

Politika, prompt, MCP ve çalışma zamanı bulgularını doğrudan yayın kararına çevirmek isteyen ekipler.

Kapsam

Prompt, system prompt ve koruma atlatma testleri
RAG, vector database ve veri sızıntısı akışları
Ajan araç kullanımı, MCP sunucusu ve iş akışı suistimali
Model dosyası, eklenti ve tedarik zinciri kabul incelemesi

Risk sinyalleri

Indirect prompt injection ile veri sızıntısı
Araç suistimali ile yetkisiz işlem
MCP komut/kimlik sınırı zafiyetleri
Zehirli model dosyası veya güvensiz deserialization

Teslimatlar

AI saldırı yolu raporu
Prompt ve araç çağrısı PoC kanıtları
Koruma kuralı ve politika önerileri
MCP ve ajan sertleştirme kontrol listesi
Çalışma modeli

Tarayıcı çıktısı değil, kanıt üreten ofansif süreç.

01

Kapsam ve hedef

Varlıkları, iş akışlarını, kullanıcı rollerini, test pencerelerini ve güvenli çalışma sınırlarını birlikte netleştiririz.

02

Uzman doğrulaması

Eresus analistleri otomatik çıktıyı değil, gerçek istismar edilebilirliği ve iş etkisini kanıtlayan kontrollü testleri yürütür.

03

Kanıt, düzeltme, yeniden test

Her bulgu kanıt, etki, çözüm yolu ve yeniden test adımlarıyla teslim edilir; kapanış doğrulaması aynı akışta yapılır.

Sık sorulanlar

Alıcıların ilk konuşmada netleştirmek istediği başlıklar.

Hangi yapay zeka yüzeylerini ve mimarilerini test ediyorsunuz?+
Otonom AI ajanları, LLM entegrasyonları, RAG vektör arama akışları, MCP sunucuları, araç/fonksiyon çalıştırma sınırları, serileştirilmiş model dosyaları (.pkl, .joblib, .gguf, .onnx, .keras) ve koruma kuralı (guardrail) katmanlarını test ederiz.
Bu çalışma sadece basit prompt injection testi ile mi sınırlı?+
Hayır. Prompt injection incelenen başlıklardan sadece biridir. Kırmızı takımımız; ajan araç yetkilerinin kötüye kullanımı, RAG dokümanlarından gelen dolaylı enjeksiyonlar, model tersine mühendisliği, veri zehirlenmesi ve güvensiz model deserialization ile RCE gibi sistemik tehditlere odaklanır.
Bulgular yapay zeka ekipleri için nasıl mühendislik aksiyonlarına çevrilir?+
Her bulguyu somut koruma kurallarına, sistem promptu yapısal sertleştirmesine, araç çağrıları için katı JSON şema doğrulayıcılarına, bağlam penceresi izolasyonuna veya container sandbox yapılandırmalarına dönüştürürüz.
Yapay Zeka Güvenlik Testinin süresi ve fiyatlandırması nasıldır?+
Tipik bir AI ve ajan güvenlik değerlendirmesi; ajan araç sayısı, RAG veri kaynakları ve özel model mimarisine göre 7 ile 20 iş günü sürer. Fiyatlandırma entegrasyon ve araç sınırlarına göre şeffaf olarak belirlenir.
AB Yapay Zeka Yasası (EU AI Act) ve OWASP LLM Top 10 uyumu değerlendiriliyor mu?+
Evet. Tüm testlerimiz OWASP LLM Top 10 risklerini tam olarak kapsar ve bulguları AB Yapay Zeka Yasası'nın (EU AI Act) yüksek riskli sistemler için belirlediği şeffaflık ve siber güvenlik zorunluluklarıyla eşleştirir.
AI koruma kuralları ve prompt düzeltmeleri için yeniden test dahil mi?+
Evet. Düzeltmelerin anlamsal varyasyonlarla atlatılamadığından emin olmak için 30 gün içinde hedeflenmiş adversarial jailbreak ve araç sınırı testlerini ücretsiz yeniden uygularız.

Riskleri iş etkisine bağlarız.

Bulgular sadece CVSS skoru olarak kalmaz. Hangi müşteri akışını, hangi veri sınıfını, hangi operasyonel hedefi etkilediği açıkça yazılır.

Teslimat geliştirici ve yönetici için ayrı okunur.

Teknik ekipler yeniden üretilebilir kanıt ve düzeltme yönü alır; liderlik tarafı ise risk hikayesini, önceliği ve kapanış durumunu net görür.

Sonraki adım

Bu kapsamı gerçek risk yüzeyinize göre birlikte netleştirelim.

Pilot, tek uygulama, kritik API, AI ajan akışı veya daha geniş program fark etmez; önce iş etkisi yüksek yüzeyden başlarız.