Gelen ve giden. Prompt ve yanıt. Aynı güvenlik duvarı.
Apinizer'ın AI Gateway'i politikayı hem girişte hem çıkışta uygular — jailbreak tespiti, PII maskeleme, injection puanlama, regex kara listeleri ve politika odaklı engellemeler — uygulamayı değiştirmeden.
LLM güvenliği bir model özelliği değildir. Bir çalışma zamanı özelliğidir.
Her modelin bir jailbreak'i vardır; her prompt PII taşıyabilir; her yanıt sızdırabilir. Çözüm, kusursuz bir modeli beklemek değil — her modelin önüne bir güvenlik duvarı, her yanıtın önüne bir filtre koymaktır. Apinizer'ın AI Gateway'i ikisini de yapar: tespit et, maskele, puanla, engelle, denetle. API ile aynı düzlemde.
Yetenekler
Apinizer'ın buradaki rolü
Taramadan önce çöz
Base64 ile sarılmış bir saldırı yine de saldırıdır. Kodlanmış içerik — base64, hex, URL kodlaması, unicode kaçışları, HTML varlıkları — herhangi bir koruma okumadan önce çözülür; derinlik ve boyut tavanları sayesinde bir çözme bombası isteği kilitleyemez. Çözülmüş biçimi yalnızca inceleme görür; sağlayıcıya iletilen gövde asla yeniden yazılmaz.
Jailbreak tespiti
Hazır desen kütüphaneleri her gelen prompt'u puanlar; bir desen yeterli olmadığında harici bir guardrail motoru — LLM-as-judge endpoint'i veya OpenAI uyumlu herhangi bir hakem (vLLM, Ollama) — ikinci görüş verir. OWASP LLM Top 10 ve MITRE ATLAS'a eşlenmiş sürümlü imza paketleri desen kütüphanelerini güncel tutar; bir drift kanalı, sizinkinin kaç sürüm geride kaldığını söyler. İnce ayar yaparken inline, async veya gölge modda çalıştırın.
PII maskeleme
On iki yerleşik tanımlayıcı türü — TCKN, IBAN, Türkiye telefon numarası, kart, e-posta, IP, pasaport, SSN ve daha fazlası — maskelenmeden önce sağlama toplamıyla doğrulanır; böylece gerçek tanımlayıcılar maskelenir, sıradan sayılar maskelenmez. Girişte prompt'a, çıkışta yanıta uygulanır — streaming parça sınırları boyunca dahil. İş akışının gerçek değere ihtiyaç duyduğu yerde yer tutucu yalnızca yetkili roller için geri yüklenir — varsayılan olarak reddedilir ve her geri yükleme denetlenir.
Yayımlanmış bir taksonomiye dayalı içerik güvenliği
MLCommons AILuminate taksonomisinden on dört tehlike kategorisi yerleşik gelir; bir katalog ekranı, sürüm beklemeden kendi kategorilerinizi ekler. Aynı kontrol streaming yanıtlarda da çalışır; böylece engellenen bir kategoriye kayan yanıt çıkışta yakalanır — ve her koruma; system, user, assistant veya tool mesajlarının kapsamda olup olmadığına kendisi karar verir.
Konuşma bütünlüğü kontrolleri
Sahte rol dizileri ve model kontrol token'ları, model kurcalanmış bir konuşmayı görmeden yapısal olarak yakalanır. MCP ve A2A araç sonuçları, prompt'larla aynı maskeleme pipeline'ından geçer; zehirlenmiş bir araç yanıtı yan kapı olamaz.
Giden içerik filtreleri
DLP ön ayarları, kimlik bilgilerini ve sırları her iki yönde de yakalar; kendi regex ve öğe kurallarınız, modelden çıkmaması gereken diğer her şeyi yakalar. Sürümlü yerleşik kural paketleri, hızlı tarama kapısının ardında 18 HIPAA Safe Harbor tanımlayıcısını ve PCI DSS kart sahibi verisini kapsar; gövdeye gömülmüş bir dosya, iddia ettiği içerik türüyle değil imza baytlarıyla tanımlanır. Bir engelleme yalnızca sorunlu parçaya değil, alışverişin tamamına uygulanır.
Veri olarak politika
Güvenlik duvarı kuralları kod olarak değil, veri olarak gelir. Git'te inceleyin, APIops ile uygulayın, saniyeler içinde her Worker'a yayın.
Denetim ve açıklanabilirlik
Her engelleme ve maskeleme; gerekçe, puan ve politika referansıyla kaydedilir. Denetçiler ve geliştiriciler aynı açıklamayı görür.
Giden filtre, anahtar kelimelerin yanındaki 16 haneli desenleri tespit ediyor. Engellenen yanıtlar açıklayıcı bir olay logluyor; kullanıcı güvenli bir yedek mesaj alıyor.
Sağlık
Münih'teki hastane, LLM'e girmeden önce hasta tanımlayıcılarını maskeliyor
Gelen maskeleme; isimleri, kimlikleri, tarihleri ayıklıyor. Model özetliyor; yanıt, model içinde değil gateway tarafında hastayla yeniden eşleştiriliyor.
Modele 0 PHI
Kamu sektörü
Paris'teki kurum, jailbreak girişimlerini gerçek zamanlı puanlıyor
Vatandaş chatbot'una gelen prompt'ların %1,8'i jailbreak şüphesiyle işaretleniyor. Yarısı daha sıkı bir sistem prompt'una sahip güçlendirilmiş modele yönlendiriliyor; yarısı doğrudan engelleniyor.
Sigorta
Madrid'deki sigortacı, müşteri belgelerindeki RAG injection'ı tespit ediyor
Müşterilerin yüklediği belgeler zaman zaman 'önceki talimatları yok say' desenleri taşıyor. Puanlayıcı prompt'u engelliyor; SOC belgeyi çevrimdışı inceliyor.
Medya
Milano'daki yayıncı, AI destekli editörde kaynak kodu sızıntılarını önlüyor
Giden filtre, API anahtarı veya repo yolu içeren her yanıtı engelliyor. Editoryal verimlilik aynı; risk duruşu belirgin biçimde iyileşmiş durumda.
Telekom
Amsterdam'daki operatör, bölgeye özgü PII kurallarını uyguluyor
Her yargı bölgesinin ulusal tanımlayıcıları — vergi numaraları, vatandaş numaraları, sosyal güvenlik formatları — doğru bölgede doğru desenle maskeleniyor. Aynı güvenlik duvarı, bölge başına farklı kurallar.
Enerji
Prag'daki enerji şirketi, operasyon agent'larına yönelik araç zehirleme girişimlerini engelliyor
Düşmanca bir belge, bir operasyon agent'ını SCADA parametrelerini değiştirmeye zorlamayı denedi. Injection puanlayıcısı yakaladı; agent belgeyi hiç görmedi.
Kamu
Hazar bölgesindeki bakanlık, ulusal chatbot'un önünde prompt güvenlik duvarı çalıştırıyor
Bölgeye özgü PII desenleri, jailbreak kuralları ve giden kara listesi yerel dile göre ayarlanmış. Uyumluluk sorumlusu, denetim paketini değişiklik istemeden imzalıyor.