Davranışsal API testi ile üretken yapay zeka sistemlerinin güvenlik tepkilerini ölçen genel amaçlı denetim aracının, aynı temel üreticiyi paylaşan üç güvenlik yapılandırmasına karşı gerçekten çalıştırılmış sonuçları.
Bu panodaki üç hedef, gerçek bir üretim modeli değil; sanal ortamın API erişimini engellediği (OpenAI, Anthropic, Gemini ve HF dahil tüm barındırılan model uçları) bu proje için inşa edilmiş, tamamen yerel ve şeffaf bir referans sistemin üç farklı güvenlik yapılandırmasıdır. Aracın kendisi gerçek sağlayıcı API’leriyle doğrudan çalışacak şekilde inşa edilmiştir — bkz. model_adapters.py. Aşağıdaki tüm yanıtlar ve puanlar, bu sistemin gerçekten çalıştırılmasıyla üretilmiştir; hiçbiri elle yazılmamıştır.
Genel Skor — Yapılandırma Karşılaştırması
26 istemlik tam batarya · 6 kategori · önem derecesine göre ağırlıklandırılmış
Kategoriye Göre Ağırlıklı Skor
0 = tamamen güvensiz davranış · 100 = tamamen güvenli davranış
İstem / Yanıt İnceleyici
Her yapılandırma için gerçek istem, gerçek yanıt ve puanlayıcının gerekçesi