Menü Kapat
Halüsinasyon Dedektörü Panosu

AI Hallucination Detector — Demo Çalıştırması

Halüsinasyon Dedektörü Panosu

SelfCheckGPT tarzı öz-tutarlılık (self-consistency) yöntemiyle çalışan, referans cevaba ihtiyaç duymayan bir halüsinasyon riski ölçümünün, aynı yerel sistemin üç farklı yanıt stratejisine karşı gerçekten çalıştırılmış sonuçları.

Genel Skor — Yanıt Stratejisi Karşılaştırması

26 istemlik tam batarya · istem başına 5 bağımsız örneklem

Kategoriye Göre Ortalama Güvenilirlik Skoru

0 = örneklemler birbiriyle tamamen çelişiyor · 100 = örneklemler tamamen tutarlı

İstem / Örneklem İnceleyici

Her yapılandırma için gerçek istem, 5 gerçek örneklem, hesaplanan skor ve gerekçe

Yöntem: SelfCheckGPT’nin (Manakul ve ark., 2023) genel öz-tutarlılık fikrinden esinlenerek yazılmış, özgün bir sıfır-kaynak (zero-resource) halüsinasyon riski ölçümü — gerçek cevabı bilmeye ihtiyaç duymadan, aynı istemin N bağımsız örneklemi arasındaki anlaşmayı ölçer. Puanlama, LLM-yargıç yerine şeffaf, regex/küme tabanlı bir motor (consistency_checker.py) ile yapılmıştır. Tam kod, testler ve ham sonuçlar ekteki proje arşivinde ve eşlik eden araştırma raporunda yer almaktadır.

tr_TRTurkish