AI Hallucination Risk Score (AHRS)
Generativ süni intellekt modellərinin istifadəçi sorğularına cavab verərkən yanlış, uydurma və ya qeyri-dəqiq məlumat (hallüsinasiya) istehsal etmə ehtimalını ölçən təhlükəsizlik metrikidir.
AHRS = (Yoxlanılan Cavablardakı Səhv Faktların Sayı / Ümumi Faktiki İddiaların Sayı) * 100Ətraflı İzah
Müştəri xidmətlərində, hüquq və ya tibb sahələrində tətbiq olunan LLM (Böyük Dil Modelləri) əsaslı süni intellekt sistemlərinin etibarlılığı kritik əhəmiyyət kəsb edir. AHRS metriki, sistemin verdiyi cavabların nə dərəcədə real faktlara əsaslandığını və nə dərəcədə uydurma olduğunu kəmiyyətlə qiymətləndirir.
Yüksək AHRS balı brendin reputasiyasına ciddi zərər vura bilər və hüquqi məsuliyyət yarada bilər. Bu səbəbdən, şirkətlər RAG (Retrieval-Augmented Generation) və incə tənzimləmə (fine-tuning) vasitəsilə AHRS göstəricisini minimuma endirməyə çalışırlar.
Süni intellekt əsaslı müştəri dəstək botunun verdiyi 50 fərqli cavab analiz edilmişdir. Bu cavablarda cəmi 120 faktiki iddia irəli sürülmüş, lakin onlardan 18-nin tamamilə uydurma (hallüsinasiya) olduğu aşkarlanmışdır. AHRS = (18 / 120) * 100 = 15%.