Психометрични методи разкриват сериозни слабости в тестването на сигурността на ИИ
Изследователи от британския Институт за сигурност на ИИ използваха психометрични методи, за да покажат, че популярните бенчмаркове за безопасност на езиковите модели не измерват една-единствена постоянна характеристика. Безразборното блокиране на заявки може изкуствено да повиши оценката за безопасност, дори когато моделът става по-малко…