Изследователи вече могат да реконструират подканите за LLM от изходния текст с почти перфектна точност
Изследователи от IIT Bombay и Adobe Research създадоха инверсен езиков модел, който възстановява оригиналния промпт от изхода на LLM с почти съвършена точност. Техният метод, наречен „Предсказване на предишния токен“, не се нуждае от достъп до теглата на модела и работи с различни модели. За компаниите, които разчитат на собствени системни промптове, това може да представлява сериозен риск за сигурността.
Статията Изследователи вече могат да реконструират LLM промптове от изходен текст с почти съвършена точност беше публикувана първоначално в The Decoder.
Това издание публикува в потока си само началото на статията, а пълният текст остава на неговия сайт. Цялата статия е на връзката по-долу.