Дослідники тепер можуть реконструювати промпти LLM за вихідним текстом із майже ідеальною точністю
Дослідники з IIT Bombay і Adobe Research створили обернену мовну модель, яка з майже ідеальною точністю відновлює оригінальний промпт за результатом роботи LLM. Їхній метод, що отримав назву «передбачення попереднього токена», не потребує доступу до ваг моделі й працює з різними моделями. Для компаній, які покладаються на власні системні промпти, це може становити серйозний ризик для безпеки.
Стаття Дослідники тепер можуть реконструювати промпти LLM за текстом результату з майже ідеальною точністю вперше з’явилася на сайті The Decoder.
Це видання віддає у стрічку лише початок статті, а повний текст тримає у себе. Повністю стаття доступна за посиланням нижче.