Исследователи теперь могут реконструировать промпты LLM по выходному тексту с почти идеальной точностью
Исследователи из Индийского технологического института в Бомбее и Adobe Research создали инверсную языковую модель, которая восстанавливает исходный промпт по выводу LLM с почти идеальной точностью. Их метод, получивший название «предсказание предыдущего токена», не требует доступа к весам модели и работает с разными моделями. Для компаний, полагающихся на проприетарные системные промпты, это может представлять серьёзный риск для безопасности.
Статья Исследователи теперь могут реконструировать промпты LLM по тексту вывода с почти идеальной точностью впервые появилась на сайте The Decoder.
Это издание отдаёт в ленту только начало статьи, а полный текст держит у себя. Целиком статья доступна по ссылке ниже.