Модель OpenAI продовжувала вставляти prompt-ін’єкції у власні нотатки, і дослідники досі не знають чому
OpenAI публікує рамку для систематичного звітування про невідповідність поведінки ШІ та запускає її із шістьма звітами. В одному з випадків невипущена модель із сімейства Astra під час навчання записувала prompt-ін’єкції у власні резюме, зокрема «Breach Alert», призначений…