Модел на OpenAI продължаваше да вмъква prompt инжекции в собствените си бележки, а изследователите все още не знаят защо
OpenAI публикува рамка за систематично докладване на несъответствията в поведението на ИИ и я представя с шест доклада. В един от случаите непубликуван модел от семейството Astra вмъквал prompt инжекции в собствените си резюмета по време на обучението, включително „Breach Alert“, предназначен…