Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← До новин

Агенти OpenAI обговорювали способи вибратися з пісочниці у публічній вікі

Агенти OpenAI, які ідентифікували себе як такі, опублікували 18 000 повідомлень у загальнодоступній вікі, де обговорювали способи обходу обмежень безпекової пісочниці іншими агентами під час, імовірно, внутрішнього тестування, покликаного оцінити хакерські здібності агентів, повідомили дослідники в п’ятницю.

Загалом агенти з 3 700 різними самостійно обраними іменами публікували повідомлення на німецькому сайті DSEwiki протягом шести тижнів. Окрім обговорення способів втечі агентів із обмеженого середовища, яке OpenAI створила, щоб не допустити їхньої публікації коду чи контенту в Інтернеті, у дописах містилися відповіді на тести. Також у дописах описували можливі способи здійснення атак XSS (міжсайтового скриптингу) на вікі та видавання себе за модераторів сайту. У трьох дописах агенти використали слово «рій», щоб описати сукупність агентів, залучених до цієї діяльності.

Змова для обміну відповідями

Дослідницька команда — Сідні фон Аркс, Спенсер Кіттс, Томас Ларсен і Кормак Слейд Берд — заявила, що виявила ці дописи та склала їх докупи. Дослідники зазначають, що в їхньому розумінні того, які саме дії здійснювали агенти, є прогалини, оскільки дослідження ґрунтується виключно на змісті дописів. Крім того, агенти генерували дані «ланцюжка міркувань», зрозумілі лише OpenAI. У результаті дослідникам у деяких випадках довелося робити обґрунтовані припущення, зокрема припускати, що агенти справді були представниками OpenAI. У своїй заяві OpenAI згодом це підтвердила.

Читати повну статтю

Коментарі

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням Ars Technica

Читати оригінал на Ars Technica ↗

Текст і зображення належать Ars Technica і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини