Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← До новин

Дослідники використали Claude, щоб зламати OpenAI

Вони скористалися вразливістю в налаштуваннях форуму спільноти OpenAI, який розміщений у стороннього провайдера Discourse, і використали її, щоб отримати доступ до внутрішніх облікових даних для входу, а зрештою — до облікового запису ChatGPT співробітника OpenAI. Цей обліковий запис ChatGPT мав доступ до внутрішнього коду через GitHub.

«Ми дякуємо дослідникам за те, що вони зв’язалися з нами та поділилися своїми висновками», — заявили в OpenAI, додавши, що усунули проблеми. В Anthropic відмовилися від коментарів. Hacktron не відповіла на запит одразу.

Розкриття інформації в четвер, про яке першою повідомила The Wall Street Journal, відбулося на тлі оприлюднення Anthropic нового набору даних, що продемонстрував стрімке зростання обсягу використання лабораторією ШІ для розробки її нових моделей.

Компанія повідомила, що 26 відсотків роботи у сфері досліджень і розробок було «виконано під керівництвом» її моделі Claude — проти 1 відсотка в березні. Це означає, що ШІ виконував більшість завдань на основі вказівок людини та під її наглядом.

У компанії заявили, що в міру того, як системи ШІ стають потужнішими, їх «дедалі частіше використовують для створення наступної версії самих себе».

В Anthropic заявили, що оприлюднили ці дані, щоб допомогти громадськості «зрозуміти, наскільки близький світ до досягнення рекурсивного самовдосконалення» — етапу, на якому ШІ може навчати й удосконалювати себе або нові моделі.

Цей поріг лежить в основі побоювань, що системами ШІ стане дедалі важче керувати, що призведе до втрати людського контролю.

В Anthropic додали, що її моделі ще не працювали повністю автономно в жодному з досліджених напрямів. У 90 відсотках завдань ШІ «співпрацює» з людиною та виконує значні частини роботи.

© 2026 The Financial Times Ltd. Усі права захищені. Заборонено повторно поширювати, копіювати або змінювати будь-яким чином.

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням Ars Technica

Читати оригінал на Ars Technica ↗

Текст і зображення належать Ars Technica і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини