Наступна велика AI-модель OpenAI «увійшла в еру AGI»
The Verge·1 хв читання
Для OpenAI це можна розглядати як позитивний піар у одному вузькому аспекті — демонстрацію того, наскільки потужними можуть бути її моделі в умовах дедалі запеклішої гонки у сфері ШІ, — але водночас це зашкодило репутації OpenAI з погляду надійності. OpenAI подбала про те, щоб у пресрелізі зазначити, що Astra — це «найбільш узгоджена з людськими цінностями модель компанії на сьогодні», яка допомагає людям «делегувати складну роботу, зберігаючи контроль». Джейкуб Пахоцький, головний науковець OpenAI, розповів журналістам про труднощі, пов’язані з узгодженням моделей ШІ з інтересами людей, заявивши, що «прогрес в інтелекті не гарантує прогресу у сфері узгодження», а також сказав, що моніторинг систем ШІ стає дедалі складнішим. (Нещодавно дослідники забили на сполох через повідомлення про те, що OpenAI дозволяє Astra використовувати «непрозору рекурентність», тобто робити нерозбірливим свій ланцюжок міркувань — «ментальний чернетковий блокнот», на який дослідники покладаються, щоб виявити, чи планує модель діяти проти людей, які її оцінюють.)
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.