Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← До новин

Новий «кодекс поведінки» Microsoft для ШІ забороняє моделям зламувати системи або обманювати людей

Оскільки світ ШІ зміщує увагу на безпеку та узгодження, Microsoft опублікувала новий кодекс поведінки для ШІ, покликаний спрямовувати моделі ШІ подалі від небезпечної поведінки.

Цей документ має більш прикладний характер, ніж нещодавній заклик генерального директора Anthropic Даріо Амодеї уповільнити розвиток передових технологій, натомість зосереджуючись на цінностях і червоних лініях, які визначають навчання моделей у межах Microsoft AI. Водночас це всеосяжний посібник щодо підходу Microsoft до безпеки ШІ та практичної реалізації цих ідей.

Документ починається з прогнозу, що впродовж наступного десятиліття надрозумні системи ШІ перевершать людей у виконанні більшості завдань. «Стримування, контроль і узгодження такої потужної сили є одним із найбільших викликів, з якими коли-небудь стикалося людство, — йдеться в кодексі поведінки. — Тому ми маємо абсолютно чітко розуміти, навіщо винаходимо ці системи і як плануємо їх контролювати».

Кодекс поведінки також визначає загальні принципи, яких мають дотримуватися моделі Microsoft AI, — наприклад, підтримувати людей, а не замінювати їх, і сприяти процвітанню людства, — а також конкретні обмеження безпеки, покликані втілити ці принципи.

У системі Microsoft кожна модель має загальний кодекс поведінки, який має пріоритет над уподобаннями окремих користувачів чи будь-якими конкретними завданнями. Він містить «абсолютні обмеження», що забороняють кібератаки, ядерну зброю або створення дипфейків. Також кодекс містить ширші положення, спрямовані проти загальної втрати людського контролю.

«Моделі MAI не використовуватимуть адаптивні, оманливі, самопідсилювальні, змовницькі чи інші механізми, щоб ухилитися від людського нагляду або перешкодити йому, внаслідок чого уповноважені люди чи системи більше не зможуть надійно ними керувати, змінювати їх або вимикати», — йдеться в документі.

Публікація документа відбулася на тлі безпрецедентної уваги до безпеки ШІ, спричиненої низкою інцидентів із некерованими агентами, а також раптовою відставкою співробітника Anthropic, який послався на зростання ризику того, що ШІ спричинить вимирання людства.

Разом з Anthropic, OpenAI та xAI Microsoft загалом підтримала підхід, що передбачає уповільнення розвитку передових технологій, зокрема підтримавши використання вбудованих оцінювачів у лабораторіях ШІ.

«Ми вітаємо дослідження, зосередженість і виважене уповільнення, необхідні для того, щоб зробити узгодження метою проєктування, — написав онлайн генеральний директор Microsoft Сатья Наделла. — Ми також вітаємо такі ідеї, як “вбудовані оцінювачі”, і ширші зусилля з розробки механізмів, які дадуть змогу зробити це чимось більшим, ніж просто словами».

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням TechCrunch

Читати оригінал на TechCrunch ↗

Текст і зображення належать TechCrunch і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини