Коли можна сказати, що ШІ зробив наукове відкриття?
Ця історія вперше з’явилася в The Algorithm, нашому щотижневому інформаційному бюлетені про ШІ. Щоб першими отримувати подібні історії у свою поштову скриньку, підпишіться тут.
Минулої середи Anthropic оголосила, що на початку цього року запустила лабораторію молекулярної біології, де агенти Claude читають і висувають припущення щодо складних біологічних проблем, а люди-вчені проводять експерименти на основі їхніх звітів. І ця лабораторія на базі ШІ, як заявила компанія, зробила своє перше відкриття.
Щоб зрозуміти, що, за словами Anthropic, зробила її система, уявіть, що ви гортаєте бібліотеку з мільйонами послідовностей ДНК, накопичених у міру того, як учені секвенують дедалі більше живого світу. Одним із кроків до прориву могло б стати знаходження незвичайної послідовності, яка, наприклад, кодує цікавий фермент. Потім потрібно було б з’ясувати, що робить цей фермент, і зрештою — як маніпулювати ним, щоб він виконував щось корисне.
Те, що, за словами Anthropic, її система з 950 агентів знайшла за 21 годину, не було абсолютно новою послідовністю. Натомість агенти виявили повторюваний патерн навколо відомого ферменту — особливий патерн, який, як заявила Anthropic, раніше не був каталогізований. Але якщо прочитати оголошення Anthropic, де цей патерн названо «схожим» на те, що привело до технології редагування генів CRISPR, яка «вже трансформувала науку й медицину», складається враження, ніби ця армія агентів справді знайшла щось важливе.
Ці заяви розлютили деяких біологів. У вірусному дописі одного з них, який згодом підтримали голова та генеральний директор фармацевтичної компанії Eli Lilly, було сказано, що «знайти дивний кластер генів і повторів часто є легкою частиною. Складна частина, з якої й випливають справжні відкриття, — з’ясувати, що насправді робить система». Іншими словами, агенти допомогли виконати певну рутинну лабораторну роботу. Але відкриттям це не є.
Це нагадування про те, що навіть якщо ШІ робить щось вражаюче — наприклад, знаходить патерн у масиві біологічних даних, який було б важко помітити неозброєним людським оком, — сам результат може не становити наукового прориву. Те, що є новим для ШІ, для біолога може бути буденним, не дивувати або просто не мати особливого значення.
Ще більше ускладнює ситуацію те, що, як повідомила New York Times, Маріо Родріґес Местре, біолог із Копенгагенського університету, заявив на вихідних, що його команда вже виявила цей конкретний патерн. Местре, який регулярно спілкувався з Claude у своїй роботі, припустив, що команда Anthropic могла дізнатися про нього з його розмов. Anthropic це заперечує, але Местре каже, що все одно припиняє користуватися Claude.
Частково проблема полягає в тому, що компанії, які розробляють ШІ, презентують свої системи не просто як інструменти, якими можуть користуватися вчені, на кшталт мікроскопів або суперкомп’ютерів. Вони наполягають, що самі системи ШІ роблять відкриття. Для декого такий підхід несумісний із тим, як насправді працює наука, адже нові знання зазвичай виникають у результаті співпраці та використання дедалі ширшого арсеналу інструментів.
Це також змушує людей скептичніше ставитися до справжнього прогресу, коли він відбувається. Скоротити кількість 200 000 кандидатів до кількох вартих подальшого вивчення — зовсім не дрібниця; це повноцінна наукова робота. Сам факт, що чатбот загального призначення зміг виконати цю роботу, заслуговує на увагу, навіть якщо люди допомагали спрямовувати його та зрештою проводили експерименти. Але коли мірилом стає те, чи зробив відкриття сам Claude, усе це перетворюється на доказ на користь однієї зі сторін у суперечці, яка має лише дві відповіді: прорив або провал.
Якщо ми оцінюємо ШІ за тим, чи зробив він відкриття, виникає спокуса змінювати критерії навіть після того, як він, здається, справді здобув перемогу. На початку цього місяця OpenAI заявила, що її власні агенти-команди розв’язали мільйонну математичну задачу. Але за кілька тижнів майже кожен скептик щодо ШІ у моїй стрічці поширював статтю із запитанням, чи була це та математична проблема, яка насправді має значення.
Щоб було зрозуміло, у статті не стверджувалося, що розв’язання OpenAI було неправильним. Натомість у ній ішлося про те, що конкретний результат може бути не тим, який найбільше цікавить математиків. Додайте до цього звинувачення математика в тому, що моделі могли використати частину його роботи без зазначення авторства, — і люди залишаються з думкою, що OpenAI або шахраювала, або розв’язання все одно було неважливим. Або й те, і інше.
Саме це частково непокоїть Лукаса Гаррінгтона, біолога, який написав допис із критикою оголошення Anthropic. Він завершив його пропозицією: компаніям, що розробляють ШІ, слід «вже зараз встановити високу планку, щоб, коли ШІ справді відкриє принципово новий біологічний механізм, усі усвідомили масштаб цієї події». Але поки Сем Альтман з OpenAI та Даріо Амодеї з Anthropic змагаються, намагаючись перевершити один одного, підвищення планки для наукових проривів, здійснених ШІ, може бути останнім, про що вони думають.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.