Спорът около доказателство на OpenAI за задача на хилядолетието повдига въпроса дали изследователите могат да се доверят на AI лабораториите
Основни моменти
- В спора около генерирани от AI доказателства за математически проблем от хилядолетието изследователят Тристан Бъкмастър обвинява OpenAI, че е използвала негови чернови, оказвала му е натиск и е отхвърлила съавтора му Левент Алпьоге — който работи в Anthropic — като автор.
- Главният изпълнителен директор на OpenAI Сам Алтман и изследователят Себастиен Бюбек отричат обвиненията в плагиатство, но признават, че са обучили специално собствения си модел след слухове за възможно решение.
- Случаят повдига фундаментални въпроси за отворената наука. Математикът Терънс Тао предупреждава, че в бъдеще технологични компании биха могли да мобилизират огромни ресурси само въз основа на слухове, за да изпреварят оригинални изследователски проекти.
След като математикът Тристан Бъкмастър обвини OpenAI в научно нарушение, всички страни вече излязоха с публични изявления. Случаят повдига сложни въпроси за отворената наука.
Спорът около твърдяния от OpenAI резултат, генериран от AI, по уравненията на Навие–Стокс предизвика публични изявления от всички замесени. Проблемът на Навие–Стокс е един от проблемите на хилядолетието на института „Клей“ и за него е предвидена награда от 1 милион долара.
Математикът Тристан Бъкмастър по-рано отправи сериозни обвинения срещу OpenAI, твърдейки, че след изтичането на информация за изследването му компанията му е оказвала натиск, опитала се е да отстрани съавтора му Левент Алпьоге от статията, тъй като Алпьоге работи в Anthropic, и го е заплашила с последици за кариерата му. Съществуват и подозрения, че OpenAI може да е обучила моделите си с чернови, които двамата изследователи са качили в Codex.
Едно нещо е безспорно. По собствените ѝ думи OpenAI е чула слухове, че моделите на Anthropic са решили проблем от хилядолетието, и след това е насочила собствените си ресурси към същия проблем. По редица други точки версиите се разминават.
Бъкмастър го нарича „абсолютно академично нарушение“
Алпьоге и Бъкмастър оспорват твърдението на OpenAI, че нейното собствено решение се различава съществено от тяхното. Те заявяват, че са въвели сходен подход в системите на OpenAI. Доколкото разбира Бъкмастър, тази информация е попаднала в данните за обучение. Бъкмастър вижда това като „абсолютно академично нарушение“.
Служители на OpenAI заявяват, че вероятността OpenAI действително да е обучила моделите си с изпратените решения е малка, особено ако двамата са деактивирали опцията за изключване на въведените от тях данни от обучението. Не е публично известно дали са го направили. Служителят на OpenAI Боаз Барак също отхвърли идеята, че моделът изобщо е имал нужда от външна помощ. „Просто се самозалъгваме, ако смятаме, че моделът би имал нужда от това. Всъщност той започна с доказването на по-силно твърдение от тяхното. Всеки, който е виждал този модел в действие, не би помислил, че той има нужда от „подсказки“.“
В официалната си публикация в блога OpenAI признава липсата на пълна сигурност. „Макар и малко вероятно, не можем да изключим възможността деидентифицирани данни, извлечени от използването на нашите продукти, да са помогнали за подобряването на моделите ни.“
Алтман подкрепя Бюбек, а Алпьоге му отговаря
Главният изпълнителен директор на OpenAI Сам Алтман подкрепи Бюбек в X, като заяви, че екипът е „действал почтено и великодушно през цялото време“. Той каза, че е било предложено Бъкмастър и Алпьоге да получат наградата, но екипът се е сблъскал с „неоснователни обвинения в плагиатство“.
Алтман също така написа, че усилието е започнало заради „слухове в интернет миналата седмица, че моделите на Anthropic са решили проблем от хилядолетието, и ни беше любопитно дали и нашите могат да го направят“.
Алпьоге оспорва Алтман по един ключов въпрос. Алтман пише, че е било трудно да бъде отправено същото предложение към Алпьоге, тъй като той „така или иначе не желаеше да разговаря или да координира действията си с нас“. Алпьоге казва, че би искал да работи с OpenAI и че въпросът с авторството не е бил важен за него. „Харесва ми и идеята лабораториите да си сътрудничат, а още повече — да си сътрудничат за научния прогрес. Жалко!“ — пише Алпьоге.
Какво означава това за отворената наука
Независимо кой е прав по всеки детайл, случаят повдига основен въпрос за начина, по който AI лабораториите взаимодействат с изследователската общност. Само слуховете са били достатъчни, за да накарат OpenAI да насочи огромни ресурси към изследователски проблем в кратък срок, опитвайки се да го реши и евентуално да публикува първа. Не може да се изключи и възможността компанията да е обучавала моделите си с данни, въведени в собствените ѝ системи.
За академичните среди и компаниите изводът е прост. Всеки, който подава изследователски данни в системите на OpenAI, рискува да бъде изпреварен от собствените си открития. Отказът от използване на данни за обучение чрез настройките предлага най-много ограничена защита, особено тъй като AI лабораториите не са заслужили презумпцията за добросъвестност по отношение на практиките си за обучение и данни.
Математикът Терънс Тао, един от най-влиятелните живи математици, предупреждава в Mastodon, че „дори слухът, че някой работи по даден проблем, може да предизвика огромно количество усилия, задвижвани от AI, за да го решат, преди оригиналният изследователски проект да е имал време да достигне пълния си потенциал“.
„Стимулите може вече да насочват към това обещаващите изследователски направления да не се споделят повече с по-широката общност, което би обърнало с главата надолу вековни традиции на отворената наука и би нанесло сериозни дългосрочни щети на бъдещето на областта“, пише Тао.
Новини за AI без сензации – подбрани от хора
Абонирайте се за THE DECODER за четене без реклами, седмичен бюлетин за AI, нашия ексклузивен годишен доклад „AI Radar“ за водещите технологии, публикуван шест пъти годишно, пълен достъп до архива и достъп до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.