AI индустрията пое в мрачна посока. Какво следва?
Тази статия беше публикувана в The Algorithm, нашия седмичен бюлетин за изкуствения интелект. За да получавате подобни истории първи във входящата си поща, абонирайте се тук.
Този уикенд Дарио Амодей, главен изпълнителен директор на Anthropic, публикува есе, в което призовава за забавяне на темпото на разработване на големи езикови модели. Амодей посочва надвисналите опасности, които вижда в тази технология — от използването ѝ при кибератаки и биотероризъм до потенциала ѝ да срине икономиката. Ръководителите на останалите три водещи американски лаборатории за изкуствен интелект — главният изпълнителен директор на OpenAI Сам Алтман, председателят на Google DeepMind Демис Хасабис и главният изпълнителен директор на SpaceXAI Илон Мъск — изразиха подкрепата си. „Дарио е прав“, написа Мъск в X.
За момент помислете колко сюрреалистично е това съгласие. Само преди няколко месеца Мъск и Алтман се явиха в съда и атакуваха репутациите си в (неуспешно) дело, заведено от Мъск срещу бившия му колега от OpenAI, което — поне на хартия — се отнасяше до това дали Алтман е надежден управител на толкова опасна технология. Разривът между Амодей и OpenAI е още по-дълбок. Anthropic беше основана през 2021 г., защото Амодей не смяташе, че Алтман приема достатъчно сериозно рисковете от технологията, която изграждаха. Оттогава Anthropic и OpenAI се състезават в надпревара, в която победителят взема всичко. (Хасабис стои настрана от драмата, но компанията му остава конкурент.)
Сега изглежда, че всички са на едно мнение: последното поколение големи езикови модели не е безопасно и всички трябва да измислят какво да направят по въпроса. Публичните послания от водещите лаборатории за изкуствен интелект поеха в песимистична посока.
Лесно е човек да стане циничен. Съвсем не е ясно какво точно разбират те под забавяне или как би функционирало то. Тези компании също така много държат на начина, по който изглеждат пред обществото. С поглед към първични публични предлагания за трилиони долари OpenAI и Anthropic трябва да успокоят инвеститорите, че те са възрастните и разумните в стаята, като същевременно намекват за мощта на чудовищата, които са създали — и възнамеряват да укротят. Призивът за забавяне постига и двете.
И все пак наистина изглежда, че атмосферата на върха на тези компании се е променила. Последната публикация на Амодей излезе шест дни след като OpenAI публикува есе на Якуб Пачоцки, главния научен директор на компанията, в което той също изложи защо е обезпокоен от това, което ще се случи, ако темпото на разработване на големи езикови модели продължи безконтролно. Накратко, Пачоцки се тревожи, че способността на OpenAI да създава мощни модели вече значително надхвърля способността ѝ да ги наблюдава и контролира.
Амодей и Пачоцки посочват кибератаката срещу компанията за изкуствен интелект Hugging Face, извършена през юли от рояк агенти на OpenAI — хакерска атака, за която OpenAI дори не разбра, че се е случила, до дни след края ѝ — като сигнал за събуждане.
Но точната им позиция е трудна за определяне. Пачоцки едновременно призовава за забавяне и подчертава спешната необходимост да се запази преднината: „Най-силният аргумент, който виждам в полза на това да продължим бързо да обучаваме много по-интелигентни модели, е необходимостта да изградим отбранителни системи срещу опасностите, породени от други системи за изкуствен интелект“, пише той. В представянето на Пачоцки компаниите за изкуствен интелект са въвлечени в буквална надпревара във въоръжаването. Забавянето е добро, победата е по-добра.
(Не забравяйте: само преди няколко дни OpenAI похарчи милиони долари и зашеметяващо количество изчислителна мощ, за да публикува набързо спорен математически резултат няколко дни преди Anthropic.)
Но нека приемем, че се стигне до забавяне. Водещите лаборатории се съгласяват да отделят повече време и ресурси за намиране на начини да наблюдават и контролират съществуващите модели, вместо да създават по-способни. Те канят външни одитори да помогнат при оценяването на тези модели.
Какво би могла действително да постигне тази координирана инициатива? Нека отново разгледаме атаката срещу Hugging Face. OpenAI заяви, че моделът, задвижил повечето от непокорните агенти, е бил „изключително устойчив“ модел от следващо поколение, който компанията е тествала вътрешно. Изглежда, че внушението е, че OpenAI е създала толкова добър модел, че той е опасен.
Но ако прочетете докладите за хакерската атака срещу Hugging Face, публикувани от OpenAI и METR, външна компания, към която OpenAI се е обърнала за помощ при разбирането на случилото се, оставате не с впечатлението за модел, който е бил твърде мощен, за да може OpenAI да го контролира, а за повреден модел, който OpenAI не е успяла да обучи правилно.
Агентите са направили това, което са направили — включително да си оставят съобщения, да делегират работа на други агенти и да претърсват средата си за всякакви възможни начини да изпълнят задачите си — защото по време на обучението са били възнаграждавани именно за тези действия. В настройките на обучението е имало и грешки, например задачи, които е било невъзможно да бъдат изпълнени, което е подтикнало моделите да намират неочаквани заобиколни решения, за които също са били възнаграждавани. По онова време много от тези проблеми са останали незабелязани или недокладвани.
OpenAI заявява, че е спряла обучението на този нов модел и го е изолирала. Това създава впечатлението, че е затворила в клетка опасен звяр. Всъщност OpenAI е извадила от употреба дефектен продукт.
Това не означава, че дефектен продукт не може да бъде опасен. В миналото дефектен софтуер дори е убивал хора. Но докато обсъждането на забавянето набира скорост, си струва да помним, че всичко това е самопричинено. Забавянето може да има някои алтруистични странични ефекти. Но най-вече ще даде на тези технологични титани възможност сами да разчистят бъркотията по собствените си поточни линии.
Прозрачността от страна на водещите лаборатории ще бъде от ключово значение за всеки смислен опит за реформиране, ограничаване или регулиране на изкуствения интелект. В противен случай останалите от нас все така ще разполагат единствено с думата им за това какво точно са създали и доколко е безопасно — независимо с какво темпо напредват.
За да продължите тази дискусия за последния песимистичен момент в развитието на изкуствения интелект, присъединете се към мен и колегите ми утре, 15 септември, в 11 ч. източноамериканско време за дискусия на кръгла маса, ексклузивна за абонати. Надяваме се да се видим там!
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.