Компаниите за AI с отворени тегла са най-желаните цели за придобиване в Силициевата долина
Всички чакат Nvidia да потвърди най-интересната технологична сделка за тази седмица: съобщаваното придобиване за 13 млрд. долара на Hugging Face — платформа за споделяне на AI модели с отворени тегла и бенчмаркове.
Днес най-известна като мишената на екип от агенти на OpenAI, използващи хакове за награди, Hugging Face е в центъра на екосистемата от разработчици, които създават и внедряват LLM модели, които не са собственост на водещите лаборатории. Може да я разглеждате като своеобразен GitHub за ерата на изкуствения интелект.
Слуховете за тази сделка идват след като Nvidia сключи споразумение за 6 млрд. долара с Poolside, разработчик на модел с отворени тегла, в резултат на което повечето му служители ще преминат към производителя на чипове. А преди две седмици Stripe придоби OpenRouter, водещия доставчик на модели с отворени тегла за бизнеса, за повече от 7 млрд. долара.
Това е огромен обем капитал, който се влива в сектор, основан на раздаването на продукти безплатно, и отразява последните тенденции в сектора на изкуствения интелект.
За Nvidia е необходимо да избегне по-нататъшната зависимост от сделките си с големите хиперскейлъри и водещите лаборатории. Това важи особено сега, когато големи разработчици на AI модели като OpenAI и Google също създават собствени чипове за инференс, като Jalapeño на OpenAI, чиито възможности бяха обявени тази седмица. Ако разработчиците на модели произвеждат чипове, Nvidia иска да получи дял от бизнеса с разработване на модели.
Nvidia вече създава собствено семейство Nemotron от модели с отворени тегла, но приемането им не е особено широко. Като поеме контрола над най-голямото пространство за разработчици на модели с отворен код в САЩ, компанията ще получи достъп до огромна маса от потребители, които може да насочи към своите чипове и стандарти.
Нарастват и въпросите относно разходите за инференс на AI, което кара компаниите да проучват по-евтини модели, разработени от китайски компании като Moonshot, DeepSeek и Alibaba. Засега приемането им е сравнително ограничено, но нараства — едва 6% от компаниите използват модели с отворени тегла според проучване на данните за разходите на Ramp, или едва 2% от софтуерните инженери според проучване на Jellyfish, която създава инструменти за разработчици.
Ник Албаран, ръководител на AI продуктите в Jellyfish, заяви пред TechCrunch, че моделите с отворени тегла се използват предимно от компании, чиито продукти разчитат на повтарящи се инференс натоварвания, като например тези, които предлагат чатове за обслужване на клиенти. Тъй като това са задачи с голям обем и много повторения, модел с отворени тегла може да бъде донастроен така, че да отговаря на въпросите евтино.
Именно така Stripe представи придобиването на OpenRouter. „Токените са основната валута за компаниите, които изграждат продукти с AI, и е ясно, че реалният икономически потенциал ще зависи от ефективното използване на оскъдните изчислителни ресурси“, заяви в изявление Патрик Колисън, съосновател и главен изпълнителен директор на Stripe.
При задачи, свързани с програмиране и автономни агенти, обаче разнообразните заявки и необходимостта от повече разсъждение означават, че водещите модели често вземат превес, отчасти защото собственическите лаборатории осигуряват по-лесен достъп, а в някои случаи и субсидиране на токените. Албаран казва, че с усъвършенстването на работните процеси с AI за компаниите ще бъде по-лесно да се насочат към модели с отворен код. Въпреки това основната причина компаниите да се обръщат към тези модели сега е контролът и възможността за конфигуриране, а не опасенията относно разходите.
„Все още няма много компании, при които това да е така … [но] ако цените на водещите лаборатории продължат да се покачват, все повече компании ще бъдат принудени поне да го обмислят“, каза Албаран пред TechCrunch. „Когато работните ви процеси, задвижвани от AI, станат значително по-зрели, тогава има смисъл да инвестирате в самостоятелно хостване на модели.“
Лин Цяо е главен изпълнителен директор на Fireworks, водещ маршрутизатор и хостинг доставчик на модели с отворени тегла за корпоративни потребители, който често се споменава като потенциална придобивка за технологичен гигант. Цяо казва, че компанията ѝ обработва 40 трилиона токена дневно — повече от API-тата на Gemini или OpenAI.
Залогът на Fireworks е в разнообразието от модели: С разпространението и усъвършенстването на LLM моделите за компаниите ще бъде по-лесно да ги обучават специално за своите нужди. „Всяка една компания за приложения трябва да обмисли наемането на вътрешен изследовател“, заяви тя пред TechCrunch миналата седмица. „Той може да използва продукта и продуктовите данни на компанията, за да създаде собствен модел. Бъдещето всъщност е в специализирания интелект. Буквално всяка компания трябва да има собствен модел за всеки конкретен случай на употреба и това ще се случи автоматично.“
Лесно е да забравим колко ранен е етапът, на който се намираме, в развитието на AI като инструмент и бизнес. Доминирането на OpenAI и Anthropic обаче не е неизбежно. Докато технологичните гиганти се стремят да разпределят риска от залозите си в най-големите лаборатории, привлекателността на отворените технологии се оказва трудно устоима.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.