Reflection представя Beam — AI модел с отворени тегла, който ще съперничи на китайските модели с по-ниски изчислителни разходи
Reflection AI официално представя Beam, първия си водещ AI модел с отворени тегла. Базираната в Бруклин стартъп компания, създадена преди две години, твърди, че Beam постига резултати, сравними с тези на водещите китайски модели с отворен код при бенчмаркове за напреднало разсъждение, но на драстично по-ниска цена — твърдение, което може да разпали надпреварата за създаване на западен отговор на DeepSeek, Qwen и Z.ai.
Съобщението на Reflection потвърждава информацията на Axios от уикенда, че стартъпът е близо до пускане на модела. Компанията сподели нови подробности в обширна публикация в блога си в понеделник, в която Beam е описан като текстов модел от смесени експерти, обучен чрез подсилващо обучение с високи изчислителни ресурси, за да бъде ефективен при задачи, свързани с разсъждение, програмиране и автономни агенти, при „част от разходите за токени и изчислителното време за инференс“ на конкурентите.
Beam е модел с 501 милиарда параметъра, от които 23 милиарда са активни. Той е предварително обучен с 23,8 трилиона токена и има контекстен прозорец от 1 милион токена. За сравнение, GLM-5.2 на Z.ai има приблизително 744 милиарда общи параметъра, от които 40 милиарда са активни.
Твърденията на Reflection за представянето на модела не са независимо потвърдени, но компанията заявява, че при бенчмаркове за напреднало разсъждение Beam постига резултати наравно с GLM-5.2 на Z.ai и превъзхожда водещите западни модели с отворен код, използвайки „3–4 пъти по-малко изчислителни ресурси за инференс“. Reflection нарича модела „работен кон“ за предприятия, публичния сектор и разработчиците.
Reflection се позиционира срещу затворени лаборатории като Anthropic и OpenAI, срещу популярните модели с отворен код от китайски разработчици, както и срещу западни компании като Mistral, Meta и Cohere. Най-прекият ѝ конкурент в САЩ може да се окаже Inkling, отвореният модел от Thinking Machines Lab на Мира Мурати, пуснат през юли. Собствените бенчмаркове на Reflection показват, че Beam постига по-високи резултати от Inkling в четири теста за програмиране, в които и двата модела са публикували резултати, но Inkling е мултимодален модел, докато Beam е само текстов.
Reflection е основана през 2024 г. от двама бивши изследователи на Google DeepMind и според PitchBook е набрала приблизително 4,7 милиарда долара от инвеститори, сред които Nvidia, Sequoia Capital и Lightspeed Venture Partners. При последния инвестиционен рунд компанията беше оценена на предпарична оценка от 25 милиарда долара.
Стартъпът също така осигурява изчислителни ресурси — ключова съставка, необходима за обучението на водещи модели, способни да привлекат клиенти, използващи затворените модели на Anthropic и OpenAI, както и по-евтините модели с отворени тегла от китайски лаборатории. Това лято Reflection сключи договори на обща стойност над 7 милиарда долара с SpaceX и Nebius, за да си осигури достъп до чиповете GB300 на Nvidia до 2029 г.
Reflection насочва Beam и бъдещите си модели към предприятия и суверенни държави. Идеята е да се изградят „AI фабрики“ — продукт, който би позволил на институциите да създават свои собствени персонализирани локални AI системи, като обучават AI моделите на Reflection със собствените си патентовани данни. Главният изпълнителен директор на Nvidia Дженсън Хуанг, чиято компания подкрепя Reflection, отдавна защитава идеята за „AI фабрики“ и насърчава укрепването на екосистемата за отворен AI — визия, която би била от полза и за Nvidia, чиито графични процесори биха захранвали тези системи.
Axios съобщи, че хедж фондове и търговски компании са сред желаещите да изградят подобни системи. Reflection вече започна да тества концепцията за партньорство за суверенна AI фабрика с Shinsegae Group в Южна Корея.
Reflection заявява, че ще публикува теглата на Beam и пълните технически подробности за него този месец, като при старта ще осигури разпространение чрез хиперскейлъри и неоклауд доставчици, както и интеграции с библиотеки с отворен код.
Reflection не отговори навреме на запитванията на TechCrunch за повече информация.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.