Първият специално разработен чип на OpenAI „Jalapeño“ според съобщенията изпреварва Blackwell и Rubin на Nvidia в тестове за инференция
OpenAI представи първите тестове на своя чип за инференс, разработен вътрешно, на конференцията Hot Chips. Според съобщенията „Jalapeño“ превъзхожда както Blackwell, така и Rubin на Nvidia по производителност на ват и латентност на токените.
Чипът обработва само инференс, което означава, че изпълнява AI модели, но не ги обучава. Jalapeño не е оптимизиран и за собствените модели на OpenAI. Това е универсален ускорител за инференс на големи езикови модели.
OpenAI твърди, че Jalapeño осигурява от 1,5 до 1,9 пъти повече AI операции на ват при пикова производителност за всички три тествани модела, с от 1,7 до 3,6 пъти по-ниска крайна латентност от най-добрите налични в търговската мрежа системи. За интерактивни натоварвания компанията посочва от 2,1 до 4,1 пъти по-висока производителност.
Резултатите са получени от тестове с публичния бенчмарк InferenceX на SemiAnalysis. OpenAI е предоставила данните. SemiAnalysis е проверила част от тестовете на място в лабораторията. Тестваните модели са GPT-OSS 120B, Deepseek R1 670B и Kimi K2.5 1T. При GPT-OSS Jalapeño е достигнал около 1400 токена в секунда на потребител. При Deepseek R1 е надхвърлил 700 токена в секунда при една едновременна заявка.

Jalapeño е постигнал тези резултати, без да използва техники като предсказване на множество токени или спекулативно декодиране, докато някои от сравняваните системи разчитат на тези оптимизации, така че все още има възможности за подобрение.
В основното си сравнение на производителността на ват „Jalapeño засенчва всеки друг чип“, пише SemiAnalysis. Главният изпълнителен директор на SemiAnalysis Дилън Пател добавя: „Обикновено чиповете от първо поколение не са конкурентоспособни, но OpenAI изпреварва Blackwell на Nvidia и дори Rubin.“
SemiAnalysis посочва, че по-справедливото сравнение не е с Blackwell, а с по-новата платформа Vera Rubin на Nvidia, тъй като и двете използват памет HBM4. Дори и тогава Jalapeño постига повече изходни токени на мегават от Vera Rubin, въпреки че ускорителят на Nvidia използва оптимизацията за предсказване на множество токени, която Jalapeño все още не е възприел. По обща себестойност на притежание на токен двата чипа са приблизително равностойни.
Има обаче някои уговорки. Nvidia и AMD вече са публикували резултати с по-големи модели като Deepseek V4 Pro и Kimi K3, които все още не са тествани на Jalapeño. Освен това системите с Rubin вече се доставят на клиенти, докато според съобщенията Jalapeño не е преминал отвъд етапа на инженерни образци.
OpenAI разработи чипа за девет месеца, отчасти използвайки собствените си модели
OpenAI разработи Jalapeño съвместно с Broadcom. Работата по дизайна започна в средата на 2024 г., а окончателният дизайн беше изпратен за производство през ноември 2025 г. Целият цикъл отне около 16 месеца, но OpenAI твърди, че между първия дизайн на чипа и завършения проект, изпратен към фабриката, са изминали само девет месеца. По време на разработката компанията е използвала собствените си AI модели, според OpenAI. По-старите поколения модели са помогнали при проектирането на чипа, докато по-новите са ускорили програмирането и оптимизацията.
SemiAnalysis вижда в това знак, че широко обсъжданото „предимство на CUDA“ на Nvidia може вече да не е устойчиво. „Предимството на CUDA потенциално е мъртво предвид това колко бързо OpenAI може да внедрява нови модели върху собствения си силиций“, пише компанията.
Главният финансов директор на OpenAI Сара Фрайър казва, че чипът е част от по-широка стратегия за изчислителни ресурси, при която центрове за данни, чипове, модели, платформа за разработчици, продукти и устройства работят като една интегрирана система. Според нея Jalapeño допълва съществуващите партньорства на OpenAI с Nvidia, AMD, AWS, Cerebras, CoreWeave и други, вместо да ги заменя.
OpenAI има тесни връзки с няколко от тези компании. Nvidia, AMD и AWS са инвеститори или партньори в областта на изчислителните ресурси, като Nvidia е един от най-големите. Всяка от тях също разработва собствени AI чипове, което прави отношенията едновременно кооперативни и конкурентни. Въпреки това всички тези компании продължават да твърдят, че светът не може да разполага с достатъчно изчислителни ресурси — твърдение, което удобно подкрепя собствените им бизнес модели.
AI новини без сензация – подбрани от хора
Абонирайте се за THE DECODER, за да четете без реклами, да получавате седмичен AI бюлетин и нашия ексклузивен водещ доклад „AI Radar“ шест пъти годишно, да имате достъп до пълния архив и до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.