Sakhanda Wire
NVDA MSFT GOOGL META AMZN
← К новостям

Первый собственный чип OpenAI «Jalapeño», как сообщается, превзошёл Blackwell и Rubin от Nvidia в тестах инференса

Первый собственный чип OpenAI «Jalapeño», как сообщается, обходит Nvidia Blackwell и Rubin в тестах производительности инференса
Matthias Bastian
25 авг. 2026
OpenAI

На конференции Hot Chips OpenAI впервые представила результаты тестирования собственного чипа для инференса. По сообщениям, «Jalapeño» превосходит Blackwell и Rubin от Nvidia по производительности на ватт и задержке генерации токенов.

Чип предназначен только для инференса, то есть запускает ИИ-модели, но не обучает их. Jalapeño также не оптимизирован специально под собственные модели OpenAI. Это ускоритель инференса универсальных больших языковых моделей.

По данным OpenAI, при пиковой пропускной способности Jalapeño обеспечивает в 1,5–1,9 раза больше вычислений ИИ на ватт во всех трех протестированных моделях, а сквозная задержка у него на 1,7–3,6 раза ниже, чем у лучших коммерчески доступных систем. Для интерактивных нагрузок компания заявляет о превосходстве в производительности в 2,1–4,1 раза.

Результаты получены в тестах с использованием публичного бенчмарка InferenceX от SemiAnalysis. Цифры предоставила OpenAI. SemiAnalysis проверила некоторые запуски непосредственно в лаборатории. Тестировались модели GPT-OSS 120B, Deepseek R1 670B и Kimi K2.5 1T. В тесте GPT-OSS Jalapeño достиг примерно 1400 токенов в секунду на пользователя. В тесте Deepseek R1 показатель превысил 700 токенов в секунду при одном параллельном запросе.

Jalapeño erzielt bei gleicher Decoding-Geschwindigkeit je nach Modell das 54- bis 104-Fache des Token-Durchsatzes pro Kilowatt im Vergleich zum besten verfügbaren Beschleuniger. | Bild: OpenAI
При одинаковой скорости декодирования Jalapeño обеспечивает в 54–104 раза большую пропускную способность по токенам на киловатт по сравнению с лучшим доступным ускорителем — в зависимости от модели. | Изображение: OpenAI

Jalapeño показал эти результаты без использования таких методов, как предсказание нескольких токенов или спекулятивное декодирование, тогда как некоторые системы, с которыми проводилось сравнение, использовали эти оптимизации. Это означает, что возможности для дальнейшего улучшения еще остаются.

В своем ключевом сравнении производительности на ватт SemiAnalysis пишет, что «Jalapeño уделывает все остальные чипы». Генеральный директор SemiAnalysis Дилан Патель добавил: «Обычно чипы первого поколения не способны конкурировать, но OpenAI обходит Nvidia Blackwell и даже Rubin».

SemiAnalysis отмечает, что более корректным объектом сравнения является не Blackwell, а новая платформа Vera Rubin от Nvidia, поскольку обе системы используют память HBM4. Даже в этом случае Jalapeño выдает больше выходных токенов на мегаватт, чем Vera Rubin, несмотря на то что ускоритель Nvidia использует оптимизацию предсказания нескольких токенов, которую Jalapeño пока не применяет. По совокупной стоимости владения в расчете на токен системы показывают примерно одинаковый результат.

Однако есть важные оговорки. Nvidia и AMD уже опубликовали результаты для более крупных моделей, таких как Deepseek V4 Pro и Kimi K3, которые пока не тестировались на Jalapeño. Кроме того, системы на базе Rubin уже поставляются клиентам, тогда как Jalapeño, по сообщениям, еще не вышел за пределы инженерных образцов.

OpenAI создала чип за девять месяцев, частично используя собственные модели

OpenAI разработала Jalapeño совместно с Broadcom. Проектирование началось в середине 2024 года, а финальный дизайн был передан в производство в ноябре 2025 года. Полный цикл занял около 16 месяцев, однако OpenAI утверждает, что между созданием первого дизайна чипа и передачей готовой схемы на фабрику прошло всего девять месяцев. В ходе разработки компания использовала собственные ИИ-модели, сообщает OpenAI. Старые поколения моделей помогали проектировать чип, а новые ускоряли программирование и оптимизацию.

SemiAnalysis видит в этом признак того, что широко обсуждавшийся «ров CUDA» Nvidia может больше не быть непреодолимым. «Ров CUDA потенциально мертв, учитывая, насколько быстро OpenAI может выводить новые модели на собственном кремнии», — написала компания.

Финансовый директор OpenAI Сара Фрайар заявляет, что чип является частью более широкой вычислительной стратегии, в рамках которой дата-центры, чипы, модели, платформа для разработчиков, продукты и устройства работают как единая интегрированная система. По ее словам, Jalapeño дополняет существующие партнерства OpenAI с Nvidia, AMD, AWS, Cerebras, CoreWeave и другими компаниями, а не заменяет их.

OpenAI поддерживает тесные связи с несколькими из этих компаний. Nvidia, AMD и AWS являются инвесторами или вычислительными партнерами, причем Nvidia — одним из крупнейших. Каждая из этих компаний также разрабатывает собственные ИИ-чипы, что делает их отношения одновременно партнерскими и конкурентными. При этом все они продолжают утверждать, что вычислительных мощностей в мире не может быть слишком много — заявление, удобно поддерживающее их собственные бизнес-модели.

Новости ИИ без шумихи — отобраны людьми

Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ, эксклюзивный перспективный отчет «AI Radar» шесть раз в год, полный доступ к архиву и разделу комментариев.

Источник: OpenAI | SemiAnalysis

Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

Впервые опубликовано изданием The Decoder

Читать оригинал на The Decoder ↗

Текст и изображения принадлежат The Decoder и приводятся здесь с указанием авторства и ссылкой на оригинальную публикацию.

← К новостям

Ещё новости

Все последние новости