Sakhanda Wire
NVDA $225.65 +0.15% MSFT $497.15 +0.05% GOOGL $344.85 -0.44% META $593.00 -0.33% AMZN $263.88 -0.47%
← К новостям

GPT-5.6 Sol стал в 14 раз быстрее: OpenAI запускает режим Ultrafast на базе Cerebras

GPT-5.6 Sol работает в 14 раз быстрее: OpenAI запускает режим Ultrafast на базе Cerebras
Маттиас Бастиан
14 авг. 2026
GPT-Image-2 по запросу THE DECODER

OpenAI запускает предварительную версию нового режима «Ultrafast», который обеспечивает скорость до 750 выходных токенов в секунду во флагманской модели GPT-5.6 Sol.

Ускорение инференса обеспечивается компанией Cerebras, заключившей с OpenAI партнерство на сумму десять миллиардов долларов ранее в этом году. Изначально сервис будет доступен только через API OpenAI для GPT-5.6 Sol и лишь избранным клиентам. OpenAI планирует постепенно расширять доступ по мере наращивания мощностей. Компании, заинтересованные в участии, могут подписаться на обновления через форму.

Более высокая скорость вывода открывает новые варианты использования

По словам OpenAI, Ultrafast призван объединить скорость небольших моделей с полными возможностями крупной модели рассуждений, обеспечивая то, что компания называет «более полезной работой в секунду». Например, во время устранения инцидента инженеры могли бы анализировать журналы, изменения в коде и отчеты, пока сбой еще продолжается, что помогало бы в реальном времени определить причину и подготовить исправление. OpenAI сообщает, что уже использует модель внутри компании именно для этой цели.

OpenAI предлагает и ряд других сценариев. В сфере финансов модель могла бы оценивать рыночные сигналы и выявлять подозрительные транзакции, пока рыночные условия продолжают меняться. В службе поддержки сложные запросы можно было бы обрабатывать в реальном времени, даже если поиск ответа требует нескольких шагов или обращения к нескольким системам. В электронной торговле модель могла бы отвечать на вопросы о товарах, проверять уровень запасов и персонализировать рекомендации до того, как сомневающийся покупатель покинет корзину.

Видео: создание 3D-симулятора склада, показанного слева в режиме Ultrafast

Еще одна область, которую выделяет OpenAI, — исследования. Эксперименты, которые раньше выполнялись ночью в пакетном режиме, могли бы превратиться в интерактивные рабочие сессии, позволяя командам проверять идею, изучать результаты, корректировать свой подход и запускать следующий цикл, не прерывая рабочий процесс.

OpenAI превращает скорость ИИ в инструмент ценообразования

OpenAI уже монетизирует скорость инференса через разные тарифные уровни. Через API компания предлагает «Fast Mode», который обещает ускорение до 2,5 раза и меньшую задержку для GPT-5.6 Sol примерно за вдвое более высокую цену. Ultrafast добавляет третий, более быстрый и, вероятно, более дорогой уровень.

Эта логика напоминает облачных провайдеров вроде AWS, которые давно взимают больше за ту же услугу при более высокой производительности. OpenAI применяет этот подход к инференсу ИИ. Если скорость станет узким местом в различных отраслях, такая многоуровневая модель позволит OpenAI напрямую получать долю доходов, создаваемых ускорением инференса.

Новости ИИ без шумихи — отобраны людьми

Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ и наш эксклюзивный отчет о передовых разработках «AI Radar» шесть раз в год, иметь полный доступ к архиву и разделу комментариев.

Источник: OpenAI

Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.

Впервые опубликовано изданием The Decoder

Читать оригинал на The Decoder ↗

Текст и изображения принадлежат The Decoder и приводятся здесь с указанием авторства и ссылкой на оригинальную публикацию.

← К новостям

Ещё новости

Все последние новости