Sakhanda Wire
NVDA $225.65 +0.15% MSFT $497.15 +0.05% GOOGL $344.85 -0.44% META $593.00 -0.33% AMZN $263.88 -0.47%
← Към новините

GPT-5.6 Sol става 14 пъти по-бърз, след като OpenAI пуска режим Ultrafast с технологията на Cerebras

GPT-5.6 Sol е 14 пъти по-бърз, докато OpenAI пуска режим Ultrafast, захранван от Cerebras
Matthias Bastian
14 август 2026 г.
GPT-Image-2, подканен от THE DECODER

OpenAI пуска предварителна версия на новия си режим „Ultrafast“, който осигурява до 750 изходни токена в секунда от водещия си модел GPT-5.6 Sol.

Ускоряването на инференса идва от Cerebras, която по-рано тази година подписа партньорство с OpenAI на стойност десет милиарда долара. Първоначално услугата ще бъде достъпна само чрез API на OpenAI за GPT-5.6 Sol и ще бъде ограничена до избрани клиенти. OpenAI планира постепенно да разшири достъпа с нарастването на капацитета. Компаниите, които искат да се включат, могат да се запишат за актуализации чрез формуляр.

По-бързото генериране на резултати отваря нови приложения

OpenAI заявява, че Ultrafast е създаден, за да съчетава скоростта на по-малките модели с пълните възможности на голям модел за разсъждение, което позволява това, което компанията нарича „по-полезна работа за секунда“. Например по време на реакция при инциденти инженерите биха могли да анализират логове, промени в кода и отчети, докато прекъсването все още се случва, което ще им помогне да установят причината и да подготвят решение в реално време. OpenAI заявява, че вече използва модела вътрешно за тази цел.

OpenAI посочва и няколко други сценария. Във финансите моделът би могъл да оценява пазарни сигнали и да сигнализира за подозрителни транзакции, докато условията все още се променят. В обслужването на клиенти сложни запитвания биха могли да бъдат разрешавани в реално време, дори когато намирането на отговора изисква множество стъпки или системи. В електронната търговия той би могъл да отговаря на въпроси за продукти, да проверява наличностите и да персонализира препоръки, преди колебаещият се купувач да изостави количката си.

Видео: Генериране на 3D симулатор на склад, показан вляво в режим Ultrafast

Изследванията са друга област, която OpenAI подчертава. Експерименти, които преди са се изпълнявали през нощта като пакетни задачи, биха могли да се превърнат в интерактивни работни сесии, позволявайки на екипите да изпробват идея, да прегледат резултатите, да коригират подхода си и да стартират ново изпълнение, без да прекъсват работния си процес.

OpenAI превръща скоростта на AI в инструмент за ценообразуване

OpenAI вече монетизира скоростта на инференса чрез различни нива. Чрез API компанията предлага „Fast Mode“, който обещава до 2,5 пъти по-висока скорост с по-ниска латентност за GPT-5.6 Sol на приблизително двойна цена. Ultrafast добавя трето, по-бързо и вероятно по-скъпо ниво.

Логиката наподобява тази на облачни доставчици като AWS, които отдавна таксуват повече за същата услуга при по-високи нива на производителност. OpenAI прилага това към инференса на AI. Ако скоростта се превърне в пречка в различни индустрии, този многостепенен модел дава на OpenAI пряк дял от приходите, генерирани от по-бързия инференс.

AI новини без сензации – подбрани от хора

Абонирайте се за THE DECODER, за да четете без реклами, да получавате седмичен AI бюлетин, нашия ексклузивен шест пъти годишно доклад за водещите разработки „AI Radar“, пълен достъп до архива и достъп до секцията за коментари.

Източник: OpenAI

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от The Decoder на

Прочетете оригинала в The Decoder ↗

Текстът и изображенията са собственост на The Decoder и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини