Decisions API на OpenAI излиза в публична бета-версия с 10 пъти по-бързи типизирани отговори
OpenAI пусна Decisions API в публична бета версия. Той превръща текстове и изображения в типизирани отговори, въз основа на които кодът ви може да взема решения. Екипът на OpenAI заявява, че OpenAI Decisions API работи около 10 пъти по-бързо от Responses API. Той е предназначен за често срещан модел: подаване на подкана към LLM, след което парсване на текста му до етикет.
Накратко
- Размер: Броят параметри на GPT-6 Luna не е разкрит. Неговата карта на модела посочва контекстен прозорец от 1 050 000 токена.
- Работи на: Само чрез хостван от OpenAI API, посредством
POST /v1/decisions. Няма отворени тегла и възможност за самостоятелно хостване. - Производителност: Около 10 пъти по-бърз от Responses API, според OpenAI.
- Най-добро: $0.10 за 1 млн. входни токена, без такси за изход, прочитане от кеша или запис в кеша.
- Извод:
- Най-добро: бързи, типизирани решения с вероятности.
- Най-лошо: 1 модел, бета статус, все още няма независими оценки.
- Най-добро: бързи, типизирани решения с вероятности.
Какво представлява OpenAI Decisions API?
Decisions API е крайна точка на OpenAI, която оценява текст, изображения или и двете и връща типизирани отговори. Той не генерира проза. Заявката съдържа 3 полета: model, input и questions. Единственият поддържан модел днес е gpt-6-luna. OpenAI очаква общодостъпността да бъде през следващите седмици.
Как работи Decisions API?
Всяка заявка съдържа общи доказателства и списък с въпроси. Всеки въпрос има уникално name, тип и инструкции. Отговорът връща масив answers, индексиран по тези имена.
Кои са 3-те типа въпроси?
- predicate: проверява условие и връща
probabilityот 0 до 1. Пример: показва ли снимката на продукт пукнатина, разкъсване или вдлъбнатина? - choice: избира 1 стойност от предоставените от вас опции. Връща също така
probabilitiesза всяка опция и полеconfidence. - score: оценява входа спрямо подредени
levels, индексирани от 0. Резултатът е среднопретеглена с вероятности стойност на индексите на нивата.
Примерът на OpenAI за степента на сериозност прави математиката конкретна. Вероятности за нивата от 0.1, 0.7 и 0.2 дават резултат 1.1. Тази стойност е между „Налично е временно решение“ и „Напълно блокирано“.
Кога вместо това трябва да използвате Structured Outputs?
OpenAI очертава ясна граница. Използвайте Decisions за вероятности, избори или оценки. Използвайте Structured Outputs, за да попълвате собствена JSON схема или да пишете обяснения. Използвайте извикване на функции, когато моделът трябва да заяви извикване на инструмент с аргументи.
Колко бърз е той и какви са доказателствата?
Документът на OpenAI твърди, че отговорите са около 10 пъти по-бързи от тези на Responses API. Материалите от DevDay посочват около 150 мс за едно решение срещу около 1,6 секунди за стандартни извиквания към Luna. OpenAI не е публикувала данни за точността или калибрирането на крайната точка. Документацията препоръчва праговете да се задават с етикетирани примери от собственото ви приложение.
Колко струва и къде можете да го внедрите?
При gpt-6-luna входът струва $0.10 за 1 млн. токена. Няма такси за изходни токени, прочитане от кеша или запис в кеша. Все още се прилагат премии за регионална обработка и множители за дълъг контекст. Картата на модела Luna посочва, че подканите над 272 хил. токена се таксуват с двойни входни ставки.
- Крайна точка:
POST /v1/decisionsв OpenAI API, както и Playground. - Минимални версии на SDK: Python 3.26.0, JavaScript 7.30.0, Go 3.73.0, Ruby 0.101.0, Java 4.78.0.
- Съответствие: Zero Data Retention и HIPAA за отговарящи на условията клиенти.
- Местоположение на данните: Съединените щати и Европа (ЕИП плюс Швейцария).
- Глас: решенията могат да задействат действия чрез делегиране от клиента с Live API.
Как се сравнява с TypeSafe Jev?
Най-близкият конкурент е TypeSafe Jev, пуснат на 15 септември 2026 г. Jev е модел System One, който връща типизирани стойности с калибрирани вероятности. TypeSafe таксува входа с $0.042 за 1 млн. токена, а изходът е безплатен. Това прави базовата тарифа на OpenAI около 2,4 пъти по-висока. TypeSafe отчита от 70 до 500 мс от край до край, измерени от западното крайбрежие на САЩ. Jev поддържа до 255 избора, но все още е в ранен достъп. Предимствата на OpenAI са въвеждането на изображения, опциите за съответствие и отвореният бета достъп.
| Функция | OpenAI Decisions API | TypeSafe Jev 1.13 | GPT-6 Luna чрез Responses API |
|---|---|---|---|
| Пускане | Бета, 6 октомври 2026 г. | Ранен достъп, 15 септември 2026 г. | Общодостъпен, 22 септември 2026 г. |
| Базов модел | gpt-6-luna | Jev (модел System One) | gpt-6-luna |
| Параметри | Не са разкрити | Не са разкрити | Не са разкрити |
| Вход | Текст, изображения (вграден base64) | Текст и структурирано състояние | Текст, изображения |
| Изход | Вероятност, избор или оценка | Типизирани стойности с вероятности | Генериран текст (JSON чрез Structured Outputs) |
| Макс. брой опции на въпрос | Не е разкрит | До 255 | Неприложимо |
| Скорост (посочена от доставчика) | Около 10 пъти по-бърз от Responses API | От 70 до 500 мс от край до край | Базова стойност |
| Цена на входа за 1 млн. токена | $0.10 | $0.042 | $0.10 |
| Цена на изхода за 1 млн. токена | $0 | $0 | $0.50 |
| Съответствие | ZDR, HIPAA (за отговарящи на условията); местоположение на данните в САЩ и ЕС | Не е разкрито | Налично е местоположение на данните в ЕС |
Основни изводи
- OpenAI Decisions API връща вероятности, избори и оценки, а не проза.
- Входът струва $0.10 за 1 млн. токена; изходът е безплатен.
- OpenAI твърди, че е около 10 пъти по-бърз от Responses API.
- TypeSafe Jev е по-евтин — $0.042 за 1 млн. входни токена.
Вижте техническите подробности тук. Цялата заслуга е за изследователя на този проект. Също така можете да ни последвате в Twitter и не забравяйте да се присъедините към нашия 150k+ ML SubReddit и да се абонирате за нашия бюлетин. Чакайте! В Telegram ли сте? сега можете да се присъедините към нас и в Telegram.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.