Sakhanda Wire
NVDA — MSFT — GOOGL — META — AMZN —
← До новин

Architect запускає Liquid Inference — аукціон у реальному часі для інференсу LLM

Architect Financial Technologies запустила Liquid Inference — маршрутизатор LLM, який проводить живий аукціон для кожного запиту. Liquid Inference — це маркетплейс інференсу LLM від Architect, де постачальники змагаються за обслуговування кожного промпту. Покупець платить найнижчу ціну, яка відповідає його правилам. Для розробників усе дуже просто: замініть базову URL-адресу, збережіть свій код і дозвольте постачальникам конкурувати за ціною.

Що таке Liquid Inference?

Liquid Inference — це маршрутизатор інференсу LLM біржового типу. За словами Architect, постачальники публікують пропозиції щодо обслуговування конкретних моделей. Кожен запит виставляється на аукціон серед усіх постачальників, які вказали ціну для зазначеної моделі. Перемагає найдешевша пропозиція, що відповідає правилам покупця.

Продукт створила торговельна компанія, а не лабораторія штучного інтелекту. Architect керує біржею безстрокових ф’ючерсів AX. У травні 2026 року компанія придбала американський Designated Contract Market для лістингу ф’ючерсів на обчислювальні потужності GPU — за умови проходження регуляторної перевірки. Команда використала свій досвід створення фінансових бірж, щоб розробити двостороннє визначення цін для інференсу.

Як працює аукціон інференсу?

Процес складається з 4 кроків:

  1. Запит: Клієнт надсилає стандартний API-запит OpenAI або Anthropic.
  2. Правила: Обмеження покупця фільтрують доступні пропозиції.
  3. Аукціон: Постачальники, які вказали ціну для цієї моделі, змагаються між собою. Перемагає найнижча пропозиція, що відповідає вимогам.
  4. Квитанція: Максимальна ціна фіксується до початку генерації. Оплата стягується лише за виміряне використання.

Покупці можуть установлювати ліміти вартості для кожного завдання, обмеження часу до отримання першого токена та мінімальну пропускну здатність. Вони також можуть вимагати схвалені регіони, нульове зберігання даних, а також списки дозволених постачальників або моделей. Режим Auto може вибрати модель для конкретного завдання. У дописі Гаррісона в LinkedIn також згадуються готові набори правил маршрутизації та повна підтримка мультимодальності.

Власники облікових записів можуть переглядати книги заявок у реальному часі, котирування кожного постачальника й моделі, а також виконані транзакції. Такий рівень ринкових даних є незвичним для API LLM.

Що отримують покупці?

  • Сумісність без додаткових налаштувань з інструментами агентного програмування. У дописі перелічено Claude Code, Codex, OpenCode, Cursor, Pi та Cline.
  • Безкоштовна реєстрація через електронну пошту. За словами Гаррісона, перші 500 користувачів отримають інференс на $20 безкоштовно.
  • Реферальна програма: 20% комісій за запрошених користувачів у вигляді безкоштовного інференсу, а також 10% за рефералів другого рівня.

Що отримують постачальники інференсу?

Постачальники реєструються через застосунок Liquid Inference. Гаррісон стверджує, що нових постачальників перевіряють «за хвилини, а не за тижні». Усі промпти використовують стандарт API OpenAI. REST API та WebSocket API реєструють моделі й котирування.

Постачальники можуть оновлювати котирування відповідно до власних витрат. Це дає їм змогу продавати вільні потужності GPU лише тоді, коли вони цього хочуть. Виплати здійснюються через Stripe, а для кожного завдання формуються деталізовані записи.

Як Liquid Inference порівнюється з OpenRouter і Hugging Face?

ФункціяLiquid InferenceOpenRouterПостачальники інференсу Hugging Face
Модель маршрутизаціїАукціон для кожного запиту серед постачальників, які вказали ціну Балансування навантаження з урахуванням ціни, обернено пропорційне квадрату ціни За замовчуванням — найшвидший постачальник; суфікс :cheapest необов’язковий
Кількість моделей / постачальників«Сотні» моделей; постачальники не розкриваються500+ моделей, 80+ постачальників 18 перелічених партнерів
Сумісність APIСумісність з OpenAI та AnthropicСумісність з OpenAIСумісність з OpenAI, лише чат
Ліміт ціниМаксимальна ціна фіксується до першого токенаПараметр max_price Не розкрито
Контроль данихZDR, регіони, списки дозволенихzdr, data_collection, only/ignore Порядок пріоритету постачальників
Комісія платформиНе розкритоКомісія 5,5% за оплату карткою, мінімум $0,80 Без націнки
Безкоштовні кредити$20 для перших 500 користувачів Не розкрито$0,10 на місяць безкоштовно, $2,00 PRO
Публічні ринкові даніКниги заявок у реальному часі та виконані угодиНе розкритоНе розкрито

Ключові висновки

  • Liquid Inference проводить аукціон кожного запиту LLM між конкуруючими постачальниками.
  • Максимальна ціна фіксується до першого токена, а для кожного завдання формується квитанція.
  • Працює з клієнтами OpenAI та Anthropic, зокрема Claude Code і Cursor.
  • Перші 500 користувачів отримують $20 безкоштовно; за рефералів нараховується 20% комісій.
  • Комісії, список постачальників і дані про затримку поки що не оприлюднені.

Ознайомтеся з технічними деталями. Уся подяка досліднику цього проєкту. Також підписуйтеся на нас у Twitter і не забудьте приєднатися до нашого сабреддіту про машинне навчання з понад 150 тисячами учасників та підписатися на нашу розсилку. Стривайте! Ви є в Telegram? Тепер ви також можете приєднатися до нас у Telegram.

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням MarkTechPost

Читати оригінал на MarkTechPost ↗

Текст і зображення належать MarkTechPost і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини