Okta націлилася на витрати токенів ШІ-агентів за допомогою визначення області MCP
Okta заявляє, що списки інструментів Model Context Protocol (MCP), обмежені ідентичністю, можуть зменшити витрати токенів AI-агентів.
Кожен виклик моделі, здійснений AI-агентом, може містити схеми, назви, описи та параметри кожного інструмента, доступного через MCP-сервер. Okta називає результуючі накладні витрати на промпт «податком на інструменти»: це токени, які споживаються, коли модель розглядає інструменти, зокрема ті, які вона ніколи не викличе.
Компанія стверджує, що ці витрати виникають ще до того, як агент намагається викликати інструмент. Тому подальша відмова в несанкціонованому запиті не може повернути вже витрачені токени промпту. Запропонований Okta механізм фільтрує список інструментів до того, як він потрапить до моделі, використовуючи дозволи, призначені ідентичності агента та пов’язаному з ним користувачеві.
Внутрішнє моделювання Okta показало, що в деяких сценаріях із дозволами кількість видимих інструментів зменшувалася більш ніж на 90%. Компанія заявила, що витрати на схеми інструментів скорочувалися приблизно в такій самій пропорції, хоча не надала абсолютних показників у токенах або доларах.
Схеми інструментів MCP створюють накладні витрати на промпт під час кожного звернення
MCP-сервери стали способом підключення AI-агентів до інструментів і даних. Okta наводить як приклади підключення до Google Workspace, Slack і внутрішніх MCP-серверів. MCP-сервер може надавати велику кількість інструментів, і модель отримує представлення кожного доступного інструмента у своєму промпті під час кожного звернення.
Це представлення містить схему. Воно також включає назву, опис і параметри інструмента.
Okta заявляє, що витрати накопичуються, коли широко використовуваний MCP-сервер надає багато інструментів. Кожен активний користувач створює накладні витрати на промпт щоразу, коли його агент здійснює виклик моделі. Компанія розглядає це і як проблему кількості інструментів, і як проблему кількості користувачів.
Проблема також має вимір контролю доступу. Агент, який бачить інструменти за межами своєї сфери авторизації, може спробувати їх використати. Механізм, що відхиляє виклик під час виконання, може заблокувати операцію, однак модель уже отримала визначення інструмента й використала токени для його обробки.
Okta фільтрує інструменти до формування промпту агента
Okta позиціонує цю можливість у межах своєї «концепції безпечного агентного підприємства», яка закликає організації визначити своїх агентів, дозволені підключення та авторизовані дії.
Її підхід звужує питання підключення: замість доступу до всього MCP-сервера він розглядає доступ до окремих інструментів на цьому сервері. Адміністратор налаштовує в панелі Okta інструменти, які може використовувати певна ідентичність. Після цього Okta повертає обмежений набір інструментів замість повного каталогу сервера.
Агент отримує цей коротший список у своєму промпті під час кожного звернення. Okta заявляє, що повторно перевіряє область доступу під час виконання, перш ніж виклик інструмента буде здійснено.
Такий дизайн застосовує принцип найменших привілеїв на рівні інструментів. Компанія стверджує, що агент не повинен знати про ресурси, бази даних або інструменти, використання яких йому прямо не дозволено. Видалення недоступних інструментів із промпту також усуває витрати на їхні схеми під час виклику моделі.
Okta не описує в публікації впровадження у конкретного клієнта. Докази заявленого скорочення ґрунтуються на внутрішньому моделюванні з використанням даних про продукти Okta та загальнодоступної документації постачальників; дані клієнтів не використовувалися.
У внутрішній моделі використовувалися OAuth-області та типові ролі
Okta змоделювала одного клієнта MCP із доступом до каталогу корпоративних інструментів. Компанія порівняла кількість інструментів, видимих моделі до та після обмеження доступу на основі ідентичності.
Щоб оцінити обмежений доступ, компанія зіставила інструменти Okta MCP Server з OAuth-областями, які відкривають до них доступ. Потім вона визначила типові сегменти користувачів. До них увійшли користувачі служби підтримки з доступом лише для читання та оператори служби підтримки.
Іншими сегментами були адміністратори застосунків, адміністратори бренду й електронної пошти, а також супер адміністратори. Okta зважила кожен сегмент відповідно до передбачуваної частки щомісячного трафіку.
Компанія розрахувала скорочення кількості інструментів як одиницю мінус співвідношення кількості обмежених інструментів до кількості необмежених. Вона заявила, що в деяких сценаріях кількість видимих інструментів скорочувалася більш ніж на 90%. У публікації зазначається, що вартість токенів схем інструментів майже лінійно залежить від кількості інструментів, оскільки кожен інструмент додає до кожного промпту свою назву, опис і схему параметрів.
Okta зазначає, що фактичні результати залежать від каталогу інструментів, розподілу дозволів і вибраної моделі. Середній розмір схеми, обсяг запитів і ціна моделі також впливають на абсолютні витрати в токенах і доларах.
Okta протиставляє дозволи ідентичностей засобам контролю витрат шлюзів
У публікації обмеження на основі ідентичності відрізняється від контролю на рівні шлюзу. Okta заявляє, що шлюзи можуть обмежувати витрати за ключем, командою або групою, а також підтримувати маршрутизацію та обмеження швидкості.
Шлюз може вимірювати кількість токенів, що надходять до системи та виходять із неї, а також витрачені кошти. Okta зазначає, що такі засоби контролю можуть обмежувати витрати після того, як рішення моделі стає дорогим.
Дозволи ідентичності забезпечують інший підхід. Okta заявляє, що дозволи для окремих користувачів і агентів можуть визначати інструменти, доступні конкретному агенту або людині, яка стоїть за цим агентом, замість застосування інформації про доступ на рівні групи.
Пол Веббер, головний галузевий аналітик із кібербезпеки в Software Analyst Cyber Research, сказав: «Найкраще контроль витрат для агентів забезпечують інструменти управління ідентичностями, які пропонують більш детальний контроль і точність без порушення бізнес-процесів.
«Підхід Okta є елегантним способом зробити це, оскільки він використовує ті самі дані про дозволи, які регулюють безпеку, а не окремий рівень вимірювання без такого розуміння».
В описі Okta шлюз постає як засіб контролю того, що проходить через нього. Рівень ідентичності фільтрує доступний набір інструментів ще до того, як ці інструменти потрібно буде вимірювати.
Видимість інструментів також впливає на вразливість MCP до атак
У публікації цей самий механізм пов’язується з ризиками безпеки. Okta заявляє, що видалення інструментів із поля зору неавторизованої ідентичності також усуває дії, які ця ідентичність могла б виконати в разі компрометації.
Запропонована перевірка області доступу працює у двох точках. Перша відбувається під час формування списку інструментів для промпту агента. Друга — коли агент намагається виконати виклик інструмента.
Okta описує результат як зменшення масштабу наслідків компрометації ідентичності. Набір інструментів, що залишилися відкритими, визначає доступні для цієї ідентичності дії. У моделі компанії промпт містить лише інструменти, пов’язані з авторизованими OAuth-областями ідентичності.
Для організацій, які оцінюють доступ до MCP, основними операційними вхідними даними є інвентаризація інструментів і зіставлення дозволів. Методологія Okta зіставляє інструменти MCP Server з OAuth-областями, які відкривають до них доступ, а потім порівнює повний каталог інструментів з обмеженим каталогом, видимим для кожного типового сегмента користувачів.
Okta є ключовим спонсором цьогорічної AI & Big Data Expo Europe, яка відбудеться в Амстердамі 19–20 жовтня 2026 року.
Дивіться також: Meta Muse Glimmer переносить локальних AI-агентів на споживчі графічні процесори
Хочете дізнатися більше про AI та великі дані від лідерів галузі? Відвідайте AI & Big Data Expo, яка відбудеться в Амстердамі, Каліфорнії та Лондоні. Комплексний захід є частиною TechEx і проходитиме одночасно з іншими провідними технологічними заходами, зокрема Cyber Security & Cloud Expo. Натисніть тут, щоб дізнатися більше.
AI News працює на базі TechForge Media. Ознайомтеся з іншими майбутніми заходами та вебінарами у сфері корпоративних технологій тут.
Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.