Sakhanda Wire
NVDA MSFT GOOGL META AMZN
← Към новините

Okta цели разходите за токени на AI агентите чрез обхват на MCP

Okta заявява, че списъците с инструменти на Model Context Protocol (MCP), обвързани с идентичността, могат да намалят разходите за токени на AI агентите.

Всяко извикване на модел, извършено от AI агент, може да включва схеми, имена, описания и параметри за всеки инструмент, изложен от MCP сървър. Okta нарича произтичащите от това допълнителни разходи в промпта „данък върху инструментите“: токени, изразходвани, докато моделът разглежда инструментите, включително тези, които никога няма да извика.

Компанията твърди, че този разход възниква преди агентът да направи опит за извикване на инструмент. Следователно последващото отхвърляне на неоторизирана заявка не може да възстанови вече изразходваните токени за промпта. Предложеният от Okta контрол филтрира списъка с инструменти, преди той да достигне до модела, като използва разрешенията, зададени на идентичността на агента и на свързания с него потребител.

Вътрешното моделиране на Okta установи, че при някои сценарии с разрешения броят на видимите инструменти е намалял с повече от 90%. Компанията заяви, че разходите за схемите на инструментите са спаднали приблизително в същата пропорция, макар да не предостави абсолютни стойности за токени или долари.

Схемите на MCP инструментите създават допълнителни разходи в промпта при всеки ход

MCP сървърите се превърнаха в начин за свързване на AI агенти с инструменти и данни. Okta посочва връзките с Google Workspace, Slack и вътрешни MCP сървъри като примери. MCP сървърът може да предоставя голям брой инструменти, а моделът получава представяне на всеки наличен инструмент в своя промпт при всеки ход.

Това представяне включва схема. То включва също името, описанието и параметрите на инструмента.

Okta заявява, че разходът се натрупва, когато широко използван MCP сървър предоставя много инструменти. Всеки активен потребител генерира допълнителни разходи за промпта всеки път, когато неговият агент извършва извикване на модела. Компанията представя това едновременно като проблем с броя на инструментите и с броя на потребителите.

Проблемът има и измерение, свързано с контрола на достъпа. Агент, който вижда инструменти извън обхвата на своето оторизиране, може да се опита да ги използва. Контрол, който отхвърля извикването по време на изпълнение, може да блокира изпълнението, но моделът вече е получил дефиницията на инструмента и е използвал токени за обработката ѝ.

Okta филтрира инструментите, преди да бъде изграден промптът на агента

Okta позиционира тази възможност в рамките на своята „концепция за сигурно агентно предприятие“, която призовава организациите да идентифицират своите агенти, разрешените им връзки и оторизираните им действия.

Подходът на компанията стеснява въпроса за връзките — от достъп до цял MCP сървър до достъп до отделни инструменти на този сървър. Администратор конфигурира инструментите, които дадена идентичност може да използва, в таблото за управление на Okta. След това Okta връща ограничения набор от инструменти вместо пълния каталог на сървъра.

Агентът получава този по-кратък списък в своя промпт при всеки ход. Okta заявява, че проверява обхвата отново по време на изпълнение, преди да бъде изпълнено извикване на инструмент.

Този дизайн прилага достъп с минимални привилегии на ниво инструмент. Компанията заявява, че агентът не би трябвало да има информация за ресурси, бази данни или инструменти, които не са му изрично разрешени. Премахването на недостъпните инструменти от промпта премахва и разходите за техните схеми от извикването на модела.

Okta не описва реално внедряване при клиент в публикацията. Доказателствата за заявеното намаление идват от вътрешно моделиране, използващо продуктови данни на Okta и публична документация на доставчици, без да са използвани клиентски данни.

Вътрешният модел използва OAuth обхвати и представителни роли

Okta моделира един MCP клиент с достъп до каталог от корпоративни инструменти. Компанията сравнява броя на инструментите, видими за модела, преди и след прилагането на обхват, базиран на идентичността.

За да оцени ограничения достъп, компанията съпоставя инструментите на Okta MCP Server с OAuth обхватите, които отключват достъпа до тях. След това определя представителни потребителски сегменти. Те включват потребители на бюрото за помощ с достъп само за четене и оператори на бюрото за помощ.

Други сегменти са администратори на приложения, администратори на брандове и имейли и супер администратори. Okta претегля всеки сегмент според предполагаемия му дял от месечния трафик.

Компанията изчислява намалението на броя инструменти като единица минус съотношението между инструментите с ограничения достъп и инструментите без ограничения. Тя заявява, че при някои сценарии са премахнати повече от 90% от видимите инструменти. В публикацията се посочва, че разходите за токени за схемите на инструментите следват почти линейно броя на инструментите, тъй като всеки инструмент добавя името, описанието и схемата на параметрите си към всеки промпт.

Okta заявява, че действителните резултати варират според каталога от инструменти, разпределението на разрешенията и избрания модел. Средният размер на схемата, обемът на заявките и цените на модела също влияят върху абсолютните разходи за токени и долари.

Okta противопоставя правата на идентичностите на контролите за разходите в шлюзовете

Публикацията разграничава обхвата, базиран на идентичността, от контролите на шлюза. Okta заявява, че шлюзовете могат да ограничават разходите по ключ, екип или група, както и да поддържат маршрутизация и ограничаване на честотата.

Шлюзът може да измерва токените, които влизат и излизат от системата, както и изразходваните средства. Okta заявява, че тези контроли могат да ограничат разходите, след като дадено решение на модела вече е станало скъпо.

Правата на идентичностите осигуряват различен тип входни данни. Okta заявява, че правата на ниво потребител и агент могат да определят инструментите, достъпни за конкретен агент или за човека зад този агент, вместо да прилагат информацията за достъпа на ниво група.

Пол Уебър, главен индустриален анализатор по киберсигурност в Software Analyst Cyber Research, заяви: „Контролът на разходите за агентите се осигурява най-добре чрез инструменти за управление на идентичностите, които предлагат по-прецизен и детайлен контрол, без да нарушават бизнес процесите.

„Подходът на Okta е елегантен начин за постигане на това, защото използва същите данни за правата, които управляват сигурността, а не отделен слой за измерване без такава информация.“

В представянето на Okta шлюзът е контрол за това, което преминава през него. Слоят на идентичността филтрира наличния набор от инструменти, преди тези инструменти да трябва да бъдат измервани.

Видимостта на инструментите влияе и върху излагането на MCP атаки

Публикацията свързва същия механизъм с излагането на рискове за сигурността. Okta заявява, че премахването на инструментите от полезрението на неоторизирана идентичност премахва и действията, които тази идентичност би могла да предприеме, ако бъде компрометирана.

Предложената проверка на обхвата се извършва на две места. Първата се осъществява при съставянето на списъка с инструменти за промпта на агента. Втората се извършва, когато агентът се опита да изпълни извикване на инструмент.

Okta описва резултата като по-малък радиус на поражение при компрометирана идентичност. Останалите изложени инструменти определят набора от действия, достъпни за тази идентичност. В модела на компанията промптът съдържа само инструменти, свързани с оторизираните OAuth обхвати на идентичността.

За организациите, които оценяват достъпа до MCP, инвентаризацията на инструментите и съпоставянето на правата са основните оперативни входни данни. Методологията на Okta съпоставя инструментите на MCP Server с OAuth обхватите, които отключват достъпа до тях, след което сравнява пълния каталог от инструменти с ограничения каталог, видим за всеки представителен потребителски сегмент.

Okta е ключов спонсор на тазгодишното AI & Big Data Expo Europe, което ще се проведе в Амстердам на 19–20 октомври 2026 г.

Вижте също: Meta Muse Glimmer пренася локалните AI агенти на потребителски графични процесори

Искате да научите повече за AI и големите данни от лидери в индустрията? Посетете AI & Big Data Expo, което ще се проведе в Амстердам, Калифорния и Лондон. Цялостното събитие е част от TechEx и се провежда едновременно с други водещи технологични събития, включително Cyber Security & Cloud Expo. Щракнете тук за повече информация.

AI News се поддържа от TechForge Media. Разгледайте други предстоящи събития и уебинари за корпоративни технологии тук.

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от AI News на

Прочетете оригинала в AI News ↗

Текстът и изображенията са собственост на AI News и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини