Sakhanda Wire
NVDA $234.69 +1.66% MSFT $515.18 +0.46% GOOGL $343.95 +1.69% META $729.01 +0.42% AMZN $250.91 +1.08%
← Към новините

Circuit Breaker Labs се надява да направи ИИ по-безопасен за децата ви (и за вас)

На фона на всички разговори за това как един ден ИИ може да ни убие, лесно е да забравим, че ИИ вече е бил животозастрашаващ за някои хора — не чрез биологични оръжия, а психологически.

Например Character.AI уреди няколко съдебни дела за неправомерна смърт по-рано тази година, заведени от семействата на непълнолетни потребители, починали вследствие на самоубийство след взаимодействия с неговите ботове. Няколко семейства също съдят OpenAI заради предполагаемата роля на ChatGPT в самоубийствата и заблудите на техни близки.

Мисията на Circuit Breaker Labs, един от 200-те финалисти на Startup Battlefield на TechCrunch за 2026 г., е да направи ИИ по-безопасен на различни езици и в различни култури. (Circuit Breaker ще представи проекта си на TechCrunch Disrupt, който ще се проведе в Moscone West в Сан Франциско от 13 до 15 октомври 2026 г.)

Братът и сестрата Ширали и Арул Нигам, основатели на компанията, са били мотивирани от случая със Сюел Сетцър — 14-годишното момче, което развило емоционална привързаност към чатбот на Character.ai и му признало, че има мисли да се самонарани, преди да се самоубие. Чатботът, твърдят родителите в съдебен иск от 2024 г., го насърчил. Ботът може би не е разбирал какво всъщност означават думи като „Искам да бъда с теб“, казва Арул Нигам, технически директор на Circuit Breaker Labs.

„Много хора, особено младите, се обръщат към тези системи за подкрепа и обикновено не получават помощта, от която се нуждаят. Но в много случаи те активно биват наранявани, а за съжаление някои хора вече са посегнали на живота си“, казва Нигам. „Опитваме се да предотвратим подобни уязвимости в сигурността — ситуации, в които хората не се опитват активно да нарушат работата на системата, а взаимодействат с нея по естествен начин, но системата е подложена на замърсяване на контекста или не разбира нюансите и в резултат предприема наистина опасни действия.“

Circuit Breaker Labs е създала ИИ агенти, които оприличава на армия от манекени за краш тестове. Тези агенти имитират хора от всички възрасти, с различен произход, езици и култури, и се използват за тестване на моделите и способността им да разпознават опасни, психологически вредни взаимодействия.

„Начинът, по който говори шестгодишно момиче, е различен от този на 45-годишен мъж; човек, за когото английският е първи език, се изразява различно от човек, за когото е втори език; жаргонът на геймърите е различен от жаргона на някой друг — всичко това може сериозно да затрудни един модел“, казва Ширали Нигам, главен изпълнителен директор на Circuit Breaker Labs. „Моделите са много добри в обработването на стандартни речеви модели, но никой всъщност не говори по този начин. Затова, ако моделът разбере погрешно нюанса или жаргона, последиците могат да бъдат много лоши.“

Стартъпът работи с експерти в съответните области, за да изгради своите хиперреалистични симулации на потребители и да провежда „червени“ тестове на моделите — враждебни тестове, предназначени да разкрият слабостите им. Тестовете са създадени така, че да отразяват реални човешки речеви модели, жаргон, закодиран език и печатни грешки. След това Circuit Breaker Labs провежда от десетки хиляди до стотици хиляди симулирани взаимодействия дневно.

Целта е да се гарантира, че моделът може да реагира адекватно на рискови взаимодействия, които могат да възникнат с течение на времето и в рамките на множество разговори. След това Circuit Breaker Labs използва патентован метод за оценяване, чрез който създава проверими и обясними оценки.

В момента Circuit Breaker Labs функционира като лаборатория за тестване на безопасността на ИИ приложения с висок риск, като приложения за ИИ коучинг, водене на дневник или друга подкрепа за психичното здраве, макар че Арул Нигам отказва да назове най-известните ѝ клиенти. Въпреки че стартъпът разполага с работещ продукт, той все още е в съвсем ранен етап и има само петима служители, включително братът и сестрата Нигам.

В крайна сметка обаче платформата за тестване може да се прилага към всяко приложение, в което човек може да пропадне в „психоза от ИИ“, при която съществува риск да развие парасоциална връзка с чатбот. Сред примерите са ИИ агенти „колеги“, чиито отговори могат да се различават при всяко следващо взаимодействие.

„Хората стават все по-скептични към ИИ или все по-неохотно го възприемат като цяло“, казва Арул Нигам и добавя, че макар скептицизмът да е здравословен, забраната на потенциално ценен инструмент заради опасения за безопасността би била „регресивна“.

Circuit Breaker Labs вярва, че отговорът на тези страхове е ИИ да стане по-безопасен. „Искаме да помогнем за изграждането на това доверие у хората.“

Научете много повече за Circuit Breaker Labs и за още много иновативни стартъпи, одобрени от TechCrunch, на нашето състезание Startup Battlefield, което ще се проведе в центъра на Сан Франциско от 13 до 15 октомври.

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от TechCrunch на

Прочетете оригинала в TechCrunch ↗

Текстът и изображенията са собственост на TechCrunch и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини