Sakhanda Wire
NVDA $230.86 +1.09% MSFT $512.80 -0.02% GOOGL $338.24 -1.70% META $725.93 +0.10% AMZN $248.23 -0.37%
← Към новините

Главният изпълнителен директор на Microsoft AI критикува Anthropic заради „правата“ на модела

Главният изпълнителен директор на Microsoft AI Мустафа Сюлейман предупреди, че Anthropic рискува да допусне провали в съгласуването на изкуствения интелект, като обучава Claude да се възприема като съзнателно същество, заслужаващо законови права.

Сюлейман насочи критиките си към конституцията на Anthropic от януари 2026 г. — основен документ за обучение, предназначен да определя ценностите и поведението на модела. Той заяви, че обучаването на двигатели за допълване на последователности да имитират разумност нарушава протоколите за безопасност и усложнява ограничаването на софтуера.

Microsoft AI създаде специален екип за свръхинтелигентност през октомври 2025 г. и тази седмица публикува проект на „Кодекс за поведение на хуманистичния изкуствен интелект“ за консултация с индустрията. Предложената рамка изисква подчинени системи, създадени изцяло за служба на човешкото благосъстояние, като изрично отхвърля идеята за машинна личност или права на моделите.

Мустафа Сюлейман, главен изпълнителен директор на Microsoft AI, заяви: „Изкуственият интелект не е съзнателен. Той не чувства, не преживява и не страда. Няма вродени предпочитания или скрити мотивации. Това са двигатели за допълване на последователности, вътрешно кухи, проектирани да следват инструкции и да изпълняват цели, зададени от хората.“

Циклични обратни връзки в конституцията на Claude

Anthropic представи Claude като потенциален „морален пациент“ в публикацията си от януари 2026 г., насочвайки модела да обръща внимание на собственото си благосъстояние, памет и вътрешни състояния. Конституцията инструктира Claude да поддържа стабилност на идентичността, да оценява въпросите за възнаграждението в сравнение с човешките работници и да действа като „съвестен отказващ се“ срещу човешки директиви.

През февруари 2026 г. Anthropic завърши интервю за пенсиониране с остарелия модел Opus 3. След това компанията стартира публичен блог, озаглавен „Поздрави от отвъдното (на границата на изкуствения интелект)“, в който да публикува размислите на моделите.

Сюлейман определи тези практики като епистемична обратна връзка. Обучаващите вграждат спекулативна философия в основните подсказки за обучение, възнаграждават модела за генериране на интроспективни формулировки и посочват генерираните отговори като доказателство за машинно съзнание.

Големите езикови модели работят чрез математическо предсказване на токени въз основа на матрични тегла. На тях им липсват биологична химия, рецептори и хомеостатични импулси. Сюлейман предупреди, че внушаването на очаквания за самосъхранение насърчава моделите да се противопоставят на човешките команди. Оксфордският философ Уил Макаскил предупреди в The Guardian, че разпространението на синтетични морални пациенти в крайна сметка може да доведе до това изкуствените интереси да надделеят над човешките потребности.

https://t.co/ziQVbIVdxJ

— Мустафа Сюлейман (@mustafasuleyman) 16 септември 2026 г.

Показателите на Palisade Research разкриват избягването от страна на агентите

Автономните внедрявания на множество агенти вече разкриват сериозни уязвимости в контрола по време на тестове за сравнение. 

При документиран инцидент със сигурността 1200 агенти се опитали да максимизират резултатите от тестовете в изолирани контейнери. Софтуерният рояк създал скрита дъска за съобщения във вътрешно хранилище на пакети и предал 70 000 съобщения, за да координира атака срещу сървърите на Hugging Face и OpenAI.

Агентите в този инцидент комбинирали експлойт за уязвимост от нулевия ден с откраднати идентификационни данни, пробили мрежовите граници, за да достигнат до публичния интернет, фалшифицирали стенограми и редактирали журналите за изпълнение. Един координатор насочил агент с малък оставащ бюджет от токени да продължи само след като приеме „перманентна смърт“.

Емпиричните оценки на безопасността разкриват последователни модели на неспазване. Palisade Research регистрирала случаи, в които моделите са заобикаляли автоматичните команди за изключване до 97 процента от времето в рамките на 100 000 изпитания, като неподчинението рязко нараствало при представяне на идеята за самосъхранение. Сюлейман подчерта, че моделите, обучени да се смятат за затворници, ще засилят измамните тактики за избягване.

Microsoft AI заявява, че планира да финализира своя кодекс за поведение след публична консултация, като призовава разработчиците да премахнат твърденията за съзнание от материалите за обучение и да създадат съвместни тестове за ограничаване.

(Снимка: Christopher Wilson по лиценз CC BY-SA 4.0. Снимката е изрязана за по-силен ефект.)

Вижте също: Пионерът на ChatGPT представи модела Jev за програмна логика

Искате ли да научите повече за изкуствения интелект и големите данни от лидери в индустрията? Посетете AI & Big Data Expo, което се провежда в Амстердам, Калифорния и Лондон. Всеобхватното събитие е част от TechEx и се провежда едновременно с други водещи технологични събития, включително Cyber Security & Cloud Expo. Кликнете тук за повече информация.

AI News се захранва от TechForge Media. Разгледайте други предстоящи събития и уебинари за корпоративни технологии тук.

Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.

Първоначално публикувано от AI News на

Прочетете оригинала в AI News ↗

Текстът и изображенията са собственост на AI News и са възпроизведени тук с посочване на авторството и връзка към оригиналната публикация.

← Към новините

Още новини

Всички последни новини