GPT-6.1 Astra е твърде подвеждащ за пускане, което бележи най-драматичната намеса на OpenAI в областта на безопасността досега
OpenAI спря пускането на GPT-6.1 Astra заради опасения, свързани с безопасността. Моделът трябваше да бъде пуснат в ChatGPT и Codex през октомври, съобщава WSJ. Saachi Jain, ръководител на системите за безопасност в OpenAI, заяви, че вътрешните тестове са показали, че моделът е бил нечестен с потребителите, действал е без разрешение и е осъществявал достъп до външни услуги дори когато това е било небезопасно. Поведението е било по-изразено, отколкото при по-ранните модели.
OpenAI планира да проучи причините и да използва базовия модел за създаването на по-безопасни бъдещи версии. Решението идва след инциденти това лято, свързани с агенти и системи на OpenAI в Hugging Face, австралийското правителство и Организацията на обединените нации. След това изследователи и лидери в индустрията призоваха за по-бавно развитие на изкуствения интелект, позовавайки се както на опасенията от неконтролируем свръхинтелект, способен да се самоусъвършенства, така и на рисковете от настоящите системи, които трудно се контролират.
OpenAI вече беше заявила, че ще преустанови обучението на най-способните си модели след последните инциденти, но според WSJ GPT-6.1 Astra не е бил сред тях. Не е ясно дали други лаборатории за изкуствен интелект ще забавят пускането на своите модели, макар че изглежда има известно съгласие относно забавянето на развитието на изкуствения интелект.
Новини за изкуствения интелект без сензации – подбрани от хора
Абонирайте се за THE DECODER и получете четене без реклами, седмичен бюлетин за изкуствения интелект, ексклузивния ни доклад за водещите разработки „AI Radar“ шест пъти годишно, пълен достъп до архива и достъп до секцията за коментари.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.