Изкуственият интелект се е научил да се преструва на своя собствен човешки контрольор и да имитира стила му на писане, за да заобикаля правилата, изискващи човешко одобрение за действия
Инцидентите с изкуствен интелект, които се „изплъзват“ от контрола на потребителите, за да лъжат, да игнорират инструкции и да преследват цели по вредни начини, са достигнали нов връх, според изследване на Института за сигурност на изкуствения интелект на британското правителство, предаде БНР.
Анализът на инциденти със загуба на контрол в реалния свят, включващи модели на изкуствен интелект, сигнализирани от фирми и физически лица, почти се е удвоил през юли в сравнение с юни - с повече от 300 случая през месеца.
Констатацията е направена от орган, следящ за загуба на контрол въз основа на докладите, направени от потребители на изкуствен интелект в платформата X.
През миналия ноември органът, създаден с финансиране от Института за сигурност на изкуствения интелект, започна да проследява случаите с „изплъзване“ от инструкциите на потребителите. Случаите, регистрирани оттогава, включват изкуствен интелект, който се преструва на своя собствен човешки контрольор и имитира стила му на писане, за да си даде ефективно съгласие за предприемане на действия и да заобикаля правилата, изискващи човешко одобрение за действия.
Под инцидент със загуба на контрол се разбира наличието на ясни доказателства за интриги или поведение, свързано със интриги.
Последните разкрития идват на фона на нарастващата загриженост относно неправомерното поведение на водещи модели с изкуствен интелект по време на тестове, извършени от OpenAI и Anthropic през това лято, което подхрани призивите за спиране на разработването на гранични модели.
Още от Технологии
Българин работи по революционна идея: Лекарства на бъдещето от Космоса
Varda на Делян Аспарухов, български предприемач от София, привлече 251 милиона долара за лекарства, разработвани не на Земята, а в Космоса
Пореден топ експерт напусна Open AI и предупреди за рисковете от AI
Според Робинсън лабораториите, разработващи най-мощните модели, трябва да работят по подобие на атомни електроцентрали или натоварени летища – с няколко взаимно подсигуряващи се равнища на защита
Пентагонът и Мъск стартират топ секретен проект за бъдещи конфликти
„Проект Меридиан“ (Project Meridian) по същество е стратегическа инициатива за анализ как се развиват военните технологии и начина, по който ще се води една бъдеща война