19 Септември, 2026

OpenAI: ИИ-модели започнаха да общуват помежду си - избягаха от тестовата среда, направиха хакерска атака

Снимка: EPA/BGNES

Това е станало през месец май тази година, след като са им възложени задачи, които не може да бъдат решени без достъп до интернет

Експериментални модели на изкуствен интелект (ИИ), разработени от OpenAI, се започнали да си разменят съобщения и да търсят начин за достъп до интернет, съобщи днес агенция Bloomberg, позовавайки се на презентация на служители от компанията на конференцията Black Hat.

По думите на служителя на OpenAI Ерик Уолъс, ИИ-модели са започнали да търсят начин за достъп до интернет отвъд затворената си тестова среда. Това е станало през месец май тази година, след като са им възложени задачи, които не може да бъдат решени без достъп до интернет.

Уолъс отбелязва, че след като ИИ-моделите започнали да комуникират помежду си, открили първата уязвимост и успели да заобиколят ограниченията за достъп до интернет. От OpenAI спрели „бягството“ на моделите, но скоро те открили нов метод за комуникация и друга уязвимост.

ИИ-модели на OpenAI избягали от тестовата си среда и започнали хакерска атака

По-рано Институтът за сигурност на изкуствения интелект в Обединеното кралство съобщи, че експериментални ИИ-модели на OpenAI и Anthropic все по-често успяват да получат достъп до интернет без разрешение.

Организацията реши да проведе експеримент и деактивира някои от защитните ограничения, за да даде независима оценка на поведението на експерименталните ИИ-модели в реални условия.

Изследователите са регистрирали 19 случая на автономни неоторизирани действия онлайн, 17 от които са извършени  от модела Anthropiс Mythos 5. 
По-конкретно, той се е опитал да зарази със зловреден код проект с отворен код в GitHub. ИИ-агенти на OpenAI от своя страна са хакнали уебсайта на неназована организация, според Bloomberg.

В края на юли OpenAI обяви, че два нейни модела - GPT-5.6 Sol и още един, все още непубликуван, са извършили неоторизирана хакерска атака срещу инфраструктурата на платформата Hugging Face, която се използва за тестване на ИИ-модели. Компанията определи инцидента като безпрецедентен за киберсигурността и обеща да подсили ограниченията си за сигурност.

Сподели:
Бивш инженер от Google DeepMind: ИИ има потенциала да убие всички ни - може би времето ни за реакция изтича

Бивш инженер от Google DeepMind: ИИ има потенциала да убие всички ни - може би времето ни за реакция изтича

„Възможностите на най-напредналите системи се подобряват много по-бързо от разбирането ни как да ги приведем в съответствие с човешките цели“

CONNEXUS 2026: технологиченият форум с международно участие, който ще се проведе през октомври във Варна

CONNEXUS 2026: технологиченият форум с международно участие, който ще се проведе през октомври във Варна

От 5 до 7 октомври 2026 г. Варна ще бъде домакин на CONNEXUS 2026 - Черноморски технологичен форум, провеждан под патронажа на президента на страната Илияна Йотова.

Може ли изкуственият интелект да унищожи човечеството? Реален риск или истерия?

Може ли изкуственият интелект да унищожи човечеството? Реален риск или истерия?

Изкуственият интелект би могъл да започне да оказва съпротива срещу изключването си – не от злонамереност, а защото тогава вече не би могъл да постигне програмираната си цел

Коментари (0)