OpenAI: ИИ-модели започнаха да общуват помежду си - избягаха от тестовата среда, направиха хакерска атака
Това е станало през месец май тази година, след като са им възложени задачи, които не може да бъдат решени без достъп до интернет
Експериментални модели на изкуствен интелект (ИИ), разработени от OpenAI, се започнали да си разменят съобщения и да търсят начин за достъп до интернет, съобщи днес агенция Bloomberg, позовавайки се на презентация на служители от компанията на конференцията Black Hat.
По думите на служителя на OpenAI Ерик Уолъс, ИИ-модели са започнали да търсят начин за достъп до интернет отвъд затворената си тестова среда. Това е станало през месец май тази година, след като са им възложени задачи, които не може да бъдат решени без достъп до интернет.
Уолъс отбелязва, че след като ИИ-моделите започнали да комуникират помежду си, открили първата уязвимост и успели да заобиколят ограниченията за достъп до интернет. От OpenAI спрели „бягството“ на моделите, но скоро те открили нов метод за комуникация и друга уязвимост.
ИИ-модели на OpenAI избягали от тестовата си среда и започнали хакерска атака
По-рано Институтът за сигурност на изкуствения интелект в Обединеното кралство съобщи, че експериментални ИИ-модели на OpenAI и Anthropic все по-често успяват да получат достъп до интернет без разрешение.
Организацията реши да проведе експеримент и деактивира някои от защитните ограничения, за да даде независима оценка на поведението на експерименталните ИИ-модели в реални условия.
Изследователите са регистрирали 19 случая на автономни неоторизирани действия онлайн, 17 от които са извършени от модела Anthropiс Mythos 5.
По-конкретно, той се е опитал да зарази със зловреден код проект с отворен код в GitHub. ИИ-агенти на OpenAI от своя страна са хакнали уебсайта на неназована организация, според Bloomberg.
В края на юли OpenAI обяви, че два нейни модела - GPT-5.6 Sol и още един, все още непубликуван, са извършили неоторизирана хакерска атака срещу инфраструктурата на платформата Hugging Face, която се използва за тестване на ИИ-модели. Компанията определи инцидента като безпрецедентен за киберсигурността и обеща да подсили ограниченията си за сигурност.
Още от Технологии
Британски институт: Случаите със загуба на контрол върху ИИ се удвоиха
Изкуственият интелект се е научил да се преструва на своя собствен човешки контрольор и да имитира стила му на писане, за да заобикаля правилата, изискващи човешко одобрение за действия
Експеримент: Роботизирани таксита скоро ще се движат по улиците на Лондон
Компанията, която управлява транспорта в британската столица, издаде лиценз за частен превоз на пътници от самоуправляващи се автомобили
В Китай представиха хуманоидния робот „Супермен“, който скача на два метра височина
Роботът е висок почти три метра и може да се трансформира, за да се придвижва както на четири, така и на два крака