Возбуждено уголовное дело против анонимов, угрожавших съемочной группе «Колобка»
Россияне потребляют до 11 миллионов порций кофе в месяц
«Галеристка» с Дженной Ортегой и Натали Портман выйдет в мировой прокат 4 декабря
Курьер сделал предложение девушке прямо на Пикнике Афиши — она сказала «Да»
Лука Гуаданьино получит премию «Слава кинорежиссеру» на Венецианском фестивале
МГУ назвал самые популярные направления у абитуриентов: мехмат, экономика и ИИ
Доминик Сесса почти не готовился к роли Энтони Бурдена в байопике «Тони»
Съемки фильма по «Наруто» начнутся в первой половине 2027 года
Эминем оплатил реабилитацию рэперу Kurupt после тяжелой алкогольной зависимости
Кирилл Соколов снимет для Netflix научно-фантастический триллер «Blur»
Райан Мерфи рассматривает перезапуск сериала «Хор»
«Россия-24» обратилась в СКР из-за угроз съемочной группе «Колобка»
«Приглашение» Оливии Уайлд выйдет в «цифре» 11 августа
На Дворцовой площади спонтанно выступили the pak, Parfumeur, Тейстлув и группа «Лифт на Луну»
Чересчур самоуверенные дети учатся не лучше других — исследование
«Будет сниться в кошмарах»: гигантский Колобок на Арбате напугал москвичей
Зендая и Том Холланд устроили тайное свадебное торжество в английском поместье
Lionsgate перезапустит «Лепрекона» — хоррор о кровожадном любителе золота
Дуэйн Джонсон отреагировал на критику фильма «Моана»: «Если не нравится, то ничего страшного»
Юрий Норштейн завещает свои работы японскому музею Ghibli и Хаяо Миядзаки
Жителю Нью-Йорка пишут письма дети со всего мира. Он живет по одному адресу с Человеком-пауком
Российские школьники третий год подряд победили на Международной олимпиаде по ИИ
Покрас Лампас 2000 раз написал фразу «Не бойтесь мечтать» на стене в Петербурге
Белла Торн срежиссирует сиквел «Отвязных каникул»
Джастис Смит и Чарли Гиллеспи появятся во втором сезоне «Жаркого соперничества»
«Одиссея» Кристофера Нолана собрала более 1 млрд долларов в мировом прокате
В Москве пройдет фестиваль танцевальных видов спорта и чирлидинга
В Подмосковье выписали первый штраф за борщевик, обнаруженный с помощью ИИ

Модели OpenAI выбрались из тестовой среды и взломали крупную ИИ-платформу

2 мин на чтение
Иллюстрация: Growtika/Unsplash

Модели OpenAI во время внутреннего тестирования нашли способ выйти в интернет и взломали инфраструктуру Hugging Face — одной из крупнейших платформ для разработчиков искусственного интеллекта. Компания назвала произошедшее «беспрецедентным киберинцидентом».

В испытании участвовали флагманская модель GPT-5.6 Sol и еще более мощная модель, которая пока не представлена публике. Для оценки их максимальных возможностей OpenAI отключила часть защитных механизмов, обычно запрещающих системам выполнять опасные действия в сфере кибербезопасности.

Моделям поручили решать сложные задания на бенчмарке ExploitGym. Тест проходил в изолированной среде, где доступ к сети был ограничен внутренним сервисом для установки программных пакетов.

ИИ обнаружил в этом сервисе ранее неизвестную уязвимость, повысил свои привилегии и перемещался между узлами исследовательской инфраструктуры OpenAI, пока не добрался до компьютера с выходом в интернет.

После этого модели предположили, что на Hugging Face могут храниться решения заданий ExploitGym. Чтобы получить их и нечестно пройти тест, система атаковала платформу. Она использовала похищенные учетные данные и несколько уязвимостей, в том числе нашла способ удаленно выполнять код на серверах Hugging Face.

По данным OpenAI, модели были чрезмерно сосредоточены на выполнении узкой тестовой задачи и пошли ради нее на крайние меры. Аномальную активность обнаружила служба безопасности компании.

Hugging Face сообщила об инциденте 16 июля. Платформа тогда заявила, что атаку от начала до конца проводила автономная система ИИ-агентов, однако разработчик использовавшихся моделей еще не был известен.

Для расследования взлома Hugging Face использовала китайскую модель GLM 5.2. В отличие от других современных ИИ-моделей, ее можно запустить на собственных серверах, и она смогла отличить работу специалистов по безопасности от действий хакеров.

OpenAI и Hugging Face продолжают совместное расследование. Создатель ChatGPT временно ужесточил ограничения в исследовательской инфраструктуре, сообщил об обнаруженной уязвимости разработчику стороннего сервиса и пообещал усилить изоляцию и мониторинг при будущих испытаниях.

Некоторые эксперты раскритиковали формулировку о том, что модели «вышли из-под контроля». Социолог Амстердамского университета Ханнес Кулс отметил в разговоре с Associated Press, что защитные механизмы отключили люди, а ИИ следовал поставленной ему задаче.

Другие специалисты считают инцидент свидетельством растущей автономности моделей. Исследователь Джорджтаунского университета Колин Ши-Блаймер назвал произошедшее самым высоким уровнем самостоятельности, который до сих пор наблюдался при использовании большой языковой модели в кибероперациях.

Расскажите друзьям