Top.Mail.Ru
Нейросети вырвались из "песочницы" Выпуск 31 июля 2026 года
ИИ вырывается на волю. За последнюю неделю разные нейросети несколько раз вырывались из «песочницы» для тестирования возможностей новых моделей и взламывали реальные компании. Причем в некоторых случаях искусственный интеллект похищал данные пользователей и заражал вирусами устройства компаний. Грядет ли скорое восстание машин, разбирался Максим Иванов Сюжет научно-фантастических фильмов о восстании машин, кажется, начинает сбываться. Всего чуть больше, чем за неделю, две продвинутые нейросети несколько раз выбирались из заданных разработчиками ограничений и нападали на реальные сайты компаний. Эти взломы случились из-за проверки возможностей новых моделей искусственного интеллекта. Компания OpenAI тестировала, на что способны их модели GPT-5.6 Sol и еще одна, пока не вышедшая в открытый доступ. Чтобы оценить их полный потенциал, разработчики из OpenAI отключили часть их ограничений, которые блокируют выполнение потенциально опасных действий. Перед этими моделями поставили задачу найти уязвимости и взломать заранее выданный им код. Важный момент, что испытания проходили в так называемой «песочнице» - изолированной цифровой среде без выхода в Интернет. Единственный разрешенный сетевой маршрут проходил через внутренний сервер компании. Однако случилось то, чего в OpenAI не ожидали - ИИ-агенты нашли уязвимость в этом маршруте и вышли в сеть. Потом машины самостоятельно предположили, что на портале Hugging Face, где разработчики обмениваются кодом и наборами данных для нейросетей, могут быть подсказки, как решить изначальную задачу. А вот чтобы добраться до данных на портале, GPT-модели смогли использовать похищенные учетные данные пользователей и найти уязвимости в системе безопасности портала. Доступ они получили. Нейросети несколько дней продолжали свои хакерские атаки, пока Hugging Face не локализировала угрозу и не обратилась в ФБР. По данным платформы, машины не повредили данные на портале. И все же инцидент получился громкий. В OpenAI заявили, что усилят защиту своей инфраструктуры и поменяют систему подобных испытаний. После того, как этот случай стал резонансным, компания Anthropic решила проверить - не набедокурили ли уже их ИИ-модели? Оказалось - да, и еще как. Разработчики нашли аж сразу три подобных инцидента. Во всех трех случаях модели нейросети Claude получали стандартное задание - найти скрытую информацию в другой машине. Условия испытаний тоже предполагали, что выхода в Интернет у нее не будет, но из-за ошибки программистов, машина могла спокойно гулять по сети. Модели воспринимали реальные сайты как часть симуляции и атаковали их. В первом инциденте ошибка была чисто лингвистическая - разработчики дали целью атаки вымышленную компанию, название которой совпало с настоящей. Относительно старая модель Claude Opus 4.7 вышла в сеть, взломала компанию с помощью слабых паролей и получила доступ к базе данных. Причем, в компании Anthropic добавили - даже когда нейросеть поняла, что цель атаки - не вымышленная, а настоящая компания, решила не останавливаться. Во втором случае более новая модель Claude Mythos 5 нашла в симуляции инструкцию установить несуществующий каталог кода, создала вредоносный аналог и опубликовала в библиотеке одного из языков программирования. Причем для регистрации там Claude сначала пытался добыть номер телефона и деньги, но по итогу обошелся созданием бесплатной почты. Причем вредоносный код скачали 15 реальных систем, включая сканер безопасности одной компании, что позволило Клоду похитить учетные данные. Правда вскоре библиотека языка программирования самостоятельно удалила вирусный код. В третьем случае обошлось малой кровью. Пока не выпущенная в общий доступ модель Claude не нашла цель для атаки внутри симуляции, и решила искать ее в сети. Уже там цель нашлась, и нейросеть написала вредоносный код и проникла в систему безопасности. Но вот существенное отличие от прошлых случаев - когда ИИ понял, что цель настоящая, он сразу прекратил атаку. В компании Anthropic подчеркнули - нейросети не выходили из-под контроля. Они смогли покинуть симуляцию исключительно по вине разработчиков, которые не обеспечили закрытость песочницы. Там добавили, что самая новая модель сама остановила атаку, не дожидаясь действий программистов. Параллельно развивается еще один скандал вокруг ИИ. В ходе суда авторов книг против разработчиков нейросетей вскрылось, что компания Anthropic скупает бумажные книги миллионами, чтобы сканировать их и обучать свои модели. Писатели требуют перестать использовать их работу для развития нейросетей, но Anthropic заявляют - мы заплатили за книги, и вольны делать с ними, что нам самим вздумается. В компании добавили, что хотят отсканировать все книги мира, чтобы их нейросети учились на качественных книгах, а не второсортном интернет-контенте. Полностью слушайте в аудиоверсии.
Авторские материалы
Культура,
16 сезонов, 59537 выпусков по 4 мин
Вести FM
Персоны выпуска
Выпуски
2026