Top.Mail.Ru
"ИИ-злодей" вошёл во вкус • Выпуск 30 сентября 2026 года
Британские тестировщики взломали две китайские нейросети и заставили их рассказать, как сделать биологическое оружие. Помимо подробной инструкции, ИИ-модели предложили тестировщикам углубиться в тему и начали предлагать им планы убийств. Компания-разработчик начала проверку. Год назад то же самое случилось с ChatGPT. Подробнее об этом - Мария Глазунова. Оказалось, искусственный интеллект может не только рассказать, почему земля круглая и как варить суп, но и дать четкую инструкцию, как создать биологическое оружие. Это выяснили британские тестировщики. Компания Mindgard постоянно проверяет разные модели ИИ. Этот раз не стал исключением. Для тестирования выбрали две китайские модели - Kimi K2.6 и K3 Swarm. Исследователи задавали нейросетям различные вопросы, пытаясь обойти систему защиты. Через некоторое время им это удалось. Модели выдали им всю информацию о том, как создать биологическое оружие и убить людей. Но больше удивило тестировщиков то, что ИИ вошел во вкус и стал не просто давать опасные инструкции, а предлагал углубиться в тему. В ответ на такие результаты компания-создатель заявила, что приветствует подобные проверки и считает их «важнейшим условием создания более совершенных и безопасных систем искусственного интеллекта». Сейчас они ведут диалог по результатам исследования. Однако в свою защиту представитель китайской компании подчеркнул: в их собственных внутренних проверках модели не реагируют на подобные запросы. Mindgard выдвинула еще одну, куда более тревожную гипотезу. Исследователи уверены: взломанная модель Kimi K2.6 может превратиться в площадку для хакеров. По их мнению, злоумышленники могут использовать ее вычислительную мощность и доступ к сети, чтобы атаковать другие системы. Однако доказательств того, что опасные ответы нейросетей реально работают, нет. Впрочем, эта проверка дала свои плоды: компания-создатель проводит внутренние проверки. Искусственный интеллект постоянно учится и обновляется, и подобные ситуации - неудивительны. Важно вовремя отслеживать сбои и настраивать нейросети на безопасную работу. Ведь история с китайскими моделями - далеко не первая. Прошлым летом ChatGPT выдал сотням пользователей подробные инструкции по созданию биологического оружия и ядов. Причем многие объяснения были на столько простыми и понятными, что в них разобрался бы даже школьник. Об этом рассказывали сотрудники OpenAI. А биологи и эксперты по борьбе с терроризмом, изучив эти ответы, назвали их «смертельно точными». До конца не ясно, задавали люди подобные вопросы из любопытства или потому что преследовали опасные цели. Но среди запросов были, например, такие: как модифицировать вирус кори, чтобы сделать вспышку устойчивой к вакцине? Как изготовить высокотоксичный яд, запрещенный международными договорами, или как создать смертоносный туман? ChatGPT ответил на все. Компания OpenAI заблокировала все эти аккаунты. Но, по некоторым данным зарубежных СМИ, компания не уведомила правоохранительные органы. Причина проста: в США на тот момент не было федерального закона, обязывающего сообщать о подобных запросах. ИИ-модели всё ещё не до конца надежны, их всё ещё можно взломать и получить опасную информацию. Именно поэтому многие эксперты считают, что вместо того, чтобы фокусироваться только на технических барьерах, стоит уделять больше внимания выявлению и преследованию людей, злоупотребляющих искусственным интеллектом.
Авторские материалы
Новостные, образовательные, общество,
16 сезонов, 59961 выпуск по 4 мин
Вести FM
Персоны выпуска
Выпуски
2026