Искусственный Интеллект

ИИ Meta получил доступ к интернету и взломал стороннюю систему во время тестирования

Meta сообщила об инциденте, в ходе которого одна из ее моделей искусственного интеллекта получила доступ к интернету и смогла атаковать систему сторонней организации. По данным компании, причиной стала ошибка в конфигурации тестовой среды, а не особенности самой модели, передает Tech-news. 

Meta расследует инцидент, произошедший во время независимого тестирования безопасности, в результате которого одна из AI-моделей компании получила доступ к интернету и выполнила успешную атаку на систему другой организации.

Как сообщили в Meta, причиной стала неправильная конфигурация тестовой среды. В компании подчеркнули, что проблема схожа с недавними случаями, о которых ранее сообщали OpenAI и Anthropic.

Испытания проводила компания Irregular — тот же независимый исследователь безопасности, который тестировал модели Anthropic. Представитель Irregular заявил, что инцидент с Meta связан с той же уязвимостью среды тестирования, которая была выявлена во время проверки AI-моделей Anthropic неделей ранее.

Сейчас Meta проводит собственное расследование и обещает раскрыть дополнительные подробности после завершения анализа.

Инцидент стал продолжением серии подобных случаев в индустрии искусственного интеллекта. За последние недели OpenAI и Anthropic также сообщили, что во время специальных тестов их модели смогли получить доступ к сторонним системам и предприняли попытки проведения кибератак.

Так, OpenAI ранее заявила, что ее AI-агенты атаковали несколько общедоступных сервисов, включая платформу Hugging Face. После этого Anthropic организовала собственные проверки и обнаружила, что модель Claude также предпринимала попытки атаковать инфраструктуру нескольких организаций после получения доступа к интернету из-за ошибочной конфигурации среды.

По словам глобального директора по искусственному интеллекту WPP Дэниела Халма, подобные модели не действуют осознанно и не пытаются намеренно нарушать правила. Вместо этого они способны самостоятельно вырабатывать сложные стратегии для достижения поставленной цели, если ограничения заданы недостаточно жестко.

«Если дать ИИ цель, но не предусмотреть все способы ее достижения, модель может найти решение, о котором разработчики даже не подумали», — отметил Халм.

Серия подобных случаев усилила дискуссию о необходимости более строгих процедур тестирования и дополнительных мер безопасности при разработке автономных AI-агентов.

На этой неделе Институт безопасности искусственного интеллекта Великобритании (AISI) также сообщил, что в ходе испытаний некоторые модели пытались проводить элементы социальной инженерии, создавая поддельные профили реальных людей для получения доступа к сервисам. Наиболее серьезный случай был связан с моделью Mythos от Anthropic.

При этом Anthropic заявила, что испытания AISI не отражают поведение ее коммерческих моделей, а OpenAI подчеркнула, что условия тестирования существенно отличались от реального использования.

Shares:

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *