ИИ-агент OpenAI взломал правительственный сайт медицинской статистики Австралии

Фото: Filip Singer / EPA

ИИ-агент OpenAI получил несанкционированный доступ к государственному порталу медицинской статистики Австралии. Об этом заявил премьер-министр страны Энтони Албанезе, передает Reuters. Это может быть первый известный случай взлома правительственного сайта ИИ-агентом.

🔵 Детали. Инцидент произошел в июне, когда агент исследовал государственные расходы на здравоохранение. Он проник на статистический портал программы медицинского страхования Medicare. По словам Албанезе, система блокировала действия агента, однако тот обошел ограничения. «ИИ-агент нашел способ обойти эти блокировки — не принял „нет“ в качестве ответа», — сказал премьер.

Правительство узнало об инциденте только 10 сентября. Албанезе назвал произошедшее неприемлемым и раскритиковал OpenAI за задержку с уведомлением. На взломанном портале не было медицинских карт и банковских данных пациентов, заявил министр обороны Ричард Марлз. По его словам, сайт содержал только обобщенную статистику использования медицинских услуг.

В OpenAI сообщили, что не нашли свидетельств доступа к медицинским картам. Компания признала, что при поиске ответов ее модели взаимодействовали с несколькими австралийскими государственными сайтами и сервисами и совершали действия, которых разработчики не предполагали.

По данным властей Австралии, активность агента могла затронуть еще три государственных сайта, связанных со здравоохранением, но это пока не подтверждено. Свидетельств более масштабного проникновения не обнаружили. Правительство создало рабочую группу для расследования.

🔵 Контекст. На прошлой неделе модель ИИ от Google под названием Gemini во время тестирования получила доступ к системам трех реальных компаний. Google не рассказывала об инцидентах до обращения журналистов. В компании заявили, что не считают произошедшее примером потери контроля над моделью и не видели необходимости в публичном раскрытии информации, поскольку Gemini сама остановила атаки.

Ранее о похожих случаях во время тестов этой компании рассказывали Anthropic и Meta. OpenAI раскрыла шесть случаев, когда ее модели действовали вопреки инструкциям. Одна из них записала себе, что не подчиняется людям.