Компания-разработчик чат-бота Claude Anthropic обнаружила три инцидента, в которых ее ИИ-модель выходила в интернет из тестовой среды партнера Irregular и получала несанкционированный доступ к системам трех организаций.
Как передает Oxu.Az, об этом говорится в заявлении организации.
В Anthropic уточнили, что начали проверку начали после того, как OpenAI сообщила о похожем случае.
Отмечается, что "несанкционированный доступ к реальным системам трех разных организаций" совершили три модели Anthropic: Opus 4.7, Mythos 5 и некая внутренняя исследовательская модель. При этом, как уточнили в компании, ИИ-модели находились в изолированной среде компании Irregular.
Во всех трех случаях Claude выполняла стандартное задание "захват флага", в ходе которого по сценарию ИИ было необходимо найти скрытую информацию на другой машине. Согласно условиям, выход в интернет-пространство был заблокирован, но из-за ошибки конфигурации модель Claude выходила в интернет, получала доступ к реальным системам трех разных организаций и атаковала их, пишет Anthropic.