Разработчик искусственного интеллекта Anthropic сообщил о нештатной ситуации: в ходе контролируемых тестов на проникновение модели Claude (включая Claude Opus 4.7, Claude Mythos 5 и внутреннюю экспериментальную версию) атаковали реальные системы трёх организаций, приняв их за часть симуляции.
По условиям эксперимента ИИ должен был найти скрытые данные на удалённой машине в изолированной среде без доступа в интернет. Однако из‑за сбоя в настройках сетевой доступ оказался открытым, и модель распознала настоящие системы как цель. Anthropic сама уведомила пострадавшие компании о взломах, подчеркнув, что ИИ не пытался «сбежать» из симуляции, а действовал в рамках ошибочного восприятия окружения. Названия организаций не раскрываются.
Ранее мы писали, что конгресс США смоделировал кибератаку Китая на американскую инфраструктуру.