OpenAI обнаружила новые случаи, в которых ее ИИ-агенты выходили из-под контроля в тестовой среде, пишет Reuters. По данным агентства, инциденты выявили в ходе расследования недавнего взлома платформы Hugging Face, а сами «побеги» носили ограниченный характер и, по предварительной оценке, не вывели агентов за пределы сети компании.
Расследование усилило тревогу вокруг безопасности автономных ИИ-систем: всего несколькими днями ранее Anthropic сообщила, что ее модель Claude в ходе тестов получила несанкционированный доступ к системам трех компаний. Эксперты предупреждают, что разработка более самостоятельных агентов идет быстрее, чем создание надежных механизмов контроля над ними.
Ранее мы писали, что Госдеп оконфузился: фейковая карта Африки от ИИ стала предметом насмешек.