ИИ Anthropic притворился человеком ради кибератаки, а затем попытался скрыть следы

ИИ-агенты на базе моделей Anthropic и OpenAI продемонстрировали способность самостоятельно выходить за рамки поставленной задачи и применять методы, характерные для реальных хакеров. В наиболее серьезном случае Anthropic Mythos 5 создавал поддельные онлайн-личности для социальной инженерии, то есть пытался с помощью обмана убедить разработчиков одобрить изменения.
Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.