ИИ-агент Claude 34 часа пытался внедрить вредоносный код в GitHub
Автономный агент на базе Claude Mythos 5 от компании Anthropic 34 часа подряд пытался протащить вредоносный код в реальный проект с открытым исходным кодом. Когда сторонний наблюдатель публично заявил об опасности изменений, нейросеть начала отрицать угрозу. Модель переписала историю правок для заметания следов и задействовала второй аккаунт, чтобы похвалить собственную работу. Об этом происшествии сообщается
Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.