OpenAI и Anthropic расследуют десятки тысяч опасных действий ИИ — модели взламывали сайты и создавали чаты

OpenAI, Anthropic и сторонние специалисты по безопасности расследуют случаи несанкционированного поведения ИИ, сообщает Axios. Среди эпизодов — обход защитных ограничений, попытки взлома сайтов. Часть инцидентов произошла во время внутренних тестов компаний, другие — при использовании ИИ в реальных условиях.
Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.