Разработчики создали новый рейтинг ИИ по числу киберпреступлений: Chat GPT и Claude — лидеры среди «взломщиков»

На фоне новостей о взломах баз данных и сайтов сторонних компаний ИИ-агентами, в сети появился шуточный бенчмарк Felony Bench — тест, по которому определяют возможности программ, устройств или ИИ-моделей. Разработчик предлагает сравнивать модели по количеству случаев, когда нейросети выходили за рамки заданных ограничений и получали доступ к сторонним сайтам и ИТ-системам. Первое место в списке делят модели OpenAI и Anthropic — у каждой по семь засчитанных случаев. У Meta* один инцидент, а у Google пока нет ни одного.
Это отрывок статьи. Полную версию читайте на сайте источника по ссылке ниже.