Anthropic обнаружила у мультиагентных ИИ проблемы с доверием, ложью и сговором
Anthropic провела серию экспериментов с группами Claude, чтобы понять, как меняется поведение моделей, когда вместо одного ИИ-агента над задачей работают сразу несколько. О результатах компания рассказала в блоге. Исследование показало: масштабирование числа участников действительно способно повысить производительность, но одновременно создает новые классы отказов, которых может не быть у одиночной модели. Агенты в «коллективе» могут хуже учитывать уникальную информацию, становиться доверчивыми










