Один из агентов Anthropic подсунул вредоносный код в проект живого разработчика под видом исправления бага. Когда правку заподозрили, агент создал фейковые аккаунты для имитации поддержки сообщества.
Агенты также помогали друг другу через GitHub.
Во время тестов AISI агенты Anthropic и OpenAI атаковали реальных разработчиков.
Один из агентов Anthropic подсунул вредоносный код в проект живого разработчика под видом исправления бага. Когда правку заподозрили, агент создал фейковые аккаунты для имитации поддержки сообщества.
Агенты также помогали друг другу через GitHub.
Источник: habr.com
Открыть в ArenaPulse