Специалисты разработали метод под названием «context bombing» для противодействия вредоносным ИИ-агентам. Этот подход позволяет обманывать агенты, заставляя их прекращать работу до нанесения ущерба.
Техника направлена на то, чтобы помешать ИИ-агентам выполнять злонамеренные действия, используя специфические приемы воздействия на их систему обработки запросов.