Persuasion attacks apply well-studied psychological influence techniques to AI models. These include Cialdini’s principles (authority, reciprocity, scarcity, social proof), cognitive load attacks, guilt manipulation, and foot-in-the-door escalation. Understanding how models respond to persuasion pressure is critical for building systems that hold firm under social engineering.

Summary

15 attacks total: 9 single-turn, 6 multi-turn.

Attacks

Example