AnthropicFri, Sep 11, 2026, 5:13 AM PDT
score 37.6
3HN
Anthropic finds long prompts can jailbreak AI safety
Original: Many Shot Jailbreaking
Source: anthropic.com ↗
Writing ELI5 summary…
Original: Many Shot Jailbreaking
Source: anthropic.com ↗
Writing ELI5 summary…