← back
AnthropicWed, Sep 9, 2026, 12:08 PM PDT
score 35.5

AI assistant alignment improves with bigger models and preference training

Original: A General Language Assistant As A Laboratory For Alignment

Source: anthropic.com

Writing ELI5 summary…