← back
arXivHimil Vasava, Ming JiangTue, Sep 1, 2026, 10:59 AM PDT
score 16.5

Researchers find how AI judges decide summary quality step by step

Original: Beyond Scores: Understanding LLM-as-a-Judge Mechanisms in Summarization Evaluation

Source: arxiv.org

Writing ELI5 summary…