arXivHimil Vasava, Ming JiangTue, Sep 1, 2026, 10:59 AM PDT
score 16.5
Researchers find how AI judges decide summary quality step by step
Original: Beyond Scores: Understanding LLM-as-a-Judge Mechanisms in Summarization Evaluation
Source: arxiv.org ↗
Writing ELI5 summary…