← back
arXivSiyu Wang, Yifan Wang, Yuecheng HeFri, Oct 2, 2026, 3:01 AM PDT
score 14.9

New Benchmark Checks If AI Trading Code Matches the Strategy Asked For

Original: MintEval: Do LLMs Implement the Trading Strategy You Asked For? A Behavioural-Equivalence Benchmark for Natural-Language-to-Strategy Code

Source: arxiv.org ↗

Writing ELI5 summary…