← back
arXivJiapeng Li, Yong Li, Junjie Zhou, Fan Zhang, Yu LiuTue, Aug 4, 2026, 8:36 AM PDT
score 17.0

New benchmark and model help AI compare urban images and text

Original: Geo-Embed: Towards Unified Multimodal Embeddings for Urban Understanding

Source: arxiv.org

Writing ELI5 summary…