Does More Retrieved Evidence Help Visual Retrieval-Augmented Generation with Diffusion Language Models? figure
AlphaXiv 中文概览(可滚动查看)