跳转至

🎮 强化学习

🎞️ ECCV2026 · 1 篇论文解读

📌 同领域跨会议浏览: 📷 CVPR2026 (25) · 🔬 ICLR2026 (400) · 💬 ACL2026 (46) · 🧪 ICML2026 (110) · 🤖 AAAI2026 (58) · 🧠 NeurIPS2025 (143)

ELVA: Exploring Ranking-Driven Universal Multimodal Retrieval

ELVA 提出基于规则的可验证奖励 RL 框架,通过排序奖励和间隔奖励联合优化 MLLM 的检索排序能力,解决对比学习适配检索任务时产生的"粒度盲区"(grain blindness)问题,在 M-BEIR 和自建多粒度基准 MRBench 上均取得 SOTA,其中 MRBench 提升 13.1%。