🔍 信息检索/RAG¶
🎞️ ECCV2026 · 2 篇论文解读
📌 同领域跨会议浏览: 🔬 ICLR2026 (81) · 💬 ACL2026 (73) · 🧪 ICML2026 (26) · 🤖 AAAI2026 (21) · 🧠 NeurIPS2025 (25) · 📹 ICCV2025 (5)
- HyFL-CLIP: Hyperbolic Fine-Tuning of CLIP for Robust Long-Context Understanding
-
HyFL-CLIP 将预训练 CLIP 的欧氏图文对齐蒸馏到双曲空间(Lorentz 模型),通过爱因斯坦中点聚合建模"全局描述--局部成分"的层次蕴涵关系,使模型在长文本被扰动(重排、删除、丢词)时仍能稳定检索正确图像,在扰动词下比最强基线提升最高 19.5%。
- LightSTAR: Efficient Visual Document Retrieval via Lightweight Selection with Vision-Adaptive Refinement
-
LightSTAR 针对视觉文档检索中 MLLM 全量编码页面太慢的问题,先用 LLM-free 轻量视觉选择模块高召回筛出候选,再只对候选做视觉自适应语义精排,在 ViDoRe 上达到 89.1 NDCG@5,同时把 5000 页端到端延迟降到 123.9s。