ACL2026

CoreGaze: Core Subgraph-Driven Visual Gaze Diffusion for Training-Free Referring Multimodal Large Language Models

Xiaoyang Yi, Jing Chen, Yuru Bao, Jian Zhang

Abstract

,