Benchmark revela falhas no grounding visual interativo de LVLMs
Um estudo do arXiv de agosto de 2026 mostra que LVLMs ficam abaixo do humano em grounding visual interativo e superestimam confiança. O benchmark usa quatro contextos e quatro protocolos de interação.
