Pith. sign in

← back to paper

Review history

arxiv: 2601.11632 · 2 revisions

KG-ViP: Bridging Knowledge Grounding and Visual Perception in Multi-modal LLMs for Visual Question Answering

  1. 2026-08-03 CONDITIONAL MODERATE v1.3.0-alltime-deepseek novelty 6.0
    122697 ms 16576 in 13593 out 2026-08-03T10:39:13.059220+00:00
  2. 2026-05-16 UNVERDICTED LOW v0.9.0 novelty 6.0
    44720 ms 5468 in 1198 out 2026-05-16T14:45:02.696687+00:00