Pith. sign in

Matterport3D: Learning from RGB-D data in indoor environments

1 Pith paper cite this work. Polarity classification is still indexing.

1 Pith paper citing it

citation-role summary

background 1

citation-polarity summary

fields

cs.CV 1

years

2025 1

verdicts

CONDITIONAL 1

roles

background 1

polarities

unclear 1

representative citing papers

VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning

cs.CV · 2025-06-20 · conditional · novelty 6.0

VLN-R1 shows that a Qwen2-VL model trained with supervised fine-tuning plus GRPO-based reinforcement fine-tuning can navigate continuous indoor environments from egocentric video, improving success rate on VLN-CE R2R and RxR benchmarks over its own SFT baselines.

citing papers explorer

Showing 1 of 1 citing paper.

  • VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning cs.CV · 2025-06-20 · conditional · none · ref 4

    VLN-R1 shows that a Qwen2-VL model trained with supervised fine-tuning plus GRPO-based reinforcement fine-tuning can navigate continuous indoor environments from egocentric video, improving success rate on VLN-CE R2R and RxR benchmarks over its own SFT baselines.