{"as_of":"2026-08-04T07:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:80cca99ace26b2591dbc9e7ae67e1ec083ca0227df2bcd77ec3811a6648eafe7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T19:24:39.321499Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-05T11:41:02.489833Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-08-03T19:24:39.321499Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.00814","last_updated":"2026-05-27T04:00:29Z","snapshot_observed_at":"2026-08-03T19:24:36.636868Z","submitted_at":"2025-11-30T09:42:24Z","title":"IRPO: Boosting Image Restoration via Post-training GRPO","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T19:24:39.321499Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2512.00814"},"observation_digest":"sha256:e7449866771bf3d936d3fb3def1ec0a2c30163ed1b778640699087d50fb66195","observation_id":"8f6d4493-0bc1-4a99-9994-6333f0c359cd","resolution":{"observed_at":"2026-08-03T19:24:39.321499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2512.08639","last_updated":"2026-04-15T10:58:19Z","snapshot_observed_at":"2026-07-06T22:38:13.359449Z","submitted_at":"2025-12-09T14:25:24Z","title":"Aerial Vision-Language Navigation with a Unified Framework for Spatial, Temporal and Embodied Reasoning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-16T23:58:40.992942Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2512.08639"},"observation_digest":"sha256:8d06a4985739e97e500e5ad202ff28bcbb05813e1eb8a841063a577ae3f388ca","observation_id":"49bc9c5f-727f-4eb4-9bc8-98d0d5dd10a2","resolution":{"observed_at":"2026-05-16T23:58:42.589185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.02870","last_updated":"2026-04-03T08:37:08Z","snapshot_observed_at":"2026-08-01T03:43:05.117795Z","submitted_at":"2026-04-03T08:37:08Z","title":"Token Warping Helps MLLMs Look from Nearby Viewpoints","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-13T21:07:55.062113Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.02870"},"observation_digest":"sha256:31139a59c201b656bb61263ede6772c7adba994f20a071a447db4a0a173f3be8","observation_id":"6ef87bd5-bd44-4240-8069-7b85f724ef06","resolution":{"observed_at":"2026-05-13T21:08:17.442855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.04108","last_updated":"2026-04-05T13:02:18Z","snapshot_observed_at":"2026-07-06T22:53:10.816748Z","submitted_at":"2026-04-05T13:02:18Z","title":"Hypothesis Graph Refinement: Hypothesis-Driven Exploration with Cascade Error Correction for Embodied Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T17:05:57.205365Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.04108"},"observation_digest":"sha256:548ddb4fd5c355b6af50a269c17eec5ad1ca2181f7b97c59dedf880a3243fe1a","observation_id":"818345e2-d07f-4a43-a906-1cca8202e0c9","resolution":{"observed_at":"2026-05-13T17:08:00.907219Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.06725","last_updated":"2026-04-08T06:47:55Z","snapshot_observed_at":"2026-08-02T13:53:46.692069Z","submitted_at":"2026-04-08T06:47:55Z","title":"Enhancing MLLM Spatial Understanding via Active 3D Scene Exploration for Multi-Perspective Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T19:16:46.753641Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.06725"},"observation_digest":"sha256:f489c6d61361d12977c776299328c65861101727db52400a59e6c3fcba9b9d6f","observation_id":"fde93708-7efc-41f8-aaa4-f929867df094","resolution":{"observed_at":"2026-05-10T23:15:47.751455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.08232","last_updated":"2026-04-09T13:22:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T13:22:24Z","title":"HiRO-Nav: Hybrid ReasOning Enables Efficient Embodied Navigation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T17:01:13.350219Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.08232"},"observation_digest":"sha256:a433ce5be8b144045d37cc99876c89764e1f74e3b8f706f1116474ca599f761d","observation_id":"53443418-d67e-4f2a-9708-e9072ca1faf8","resolution":{"observed_at":"2026-05-11T07:41:01.531030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.17407","last_updated":"2026-04-19T12:30:22Z","snapshot_observed_at":"2026-08-02T21:38:53.966924Z","submitted_at":"2026-04-19T12:30:22Z","title":"Think before Go: Hierarchical Reasoning for Image-goal Navigation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-10T05:43:27.972164Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.17407"},"observation_digest":"sha256:f4db084a85fd8abb419993d120b5141590a5c43e8b1d2a7ef3eb26b9f0fd550c","observation_id":"062ae992-5bef-4e9a-af06-a426058fbc1f","resolution":{"observed_at":"2026-05-10T05:51:10.485653Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.17473","last_updated":"2026-06-23T08:05:53Z","snapshot_observed_at":"2026-08-01T16:55:52.786011Z","submitted_at":"2026-04-19T15:03:38Z","title":"Dual-Anchoring: Addressing State Drift in Vision-Language Navigation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-10T06:50:34.310831Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.17473"},"observation_digest":"sha256:5a3c509c0476dc75897d8f4d3da3b27f97e96aff49bbbde05acd9469f4f0271a","observation_id":"d7e87bfa-b62d-4502-b272-c4e2f2ccce5b","resolution":{"observed_at":"2026-05-10T06:51:45.828270Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.18483","last_updated":"2026-07-01T12:23:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-20T16:35:57Z","title":"Steadily moving semi-infinite fracture in plane poroelasticity","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-05T11:39:05.686584Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.18483"},"observation_digest":"sha256:f290332df952fe703af8f7eb1d2aa20ba9b859e08c82c727ffaabd14a918ce26","observation_id":"9f612723-deee-4adf-a40e-1a7f51c2744e","resolution":{"observed_at":"2026-07-05T11:41:02.491147Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.18484","last_updated":"2026-04-20T16:37:16Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T16:37:16Z","title":"XEmbodied: A Foundation Model with Enhanced Geometric and Physical Cues for Large-Scale Embodied Environments","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-10T05:46:36.865150Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.18484"},"observation_digest":"sha256:d25a1853c7e0de8798ef5b7cea5c0b84c2c9de913eee193551c8ae208498345c","observation_id":"c75ecfb5-fb62-42f1-a8d0-f4067bd19a30","resolution":{"observed_at":"2026-05-10T05:51:10.296777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2604.27620","last_updated":"2026-04-30T09:09:40Z","snapshot_observed_at":"2026-08-02T10:15:35.110642Z","submitted_at":"2026-04-30T09:09:40Z","title":"SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-07T05:05:33.606975Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2604.27620"},"observation_digest":"sha256:472c7fa52d2c88bfc14201da83b70f5fb71c63dfe4e70c3779ed77e8b151eba1","observation_id":"e37d385e-ef1d-407e-acb5-948dbc1a8cc6","resolution":{"observed_at":"2026-05-12T10:36:31.243113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2605.09146","last_updated":"2026-05-09T20:10:53Z","snapshot_observed_at":"2026-07-06T23:21:16.454273Z","submitted_at":"2026-05-09T20:10:53Z","title":"Beyond Thinking: Imagining in 360$^\\circ$ for Humanoid Visual Search","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-12T02:58:46.728868Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2605.09146"},"observation_digest":"sha256:818e4ad41e306354531b40fe9a43291d41f05c59ff9af542e0c87008f9dad757","observation_id":"79ce5e0b-fb83-47c5-bf81-7c5e0cf19292","resolution":{"observed_at":"2026-05-12T03:01:18.332757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2605.15964","last_updated":"2026-05-15T13:55:39Z","snapshot_observed_at":"2026-07-06T23:27:11.118592Z","submitted_at":"2026-05-15T13:55:39Z","title":"WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T17:47:32.953903Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2605.15964"},"observation_digest":"sha256:bf2ebd947af7bbd5d380f2b1c6b569771f577b27fd2d20ac8cb1e802e3f1b9c2","observation_id":"f66da04d-f31d-4ccc-9688-5ff8f158570e","resolution":{"observed_at":"2026-05-20T17:48:48.633274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2605.22816","last_updated":"2026-05-21T17:58:26Z","snapshot_observed_at":"2026-08-03T04:05:29.788502Z","submitted_at":"2026-05-21T17:58:26Z","title":"AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T04:46:03.020800Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2605.22816"},"observation_digest":"sha256:efca807e3cd2ecf398a566c1bee9d736392420c4c4d76b2c658aebb24507f5f0","observation_id":"0ce6c4d5-b991-4c1b-a393-9f1103944045","resolution":{"observed_at":"2026-05-22T04:46:04.568388Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2605.24578","last_updated":"2026-05-23T13:42:35Z","snapshot_observed_at":"2026-08-02T07:50:35.635060Z","submitted_at":"2026-05-23T13:42:35Z","title":"World Models as Group Actions","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T13:17:42.720825Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2605.24578"},"observation_digest":"sha256:6c99a0198e3786f64ccf174c56ec430d1c207b64494a65dd2fca5626f161bed6","observation_id":"8da6f638-a852-4621-a212-12dc15632643","resolution":{"observed_at":"2026-06-30T13:24:40.331396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2606.00095","last_updated":"2026-05-25T08:53:21Z","snapshot_observed_at":"2026-08-02T11:09:28.452176Z","submitted_at":"2026-05-25T08:53:21Z","title":"Bridging the 2D-3D Gap: A Hierarchical Semantic-Geometric Map for Vision Language Navigation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T22:33:32.671550Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2606.00095"},"observation_digest":"sha256:baf9c6a1709580d43286c6ce4a39ada03a51641836eefeffa6756c6ecaf2b484","observation_id":"ed9be44b-6172-4d41-b974-7b2b4d67a4ed","resolution":{"observed_at":"2026-06-29T22:34:01.336932Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2606.00963","last_updated":"2026-05-31T02:36:57Z","snapshot_observed_at":"2026-07-06T23:41:34.459700Z","submitted_at":"2026-05-31T02:36:57Z","title":"Reasmory: 3D Reconstruction as Explicit Memory for VLMs Spatial Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T17:46:21.821764Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2606.00963"},"observation_digest":"sha256:30f757bf8a942ab05a2d88fdd63850f4623ceeea9061cc270d08c3f05d939424","observation_id":"b0a0df41-f434-4da9-90ef-c03458f72283","resolution":{"observed_at":"2026-07-01T20:46:13.683917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2606.01621","last_updated":"2026-06-11T13:52:08Z","snapshot_observed_at":"2026-07-06T23:42:07.508474Z","submitted_at":"2026-06-01T03:12:58Z","title":"Goal2Pixel: Grounding Goals to Pixels for Vision-Language Navigation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T15:39:13.803571Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2606.01621"},"observation_digest":"sha256:53fee00cc6f0bab04cfe795a3e25205347f13d658f5334075ca4c7d5dbfe6157","observation_id":"59072d98-3d15-47d9-b66f-d43b0980ef2a","resolution":{"observed_at":"2026-07-01T22:16:15.779796Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2606.07244","last_updated":"2026-06-05T13:11:39Z","snapshot_observed_at":"2026-08-03T01:43:22.064081Z","submitted_at":"2026-06-05T13:11:39Z","title":"Beyond Waypoints: A Trajectory-Centric Waypointing Paradigm for Vision-Language Navigation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T21:40:58.329546Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2606.07244"},"observation_digest":"sha256:c48143e5b3fb0d3b3b0bebc033a136a78fe4f0d22452a46af99af7d6c962a706","observation_id":"39828a1e-b0db-486a-b879-ad91aba9459b","resolution":{"observed_at":"2026-07-02T19:07:17.765948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2606.07433","last_updated":"2026-06-05T16:29:13Z","snapshot_observed_at":"2026-08-01T21:05:06.439607Z","submitted_at":"2026-06-05T16:29:13Z","title":"Watch, Remember, Reason: Human-View Video Understanding with MLLMs","version":1},"reference_index":239,"source":"pdf_text","source_observed_at":"2026-06-27T22:00:28.350003Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2606.07433"},"observation_digest":"sha256:7ddf38bd5db43a820317b546c888ecc2d27ee4656cdf1e675dc1ca29a4bb3d4d","observation_id":"9ee761ed-2ee7-4e27-8aab-274aa4eee27c","resolution":{"observed_at":"2026-07-02T17:27:15.728048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2506.17221","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-05T11:41:02.489833Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning.arXiv preprint arXiv:2506.17221","venue":"cs.CV","work_id":"1de72e61-2884-4b01-abd8-bcf151cbd255","year":2025},"citing_paper":{"arxiv_id":"2607.01754","last_updated":"2026-07-02T06:11:07Z","snapshot_observed_at":"2026-08-02T15:41:12.241586Z","submitted_at":"2026-07-02T06:11:07Z","title":"Path-level Hindsight Instructions for Semantic Exploration in Vision-Language Navigation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-03T14:04:46.400336Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2607.01754"},"observation_digest":"sha256:15ea49362fb258d41f05099fa5cc64970fe778beede065b7744538baf0887729","observation_id":"afdb57f2-0228-4d53-b770-cbc3316ed17e","resolution":{"observed_at":"2026-07-03T14:08:21.390625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-07-14T15:39:59.878169Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09792","last_updated":"2026-07-09T05:13:02Z","snapshot_observed_at":"2026-08-01T19:52:29.316601Z","submitted_at":"2026-07-09T05:13:02Z","title":"A Comprehensive Survey and Systematic Real-World Evaluation of Embodied Vision-and-Language Navigation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T15:39:59.878169Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2607.09792"},"observation_digest":"sha256:ca4a32ef8eb6a9f1bb08aca57653991e6f953e665436da44b0cc0d2f1b805bf8","observation_id":"43227267-f85c-427b-b2e8-587b41454996","resolution":{"observed_at":"2026-07-14T15:39:59.878169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-08-02T05:13:54.793452Z","title":"Vln-r1: Vision- language navigation via reinforcement fine-tuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13461","last_updated":"2026-07-15T05:46:34Z","snapshot_observed_at":"2026-08-02T14:26:06.309901Z","submitted_at":"2026-07-15T05:46:34Z","title":"Joint On-and-Off Policy Learning for Vision-and-Language Navigation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:54.793452Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2607.13461"},"observation_digest":"sha256:d1ed4199b07035e8b58a0d98de654d7a4ce0be39e41b5690e06629ccb99a4999","observation_id":"86424cd5-e548-4337-b63d-c8f01723c1ad","resolution":{"observed_at":"2026-08-02T05:13:54.793452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17221","snapshot_observed_at":"2026-08-01T03:26:15.484911Z","title":"Vln-r1: Vision-language navigation via reinforcement fine-tuning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23181","last_updated":"2026-07-25T12:26:47Z","snapshot_observed_at":"2026-08-01T03:26:11.240327Z","submitted_at":"2026-07-25T12:26:47Z","title":"Towards Dual-Brain Minimal Sufficient Representation for Vision-Language Navigation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T03:26:15.484911Z"},"links":{"cited_paper":"/paper/2506.17221","citing_paper":"/paper/2607.23181"},"observation_digest":"sha256:b11f8155dcd3ff3a569ae8b6e85df8c48785c15d7ecd11440887fad0e6405696","observation_id":"7b9be73c-fe2f-4bf4-b991-db29888e2848","resolution":{"observed_at":"2026-08-01T03:26:15.484911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17221/citation-record","integrity":"/paper/2506.17221/integrity","json":"/paper/2506.17221/citation-record.json","paper":"/paper/2506.17221"},"outbound":[],"paper":{"arxiv_id":"2506.17221","last_updated":"2025-06-25T06:03:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T03:06:06.303999Z","submitted_at":"2025-06-20T17:59:59Z","title":"VLN-R1: Vision-Language Navigation via Reinforcement Fine-Tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2506.17221."}