{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:7WKNXNMDE5VLCB4LM6RZ6JE36P","short_pith_number":"pith:7WKNXNMD","schema_version":"1.0","canonical_sha256":"fd94dbb583276ab1078b67a39f249bf3ff806bd9dc975402db757a43117d69ee","source":{"kind":"arxiv","id":"2410.07087","version":2},"attestation_state":"computed","paper":{"title":"Towards Realistic UAV Vision-Language Navigation: Platform, Benchmark, and Methodology","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.RO"],"primary_cat":"cs.CV","authors_text":"Donglin Yang, Hohin Kwan, Hongsheng Li, Jinyu Chen, Si Liu, Wenjun Wu, Xiangyu Wang, Yue Liao, Ziqin Wang","submitted_at":"2024-10-09T17:29:01Z","abstract_excerpt":"Developing agents capable of navigating to a target location based on language instructions and visual information, known as vision-language navigation (VLN), has attracted widespread interest. Most research has focused on ground-based agents, while UAV-based VLN remains relatively underexplored. Recent efforts in UAV vision-language navigation predominantly adopt ground-based VLN settings, relying on predefined discrete action spaces and neglecting the inherent disparities in agent movement dynamics and the complexity of navigation tasks between ground and aerial environments. To address thes"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2410.07087","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2024-10-09T17:29:01Z","cross_cats_sorted":["cs.RO"],"title_canon_sha256":"5943ae89b87cf0a1f59c2de1170ac98523fdeea7ff268eee413c47f3a357ee54","abstract_canon_sha256":"85b166653d4c226b2f5b4d60bf2f7db05e256087147977f55362030f55bf4cde"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T09:18:32.250852Z","signature_b64":"IRACgGBcWUeUji0dbAIZh0WJZ6lRg3Z1DkSa5oNJB0vhLSxK6Nf823wthzAfuoRaGBVk6NimDk1jbsMFBzQ3AQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"fd94dbb583276ab1078b67a39f249bf3ff806bd9dc975402db757a43117d69ee","last_reissued_at":"2026-07-05T09:18:32.250353Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T09:18:32.250353Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Towards Realistic UAV Vision-Language Navigation: Platform, Benchmark, and Methodology","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.RO"],"primary_cat":"cs.CV","authors_text":"Donglin Yang, Hohin Kwan, Hongsheng Li, Jinyu Chen, Si Liu, Wenjun Wu, Xiangyu Wang, Yue Liao, Ziqin Wang","submitted_at":"2024-10-09T17:29:01Z","abstract_excerpt":"Developing agents capable of navigating to a target location based on language instructions and visual information, known as vision-language navigation (VLN), has attracted widespread interest. Most research has focused on ground-based agents, while UAV-based VLN remains relatively underexplored. Recent efforts in UAV vision-language navigation predominantly adopt ground-based VLN settings, relying on predefined discrete action spaces and neglecting the inherent disparities in agent movement dynamics and the complexity of navigation tasks between ground and aerial environments. To address thes"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2410.07087","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2410.07087/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2410.07087","created_at":"2026-07-05T09:18:32.250407+00:00"},{"alias_kind":"arxiv_version","alias_value":"2410.07087v2","created_at":"2026-07-05T09:18:32.250407+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2410.07087","created_at":"2026-07-05T09:18:32.250407+00:00"},{"alias_kind":"pith_short_12","alias_value":"7WKNXNMDE5VL","created_at":"2026-07-05T09:18:32.250407+00:00"},{"alias_kind":"pith_short_16","alias_value":"7WKNXNMDE5VLCB4L","created_at":"2026-07-05T09:18:32.250407+00:00"},{"alias_kind":"pith_short_8","alias_value":"7WKNXNMD","created_at":"2026-07-05T09:18:32.250407+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":17,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2607.08359","citing_title":"FSD-VLN: Fast-Slow Dual-System Modeling for Aerial Long-Horizon Vision-Language Navigation","ref_index":41,"is_internal_anchor":true},{"citing_arxiv_id":"2606.31654","citing_title":"DynFly: Dynamic-Aware Continuous Trajectory Generation for UAV Vision-Language Navigation in Urban Environments","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2607.00338","citing_title":"DroneFINE: Domain-Aware Parameter-Efficient Fine-Tuning of Vision-Language Detectors for Drone Images","ref_index":39,"is_internal_anchor":false},{"citing_arxiv_id":"2606.02313","citing_title":"Towards Precise Intent-Aligned VLA Aerial Navigation via Expert-Guided GRPO","ref_index":25,"is_internal_anchor":false},{"citing_arxiv_id":"2606.31654","citing_title":"DynFly: Dynamic-Aware Continuous Trajectory Generation for UAV Vision-Language Navigation in Urban Environments","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2606.30151","citing_title":"AERIS: Aerial-Edge Role-Driven Intelligence at Runtime via Orchestrated Language-Model Swarm","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2605.27582","citing_title":"Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2606.00104","citing_title":"PEACE: A Planner-Executor Agent with Constraint Enforcement for UAVs","ref_index":5,"is_internal_anchor":false},{"citing_arxiv_id":"2605.31066","citing_title":"Can Aerial VLA Models Cooperate? Evaluating Closed-Loop Air-Ground Coordination with CARLA-Air","ref_index":30,"is_internal_anchor":false},{"citing_arxiv_id":"2605.17776","citing_title":"CosFly-Track: A Large-Scale Multi-Modal Dataset for UAV Visual Tracking via Multi-Constraint Trajectory Optimization","ref_index":24,"is_internal_anchor":false},{"citing_arxiv_id":"2605.17776","citing_title":"CosFly-Track: A Large-Scale Multi-Modal Dataset for UAV Visual Tracking via Multi-Constraint Trajectory Optimization","ref_index":24,"is_internal_anchor":false},{"citing_arxiv_id":"2605.19600","citing_title":"FlyMirage: A Fully Automated Generation Pipeline for Diverse and Scalable UAV Flight Data via Generative World Model","ref_index":16,"is_internal_anchor":false},{"citing_arxiv_id":"2602.11183","citing_title":"Mitigating Error Accumulation in Continuous Navigation via Memory-Augmented Kalman Filtering","ref_index":17,"is_internal_anchor":false},{"citing_arxiv_id":"2604.13654","citing_title":"Vision-and-Language Navigation for UAVs: Progress, Challenges, and a Research Roadmap","ref_index":225,"is_internal_anchor":false},{"citing_arxiv_id":"2604.07973","citing_title":"How Far Are Large Multimodal Models from Human-Level Spatial Action? A Benchmark for Goal-Oriented Embodied Navigation in Urban Airspace","ref_index":49,"is_internal_anchor":false},{"citing_arxiv_id":"2604.16298","citing_title":"FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation","ref_index":30,"is_internal_anchor":false},{"citing_arxiv_id":"2604.17190","citing_title":"LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation","ref_index":36,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P","json":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P.json","graph_json":"https://pith.science/api/pith-number/7WKNXNMDE5VLCB4LM6RZ6JE36P/graph.json","events_json":"https://pith.science/api/pith-number/7WKNXNMDE5VLCB4LM6RZ6JE36P/events.json","paper":"https://pith.science/paper/7WKNXNMD"},"agent_actions":{"view_html":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P","download_json":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P.json","view_paper":"https://pith.science/paper/7WKNXNMD","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2410.07087&json=true","fetch_graph":"https://pith.science/api/pith-number/7WKNXNMDE5VLCB4LM6RZ6JE36P/graph.json","fetch_events":"https://pith.science/api/pith-number/7WKNXNMDE5VLCB4LM6RZ6JE36P/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P/action/timestamp_anchor","attest_storage":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P/action/storage_attestation","attest_author":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P/action/author_attestation","sign_citation":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P/action/citation_signature","submit_replication":"https://pith.science/pith/7WKNXNMDE5VLCB4LM6RZ6JE36P/action/replication_record"}},"created_at":"2026-07-05T09:18:32.250407+00:00","updated_at":"2026-07-05T09:18:32.250407+00:00"}