{"as_of":"2026-08-11T11:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:539a3418cde61c608ac2544117d5323ffa4d73f9b3b45059d6f81a5657ee234d","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:23:29.725106Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:33:26.532297Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T14:10:29.554930Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05014","snapshot_observed_at":"2026-08-04T16:33:26.532297Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.12795","last_updated":"2026-06-01T08:46:33Z","snapshot_observed_at":"2026-08-04T16:33:19.031185Z","submitted_at":"2025-09-16T08:14:15Z","title":"When Large Language Models Meet UAV Projects: An Empirical Study from Developers' Perspective","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T16:33:26.532297Z"},"links":{"cited_paper":"/paper/2501.05014","citing_paper":"/paper/2509.12795"},"observation_digest":"sha256:3bbc8f496b615f01e10f80290eaedc4e37f32300412004399fa447a5d71774cb","observation_id":"343640ba-77f0-40b3-8501-69882461da16","resolution":{"observed_at":"2026-08-04T16:33:26.532297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05014","snapshot_observed_at":"2026-08-04T00:24:38.980573Z","title":"UA V-VLA: Vision-language-action system for large scale aerial mission generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.01472","last_updated":"2026-06-28T15:13:39Z","snapshot_observed_at":"2026-08-09T11:59:39.111394Z","submitted_at":"2025-11-03T11:31:55Z","title":"AERMANI-VLM: Structured Prompting and Reasoning for Aerial Manipulation with Vision Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T00:24:38.980573Z"},"links":{"cited_paper":"/paper/2501.05014","citing_paper":"/paper/2511.01472"},"observation_digest":"sha256:9325a62770c7b2329cdf086749617b983558830e384705dc3c6f6081cda7becb","observation_id":"4e0608b1-5fd4-4734-bba9-96bfa96f342b","resolution":{"observed_at":"2026-08-04T00:24:38.980573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"cited_work":{"arxiv_id":"2501.05014","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.05014","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sautenkov et al","venue":null,"work_id":"beb1bef8-53af-4522-8b41-2b19af4730d0","year":2025},"citing_paper":{"arxiv_id":"2604.13654","last_updated":"2026-04-15T09:20:02Z","snapshot_observed_at":"2026-07-06T23:01:37.207817Z","submitted_at":"2026-04-15T09:20:02Z","title":"Vision-and-Language Navigation for UAVs: Progress, Challenges, and a Research Roadmap","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T13:48:08.135538Z"},"links":{"cited_paper":"/paper/2501.05014","citing_paper":"/paper/2604.13654"},"observation_digest":"sha256:1879cb6fc207ca29efacfc1661ddc747794bc88ef85cb2d30e703a8a64c05a7a","observation_id":"490fdfe5-2d1b-4bb1-b878-1ae0e90acb8a","resolution":{"observed_at":"2026-05-10T14:10:29.557042Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.05014/citation-record","integrity":"/paper/2501.05014/integrity","json":"/paper/2501.05014/citation-record.json","paper":"/paper/2501.05014"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:23:30.728476Z","title":"AI meets UA Vs: A survey on AI empowered UA V perception systems for precision agriculture,","venue":null,"work_id":"ad18b57b-91c7-4f27-949a-b2895fd5a42b","year":2023},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.059474Z"},"links":{"citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:0afcaf9d93000e00127fb98e4303e0aa771eeaf95b9dad8049cb08c321d7a048","observation_id":"507345bd-ecfc-4293-bee9-a924ab48de70","resolution":{"observed_at":"2026-08-10T21:23:30.735303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16943","last_updated":"2024-10-22T12:18:38Z","snapshot_observed_at":"2026-08-09T16:17:08.018894Z","submitted_at":"2024-10-22T12:18:38Z","title":"FlightAR: AR Flight Assistance Interface with Multiple Video Streams and Object Detection Aimed at Immersive Drone Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16943","snapshot_observed_at":"2026-08-10T21:23:29.138761Z","title":"FlightAR: AR Flight Assistance Interface with Multiple Video Streams and Object Detection Aimed at Immersive Drone Control,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.138761Z"},"links":{"cited_paper":"/paper/2410.16943","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:fedd1b96e0d90ad373db833bf1fff6f08d32cf80a84b9498bc5845ba59e04102","observation_id":"8452baab-dd43-447d-ae0a-07e5e8697736","resolution":{"observed_at":"2026-08-10T21:23:29.138761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-10T21:23:29.224197Z","title":"Attention Is All You Need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.224197Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:e7b9ab1040aa82d70970047389a174cdc995106ff7146387b8288eb57fb07d2b","observation_id":"aba64b95-1f58-4074-b892-19f9d391687c","resolution":{"observed_at":"2026-08-10T21:23:29.224197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-10T21:23:29.281543Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.281543Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:fc368144810678fed1daafcecafdf7685d117288b6ee52eedf51d1fc01a37766","observation_id":"71da60e5-d604-48ce-bdf1-0c527dbd8dc2","resolution":{"observed_at":"2026-08-10T21:23:29.281543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-10T21:23:29.327288Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.327288Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:35a2a1e333fed5ab69a1cbce798daf9d9b4113d48f2b99cb3cccee347b5d148e","observation_id":"388989cc-21e6-448d-8d8f-900c8f45f763","resolution":{"observed_at":"2026-08-10T21:23:29.327288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-10T21:23:29.333458Z","title":"RT-2: Vision-Language-Action Mod- els Transfer Web Knowledge to Robotic Control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.333458Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:e3a085014948406a85456718e18c1904eecda795724724a2cd9beaa1b4fc440a","observation_id":"12713fc5-4687-4d6c-baa2-32f687342492","resolution":{"observed_at":"2026-08-10T21:23:29.333458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14240","last_updated":"2025-08-02T16:25:00Z","snapshot_observed_at":"2026-08-10T18:10:24.287452Z","submitted_at":"2024-06-20T12:08:27Z","title":"CityNav: A Large-Scale Dataset for Real-World Aerial Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14240","snapshot_observed_at":"2026-08-10T21:23:29.340647Z","title":"CityNav: Language-Goal Aerial Navigation Dataset with Geographic Information,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.340647Z"},"links":{"cited_paper":"/paper/2406.14240","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:7e44caf625eeb893dcd00c8bf098f992e6ae400644409244e8748120389cbda2","observation_id":"d0ef5729-c36a-47db-bfde-009ecb02a977","resolution":{"observed_at":"2026-08-10T21:23:29.340647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12893","last_updated":"2023-12-23T08:27:04Z","snapshot_observed_at":"2026-07-06T16:50:46.608196Z","submitted_at":"2023-11-21T08:09:00Z","title":"A Safer Vision-based Autonomous Planning System for Quadrotor UAVs with Dynamic Obstacle Trajectory Prediction and Its Application with LLMs","version":2},"cited_work":{"arxiv_id":"2311.12893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.12893","snapshot_observed_at":"2026-08-10T21:23:30.148714Z","title":"A Safer Vision-based Autonomous Planning System for Quadrotor UAVs with Dynamic Obstacle Trajectory Prediction and Its Application with LLMs","venue":"cs.RO","work_id":"1939806d-29f4-4fd0-b543-11bfabd2782c","year":2023},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.421911Z"},"links":{"cited_paper":"/paper/2311.12893","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:1a5ecc9ea7630d011332b752d3df7aa605452dc0d0ad7201d6182b591e8ddf6d","observation_id":"046dd9b1-0080-41c2-929a-8609eef1a40f","resolution":{"observed_at":"2026-08-10T21:23:30.246325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12219","last_updated":"2023-06-01T06:39:11Z","snapshot_observed_at":"2026-08-10T05:37:00.418565Z","submitted_at":"2022-05-24T17:28:14Z","title":"Aerial Vision-and-Dialog Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12219","snapshot_observed_at":"2026-08-10T21:23:29.471276Z","title":"Aerial Vision-and-Dialog Navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.471276Z"},"links":{"cited_paper":"/paper/2205.12219","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:211aa8dbc318e070988b66220a876fba1ddac24f43d998a736c8573865b8165d","observation_id":"90b6a71e-b4f4-48db-9ca8-3689e6cde288","resolution":{"observed_at":"2026-08-10T21:23:29.471276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:23:30.706651Z","title":"Embodied- City: Embodied Aerial Agent for City-level Visual Language Navigation Using Large Language Model,","venue":null,"work_id":"2ab1aadf-a758-4e75-9a4d-1fb05dd1411d","year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.499809Z"},"links":{"citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:960dd3a3e22125f7771ae757c4f2f43a14340081a9ca147635632332d886dd7a","observation_id":"f55b94e9-bb58-449d-aa90-b497b3af51fd","resolution":{"observed_at":"2026-08-10T21:23:30.715476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-10T21:23:29.511685Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.511685Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:ff103de44044f0b96ad8e89a01f7409d54038bc0b6e7b059edaeb123c5718b94","observation_id":"aeb44cb5-bb41-43d7-acc8-cd3b7ad53a21","resolution":{"observed_at":"2026-08-10T21:23:29.511685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-10T21:23:29.517494Z","title":"Learning Transferable Visual Models from Natural Language Supervi- sion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.517494Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:1bab6ab43f613589d4a51560795aafcd554f5b614e702183b2139adeab0a17fc","observation_id":"3c92c6ef-a221-4db8-a603-3990ef426101","resolution":{"observed_at":"2026-08-10T21:23:29.517494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T21:23:29.522936Z","title":"GPT-4 Technical Report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.522936Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:cd1c9d209fe152f6197e19329fcc0f3fd670f241838796a83756d164102084fd","observation_id":"240c53ed-1a60-48a9-94ee-596643bd9b00","resolution":{"observed_at":"2026-08-10T21:23:29.522936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17146","last_updated":"2024-12-05T14:28:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-25T17:59:51Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17146","snapshot_observed_at":"2026-08-10T21:23:29.528513Z","title":"Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Multimodal Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.528513Z"},"links":{"cited_paper":"/paper/2409.17146","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:f7eb05ad48ace5be2bec1f6db539f59a92732c649ca8e14e3bb4a62cc7db63d1","observation_id":"66901023-2ca5-4f66-a4a9-6815429bf029","resolution":{"observed_at":"2026-08-10T21:23:29.528513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06735","last_updated":"2023-08-13T09:55:04Z","snapshot_observed_at":"2026-07-06T16:05:42.952649Z","submitted_at":"2023-08-13T09:55:04Z","title":"AerialVLN: Vision-and-Language Navigation for UAVs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06735","snapshot_observed_at":"2026-08-10T21:23:29.534214Z","title":"Aeri- alVLN: Vision-and-Language Navigation for UA Vs,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.534214Z"},"links":{"cited_paper":"/paper/2308.06735","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:6ac0de9d9eb35f47d357700aaccaaadfb216ce7c467a42ddc034c46200ffa9fa","observation_id":"5c31e400-2433-44e3-9056-77156551f7c5","resolution":{"observed_at":"2026-08-10T21:23:29.534214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08500","last_updated":"2025-08-11T03:42:18Z","snapshot_observed_at":"2026-08-10T18:28:30.995910Z","submitted_at":"2024-10-11T03:54:48Z","title":"Exploring Spatial Representation to Enhance LLM Reasoning in Aerial Vision-Language Navigation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08500","snapshot_observed_at":"2026-08-10T21:23:29.629020Z","title":"Aerial Vision-and-Language Navigation via Semantic-Topo-Metric Representa- tion Guided LLM Reasoning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.629020Z"},"links":{"cited_paper":"/paper/2410.08500","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:cc7634bb4ec9157bc89ffb01516729ea9cb8604e1be38cd5e3f69e7886c59cf1","observation_id":"10285939-4231-46bd-9e75-0d1198140125","resolution":{"observed_at":"2026-08-10T21:23:29.629020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07087","last_updated":"2024-10-10T05:02:04Z","snapshot_observed_at":"2026-08-10T19:28:41.701196Z","submitted_at":"2024-10-09T17:29:01Z","title":"Towards Realistic UAV Vision-Language Navigation: Platform, Benchmark, and Methodology","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07087","snapshot_observed_at":"2026-08-10T21:23:29.692917Z","title":"Towards Realistic UA V Vision-Language Navigation: Plat- form, Benchmark, and Methodology,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.692917Z"},"links":{"cited_paper":"/paper/2410.07087","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:8f5de0150880813dacb8010010adbf5fd091a9d3fb615d91125b900c269e4db8","observation_id":"d678a152-e69c-445d-b7c7-4261f8cba86a","resolution":{"observed_at":"2026-08-10T21:23:29.692917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06039","last_updated":"2024-08-19T14:05:53Z","snapshot_observed_at":"2026-07-06T18:12:18.103577Z","submitted_at":"2024-05-09T18:17:53Z","title":"Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06039","snapshot_observed_at":"2026-08-10T21:23:29.700054Z","title":"Bi-VLA: Vision-Language-Action Model-Based System for Bimanual Robotic Dexterous Manipulations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.700054Z"},"links":{"cited_paper":"/paper/2405.06039","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:577454d2643fac49bbf0ce5880f234a62cb135a7f13335651217300ce3c32471","observation_id":"70a6942c-500c-4b33-bb5f-8fa181fec431","resolution":{"observed_at":"2026-08-10T21:23:29.700054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05107","last_updated":"2024-11-07T19:34:32Z","snapshot_observed_at":"2026-07-06T19:47:03.132530Z","submitted_at":"2024-11-07T19:34:32Z","title":"MissionGPT: Mission Planner for Mobile Robot based on Robotics Transformer Model","version":1},"cited_work":{"arxiv_id":"2411.05107","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.05107","snapshot_observed_at":"2026-08-10T21:23:29.853494Z","title":"MissionGPT: Mission Planner for Mobile Robot based on Robotics Transformer Model","venue":"cs.RO","work_id":"b4b71295-c378-4daa-89ca-3553752edeed","year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.705867Z"},"links":{"cited_paper":"/paper/2411.05107","citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:a1efd15f597950d63ef61a2f4a9fe8a3280a4eb64c55892756ed023edd61806e","observation_id":"c3ac0511-3eca-4954-9481-5e2cfbcb56f8","resolution":{"observed_at":"2026-08-10T21:23:29.892881Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:23:30.569191Z","title":"[Online]","venue":null,"work_id":"f6c9fc36-031f-45c7-aa3c-00c96678e037","year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.712515Z"},"links":{"citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:012087df92415cbe939d0f1f20130787a35c917f1c50e151035b9fc4ae267b73","observation_id":"82322044-e685-4c84-a067-df7e0191fff7","resolution":{"observed_at":"2026-08-10T21:23:30.646537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:23:30.546443Z","title":"M ¨uller, Information Retrieval for Music and Motion","venue":null,"work_id":"9b2895e3-a5e5-4bd8-bc1b-e5b27c049514","year":2007},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.718284Z"},"links":{"citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:dcba4bf9f5d902c0e027f61eaad83cb65341f690b8d425bf98536d476e5cc1c6","observation_id":"9b625568-571b-4f8d-8317-6b179fcfa234","resolution":{"observed_at":"2026-08-10T21:23:30.553156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:23:30.511322Z","title":"[Online]","venue":null,"work_id":"e4e6a0ff-8945-43e5-88db-33265e5aab48","year":2024},"citing_paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:23:29.725106Z"},"links":{"citing_paper":"/paper/2501.05014"},"observation_digest":"sha256:2a40ce54c8e42d36bd218042c18a81b6b47e33d15afb1e53180ca4961e267632","observation_id":"87bf964b-78d6-43ca-9431-d21eca46fc41","resolution":{"observed_at":"2026-08-10T21:23:30.533127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.05014","last_updated":"2025-05-13T06:54:45Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-10T21:18:11.391132Z","submitted_at":"2025-01-09T07:15:59Z","title":"UAV-VLA: Vision-Language-Action System for Large Scale Aerial Mission Generation"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":5},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 3 inbound Pith citation observations for arXiv:2501.05014."}