{"as_of":"2026-08-20T19:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3592c2841c6ff2c7213ed9df737c0adbd1ac3ef8f82a87d6c64740631485842f","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T06:06:27.053550Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22014/citation-record","integrity":"/paper/2607.22014/integrity","json":"/paper/2607.22014/citation-record.json","paper":"/paper/2607.22014"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-08-18T11:44:22.813405Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-01T06:06:22.205940Z","title":"Do as i can, not as i say: Grounding language in robotic affordances","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:22.205940Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:f8fd67181f0927f0d62782461ba9ca9844afcc5805812396927dbcfa43b23664","observation_id":"ec3cfbd5-58ee-42ba-944d-d30c22f1dadc","resolution":{"observed_at":"2026-08-01T06:06:22.205940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:22.322113Z","title":"Vision-and-language navigation: Interpreting visually-grounded navigation instructions in real environments","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:22.322113Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:19c9a3a6f0eaaf1dbc5cd8d1dc21d7676491f3f9654f3d58ef1175ac7ab1abaa","observation_id":"dd4230a2-8678-4e8b-aeb3-9715c914ba81","resolution":{"observed_at":"2026-08-01T06:06:22.322113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13171","last_updated":"2020-08-30T04:28:13Z","snapshot_observed_at":"2026-08-18T16:20:55.129945Z","submitted_at":"2020-06-23T17:18:54Z","title":"ObjectNav Revisited: On Evaluation of Embodied Agents Navigating to Objects","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13171","snapshot_observed_at":"2026-08-01T06:06:22.509088Z","title":"Objectnav revisited: On evaluation of embodied agents navigating to objects","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:22.509088Z"},"links":{"cited_paper":"/paper/2006.13171","citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:ff3a6c40538f72736e03a717269f215f8d0232c6c8d04a9f18e42e32a994a7fe","observation_id":"55877264-052d-4d56-9c15-4298c5c30555","resolution":{"observed_at":"2026-08-01T06:06:22.509088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:22.619852Z","title":"Neusis: A compositional neuro-symbolic framework for autonomous perception, reasoning, and planning in complex uav search missions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:22.619852Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:d76a93fa5cac99117e85b188d204dfee4e94fb76051ea093912527a2f69b417a","observation_id":"341f4d76-c855-42a0-9518-a5f3b5ef1247","resolution":{"observed_at":"2026-08-01T06:06:22.619852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14950","last_updated":"2024-09-26T15:45:13Z","snapshot_observed_at":"2026-08-16T14:36:29.555576Z","submitted_at":"2023-12-08T15:57:18Z","title":"TypeFly: Flying Drones with Large Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14950","snapshot_observed_at":"2026-08-01T06:06:22.727891Z","title":"Typefly: Flying drones with large language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:22.727891Z"},"links":{"cited_paper":"/paper/2312.14950","citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:5628c7235978a58ad606dc7d65e3687bcb737fc9dd27d84c8b7b20baa453194d","observation_id":"2ed5fccc-e570-4c51-93a3-696004f56dfa","resolution":{"observed_at":"2026-08-01T06:06:22.727891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04453","last_updated":"2025-02-17T18:27:27Z","snapshot_observed_at":"2026-08-17T17:58:31.496050Z","submitted_at":"2024-12-05T18:58:17Z","title":"NaVILA: Legged Robot Vision-Language-Action Model for Navigation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04453","snapshot_observed_at":"2026-08-01T06:06:22.870692Z","title":"Navila: Legged robot vision-language-action model for navigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:22.870692Z"},"links":{"cited_paper":"/paper/2412.04453","citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:c0bfaca452d2ea8019daea0db9761243adfc2518859f6486379920ad8c54e2d1","observation_id":"79160368-0112-47d0-b764-c75123e98fe3","resolution":{"observed_at":"2026-08-01T06:06:22.870692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:22.985428Z","title":"Spatialrgpt: Grounded spatial reasoning in vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:22.985428Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:141ac8d66084f56751e0e3d4db7da4ce3a6fe6a3bb9f566579a61427fcf6c2bc","observation_id":"0388e1fc-4596-40cf-8314-14968ac96602","resolution":{"observed_at":"2026-08-01T06:06:22.985428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-14T18:47:26.721223Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-01T06:06:23.128305Z","title":"Palm-e: An embodied multimodal language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:23.128305Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:cec91f760703afb2260a20326197d98ee49fa61857bcb5cae9430e707460b5c2","observation_id":"41aac132-8697-40a7-a404-378f641a0870","resolution":{"observed_at":"2026-08-01T06:06:23.128305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:23.243971Z","title":"Unreal engine, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:23.243971Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:b8f77ae97a95d1a897f4a6f9db51a0aa0d48359f20d2a33b8de935d487f0b175","observation_id":"fa6551c9-4ffc-4983-9dfd-87b21718a2f8","resolution":{"observed_at":"2026-08-01T06:06:23.243971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:23.341555Z","title":"Aerial vision-and-dialog navigation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:23.341555Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:9aed7f5e069e1a36dee146fb64422ed9e6fa1c83ab2e53fd132a2fe5c681f0e0","observation_id":"58f257f1-a520-42af-ba85-2c237643191f","resolution":{"observed_at":"2026-08-01T06:06:23.341555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:23.519409Z","title":"Openfly: A comprehensive platform for aerial vision-language navigation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:23.519409Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:d621e9d989df294395110df9e4bf48dffcd448078132c6363cb9a4d2b65600e9","observation_id":"cac186aa-430b-4d77-8fcb-aca6c0da8293","resolution":{"observed_at":"2026-08-01T06:06:23.519409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:23.671626Z","title":"Bedi: A comprehensive benchmark for evaluating embodied agents on uavs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:23.671626Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:2aa09a8bfea647ec4ec6d9a02ca86330f0332a5b92d9c6d34c26024ac83883dc","observation_id":"a7591919-e997-4f45-9756-87227c45556a","resolution":{"observed_at":"2026-08-01T06:06:23.671626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:23.823269Z","title":"See, point, fly: A learning-free vlm framework for universal unmanned aerial navigation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:23.823269Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:d6e38baca387db2a11e8277753d436ab658f8b8181de3c860b836019de1beca7","observation_id":"1ed93ec9-34f6-4db4-a6a8-9be470d5fc34","resolution":{"observed_at":"2026-08-01T06:06:23.823269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:24.040848Z","title":"Cosys-airsim: a real-time simulation framework expanded for complex industrial applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:24.040848Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:78ca045f37f5461a9ec0d06131df7161e31b8e0e780579ecf6c98ca4088cced9","observation_id":"a6053d50-668a-412c-ada4-3a4e7ab9432a","resolution":{"observed_at":"2026-08-01T06:06:24.040848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:24.167344Z","title":"Citynav: A large-scale dataset for real-world aerial navigation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:24.167344Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:587471b4e46559352e923e28d70491d0dacc55b621697e75f82c205e0c158022","observation_id":"3042a8fa-1ab6-4309-b836-960f98916f4f","resolution":{"observed_at":"2026-08-01T06:06:24.167344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:24.344583Z","title":"Aerialvln: Vision-and-language navigation for uavs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:24.344583Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:83b486a83ae36ee39394b8d34b79eee2401c8f6497311de6d91f6b415955f116","observation_id":"db3ba871-0065-467d-817a-1fce14300f3e","resolution":{"observed_at":"2026-08-01T06:06:24.344583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:24.527579Z","title":"Unmanned aerial vehicles (uavs): Practical aspects, applications, open challenges, security issues, and future trends","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:24.527579Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:fc6ca93e265d88cc0da691cc39427b04b1a1d5cb8416d95b99624fde7b62f5c6","observation_id":"1d9a592b-4f78-470f-942b-46595d1d0917","resolution":{"observed_at":"2026-08-01T06:06:24.527579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:24.709694Z","title":"Flysearch: Exploring how vision-language models explore","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:24.709694Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:c2a5a95146d7211c5404c9aa2e175b63a7b072a591a6799793d111b256e00411","observation_id":"5bfd415c-c03d-4bc1-af1f-c1307428d40e","resolution":{"observed_at":"2026-08-01T06:06:24.709694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:24.825591Z","title":"Unrealcv: Virtual worlds for computer vision","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:24.825591Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:5f8f3780918be970900d170287d281e9d1e80f251a93d51e3c197ee44e6a0e74","observation_id":"65f50460-9375-4870-923e-b787ec04db13","resolution":{"observed_at":"2026-08-01T06:06:24.825591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:25.002520Z","title":"Airsim: High-fidelity visual and physical simulation for autonomous vehicles","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:25.002520Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:3469de53e4a0e05dd70d863f028ad3eee1d7d5171be37675a76ae73e6f03935a","observation_id":"67979c39-150b-4e7a-8a17-e4836295b2f8","resolution":{"observed_at":"2026-08-01T06:06:25.002520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:25.128108Z","title":"Unmanned aerial vehicles (uavs): A survey on civil applications and key research challenges","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:25.128108Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:4d6bdb8aad7a6027850b3c9da8c0151b72908561f15fcd314d16dbba949798bc","observation_id":"dbf39903-e55b-408f-bb48-57a0b77cf14a","resolution":{"observed_at":"2026-08-01T06:06:25.128108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:25.278237Z","title":"Alfred: A benchmark for interpreting grounded instructions for everyday tasks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:25.278237Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:68617e5b8db648b0e39ae59c061994a8d9c2df95fc4b6ea1bf1a1fddd532e6d4","observation_id":"a7a5c4a5-db10-4761-8417-62f3f3a5439a","resolution":{"observed_at":"2026-08-01T06:06:25.278237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:25.426013Z","title":"UAVs meet LLMs : Overviews and perspectives toward agentic low-altitude mobility, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:25.426013Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:97a11463a8d80a96c64d358cf677ab59f6a8bfe3e138378799c28949c5acce4f","observation_id":"04f9071a-34e7-4df7-80e4-be0ed12d917a","resolution":{"observed_at":"2026-08-01T06:06:25.426013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:25.547686Z","title":"Cambrian-1: A fully open, vision-centric exploration of multimodal llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:25.547686Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:433bed57074635a5d7bacc79cab8bcfebe890f3e12c4820f56b59f6e1d926cad","observation_id":"f67ef22f-c96e-496b-9fed-e703bb4050c4","resolution":{"observed_at":"2026-08-01T06:06:25.547686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:25.666211Z","title":"Towards realistic uav vision-language navigation: Platform, benchmark, and methodology","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:25.666211Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:80b5ddb6522f4dbbb043bc5738aeecf455456594a974bb03a80baf8e5f1cbd93","observation_id":"974fd98a-3256-4475-81d7-60bc26bff0d8","resolution":{"observed_at":"2026-08-01T06:06:25.666211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:25.860668Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:25.860668Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:28001546149986ee305bc85ce368dc0310e515d606ebe4a1f73ccf1a83fd7b7e","observation_id":"5fd02f4f-3bd6-4d32-afbe-ea66ab9d1f71","resolution":{"observed_at":"2026-08-01T06:06:25.860668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:26.055345Z","title":"Uav-on: A benchmark for open-world object goal navigation with aerial agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:26.055345Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:4bfe225baeea67e10621ee78ebfe23fb5b34098de25cd59a1744c2981d353bd8","observation_id":"5a64412e-eeb4-4797-b757-92ac34df7be0","resolution":{"observed_at":"2026-08-01T06:06:26.055345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:26.183336Z","title":"Aeroverse: Uav-agent benchmark suite for simulating, pre-training, finetuning, and evaluating aerospace embodied world models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:26.183336Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:6b2e551f47208880a53cd88c52cab94a331df15a2a7b5d36d92f0f5e863a69e3","observation_id":"7d98032a-5083-4a3e-bf17-822cd8fe2055","resolution":{"observed_at":"2026-08-01T06:06:26.183336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01371","last_updated":"2026-05-02T10:30:42Z","snapshot_observed_at":"2026-08-17T15:19:48.528442Z","submitted_at":"2026-05-02T10:30:42Z","title":"ESARBench: A Benchmark for Agentic UAV Embodied Search and Rescue","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.01371","snapshot_observed_at":"2026-08-01T06:06:26.379840Z","title":"Esarbench: A benchmark for agentic uav embodied search and rescue","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:26.379840Z"},"links":{"cited_paper":"/paper/2605.01371","citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:c9601b90eeb13515f11b1d0647c65ee9e4d78515298daf13113304135e1d4bc2","observation_id":"523e0590-29fe-44c9-b6c2-695bdb17d436","resolution":{"observed_at":"2026-08-01T06:06:26.379840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15852","last_updated":"2024-06-30T11:14:13Z","snapshot_observed_at":"2026-08-18T12:12:42.503422Z","submitted_at":"2024-02-24T16:39:16Z","title":"NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15852","snapshot_observed_at":"2026-08-01T06:06:26.559465Z","title":"Navid: Video-based vlm plans the next step for vision-and-language navigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:26.559465Z"},"links":{"cited_paper":"/paper/2402.15852","citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:50872363b44e5d0c87e48a508f9d1b8207a2d9bff8968878c849ca374cdf0b5b","observation_id":"bfaa9010-c4e0-4e65-9d65-3ddcf053f311","resolution":{"observed_at":"2026-08-01T06:06:26.559465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:26.720238Z","title":"Is your vlm sky-ready? a comprehensive spatial intelligence benchmark for uav navigation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:26.720238Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:ccea14b457f7df08fb8a5320a7543e70d7fe480aa7f8ef484b0abe026bf50d9f","observation_id":"3e1e7f5a-c240-4266-a3ac-94ed28ff8bd1","resolution":{"observed_at":"2026-08-01T06:06:26.720238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:26.882286Z","title":"Towards learning a generalist model for embodied navigation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:26.882286Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:efb9cc99aae73e79a6b54d5f4a64a421dad3d92def6c31f62669193fcfe396bd","observation_id":"cab63ab8-972c-40ff-b6d4-ff9bb840a4ff","resolution":{"observed_at":"2026-08-01T06:06:26.882286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T06:06:27.053550Z","title":"Navgpt-2: Unleashing navigational reasoning capability for large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T06:06:27.053550Z"},"links":{"citing_paper":"/paper/2607.22014"},"observation_digest":"sha256:9bca132e20e741f7610cd9212e5599d2ff81a9bfa70910fe633fbc4c5945697c","observation_id":"c9dd02ac-605d-438f-97c7-8314f87ef883","resolution":{"observed_at":"2026-08-01T06:06:27.053550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22014","last_updated":"2026-07-24T06:22:50Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-17T15:20:39.633863Z","submitted_at":"2026-07-24T06:22:50Z","title":"Zero-Shot Mission-Level Evaluation for Aerial MLLM Agents"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2607.22014."}