{"as_of":"2026-08-19T16:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2e338b11d1cf348edf96ee7fb8b4a26cd8fb62c709cc6f5cc9bd0619cef6b790","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:31:27.515805Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.11738/citation-record","integrity":"/paper/2608.11738/integrity","json":"/paper/2608.11738/citation-record.json","paper":"/paper/2608.11738"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.01855","last_updated":"2025-07-01T15:51:19Z","snapshot_observed_at":"2026-08-18T10:08:55.646915Z","submitted_at":"2025-01-03T15:11:14Z","title":"UAV-DETR: Efficient End-to-End Object Detection for Unmanned Aerial Vehicle Imagery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01855","snapshot_observed_at":"2026-08-16T00:31:27.285695Z","title":"Uav-detr: efficient end-to-end object detection for unmanned aerial vehicle imagery,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.285695Z"},"links":{"cited_paper":"/paper/2501.01855","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:e4e2a0f1b0f5485ebf2c98cc569314493dfe35eee9d0e3455c3a3977b4a648c9","observation_id":"7f9aa27a-b049-4b94-96e3-f84b24817a9a","resolution":{"observed_at":"2026-08-16T00:31:27.285695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.804506Z","title":"Self-supervised monocular depth estimation from oblique uav videos,","venue":null,"work_id":"a97ad056-9f05-467b-98c1-b84480d34caa","year":2021},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.290318Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:0c402f3d0fd376456eb40933519b65cca1bbfab8f282504ad2b315638ad3b474","observation_id":"8d8d2ca8-daa9-4a97-99b6-2ebe17933e13","resolution":{"observed_at":"2026-08-16T00:31:28.808370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.294366Z","title":"Mmbench: Is your multi-modal model an all-around player?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.294366Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:8cbc5e8974312d5ab287aefdf1d94322c4917ed1bcb3293f681a99dd2b5b67d3","observation_id":"9bb809a9-b870-464e-be9d-a52fa5e966e6","resolution":{"observed_at":"2026-08-16T00:31:27.294366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.786893Z","title":"RSVQA: Visual question answering for remote sensing data,","venue":null,"work_id":"9951b511-5069-4a38-94fd-4e0b203256fe","year":2020},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.298364Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:2c3c7cf06a50971b97026090a705eedacf6a6b804424304e17534d58a1d7d0f5","observation_id":"0b841e4b-00be-4c80-b8d1-e36eaf831163","resolution":{"observed_at":"2026-08-16T00:31:28.790802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.302497Z","title":"Vrsbench: A versatile vision-language benchmark dataset for remote sensing image understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.302497Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:ee22c2f2a62be2c634406c7a7a7435553721f70d8d983e2d8f7581831923300b","observation_id":"3a3c2380-3bf0-4a27-b4bb-f58628874ea4","resolution":{"observed_at":"2026-08-16T00:31:27.302497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.306758Z","title":"Xlrs-bench: Could your multimodal llms understand extremely large ultra-high-resolution remote sensing im- agery?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.306758Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:eafb91307c79c28c4f5ab82a220940861f6ab63181dcbacd06ac2f31df37daf0","observation_id":"9d6dd457-786c-4a91-ad82-2d0eaf2ca8b5","resolution":{"observed_at":"2026-08-16T00:31:27.306758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.310496Z","title":"Visdrone-det2019: The vision meets drone object detection in image challenge results,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.310496Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:a45cd36751ae6ae4cc693b1ad748554fc3633901cf823355f5f98205d33e80d9","observation_id":"8a89ca7f-037a-453a-804e-7e955531adcf","resolution":{"observed_at":"2026-08-16T00:31:27.310496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.313917Z","title":"The unmanned aerial vehicle benchmark: Object detection and tracking,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.313917Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:8ec2839bf74af5d1c52e0956e9ddc8fe96fa7e4a2b4c1b26f8352e1aa6368225","observation_id":"640fa146-fb7f-43d7-868a-21f739b2b799","resolution":{"observed_at":"2026-08-16T00:31:27.313917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.317202Z","title":"Urbanvideo-bench: Benchmarking vision-language models on embodied intelligence with video data in urban spaces,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.317202Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:0a83a88577599fe274b1a2b0da22a03679806c2e2de86f7c8548044bc9356a13","observation_id":"87fed708-44f0-4c26-a9b4-7bac1a49038b","resolution":{"observed_at":"2026-08-16T00:31:27.317202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.321735Z","title":"Yolo26: An analysis of nms-free end to end framework for real-time object detection,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.321735Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:0e686349f9c74dafd58f751d8eee432613f18c3820c0236b09fca830ef021af6","observation_id":"464fc5d6-ea0f-45df-ac38-3867bb375d1e","resolution":{"observed_at":"2026-08-16T00:31:27.321735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07078","last_updated":"2026-05-22T17:42:16Z","snapshot_observed_at":"2026-08-19T05:56:01.499083Z","submitted_at":"2025-12-08T01:25:10Z","title":"DFIR-DETR: Frequency-Domain Iterative Refinement and Dynamic Feature Aggregation for Small Object Detection","version":4},"cited_work":{"arxiv_id":"2512.07078","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.07078","snapshot_observed_at":"2026-08-16T00:31:28.268369Z","title":"DFIR-DETR: Frequency-Domain Iterative Refinement and Dynamic Feature Aggregation for Small Object Detection","venue":"cs.CV","work_id":"6496216d-e63f-40be-808f-77c7a3d68a71","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.325458Z"},"links":{"cited_paper":"/paper/2512.07078","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:3d7ed40c334a5b4a7bc597235558acbf865aa6106dc30e5ce19db756e67833e2","observation_id":"3c6b33d9-675d-4adf-b42d-85cad76e03b9","resolution":{"observed_at":"2026-08-16T00:31:28.273071Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04624","last_updated":"2025-09-04T19:19:25Z","snapshot_observed_at":"2026-08-18T10:20:02.679733Z","submitted_at":"2025-09-04T19:19:25Z","title":"UAV-Based Intelligent Traffic Surveillance System: Real-Time Vehicle Detection, Classification, Tracking, and Behavioral Analysis","version":1},"cited_work":{"arxiv_id":"2509.04624","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.04624","snapshot_observed_at":"2026-08-16T00:31:28.251921Z","title":"UAV-Based Intelligent Traffic Surveillance System: Real-Time Vehicle Detection, Classification, Tracking, and Behavioral Analysis","venue":"cs.CV","work_id":"57138885-a6d9-422e-99b3-95737f038a37","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.329442Z"},"links":{"cited_paper":"/paper/2509.04624","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:fcc49bb5ac8b2f3c676d02dfd75d608316abe83437a447dcaa009f8a9be3baf1","observation_id":"7eb40ff3-37a0-452f-bdb1-e2e3a9baebc9","resolution":{"observed_at":"2026-08-16T00:31:28.256406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.751286Z","title":"Global–local fusion with semantic information-guidance for accurate small object detection in UA V aerial images,","venue":null,"work_id":"7e5d5e33-661c-442f-8983-c6eb677073c0","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.333803Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:c5b7371f9565430c246be60bd277b21ba87993a220fc40d9cc1f78819bafbc19","observation_id":"c5535b51-d8d8-45ca-acd9-56bfdc6999df","resolution":{"observed_at":"2026-08-16T00:31:28.754303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.739644Z","title":"Detection-driven exposure-correction network for nighttime drone-view object detection,","venue":null,"work_id":"68ac446d-f807-4a47-994e-348480f4a777","year":2024},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.337470Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:ed5d286b7016c487e4c61ffab6c75055cb7af2251378ab12aeea171eaa94e4ec","observation_id":"fb6fa9b1-0cfa-4144-b5c5-b25e30f8dc14","resolution":{"observed_at":"2026-08-16T00:31:28.743869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.08863","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.235271Z","title":"Wheatai v1. 0: An ai-powered high throughput wheat phenotyping platform,","venue":null,"work_id":"daf97dad-9524-4d2f-8bea-7ad3d1c674a2","year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.341390Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:0579ade6d9c758c2ccbfc698aa585ae54a3bdc2bfdf65d7095884441bc6d3074","observation_id":"fe4a1849-3b77-43c0-bc41-728c15125cf9","resolution":{"observed_at":"2026-08-16T00:31:28.241058Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07580","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.167131Z","title":"Maizestandcounting (masc): Auto- mated and accurate maize stand counting from uav imagery using image processing and deep learning,","venue":null,"work_id":"166019e2-283d-4a74-a2c5-b308bfdc6d77","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.345248Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:9e0dfc9992ba309251a4bcc3452d27cc416163448b3485fba250a317e587de3c","observation_id":"5955763a-8ea9-4a7c-bff9-6350ce4d1866","resolution":{"observed_at":"2026-08-16T00:31:28.172952Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15985","last_updated":"2025-08-21T22:07:59Z","snapshot_observed_at":"2026-08-17T18:48:56.899118Z","submitted_at":"2025-08-21T22:07:59Z","title":"Panoptic Segmentation of Environmental UAV Images : Litter Beach","version":1},"cited_work":{"arxiv_id":"2508.15985","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.15985","snapshot_observed_at":"2026-08-16T00:31:28.098647Z","title":"Panoptic Segmentation of Environmental UAV Images : Litter Beach","venue":"cs.CV","work_id":"6b8caa72-af7e-479b-a7ea-1d091cd7d4bb","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.348719Z"},"links":{"cited_paper":"/paper/2508.15985","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:9d84716b14259e3aaf1069b6cfd3fa24e4932af186faa93d57f96ebece1ffd6f","observation_id":"1723bf71-7461-4e21-89e6-c0f520b7ada7","resolution":{"observed_at":"2026-08-16T00:31:28.103112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.728231Z","title":"Codrone: Autonomous drone navigation assisted by edge and cloud foundation models,","venue":null,"work_id":"0745dfb3-34fb-4201-ab15-a01834ee2851","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.352467Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:34d40857a57ea06a4aec3997c4226b284662f9af7a1a2a6385791d1653589411","observation_id":"1463b128-b880-4252-b191-54da15b7b961","resolution":{"observed_at":"2026-08-16T00:31:28.732188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.03427","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.077675Z","title":"Generalization evaluation of deep stereo matching methods for uav-based forestry applications,","venue":null,"work_id":"4a00cdd9-2997-4dbb-b4d4-d84933184206","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.355704Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:f7de69eac3d8710c7687f83f3330f3147f3c2b23fe21acca728488576471ff44","observation_id":"4f751f18-66c7-480a-9987-db861d7ee20f","resolution":{"observed_at":"2026-08-16T00:31:28.086685Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.717000Z","title":"Precise depth estimation by calculating affine transformation parameters,","venue":null,"work_id":"3682acab-a183-4be0-9ec5-56b5f674ee6b","year":2024},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.358891Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:0daf752083382a5b5d5d7d9e0aa088b6b19b8ad0b0534ca3f9acd7c741110c35","observation_id":"79eb51ea-553b-4315-9b42-3ef0cac51642","resolution":{"observed_at":"2026-08-16T00:31:28.721023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.705925Z","title":"FLDet: Faster and lighter aerial object detector,","venue":null,"work_id":"c0fc7af0-6c21-4f02-b824-e1adc5c507cf","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.361896Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:4ec51f57cfe40e8addeaf48610e31fe9338dbf09adfe2260b241193e25f5929c","observation_id":"09e7cb06-9bfb-448b-9116-d3c41726bbb4","resolution":{"observed_at":"2026-08-16T00:31:28.709630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.694914Z","title":"TGCADNet: Text-guided context-aware detection via CLIP for small objects in UA V scenes,","venue":null,"work_id":"f98b89c3-81eb-4df3-8340-168ea9ce7e0d","year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.364950Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:3d25881702309f0abacb3bb9a9cc34f70439ce96c45c7d591cf7047d57fd8617","observation_id":"56d17056-53ce-490c-86ff-a2ebdc65618b","resolution":{"observed_at":"2026-08-16T00:31:28.698749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.368435Z","title":"Detect anything via next point prediction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.368435Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:c41944e965db56e58514096755cb4d7b9880baea3ab986371f133ac5634ade39","observation_id":"15e38d26-f309-47ef-9b33-9853ce22c986","resolution":{"observed_at":"2026-08-16T00:31:27.368435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.683534Z","title":"Visdrone-det2021: The vision meets drone object detection challenge results,","venue":null,"work_id":"006fd665-94f2-4403-8bf2-1d9cca53dbb9","year":2021},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.371664Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:50743dfec93a2ede357f636339a25c2470a77aea07ae014071850da31ddd3425","observation_id":"ed7f1e47-46c9-43cf-b8d3-f0a3686c3224","resolution":{"observed_at":"2026-08-16T00:31:28.687182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.375228Z","title":"Dota: A large-scale dataset for object detection in aerial images,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.375228Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:cd31c6e9bbe7b07051cb0bb113e919c571d60a2ecde98d40b9bca8e771b7b8c4","observation_id":"63aa5ea4-565f-430f-8b2b-739758c52de2","resolution":{"observed_at":"2026-08-16T00:31:27.375228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22412","last_updated":"2025-07-30T06:29:52Z","snapshot_observed_at":"2026-08-14T19:28:32.692218Z","submitted_at":"2025-07-30T06:29:52Z","title":"UAVScenes: A Multi-Modal Dataset for UAVs","version":1},"cited_work":{"arxiv_id":"2507.22412","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.22412","snapshot_observed_at":"2026-08-16T00:31:27.943165Z","title":"UAVScenes: A Multi-Modal Dataset for UAVs","venue":"cs.CV","work_id":"402fe321-3b98-48d9-98e1-c4a5f6945a01","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.378835Z"},"links":{"cited_paper":"/paper/2507.22412","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:cc832b15eee6cf340c2d1987f08b6888a9162674017d152ba9169965fdee1c41","observation_id":"1a230828-e41d-42b0-97d6-2910a398df01","resolution":{"observed_at":"2026-08-16T00:31:27.947353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.667495Z","title":"Dyfo: A training-free dynamic focus visual search for enhancing lmms in fine-grained visual understanding,","venue":null,"work_id":"a6f2d558-1b16-471f-bb07-205ec0dce86a","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.382949Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:3b298386f8f33dfa3b58d7ab41eef5231a64556a7bfc5d226227af8f1a870adf","observation_id":"d1370554-1d96-45dc-9cd9-f57e0e86abb7","resolution":{"observed_at":"2026-08-16T00:31:28.670772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07998","last_updated":"2025-08-27T07:42:56Z","snapshot_observed_at":"2026-08-15T15:17:35.540750Z","submitted_at":"2025-07-10T17:59:55Z","title":"PyVision: Agentic Vision with Dynamic Tooling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.07998","snapshot_observed_at":"2026-08-16T00:31:27.386319Z","title":"Pyvision: Agentic vision with dynamic tooling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.386319Z"},"links":{"cited_paper":"/paper/2507.07998","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:58bd4ecb2184a8382c4defd082900e0f45316cd52293792727acd8badf1ef670","observation_id":"b20e04b2-c8af-4885-aab2-9b3f0944e60b","resolution":{"observed_at":"2026-08-16T00:31:27.386319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.15077","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.905447Z","title":"Multi-agent constraint factorization reveals latent invariant solution structure,","venue":null,"work_id":"ff45e5b8-1fdd-4e00-8920-bbfd73db45ba","year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.390020Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:7fecc92075d5e339b591884590ee8ffe0ba38b8cd336d844b3495bc1f200d1f4","observation_id":"e92c2adc-7ac7-4b10-a9b4-e041a1c76188","resolution":{"observed_at":"2026-08-16T00:31:27.911979Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.14652","last_updated":"2026-05-21T18:10:39Z","snapshot_observed_at":"2026-08-16T03:55:51.800980Z","submitted_at":"2026-01-21T04:57:02Z","title":"MAS-Orchestra: Understanding and Improving Multi-Agent Reasoning Through Holistic Orchestration and Controlled Benchmarks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.14652","snapshot_observed_at":"2026-08-16T00:31:27.393535Z","title":"Mas-orchestra: Understanding and improv- ing multi-agent reasoning through holistic orchestration and controlled benchmarks,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.393535Z"},"links":{"cited_paper":"/paper/2601.14652","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:26cb260d31c610d10e808c3b32231a78f85cd7e9e5adcb897fe35bf364124c68","observation_id":"0240dbda-b017-4657-bb9d-48a75908c004","resolution":{"observed_at":"2026-08-16T00:31:27.393535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.14567","last_updated":"2026-07-13T23:08:56Z","snapshot_observed_at":"2026-08-18T10:19:37.512902Z","submitted_at":"2026-01-21T01:09:22Z","title":"Agent Identity URI Scheme: Topology-Independent Naming and Capability-Based Discovery for Multi-Agent Systems","version":2},"cited_work":{"arxiv_id":"2601.14567","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.14567","snapshot_observed_at":"2026-08-16T00:31:27.833168Z","title":"Agent Identity URI Scheme: Topology-Independent Naming and Capability-Based Discovery for Multi-Agent Systems","venue":"cs.MA","work_id":"9cefb0ee-ae07-418c-a70a-58fb94e1f0a4","year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.397088Z"},"links":{"cited_paper":"/paper/2601.14567","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:8fffa750d4d302c5187b490346e8ef1df87d40c2dab30a9319be3ed5db1c932f","observation_id":"8f77dffa-9378-4dc2-9d58-45e4bbd1d2fb","resolution":{"observed_at":"2026-08-16T00:31:27.837504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-16T00:31:27.400755Z","title":"Internvl3. 5: Advancing open-source multi- modal models in versatility, reasoning, and efficiency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.400755Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:bb69ebeb3a01238902671c29a983502b5d3a6b9ba363d936ba5bce601d51c2fd","observation_id":"5e656d98-fe91-4c3c-a84a-a59c2340c1e3","resolution":{"observed_at":"2026-08-16T00:31:27.400755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.14171","last_updated":"2026-06-30T06:31:58Z","snapshot_observed_at":"2026-08-14T16:09:13.431874Z","submitted_at":"2026-01-20T17:23:51Z","title":"Paper2Rebuttal: A Multi-Agent Framework for Transparent Author Response Assistance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.14171","snapshot_observed_at":"2026-08-16T00:31:27.404493Z","title":"Pa- per2rebuttal: A multi-agent framework for transparent author response assistance,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.404493Z"},"links":{"cited_paper":"/paper/2601.14171","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:db5bccff304fdb6140314d17c22ae346c6a970b62f7dee7e5fbf23ae28998805","observation_id":"ee9d8d0e-f173-40d9-85e5-ca2bb8288c96","resolution":{"observed_at":"2026-08-16T00:31:27.404493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.408106Z","title":"The orchestration of multi- agent systems: Architectures, protocols, and enterprise adoption,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.408106Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:90334e86e8c6f26f05e3220765d51b8ac9e4d0fbdf41e1ded934d6d146390016","observation_id":"90fd04e1-a0c0-42ad-ab75-0b9a42958c0f","resolution":{"observed_at":"2026-08-16T00:31:27.408106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.13589","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.732606Z","title":"Motion-to-response content generation via multi-agent ai sys- tem with real-time safety verification,","venue":null,"work_id":"89258d47-4ea1-4c5c-a1bb-0500cdf04ea2","year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.411453Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:2c4af6a513f9cd1346c329483b428bb477118007aeabb08dae3e63394dc34447","observation_id":"f790320e-103e-4a76-93a3-20faed97d1bc","resolution":{"observed_at":"2026-08-16T00:31:27.738154Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.13559","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.659166Z","title":"Agentgc: Evolutionary learning-based lossless compres- sion for genomics data with llm-driven multiple agent,","venue":null,"work_id":"2c6966b6-d65d-43c0-b51c-5a2a692babb4","year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.414824Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:0c79e5eda6cf057ebb54e67b833f610ef8a40c5f58d7d3567dac0bd744be184e","observation_id":"fc6fa419-fd49-4951-9550-9907b2548d11","resolution":{"observed_at":"2026-08-16T00:31:27.668711Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.418416Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.418416Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:85d96b3a943d4ed870314bfab762fb4197483c8f88edd0a875d75616a7bcf22d","observation_id":"20d81a4c-eb67-4652-a8e9-22648a8d5da1","resolution":{"observed_at":"2026-08-16T00:31:27.418416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.421760Z","title":"Au-air: A multi-modal unmanned aerial vehicle dataset for low altitude traffic surveillance,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.421760Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:d87ff0a224f773033f753731cd09ec2f3620c6c5c499e46e684a02a7e386a435","observation_id":"48bdafe8-15ee-4f2e-9a24-d0b1c20a6d47","resolution":{"observed_at":"2026-08-16T00:31:27.421760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.643066Z","title":"Webuav-3m: A benchmark for unveiling the power of million- scale deep uav tracking,","venue":null,"work_id":"56472c98-e80f-451d-87f1-362c72b3cf0f","year":2022},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.425387Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:37a230cac79e03333a24bacb310d19a0e7032914c00091ce3fed33711e60254c","observation_id":"563514e4-d2b0-4ed3-b14e-ab8460831e53","resolution":{"observed_at":"2026-08-16T00:31:28.646994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.631890Z","title":"Visdrone-det2019: The vision meets drone object detection in image challenge results,","venue":null,"work_id":"7abc9cd6-233e-4131-b163-29c77ba7cac9","year":2019},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.428876Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:408ca373a511f1cfcf26c36116d2dc257aab144dd7b028ac9c05e0e023350e47","observation_id":"20a9576c-9880-4321-9ec5-6203ca32852d","resolution":{"observed_at":"2026-08-16T00:31:28.636084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.621248Z","title":"Semantic drone dataset,","venue":null,"work_id":"3f187d7c-eded-4cd9-8477-415450c1fe9d","year":2019},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.431580Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:b64f7c0343aaa5fa8664a6eaeb0220eabe595d6bd9e744495b128534c6abcb22","observation_id":"feb753c5-a7bc-4337-8017-10c5bc9c8518","resolution":{"observed_at":"2026-08-16T00:31:28.624675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.434431Z","title":"Drone-based rgb-infrared cross- modality vehicle detection via uncertainty-aware learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.434431Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:e4110e9e21e990c546b297070feea22c377c495bd306528d6fe1bca30b96e059","observation_id":"a00e629e-3715-4fe6-9515-728a596eea46","resolution":{"observed_at":"2026-08-16T00:31:27.434431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.437160Z","title":"Vdd: Varied drone dataset for semantic segmentation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.437160Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:e3ac5ddefdee9ef903df014e127bc275001910255d72aea3fe748e18289d39a2","observation_id":"a6df930a-9bab-40b1-a3b1-b6a47abadf9b","resolution":{"observed_at":"2026-08-16T00:31:27.437160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.596652Z","title":"Large-scale structure from motion with semantic constraints of aerial images,","venue":null,"work_id":"c01f7b8a-8e51-4dfe-a8d8-e46ac6817a89","year":2018},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.440209Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:aecbdae7f79901bd0588d7f6ab6c980078484f609805ac7c6285716c28d01ecf","observation_id":"af02ae8d-c27e-4005-b924-02e5f0c22608","resolution":{"observed_at":"2026-08-16T00:31:28.600535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.443026Z","title":"Uavid: A semantic segmentation dataset for uav imagery,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.443026Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:55a72d6669bca9da0874097cefe0f9a2b7b97662584e35cf8d43d829a74de577","observation_id":"e0569390-b131-47a0-868e-1a52a25b3cc2","resolution":{"observed_at":"2026-08-16T00:31:27.443026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.579563Z","title":"Wilduav: Monocular uav dataset for depth estimation tasks,","venue":null,"work_id":"eb7bbc2b-8bb2-4535-ad0f-e479b7e96041","year":2021},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.445863Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:1062360d5db4103dbf812e7c5c3f7e4e0a84e341e69813b75ee80b2bd7225d65","observation_id":"fe3a45f6-48e8-4105-85ea-ef5d7cf47f34","resolution":{"observed_at":"2026-08-16T00:31:28.583292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19833","last_updated":"2025-05-26T05:15:33Z","snapshot_observed_at":"2026-08-18T10:20:24.219721Z","submitted_at":"2024-09-30T00:11:40Z","title":"HazyDet: Open-Source Benchmark for Drone-View Object Detection with Depth-Cues in Hazy Scenes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19833","snapshot_observed_at":"2026-08-16T00:31:27.449187Z","title":"Hazydet: Open-source benchmark for drone-view object detec- tion with depth-cues in hazy scenes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.449187Z"},"links":{"cited_paper":"/paper/2409.19833","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:beb7ff263abf77a405ddc5b0457f4070682c1a30f39498f3828e5b07b769af4e","observation_id":"0357ab5e-5570-4f44-8424-838611675601","resolution":{"observed_at":"2026-08-16T00:31:27.449187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.569762Z","title":"Graph regularized flow attention network for video animal counting from drones,","venue":null,"work_id":"c19ccaf1-f5f2-4935-9e3b-5d30a753ecd7","year":2021},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.452938Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:020be96fb0b1851f844127403546f0a9da990148c57aa987188d13ec2314b004","observation_id":"d27f48d6-ab96-45ad-adda-985ca6d69a29","resolution":{"observed_at":"2026-08-16T00:31:28.573252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.559509Z","title":"A benchmark and simulator for uav tracking,","venue":null,"work_id":"3c6b6b18-ef75-4d86-bb9b-a113da0aa12e","year":2016},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.457011Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:d2baa7575f54bd7cfbc87124c2a6987395ac0c2233c37ad7c33d1246379094a5","observation_id":"1a89ec76-721b-4035-b1e6-9650f231495d","resolution":{"observed_at":"2026-08-16T00:31:28.562943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-08-15T23:16:19.228206Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-16T00:31:27.460565Z","title":"Depth anything 3: Recovering the visual space from any views,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.460565Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:90523550538d35ad68840f39bbe6db94069b4a2a9baf9ca208eddd7d8ba8684b","observation_id":"9f5c44dc-e5d8-445a-9951-12c95cf72dd1","resolution":{"observed_at":"2026-08-16T00:31:27.460565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-16T00:31:27.465038Z","title":"Qwen3-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.465038Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:71257c035a110cda2a5be4be2b7744243869db97065d49c991066df04b8ccbc3","observation_id":"9dba91f5-e108-4d0c-8b3b-598d9b3bc340","resolution":{"observed_at":"2026-08-16T00:31:27.465038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-16T00:31:27.468674Z","title":"Glm-4.5v and glm-4.1v-thinking: Towards versatile multimodal reasoning with scalable reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.468674Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:ece08d31a9f4bb3e5cd0d8f0fb36bd4ca8045e00e7dffca70d94ba033d9ee24c","observation_id":"5b50537b-3c82-40a7-85e7-c17eb5863428","resolution":{"observed_at":"2026-08-16T00:31:27.468674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:27.472535Z","title":"Qwen3.5: Accelerating productivity with native multimodal agents,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.472535Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:a7518f9d40edd186df2c8b87a9f926a9a8a79292f1ea9a81a57129bf97b1e7ef","observation_id":"a4cc5f43-ba47-4f60-8dcc-e957330a89fa","resolution":{"observed_at":"2026-08-16T00:31:27.472535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.541085Z","title":"Introducing gpt-5.2,","venue":null,"work_id":"8c13579a-bc10-4fc4-ad92-ac3de268458d","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.476072Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:bfe05a468b87c5d317f607caca957477fefea4070ab243caee8e3a21a247079a","observation_id":"755e62de-a8c8-4c5b-9135-4de8b5fc0911","resolution":{"observed_at":"2026-08-16T00:31:28.545105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.530375Z","title":"Gemini 3 pro and gemini 3 flash models,","venue":null,"work_id":"3fffd94e-21ee-49d5-ba98-22964b668ceb","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.479829Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:3a3c29ef11801064758bd93db665e510c5e7a0fb50d55a95436d9d7033991346","observation_id":"b5130d4f-40a2-40ff-bf9e-f9662f5e1391","resolution":{"observed_at":"2026-08-16T00:31:28.534338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.519710Z","title":"Qwen-agent: An agent framework based on qwen,","venue":null,"work_id":"06d124fe-f6c9-46cf-99c6-99067a91e679","year":2024},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.483382Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:feb2d4ddc788d718ff607d91348a621b5dd82229d21467d921365b7824939ad8","observation_id":"077a1e73-0aea-438a-9d58-29d830c89b29","resolution":{"observed_at":"2026-08-16T00:31:28.523597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.507499Z","title":"Choice: Benchmarking the remote sensing capabilities of large vision-language models,","venue":null,"work_id":"9b58f12f-9ef9-46f4-b2d0-a3786d948666","year":2025},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.487156Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:a4d23a4618c8d99b87429efb4fa1338f8bee4fb1c0163ecb8efed7ca86753d5c","observation_id":"3c374b9b-6025-43a5-bdcc-974d87661716","resolution":{"observed_at":"2026-08-16T00:31:28.511958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.483970Z","title":null,"venue":null,"work_id":"1bb70670-2bf3-4adb-a229-ba1c55d1a1cf","year":null},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.494886Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:de7d1af16e4b779706cccb7bf34db0a59338b523dbd0ff4e2bbb7af24cff0cc5","observation_id":"27a23c46-c6a7-45e3-953a-b5648a009d0f","resolution":{"observed_at":"2026-08-16T00:31:28.488005Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.472693Z","title":"◦Classify the object in region{<x 1><y1><x2><y2>}","venue":null,"work_id":"1773ee01-f974-4f5a-9a98-e3e1f0605e77","year":null},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.498768Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:470321713370b472c9a6b3256a6534334d586b594bd992f35df91fa09d297ca7","observation_id":"34a35d45-76de-4464-8aa6-1bf139429487","resolution":{"observed_at":"2026-08-16T00:31:28.476748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.460622Z","title":"◦Count all the{object}in this picture","venue":null,"work_id":"8b9e2202-8127-4668-b6a1-9aa9eeb7d2a7","year":null},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.502502Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:8b71565f8f69f381b0bae668070f2987bf133fb3db4f49b469ca8dae2bcd1d45","observation_id":"40eafc3f-ee13-4d5d-aa49-24cf7d65df1b","resolution":{"observed_at":"2026-08-16T00:31:28.464426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.449548Z","title":"◦Which color does the{object}in{<x 1><y1><x2><y2>}have? ◦Identify the driving direction (relative to the camera) of the{object}in{<x 1><y1><x2><y2>}","venue":null,"work_id":"d774e0f7-a314-4a0f-bb8b-c15df4d6594f","year":null},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.505741Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:bade1b0c0331a9830057ffb0a3e631a576c67dfabd1cee1ee6ede837460a99f6","observation_id":"5accec8a-da81-45ad-852b-8bfed2612d65","resolution":{"observed_at":"2026-08-16T00:31:28.453116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.439987Z","title":null,"venue":null,"work_id":"1077d55a-701a-4b63-a518-5dfbef19d069","year":null},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.509216Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:2766f8848c3a959a9d9bf024c3679fa63541873e10ff3230d23984a5bb5e149e","observation_id":"01ec38de-7eea-4f1e-a256-e2657a007991","resolution":{"observed_at":"2026-08-16T00:31:28.442992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.429916Z","title":"Yes\", \"No","venue":null,"work_id":"57d6dbeb-8dfd-4fd6-94e7-be5e63771786","year":null},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.512360Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:5983009786fc113b80a387bf78243827663c8487c7c9f927e259d0cd1010e123","observation_id":"ccc06e18-cd83-474a-bdae-19be10cdb9c7","resolution":{"observed_at":"2026-08-16T00:31:28.433322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.418404Z","title":"Q”, “O”, and “A","venue":null,"work_id":"f73fdc5b-c513-4984-80a9-ac15eba75b25","year":null},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.515805Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:3aa5098eb091a163ed0ad3b2228cb4d6a8a759e3c3f4480a23135d47055d5396","observation_id":"2fbf2747-4dc0-4ae0-90bc-2abdb12b614d","resolution":{"observed_at":"2026-08-16T00:31:28.422020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T00:31:28.495263Z","title":"He is currently a Professor with the College of Future In- formation Technology, Fudan University, Shanghai, China","venue":null,"work_id":"3da56dad-0518-4a6f-9900-66f5e6082fbb","year":2013},"citing_paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-16T00:31:27.490931Z"},"links":{"citing_paper":"/paper/2608.11738"},"observation_digest":"sha256:566fcc7726a2ea21698c949e7ea2fd41c87c1f713473cc3938f061c565390e68","observation_id":"803ab6ca-615c-4a4d-aa5f-54e44704ff68","resolution":{"observed_at":"2026-08-16T00:31:28.499622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.11738","last_updated":"2026-08-12T07:25:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T21:42:34.626026Z","submitted_at":"2026-08-12T07:25:32Z","title":"Advancing MLLM-based UAV Image Understanding and Reasoning: A Benchmark and a Training-Free Multi-Agent System"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":11,"verified_fuzzy":27},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2608.11738."}