{"as_of":"2026-08-18T00:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ba543875cd4d1617c74914d7952354e3084ea8d02c9d58494704b930b86b58b","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T06:02:45.207283Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:53:41.919618Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T00:44:12.303112Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16928","snapshot_observed_at":"2026-08-11T13:53:41.919618Z","title":"Av-dtec: Self-supervised audio-visual fusion for drone trajectory estimation and classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12698","last_updated":"2025-01-19T15:29:46Z","snapshot_observed_at":"2026-08-17T23:50:57.465202Z","submitted_at":"2024-12-17T09:16:28Z","title":"Audio Array-Based 3D UAV Trajectory Estimation with LiDAR Pseudo-Labeling","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T13:53:41.919618Z"},"links":{"cited_paper":"/paper/2412.16928","citing_paper":"/paper/2412.12698"},"observation_digest":"sha256:e69823d38ef092ce1497e059ae9e46ded6037f459f39c201396838d4810d95cb","observation_id":"9016e299-0688-4ee5-a657-6bc2e1de7280","resolution":{"observed_at":"2026-08-11T13:53:41.919618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16928","snapshot_observed_at":"2026-08-11T13:52:38.540517Z","title":"Av-dtec: Self-supervised audio-visual fusion for drone trajectory estimation and classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12716","last_updated":"2025-01-19T16:32:25Z","snapshot_observed_at":"2026-08-16T04:23:19.233892Z","submitted_at":"2024-12-17T09:30:31Z","title":"Unsupervised UAV 3D Trajectories Estimation with Sparse Point Clouds","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T13:52:38.540517Z"},"links":{"cited_paper":"/paper/2412.16928","citing_paper":"/paper/2412.12716"},"observation_digest":"sha256:69cefa8d31ba120d9b2877173d245021b6ed3ddfe46d5ed938d654986f870252","observation_id":"31e3929e-a21d-4d17-8d79-58c74c048a02","resolution":{"observed_at":"2026-08-11T13:52:38.540517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16928","snapshot_observed_at":"2026-08-11T13:33:09.322400Z","title":"Av-dtec: Self-supervised audio-visual fusion for drone trajectory estimation and classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13037","last_updated":"2025-03-01T05:16:22Z","snapshot_observed_at":"2026-08-17T14:09:28.211216Z","submitted_at":"2024-12-17T16:00:31Z","title":"TAME: Temporal Audio-based Mamba for Enhanced Drone Trajectory Estimation and Classification","version":7},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T13:33:09.322400Z"},"links":{"cited_paper":"/paper/2412.16928","citing_paper":"/paper/2412.13037"},"observation_digest":"sha256:64c6ce096c1ea273131c0797901d1352cef2206bd457ff5785d73bb28aa7d0a5","observation_id":"af837092-cf6a-4504-a617-2d816e4e1818","resolution":{"observed_at":"2026-08-11T13:33:09.322400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"cited_work":{"arxiv_id":"2412.16928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.16928","snapshot_observed_at":"2026-08-07T00:44:12.303112Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","venue":"cs.SD","work_id":"f9ed7dee-75c5-47d5-9cd4-6fbd445a4306","year":2024},"citing_paper":{"arxiv_id":"2506.13106","last_updated":"2025-06-16T05:31:41Z","snapshot_observed_at":"2026-08-16T04:22:26.137241Z","submitted_at":"2025-06-16T05:31:41Z","title":"Autonomous 3D Moving Target Encirclement and Interception with Range measurement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:44:06.501102Z"},"links":{"cited_paper":"/paper/2412.16928","citing_paper":"/paper/2506.13106"},"observation_digest":"sha256:02e28c83a744fcd1939aadb893e01693ece5805f98b1974b1e9ee9975cacaafb","observation_id":"08e31965-1135-4677-a47b-a5e62acc3246","resolution":{"observed_at":"2026-08-07T00:44:12.419219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.16928/citation-record","integrity":"/paper/2412.16928/integrity","json":"/paper/2412.16928/citation-record.json","paper":"/paper/2412.16928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.603412Z","title":"Unmanned aerial systems for civil applications: A review,","venue":null,"work_id":"796ef399-4b5e-46cc-9fc5-577c48920b03","year":2017},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.079154Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:b5c8611f5c71db0e64219890c1a24e5c94e3dbb3ba410379a1ec97709e13b379","observation_id":"aa6a6301-d9a9-49ad-8ba6-dbf948ead8c5","resolution":{"observed_at":"2026-08-11T06:02:45.607752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.083853Z","title":"Drone-surveillance for search and rescue in natural disaster,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.083853Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:93bcf1311970e9a746d816885845a63bf8e3b3a9eaeff1f33f411cb9a1f2980f","observation_id":"153e4f90-58b8-45df-92b9-b35446b6ea71","resolution":{"observed_at":"2026-08-11T06:02:45.083853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.585140Z","title":"Mobile technology platform project for monitoring and border surveillance of illegal migration and smuggling of goods,","venue":null,"work_id":"02178e50-f5af-4832-bc47-4fe0709bd7cd","year":2019},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.088187Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:c25704ec9974d6614111d071419caed058150895645181ac03a73acb117b2bed","observation_id":"8f86c2a9-7b44-4da1-aa0d-f093fe029d22","resolution":{"observed_at":"2026-08-11T06:02:45.589453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.092200Z","title":"Air-to-air visual detection of micro-uavs: An experimental evaluation of deep learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.092200Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:20e1bb70c97ed84289c549a50703abc950db16396c3430e64cc0a96052226b8d","observation_id":"e6a0a9f1-6d1e-4c05-ab5d-17b9a7561c61","resolution":{"observed_at":"2026-08-11T06:02:45.092200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.566138Z","title":"Dronechase: A mobile and automated cross-modality system for continuous drone tracking,","venue":null,"work_id":"983bf066-a60a-4dd4-b046-21a7e7031b72","year":2023},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.096376Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:eb0d266426bcc302141a75232601e42a29e07987ede4f041feebf9f1ba538857","observation_id":"51b4c0e0-8ffd-4029-8fa2-2dd211f634ea","resolution":{"observed_at":"2026-08-11T06:02:45.570531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16464","last_updated":"2024-05-26T07:21:18Z","snapshot_observed_at":"2026-08-16T13:49:22.220870Z","submitted_at":"2024-05-26T07:21:18Z","title":"Multi-Modal UAV Detection, Classification and Tracking Algorithm -- Technical Report for CVPR 2024 UG2 Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16464","snapshot_observed_at":"2026-08-11T06:02:45.100300Z","title":"Multi-modal uav detection, classification and tracking algorithm–technical report for cvpr 2024 ug2 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.100300Z"},"links":{"cited_paper":"/paper/2405.16464","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:8d793e16b1dc09ec379148d625f06121227217dd3a48c0e5fa2f87a99a65ec80","observation_id":"d99e0d0a-8ff4-40d8-9218-13404000cece","resolution":{"observed_at":"2026-08-11T06:02:45.100300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.105133Z","title":"Av-pedaware: Self- supervised audio-visual fusion for dynamic pedestrian awareness,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.105133Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:cfb00512d65158eecded05be3ea1fafd7ed525b2b280e0cb390bff11777d3b3e","observation_id":"f12e2831-1135-4231-bb51-b719ae0cbb0a","resolution":{"observed_at":"2026-08-11T06:02:45.105133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-11T06:02:45.109012Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.109012Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:7ee3474fe964c16d902087be4df33fe3b463fa6e1fbe027e6328f3d5f351c67c","observation_id":"d20ab443-7a3f-4d81-ab83-6109157933d1","resolution":{"observed_at":"2026-08-11T06:02:45.109012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.547398Z","title":"Vision-based anti-uav de- tection and tracking,","venue":null,"work_id":"2a3c0d62-704e-4a12-a281-bad927d05bd4","year":2022},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.113602Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:303c2a64b29c6dfc77b95da41e929026839ec36ce74581a6cec1fe2a8b182019","observation_id":"41048c13-1608-482c-abbd-83a481d10c4a","resolution":{"observed_at":"2026-08-11T06:02:45.551510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.535061Z","title":"Investigation of uav detection in images with complex backgrounds and rainy artifacts,","venue":null,"work_id":"28e09143-9dcb-456d-855c-c593bd8e520f","year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.117509Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:a1172ebc62b871fe78d8560e6466f650be9923f2330896797163341a4560912f","observation_id":"d77b932d-de0d-4cfc-a4ea-99869d07c737","resolution":{"observed_at":"2026-08-11T06:02:45.539469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.08466","last_updated":"2021-02-08T02:01:55Z","snapshot_observed_at":"2026-08-16T18:50:59.921874Z","submitted_at":"2021-01-21T07:00:15Z","title":"Anti-UAV: A Large Multi-Modal Benchmark for UAV Tracking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.08466","snapshot_observed_at":"2026-08-11T06:02:45.121407Z","title":"Anti-uav: A large multi-modal benchmark for uav tracking,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.121407Z"},"links":{"cited_paper":"/paper/2101.08466","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:414c5e2e66e51eca69f9a1d794de0b304e0320b39916d537586428ffcd2e8e93","observation_id":"d9276160-b313-4788-803d-1ae8c306a9ba","resolution":{"observed_at":"2026-08-11T06:02:45.121407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.09909","last_updated":"2021-09-29T07:38:39Z","snapshot_observed_at":"2026-08-16T18:01:40.894612Z","submitted_at":"2021-08-23T03:27:36Z","title":"The 2nd Anti-UAV Workshop & Challenge: Methods and Results","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.09909","snapshot_observed_at":"2026-08-11T06:02:45.125881Z","title":"The 2nd anti-uav workshop & challenge: Methods and results,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.125881Z"},"links":{"cited_paper":"/paper/2108.09909","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:3705854c06955fff6991c82011f31317a8c67ac3858e867a4d36e2fd85c77da3","observation_id":"ddefe9dd-75c4-435b-9ae1-fb733d1dfe56","resolution":{"observed_at":"2026-08-11T06:02:45.125881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07290","last_updated":"2023-07-15T05:32:55Z","snapshot_observed_at":"2026-08-17T17:06:07.139171Z","submitted_at":"2023-05-12T07:37:04Z","title":"The 3rd Anti-UAV Workshop & Challenge: Methods and Results","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07290","snapshot_observed_at":"2026-08-11T06:02:45.130254Z","title":"The 3rd anti-uav workshop & challenge: Methods and results,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.130254Z"},"links":{"cited_paper":"/paper/2305.07290","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:72dea38136ee777ff083c5000a49c4ec84dad8ab2037b69a04103e76d86540d0","observation_id":"14994f7b-88d8-41eb-a566-567b772b396a","resolution":{"observed_at":"2026-08-11T06:02:45.130254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.522682Z","title":"A real-time and lightweight method for tiny airborne object detection,","venue":null,"work_id":"c9a6b9f7-8487-48a2-8229-19d971e89f87","year":2023},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.134612Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:114ca0e4dc873a0ea6745b538b55fa756f4b2606004dcd432d4a8a89588b82cd","observation_id":"a647e27b-a9a1-4807-b946-9c6cf5b20096","resolution":{"observed_at":"2026-08-11T06:02:45.526883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.510743Z","title":"Anti- uav410: A thermal infrared benchmark and customized scheme for tracking drones in the wild,","venue":null,"work_id":"bc26eab9-64c6-4577-9aa5-83424cb906ed","year":2023},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.138546Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:9701cad82cfb369a731c0d031079b4d72f8df25e16181115f01e6782d93247b8","observation_id":"3c2fb7c9-f46d-41c6-acb9-ff9735cb4458","resolution":{"observed_at":"2026-08-11T06:02:45.514770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.499014Z","title":"A large- scale uav audio dataset and audio-based uav classification using cnn,","venue":null,"work_id":"b2ef2260-4fe7-401b-80fb-2951730114d9","year":2022},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.142481Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:fae84c1ba69debceaf524113629eb80e64d70214f86d57d72afb6b54d79b769d","observation_id":"71e7b5db-3949-4a8f-8b52-14ea547d4401","resolution":{"observed_at":"2026-08-11T06:02:45.502970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.486625Z","title":"Exploiting wavelet scattering transform & 1d-cnn for unmanned aerial vehicle detection,","venue":null,"work_id":"ec066f86-16ff-4d32-89b3-e4ff08959cbf","year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.146621Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:74a1c168d1685cd38cdc365a7df08d86e9b672138083bc78b49e4dd54ea234dd","observation_id":"c5a7b9a2-7044-496c-93fb-c8afe53cfc54","resolution":{"observed_at":"2026-08-11T06:02:45.491202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.474433Z","title":"A vehicle-mounted radar- vision system for precisely positioning clustering uavs,","venue":null,"work_id":"109449b8-f677-44db-b6c8-62c20d8affb8","year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.150496Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:132e5b46778b76ead39da19a148845f54648eced212236d84b3517d86cd3b0e8","observation_id":"6766d455-d1b7-4962-9ebd-abff6cdfd789","resolution":{"observed_at":"2026-08-11T06:02:45.478738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.154542Z","title":"On onboard lidar-based flying object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.154542Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:24c7222dc5375c70ceea7f55bf65ce90189f93ed72fae8d3bae2725da73ae9c4","observation_id":"9b6d6f6b-c2a4-4c61-934e-dbe132b4b64f","resolution":{"observed_at":"2026-08-11T06:02:45.154542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.454778Z","title":"Soundspaces: Audio-visual navigation in 3d environments,","venue":null,"work_id":"89d6813b-4911-4a38-a449-0e2833a5e9c8","year":2020},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.158287Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:e1626391ee5acafb3be98a1c501d275210a6cfce1b5a6a5a748ac61cf582205e","observation_id":"dc19f5da-7eb8-4ffd-9a58-9f6955704fcf","resolution":{"observed_at":"2026-08-11T06:02:45.458879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.442895Z","title":null,"venue":null,"work_id":"e58c94e7-590e-41d2-a909-7c513ee4cf79","year":2020},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.163241Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:1ad0334aa2d6f522258ac57e43fa4fadb910e7c835d5cb18641f0df29d6d6fff","observation_id":"1d117a3d-d092-4dff-919c-7f536c0ecb3e","resolution":{"observed_at":"2026-08-11T06:02:45.446838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.167212Z","title":"Is someone speaking? exploring long-term temporal features for audio- visual active speaker detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.167212Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:95d149a26c0ae6dbb487edd7d1ef756b6355549c3779f8cf4dc100ba8a9d3155","observation_id":"c0330a46-418f-4e1c-94a0-9776be2c7ffc","resolution":{"observed_at":"2026-08-11T06:02:45.167212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.419539Z","title":"Egocentric deep multi- channel audio-visual active speaker localization,","venue":null,"work_id":"0092f2b8-29cf-4c06-ac72-adc6c92697af","year":2022},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.171064Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:fc5a3a64069c1a93896653c107973d4f2a993d8abe11680c9a66546c233eb070","observation_id":"93344ab4-4325-4b72-8ee9-07dd38c27770","resolution":{"observed_at":"2026-08-11T06:02:45.424045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.406085Z","title":"There is more than meets the eye: Self-supervised multi-object detection and tracking with sound by distilling multimodal knowledge,","venue":null,"work_id":"20d31048-68be-4cab-82aa-936da611af4a","year":2021},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.174887Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:aba855db503fb006cec7390733d61ee92c1abb1ff9e6eb9896d063b70f5d6c42","observation_id":"c8c796c7-4c06-48f0-a4a3-835a21ba46d8","resolution":{"observed_at":"2026-08-11T06:02:45.410623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.392782Z","title":"Self-supervised moving vehicle tracking with stereo sound,","venue":null,"work_id":"ca0ee655-ef81-44aa-baf6-d57bc8aaead6","year":2019},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.178701Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:3c377eea34ea8859f633d6816635d543a939be5bd3542e038f23ac58f73cbbfa","observation_id":"b1ee6530-6703-4655-969c-464abb1a5308","resolution":{"observed_at":"2026-08-11T06:02:45.397146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.380225Z","title":"Av-fdti: Audio-visual fusion for drone threat identification,","venue":null,"work_id":"cbbb0a10-8b02-4805-a90b-55619e9b5354","year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.182784Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:496d415cebe1027dc1d6f37ef2494aa7f53538636c6a3c313f55bbdf12f1f2fe","observation_id":"2d198b78-1b82-44e3-bf5f-bf9c972bd884","resolution":{"observed_at":"2026-08-11T06:02:45.384585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.367395Z","title":"An image is worth 16x16 words: Transformers for image recogni- tion at scale,","venue":null,"work_id":"0d5adbae-b2f7-48aa-b688-9915af7fad4a","year":2021},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.186725Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:75e8b03a9cc6504783d59fa955d16595f472c4fc23b808c1c8c98b922ca94428","observation_id":"d31f3a90-2ada-427f-bf41-669d27718f7a","resolution":{"observed_at":"2026-08-11T06:02:45.371657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-08-14T11:12:31.002605Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-11T06:02:45.190718Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.190718Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:b45d16389ae2682355724946d51d5a49611ed9dd3b2f73e46f2ad4b72f7cacca","observation_id":"f9d13598-a528-4519-9227-bac99f9dd5c8","resolution":{"observed_at":"2026-08-11T06:02:45.190718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.195298Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.195298Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:42aac24d8c2b6cf337b4b5fbdb806d3ebfd3e20e93400d5f564a36d1b18eb7bd","observation_id":"23df8787-8507-4d63-b356-6281ec6c5657","resolution":{"observed_at":"2026-08-11T06:02:45.195298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10934","last_updated":"2020-04-23T02:10:02Z","snapshot_observed_at":"2026-08-16T04:20:57.069798Z","submitted_at":"2020-04-23T02:10:02Z","title":"YOLOv4: Optimal Speed and Accuracy of Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10934","snapshot_observed_at":"2026-08-11T06:02:45.199197Z","title":"Yolov4: Op- timal speed and accuracy of object detection,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.199197Z"},"links":{"cited_paper":"/paper/2004.10934","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:947e396398d1e720abe331cd861436303f37edaf235490abbed73e155dbc092a","observation_id":"b8ed768d-953a-4954-9673-a2b9536c7bae","resolution":{"observed_at":"2026-08-11T06:02:45.199197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16867","last_updated":"2024-05-27T06:33:25Z","snapshot_observed_at":"2026-08-16T13:49:11.354038Z","submitted_at":"2024-05-27T06:33:25Z","title":"Clustering-based Learning for UAV Tracking and Pose Estimation","version":1},"cited_work":{"arxiv_id":"2405.16867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.16867","snapshot_observed_at":"2026-08-11T06:02:45.239078Z","title":"Clustering-based Learning for UAV Tracking and Pose Estimation","venue":"cs.RO","work_id":"9987e8b2-3ad1-4f8a-8772-1ec95f0e6d59","year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.203179Z"},"links":{"cited_paper":"/paper/2405.16867","citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:9c03e83f8668133b02120cc51da37acdafa29cf7b23a0435a0198495d403c4fa","observation_id":"7350dcc0-0987-4ef9-93a9-8de919c591e9","resolution":{"observed_at":"2026-08-11T06:02:45.245828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T06:02:45.346622Z","title":"MMAUD: A Comprehensive Multi-Modal Anti- UA V Dataset for Modern Miniature Drone Threats,","venue":null,"work_id":"eddea17b-1781-42d6-a288-d4e504ee4ef8","year":2024},"citing_paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T06:02:45.207283Z"},"links":{"citing_paper":"/paper/2412.16928"},"observation_digest":"sha256:9c36e0c149fad023d687c662dfebc667d97c4348b4f49bec3aa4de63f7585d76","observation_id":"3515e056-a87f-4516-88cd-a2e54d5a8072","resolution":{"observed_at":"2026-08-11T06:02:45.350750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.16928","last_updated":"2024-12-22T08:58:15Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-17T23:51:03.220623Z","submitted_at":"2024-12-22T08:58:15Z","title":"AV-DTEC: Self-Supervised Audio-Visual Fusion for Drone Trajectory Estimation and Classification"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 4 inbound Pith citation observations for arXiv:2412.16928."}