{"as_of":"2026-08-12T22:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b85eb233377c03533e1699a2aa7b3503fd04e46d46f8dfab7c0ae931d854d57","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T12:00:12.377435Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.23803/citation-record","integrity":"/paper/2607.23803/integrity","json":"/paper/2607.23803/citation-record.json","paper":"/paper/2607.23803"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.034369Z","title":"Secap: self- calibrating and adaptive prompts for cross-view person re-identification in aerial-ground networks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.034369Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:3d07ef5ebc3ed7c5052470029f67f707593be2a5cf288b44a1e64523e32451c1","observation_id":"0bb8d573-859b-47b1-9d40-bd1cf36bb0dc","resolution":{"observed_at":"2026-07-30T12:00:12.034369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.040661Z","title":"Generalizable person re-identification from a 3d perspective: Address- ing unpredictable viewpoint changes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.040661Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:f76a084c859259da9cb6c4725e94e5293772c550a118549943c53774496a8acd","observation_id":"256d1345-1a34-4637-a214-01166fdb86da","resolution":{"observed_at":"2026-07-30T12:00:12.040661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.045728Z","title":"Posture-aware robust person re-identification via optimal transport calibration,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.045728Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:23db9b50c09bb41c349cbe50b8675d7c134888e85b1aa8c028d7ee4480ace612","observation_id":"6332e25a-5f23-47e8-896e-b60ce068c07a","resolution":{"observed_at":"2026-07-30T12:00:12.045728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.052154Z","title":"Famnet: Joint learning of feature, affinity and multi-dimensional assignment for online multiple object tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.052154Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:ecd9e35efee7f54691def43c1db208c92e039cfd89fbe63a546056b8803410d5","observation_id":"f36cbc4a-f0f1-4aae-9f83-bed247686da1","resolution":{"observed_at":"2026-07-30T12:00:12.052154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.057769Z","title":"Deep affinity network for multiple object tracking,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.057769Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:3c7561b3808a404f199b6b8fd23f2cd20a662c68b150da85c5ced67a97043500","observation_id":"ceca164a-e505-4628-aa33-c6912586734a","resolution":{"observed_at":"2026-07-30T12:00:12.057769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.062781Z","title":"Robust privacy-preserving motion detection and object tracking in encrypted streaming video,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.062781Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:965342223548f5247c3b6f322b46dabb73c3479d671dd80e5a56cba5c4870768","observation_id":"3f7a5dfb-46fe-45ce-80b4-223ab913f5e2","resolution":{"observed_at":"2026-07-30T12:00:12.062781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.067931Z","title":"The p- destre: A fully annotated dataset for pedestrian detection, tracking, and short/long-term re-identification from aerial devices,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.067931Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:fb6fb35137ffd978e30e64763e73719255ddde90d86b29b89481faa75a896c67","observation_id":"8c9f0f93-9ece-4e2c-ad16-cdc84727caba","resolution":{"observed_at":"2026-07-30T12:00:12.067931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.074239Z","title":"Self-supervised multi-view multi-human association and tracking,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.074239Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:9f84d0710af3668aaa525a54388aac655d28a482b6d79c7eb1ccacd8e096c806","observation_id":"1b4e6f91-4cb8-493b-a701-be69e63cbd6d","resolution":{"observed_at":"2026-07-30T12:00:12.074239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.080152Z","title":"Unveiling the power of self-supervision for multi-view multi-human association and tracking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.080152Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:4bcb89e5d0008cdcd343926130c03d3567cf0c61ad44605849305690fab77d8c","observation_id":"4215d2ee-307f-47b4-a233-48cf76e7f96d","resolution":{"observed_at":"2026-07-30T12:00:12.080152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.084722Z","title":"Divotrack: A novel dataset and baseline method for cross- view multi-object tracking in diverse open scenes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.084722Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:64d7a6dc315ec9a12a66e11f5e3ce2fbbd8ada43d80e963bf34d3cb170438d65","observation_id":"8fe22cbf-df27-4b4b-b4e2-4760baaf7c33","resolution":{"observed_at":"2026-07-30T12:00:12.084722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.089723Z","title":"Benchmark- ing the complementary-view multi-human association and tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.089723Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:c01f3b2dfeba508eaa8b4ddbfea2a125560de422ed4a06719c1071b655ce247c","observation_id":"535f438d-cfee-4c5c-ba40-33782bad3a9d","resolution":{"observed_at":"2026-07-30T12:00:12.089723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.094850Z","title":"Robust multi-drone multi-target tracking to resolve target occlusion: A benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.094850Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:b20aa34e1c793e5b3e691d4695e0d614abc984565b3a851329abd316f309209a","observation_id":"cbad3a18-2973-4290-b13e-7c5869762112","resolution":{"observed_at":"2026-07-30T12:00:12.094850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.099558Z","title":"Neural mech- anisms of context effects on face recognition: automatic binding and context shift decrements,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.099558Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:1482b2236e9bc53a0465e637e55246e9001d8d4ebc65fe88b5c42a0f2ed5ea92","observation_id":"68fcfe9f-1dbe-494b-bf1c-c044698e8ab9","resolution":{"observed_at":"2026-07-30T12:00:12.099558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.104203Z","title":"Unaware person recognition from the body when face identification fails,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.104203Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:56ebb4bc3d2764b73bd5a70d1b047105206f2ca973332be127342f790bf429e0","observation_id":"a5fc8932-01ce-4d14-a91d-e7bc5451b5b6","resolution":{"observed_at":"2026-07-30T12:00:12.104203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.108590Z","title":"Separated and overlapping neural coding of face and body identity,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.108590Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:08c3bddea1deeb83137ac47f804c4eb870f59788b2f334b0ed744b1f9c31d152","observation_id":"894ae674-4b3c-4c40-b0a4-06f0cb1a6fad","resolution":{"observed_at":"2026-07-30T12:00:12.108590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.113452Z","title":"Visual perception of biological motion and a model for its analysis,","venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.113452Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:1503c6bad7e903e328d6680ff60f06b02a9e11fd08ea772cb3838876f3943c18","observation_id":"92bda0bd-f4c1-4f53-b7a0-47d84a4fa8a4","resolution":{"observed_at":"2026-07-30T12:00:12.113452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.118617Z","title":"Learning multi-attention context graph for group-based re-identification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.118617Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:3330eef44d7ce6e6fe1177ea57ed29df0be4ea29ddc9d1f8f698b2dc0f1828e4","observation_id":"2a6dc711-e5dc-45b4-a4fd-0df7894abf53","resolution":{"observed_at":"2026-07-30T12:00:12.118617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.123532Z","title":"3-d personvlad: Learning deep global representations for video-based person reidentification,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.123532Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:e7972240fa7f15f74dfc6397206dbdeeec3dbf2edaa57e1bf22bdc6d1dd7fc83","observation_id":"fd98bbe6-7a2e-4b5a-86b1-63324aac31e4","resolution":{"observed_at":"2026-07-30T12:00:12.123532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.129664Z","title":"A strong baseline and batch normalization neck for deep person re-identification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.129664Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:11d1af7d7dba39159fec06fff223cb28fbc8bd96b323861c4c51f4338558a22f","observation_id":"c2eb239b-f5e7-45b3-823e-f37dd7f54901","resolution":{"observed_at":"2026-07-30T12:00:12.129664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.135760Z","title":"Beyond part models: Person retrieval with refined part pooling (and a strong convolutional baseline),","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.135760Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:5eda9be32c91982cff5e0ab14043958368394bc564f7b59928308dd8c8f2a369","observation_id":"b2b9e9fb-ec86-4195-ad64-bae346209402","resolution":{"observed_at":"2026-07-30T12:00:12.135760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.142910Z","title":"Learning discriminative features with multiple granularities for person re-identification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.142910Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:a6818b2b6d61f4031d219e3dad725258003a81cdb2feb433a8502541b0de07e5","observation_id":"4df41665-5548-4666-8638-901488df4e8b","resolution":{"observed_at":"2026-07-30T12:00:12.142910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.148412Z","title":"Deep metric learning for person re-identification,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.148412Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:5e18853464b8e988fc3211787d2bc8661829f29cbcc00fbbfb260ecc51e94ab2","observation_id":"a9f5dd24-4912-4bb3-98fb-1f1089ef136f","resolution":{"observed_at":"2026-07-30T12:00:12.148412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.07737","last_updated":"2017-11-21T15:35:07Z","snapshot_observed_at":"2026-08-04T09:19:45.912586Z","submitted_at":"2017-03-22T16:34:29Z","title":"In Defense of the Triplet Loss for Person Re-Identification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.07737","snapshot_observed_at":"2026-07-30T12:00:12.153445Z","title":"In defense of the triplet loss for person re-identification,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.153445Z"},"links":{"cited_paper":"/paper/1703.07737","citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:4ba87b4e50c5c396eaaec059069b537b55b1a06ee8d09aac02e5c564f5e2a2c9","observation_id":"20fe3670-997a-4f3c-8b14-df4d1e11afe8","resolution":{"observed_at":"2026-07-30T12:00:12.153445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.159070Z","title":"Beyond triplet loss: A deep quadruplet network for person re-identification,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.159070Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:2f5367eefc9f69752a8065ace2d124e57f27f2ab791d77f8837fcb8228a5be3b","observation_id":"c434356c-23ca-41a1-80f7-f8225b9cd260","resolution":{"observed_at":"2026-07-30T12:00:12.159070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.165139Z","title":"Long-term cloth-changing person re-identification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.165139Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:937922ae0b485bbe682c8dfc887a339da8a0090724301ba5dbabb5ccb800f6c0","observation_id":"d94aad4f-6ddc-40bf-adae-a7305ef9f910","resolution":{"observed_at":"2026-07-30T12:00:12.165139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.170865Z","title":"Dynamically transformed instance normalization network for generalizable person re-identification,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.170865Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:5ee9f32a03ce701aaf5b954561825338e7351bba9d63a7c597586ea5d8157fd3","observation_id":"d68dfe08-741d-411b-89dd-b8df7616718e","resolution":{"observed_at":"2026-07-30T12:00:12.170865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.177898Z","title":"Enhanc- ing visible-infrared person re-identification with modality-and instance- aware adaptation learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.177898Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:cf581e4f6115c4eed438d932ac623f7491c72d33041748e132949d00792a8f12","observation_id":"03cb17fa-4ab5-41ad-ace2-73cb5939adda","resolution":{"observed_at":"2026-07-30T12:00:12.177898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.184769Z","title":"Vehicle re-identification in aerial imagery: Dataset and approach,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.184769Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:159ebfe70f2c31c85323b8e32b2762d911b1bce90c87cc3849fde25a89eefd6e","observation_id":"1b522f51-6169-4998-8ea0-52b5957ba1af","resolution":{"observed_at":"2026-07-30T12:00:12.184769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.197535Z","title":"Large-scale vehicle re-identification in urban surveillance videos,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.197535Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:301a8507a4683bdc9a47e907938c15a0cca9a32c93174df9abcc3b1be447d102","observation_id":"5936047f-bd82-4dbc-9e97-f70a33833fe8","resolution":{"observed_at":"2026-07-30T12:00:12.197535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.202860Z","title":"Toward re-identifying any animal,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.202860Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:05d906b652f80c3f64f18427c1d787851c83d47e36bd9a5ef8c9ec7c6b371afc","observation_id":"16ae7cdb-be0f-4243-837e-81259486094f","resolution":{"observed_at":"2026-07-30T12:00:12.202860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.207872Z","title":"Simple online and realtime tracking,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.207872Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:e79e4cee7b97254d61433316d649a0b64fff68a39dd493a5adca417b6ebdc3c0","observation_id":"7f132828-4e45-4265-82ae-486dd51c1c20","resolution":{"observed_at":"2026-07-30T12:00:12.207872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.212057Z","title":"Strongsort: Make deepsort great again,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.212057Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:552ce6ac537adb5dc1a128403596383892e4866573c5bd22d808461c2047c727","observation_id":"ab7eb24b-e6d3-4735-8f39-46263e520af3","resolution":{"observed_at":"2026-07-30T12:00:12.212057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.216829Z","title":"Multiple object tracking with correlation learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.216829Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:405ccd0824a5b0c4e021514f589114da80c3e455d412353c511fe21a80bb508b","observation_id":"dc0d7218-c0df-492d-b40a-a2fa9daf1a03","resolution":{"observed_at":"2026-07-30T12:00:12.216829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.222473Z","title":"Multi-object tracking: Decoupling features to solve the contradictory dilemma of feature requirements,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.222473Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:d8f509fc95958feea4aa7829856da32acc5ccef511a1b38e4b59ec3a2e74d30c","observation_id":"9f33e10a-3e85-4f7f-9f8e-009f6db7223c","resolution":{"observed_at":"2026-07-30T12:00:12.222473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.228594Z","title":"Tracking objects as points,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.228594Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:1cb9cc310117fcf2c44d9a8b2584d046c9ad839c3f65e5c3a1db0460dfbfc294","observation_id":"f96aba5e-53b3-47aa-8993-f1f2db41c617","resolution":{"observed_at":"2026-07-30T12:00:12.228594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.233884Z","title":"Retinatrack: Online single stage joint detection and tracking,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.233884Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:60e9239f0597c789a1fb58a5f3965e31392c2e670d00c959f104222cc966e945","observation_id":"c5813bf8-ab09-4a7f-9254-a06ea618f217","resolution":{"observed_at":"2026-07-30T12:00:12.233884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.238377Z","title":"3d multi-object tracking: A baseline and new evaluation metrics,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.238377Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:1220561fa4f466f14ac9b74e1feb78ed71139aa3cdc50b46757803fd1ea589b9","observation_id":"6f654e0e-a4e4-4551-a484-350cfa317268","resolution":{"observed_at":"2026-07-30T12:00:12.238377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.243007Z","title":"Complementary-view multiple human tracking,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.243007Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:36a454dc3950b32de195ff7d5f9688eaadefd247b475cf17b8771bd709351401","observation_id":"c2eb0118-1d4d-445f-a6dc-2c0ca87cb453","resolution":{"observed_at":"2026-07-30T12:00:12.243007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.247381Z","title":"Temporal-spatial feature interac- tion network for multi-drone multi-object tracking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.247381Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:beb923d26dd073493e9816047e1d28441c1f87741b808520b93cff44a5ee4756","observation_id":"d611a491-190a-4ec4-beb5-3e5f154a3de6","resolution":{"observed_at":"2026-07-30T12:00:12.247381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.253487Z","title":"Multi-view multi- human association with deep assignment network,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.253487Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:4821fba830cdf568e5fc315b98a8a6c1fdb1b6eab3bff686502f195381843cd0","observation_id":"70a1fd17-f161-4cfb-8c25-c52107ebd501","resolution":{"observed_at":"2026-07-30T12:00:12.253487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.259582Z","title":"Learning from syn- chronization: Self-supervised uncalibrated multi-view person association in challenging scenes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.259582Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:f69b368d61cc2b39c08f9340003ee7658bef31b40976b1671461259d2b92e51b","observation_id":"dc7a6f2d-cc26-47c1-9040-efd4f91c71ab","resolution":{"observed_at":"2026-07-30T12:00:12.259582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.267049Z","title":"Multi-view people tracking via hierarchical trajectory composition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.267049Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:0baad54bb501ae39f84b73621e2457981c185ddc5792546efdf8c2d66d4bc82e","observation_id":"3a856f64-ff9b-4ab2-b083-5c582a1abec9","resolution":{"observed_at":"2026-07-30T12:00:12.267049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.272074Z","title":"Multicamera people tracking with a probabilistic occupancy map,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.272074Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:7975638f54156792022d1291ab9b8fec2424eb36bb656b122c75bf1fec6f0c5f","observation_id":"50d4d4e2-f5c1-475f-bc10-a8f62a166cb2","resolution":{"observed_at":"2026-07-30T12:00:12.272074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.276901Z","title":"Wildtrack: A multi-camera hd dataset for dense unscripted pedestrian detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.276901Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:cbd7b54125d0a47119b3a3f4ac4b7f85dd6285fc72a3604c6e145e2631684c01","observation_id":"c4921bb0-d11f-422f-a65b-b00d1bce0bb8","resolution":{"observed_at":"2026-07-30T12:00:12.276901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.281259Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.281259Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:28045f4791caa83526b2e17e0ad908ea8fb1026fa4a60f8a808c9f202e5df7c6","observation_id":"99b7459a-784d-4267-a25a-46c036b7ae18","resolution":{"observed_at":"2026-07-30T12:00:12.281259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.286438Z","title":"3d human pose, shape and texture from low-resolution images and videos,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.286438Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:bcc0b5e32a2b10ce1ed3da0b932a33a25e6a810b61f9d3b8780f29f67f7fab52","observation_id":"59fb12bf-310b-4f9e-b626-1afdd6075697","resolution":{"observed_at":"2026-07-30T12:00:12.286438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.14491","last_updated":"2022-01-31T07:20:20Z","snapshot_observed_at":"2026-07-06T11:14:04.454155Z","submitted_at":"2021-05-30T10:17:58Z","title":"How Attentive are Graph Attention Networks?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.14491","snapshot_observed_at":"2026-07-30T12:00:12.291013Z","title":"How attentive are graph attention networks?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.291013Z"},"links":{"cited_paper":"/paper/2105.14491","citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:cc455d71d8e97d5cb1723721c625e61a5ccd54142d5f8d1aba145167e714049c","observation_id":"7cf6e8a9-8468-4996-a65a-b7aa502aebdc","resolution":{"observed_at":"2026-07-30T12:00:12.291013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.295979Z","title":"Invariant visual representation by single neurons in the human brain,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.295979Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:db109cb6ec5e2e18f7a1a83a047dbccaea6bb594393a350f99ec30863ad8c2b2","observation_id":"bc7617da-c5c7-49d2-943d-e35d231a154f","resolution":{"observed_at":"2026-07-30T12:00:12.295979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.300441Z","title":"Simple online and realtime tracking with a deep association metric,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.300441Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:58c9eb14d70e4c3ce42340705bc92891a97c993c38c21f447d753aa557c74ac9","observation_id":"3f9d7b05-cf41-4caa-9832-8fc62ad2d3cd","resolution":{"observed_at":"2026-07-30T12:00:12.300441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.305408Z","title":"Vitpose: Simple vision transformer baselines for human pose estimation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.305408Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:481c83b2bb2da9e4d11eb8cb67d2ed84abae0b957e36a81541954945909713c2","observation_id":"a04940c6-2333-400f-b697-6364ce5021f7","resolution":{"observed_at":"2026-07-30T12:00:12.305408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.309664Z","title":"Mmptrack: Large-scale densely annotated multi-camera multiple people tracking benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.309664Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:ac7858673fe9340f57955736b20c7a0685a5326957c1c8eb48439d925d10fd41","observation_id":"36240cae-7d5d-4a3e-8024-206e2a298234","resolution":{"observed_at":"2026-07-30T12:00:12.309664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.314107Z","title":"Lifting multi- view detection and tracking to the bird’s eye view,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.314107Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:170ccc985ed02ba9fc01c5e872cacf4e03211820a4bdc4924d3c63d42c36ca0f","observation_id":"56764476-acb5-4e95-add6-fd289bf70797","resolution":{"observed_at":"2026-07-30T12:00:12.314107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.318458Z","title":"Enhanced multi-view pedestrian detection using probabilistic occupancy volume,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.318458Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:ed1efe93b4ee1b831abf04cb72ebcba010211d1eb9363ad0683393cc584ee580","observation_id":"d4c79c11-58b5-413d-996a-7a87b31cc0a7","resolution":{"observed_at":"2026-07-30T12:00:12.318458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.323227Z","title":"Ultralytics yolov8,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.323227Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:a43233e67cb32d2019d4ebc1b3c1e1592313e24d8483e9d63706c2372e57cc67","observation_id":"b789e91d-45b3-4dbb-9a28-3ddaefe67d1b","resolution":{"observed_at":"2026-07-30T12:00:12.323227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.327586Z","title":"Detectron2,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.327586Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:a5d017b169ab5032767a7e5dcf138a85f6d443c9ba1cd37de096cf1622d96ad7","observation_id":"780a6136-459a-4748-b4e9-c95e4ee42d55","resolution":{"observed_at":"2026-07-30T12:00:12.327586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.332701Z","title":"Vitpose++: Vision transformer for generic body pose estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.332701Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:fa183f28d35efc04be643fee98ed9facce1c284e7edaf51a8a6597744067522d","observation_id":"adf37717-3d57-4cd9-8ddd-ed7fc65cb5bf","resolution":{"observed_at":"2026-07-30T12:00:12.332701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.338051Z","title":"Extract free dense labels from clip,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.338051Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:ec1cb1ffb4904c11f359b175ca30bc50bd6d840e935ab3f54b60c760c2780887","observation_id":"dcfd1442-ca3f-4dc3-a10b-4cbeac3fedd5","resolution":{"observed_at":"2026-07-30T12:00:12.338051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.344195Z","title":"Hota: A higher order metric for evaluating multi-object tracking,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.344195Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:0862c5b4f69ac046a83f47216eb632075530bed116f059f1826118cde59ccd32","observation_id":"7b678945-2b29-465b-9f1f-d09a1ed5c843","resolution":{"observed_at":"2026-07-30T12:00:12.344195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-07-30T12:00:12.348597Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.348597Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:6c3b92f7d5489b225e1da3823c809e746b48df4022dfa90cea7c12cce4accb7d","observation_id":"aeffd5ac-ed55-488b-be9b-b5efa8a46fed","resolution":{"observed_at":"2026-07-30T12:00:12.348597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.356476Z","title":"End-to-end recovery of human shape and pose,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.356476Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:d08fdacb2e9dcfd0960a4571376cbcfbcc416e1410c92dfb67f2695a00e4e4f1","observation_id":"9c905990-731e-4173-94b0-4472e4c875c9","resolution":{"observed_at":"2026-07-30T12:00:12.356476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.362224Z","title":"Tracking without bells and whistles,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.362224Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:d0b6f3250aef6dd0c6ec009b0011f5421e10175ff01f59a2afe91e9f8033d5ea","observation_id":"81c8f9ff-374e-4412-bf88-13ccbe861887","resolution":{"observed_at":"2026-07-30T12:00:12.362224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.367150Z","title":"Track to detect and segment: An online multi-object tracker,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.367150Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:665731b7b4d1972a8b9e922983358bee3126c658ce76a247b92c6d9af8a83c06","observation_id":"726bc4b7-6568-4624-ade9-1420930c19f1","resolution":{"observed_at":"2026-07-30T12:00:12.367150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.373007Z","title":"Track- former: Multi-object tracking with transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.373007Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:2f0d0101e9a5de1c1af0980b766351aff55cae7d4409300214d4d411bfa26a3e","observation_id":"cbed476a-0131-49ac-8bc7-d3d3eca05e1a","resolution":{"observed_at":"2026-07-30T12:00:12.373007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-30T12:00:12.377435Z","title":"Self-supervised multi-object tracking with cross-input consistency,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-30T12:00:12.377435Z"},"links":{"citing_paper":"/paper/2607.23803"},"observation_digest":"sha256:b3dc9ae38697262898f149bacf529d50b187b2eab099036cf068d1b3091a83cc","observation_id":"ab343e42-62e5-4a10-a27d-39d515726656","resolution":{"observed_at":"2026-07-30T12:00:12.377435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.23803","last_updated":"2026-07-26T19:06:04Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T04:02:24.376989Z","submitted_at":"2026-07-26T19:06:04Z","title":"Beyond Appearance: A Multi-cue Framework and Large-scale Benchmark for Pedestrian Association and Tracking on Mobile Aerial-Ground Platforms"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2607.23803."}