{"as_of":"2026-08-08T05:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1745468e9a76205fd3a06b06974e5e3ed683818b54ce39ec7581eeea985310c","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:40:34.320493Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T17:16:38.347066Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T15:15:47.200997Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"cited_work":{"arxiv_id":"2506.07375","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07375","snapshot_observed_at":"2026-07-01T15:15:47.200997Z","title":"Dino-codt: Multi-class collaborative detection and tracking with vision foundation models,","venue":null,"work_id":"1ee98816-06ed-4517-99e7-1dbfd9fcd5cc","year":2025},"citing_paper":{"arxiv_id":"2605.24025","last_updated":"2026-05-20T13:39:48Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-20T13:39:48Z","title":"Towards Large Model Feature Coding","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-30T17:16:38.347066Z"},"links":{"cited_paper":"/paper/2506.07375","citing_paper":"/paper/2605.24025"},"observation_digest":"sha256:ef60089669cb3c95e37da0683608c853b49a87523f52c7e7087bd8c1c5d5e082","observation_id":"0b69c2fe-00b0-4969-9666-6d6c646795f0","resolution":{"observed_at":"2026-07-01T15:15:47.203056Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07375/citation-record","integrity":"/paper/2506.07375/integrity","json":"/paper/2506.07375/citation-record.json","paper":"/paper/2506.07375"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.668287Z","title":"Macim: Multi-agent collaborative implicit mapping,","venue":null,"work_id":"f16c23cb-a21a-4a9d-bed8-aa8144ade6c0","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.211083Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:2cfd7dec5ea90649a354e39bc235a6b642320b6589d549511d7e04d34837d134","observation_id":"2b5301dd-9456-48e9-9533-b25143c47a6a","resolution":{"observed_at":"2026-08-07T05:40:34.672771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.657340Z","title":"Multi- view robust collaborative localization in high outlier ratio scenes based on semantic features,","venue":null,"work_id":"66f33bd3-e0da-4fda-8975-17d91e9585b9","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.215096Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:9c601e2d876fb96ee2c61f20eee443c543d7992909fa8201c2abe4831fd3f258","observation_id":"6ea01c9b-fe1e-4bf1-82a6-bcc05056754e","resolution":{"observed_at":"2026-08-07T05:40:34.661333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.645722Z","title":"Collaborative 3d object detection for autonomous vehicles via learnable communications,","venue":null,"work_id":"fa9a5a8f-2b54-43fb-b7cd-91a4f83a0460","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.218896Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:2e98086a0a85f11f436d64df96c5c0e2d3cbd1d31b1d625d22ff2f74dc34f5a0","observation_id":"46052037-7cb2-4f44-9dac-a65a0e12fe88","resolution":{"observed_at":"2026-08-07T05:40:34.649981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.634499Z","title":"F-cooper: Feature based cooperative perception for autonomous vehicle edge computing system using 3D point clouds,","venue":null,"work_id":"7b4288f0-b1c2-4cb1-95bb-cff0030a7802","year":2019},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.222572Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:841eeb72b180677ae26f151b0fdb2b29ec9660a5453b62d0497a19c12080200c","observation_id":"76cd70cf-ded9-4f96-9fcc-0e36a1eafdd9","resolution":{"observed_at":"2026-08-07T05:40:34.638407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.622512Z","title":"V2x-vit: Vehicle-to-everything cooperative perception with vision transformer,","venue":null,"work_id":"e8c9a23d-bef2-464c-9384-57b1ea478131","year":2022},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.226335Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:522c951a7454e11c85e474f0b59fb90711dc3c0e0a69f411e77b8222e08bb9e6","observation_id":"61d94fb0-4c2e-467c-9c89-9216a5cba8d6","resolution":{"observed_at":"2026-08-07T05:40:34.626578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.610350Z","title":"Robust collaborative perception against temporal information disturbance,","venue":null,"work_id":"8a6b2e1c-3ff3-47a1-a150-7a24d04b21f7","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.229942Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:2cb99df85be14235ad7c7e728b9a239cb2ccd89afb25d1b653a94cde9fb77c1e","observation_id":"196c12cc-7354-4e7d-a49a-819f763f2194","resolution":{"observed_at":"2026-08-07T05:40:34.614498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.598826Z","title":"Opv2v: An open benchmark dataset and fusion pipeline for perception with vehicle-to- vehicle communication,","venue":null,"work_id":"6719d996-ad41-47d3-b558-7067943f4663","year":2022},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.233705Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:366cd83b8e36aae79c71fdf20d674407bc7de814ddf22dc09fbdcb41ca936de0","observation_id":"19248bbe-28b6-4f5a-abd5-3e3a26f92a3c","resolution":{"observed_at":"2026-08-07T05:40:34.603033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.586904Z","title":"V2x-real: a largs-scale dataset for vehicle-to-everything cooperative perception,","venue":null,"work_id":"7e9a0d1a-fb68-4a08-92f7-c74399c54e7b","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.237029Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:1e60528f8dfb0fc7e5b7b4470ef10694012bf64c9499ea47ad02ec654d50d400","observation_id":"a08d0ef1-b5bc-4b8f-a21c-cf5635839a11","resolution":{"observed_at":"2026-08-07T05:40:34.590923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.575296Z","title":"Efficient vehicle- infrastructure collaborative perception based on vehicle re-identification and mini-icp algorithm,","venue":null,"work_id":"24cd1737-3833-4e60-bfff-7f2f323a4dcc","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.240502Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:7a31fd6fc420cce5de66021b8d3bfce3ae6d3b8d830f0f0e63673f74c1525f60","observation_id":"4b9605b7-ea3c-4b94-b2b4-2f71586ae24a","resolution":{"observed_at":"2026-08-07T05:40:34.579440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.563449Z","title":"V2vformer++: Multi-modal vehicle-to-vehicle cooperative perception via global-local transformer,","venue":null,"work_id":"73501111-a011-4961-a781-798e8ec5fee8","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.244531Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:676bc22e026efa2bf69c9a13a7380c7bb8ee1cb1f39e004bea6e84e16daaf7b5","observation_id":"76dae3d4-ea14-4eed-ab2c-cfb8affc30d9","resolution":{"observed_at":"2026-08-07T05:40:34.567721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.551789Z","title":"Probabilistic 3d multi-object cooperative tracking for autonomous driving via differ- entiable multi-sensor kalman filter,","venue":null,"work_id":"f0008f73-3a1c-418c-b62b-13f0ee8d44f3","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.248508Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:fe8350f7cb03c12b7394b5ba59a2aeec39be0748c884d71afd4d6b5838bf3eab","observation_id":"9dfe6f54-2c4d-4485-8a7b-ba506d9dfc29","resolution":{"observed_at":"2026-08-07T05:40:34.555765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.540323Z","title":"Fast-poly: A fast polyhedral algorithm for 3d multi-object tracking,","venue":null,"work_id":"61b4ae15-9b0c-4485-95f3-3cab73a990f0","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.251959Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:915bead84280e1ff787056d81d340754930b5cfa9ea1caddec73b7d81653845f","observation_id":"e155cbf2-daf7-45dd-aced-6e6623e18aa9","resolution":{"observed_at":"2026-08-07T05:40:34.544883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.255319Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.255319Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:036d61f574dce72d4dcbaf8b0563e12a42641da854d4ff3cd17ac9e7515b06fe","observation_id":"9432761f-44a0-4be3-9b00-0c1fceadbae5","resolution":{"observed_at":"2026-08-07T05:40:34.255319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.522334Z","title":"Conftrack: Kalman filter-based multi-person tracking by utilizing confidence score of detection box,","venue":null,"work_id":"8089a51c-24ef-4064-8c3e-ff1729789617","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.258655Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:471431004d8734d29d27fb9451686bcafebc0c28482e2da65e4d99919467d48b","observation_id":"f624ce42-f7eb-494d-9aa9-63712e2fa198","resolution":{"observed_at":"2026-08-07T05:40:34.526829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.511701Z","title":"AB3DMOT: A Baseline for 3D Multi-Object Tracking and New Evaluation Metrics,","venue":null,"work_id":"69ed27cb-97c0-442b-8c98-a32f03350087","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.262058Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:55f4960bbde0ab3fae2b9cebc6f700095f9ffb1416c88282525d5a77203a7762","observation_id":"cebf673a-42ca-4075-8806-f74f819dd39f","resolution":{"observed_at":"2026-08-07T05:40:34.515377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.500725Z","title":"Cooper: Cooperative perception for connected autonomous vehicles based on 3d point clouds,","venue":null,"work_id":"311a3b47-cc73-4077-8be7-25d4cb386c17","year":2019},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.265540Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:273203fa809676f25017941d2ab5c6e6232c69db8b3161c6cbdb06f8fa35f853","observation_id":"ed151d4c-4cc9-4ae6-a02c-a85b1d79b8e2","resolution":{"observed_at":"2026-08-07T05:40:34.504862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.490156Z","title":"Cooperative perception for 3d object detection in driving scenarios using infrastruc- ture sensors,","venue":null,"work_id":"1bc9fcc6-08d9-491f-82b2-40670a8bbea7","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.268787Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:4cebed314fc4784741838eb4bfeff82a599cf1a08863d75b4c85ef4b64cc2768","observation_id":"0f93fc68-f10b-4343-bf64-02a2b7d5492a","resolution":{"observed_at":"2026-08-07T05:40:34.493930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.479668Z","title":"Object detection with discriminatively trained part-based models,","venue":null,"work_id":"3fd38ee3-1193-4ef5-b788-a30556cb5b83","year":2009},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.272296Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:5d448d72c23fcbae7303083538345951a87cd4f4263009255f8f03838d46645b","observation_id":"8c2bd0d3-f27e-43cc-8fcd-182cf2c2313b","resolution":{"observed_at":"2026-08-07T05:40:34.483349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.468531Z","title":"V2vnet: Vehicle-to-vehicle communication for joint perception and prediction,","venue":null,"work_id":"e67d3c0a-ddf7-4eb9-81d8-4d31b68dcce3","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.275808Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:e3eec0a645e5a41a645a6cd17b7c66da728e8a90ecf41cb90c2da2acc8273c41","observation_id":"db46c5d3-0727-4d51-ba99-f5fd956ddfd3","resolution":{"observed_at":"2026-08-07T05:40:34.472138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.458705Z","title":"When2com: Multi-agent perception via communication graph grouping,","venue":null,"work_id":"d5655932-446f-4279-bf34-b4e64f77d471","year":2020},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.279304Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:3f22da9780dc84283f85c37d65ff3713130d14f336ccb210d97e5ba29f7462ee","observation_id":"70919f7d-2788-4877-9151-16ff2741f2fe","resolution":{"observed_at":"2026-08-07T05:40:34.462318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.447997Z","title":"Where2comm: Communication-efficient collaborative perception via spatial confidence maps,","venue":null,"work_id":"01d840d8-fb25-499e-9559-928d3b82709f","year":2022},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.282892Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:764285678d1c281839c9176beb4e6552cd016e5da9d390624c9930d52eabf587","observation_id":"c6247b37-8490-4e69-92ec-7107cb736e5d","resolution":{"observed_at":"2026-08-07T05:40:34.451975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.436285Z","title":"Select2Col: Leveraging spatial-temporal importance of se- mantic information for efficient collaborative perception,","venue":null,"work_id":"afe80c5e-395b-47a2-ae1d-f1e70121ae0c","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.287427Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:ed5bfd6eeef4eaadf47bd51ffd0e70db41f7e869620e8306fc9bfad75556ec1f","observation_id":"a93995ce-711e-44e7-8a9a-b390ed3b736b","resolution":{"observed_at":"2026-08-07T05:40:34.440140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.424885Z","title":"Collaboration helps camera overtake lidar in 3D detection,","venue":null,"work_id":"848bd472-af79-4202-8d94-3a512ed558be","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.291029Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:5033e926821a77bd82ee5b5dbf6185e121501c93259429808a17068d5847aea0","observation_id":"8c23272c-eca5-41b7-9c14-c17c83e30b5d","resolution":{"observed_at":"2026-08-07T05:40:34.429101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.412632Z","title":"CoBEVT: Coop- erative bird’s eye view semantic segmentation with sparse transformers,","venue":null,"work_id":"3d74f0d6-22e0-42d5-8cae-7251f4aee8a2","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.294531Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:ba0eed1e48fadc4c3621133f62cc56557e5545a123ce9e4d7901972b2474f563","observation_id":"3bfd63fd-eb56-4e60-8c1d-005c9d1142d9","resolution":{"observed_at":"2026-08-07T05:40:34.416560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.401087Z","title":"Dino-mot: 3d multi-object tracking with visual foundation model for pedestrian re- identification using visual memory mechanism,","venue":null,"work_id":"82ca47da-f773-488e-b6da-ac82556aff3c","year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.298050Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:dece312b8aa6d41daced67688ed670f6298510ab91f397a7d019d26f6b7f3d23","observation_id":"60e952c7-2cf6-45d1-821f-63597aa63701","resolution":{"observed_at":"2026-08-07T05:40:34.405633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.389979Z","title":"Quasi- dense similarity learning for multiple object tracking,","venue":null,"work_id":"7764f366-5fc2-4ad7-bdff-8ce6f71674d2","year":2021},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.301589Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:2e8b66a075424a3838e60d0b3d6d0c2b69bea6d6b6d321a0739b98135280461d","observation_id":"da138498-dd73-4482-b8de-70d866b18379","resolution":{"observed_at":"2026-08-07T05:40:34.393801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.305000Z","title":"Simple online and realtime tracking with a deep association metric,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.305000Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:abe543690aafbe6da66a94a7381d63b418c65f417b346652c57fd9bf26170b35","observation_id":"8efa25b4-8d0c-4727-ba1c-f19f77ab9208","resolution":{"observed_at":"2026-08-07T05:40:34.305000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01806","last_updated":"2024-10-02T17:59:57Z","snapshot_observed_at":"2026-07-31T01:10:11.839402Z","submitted_at":"2024-10-02T17:59:57Z","title":"Samba: Synchronized Set-of-Sequences Modeling for Multiple Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01806","snapshot_observed_at":"2026-08-07T05:40:34.308502Z","title":"Samba: Synchronized set-of-sequences modeling for end-to-end multi- ple object tracking,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.308502Z"},"links":{"cited_paper":"/paper/2410.01806","citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:9fb580cc8b24cc1c4d98e6e2084ec2131803c8b3c423f747ba2e150be45e86d7","observation_id":"35a5d8c5-29e5-44f7-80fe-e5d03df29023","resolution":{"observed_at":"2026-08-07T05:40:34.308502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.312606Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s-eye view representation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.312606Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:9f16c8a3561799c33271cbe6bf746d04a74e21d960ab489b93837c962b2cf137","observation_id":"db7701ec-1e3c-44e4-b5ec-cf5b17b8708a","resolution":{"observed_at":"2026-08-07T05:40:34.312606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.363108Z","title":"Assignment algorithms for multi-robot multi- target tracking with sufficient and limited sensing capability,","venue":null,"work_id":"08bc4657-5dee-4f28-a7dc-6380017cc90d","year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.317016Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:be327b90c30a210538eb05029548baffe0da072d1f088e09ad6916a198c4314c","observation_id":"6bea7e56-2745-4e40-affe-c88c355105d8","resolution":{"observed_at":"2026-08-07T05:40:34.369522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:40:34.320493Z","title":"Anyloc: Towards universal visual place recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:40:34.320493Z"},"links":{"citing_paper":"/paper/2506.07375"},"observation_digest":"sha256:05b25bb33a2e56b22b43d87ea69fed0a8e8a16f2b2d5d4ffad420a1fe1ebd151","observation_id":"8c72fe63-1643-42b8-b629-f62576aa0ec5","resolution":{"observed_at":"2026-08-07T05:40:34.320493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07375","last_updated":"2025-06-09T02:49:10Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:33:05.699428Z","submitted_at":"2025-06-09T02:49:10Z","title":"DINO-CoDT: Multi-class Collaborative Detection and Tracking with Vision Foundation Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2506.07375."}