{"as_of":"2026-08-19T14:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:02bcdd928b2bb4ab02c51015b888b4b2326ea20c12ad9059c292445e77670bbb","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:54:19.165858Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.18855/citation-record","integrity":"/paper/2411.18855/integrity","json":"/paper/2411.18855/citation-record.json","paper":"/paper/2411.18855"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.866314Z","title":"https://github.com/got- 10k/ toolkit","venue":null,"work_id":"f7f8e9bd-35cb-4cf9-91ac-101eb5ed7960","year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.928212Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:78f56add120282adee3bec1069822a49d0a985f824c998e45b633f8b1bffa758","observation_id":"3a269d5a-b706-4ec2-bd31-50851354f59a","resolution":{"observed_at":"2026-08-12T10:54:19.869456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04795","last_updated":"2024-05-23T10:38:24Z","snapshot_observed_at":"2026-08-16T15:41:30.235177Z","submitted_at":"2023-04-10T18:01:47Z","title":"Evaluation of Test-Time Adaptation Under Computational Time Constraints","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04795","snapshot_observed_at":"2026-08-12T10:54:18.933271Z","title":"Revisiting test time adaptation under online evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.933271Z"},"links":{"cited_paper":"/paper/2304.04795","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:124fb6f7f0e766591908d89bb7d2a0563b98db0224c4c3ca9e47c6e44a5846c6","observation_id":"22b85741-ab30-4504-ace2-743882e38140","resolution":{"observed_at":"2026-08-12T10:54:18.933271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.856465Z","title":"Fully-convolutional siamese networks for object tracking","venue":null,"work_id":"41fec971-adcf-4a73-96d3-b31d9fdc5c7f","year":2016},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.937795Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:097a52f2ac7ee9f78c1ef97fe07002ac518666be998798719ae3b107d4345022","observation_id":"ec10e845-74e8-4e10-b9bd-5b404265a3a3","resolution":{"observed_at":"2026-08-12T10:54:19.859923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.846280Z","title":"Learning discriminative model prediction for track- ing","venue":null,"work_id":"cbfa7201-5076-450f-9f1b-341868d47476","year":2019},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.942023Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:13356c8265d69bf5e4060d8bc19fc327f46c7fdffeed15863cb979d4183d2a57","observation_id":"c057a5e2-01c2-46ab-ba74-d4a1cbf88f47","resolution":{"observed_at":"2026-08-12T10:54:19.849922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.835711Z","title":"Efficient visual tracking with exemplar trans- formers","venue":null,"work_id":"833b7a87-a3ab-479d-9391-cae922803490","year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.945711Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:ae2b385b03b6cc23d9b99d9f8316d1af303a19ecf0570f560575f0062cb9576c","observation_id":"ec85dc72-2eca-45c7-a62e-4a2a4b282a6c","resolution":{"observed_at":"2026-08-12T10:54:19.839232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.824532Z","title":"Fear: Fast, efficient, accu- rate and robust visual tracker","venue":null,"work_id":"89f1bd78-f291-409b-ac09-281eb0f12060","year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.949748Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:ad24a872201c71284ddc734518cbec20c1b7413e43c0616649f026255a9d932f","observation_id":"50fb92af-6e5d-416b-91f0-b7510e03e37e","resolution":{"observed_at":"2026-08-12T10:54:19.828761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.813921Z","title":"Exploring simple siamese rep- resentation learning","venue":null,"work_id":"bfca3b17-648c-43e1-89e5-5c1a99994cd9","year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.953689Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:981d9479615baee16336a6159b800cb16fb504742ae5449223d0ef0b24c6ed0b","observation_id":"7a7dc021-1497-41d7-b243-a7c2806ac58c","resolution":{"observed_at":"2026-08-12T10:54:19.817574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.802399Z","title":"Efficient visual tracking via hierarchical cross- attention transformer","venue":null,"work_id":"1bdf9afb-982b-45c0-b980-598f7a4cefd8","year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.957170Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:facc001327bb5ff5e284f952a3932b2c80d8b73e16572418b17801464ab62fa5","observation_id":"6a2665aa-7e84-404d-a28a-1422a9396ffe","resolution":{"observed_at":"2026-08-12T10:54:19.806893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.791075Z","title":"Seqtrack: Sequence to sequence learning for visual ob- ject tracking","venue":null,"work_id":"83c8a5b5-3f1c-45df-bd70-9b3ca3d99386","year":2023},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.961047Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:383d52944563bc7dd59b12110c3cf84ad9e54b72de29a3e6cf1a32f9073cfa48","observation_id":"ba2ce509-6abe-47d4-b175-6ff984dac96c","resolution":{"observed_at":"2026-08-12T10:54:19.794670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.781375Z","title":"Transformer tracking","venue":null,"work_id":"5c21613a-7173-4006-acad-e0b9b8c9607e","year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.964611Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:0e60042fef8698dfedd41728fe4cf764326eb44ff01e4978c1f10cbc373c7fb8","observation_id":"e50095c2-2bff-44f5-8cfe-85297aef1843","resolution":{"observed_at":"2026-08-12T10:54:19.784843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.771980Z","title":"Siamese box adaptive network for visual tracking","venue":null,"work_id":"42debf87-7f81-45bf-9ab3-2a532fafb043","year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.967959Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:de642c04b13a31cea5b5aeaaa7298367bb4f30f2cab4fc6ff226ec00ca41c95b","observation_id":"d9355573-78c2-4545-87e9-9c805ac78898","resolution":{"observed_at":"2026-08-12T10:54:19.775228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.762786Z","title":"Mixformerv2: Efficient fully transformer tracking.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"f61c0a3b-3963-4bb3-843b-1c0728012047","year":2024},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.971957Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:78bd186b0688d3246cbb48056f9e2bb29d27f72cb5cb1b3d90e7263c09b0c9df","observation_id":"eea6748e-e4dc-4351-aff2-541511b84504","resolution":{"observed_at":"2026-08-12T10:54:19.765904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.752968Z","title":"Atom: Accurate tracking by overlap max- imization","venue":null,"work_id":"893e4a87-75dc-4054-a5b5-16ce83349d68","year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.975476Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:9b2972a750eb91d2252b2adc07ef2d326f890094747926dc7a5dfc55ddc84473","observation_id":"6d753dd8-073c-48bf-a7b5-677f64656eb3","resolution":{"observed_at":"2026-08-12T10:54:19.756490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:18.978983Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.978983Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:d9858349aeaf2109f469f033c541c007731cc92b0a157cd7cda0c71c1d36b6d0","observation_id":"b419ef9d-1194-41d0-9cfa-295fe4251af6","resolution":{"observed_at":"2026-08-12T10:54:18.978983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.736808Z","title":"Lasot: A high-quality large-scale single object track- ing benchmark","venue":null,"work_id":"2970fdb4-3b58-4029-8af8-7c7159f64113","year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.982780Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:5fa39f570306dfdec40c91cbaf20ff39a541b59c0d103ab134be5d725c243127","observation_id":"c98decc5-f1cf-40d6-97b0-5ad25ade189e","resolution":{"observed_at":"2026-08-12T10:54:19.740481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:18.986340Z","title":"Dual attention network for scene seg- mentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.986340Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:08af0d80e3414b7af4e79d3fa21fed057d08cf019541bfcf62288a84d9b78059","observation_id":"2304a238-1177-44a5-98b6-55cfd2b6e5c4","resolution":{"observed_at":"2026-08-12T10:54:18.986340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.720127Z","title":"Aiatrack: Attention in attention for trans- former visual tracking","venue":null,"work_id":"eaa94b61-e907-434d-8eb0-717a3ec8854f","year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.989925Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:797ab43ed2c66b1af683b0865f8f01c5af9e153780a0557ab07e455d96f8f627","observation_id":"ae304385-4e28-4a1d-8d44-653eb162392a","resolution":{"observed_at":"2026-08-12T10:54:19.723783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.708958Z","title":"Separable self and mixed attention transformers for efficient object track- ing","venue":null,"work_id":"2d5fca74-26f8-46dd-bf28-79fa2c7d77cb","year":2024},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.993343Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:c6f61100d0d2ef18a0c629cc2bbea9a4b4cf1c32d6677b80d02d3998f668d6f1","observation_id":"a8ece105-2061-44b9-83ba-ca3b381a11f5","resolution":{"observed_at":"2026-08-12T10:54:19.713148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13840","last_updated":"2023-02-27T14:40:58Z","snapshot_observed_at":"2026-08-19T14:07:51.917143Z","submitted_at":"2023-02-27T14:40:58Z","title":"Target-Aware Tracking with Long-term Context Attention","version":1},"cited_work":{"arxiv_id":"2302.13840","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.13840","snapshot_observed_at":"2026-08-12T10:54:19.295365Z","title":"Target-Aware Tracking with Long-term Context Attention","venue":"cs.CV","work_id":"5921e903-cb9e-460b-958e-7589d4880d86","year":2023},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:18.996792Z"},"links":{"cited_paper":"/paper/2302.13840","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:54e5856d1f415daab7d10baa2c002e7d1e2fd365ee787a994f8005032b6f4127","observation_id":"9e694356-9fc4-4b48-8f3a-618a3a2e25ff","resolution":{"observed_at":"2026-08-12T10:54:19.300397Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.000722Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.000722Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:1212a1ab8b9b108b964c90bf00aee2fbcd51edd1227c4a2e43638f7b5837f5c6","observation_id":"685e844a-fd43-4e92-a5d5-97d254faeb48","resolution":{"observed_at":"2026-08-12T10:54:19.000722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.690966Z","title":"Learning to track at 100 fps with deep regression networks","venue":null,"work_id":"bbffd993-32fd-49a3-8ef7-57cc4057f1cc","year":2016},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.004528Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:9a4224f778688c2519a965d9a7c709d74a488d540e0bc23b8234f89e0466e034","observation_id":"404a7580-a97a-48af-8fb4-12110adcf105","resolution":{"observed_at":"2026-08-12T10:54:19.694433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.680954Z","title":"Got-10k: A large high-diversity benchmark for generic object tracking in the wild","venue":null,"work_id":"0bd17c58-370d-49c5-bd14-7f97233770c4","year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.008017Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:8e0a67e66deff22637f1fc45ae88099e3fc0ffb7957e7cf31bb6808b8cf77f03","observation_id":"6cd4674e-2763-4d40-8e93-63e5a4039818","resolution":{"observed_at":"2026-08-12T10:54:19.684623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.07360","last_updated":"2016-11-04T21:26:08Z","snapshot_observed_at":"2026-08-14T22:09:04.541956Z","submitted_at":"2016-02-24T00:09:45Z","title":"SqueezeNet: AlexNet-level accuracy with 50x fewer parameters and <0.5MB model size","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.07360","snapshot_observed_at":"2026-08-12T10:54:19.011718Z","title":"Squeezenet: Alexnet-level accuracy with 50x fewer pa- rameters and¡ 0.5 mb model size","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.011718Z"},"links":{"cited_paper":"/paper/1602.07360","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:7a44a6641b2d398dc419b94051062288e782f03030ac87a2404f1cf190bd7885","observation_id":"bc5a98cb-f44a-4318-8ee7-5f723117b02a","resolution":{"observed_at":"2026-08-12T10:54:19.011718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.670382Z","title":"Exploring lightweight hierarchical vision transformers for efficient visual tracking","venue":null,"work_id":"ecd33709-7c62-42bc-acb9-16529ea9ec13","year":2023},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.015529Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:380cfc171a6de9a8f5a54aa76fcfa540180043dab6a04474019287748f570236","observation_id":"e9459df0-bce5-46ff-adc0-45837bde2d1c","resolution":{"observed_at":"2026-08-12T10:54:19.674443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.657577Z","title":"Need for speed: A benchmark for higher frame rate object tracking","venue":null,"work_id":"3c9c395d-729b-4576-86be-382d7fe7fdd9","year":2017},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.018718Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:48c2bd0f31cfbb85d51a67a31ffb09ccc88f1de265ca9c142542a96cd4f133e9","observation_id":"3f411833-9af5-48b2-9478-47805ddcf4c5","resolution":{"observed_at":"2026-08-12T10:54:19.663323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T10:54:19.022005Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.022005Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:fc47fa5eaefb1dde7c01d7b2216d919f070f37cded885e8cd8462bb9d70351cb","observation_id":"714ea092-b91b-4141-85a6-3c10a12062d4","resolution":{"observed_at":"2026-08-12T10:54:19.022005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.645944Z","title":"Siamese neural networks for one-shot image recognition","venue":null,"work_id":"c6d67431-4ebc-429b-9fc3-a8ff259256f3","year":2015},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.025943Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:8019af9551392efe7e730f286857dac416de96fe7be406eea12c7301cbe37d50","observation_id":"4668e30e-c5fc-413c-b6a1-c8db1a1297bc","resolution":{"observed_at":"2026-08-12T10:54:19.650467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.633887Z","title":"The eighth visual object tracking vot2020 chal- lenge results","venue":null,"work_id":"04c6c307-ff32-479f-b2c9-0eac64fa1a96","year":2020},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.029489Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:a816a8dedf61c7a915abacdfc08d8110e2d1f54acbce2bf58692e2928e9842f4","observation_id":"063bb833-2040-410c-90f3-e60927ec0203","resolution":{"observed_at":"2026-08-12T10:54:19.638230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.623299Z","title":"Siamrpn++: Evolution of siamese vi- sual tracking with very deep networks","venue":null,"work_id":"5039758d-92e6-42ac-8265-e359c49dec10","year":2019},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.032811Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:727c09a449c5b6cd06d0221771e9108d83dbab55b587f16e71aca6f76a4a0918","observation_id":"9f5f3576-48a2-4b07-901f-ea4ff07fc86d","resolution":{"observed_at":"2026-08-12T10:54:19.626986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.612607Z","title":"High performance visual tracking with siamese region pro- posal network","venue":null,"work_id":"ce093846-f477-4977-a1f8-776863ac2a8d","year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.036238Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:856d6eac82019be800ebb2ae7ba56a529c7f5fe24f37a5ce474c3d493be7fe85","observation_id":"dd6276fe-6f28-4011-b174-a0259cc7a8cb","resolution":{"observed_at":"2026-08-12T10:54:19.616440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.602427Z","title":"Visual object tracking for un- manned aerial vehicles: A benchmark and new motion mod- els","venue":null,"work_id":"4fab5ded-49bd-4a27-85e1-88b9ee8e8994","year":2017},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.039623Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:9229e1cf047a6d1ab6b3e43dc525c3196d08525a5875ccc529e22638e1525cee","observation_id":"b9f61ee6-3c28-49cd-bab2-333eea8d2cde","resolution":{"observed_at":"2026-08-12T10:54:19.606149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.06467","last_updated":"2021-12-13T07:56:16Z","snapshot_observed_at":"2026-08-17T15:34:23.807968Z","submitted_at":"2021-12-13T07:56:16Z","title":"An Informative Tracking Benchmark","version":1},"cited_work":{"arxiv_id":"2112.06467","doi":null,"metadata_source":"pith","pith_arxiv_id":"2112.06467","snapshot_observed_at":"2026-08-12T10:54:19.257172Z","title":"An Informative Tracking Benchmark","venue":"cs.CV","work_id":"e856268b-cc76-45c7-8209-e489c7638637","year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.042812Z"},"links":{"cited_paper":"/paper/2112.06467","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:9d4671d24b6225f7f03ce7f094c0fc4b2ca1cfd7edb557dcf4cd918c9a5a1ba7","observation_id":"a5178be6-b53f-4868-af7a-cbbd725a14d7","resolution":{"observed_at":"2026-08-12T10:54:19.262214Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1603.04779","last_updated":"2016-11-08T06:11:30Z","snapshot_observed_at":"2026-08-14T22:05:56.198273Z","submitted_at":"2016-03-15T17:44:32Z","title":"Revisiting Batch Normalization For Practical Domain Adaptation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.04779","snapshot_observed_at":"2026-08-12T10:54:19.046790Z","title":"Revisiting batch normalization for practical do- main adaptation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.046790Z"},"links":{"cited_paper":"/paper/1603.04779","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:06334314184cfb1cd36222549ab17604a2ec2f18bfdf043ebfa897caf60c9c70","observation_id":"0630f15e-cdfa-436f-a2cd-65773732a171","resolution":{"observed_at":"2026-08-12T10:54:19.046790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.591859Z","title":"Encoding color information for visual tracking: Algorithms and bench- mark","venue":null,"work_id":"02789bf0-5a63-4932-8804-0d4c2c60a3b9","year":2015},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.050469Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:8337dfbb019823d692a0be9c8cce01c16cfdf3e60ae89ab697785bc511460185","observation_id":"7ef4952a-1992-491b-84ae-f778a56ea99e","resolution":{"observed_at":"2026-08-12T10:54:19.595577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.053924Z","title":"Focal loss for dense object detection","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.053924Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:0b0185b6ce91fbd7048e30b9d7007063c277f0087f1986299bc2948026cec54a","observation_id":"20f6ee99-bec5-41d3-a952-521df26631a4","resolution":{"observed_at":"2026-08-12T10:54:19.053924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.057442Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.057442Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:08818ff6e9214ab5d1b8828f1c5320544e54f704c186c49b7a4e8c7b706a588b","observation_id":"09ba2518-8ba5-4a1b-bcee-474b5040a83b","resolution":{"observed_at":"2026-08-12T10:54:19.057442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00782","last_updated":"2021-07-08T15:33:31Z","snapshot_observed_at":"2026-08-16T18:12:52.134237Z","submitted_at":"2021-07-02T01:03:11Z","title":"Polarized Self-Attention: Towards High-quality Pixel-wise Regression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00782","snapshot_observed_at":"2026-08-12T10:54:19.060785Z","title":"Po- larized self-attention: Towards high-quality pixel-wise re- gression","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.060785Z"},"links":{"cited_paper":"/paper/2107.00782","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:3f4f729f3b458bb9909fb920123a79fa6d3247d90dc81a44f38ea692260bb9fa","observation_id":"e2c46b19-6fc8-46d8-8a4f-c4a7f7476662","resolution":{"observed_at":"2026-08-12T10:54:19.060785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.569302Z","title":"Transforming model prediction for tracking","venue":null,"work_id":"d6195026-9665-4dcd-a329-023b9d16c795","year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.064667Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:711d868da870d2f7607cb2cd73410cb7e1f380b33c9d5e959c811a5e6399b093","observation_id":"d3903bff-bd0e-419c-8095-18a6462ba075","resolution":{"observed_at":"2026-08-12T10:54:19.572811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02680","last_updated":"2022-06-06T15:31:35Z","snapshot_observed_at":"2026-08-16T16:55:01.597897Z","submitted_at":"2022-06-06T15:31:35Z","title":"Separable Self-attention for Mobile Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02680","snapshot_observed_at":"2026-08-12T10:54:19.068168Z","title":"Separable self- attention for mobile vision transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.068168Z"},"links":{"cited_paper":"/paper/2206.02680","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:44ffff75ff4db1f561b3654c6d418f04dd10fd3de67b3904e2947bdedd07a7f4","observation_id":"2e3fb3af-0186-4dca-8b16-78389ed93168","resolution":{"observed_at":"2026-08-12T10:54:19.068168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.558538Z","title":"Siamese network features for image matching","venue":null,"work_id":"a418a973-16e6-4d7b-86bd-9d1ad224202a","year":2016},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.071929Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:1d30af7ac81736b77cc553814da93696c9cbccc1aab3f6762bd7e22bd109968e","observation_id":"a8ed2bd0-b6c1-4aed-b886-07edd1b9f9dd","resolution":{"observed_at":"2026-08-12T10:54:19.562337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.547692Z","title":"The norm must go on: Dynamic unsuper- vised domain adaptation by normalization","venue":null,"work_id":"7b706a53-15a3-477e-8b7a-4442169e1567","year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.075167Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:8af0b634f54af1c84403c47bf613363fe676c7ee0ac282fcb8ad4d382f055bb3","observation_id":"34e7a94b-eebf-45df-a37a-c760a913f942","resolution":{"observed_at":"2026-08-12T10:54:19.551407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.537504Z","title":"A benchmark and simulator for uav tracking","venue":null,"work_id":"c64dae48-0744-4e70-b6cb-aae3571b95cb","year":2016},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.078611Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:98fbd898b6f8ebb57a1011f12638f681f2f67cdc61b547b90e4ce25c13211987","observation_id":"a76593b2-ac6c-4fee-9fca-2a4b24668e69","resolution":{"observed_at":"2026-08-12T10:54:19.540948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.526633Z","title":"Trackingnet: A large-scale dataset and benchmark for object tracking in the wild","venue":null,"work_id":"26c4f6b0-7a23-4dbc-b427-861d40ada5b1","year":2018},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.082157Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:ad92f6952f7be2af50a1eb59c9263faec4ff97d6c34626b26f3a938840d1f777","observation_id":"9f5175d7-1c97-48b2-8a2a-7eca599d6f2d","resolution":{"observed_at":"2026-08-12T10:54:19.530288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.516323Z","title":"Efficient test-time model adaptation without forgetting","venue":null,"work_id":"8ca727d5-701e-46b7-82d8-149fbb732776","year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.086034Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:059ab91efc7d4e1e22cbed8218f313915fbc908b24096a462d989c56c774c05b","observation_id":"67b130ed-6004-4b2d-8967-08e551f04a20","resolution":{"observed_at":"2026-08-12T10:54:19.519844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.06888","last_updated":"2022-08-14T17:49:37Z","snapshot_observed_at":"2026-08-17T08:57:35.940611Z","submitted_at":"2022-08-14T17:49:37Z","title":"AVisT: A Benchmark for Visual Object Tracking in Adverse Visibility","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.06888","snapshot_observed_at":"2026-08-12T10:54:19.089273Z","title":"Avist: A benchmark for vi- sual object tracking in adverse visibility","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.089273Z"},"links":{"cited_paper":"/paper/2208.06888","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:e561b3002b1d061c817e407767dffbeae04da9dd0f5266ace02e379616d1405e","observation_id":"36f688eb-805b-4f1f-9092-f34591cd26fa","resolution":{"observed_at":"2026-08-12T10:54:19.089273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.505535Z","title":"Two at once: Enhancing learning and generalization capacities via ibn-net","venue":null,"work_id":"d34b197d-18ab-46ef-9c38-1207131d0e94","year":2018},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.092846Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:d62b6d08b47bb9bbffb04c70da48e29d0ee8c4a671dec539921b87211f7333ad","observation_id":"8844f3d6-96a1-4999-9748-12912b736ab8","resolution":{"observed_at":"2026-08-12T10:54:19.509486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.096260Z","title":"Pytorch: An im- perative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.096260Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:54effd239551c3575150e7288f9532a10d7dec00724ab94075ed816c1b1db92d","observation_id":"8e8418f5-88d2-443d-9f93-2efa91912730","resolution":{"observed_at":"2026-08-12T10:54:19.096260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.100071Z","title":"Generalized in- tersection over union: A metric and a loss for bounding box regression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.100071Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:722922031c219733c32e246c248aad0218e5bb5c6b72340454541f69f60cac74","observation_id":"f0555acb-8d10-467b-a2f8-32fa423c4b03","resolution":{"observed_at":"2026-08-12T10:54:19.100071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.482368Z","title":"Improving robustness against common corruptions by covariate shift adaptation","venue":null,"work_id":"f8d6724c-fff9-4310-a1fc-f17e15bca130","year":2020},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.103513Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:8cd7b18b3fdac99e0fd1bd34f2cd1bbf4048d123fa0a4962305af011bf0c0584","observation_id":"363503bb-a525-4f70-8dbf-25e4c836f4f4","resolution":{"observed_at":"2026-08-12T10:54:19.485891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.472118Z","title":"Attention is all you need","venue":null,"work_id":"0cae2545-f2e3-40f1-aa8b-9fc3e1010edd","year":2017},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.106906Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:64ab583762c2b6767029674ee59bcafeb3e7c9e443ca9489ab74e95ef25a26b4","observation_id":"6999e909-d6eb-4b5e-b1cf-7e99bcb4f9c3","resolution":{"observed_at":"2026-08-12T10:54:19.475725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15159","last_updated":"2022-10-06T14:19:13Z","snapshot_observed_at":"2026-08-16T16:27:59.902710Z","submitted_at":"2022-09-30T01:04:10Z","title":"MobileViTv3: Mobile-Friendly Vision Transformer with Simple and Effective Fusion of Local, Global and Input Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15159","snapshot_observed_at":"2026-08-12T10:54:19.110706Z","title":"Mobilevitv3: Mobile-friendly vision transformer with simple and effec- tive fusion of local, global and input features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.110706Z"},"links":{"cited_paper":"/paper/2209.15159","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:e310689e0fd5642517f685c4798603c10a026b2584f4440e94c9c8b707b1a7a2","observation_id":"991a5d38-fc11-4289-946b-3cc446040497","resolution":{"observed_at":"2026-08-12T10:54:19.110706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-08-16T06:30:33.794820Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-12T10:54:19.114907Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.114907Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:93a77c5b7ccfb515ca21ceb62653c3c49d2daed0d2ee21975768f18f755364c8","observation_id":"575e0939-c46c-4c3b-91dc-c0eb91d1d2c0","resolution":{"observed_at":"2026-08-12T10:54:19.114907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.118670Z","title":"Continual test-time domain adaptation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.118670Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:b4cb22ac4cb39533626387f22979bc848541954e80ef8ef35824fcd26b8a03f3","observation_id":"27f6cf88-fb2f-4c1b-b5b5-fafeeac8ca5c","resolution":{"observed_at":"2026-08-12T10:54:19.118670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.455487Z","title":"Fast online object tracking and segmentation: A unifying approach","venue":null,"work_id":"a2052642-208b-4035-be3e-98c63ad52e71","year":2019},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.122143Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:2942d4ee06b0ea0221d52578f9bdd6c022e28b96d206db2f1fae02b79ea1ddaf","observation_id":"3c6ae15d-a623-4bd1-a127-b6e5a7f09fc0","resolution":{"observed_at":"2026-08-12T10:54:19.459068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.445985Z","title":"Autoregressive visual tracking","venue":null,"work_id":"c4c6ad38-f71a-4be1-9adc-dc1a8991b435","year":2023},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.125449Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:69839606619a7459838fbbeb1760493850dcfb822e66e1c5cb6de71dce1b887c","observation_id":"a28542ba-8e09-415f-8ce5-3fa57a3529b2","resolution":{"observed_at":"2026-08-12T10:54:19.449134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.436050Z","title":"Cbam: Convolutional block attention module","venue":null,"work_id":"4eba8c5f-7652-4227-b375-a3deb91b39d6","year":2018},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.128857Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:c333b0e850d69710c5a3487b6febffa03ef6fc689fb0d67bd8282696f1e2e73c","observation_id":"1a075be3-06d5-450f-a1de-1e671b09850f","resolution":{"observed_at":"2026-08-12T10:54:19.439760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.426435Z","title":"Fbnet: Hardware-aware efficient con- vnet design via differentiable neural architecture search","venue":null,"work_id":"895fe5d6-32d6-40a8-a728-a7e989f9749a","year":2019},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.132325Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:b28a8105da7b1b2cf8360f0acee9d25ded58044a8ddd21c4a3e0742f662b7178","observation_id":"94abe46e-b44b-4cdb-b229-6ef4978494dc","resolution":{"observed_at":"2026-08-12T10:54:19.429943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.416361Z","title":"Dropmae: Masked autoen- coders with spatial-attention dropout for tracking tasks","venue":null,"work_id":"cbfe88e6-8cfc-4e7d-8a5c-d897f9348d6d","year":2023},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.135411Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:4114acc7a3eb716155889fb4012779ba9ea7565ac45f7c2be2c0aba87e5b028d","observation_id":"a06702ff-6b7c-480c-a50c-fffd667edc1d","resolution":{"observed_at":"2026-08-12T10:54:19.419996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.405310Z","title":"Object track- ing benchmark","venue":null,"work_id":"7b0562fd-1433-47be-8750-4cee75de23bf","year":2015},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.138804Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:5bc5d43e0902663aa546587899643b6b9f765e05d1249c506ca9eb142a42f038","observation_id":"4a058533-5c41-44be-95b0-c1378ca0d25a","resolution":{"observed_at":"2026-08-12T10:54:19.408853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.393816Z","title":"Siamfc++: Towards robust and accurate visual tracking with target estimation guidelines","venue":null,"work_id":"5ae8d1f2-a828-4776-b0e2-08933ca2bb05","year":2020},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.142436Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:2c963411b8256ff582a881f4d4004bb9df7e7b65804058798c11337562c9308b","observation_id":"9aeec4de-6060-4657-b567-cb6845238b75","resolution":{"observed_at":"2026-08-12T10:54:19.398626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.383138Z","title":"Learning spatio-temporal transformer for vi- sual tracking","venue":null,"work_id":"a3fb4b4c-806e-4229-9821-76dbca47776a","year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.145743Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:4981ac2b7a7293d02fbc9b2816364492d673763ebef0a83b3c8fe9c8ed0cdcbf","observation_id":"65ef33d9-7c9e-4150-892e-18eb4c1e781f","resolution":{"observed_at":"2026-08-12T10:54:19.387023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.371590Z","title":"Lighttrack: Finding lightweight neural net- works for object tracking via one-shot architecture search","venue":null,"work_id":"d5ea0b60-15cd-4a89-b883-dea1d571f95c","year":2021},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.149059Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:6366a9ff6ab6ccaf8691df5d9068436a246996605aca50316f4287bc12cefa32","observation_id":"8847274c-7caf-47ee-84f8-8c4dd2200623","resolution":{"observed_at":"2026-08-12T10:54:19.375404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.360520Z","title":"Siamatt: Siamese attention network for visual tracking","venue":null,"work_id":"4d567de4-f95e-41da-a220-77bc5dd5ca16","year":2020},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.152392Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:55c2594a0b74752b2a5facbaade6ca8bd20eecd463244d25fd69710c246940e6","observation_id":"7e2223c1-4cc2-403c-9400-d554b52b1626","resolution":{"observed_at":"2026-08-12T10:54:19.364261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.349512Z","title":"Joint feature learning and relation modeling for tracking: A one-stream framework","venue":null,"work_id":"ce6d4067-72a4-46ee-a715-ef91dcfa9f00","year":2022},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.155657Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:d60128c08d2099a8e1c6e988a12fcd4bbd9df53d7860b455a2cb14231d168d8d","observation_id":"5fe9a57f-a166-49ec-8937-0e127f0f761f","resolution":{"observed_at":"2026-08-12T10:54:19.353537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.339461Z","title":"Deformable siamese attention networks for visual ob- ject tracking","venue":null,"work_id":"0aacffb9-2976-4be7-9d61-993968d09251","year":null},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.158941Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:1b904761f25c1765df2c6fb921a578ce1704a26ad3d6673afbb13fd0aa2f3f95","observation_id":"18a86ada-fc34-44ed-b4f2-29fafe590282","resolution":{"observed_at":"2026-08-12T10:54:19.342869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.328852Z","title":"Ocean: Object-aware anchor-free tracking","venue":null,"work_id":"98845400-026f-4778-a11e-58239c1c6f9c","year":2020},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.162309Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:6a687e76ba0a546aeb52bb4e49ad28ec9e480c562e7ecc5a615bd519e4cb1728","observation_id":"ec76ee5e-0beb-4f6e-8d61-8935faf466a4","resolution":{"observed_at":"2026-08-12T10:54:19.332450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:54:19.318203Z","title":"Distractor-aware siamese networks for visual object tracking","venue":null,"work_id":"630a33a3-149c-4ed1-a88f-a4c8a6392d14","year":2018},"citing_paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T10:54:19.165858Z"},"links":{"citing_paper":"/paper/2411.18855"},"observation_digest":"sha256:d1b1f9d021f4ced571611d9eb686e45170b05f67d426e6f2a35d63abf2f4d262","observation_id":"988fc291-0c39-4037-802d-10c73733a78c","resolution":{"observed_at":"2026-08-12T10:54:19.321732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.18855","last_updated":"2025-02-06T22:25:39Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T03:57:11.054334Z","submitted_at":"2024-11-28T01:51:46Z","title":"Improving Accuracy and Generalization for Efficient Visual Tracking"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":2,"verified_fuzzy":48},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2411.18855."}