{"as_of":"2026-08-08T02:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c5acb88377250688b9724655811eeebfe2a35acfd5aee26bc7605eba6c02f6e1","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:20:11.741140Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16191/citation-record","integrity":"/paper/2507.16191/integrity","json":"/paper/2507.16191/citation-record.json","paper":"/paper/2507.16191"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.867216Z","title":null,"venue":null,"work_id":"5224c50f-395a-4ba6-bd80-5f974be83233","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.436117Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:e2374d5db4853aaa83fedac5cf6cb006de9dd8c16ed64496230d1c69975e48f2","observation_id":"73dd2ece-d6c3-4e29-9d40-981f14284984","resolution":{"observed_at":"2026-08-06T15:20:17.871540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.851236Z","title":null,"venue":null,"work_id":"5ff2a5fe-93f1-4520-861a-c63f6276f8d5","year":2016},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.488508Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:1e9b395d4cf3aad70bfd35101dd67cce05c95d632ffca4e5ad17b349ccbd3897","observation_id":"47eaceea-12ff-473e-99a0-16943240b4de","resolution":{"observed_at":"2026-08-06T15:20:17.855835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.835758Z","title":null,"venue":null,"work_id":"4d3ae0ed-cf3f-4895-8625-5bd3d13b4275","year":2016},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.555077Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:7f04292de36496d3cc5a37d749608e080cee54c46180e715f6a55ed7c6fe7de7","observation_id":"ae77e0b9-963e-44cd-8659-5c3263dc5746","resolution":{"observed_at":"2026-08-06T15:20:17.840222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.820613Z","title":null,"venue":null,"work_id":"6b231495-e2bf-498f-a13c-41590b6bb470","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.631539Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:1413de0ffeab9e997faf74880fa83f707e01d975c23f271aeabf32a1c46758bf","observation_id":"2aa79352-80c6-4508-9d4b-710b9caf63dd","resolution":{"observed_at":"2026-08-06T15:20:17.825397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.804514Z","title":null,"venue":null,"work_id":"685f0a72-1a3b-483c-a760-d5510e0fa9ba","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.684799Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:27f53e8b6e5663d87acd324269aafb22183a926999695e47d890b5f64079e78d","observation_id":"f1951da9-b135-44d9-9abe-2d4d55f1720b","resolution":{"observed_at":"2026-08-06T15:20:17.809137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:06.794045Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.794045Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:b6f0f50859a0f2dc5ec07d8234d2dbe0c16a31f361f046d51187250e64456e89","observation_id":"f719d3a6-8d39-4bc0-92aa-0bac478e07d1","resolution":{"observed_at":"2026-08-06T15:20:06.794045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.762819Z","title":null,"venue":null,"work_id":"c5439a9e-bd96-4634-b394-807764e81b70","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.966483Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:dd7e580e4b4c35797fa5532f264ef1d2883fdfb03acc216be27e78b9b54b22d0","observation_id":"2107af4c-0d6f-4235-b5cd-cf8279eeb3e0","resolution":{"observed_at":"2026-08-06T15:20:17.767230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.746756Z","title":null,"venue":null,"work_id":"66a868e2-864f-4a44-bc08-908a5a2809c5","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.037025Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:a2a59f9f8a8c36e6421d67336679bb755ac166a5eb93eb73232e7cee86e85a4e","observation_id":"f911f9f0-6e28-4ca9-8575-049aa7b9c0d4","resolution":{"observed_at":"2026-08-06T15:20:17.751244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:07.141500Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.141500Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:07237eb63fed416bd1f2886637bf18200bcec911b69ab8e8428b29092a4873cb","observation_id":"9f65a3bf-0ea9-4da9-9c67-c57f0552873a","resolution":{"observed_at":"2026-08-06T15:20:07.141500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T15:20:07.330723Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.330723Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:d66c47116a778cd9e5b81bca294d906152c24e09a12f31a7413965f6eb42670f","observation_id":"81d5d451-0c11-489d-b783-487ed94d7465","resolution":{"observed_at":"2026-08-06T15:20:07.330723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.692758Z","title":null,"venue":null,"work_id":"ea9c476d-d751-4b7c-b836-8d5c29b4e540","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.410714Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:90864172cbe32e0ff33c0e15cccd2f5d335a4e45d599ae242dfc5a7dac620b99","observation_id":"94da75b9-5e96-48f9-9836-3295d026e025","resolution":{"observed_at":"2026-08-06T15:20:17.700598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.674446Z","title":null,"venue":null,"work_id":"e443773e-fa5d-4daf-93fe-c03145fe0714","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.490486Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:55efef1c8e369a36b42710cdb2fe3b914b9a5393d07cffa943b61a19e420401e","observation_id":"2dc6ba60-5252-4111-8e16-1585c8be0ffa","resolution":{"observed_at":"2026-08-06T15:20:17.679095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.657395Z","title":null,"venue":null,"work_id":"17ae8991-80d9-4602-a4f0-b1ba70059154","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.600908Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:b02e00fd3aae4a4de39fde3134ac5f7a162557a2dde3d2a7280caaae81cd9456","observation_id":"08dc74d6-35e0-4d28-a49d-36e152d96104","resolution":{"observed_at":"2026-08-06T15:20:17.662883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-06T15:20:07.645474Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.645474Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:90a97ce9d7c778878abd2c7717e40f235baab2c1a0d0f2ce634f9866a103de34","observation_id":"de66318f-3ce9-4d46-be45-a6c0b902060b","resolution":{"observed_at":"2026-08-06T15:20:07.645474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11893","last_updated":"2022-08-05T17:02:29Z","snapshot_observed_at":"2026-07-06T13:24:06.368922Z","submitted_at":"2022-06-23T17:58:39Z","title":"On the Parameterization and Initialization of Diagonal State Space Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11893","snapshot_observed_at":"2026-08-06T15:20:07.738897Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.738897Z"},"links":{"cited_paper":"/paper/2206.11893","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:66399e1ddf96b4e7105a8d6fe40a667744abdbb4c7099c762dccaea84ce4c908","observation_id":"64ebe64b-361f-43d7-81cc-190513cc7106","resolution":{"observed_at":"2026-08-06T15:20:07.738897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14343","last_updated":"2022-05-18T18:30:07Z","snapshot_observed_at":"2026-07-06T12:52:55.620227Z","submitted_at":"2022-03-27T16:30:33Z","title":"Diagonal State Spaces are as Effective as Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14343","snapshot_observed_at":"2026-08-06T15:20:07.799580Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.799580Z"},"links":{"cited_paper":"/paper/2203.14343","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:8a4611de2b9de95f7b5cbd13cbc13dee27064995c13357c58ac646b2e04c1454","observation_id":"d39db7d6-21ef-4e9a-b990-4db86fcd228f","resolution":{"observed_at":"2026-08-06T15:20:07.799580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15691","last_updated":"2024-12-20T09:10:17Z","snapshot_observed_at":"2026-07-06T20:10:46.746601Z","submitted_at":"2024-12-20T09:10:17Z","title":"Exploiting Multimodal Spatial-temporal Patterns for Video Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15691","snapshot_observed_at":"2026-08-06T15:20:07.878115Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.878115Z"},"links":{"cited_paper":"/paper/2412.15691","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:1e76b0af7c8ae584cc6f98ba84f7b679e4d45541847fb116e924f90ee81dd505","observation_id":"ac6c7c01-1c17-4d32-a60e-9ef0a9aaa8ce","resolution":{"observed_at":"2026-08-06T15:20:07.878115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06583","last_updated":"2025-02-10T15:50:26Z","snapshot_observed_at":"2026-07-06T20:34:02.031605Z","submitted_at":"2025-02-10T15:50:26Z","title":"Adaptive Perception for Unified Visual Multi-modal Object Tracking","version":1},"cited_work":{"arxiv_id":"2502.06583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.06583","snapshot_observed_at":"2026-08-06T15:20:13.646436Z","title":"Adaptive Perception for Unified Visual Multi-modal Object Tracking","venue":"cs.CV","work_id":"e4425109-f42b-446b-a14e-231c5ecf1748","year":2025},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.965249Z"},"links":{"cited_paper":"/paper/2502.06583","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:1a64903bf6a510a69dc72d0599755aa08f197bc07d67b390fb64840c112e0b9d","observation_id":"16c70ea3-faff-4ac1-8bd3-9e1cdca7e96a","resolution":{"observed_at":"2026-08-06T15:20:13.728895Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.33962","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:13.433980Z","title":null,"venue":null,"work_id":"aa54cff9-118a-482d-8050-e7058f6f680b","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.043985Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:ae5a260d18b71841a4c2d192180b5e909acb5ae24dfb09918576f9191d57ecfb","observation_id":"78074902-1021-4349-8877-d4246884fda2","resolution":{"observed_at":"2026-08-06T15:20:13.512529Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32896","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:13.191874Z","title":null,"venue":null,"work_id":"d467b015-02b1-48d9-ab18-4fae37b35b13","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.145994Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:d63d6232f3c8eda5a9bc82d26bd724366948bca799519524409fd3780c7bc4d9","observation_id":"6468cfbd-3bb7-4631-9480-50ab094f3d06","resolution":{"observed_at":"2026-08-06T15:20:13.261635Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.594856Z","title":null,"venue":null,"work_id":"9e4ebbff-bf12-4f2b-860f-5587e5620b9a","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.205829Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:0cd37cb133e41f6bc3e58a657f82a4004ce1a4cf6353d5c20371949ec8892c32","observation_id":"e11e4810-4f52-442a-9b28-69af28e7c6bc","resolution":{"observed_at":"2026-08-06T15:20:17.645965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.398738Z","title":null,"venue":null,"work_id":"db555946-778b-48e7-b2db-ad6ec5071227","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.307505Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:f4fdd0725d7bb3587f616c7465b2b8b288e2080142547cf0755ff794f122ccc7","observation_id":"ec5ddedb-3e92-4d90-8007-ab91ceb16a00","resolution":{"observed_at":"2026-08-06T15:20:17.524056Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.142427Z","title":null,"venue":null,"work_id":"cb5a58a6-4793-4911-9db7-7320558415d8","year":2018},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.405190Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:f09cfd1bc8d40afbbbc5eef6c9bef987ac9ec37a0dad0277d98da27168630305","observation_id":"0ade4111-c17b-4724-bbec-881a7c8b2441","resolution":{"observed_at":"2026-08-06T15:20:17.279990Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13615","last_updated":"2024-12-18T08:53:52Z","snapshot_observed_at":"2026-08-06T13:35:49.932865Z","submitted_at":"2024-12-18T08:53:52Z","title":"MambaLCT: Boosting Tracking via Long-term Context State Space Model","version":1},"cited_work":{"arxiv_id":"2412.13615","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.13615","snapshot_observed_at":"2026-08-06T15:20:12.944661Z","title":"MambaLCT: Boosting Tracking via Long-term Context State Space Model","venue":"cs.CV","work_id":"c555224a-ac85-4355-82dd-f350f1f85ca5","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.484726Z"},"links":{"cited_paper":"/paper/2412.13615","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:15469176fb24d6cba120c87fec9d42c8cf2b1466e2ddfe513e4157dd81624706","observation_id":"ab453aef-ee02-4fb6-8c20-137504230734","resolution":{"observed_at":"2026-08-06T15:20:13.021855Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-07-06T05:54:18.908943Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-06T15:20:08.578635Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.578635Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:22c157eec211546afad0044ca01953d6641ca5a42e9f5e4c51c63c0ce1171341","observation_id":"ad2e4d76-3a2b-4432-85a7-47d4ac9405e5","resolution":{"observed_at":"2026-08-06T15:20:08.578635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:08.685807Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.685807Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:a0e849e090343cf2e704e2a80b9359712a5f916107e601bc277dcec64a481ee8","observation_id":"e5e3666d-b374-4053-a524-4d689d72ecec","resolution":{"observed_at":"2026-08-06T15:20:08.685807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-06T15:20:08.752195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.752195Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:df054bbd14998149987221ff81c358b353444e4b98dad7dd54f7f691928145e3","observation_id":"829d0531-e278-4a23-9bcf-209ffed99b1b","resolution":{"observed_at":"2026-08-06T15:20:08.752195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T15:20:08.832478Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.832478Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:21bbfbcf4806f9dfaae1006a616ee9cd929786e35c401d2814a4e60922b851b7","observation_id":"52781879-acbd-4951-86b2-3a5ceb70ada2","resolution":{"observed_at":"2026-08-06T15:20:08.832478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.852868Z","title":null,"venue":null,"work_id":"2974af9e-33c7-476d-aed6-1bc3f035235e","year":2018},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:08.906292Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:b3bdacccbf4655017d46e55253240e714930c908e440ba6613ffb0d2b783788c","observation_id":"36b02ad8-d1f8-4877-9a63-61a88c50fc49","resolution":{"observed_at":"2026-08-06T15:20:16.996359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:09.052292Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.052292Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:890f03075239dd180cc9bf1386b939561d410785a67c5bc96c7934ca4e6bf6cf","observation_id":"5f14433e-0986-4709-8465-e9baedebef07","resolution":{"observed_at":"2026-08-06T15:20:09.052292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:09.161075Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.161075Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:6f5e544a7af0315f97812f2bba721f2211e05abd1261b2202938561a586b3b56","observation_id":"eef7b4e2-4904-4f84-b89d-71d1b75a522f","resolution":{"observed_at":"2026-08-06T15:20:09.161075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.541804Z","title":null,"venue":null,"work_id":"ecd37755-65fb-469f-8c5b-3a1c3d5fac3a","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.266401Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:84e1821a3421309dba873d5c1f77bf683c53b48fe9195a377e824f5d58716a2c","observation_id":"381930cf-aff3-46c3-9379-f6848e667287","resolution":{"observed_at":"2026-08-06T15:20:16.708265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19694","last_updated":"2023-10-30T16:11:06Z","snapshot_observed_at":"2026-08-05T16:49:20.850159Z","submitted_at":"2023-10-30T16:11:06Z","title":"Convolutional State Space Models for Long-Range Spatiotemporal Modeling","version":1},"cited_work":{"arxiv_id":"2310.19694","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.19694","snapshot_observed_at":"2026-08-06T15:20:12.594924Z","title":"Convolutional State Space Models for Long-Range Spatiotemporal Modeling","venue":"cs.LG","work_id":"ce1edf54-67fc-485c-b4ef-8c429761f1b0","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.310282Z"},"links":{"cited_paper":"/paper/2310.19694","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:43fa888e8e18396be5416f768d8102237505544e1afbbe28239ab7e4cda81ac4","observation_id":"d7fa4688-1b7e-4212-a145-9a43fa8862ae","resolution":{"observed_at":"2026-08-06T15:20:12.662630Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.358871Z","title":null,"venue":null,"work_id":"d958151d-c344-496f-ab32-7316f29de86b","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.395479Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:b68d6904675405ee981fa251eed60afb1073b6b8570f6d359c65c45fe0a29c16","observation_id":"3593425f-ccc0-41c3-afb3-87379868f7d4","resolution":{"observed_at":"2026-08-06T15:20:16.439744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:16.183977Z","title":null,"venue":null,"work_id":"bf7c7d7b-13f9-4211-ac9f-6ef903ef2347","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.476302Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:c01a5e8f91ee08d0f8ed032a3f6e78d6d28a5d6a6446f4ff261c5abf5b521012","observation_id":"6504bb16-e0e2-4176-b88e-72c8790a75b7","resolution":{"observed_at":"2026-08-06T15:20:16.268835Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.758828Z","title":null,"venue":null,"work_id":"b1a9afc5-a8f0-4cce-bab0-f41c3c851ce8","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.659536Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:32dfb8bcc814409e5819de9f8fe257e8ea3f66346adfd0e6de22c69e0ddac0ba","observation_id":"5e99ffb6-273a-4e3b-96ce-e2ea73586f84","resolution":{"observed_at":"2026-08-06T15:20:15.840732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.594803Z","title":null,"venue":null,"work_id":"6a3ec2cf-0c3b-4eca-bd3f-f59696457e64","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.739628Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:f207c937b5318c40b37727f29dfc393ae1ed16efc6c5ed82914aee5efacc21d5","observation_id":"3d130926-55ce-4971-8412-66d39c05eeb1","resolution":{"observed_at":"2026-08-06T15:20:15.676551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.435666Z","title":null,"venue":null,"work_id":"812914ca-1143-4059-a4b9-aec7bca29db8","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.842035Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:232e38a330af2b72ebbd50384eb2c1855cf2c5666ffd9cfbab2dc5db9d1a8aff","observation_id":"8a43d840-7c27-4c68-a54e-23cac48140ef","resolution":{"observed_at":"2026-08-06T15:20:15.512256Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.06521","last_updated":"2018-07-18T11:20:08Z","snapshot_observed_at":"2026-08-03T21:23:12.210486Z","submitted_at":"2018-07-17T16:05:59Z","title":"CBAM: Convolutional Block Attention Module","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.06521","snapshot_observed_at":"2026-08-06T15:20:09.919343Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.919343Z"},"links":{"cited_paper":"/paper/1807.06521","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:3ee9ea267236e77e1753bf1d235e480484cc1ad8509726ecf9752439c3676a13","observation_id":"d3258a87-35c8-413e-9aed-bbbc483f5263","resolution":{"observed_at":"2026-08-06T15:20:09.919343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01666","last_updated":"2022-03-03T11:53:54Z","snapshot_observed_at":"2026-07-06T12:43:38.893285Z","submitted_at":"2022-03-03T11:53:54Z","title":"Correlation-Aware Deep Tracking","version":1},"cited_work":{"arxiv_id":"2203.01666","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.01666","snapshot_observed_at":"2026-08-06T15:20:12.388280Z","title":"Correlation-Aware Deep Tracking","venue":"cs.CV","work_id":"a9db8ae3-9ea4-4983-bc53-c371435969e8","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.000092Z"},"links":{"cited_paper":"/paper/2203.01666","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:321fba8fa5b6da571df62465d857d0e9b3ce9b01dcffe873226e486712e1c6f0","observation_id":"c63c5510-6ffc-4861-839b-6ef33f0c6daf","resolution":{"observed_at":"2026-08-06T15:20:12.470336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.279152Z","title":null,"venue":null,"work_id":"6f1a40bf-6095-4b4a-b7f8-db26633ace23","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.127241Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:48484f63bc010b0903092047bb0b1d76f765f071e9731c3702771a898b3b913a","observation_id":"c4eb3aeb-fc06-4a3d-b0df-0f9c3dbb7a81","resolution":{"observed_at":"2026-08-06T15:20:15.359186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.108304Z","title":null,"venue":null,"work_id":"4ffc0f82-35bc-40a4-b02d-60e649646677","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.313682Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:0de4ff877f036f8a54c04fa8273505c6ef635223d5bafd66e3bd488485c5bf19","observation_id":"816775b9-456a-4976-ada7-d21f836ae072","resolution":{"observed_at":"2026-08-06T15:20:15.194844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.06188","last_updated":"2020-04-02T14:01:38Z","snapshot_observed_at":"2026-07-06T08:37:02.581209Z","submitted_at":"2019-11-14T15:43:37Z","title":"SiamFC++: Towards Robust and Accurate Visual Tracking with Target Estimation Guidelines","version":4},"cited_work":{"arxiv_id":"1911.06188","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.06188","snapshot_observed_at":"2026-08-06T15:20:12.054681Z","title":"SiamFC++: Towards Robust and Accurate Visual Tracking with Target Estimation Guidelines","venue":"cs.CV","work_id":"67d82cf5-bd89-4902-a59a-e7fb43fa6084","year":2019},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.412493Z"},"links":{"cited_paper":"/paper/1911.06188","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:2ad11cfbbf9f51bad69cbc4beb0933778f703d129cebb2c44b08e614f1f0044f","observation_id":"7d753933-8569-4e25-a741-4065c1f587ca","resolution":{"observed_at":"2026-08-06T15:20:12.127824Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.939555Z","title":null,"venue":null,"work_id":"a744cc4b-3585-4b54-9b59-1b66bb310527","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.493878Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:acd3e1c84fd00e3d11c6f03b102225c87a4b0bf60bf5525dcbb7c51c1933b0f2","observation_id":"3bffae36-d469-4f8e-9908-b89e6f3d6f5f","resolution":{"observed_at":"2026-08-06T15:20:15.027520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13611","last_updated":"2024-12-18T08:37:22Z","snapshot_observed_at":"2026-07-06T20:09:05.798010Z","submitted_at":"2024-12-18T08:37:22Z","title":"Robust Tracking via Mamba-based Context-aware Token Learning","version":1},"cited_work":{"arxiv_id":"2412.13611","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.13611","snapshot_observed_at":"2026-08-06T15:20:12.233803Z","title":"Robust Tracking via Mamba-based Context-aware Token Learning","venue":"cs.CV","work_id":"245c38a9-1692-4c25-a241-eeb309fa025c","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.230637Z"},"links":{"cited_paper":"/paper/2412.13611","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:41370a936f0d8e2544caf8361111e646d80957ef1e4807c67e0510931e3efde1","observation_id":"26d94542-1626-4d12-8754-89106045ce9f","resolution":{"observed_at":"2026-08-06T15:20:12.306621Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.591740Z","title":null,"venue":null,"work_id":"884d2c50-25b6-45bb-92fd-bcfedba56f8f","year":2021},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.865794Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:fe528ec40bef053019bdbebca0103e839dfa709db04c51f17512b22bab130e9d","observation_id":"e66b553a-cb35-4c90-8996-d2ac07febdc4","resolution":{"observed_at":"2026-08-06T15:20:14.678072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.450424Z","title":null,"venue":null,"work_id":"23754bb7-df7a-4737-81f4-3727449d159d","year":2023},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.997980Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:a6050f0202693eb4fc6374b6740c567d03f73e51013c39e5f2d4678da946dc88","observation_id":"500d506f-f219-4f14-80df-82dd05ad55bb","resolution":{"observed_at":"2026-08-06T15:20:14.514139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14168","last_updated":"2024-08-01T15:56:43Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:27:03Z","title":"Vivim: a Video Vision Mamba for Medical Video Segmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14168","snapshot_observed_at":"2026-08-06T15:20:11.176482Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.176482Z"},"links":{"cited_paper":"/paper/2401.14168","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:242add47c9047a93071f91878aed45f7525e008cbcb0a8a1cca658e25b5ce6af","observation_id":"79c2b040-56e9-4578-bd52-3eca28930e5f","resolution":{"observed_at":"2026-08-06T15:20:11.176482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.753480Z","title":null,"venue":null,"work_id":"d58c674b-ee07-4142-a2ef-e9e61269a514","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.589631Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:d3e7633e0366bbd2aea4a3295e17ff359bf1f2d04e654425543806fe0f4f53fb","observation_id":"14a0d89a-7d2f-4db3-a93f-fc86df08c73a","resolution":{"observed_at":"2026-08-06T15:20:14.839406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06625","last_updated":"2025-03-09T14:02:30Z","snapshot_observed_at":"2026-08-07T17:18:57.345263Z","submitted_at":"2025-03-09T14:02:30Z","title":"Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking","version":1},"cited_work":{"arxiv_id":"2503.06625","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.06625","snapshot_observed_at":"2026-08-06T15:20:11.910089Z","title":"Similarity-Guided Layer-Adaptive Vision Transformer for UAV Tracking","venue":"cs.CV","work_id":"cb0ec93d-81e0-40d9-8bb1-a20c5c76a247","year":2025},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:10.708501Z"},"links":{"cited_paper":"/paper/2503.06625","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:dbc2de4a04fd247d0699f24e958e413c949a408deff6e06c67de0f3665ede237","observation_id":"814a9bb0-55d8-4581-ab8e-fe38aa802f0f","resolution":{"observed_at":"2026-08-06T15:20:11.970007Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:13.935462Z","title":null,"venue":null,"work_id":"e0b97215-7c92-4bb2-bf61-bd5c220b90b1","year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.624042Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:413e20db279cde23d69a2b6d987242cf432a4b34d2f602d3ad7b6d7b097ec166","observation_id":"bcf5fe5b-8252-4f26-8ca3-38e18ccd8ab3","resolution":{"observed_at":"2026-08-06T15:20:14.002038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-06T15:20:11.741140Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.741140Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:d970fafa16ada8838ff037e01e1f4cc197d9d38391d53219d74e0e6627ef6c50","observation_id":"b796eb35-f9b2-4f07-bcf3-ffa49cb4a4ec","resolution":{"observed_at":"2026-08-06T15:20:11.741140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.292588Z","title":null,"venue":null,"work_id":"3dfc8f2e-3d45-400c-84d1-feccaff5429a","year":2022},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.308101Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:518f7cb5a2eeaa87dd1657b3d68b3f318d16f33c650742879bbb65ba2fcc124c","observation_id":"83578a43-effd-4ca6-aa62-b958aff1937e","resolution":{"observed_at":"2026-08-06T15:20:14.368760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:14.131604Z","title":null,"venue":null,"work_id":"4ec87fda-7c76-4f01-85e3-f056aa0fb100","year":2020},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:11.457487Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:f0d05dcc6199cc21a91ac2d65053aec3dca323be265f597e864b1cc9fd99d977","observation_id":"085fa55c-2c88-4327-bd26-5f9f0dbb56a9","resolution":{"observed_at":"2026-08-06T15:20:14.214621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.717655Z","title":"In Proceedings of the IEEE conference on computer vision and pattern recognition","venue":null,"work_id":"877fd729-abca-4079-9c2a-1d46a0495ebe","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:07.220686Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:875461c6d376b9a55ae3e9275220cc6beab4cd66bfb10a6a0022970b8840c251","observation_id":"712c4763-bc2e-477c-a567-b5cf11c308dd","resolution":{"observed_at":"2026-08-06T15:20:17.723520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:17.777934Z","title":"InProceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"98a2da6a-dffa-4734-a841-1c0bb5856b94","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:06.866642Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:ca501001f1f448ad366dec2f5cd7a2f16640294f37a22f5591dd2e0ef7427d24","observation_id":"b7a0f9fa-ded2-4760-a00a-3648a654f51f","resolution":{"observed_at":"2026-08-06T15:20:17.782936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:15.864983Z","title":"In Proceed- ings of the AAAI Conference on Artificial Intelligence , Vol","venue":null,"work_id":"a20071e3-a26e-4d76-881a-d5aca47ddb0c","year":null},"citing_paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:09.547849Z"},"links":{"citing_paper":"/paper/2507.16191"},"observation_digest":"sha256:477df56a3f0e4a0cf29bc4aa26521f9301320518c507aafe653138e69289a560","observation_id":"d362ebd0-b116-4c51-a047-5ffba4268729","resolution":{"observed_at":"2026-08-06T15:20:16.010266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16191","last_updated":"2025-08-20T02:43:14Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T15:13:27.552617Z","submitted_at":"2025-07-22T03:07:50Z","title":"Explicit Context Reasoning with Supervision for Visual Tracking"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":45,"verified_exact":6,"verified_fuzzy":3},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2507.16191."}