{"as_of":"2026-08-10T16:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76b6d502dfa4fa656f44944170dc2b82cae9fb9abc11141ca28ccba55c2e9c02","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:41:11.779207Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T14:28:32.127255Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":"2111.11429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-07-03T14:28:32.127255Z","title":"Bench- marking detection transfer learning with vision transformers","venue":null,"work_id":"fb035979-c073-4172-b236-f1fd9bac3d6f","year":2021},"citing_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-04T15:27:22.366324Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-16T22:43:10.880338Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2302.05543"},"observation_digest":"sha256:49f88e738c339f38588aba49b900a96e2e828ebc71c434f82823134eac42f4ec","observation_id":"035853c0-aa10-45dc-8345-d22ba0cda705","resolution":{"observed_at":"2026-05-16T22:43:10.971064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":"2111.11429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-07-03T14:28:32.127255Z","title":"Bench- marking detection transfer learning with vision transformers","venue":null,"work_id":"fb035979-c073-4172-b236-f1fd9bac3d6f","year":2021},"citing_paper":{"arxiv_id":"2407.17491","last_updated":"2026-04-03T23:10:26Z","snapshot_observed_at":"2026-08-02T18:34:18.562354Z","submitted_at":"2024-07-04T02:35:00Z","title":"Robust Adaptation of Foundation Models with Black-Box Visual Prompting","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-23T23:23:03.562550Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2407.17491"},"observation_digest":"sha256:8693f3e947684fa6e598fd0218c3da08e4cb6f21c2b83a0d291a13094a64da92","observation_id":"0408340d-2dd4-42e7-9e2b-3a84518b0e99","resolution":{"observed_at":"2026-05-23T23:23:36.307944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":"2111.11429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-07-03T14:28:32.127255Z","title":"Bench- marking detection transfer learning with vision transformers","venue":null,"work_id":"fb035979-c073-4172-b236-f1fd9bac3d6f","year":2021},"citing_paper":{"arxiv_id":"2410.07442","last_updated":"2024-10-11T08:46:46Z","snapshot_observed_at":"2026-08-03T04:31:54.832250Z","submitted_at":"2024-10-09T21:19:52Z","title":"Self-Supervised Learning for Real-World Object Detection: a Survey","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T19:02:11.415329Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2410.07442"},"observation_digest":"sha256:e539a521d55d5d4fd4c86d584d23dd8a5fe8df7d4e4afe7fd76e79c6673b0b0b","observation_id":"ffe2ee62-2558-4fe2-9a91-6e2b07c7cf38","resolution":{"observed_at":"2026-05-23T19:03:21.313635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-08-07T14:41:11.779207Z","title":"Bench- marking detection transfer learning with vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18097","last_updated":"2025-05-23T16:49:20Z","snapshot_observed_at":"2026-08-09T05:39:43.829960Z","submitted_at":"2025-05-23T16:49:20Z","title":"Towards more transferable adversarial attack in black-box manner","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:41:11.779207Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2505.18097"},"observation_digest":"sha256:08ab8a2631fc2fa48d12e19f6d9b41d1af7ed19a3472adf8382d21d3d30bc613","observation_id":"f5da79d6-9ca5-4b34-b89b-d243c4f3392a","resolution":{"observed_at":"2026-08-07T14:41:11.779207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-08-07T11:09:29.983561Z","title":"Benchmarking detection transfer learning with vision transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03433","last_updated":"2025-07-18T22:02:16Z","snapshot_observed_at":"2026-08-08T16:09:41.636816Z","submitted_at":"2025-06-03T22:34:17Z","title":"ViT-Split: Unleashing the Power of Vision Foundation Models via Efficient Splitting Heads","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:09:29.983561Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2506.03433"},"observation_digest":"sha256:130c4b8c7e4aba165f53955bd8464d50eb4c8468848a7dd75e453c876a1f035d","observation_id":"23514c34-1a8e-4d4a-9c7e-d94883a6abcd","resolution":{"observed_at":"2026-08-07T11:09:29.983561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-08-05T21:05:12.990008Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09446","last_updated":"2025-08-13T02:57:43Z","snapshot_observed_at":"2026-08-07T21:45:48.482975Z","submitted_at":"2025-08-13T02:57:43Z","title":"MPT: Motion Prompt Tuning for Micro-Expression Recognition","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T21:05:12.990008Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2508.09446"},"observation_digest":"sha256:e88329f5c58cd39beba43c124af1ae7610e724a60635e43bec93a6cf8e2f9e3e","observation_id":"ec110b89-46f8-47f9-8eb3-24092659f2d9","resolution":{"observed_at":"2026-08-05T21:05:12.990008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":"2111.11429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-07-03T14:28:32.127255Z","title":"Bench- marking detection transfer learning with vision transformers","venue":null,"work_id":"fb035979-c073-4172-b236-f1fd9bac3d6f","year":2021},"citing_paper":{"arxiv_id":"2604.14632","last_updated":"2026-04-16T05:20:38Z","snapshot_observed_at":"2026-07-06T23:02:22.790426Z","submitted_at":"2026-04-16T05:20:38Z","title":"High-Speed Full-Color HDR Imaging via Unwrapping Modulo-Encoded Spike Streams","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T12:26:23.330051Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2604.14632"},"observation_digest":"sha256:2ab7b70d96698ca4750b591f7e72b779ff5cad53121b85d7ff5b637cc7492e68","observation_id":"8db358b3-08e6-4917-8f57-f906807425a8","resolution":{"observed_at":"2026-05-10T12:30:23.828688Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":"2111.11429","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-07-03T14:28:32.127255Z","title":"Bench- marking detection transfer learning with vision transformers","venue":null,"work_id":"fb035979-c073-4172-b236-f1fd9bac3d6f","year":2021},"citing_paper":{"arxiv_id":"2606.13289","last_updated":"2026-06-11T12:46:07Z","snapshot_observed_at":"2026-08-02T10:42:01.559662Z","submitted_at":"2026-06-11T12:46:07Z","title":"HYDRA-X: Native Unified Multimodal Models with Holistic Visual Tokenizers","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T07:01:07.362430Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2606.13289"},"observation_digest":"sha256:7b16ce392ce53c15a58acdb3de0c92416e9666789e1ad3383c1694486b751623","observation_id":"edc35e0a-9445-4d58-bf6f-9bc4420c5c4b","resolution":{"observed_at":"2026-07-03T14:28:32.128646Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.11429","snapshot_observed_at":"2026-08-01T04:29:45.886889Z","title":"arXiv preprint arXiv:2111.11429 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22531","last_updated":"2026-07-24T17:59:39Z","snapshot_observed_at":"2026-08-07T13:04:18.211748Z","submitted_at":"2026-07-24T17:59:39Z","title":"Twins: Learn to Predict Unified Representations with Focal Loss","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T04:29:45.886889Z"},"links":{"cited_paper":"/paper/2111.11429","citing_paper":"/paper/2607.22531"},"observation_digest":"sha256:f1fa8def8c79389350b761be5e2b4a430c550f3a7d17b2a69d1de75e2568bf63","observation_id":"ab45c2d1-414b-41c5-9bfd-4eb025eb2c1e","resolution":{"observed_at":"2026-08-01T04:29:45.886889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2111.11429/citation-record","integrity":"/paper/2111.11429/integrity","json":"/paper/2111.11429/citation-record.json","paper":"/paper/2111.11429"},"outbound":[],"paper":{"arxiv_id":"2111.11429","last_updated":"2021-11-22T18:59:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T12:11:02.119174Z","submitted_at":"2021-11-22T18:59:15Z","title":"Benchmarking Detection Transfer Learning with Vision Transformers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2111.11429."}