{"as_of":"2026-08-07T10:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8f236bcfce24df8f69a468a7923de03977a59b7d66359a21c2e26c59a3e34b11","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T03:08:45.931239Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13983/citation-record","integrity":"/paper/2607.13983/integrity","json":"/paper/2607.13983/citation-record.json","paper":"/paper/2607.13983"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:44.625633Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:44.625633Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:30fa8f7322b8008312696db30e3359ab26bfeb3db444f8526d05d2c645db7af8","observation_id":"f50e1e6c-f2f4-4ec1-b6cc-ce6525dcd32e","resolution":{"observed_at":"2026-08-02T03:08:44.625633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-02T03:08:44.712232Z","title":"An image is worth 16x16 words: Trans- formers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:44.712232Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:efacc279c585fe79abed544a7a20f416f68495d3252d44a1f0fac4bc4e72cc13","observation_id":"fb68a3cf-1f0f-4f60-85be-0367b4915b24","resolution":{"observed_at":"2026-08-02T03:08:44.712232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:44.792791Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:44.792791Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:592f6ff4b20ec912f442e16f6790217b49d88427e35e803e660bf560d56c69e9","observation_id":"21ffc286-8f2c-4e58-8774-0b085b00e7af","resolution":{"observed_at":"2026-08-02T03:08:44.792791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:44.866848Z","title":"Rotary position embedding for vision transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:44.866848Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:9051840424030e335e2a4e24f3d158e5f12df805c6a790e779b0f83afd67f7de","observation_id":"1e6dd1dc-6674-48f3-ade0-27f829df1c6a","resolution":{"observed_at":"2026-08-02T03:08:44.866848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:44.922564Z","title":"Segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:44.922564Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:5ab0e7c0d2291d1dc373388f2125c8aa21def6b928c135cd44151ad99aad026f","observation_id":"81de5a9a-631b-48f2-8f50-37d41aef5ce5","resolution":{"observed_at":"2026-08-02T03:08:44.922564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:44.988601Z","title":"Big transfer (bit): General visual representation learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:44.988601Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:906d57fa4ac6e458c4a644da8b0994863089931d7e0e4fad8082aae87526cf04","observation_id":"cfd16ff1-cfbe-40c7-bb80-8be6f2438ebf","resolution":{"observed_at":"2026-08-02T03:08:44.988601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.110278Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.110278Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:769be9f06fb0b9c9535a70785f98c2979592ea7e56f51002f190b498fd7ec6a6","observation_id":"b328bd25-e0dd-4c1e-ac92-f08f5bf9f89f","resolution":{"observed_at":"2026-08-02T03:08:45.110278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.158294Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.158294Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:33758c7a603d407b13757bca5aa0f9055aa55628b047d2010eb4c08b97a2d053","observation_id":"32b0d7c4-8a60-47ff-ab4e-addfeb0bc8a7","resolution":{"observed_at":"2026-08-02T03:08:45.158294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.01178","last_updated":"2026-05-07T15:58:45Z","snapshot_observed_at":"2026-07-06T22:51:31.209896Z","submitted_at":"2026-04-01T17:29:08Z","title":"Screening Is Enough","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.01178","snapshot_observed_at":"2026-08-02T03:08:45.224306Z","title":"Screening is enough.arXiv preprint arXiv:2604.01178, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.224306Z"},"links":{"cited_paper":"/paper/2604.01178","citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:3a3952218f2e1c8a45862939e43023a28d629efbe02dfe91c88fc5f7d7741717","observation_id":"ff52a691-8f71-4350-9486-d3e2419facd9","resolution":{"observed_at":"2026-08-02T03:08:45.224306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.305530Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.305530Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:b8fd3cabd85130d11c5fdbed63d0fe79a7ec63bd5510de823042902f43b36fa8","observation_id":"2429aa89-af95-4e09-94cd-aac9c58bd661","resolution":{"observed_at":"2026-08-02T03:08:45.305530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10270","last_updated":"2022-06-23T10:51:04Z","snapshot_observed_at":"2026-08-06T08:18:31.112514Z","submitted_at":"2021-06-18T17:58:20Z","title":"How to train your ViT? Data, Augmentation, and Regularization in Vision Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10270","snapshot_observed_at":"2026-08-02T03:08:45.376016Z","title":"How to train your vit? data, augmentation, and regularization in vision transformers.arXiv preprint arXiv:2106.10270, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.376016Z"},"links":{"cited_paper":"/paper/2106.10270","citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:d1edc62f0a00279c3b4cb358f6a2e155aac5f58076f10927036f0d5683caa0e7","observation_id":"ebba460c-3cad-45ec-bfdd-c603b8daea9e","resolution":{"observed_at":"2026-08-02T03:08:45.376016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.442903Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 568:127063,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.442903Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:e2c0c6e30074e2226dbbac57991a56e5fe466602124d08945fe482bf9eb07f64","observation_id":"6ac32eeb-84e1-4a82-95c5-949623c2f68c","resolution":{"observed_at":"2026-08-02T03:08:45.442903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.532987Z","title":"Mlp-mixer: An all-mlp architecture for vision.Advances in neural information processing systems, 34:24261–24272,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.532987Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:db0042b2d7a1f7da1822d6c305f7090ec875858016e1f08cbead3f78f31fb047","observation_id":"970419ec-61db-4cc7-b537-505e50ee01dc","resolution":{"observed_at":"2026-08-02T03:08:45.532987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.612160Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.612160Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:cecf1012366fd6c4d8c9265f602de1381b019d4fd55ca81745c770ae96100cea","observation_id":"19aed776-c5ce-4eed-ad5b-20c2d8414526","resolution":{"observed_at":"2026-08-02T03:08:45.612160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.706332Z","title":"Resmlp: Feedforward networks for image classification with data-efficient training.IEEE transactions on pattern analysis and machine intelligence, 45(4):5314–5321, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.706332Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:01cabb6d400a65df29d37fd833ca18b1b708893b2251e8fcde418f9a276cbf71","observation_id":"73f93eda-8c93-4fb3-a341-14cc6088dbe0","resolution":{"observed_at":"2026-08-02T03:08:45.706332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.831713Z","title":"Segformer: Simple and efficient design for semantic segmentation with transform- ers.Advances in neural information processing systems, 34: 12077–12090, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.831713Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:9a88f18ac3b3f5a5293d0b92c85b03ec3c234c17ebf67bd4be8a9e205e0be75e","observation_id":"02c4c6a6-84b7-4ddc-ba47-125c3176be3b","resolution":{"observed_at":"2026-08-02T03:08:45.831713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:08:45.931239Z","title":"Metaformer is actually what you need for vision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T03:08:45.931239Z"},"links":{"citing_paper":"/paper/2607.13983"},"observation_digest":"sha256:45e4f2409472dce27ecc780a87f0a59abc53fe4122366f95fe502031651ac99d","observation_id":"88c0535b-1857-477b-a2da-5a24e74c17e8","resolution":{"observed_at":"2026-08-02T03:08:45.931239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13983","last_updated":"2026-07-15T16:12:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T22:10:02.374626Z","submitted_at":"2026-07-15T16:12:48Z","title":"Screening Is Effective for Visual Recognition"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2607.13983."}