{"as_of":"2026-08-09T12:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f4c0fd3c1e54fa9ac5df3a127436280becf173b54e688e4f00b5e0943c7643ee","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T16:06:14.458362Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.18960/citation-record","integrity":"/paper/2508.18960/integrity","json":"/paper/2508.18960/citation-record.json","paper":"/paper/2508.18960"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.05704","last_updated":"2022-06-07T19:25:30Z","snapshot_observed_at":"2026-08-07T09:29:25.938148Z","submitted_at":"2021-04-12T17:58:56Z","title":"Escaping the Big Data Paradigm with Compact Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05704","snapshot_observed_at":"2026-08-05T16:06:14.398738Z","title":"Adi Haviv, Ori Ram, Ofir Press, Peter Izsak, and Omer Levy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.398738Z"},"links":{"cited_paper":"/paper/2104.05704","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:bcbd1b15552aa8520eac1064ea18f8419486dc8b10090d1f4c4b594127d422c8","observation_id":"ef8e7f9b-7ebc-4014-a6d5-e324f47afdb4","resolution":{"observed_at":"2026-08-05T16:06:14.398738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.404401Z","title":"doi: 10.18653/v1/ 2022.findings-emnlp.99","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.404401Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:d3a78f924d564cd5faea376c6295762558923e6e5ea57c102dd671f3ce29be2e","observation_id":"0fe19501-ef97-4b5d-bdaa-df3de26baa2e","resolution":{"observed_at":"2026-08-05T16:06:14.404401Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01643","last_updated":"2025-02-16T14:14:16Z","snapshot_observed_at":"2026-08-09T04:16:12.949907Z","submitted_at":"2024-03-03T23:40:35Z","title":"Cost-Effective Attention Mechanisms for Low Resource Settings: Necessity & Sufficiency of Linear Transformations","version":3},"cited_work":{"arxiv_id":"2403.01643","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.01643","snapshot_observed_at":"2026-08-05T16:06:14.677876Z","title":"Cost-Effective Attention Mechanisms for Low Resource Settings: Necessity & Sufficiency of Linear Transformations","venue":"cs.LG","work_id":"375f2ca3-ee70-4da9-b8f8-645592be2884","year":2024},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.416634Z"},"links":{"cited_paper":"/paper/2403.01643","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:529b2afb583367f2109619be252e6127670a3ae56791ffa2c746a2b7804a91a9","observation_id":"64ad2ad0-021c-44ab-a671-194a217a42ed","resolution":{"observed_at":"2026-08-05T16:06:14.685538Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.436260Z","title":"doi: https://doi.org/10.1016/j.neucom.2023.127063","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.436260Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:6340d3fcb2fc0f6eedcb79e629476c0df51d02c7a4c8d56039fdbeaa3a5c9af8","observation_id":"464ad2bf-1c83-4c53-ae92-5278ebe1acc9","resolution":{"observed_at":"2026-08-05T16:06:14.436260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15808","last_updated":"2021-03-29T17:58:22Z","snapshot_observed_at":"2026-08-07T09:48:34.844893Z","submitted_at":"2021-03-29T17:58:22Z","title":"CvT: Introducing Convolutions to Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15808","snapshot_observed_at":"2026-08-05T16:06:14.447164Z","title":"Sangdoo Yun, Dongyoon Han, Seong Joon Oh, Sanghyuk Chun, Junsuk Choe, and Youngjoon Yoo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.447164Z"},"links":{"cited_paper":"/paper/2103.15808","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:c21ccee0e2d6ce8fbfedd826cfe269039c4f8ee5f44da4f79d987a91536ed226","observation_id":"342d9fec-7898-4ea9-95be-6a72925cb26a","resolution":{"observed_at":"2026-08-05T16:06:14.447164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6120","last_updated":"2014-02-19T17:26:57Z","snapshot_observed_at":"2026-08-08T04:46:43.735461Z","submitted_at":"2013-12-20T20:24:00Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6120","snapshot_observed_at":"2026-08-05T16:06:14.422608Z","title":"Jay Shah, Ganesh Bikshandi, Ying Zhang, Vijay Thakkar, Pradeep Ramani, and Tri Dao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.422608Z"},"links":{"cited_paper":"/paper/1312.6120","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:f977f5f54cc4b1ed09180c3b6cfa48f54676709aea7de9da8928d23ad72a0963","observation_id":"77667219-add1-41bf-ad91-3d62c193366b","resolution":{"observed_at":"2026-08-05T16:06:14.422608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.767264Z","title":"Haiping Wu, Bin Xiao, Noel Codella, Mengchen Liu, Xiyang Dai, Lu Yuan, and Lei Zhang","venue":null,"work_id":"7f45b157-30b1-4614-88df-05dbbeccd874","year":2017},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.442398Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:0824160af529bb503a15d3f457249733dbed2f89c770f9b0ee6baa18e5e01876","observation_id":"7016da55-e739-4284-b39f-5450aca25335","resolution":{"observed_at":"2026-08-05T16:06:14.772291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-05T16:06:14.458362Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.458362Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:bca9019a00c40ee32add358f61b216ef0e8b190c09e217fe9a5e0c7099dcefee","observation_id":"71035cb2-abc0-4f23-a82b-6351aeee45da","resolution":{"observed_at":"2026-08-05T16:06:14.458362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.04899","last_updated":"2019-08-07T07:15:29Z","snapshot_observed_at":"2026-08-03T20:05:54.521520Z","submitted_at":"2019-05-13T08:10:22Z","title":"CutMix: Regularization Strategy to Train Strong Classifiers with Localizable Features","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.04899","snapshot_observed_at":"2026-08-05T16:06:14.452828Z","title":"Hongyi Zhang, Moustapha Cisse, Yann N","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.452828Z"},"links":{"cited_paper":"/paper/1905.04899","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:92c9ba35701ce82bd5f7fd6351f242ffd796e8afc68953adc8b004ea0bbff6e6","observation_id":"6a0494e5-daa6-470f-8828-76e349d8abaf","resolution":{"observed_at":"2026-08-05T16:06:14.452828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T16:06:14.393248Z","title":"Ali Hassani, Steven Walton, Nikhil Shah, Abulikemu Abuduweili, Jiachen Li, and Humphrey Shi","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.393248Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:25a0da1412d71dca8d9066b5f4f901c260d78be66f88760a137bf9e01417b7e8","observation_id":"044f5c52-6736-4b19-92c1-876c51cb8275","resolution":{"observed_at":"2026-08-05T16:06:14.393248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T16:06:14.783290Z","title":null,"venue":null,"work_id":"d75d8505-1dde-4fed-9b55-643fad4cc846","year":2022},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.382302Z"},"links":{"citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:ec9daa29bfc03fe4e65365105d903d9cbd48bb51177ea34ba231e7749a94f41f","observation_id":"907e4757-36ba-4359-a650-e6c9f1287ac8","resolution":{"observed_at":"2026-08-05T16:06:14.790009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T16:06:14.410154Z","title":"Peyman Hosseini, Mehran Hosseini, Ignacio Castro, and Matthew Purver","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.410154Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:98b0d443e83293c18dd353b9b03b2153dc0a460439612a33a55eba869670d60d","observation_id":"81cad6fe-7339-4e3f-bcf8-472a4132a060","resolution":{"observed_at":"2026-08-05T16:06:14.410154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-07-06T18:44:53.587276Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-05T16:06:14.428458Z","title":"Nitish Srivastava, Geoffrey Hinton, Alex Krizhevsky, Ilya Sutskever, and Ruslan Salakhut- dinov","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.428458Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:72681ea586fdaa11f9fdc87462426711fc9f99da80ff8936d0d829a647b9e5b5","observation_id":"ab679388-0a74-4ee0-97ca-0309649c3202","resolution":{"observed_at":"2026-08-05T16:06:14.428458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T16:06:14.387738Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T16:06:14.387738Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2508.18960"},"observation_digest":"sha256:3be1fc05e89717aa447dae68695b80afbade8bbfc85062821ce1c8587b5d6c2c","observation_id":"d041d17a-9a10-418e-8133-0e08fe6e8f56","resolution":{"observed_at":"2026-08-05T16:06:14.387738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.18960","last_updated":"2025-08-26T12:00:38Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:58:40.545230Z","submitted_at":"2025-08-26T12:00:38Z","title":"Enhancing compact convolutional transformers with super attention"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2508.18960."}