{"as_of":"2026-08-07T15:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:895d6b4769eb39e014cb7506d62573a8b10a2900915a6c062759a945a3655548","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:39:37.185815Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:01:20.394734Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T11:01:21.358336Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"cited_work":{"arxiv_id":"2506.23832","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.23832","snapshot_observed_at":"2026-08-05T11:01:21.358336Z","title":"Low-latency vision transformers via large-scale multi-head attention","venue":"cs.CV","work_id":"a80be56d-6dbe-43e8-a384-dee94ae7c37e","year":2025},"citing_paper":{"arxiv_id":"2509.03407","last_updated":"2025-09-03T15:32:50Z","snapshot_observed_at":"2026-08-06T18:02:20.845251Z","submitted_at":"2025-09-03T15:32:50Z","title":"Learning Mechanism Underlying NLP Pre-Training and Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T11:01:20.394734Z"},"links":{"cited_paper":"/paper/2506.23832","citing_paper":"/paper/2509.03407"},"observation_digest":"sha256:926780075e24c7b686149d9dda2efb801510e99780fc4d8677509bacddce4445","observation_id":"15c01bdf-e0a9-440b-a0c5-a8f1d4c37ffb","resolution":{"observed_at":"2026-08-05T11:01:21.365202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23832/citation-record","integrity":"/paper/2506.23832/integrity","json":"/paper/2506.23832/citation-record.json","paper":"/paper/2506.23832"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:42.659245Z","title":null,"venue":null,"work_id":"a63daa2e-6f22-4309-a09d-6357d0f2c9f5","year":null},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.674142Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:9a674305086df384b4b46718a5a73466dfa2186868caf679f43473c91435322c","observation_id":"9e89b1b9-4f80-4f72-8cbd-32ca8fce7d45","resolution":{"observed_at":"2026-08-06T21:39:42.713058Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:42.524740Z","title":null,"venue":null,"work_id":"98cb02a8-7a4e-4179-9c46-f7a6f4afd0ea","year":null},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.703937Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:19706501e77dbc5b1e9d11be28cf243a1285c6fa83e2c43e7170c2db20c3b261","observation_id":"8edef0ea-0412-4cfe-a67b-6b9b11dae770","resolution":{"observed_at":"2026-08-06T21:39:42.594222Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:42.385501Z","title":null,"venue":null,"work_id":"89fe4e3c-79a1-4e89-baca-1079d26482e8","year":null},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.759515Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:f2652cc46db717e65c959d2ac6eead8551af5bcecbdef7916e1317b30a9f1fa4","observation_id":"245a0265-cc7b-4615-92af-83d18fcb8a2d","resolution":{"observed_at":"2026-08-06T21:39:42.440773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:42.208867Z","title":"Several CCT architectures comprising of seven components , with varying numbers of CLs, transformer blocks, heads, and 𝑑𝑖𝑚, achieve similar accuracies of ~0.81 (Tables 2–4)","venue":null,"work_id":"aa399f24-a961-4925-8a71-11c2bd589e13","year":2000},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.812928Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:8095d8c1e44344b8409c66a77c11a44c16f2c946a7c40777b960c37a57f85408","observation_id":"38ad5206-51e2-48e2-bb9a-9138dfadee25","resolution":{"observed_at":"2026-08-06T21:39:42.299861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:42.009802Z","title":"ignition","venue":null,"work_id":"a84e6422-cb6c-40f5-aebe-75b9ce058cee","year":null},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.851634Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:ff69cebb7f276c0c8a56b7ea61baaa713b41ad62b6e60850c78a0b4e5f00bae8","observation_id":"49180c26-351b-4ea8-a2f6-33bcb8360052","resolution":{"observed_at":"2026-08-06T21:39:42.112322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:41.884288Z","title":null,"venue":null,"work_id":"03bf0552-f18f-4e97-8f62-4dbcd23de151","year":2019},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.889355Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:ed6bd5fb16ae8544c629626c7b267a03c8757f59774bb02cb1c631d5b452aa46","observation_id":"df68c908-c15a-4768-9972-e2a5e629c318","resolution":{"observed_at":"2026-08-06T21:39:41.941541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T21:39:33.922080Z","title":"Simonyan, A","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.922080Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:8915faf23585c875e607b35029f530aaad480ae248b4dbdc3794075a950ebc97","observation_id":"7092366e-882e-4ce0-b5d4-02a6c0cd6acb","resolution":{"observed_at":"2026-08-06T21:39:33.922080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:33.968011Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:33.968011Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:3a28cc28c5c48048e80fa315f4636746ab8586ec3add044a582a74509652a047","observation_id":"f9d97c64-18cf-4d34-b2d0-ce1bca22e288","resolution":{"observed_at":"2026-08-06T21:39:33.968011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T21:39:34.014781Z","title":"Dosovitskiy, An image is worth 16x16 words: Transformers for image recognition at scale, arXiv preprint arXiv:2010.11929, (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.014781Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:866a267a291e24e62df2685a6248cedfee8fc3091950354d086bc08675bc4908","observation_id":"0876577c-2d8c-4ab3-9953-9503cd23e6cf","resolution":{"observed_at":"2026-08-06T21:39:34.014781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:41.722849Z","title":"Vaswani, Attention is all you need, Advances in Neural Information Processing Systems, (2017)","venue":null,"work_id":"c668d6b8-3e35-4124-a00b-a3ab6bad0f6b","year":2017},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.076150Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:da332cbee2e4f9208a14eb7a349f4ffc1a11e8118d3c3bbc1ddc652113a2850c","observation_id":"a6773015-0e46-4557-aba7-a21cb3c1723c","resolution":{"observed_at":"2026-08-06T21:39:41.791212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03584","last_updated":"2020-01-10T09:06:09Z","snapshot_observed_at":"2026-07-06T08:35:42.709133Z","submitted_at":"2019-11-08T23:48:38Z","title":"On the Relationship between Self-Attention and Convolutional Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03584","snapshot_observed_at":"2026-08-06T21:39:34.141455Z","title":"Cordonnier, A","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.141455Z"},"links":{"cited_paper":"/paper/1911.03584","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:34d52704be6968046207a3710338bd5e7f6abf56f4f872d1cb413d5ffba74b35","observation_id":"0fc6cdd0-6d73-4d66-a852-b0e85994817c","resolution":{"observed_at":"2026-08-06T21:39:34.141455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:41.569258Z","title":null,"venue":null,"work_id":"ec9924ac-f870-4bb0-a327-8f3fe974fe08","year":2020},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.206141Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:5e979298fd62c4f44721daedc2d4db4a218de799d7b921ba7e27193545008ac2","observation_id":"e6d5b42f-37d4-4c68-80ba-cefc67162742","resolution":{"observed_at":"2026-08-06T21:39:41.625985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12900","last_updated":"2025-04-09T13:06:49Z","snapshot_observed_at":"2026-07-06T20:24:27.525217Z","submitted_at":"2025-01-22T14:19:48Z","title":"Unified CNNs and transformers underlying learning mechanism reveals multi-head attention modus vivendi","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12900","snapshot_observed_at":"2026-08-06T21:39:34.270951Z","title":"Koresh, R.D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.270951Z"},"links":{"cited_paper":"/paper/2501.12900","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:3b6cdb64bb1e7c2f578a486d39e115bf47f5eff6c7e6185999588430979e18eb","observation_id":"3f7bdc5f-f13b-43c8-849b-ac96f973a776","resolution":{"observed_at":"2026-08-06T21:39:34.270951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12880","last_updated":"2025-06-12T05:37:11Z","snapshot_observed_at":"2026-08-06T04:42:12.057925Z","submitted_at":"2025-01-22T13:40:43Z","title":"Advanced deep architecture pruning using single filter performance","version":2},"cited_work":{"arxiv_id":"2501.12880","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.12880","snapshot_observed_at":"2026-08-06T21:39:37.446283Z","title":"Advanced deep architecture pruning using single filter performance","venue":"cs.LG","work_id":"57062968-2186-4043-82ea-ff87b8c78f43","year":2025},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.353144Z"},"links":{"cited_paper":"/paper/2501.12880","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:3f2219775162a3b94ced9e61a13ac2299a73ee214c40addf88b81c31f2b93b63","observation_id":"87a7a2ca-d635-43df-8a31-6dfaf4b29e15","resolution":{"observed_at":"2026-08-06T21:39:37.502933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:41.418462Z","title":"Barra, G","venue":null,"work_id":"37b1ad48-0969-458a-ba48-ff9d2456b431","year":2017},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.432919Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:6f8ec878b6a938fd3578a6dd062030786941a96fd0f12c33ab98dbbede3ed6a2","observation_id":"62c98102-6487-4e5b-a5ef-8b1cdc29ba43","resolution":{"observed_at":"2026-08-06T21:39:41.477740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:41.238437Z","title":"Agliari, L","venue":null,"work_id":"dc3fd998-c7c7-4b7a-8b1b-206bae8aca77","year":2020},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.520473Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:79c4fb50a645c2e189f9ff365db026ba4e43dee4b95370b390948ceb70e0b78f","observation_id":"22393dfe-7368-4598-b085-344945ec4fb5","resolution":{"observed_at":"2026-08-06T21:39:41.341889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05704","last_updated":"2022-06-07T19:25:30Z","snapshot_observed_at":"2026-08-07T09:29:25.938148Z","submitted_at":"2021-04-12T17:58:56Z","title":"Escaping the Big Data Paradigm with Compact Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05704","snapshot_observed_at":"2026-08-06T21:39:34.594967Z","title":"Hassani, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.594967Z"},"links":{"cited_paper":"/paper/2104.05704","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:6752968acea8eeea5c68cc80d7233651e2ecb51a6e76c4cd7e40f6700ca13c23","observation_id":"98c62ac3-a01d-44a5-9e82-6044d732fc29","resolution":{"observed_at":"2026-08-06T21:39:34.594967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:34.696379Z","title":"Krizhevsky, G","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.696379Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:8445cb0a1aef0ee84c5c495beb788ebdfd49ef00f4e6ecd0d48b9dc64c0400fe","observation_id":"500376ca-2a5e-48f4-879f-118072ddf16e","resolution":{"observed_at":"2026-08-06T21:39:34.696379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:34.783788Z","title":"Koresh, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.783788Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:1a087e9fab5881e9ad530b5c5b1cb152ec3ef1aba5e04149d027a2ff3a16eab0","observation_id":"0ec6662f-cc65-4095-a249-0e0440edb72a","resolution":{"observed_at":"2026-08-06T21:39:34.783788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:34.843445Z","title":"Tevet, R.D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.843445Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:fa186558c8dd5af951e536f9b1c02e681b0ddd4b5781e6d6eaaf07681cd57d0a","observation_id":"ae99e7f9-ff18-437e-8b07-640ac00ec3b2","resolution":{"observed_at":"2026-08-06T21:39:34.843445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:41.063020Z","title":null,"venue":null,"work_id":"fce1bd40-418a-4ccf-9720-53243549ff6b","year":2023},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:34.931638Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:1950d264dd28e9fca6e2207d27ed0b6acf9a697e505d978f325d71540ac17924","observation_id":"551600c7-b5e3-4915-a2cd-99db275b20e6","resolution":{"observed_at":"2026-08-06T21:39:41.139909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:40.923755Z","title":null,"venue":null,"work_id":"a373575d-30df-4aae-95e4-aa7fe1527b0d","year":2024},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.030892Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:9667103cd1afabe67f59ff1b7c76a7ddc64c86c1e12b4b5351438dcc713c8eb4","observation_id":"24d69a1a-f3db-4afa-b970-f10b3a6dfa7f","resolution":{"observed_at":"2026-08-06T21:39:40.983942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18078","last_updated":"2023-05-29T13:28:43Z","snapshot_observed_at":"2026-08-06T16:18:50.282813Z","submitted_at":"2023-05-29T13:28:43Z","title":"The mechanism underlying successful deep learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18078","snapshot_observed_at":"2026-08-06T21:39:35.088743Z","title":"Tzach, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.088743Z"},"links":{"cited_paper":"/paper/2305.18078","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:e23f813bc99ad85310f42ef01c10fd7660ed6761fd63ea81155f177ce7ff2670","observation_id":"05e82f77-3974-4b48-8f0b-46d348cf2851","resolution":{"observed_at":"2026-08-06T21:39:35.088743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:40.800156Z","title":"Breiman, Bagging predictors, Machine learning, 24 (1996) 123-140","venue":null,"work_id":"eeae71d0-b6c0-408b-9ed6-0510f61c2ee3","year":1996},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.138915Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:1153c26bac4db856b6963d220d3345bd4b51dd644d29bf172e25d2163899896a","observation_id":"4fc9fb88-6848-44fe-b977-2a324b0184d9","resolution":{"observed_at":"2026-08-06T21:39:40.837798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:40.621271Z","title":"Kumari, D","venue":null,"work_id":"e9ff6e1f-9468-4472-a654-8cff88f1510d","year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.217982Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:207b49f8302bc5c3e1fb6885892b8ce6cafab71d2a8df9caa7ae55fe9bba7646","observation_id":"21e84f0a-e595-4458-81b6-1ea8dadf81ae","resolution":{"observed_at":"2026-08-06T21:39:40.725067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:40.451606Z","title":"Nakkiran, G","venue":null,"work_id":"ff1989eb-a732-4c85-bb29-d3a7c5a993c8","year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.332235Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:bb41e72dece4bd20a03af3d5a745b48ea15f4d7061cc71f010710de5c816fb89","observation_id":"a46a5baa-b082-444d-a718-1393334a5bac","resolution":{"observed_at":"2026-08-06T21:39:40.548005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:40.264351Z","title":null,"venue":null,"work_id":"8799e022-2660-4053-b7b0-d77f8a59049d","year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.392920Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:dad8dc9cddd150cab929b07823b417af92c0301fe2e34033593db6380a355ed3","observation_id":"0b587ff1-84d4-4662-a03e-63605b1753ca","resolution":{"observed_at":"2026-08-06T21:39:40.334001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04451","last_updated":"2020-02-18T16:01:18Z","snapshot_observed_at":"2026-07-06T08:50:12.690900Z","submitted_at":"2020-01-13T18:38:28Z","title":"Reformer: The Efficient Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04451","snapshot_observed_at":"2026-08-06T21:39:35.467776Z","title":"Kitaev, Ł","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.467776Z"},"links":{"cited_paper":"/paper/2001.04451","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:1e1563f54801a47bc54e70bb3f5e5e5a21d9607529c0e01d450b3d6f6c9a1287","observation_id":"229de4b5-4e27-4a44-b1a2-0be2c19eef29","resolution":{"observed_at":"2026-08-06T21:39:35.467776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:40.045227Z","title":null,"venue":null,"work_id":"e72a21bc-6843-4cd3-aebd-b02c408089ae","year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.522648Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:a55f0d1bdb29b3711dc9165632700a6be1e9daef1b21534022787781d8a04b66","observation_id":"bd61316a-49cd-428f-89cd-80a09f21f1ca","resolution":{"observed_at":"2026-08-06T21:39:40.143200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:39.894096Z","title":null,"venue":null,"work_id":"aa4d0643-7556-4a12-8934-dd9139603a7e","year":2022},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.567724Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:e1bda826a777f77f689978c7b2a88af64c3681081a097769337f0ca3384a9def","observation_id":"704b36fa-a5df-4313-a68b-c4094329e26f","resolution":{"observed_at":"2026-08-06T21:39:39.969498Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:39.746714Z","title":"Blatt, E","venue":null,"work_id":"0f58b345-ff2c-4eaa-92ba-0b787e3dc3f1","year":1995},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.610039Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:b0201427b9dd2eb95ace3e51d25b3d772ead44165e7df6314128418a2907e72b","observation_id":"0df41842-e9e4-41aa-9036-a2909c1eba1a","resolution":{"observed_at":"2026-08-06T21:39:39.815074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:39.563847Z","title":null,"venue":null,"work_id":"5df8d507-e09b-48e5-9137-123103e28222","year":2009},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.682998Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:678419159d44c27d5b1ab29f25379e4c69665a0efbdb230bd0d2899904bf7b19","observation_id":"82d0948c-8bb1-4576-a65c-7bf506c4429a","resolution":{"observed_at":"2026-08-06T21:39:39.652273Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:39.382388Z","title":null,"venue":null,"work_id":"24aaef89-f22b-437a-8c03-818f5e462bbc","year":2019},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.764274Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:cc3b9a125929465b59949b310e7fba26c22b96e642dfa5f67cd4a7890bbb808e","observation_id":"4691b13c-15a6-44cf-b641-1474b4b6439e","resolution":{"observed_at":"2026-08-06T21:39:39.469733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T21:39:35.824935Z","title":"Liu, Roberta: A robustly optimized bert pretraining approach, arXiv preprint arXiv:1907.11692, 364 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.824935Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:f5abf8aafc9554ac8df8662a97c015f3b0d5afd6a662463035d5aa43979015d3","observation_id":"d4edc55d-1879-456f-bb77-559fcd20fa79","resolution":{"observed_at":"2026-08-06T21:39:35.824935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T21:39:35.897471Z","title":"Achiam, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.897471Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:8eed6ace17207fea019211fc455f957620d9097926d4e3f4c8977fd6723e10d0","observation_id":"0fcb6906-350c-4a40-ba1f-b65d804e1ba9","resolution":{"observed_at":"2026-08-06T21:39:35.897471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11717","last_updated":"2023-03-21T10:09:47Z","snapshot_observed_at":"2026-07-06T15:06:04.559453Z","submitted_at":"2023-03-21T10:09:47Z","title":"A Complete Survey on Generative AI (AIGC): Is ChatGPT from GPT-4 to GPT-5 All You Need?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11717","snapshot_observed_at":"2026-08-06T21:39:35.960244Z","title":"Zhang, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:35.960244Z"},"links":{"cited_paper":"/paper/2303.11717","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:ba1e4ac610d334de13817da1568598476616cb58d83f52d5e9c20e29d73048ed","observation_id":"94c2f037-43ea-4855-af00-95df5488b42e","resolution":{"observed_at":"2026-08-06T21:39:35.960244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:39.221729Z","title":"dreaming","venue":null,"work_id":"446ebf87-e575-425d-9dbf-9ad50d9a0105","year":2022},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.005084Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:ceb54c012c12884eed299d3327e7ab7fc3f472e0d15d17ef28e0abfca0d1b1c7","observation_id":"05e53a55-68da-4960-8f28-16823f4ccafb","resolution":{"observed_at":"2026-08-06T21:39:39.294208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:39.033097Z","title":"Agliari, F","venue":null,"work_id":"22445d44-61a8-492d-8768-7a702331c012","year":2022},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.087766Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:eabf8f1136bf2c000e1ce2d82724e9e9c56d5eab4eafe166a9057fd2be108952","observation_id":"214c937e-d9d5-44c8-b65b-ca46b13d98ac","resolution":{"observed_at":"2026-08-06T21:39:39.120089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:38.866071Z","title":"Salakhutdinov, G","venue":null,"work_id":"4e8db546-020a-41eb-9451-7a3139c3a576","year":2009},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.141760Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:2aa98609ec82f19e2fd6a01c89985f5f61ff9a5b14ebacf58914fc30607833de","observation_id":"96b675be-f32c-4220-8c34-3734b7b51081","resolution":{"observed_at":"2026-08-06T21:39:38.932065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:38.679401Z","title":"Ivanov, The new field of network physiology: building the human physiolome, in, Frontiers Media SA, 2021, pp","venue":null,"work_id":"be94c456-251a-4d70-956e-77cc405a27e3","year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.227952Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:187add536c264be454e0bb95e7faa8243a49bba433394a3a1a885bf29818aec5","observation_id":"ba3378e8-24a8-4802-b641-ab63bae75a36","resolution":{"observed_at":"2026-08-06T21:39:38.768950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:38.506913Z","title":"Ivanov, R.P","venue":null,"work_id":"760459db-c6b2-45d9-a5cb-adce6406999b","year":2014},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.300176Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:543a3e0b7362bb567926019f841e7e09cc276221d54316bea225a3ded208bc8c","observation_id":"2b901e76-4305-44b6-ad62-88b2e15df2d0","resolution":{"observed_at":"2026-08-06T21:39:38.585847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:38.351580Z","title":"Ivanov, K.K","venue":null,"work_id":"4d4f2b0e-1707-4ec2-b5a3-2523831a72d0","year":2016},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.368128Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:17ca71be4249f6fb8d6e9449841685fb7c775c58bd96f0c837b0649de2f2e13d","observation_id":"a63965fb-67ba-4bd2-9699-82868f5a3abc","resolution":{"observed_at":"2026-08-06T21:39:38.413447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:38.186732Z","title":null,"venue":null,"work_id":"54e2cbb2-a424-480b-97f1-61cfe70eb087","year":2019},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.471091Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:1b7877f15de30e64736dc4867cd7f4ba3e0971a605c095402725ceacb033fe21","observation_id":"8cf51606-f569-4fa6-97f4-35507037c856","resolution":{"observed_at":"2026-08-06T21:39:38.271558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-07-06T06:06:04.571585Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-06T21:39:36.573116Z","title":"Zhang, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.573116Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:9674520bd3efe2ed64df68adbde21ddd9305e3af174dd9be18fefc56c2ad9098","observation_id":"9824ac56-ab8a-42c9-b1ee-e83abe2e9737","resolution":{"observed_at":"2026-08-06T21:39:36.573116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:38.040087Z","title":"Cubuk, B","venue":null,"work_id":"ec5a033d-26d9-4101-a706-84e1b0081f68","year":2020},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.646146Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:004012155d52b28b99fae9bfafab113499db0f8c5276c6911cbac2531bb5113d","observation_id":"de636c71-47da-4d61-bc96-4333bb2962ba","resolution":{"observed_at":"2026-08-06T21:39:38.108866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:37.832265Z","title":"Zhong, L","venue":null,"work_id":"86ec2edf-3d02-4130-8ff2-ce565a8cd954","year":2020},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.737510Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:295e7748460f6f4c835f5c9d2e8d1d9c21d2ccc214372de9d6e714460c4c3e45","observation_id":"b46d959b-26aa-459e-af65-add30c536967","resolution":{"observed_at":"2026-08-06T21:39:37.929884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1205.2653","last_updated":"2012-05-09T15:01:22Z","snapshot_observed_at":"2026-07-06T02:47:58.266745Z","submitted_at":"2012-05-09T15:01:22Z","title":"L2 Regularization for Learning Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1205.2653","snapshot_observed_at":"2026-08-06T21:39:36.859400Z","title":"Cortes, M","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.859400Z"},"links":{"cited_paper":"/paper/1205.2653","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:c906c78a8d4d96b990626026428c64aabcecb3dbebc0af9255977a5bd7984f8d","observation_id":"24118210-fddb-4329-b730-86b6e8bef6c4","resolution":{"observed_at":"2026-08-06T21:39:36.859400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-06T21:39:36.932644Z","title":"Loshchilov, F","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:36.932644Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:c85080082ffa01f770fabfa9fc41df9ae72c6d55464c050a7f40b7be115945c8","observation_id":"68199b9d-2778-45c3-9f7f-fb4db2078e1b","resolution":{"observed_at":"2026-08-06T21:39:36.932644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.00476","last_updated":"2021-10-01T15:09:22Z","snapshot_observed_at":"2026-07-06T11:53:31.073250Z","submitted_at":"2021-10-01T15:09:22Z","title":"ResNet strikes back: An improved training procedure in timm","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.00476","snapshot_observed_at":"2026-08-06T21:39:37.008735Z","title":"Wightman, H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:37.008735Z"},"links":{"cited_paper":"/paper/2110.00476","citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:0d73f6395d467f6a6ce3d9ede2f1ce8a0681b51ae773dee2f58378e17058d81e","observation_id":"6456e447-32bc-4b8c-aefd-169b73e9fc1f","resolution":{"observed_at":"2026-08-06T21:39:37.008735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:37.094992Z","title":"Schmidhuber, Deep learning in neural networks: An overview, Neural networks, 61 (2015) 85-117","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:37.094992Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:4f01a1bd89000484e307733cc2bddfee8f0a9b974b3ac02ef480f2607e559be9","observation_id":"3d72d2a8-598e-4e71-b301-4b79ae10e9c8","resolution":{"observed_at":"2026-08-06T21:39:37.094992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:37.681477Z","title":"Llugsi, S","venue":null,"work_id":"1358cf27-94c6-4e28-a1d3-d5cda5cd7555","year":2021},"citing_paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:37.185815Z"},"links":{"citing_paper":"/paper/2506.23832"},"observation_digest":"sha256:27228fb50541207efcc16a75115762597d8e9b10e1e16751f1a929d38e5e8e13","observation_id":"04e4ee6b-379b-47e6-89ba-55dd1a52e433","resolution":{"observed_at":"2026-08-06T21:39:37.749373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23832","last_updated":"2025-06-30T13:23:46Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T21:28:18.298105Z","submitted_at":"2025-06-30T13:23:46Z","title":"Low-latency vision transformers via large-scale multi-head attention"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2506.23832."}