{"as_of":"2026-08-07T18:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1624ec013f50edbdf4cb39dbc23d2686be3767b41b3cfd087bff41ac7b70bb47","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:59:21.733748Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17245/citation-record","integrity":"/paper/2507.17245/integrity","json":"/paper/2507.17245/citation-record.json","paper":"/paper/2507.17245"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T14:59:15.809601Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:15.809601Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:aa612231d00103153b3fa413a5cac5343677523396bae2de7bd3e8c2f6038f2d","observation_id":"232ab8e8-0c6f-42a3-bbd3-6da9baa9f452","resolution":{"observed_at":"2026-08-06T14:59:15.809601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-06T14:59:15.947288Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:15.947288Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:28e1aabeb511006b7022d995177ddb4b6a7dfb3cca27208d12ab332bb10979cd","observation_id":"c8d32dea-6d28-4bcd-8844-b4ce2b678eaa","resolution":{"observed_at":"2026-08-06T14:59:15.947288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:25.298055Z","title":null,"venue":null,"work_id":"eb7e5b6f-9bd4-48db-9afe-b494cf94bb47","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.091060Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:db49edf16ed7f5f07f7d95fc5fc2737ef6d1ff113b4aa58bbd313ec07dec1994","observation_id":"cb186c9f-1eb2-42f1-941b-54f9dbe4372c","resolution":{"observed_at":"2026-08-06T14:59:25.356724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:16.200592Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.200592Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:5b6faaa83c05f11d92d2ec942447dae5ec3d178b2a490b28bbcdf820ea48c946","observation_id":"853f1073-d9ec-4e71-bf89-46292efa64a0","resolution":{"observed_at":"2026-08-06T14:59:16.200592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:16.367152Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.367152Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:62e2935d87a4a2ec278e40371c1f6d736175149dbab9884f821d94ad654c17d9","observation_id":"25b20105-c41f-4db3-8e6b-d410cc1381d1","resolution":{"observed_at":"2026-08-06T14:59:16.367152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:25.123555Z","title":null,"venue":null,"work_id":"58a16d3c-cf97-48ea-b7fd-80ecf1f32b17","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.512501Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:d3c7f539542bda15a3256805fcce974d1e7f0c6419a1a0610fe39eb8d71b643d","observation_id":"2a50d29c-4eba-4b2b-9098-a6bf20a04d9a","resolution":{"observed_at":"2026-08-06T14:59:25.186070Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.999840Z","title":null,"venue":null,"work_id":"ad0e80a0-1c82-44c3-bb26-74dd28dfe643","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.655409Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:fa91379eb12727988e167190b5cf73a20b6a6a9e0c7badeb5893b40abb9ebd0e","observation_id":"9800c2b5-e3ea-4004-a220-09196fc83f1f","resolution":{"observed_at":"2026-08-06T14:59:25.058743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:16.778790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.778790Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:9740a46324bed0e4357581ec389590fd286e9329404724cf5ce7411b51625e95","observation_id":"b64bbc2b-056e-4911-82bd-b795f2ec4943","resolution":{"observed_at":"2026-08-06T14:59:16.778790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.885942Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":"627b213a-52de-4bfd-94fe-1a26a4add54c","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:16.904359Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:932088e2311739ad39d711942c9dea32d04dac2428c61182d85c5c7ae2c0cf31","observation_id":"27652ce9-950f-4c16-8c7d-868084b14f85","resolution":{"observed_at":"2026-08-06T14:59:24.932126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:17.064513Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.064513Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:12d9efe256a1bd92b24d9d312d215f7a3751ed5d93fae58134673d92adfcff09","observation_id":"f6823301-2c45-42cc-8a6c-65bc1a0c4098","resolution":{"observed_at":"2026-08-06T14:59:17.064513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T14:59:17.196470Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.196470Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:e4da7560f42c81d382a18b7a630b8072673775235f562615935775063720d5b1","observation_id":"9bed0c7a-70e5-48f3-a498-ec09ccf6b0b1","resolution":{"observed_at":"2026-08-06T14:59:17.196470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00314","last_updated":"2024-05-01T04:32:07Z","snapshot_observed_at":"2026-08-06T01:10:35.630780Z","submitted_at":"2024-05-01T04:32:07Z","title":"Model Quantization and Hardware Acceleration for Vision Transformers: A Comprehensive Survey","version":1},"cited_work":{"arxiv_id":"2405.00314","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00314","snapshot_observed_at":"2026-08-06T14:59:22.023639Z","title":"Model Quantization and Hardware Acceleration for Vision Transformers: A Comprehensive Survey","venue":"cs.LG","work_id":"20c0f764-a763-48c2-8e31-947bf290f961","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.399880Z"},"links":{"cited_paper":"/paper/2405.00314","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:bdd89c7085d02133b58d865728e904a9393d508b871f399ce58e05af413164a2","observation_id":"20a646ab-cabe-49c6-bfa5-fac000e01ef2","resolution":{"observed_at":"2026-08-06T14:59:22.117502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.741356Z","title":null,"venue":null,"work_id":"a992ad97-58b2-40ce-b824-c5f9d2c5c68a","year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.576673Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:cc9a743bc5cf3e6f0fc1006319d4cae7e2a73105702b506286755f4626addbbe","observation_id":"d057d2da-0cb7-45f2-884d-3476c81015e5","resolution":{"observed_at":"2026-08-06T14:59:24.798586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11582","last_updated":"2024-06-17T05:59:24Z","snapshot_observed_at":"2026-08-03T18:32:12.770690Z","submitted_at":"2024-05-19T15:22:25Z","title":"SLAB: Efficient Transformers with Simplified Linear Attention and Progressive Re-parameterized Batch Normalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11582","snapshot_observed_at":"2026-08-06T14:59:17.671731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.671731Z"},"links":{"cited_paper":"/paper/2405.11582","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:9b8b03d243d76a0d2e81bbf6007b825aef14dfef75d8d2a7066399d7a5f84f7e","observation_id":"47933c8a-f709-4c3e-89b0-46ed2084c6a5","resolution":{"observed_at":"2026-08-06T14:59:17.671731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.614281Z","title":null,"venue":null,"work_id":"501dc501-e9e0-4115-8a96-6e7322953799","year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:17.882438Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:b22560a2f9f370bb712fba8b9715a352f34cdceada66d6de39b792d23ccc61e5","observation_id":"14a700cd-df99-4479-85ef-b87b0fc22d22","resolution":{"observed_at":"2026-08-06T14:59:24.677589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06590","last_updated":"2024-12-09T15:44:22Z","snapshot_observed_at":"2026-07-06T20:03:56.309640Z","submitted_at":"2024-12-09T15:44:22Z","title":"Bridging the Divide: Reconsidering Softmax and Linear Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06590","snapshot_observed_at":"2026-08-06T14:59:18.113221Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.113221Z"},"links":{"cited_paper":"/paper/2412.06590","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:47aca85c74cf8e0173edc43bfc304576e75a01bf586449157ce878332898a402","observation_id":"25b65990-dd71-49d6-8079-c1af9ea10c72","resolution":{"observed_at":"2026-08-06T14:59:18.113221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.455214Z","title":null,"venue":null,"work_id":"9de642c2-ad3f-4840-a423-1860902b6fb4","year":2025},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.216602Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:0664910ff0c50be946f5a75e8ca8dcc8aede8432231f39428fefa4c2fc810f9d","observation_id":"8205a9bf-81b8-4f8f-bc92-534e2b17dfd5","resolution":{"observed_at":"2026-08-06T14:59:24.509718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05869","last_updated":"2023-12-01T17:43:06Z","snapshot_observed_at":"2026-07-06T16:29:55.892584Z","submitted_at":"2023-10-09T17:05:25Z","title":"HyperAttention: Long-context Attention in Near-Linear Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05869","snapshot_observed_at":"2026-08-06T14:59:18.324072Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.324072Z"},"links":{"cited_paper":"/paper/2310.05869","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:ef97c049af54fb4df47b71e5b1061bcbc0be7204f264854f0d238448fa1e03e0","observation_id":"5214b05d-ff75-468e-be1d-1233b187f920","resolution":{"observed_at":"2026-08-06T14:59:18.324072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.331547Z","title":null,"venue":null,"work_id":"bb4f68bd-0809-4a10-be94-e8e5ddb6b840","year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.505631Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:2eed9698aad9120f1f5c8620b136e5dd90ba38f007f540706180136c459d7c8c","observation_id":"ccbc15de-4a5b-422c-a9ff-c493ab6288f6","resolution":{"observed_at":"2026-08-06T14:59:24.388665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:18.696047Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.696047Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:1cd59f871769d4d1f4681f2e5867564bbb4968ec35a2a2fdeed03512576236c3","observation_id":"b22d12ad-d125-42f1-8507-8f76a635d994","resolution":{"observed_at":"2026-08-06T14:59:18.696047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04451","last_updated":"2020-02-18T16:01:18Z","snapshot_observed_at":"2026-07-06T08:50:12.690900Z","submitted_at":"2020-01-13T18:38:28Z","title":"Reformer: The Efficient Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04451","snapshot_observed_at":"2026-08-06T14:59:18.845528Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.845528Z"},"links":{"cited_paper":"/paper/2001.04451","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:23445eb56fe576181dd4d5685302b073846e2efded82f06c4abf34ccccf7167e","observation_id":"dda31b12-52f4-4c02-824b-809c8ae71f65","resolution":{"observed_at":"2026-08-06T14:59:18.845528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.200129Z","title":null,"venue":null,"work_id":"2e29abef-b73c-4bb8-a3d2-5d31d8daea64","year":2009},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:18.941134Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:f416a8d468ebd11686967a1774289500e466a4d899c167549abb5b2406da0448","observation_id":"a50bd99a-e0e6-4fc8-a3a7-e113e27f20d1","resolution":{"observed_at":"2026-08-06T14:59:24.253857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:19.021449Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.021449Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:23f9448b00808bb594765f20da7aa9f07a1e9246f12d1248ef137395e51643fc","observation_id":"23c8d610-2da9-4c6f-afc0-ae723a30e647","resolution":{"observed_at":"2026-08-06T14:59:19.021449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02530","last_updated":"2024-10-30T04:55:26Z","snapshot_observed_at":"2026-08-03T19:13:08.919730Z","submitted_at":"2024-10-30T04:55:26Z","title":"A Comprehensive Study on Quantization Techniques for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02530","snapshot_observed_at":"2026-08-06T14:59:19.104376Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.104376Z"},"links":{"cited_paper":"/paper/2411.02530","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:c5d3bfa7617d0b6682312b0ee2f5d4476cbfae1b3a9c6dc807713be28f010b87","observation_id":"d6f709c2-6e21-423a-a986-1a040325a841","resolution":{"observed_at":"2026-08-06T14:59:19.104376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:24.012675Z","title":null,"venue":null,"work_id":"7caf5153-47cd-4b39-8432-f9c6f332e70d","year":2016},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.168451Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:a8300c350180bdcc428ae36d9ee5ab53ceaa87057a5834e9ada0f411d22d9df8","observation_id":"c0166071-2d08-4c7e-8fc4-fe8dfc0e2836","resolution":{"observed_at":"2026-08-06T14:59:24.092820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.832598Z","title":null,"venue":null,"work_id":"6a31b897-9d47-49a3-926e-1ca35f23072b","year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.310754Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:f64c591507aaf633f20e0ed7e110d38e30179120893f5277f383c4f9102c4b24","observation_id":"3a5794f8-8820-4db6-9774-a47ccbd7f82b","resolution":{"observed_at":"2026-08-06T14:59:23.920943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.650007Z","title":null,"venue":null,"work_id":"317c381e-cb9e-457a-b423-207f6f72397a","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.501588Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:ff6150485a7ac3b22a02963d8df43d8e0e41591f57893f221392dae21105b8e8","observation_id":"0e23106d-e2ed-47b8-8a18-9bad230eeb67","resolution":{"observed_at":"2026-08-06T14:59:23.746641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.489869Z","title":null,"venue":null,"work_id":"f7b67d37-5682-4a86-af74-96554af441d1","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.670900Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:ac96950da7ee2caa69fea097c42bfe2db84007817720758a5f475291d5abfe56","observation_id":"5ea1efeb-6db7-4dcb-8c82-6ab2ec3cf01b","resolution":{"observed_at":"2026-08-06T14:59:23.575714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.06139","last_updated":"2017-12-27T20:43:02Z","snapshot_observed_at":"2026-08-02T02:13:21.763849Z","submitted_at":"2017-12-17T16:36:26Z","title":"TensorFlow-Serving: Flexible, High-Performance ML Serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.06139","snapshot_observed_at":"2026-08-06T14:59:19.840455Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.840455Z"},"links":{"cited_paper":"/paper/1712.06139","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:8b2b712bdfcdc5379fb5d4237df0d99819bafa426ce84c07fde14fe9bc792bc7","observation_id":"df312a47-caff-40ad-94a3-6d0dc3dd3f8f","resolution":{"observed_at":"2026-08-06T14:59:19.840455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:19.896901Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:19.896901Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:619fb8b9f361265717363dbc7a7b1924ec41fc58cc0654e5b396cb4d6b62b7b6","observation_id":"e2a9fbf6-546c-4d99-a0c7-2777f3b680aa","resolution":{"observed_at":"2026-08-06T14:59:19.896901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14995","last_updated":"2024-01-19T07:47:01Z","snapshot_observed_at":"2026-08-01T19:55:19.898676Z","submitted_at":"2023-07-27T16:45:33Z","title":"TransNormerLLM: A Faster and Better Large Language Model with Improved TransNormer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14995","snapshot_observed_at":"2026-08-06T14:59:20.061853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.061853Z"},"links":{"cited_paper":"/paper/2307.14995","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:2ce63f99a2c82a3beeb79e6ad52b318d64a396e34c0b9f6b987d713a2f6ad2d8","observation_id":"28c342ae-0647-47e7-a519-eac408e4d8e7","resolution":{"observed_at":"2026-08-06T14:59:20.061853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.310570Z","title":null,"venue":null,"work_id":"4d1f6d06-e94e-4a9c-a244-338d55abc299","year":null},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.189854Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:46cdd8933b148fb6e7d1ee7b263f5227927e31f7923dc7dd96d78cd229998568","observation_id":"560a7101-d369-4b59-b209-ab02802a1225","resolution":{"observed_at":"2026-08-06T14:59:23.406700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:20.348857Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.348857Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:6621b0428e2edd9c9a1ba4f88fa6410f0d6ae214a420cf7b72ec107c831d8368","observation_id":"8525dec2-83a5-4206-b745-57e1d913c59c","resolution":{"observed_at":"2026-08-06T14:59:20.348857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:23.110540Z","title":null,"venue":null,"work_id":"835cb3ae-b886-42f7-aa96-ec337ea0d31b","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.429659Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:f2e4137510ad422cd396d3b8b89c86a7af93d0f43c5fe0f1839839f470e49599","observation_id":"dbb424ee-46cc-4566-9a2e-7a50c362952f","resolution":{"observed_at":"2026-08-06T14:59:23.192806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05964","last_updated":"2024-04-07T13:03:58Z","snapshot_observed_at":"2026-07-06T17:27:37.212340Z","submitted_at":"2024-02-05T12:16:28Z","title":"A Survey on Transformer Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05964","snapshot_observed_at":"2026-08-06T14:59:20.593821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.593821Z"},"links":{"cited_paper":"/paper/2402.05964","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:f18cb3a5235ced3230c1dacb92d6925317607de7fb8155a2fcad123d81a05f19","observation_id":"f9663580-685a-44e5-9093-ea1f5b4e7451","resolution":{"observed_at":"2026-08-06T14:59:20.593821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-06T14:59:20.706090Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.706090Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:d4f9213ec1d4f1566525161439426dab2b7b894b34b65280b309b1e8e22f9452","observation_id":"c509138d-2cdd-4431-910f-d23168e84d80","resolution":{"observed_at":"2026-08-06T14:59:20.706090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.958054Z","title":null,"venue":null,"work_id":"0694b762-8bab-4964-8f35-e32cace01ba1","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.862710Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:20eb609f2e8260ba72561881fd84fbd3a0875a07a0177192025b1131f90092ef","observation_id":"39df773b-f0d2-4945-b96e-a9d059d5c6ea","resolution":{"observed_at":"2026-08-06T14:59:23.054451Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:20.914884Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.914884Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:c94407cf669042170a45544edf88a5263a202b8d5e9a7fbc774aa200f129a34f","observation_id":"4a0b605c-a264-47c1-9dfc-31f9b0173d4b","resolution":{"observed_at":"2026-08-06T14:59:20.914884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:20.972111Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.972111Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:ffd8c814097f7a2fb6c7cb6711352b346eca52f8ae50498831ba71acd90e42f2","observation_id":"ecb22aa5-09e3-4e34-b2b3-737ea5f9f037","resolution":{"observed_at":"2026-08-06T14:59:20.972111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-06T14:59:21.049806Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.049806Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:a0ad0b90f1b15e2d7ce27e140e1901b94490108c9a27f237f71d8087016ef065","observation_id":"83cc35d0-77fb-4e13-b36d-db750f6faa65","resolution":{"observed_at":"2026-08-06T14:59:21.049806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.778400Z","title":null,"venue":null,"work_id":"40b5ae68-2e4e-437e-bc48-41575980391c","year":null},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.156696Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:da36bf3934fad8a897396675ec1732c025cffc98781f2b52820ce5e366d54d0c","observation_id":"35adaee9-69b3-4298-bc5c-0dd14f8d5da5","resolution":{"observed_at":"2026-08-06T14:59:22.858727Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08237","last_updated":"2020-01-02T12:48:08Z","snapshot_observed_at":"2026-07-31T22:49:43.034741Z","submitted_at":"2019-06-19T17:35:48Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.08237","snapshot_observed_at":"2026-08-06T14:59:21.331681Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.331681Z"},"links":{"cited_paper":"/paper/1906.08237","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:991c2d8b546a9f4120c8ba4a1b1ccb65e0a86a48ca3f6979b1a1cafc9062a8d7","observation_id":"20f7b23b-bd89-4346-8287-6bd575492ba7","resolution":{"observed_at":"2026-08-06T14:59:21.331681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08413","last_updated":"2024-06-12T16:57:58Z","snapshot_observed_at":"2026-08-06T19:09:39.550072Z","submitted_at":"2024-06-12T16:57:58Z","title":"Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08413","snapshot_observed_at":"2026-08-06T14:59:21.220570Z","title":"arXiv:2406.08413 [cs.AR] https://arxiv.org/abs/2406.08413 Conference acronym ’XX, June 03–05, 2018, Woodstock, NY Trovato et al","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.220570Z"},"links":{"cited_paper":"/paper/2406.08413","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:042af4dd89f6e620504d2bfbd6d210492aef2345e6e74894787b53fd43b4918e","observation_id":"313ba47d-2924-4ce0-8580-18c49df2de96","resolution":{"observed_at":"2026-08-06T14:59:21.220570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.592081Z","title":null,"venue":null,"work_id":"9220448d-8012-4c87-a950-17f7648134f3","year":2022},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.467894Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:8f03ca2fd1206892f07406767e5f4811044363d78c3d2ee813b3bd8fa03cb4ab","observation_id":"e3175271-c62d-4913-b8aa-8c9d1aff1d47","resolution":{"observed_at":"2026-08-06T14:59:22.672705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07368","last_updated":"2024-07-25T17:18:01Z","snapshot_observed_at":"2026-07-06T18:29:00.001236Z","submitted_at":"2024-06-11T15:34:43Z","title":"When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07368","snapshot_observed_at":"2026-08-06T14:59:21.394850Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.394850Z"},"links":{"cited_paper":"/paper/2406.07368","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:5b211545a632211094487b89e8016f9c21717b3c5ae9baafb613fdfa041230d1","observation_id":"8b144df7-8c9a-4500-ba33-d383d03d7bc4","resolution":{"observed_at":"2026-08-06T14:59:21.394850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:21.631803Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.631803Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:16fd8dee4a8a585714419e14b8ca7bf0b12bb3c05d7831cd782c2c15e18109e0","observation_id":"32a31ad1-a1c8-4d45-be76-6e12284c7cfb","resolution":{"observed_at":"2026-08-06T14:59:21.631803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.417628Z","title":null,"venue":null,"work_id":"10462232-b8b7-40d7-93e4-60e2c4e7ce18","year":2023},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.550685Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:324a58f46573846397238b5e74e57f726be9a997ed32350fa36cc5ddc8cf383b","observation_id":"1a9a3706-375f-4c58-8f05-5aac9adcb364","resolution":{"observed_at":"2026-08-06T14:59:22.487020Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:22.230347Z","title":null,"venue":null,"work_id":"ce40975f-6829-436b-a83e-fe04b786a74c","year":2021},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:21.733748Z"},"links":{"citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:b1b9e9822377922a3708cc3bdd85a6b82d02207a7b622c8f5620d0d166eaa15d","observation_id":"efe63d3a-fc0a-4bcb-8d9a-0af527e8ccc9","resolution":{"observed_at":"2026-08-06T14:59:22.302708Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04658","last_updated":"2024-01-15T14:57:29Z","snapshot_observed_at":"2026-08-03T19:06:46.657140Z","submitted_at":"2024-01-09T16:27:28Z","title":"Lightning Attention-2: A Free Lunch for Handling Unlimited Sequence Lengths in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04658","snapshot_observed_at":"2026-08-06T14:59:20.274728Z","title":"arXiv preprint arXiv:2401.04658 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:20.274728Z"},"links":{"cited_paper":"/paper/2401.04658","citing_paper":"/paper/2507.17245"},"observation_digest":"sha256:b004c47e3a03f89eabee77ff3b6d382ad2d60fd1c7f3232d910d019cde85bf7d","observation_id":"4417498f-24f2-49bf-9455-b66670c7696b","resolution":{"observed_at":"2026-08-06T14:59:20.274728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.17245","last_updated":"2025-07-23T06:29:38Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T19:10:03.852056Z","submitted_at":"2025-07-23T06:29:38Z","title":"DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2507.17245."}