{"as_of":"2026-08-09T08:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7314146302ab966b34c4e502b7a6dbc08ba774e3e4fe1dacbbe44b7984b1652d","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:29:29.161352Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.18824/citation-record","integrity":"/paper/2505.18824/integrity","json":"/paper/2505.18824/citation-record.json","paper":"/paper/2505.18824"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:34.180347Z","title":"On the computational complexity of self-attention,","venue":null,"work_id":"e4403f39-0781-4fee-83f6-c2d561f4fffd","year":2023},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:26.197619Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:aafd666bf4068c480e568112de4a3acfbea83e965226898653b6149240344437","observation_id":"6baf57a8-36f6-4226-92a5-69aa9eaf98e4","resolution":{"observed_at":"2026-08-07T14:29:34.233199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-01T22:52:35.092898Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-08-07T14:29:26.256211Z","title":"LLM inference unveiled: Survey and roofline model insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:26.256211Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:89dadade441c160282b60c60bad5e8392183f3576429f59c078805f696231fba","observation_id":"2da04287-b6d6-4094-9ce7-7ba8329aa926","resolution":{"observed_at":"2026-08-07T14:29:26.256211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:34.053642Z","title":"Data movement is all you need: A case study on optimizing transformers,","venue":null,"work_id":"a04cd0db-a66f-4544-896c-0c9bc8273d87","year":2021},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:26.366113Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:985065b71dca147d507f14272f244c2df5f303ac00bcfc19c49ea10ddded490b","observation_id":"b0cfb9b3-f0e9-4eff-95a5-e7f8e75b694e","resolution":{"observed_at":"2026-08-07T14:29:34.117193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:33.921850Z","title":"FlashAttention: Fast and memory-efficient exact attention with IO-awareness,","venue":null,"work_id":"639fbba4-216c-47b7-b1be-5ed83cf50546","year":2022},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:26.504090Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:c24c9cb9559d0255962d39216f616af6bfa4081e15e2c366c4fe1710bfd40cc7","observation_id":"b9234b8b-47e6-4fe6-9478-77b618a41694","resolution":{"observed_at":"2026-08-07T14:29:33.965439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:26.631529Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:26.631529Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:413a323aa618ed948fcd198ba2c6a1a55155d4d2c87a23a865a2de1c8309a9a9","observation_id":"4b1303b3-74ce-4003-a6e8-97045b74dd87","resolution":{"observed_at":"2026-08-07T14:29:26.631529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-07-06T18:44:53.587276Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-07T14:29:26.731577Z","title":"Flashattention-3: Fast and accurate attention with asynchrony and low-precision,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:26.731577Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:39f2ada3af1b8d5261f944a031ecc4a1da2f5146e8848b41959d31394734e02c","observation_id":"ff115aa5-8c1a-4601-a0ef-4a94f2508275","resolution":{"observed_at":"2026-08-07T14:29:26.731577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:33.752730Z","title":"SambaNova SN40L: Scaling the AI memory wall with dataflow and composition of experts,","venue":null,"work_id":"cd3721d2-c189-4b20-8e79-02ae1121254b","year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:26.876797Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:0002e6e8a94e44cda61fcf9d8b94196cb04e1a81019b4e1bfceb5e913e4063bd","observation_id":"ead9f0f6-6a3c-4d01-8439-511de6f2d9fe","resolution":{"observed_at":"2026-08-07T14:29:33.841153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:33.543576Z","title":"Wafer-scale AI: GPU impossible performance,","venue":null,"work_id":"519165ad-6831-4887-a048-57e7f0334fd1","year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.012739Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:35041384cf21354333b63dfb0af6148e2ec274c3edf589b892998992544c6a61","observation_id":"555d3de4-b705-4e0b-9c89-cd24aeb2e39d","resolution":{"observed_at":"2026-08-07T14:29:33.637534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:33.374898Z","title":"Blackhole & TT-Metalium: The standalone AI computer and its programming model,","venue":null,"work_id":"ebbe467d-3e7d-4c23-b69c-9256b125d2a8","year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.140730Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:e952fdde15e6e035e409f1f8fcaa20d75eea55194689713384e1ad6faa53a073","observation_id":"3ea76046-4229-47bc-9ca7-5f44509bda34","resolution":{"observed_at":"2026-08-07T14:29:33.468948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:33.241868Z","title":"16.2 rngd: A 5nm tensor-contraction processor for power-efficient inference on large language models,","venue":null,"work_id":"b1ae4593-cb3d-40b5-9b0e-9039251758a4","year":2025},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.260624Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:9b3f623eee7fc2f8bc5fbdd008feaa27db33c6747b7f5900556762b648b61494","observation_id":"f5bedae7-44b5-429c-85de-efbe08a69ee3","resolution":{"observed_at":"2026-08-07T14:29:33.303301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13885","last_updated":"2024-07-18T20:19:36Z","snapshot_observed_at":"2026-07-06T18:48:46.032977Z","submitted_at":"2024-07-18T20:19:36Z","title":"Attention in SRAM on Tenstorrent Grayskull","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13885","snapshot_observed_at":"2026-08-07T14:29:27.394330Z","title":"Attention in SRAM on tenstorrent grayskull,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.394330Z"},"links":{"cited_paper":"/paper/2407.13885","citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:0f24af49ea4ba5f03381747ef8c78b0eb221bdb3ed7fa240ef32908854df0d9e","observation_id":"47282922-b877-4fad-93a0-853e5b5f66bb","resolution":{"observed_at":"2026-08-07T14:29:27.394330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:33.102986Z","title":"FLAT: An optimized dataflow for mitigating attention bottlenecks,","venue":null,"work_id":"37473f03-7623-4b02-aad2-81020a9015e6","year":2023},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.554302Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:32963fd261242d10576e5ed4646d885482224aa090dd09bf00ced1d11b0fa354","observation_id":"a08011de-6c7d-4a4d-834e-bc71041f9341","resolution":{"observed_at":"2026-08-07T14:29:33.164993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:32.953233Z","title":"Fusemax: Leveraging extended einsums to optimize attention accelerator design,","venue":null,"work_id":"3c1e96c2-80a7-4292-90b4-dd598426cda2","year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.667462Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:1c8f82b94e4ae054525530e08ef2397aac371d9f65f45abdf612b7a54e1d5aea","observation_id":"2bff695c-0266-4cd1-ad94-120f6114f8ee","resolution":{"observed_at":"2026-08-07T14:29:33.034879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:32.758732Z","title":"Gemini: Mapping and architecture co-exploration for large- scale DNN chiplet accelerators,","venue":null,"work_id":"55ba0986-77a8-44d4-9573-e4b895dd0c90","year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.784853Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:eb228258775d5ce14cccf87267b1536fc0248769e6e79a4ae0986c3a44911e3e","observation_id":"bb749651-27e1-4ec3-ba8e-74bbc933b1ae","resolution":{"observed_at":"2026-08-07T14:29:32.881056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:32.516450Z","title":"DOJO: The microarchitecture of Tesla’s exa-scale computer,","venue":null,"work_id":"78dfa906-9513-4870-8c7c-71a135ef9c26","year":2022},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:27.883144Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:4f27fc65c40675bf9335385beeaf83108dafc9e36f848a2a9a0ba341a0e67f54","observation_id":"b3bf5695-480a-476c-99a9-b3a58ff851e5","resolution":{"observed_at":"2026-08-07T14:29:32.650726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:32.253263Z","title":"Collective communication,","venue":null,"work_id":"51cbc907-c821-41d2-ad4d-7bd78659f985","year":2011},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.022282Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:a22a6737fc98e7b3820b735baa7e71157e18956d7bf4ac2382c6d9fe0e99f301","observation_id":"05faa99a-a993-4ae1-af69-9b1534aa2b64","resolution":{"observed_at":"2026-08-07T14:29:32.384160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:31.928778Z","title":"Towards the ideal on-chip fabric for 1-to-many and many-to-1 communication,","venue":null,"work_id":"eb1214b0-9434-488b-94e4-5590098f3fac","year":2011},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.127464Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:f32b844f5e370b62a1d3743bcad421fafaefb44a2448c9679df2612f81be7aeb","observation_id":"0a933052-8573-4252-86f6-55e8dd9aedf4","resolution":{"observed_at":"2026-08-07T14:29:32.102965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:31.575370Z","title":"GVSoC: a highly configurable, fast and accurate full- platform simulator for RISC-V based IoT processors,","venue":null,"work_id":"3dbb5e93-b20a-407b-9076-6c44e11daae7","year":2021},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.250138Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:15b84f7cb151afddd08a83cc6f9d58b8c9d2c86764d43a42bc6d469a9e0277fc","observation_id":"decf9542-b5a8-411a-8e29-25f720ce5dcc","resolution":{"observed_at":"2026-08-07T14:29:31.742199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:31.318764Z","title":"Snitch: A tiny pseudo dual-issue processor for area and energy efficient execution of floating-point intensive workloads,","venue":null,"work_id":"bff254a3-85aa-43d7-b18e-ed8500e2be3d","year":2020},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.357031Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:fd01cc08f79f8d3f58a9f20564f41a18b799039e6e296df576b4d186a82853c1","observation_id":"8d73a607-c1f1-4753-be67-0d6e73a8d4f1","resolution":{"observed_at":"2026-08-07T14:29:31.429126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:31.054182Z","title":"Spatz: Clustering compact RISC-V-based vector units to maximize computing efficiency,","venue":null,"work_id":"eba66d5d-ae97-4533-a1c9-9bd7516044c3","year":2025},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.485665Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:9f3daaa2d730bb70714a4cdc1f193e39c87c6e7195e253c1389d3b773701ef6c","observation_id":"7c482cb8-b5c9-422f-a249-418a79543af7","resolution":{"observed_at":"2026-08-07T14:29:31.190544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:30.719302Z","title":"A high-performance, energy-efficient modular DMA engine architecture,","venue":null,"work_id":"86a62d80-0832-4607-9dcd-4f2a36f57415","year":2023},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.604764Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:e4a9d762d822a1a8a9961769af8e645fc37323713ce2221edaa3110eddf27a9f","observation_id":"c91be4fd-2578-4fca-9f12-9b05c8bff576","resolution":{"observed_at":"2026-08-07T14:29:30.874902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:30.397996Z","title":"RedMule: A mixed-precision matrix–matrix oper- ation engine for flexible and energy-efficient on-chip linear algebra and TinyML training acceleration,","venue":null,"work_id":"b4c87bc1-3e91-40fc-9791-e51c59f66abf","year":2023},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.720003Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:a4fbd92d7d6faa2c3f5ca6efb43cb83ccf91db739f320b21c3f172e778c449b0","observation_id":"1c013230-326d-4b0a-b056-7555a1d7a0ba","resolution":{"observed_at":"2026-08-07T14:29:30.533129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:30.104393Z","title":"FlooNoC: A 645-Gb/s/link 0.15-pJ/B/hop open-source NoC with wide physical links and end-to-end AXI4 parallel multistream support,","venue":null,"work_id":"2c1f2453-a5c3-4ff5-82a9-c6e2e092cf0c","year":2025},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.830392Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:9ccb63fbabeed751764f0d38642724f2032b8c47a2f491fb0ce2973f6fabc541","observation_id":"c09561ed-bd44-40a2-9f50-dbc1fa446dcd","resolution":{"observed_at":"2026-08-07T14:29:30.278817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:29.779976Z","title":"DRAMSys: a flexible DRAM subsystem design space exploration framework,","venue":null,"work_id":"15cced32-0dc1-41fd-91b5-4795fde6bb7d","year":2015},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:28.952136Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:93a4804e190241866fb482c5b1670002df4d98b946e9ebe5f1f235b9c390744a","observation_id":"f01a241a-6578-4f5a-a103-07e2a786ee47","resolution":{"observed_at":"2026-08-07T14:29:29.966934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:29.547550Z","title":"SUMMA: Scalable universal matrix multiplication algorithm,","venue":null,"work_id":"24c285cf-13ec-4cd6-bbc4-c74390fed3fe","year":1997},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:29.047456Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:47b7e8db5ef704a33c92309d540f487152b8472b570687897076b39c021264fe","observation_id":"d0180082-2dda-450a-a015-df5fd2fa1707","resolution":{"observed_at":"2026-08-07T14:29:29.651742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:29.330532Z","title":"MI300X vs H100 vs H200 Benchmark Part 1: Training,","venue":null,"work_id":"b31707fe-8e6f-46a8-a118-90de7e847383","year":2024},"citing_paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:29.161352Z"},"links":{"citing_paper":"/paper/2505.18824"},"observation_digest":"sha256:e632377951623542d97f7e7b719e7faa52f8bd22ba8a719cf14e533ec441aa57","observation_id":"6d21fc12-e934-4bfc-924e-d552d33a1e7e","resolution":{"observed_at":"2026-08-07T14:29:29.425767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18824","last_updated":"2025-05-24T18:50:04Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-07T14:22:42.767306Z","submitted_at":"2025-05-24T18:50:04Z","title":"FlatAttention: Dataflow and Fabric Collectives Co-Optimization for Efficient Multi-Head Attention on Tile-Based Many-PE Accelerators"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2505.18824."}