{"as_of":"2026-08-07T05:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b8392b21f3ba79dddc6bcf5e311c1e05395971272b14b2d35377f500ccf5f0d","coverage":[{"denominator":296,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:50:52.423393Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07223/citation-record","integrity":"/paper/2507.07223/integrity","json":"/paper/2507.07223/citation-record.json","paper":"/paper/2507.07223"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.627502Z","title":"Avoiding another AI winter,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.627502Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c64efeaa04211fac43212164a1c2609b9125d1e0213ec20e5bac928297b2eea2","observation_id":"959de874-0ed6-4b10-a622-7ab39d29eb88","resolution":{"observed_at":"2026-08-06T18:50:44.627502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.717214Z","title":"A Brief History of AI: How to Prevent Another Winter,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.717214Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2495c5772ed4b3864303d3ba588325d2cc35df54b73834dcfe11d0c021254bcb","observation_id":"ce54bb8e-08e7-4648-8652-de5c02771f8e","resolution":{"observed_at":"2026-08-06T18:50:44.717214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.810710Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.810710Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:6f4e916cdc5677d07c24f2a51b1d5ea1dbf26df49d53adddb681f89c7944daa4","observation_id":"e8c772b2-e5cd-4620-90ae-7a392cdf2523","resolution":{"observed_at":"2026-08-06T18:50:44.810710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.888240Z","title":"Annotated History of Modern AI and Deep Learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.888240Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5e8461a5d0c58e55fe857d24528059d29c868cfa054ba89669ddba1ee94aa185","observation_id":"207cb565-a9de-4eff-a1aa-95b64c6b5ad5","resolution":{"observed_at":"2026-08-06T18:50:44.888240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:44.990434Z","title":"ImageNet Classification with Deep Convolutional Neural Networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:44.990434Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a9e0dbf145c63071f1635f90e6b1347fffd59a17f3b4d57646e15d497775e55d","observation_id":"5c7a5b91-6ee6-44d7-8990-4428913cba25","resolution":{"observed_at":"2026-08-06T18:50:44.990434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.083350Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.083350Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f6e4af34b9e2aad931b7560158bc116043a9786c39ba12fbcfa8561e91134cb0","observation_id":"efc7b7dd-0b0d-40f5-824c-5c1d099a5531","resolution":{"observed_at":"2026-08-06T18:50:45.083350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T18:50:45.175041Z","title":"The Llama 3 Herd of Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.175041Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:be174fd8226925e7da3ecfac38f1022217c32c9ecaa8d7dc8a4c9f70b9738c49","observation_id":"b6e0c890-a0e1-48ac-a03e-279326fb2505","resolution":{"observed_at":"2026-08-06T18:50:45.175041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.188306Z","title":"Generative Adversarial Nets,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.188306Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:0796fb0031034481a88d3879d8e841ca7c67202183beeffe3f7469829ba85702","observation_id":"13bf8b61-7b83-4743-8764-ec3ce4cbf352","resolution":{"observed_at":"2026-08-06T18:50:45.188306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.249588Z","title":"Learning to learn by gradient descent by gradient descent,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.249588Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:99d69f561d56d44167e4798286c936cac378bf43106a59231c5b335360711bbb","observation_id":"8d03c592-3f66-4338-9dae-a5080df60f22","resolution":{"observed_at":"2026-08-06T18:50:45.249588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.360307Z","title":"Gradient Descent: The Ultimate Optimizer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.360307Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:81d208185044b0b9efac142ff585a3c138ecc0f2aa5b4ce39715eb3622ff2fca","observation_id":"c643b260-79ef-4c73-9b22-1d47c1d1100d","resolution":{"observed_at":"2026-08-06T18:50:45.360307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04747","last_updated":"2017-06-15T13:21:04Z","snapshot_observed_at":"2026-08-04T02:05:40.539691Z","submitted_at":"2016-09-15T17:32:34Z","title":"An overview of gradient descent optimization algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04747","snapshot_observed_at":"2026-08-06T18:50:45.468946Z","title":"An overview of gradient descent optimization algorithms,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.468946Z"},"links":{"cited_paper":"/paper/1609.04747","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5cae7af2444d9ec70548310066ee7140dff4e26a774a1160b2356831e2484566","observation_id":"4b53a767-b11b-4031-8f05-726cf381178f","resolution":{"observed_at":"2026-08-06T18:50:45.468946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.594404Z","title":"Optimization methods for large-scale machine learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.594404Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:033a89cb5b130c49f9e85905bf48ec6f0ec4f9c16e72dcf7704e0baa0626066d","observation_id":"230dcd83-dac4-4422-82a6-054fa3ad0dd1","resolution":{"observed_at":"2026-08-06T18:50:45.594404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:45.774798Z","title":"Practical recommendations for gradient-based training of deep architectures,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:45.774798Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:6d78dbe949276c0c2941e544a8f6866307a660431df4a7754f664b4304bb89ca","observation_id":"36e9eb5a-9b22-4de1-a768-9b076e810478","resolution":{"observed_at":"2026-08-06T18:50:45.774798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.005976Z","title":"On the Number of Linear Regions of Deep Neural Networks,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.005976Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:3b46a35654d2fadae9f7e778911f3c61794cca527578fa3b701007ede2a18ffa","observation_id":"86498f9e-16f8-4fd0-9321-efb53d7b24b0","resolution":{"observed_at":"2026-08-06T18:50:46.005976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.243461Z","title":"Representation learning: A review and new perspectives,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.243461Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a49ddf74680b4a79faff49f63155d348f9cfcd99ff1c8a0b84aef1f5e99697f4","observation_id":"2a6e391b-8884-42e6-a895-4e20279cfca5","resolution":{"observed_at":"2026-08-06T18:50:46.243461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.411121Z","title":"Intrinsic dimension of data representations in deep neural networks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.411121Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f7aeb41d3b4bf75c55969e689370d469f96b3b1680d7bb48188f432a68adf79b","observation_id":"817ff0a6-3d06-4c31-ada0-b89333443442","resolution":{"observed_at":"2026-08-06T18:50:46.411121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.553457Z","title":"High dimensional, tabular deep learning with an auxiliary knowledge graph,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.553457Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:67fe769ed535d0d8125d07c18c68780c31ec0de2b12e5c7970d060c3c65ff07d","observation_id":"8bd1f63e-ac89-4826-b89c-8f43c349539c","resolution":{"observed_at":"2026-08-06T18:50:46.553457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.684131Z","title":"General-purpose, long-context autoregressive modeling with Perceiver AR,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.684131Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ed5b216ff7557e99b350092706c6ae30a8723f798d14fe2fc0381dfa5b822fde","observation_id":"cb93f79f-2a97-42c1-8597-a5156d2935ab","resolution":{"observed_at":"2026-08-06T18:50:46.684131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.788043Z","title":"A survey on hardware accelerators: Taxonomy, trends, challenges, and perspectives,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.788043Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:dab36e069c2b9bc10aa2af9257020424b9c72cf5f1ba64bfe8cd09046298344d","observation_id":"2cf42575-8cc0-4ea4-9900-a535202646f8","resolution":{"observed_at":"2026-08-06T18:50:46.788043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:46.954360Z","title":"The transformational role of GPU computing and deep learning in drug discovery,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:46.954360Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:fd32dd72a5f184bfce77f0b076e6f6a845904bc1a6b254d7effbde00074defec","observation_id":"31a8081c-30cd-4d7f-9c56-80b53a4dc450","resolution":{"observed_at":"2026-08-06T18:50:46.954360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.093029Z","title":"ZeRO: Memory optimizations Toward Training Trillion Parameter Models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.093029Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f2a0e00a1d9ba75cd7d502cf9a7c6bd0609f05ad315b6c70bd282493fbb4aa4f","observation_id":"6f31e56b-8ae3-4121-8ef2-2e28ea43073b","resolution":{"observed_at":"2026-08-06T18:50:47.093029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.300565Z","title":"DeepSpeed: System Optimizations Enable Training Deep Learning Models with Over 100 Billion Parameters,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.300565Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:6103f45d408e9f388f6848fb9ce103f7e07bdd5554ceb8fceaf3595dcd31ead6","observation_id":"6e48f871-6030-4f03-9662-04c96aa0b323","resolution":{"observed_at":"2026-08-06T18:50:47.300565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:47.455266Z","title":"Gpu graph processing on cxl-based microsecond-latency external memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.455266Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:4b7f6604c9d34e9f80e4e4533b9e097501bfa91fa483abbbf39965cdf0d75968","observation_id":"b9639a43-3504-44fe-8d70-49190af0d5a7","resolution":{"observed_at":"2026-08-06T18:50:47.455266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.06890","last_updated":"2021-01-14T23:04:37Z","snapshot_observed_at":"2026-07-06T09:28:19.550239Z","submitted_at":"2020-06-12T00:37:51Z","title":"EMOGI: Efficient Memory-access for Out-of-memory Graph-traversal In GPUs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.06890","snapshot_observed_at":"2026-08-06T18:50:47.659632Z","title":"Emogi: Efficient memory-access for out-of-memory graph-traversal in gpus,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:47.659632Z"},"links":{"cited_paper":"/paper/2006.06890","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a3dec8161a2433fa55882e4f53d0635c6d9356f19641064a5dfcf225fd9b28b7","observation_id":"4532eeee-b5d6-4a51-b978-070f45b6e814","resolution":{"observed_at":"2026-08-06T18:50:47.659632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.041272Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.041272Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:7543d873f26f6fc3e164633c9df6c022aee72bbfaf45dcc50c0869f4c8f4d488","observation_id":"6ff19642-e4de-4110-9ead-c0d8813baeab","resolution":{"observed_at":"2026-08-06T18:50:48.041272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.209373Z","title":"H2O: Heavy-hitter oracle for efficient generative inference of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.209373Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:8a984ec46c0fc61648d3f5e28e3977e0392f78ffb4b604225553ddd258504f94","observation_id":"65a9e8be-924a-4f32-a4cd-654c6ff95f35","resolution":{"observed_at":"2026-08-06T18:50:48.209373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.378999Z","title":"Keyformer: Kv cache reduction through key tokens selection for efficient generative inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.378999Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:7b1feef0116937f1f2aa853a23c2d0907dcce5e72bad929618df6b456fcf4ccd","observation_id":"ec03af62-3cd0-4b87-82fb-c947d50952e7","resolution":{"observed_at":"2026-08-06T18:50:48.378999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2198.36737","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:56.851109Z","title":"TCCL: Co-optimizing Collective Communication and Traffic Routing for GPU-centric Clusters,","venue":null,"work_id":"e7cd5845-7f49-490d-88f5-fb1eb970777b","year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.493360Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:fbe7148d8c6be3eeab7a50aace44206c8f4309451b1013d1e34c262d98ab423a","observation_id":"dd52f4e3-87c9-48cb-bd38-916e95856bfe","resolution":{"observed_at":"2026-08-06T18:50:56.859861Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.717974Z","title":"Sˆ3: Increasing GPU Utilization during Generative Inference for Higher Throughput,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.717974Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:519f2253bf0d467535c4b94445a8f53f461c50a3da7ba48eae5e972313d68131","observation_id":"4df1ebe9-bdec-4b05-9be5-cb2efc8b23d6","resolution":{"observed_at":"2026-08-06T18:50:48.717974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.869405Z","title":"NVIDIA Grace GPU","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.869405Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:da3042cb8e54b02d806fdd87fa2e0d831a25e7acd8439a4dbfbc2da4a7c1edc3","observation_id":"5873df17-6e2b-4c7e-9730-45ba117901b1","resolution":{"observed_at":"2026-08-06T18:50:48.869405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:48.929610Z","title":"Characterization and prediction of deep learning workloads in large-scale GPU datacenters,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:48.929610Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c744b2a4f8f858822d15870b5f6a4c5e78bc8fcbe1fb459cae0d241f0a0ca037","observation_id":"a7302004-5471-4415-bbfc-672d8c95ee24","resolution":{"observed_at":"2026-08-06T18:50:48.929610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3851.37238","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:56.764203Z","title":"Towards Memory Disaggregation via NVLink C2C: Benchmarking CPU-Requested GPU Memory Access,","venue":null,"work_id":"cc3f5d2e-bac5-4b4b-9b53-1101446a22f2","year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.011951Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:0086121852c654c05f3766cbe16c774fa920bc77e5f7deaa347045a7e7971b20","observation_id":"52ad905f-5962-4bdf-8664-8935afb33c2f","resolution":{"observed_at":"2026-08-06T18:50:56.774562Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.068169Z","title":"Poseidon: An Efficient Communication Architecture for Distributed Deep Learning on GPU Clusters,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.068169Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ed6bc4bd7c5b16bad5730c68b840cc089330ab30264f972f694477f68717687e","observation_id":"c3db7e59-9f25-477b-a3bf-d9e8af32f857","resolution":{"observed_at":"2026-08-06T18:50:49.068169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.161709Z","title":"A memory perspective: The effects of finetuning llms with highbandwidth memory,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.161709Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:cde7149a9cc36adcc513cf7360cecb2c9b9652b2d05c07c3023fa60e51e77bf9","observation_id":"f178814c-9fc0-44bd-b2a1-dfed9ba92ff0","resolution":{"observed_at":"2026-08-06T18:50:49.161709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.244384Z","title":"Whitepaper: NVDIA GH200 Grace Hopper Superchip Architecture,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.244384Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ed84ef18f8cc5deb75cfdf0017e5af39dbd86e20e05bbdefff950fea45cd2405","observation_id":"41c58c71-2b96-4316-9dda-f8b511a7f751","resolution":{"observed_at":"2026-08-06T18:50:49.244384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.329840Z","title":"Streambox-hbm: Stream analytics on high bandwidth hybrid memory,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.329840Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f2a6c5d039ba20b06e7d7c23a18db3a7911df69e3f269e2683fb0b1aafeb9875","observation_id":"f158507a-488c-4d1c-9ce8-2a1e5656de15","resolution":{"observed_at":"2026-08-06T18:50:49.329840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.400186Z","title":"Performance evaluation and optimization of HBM- enabled GPU for data-intensive applications,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.400186Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:08bbf9eafeb3458de0dbfb62df4deed70c16d10619f51cc7adc9b43b413d7096","observation_id":"a5aaf8ac-80e0-4118-84af-6ce1e7d42c60","resolution":{"observed_at":"2026-08-06T18:50:49.400186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.473655Z","title":"NVIDIA GB200 NVL72 Delivers Trillion-Parameter LLM Train- ing and Real-Time Inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.473655Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:18621337244563390f7e0a7a4103d5728d8f1e85e4d523d7c6c2330d34144773","observation_id":"d77be27f-0c10-4952-b990-5bcfd6dedef1","resolution":{"observed_at":"2026-08-06T18:50:49.473655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.560002Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.560002Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f26838eb199ad2a463d237809bd3b1f509e39e2f267b2b0a6e1f0166ea1b7415","observation_id":"fcc8e50f-8c18-44fa-974a-e35db944713d","resolution":{"observed_at":"2026-08-06T18:50:49.560002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.633004Z","title":"Retrieval augmented language model pre-training,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.633004Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:21a324aee6ee6db87e3b0eeda81c8f5330c85e455978a9d2ebce542e0b233f64","observation_id":"f91d6942-3f99-4749-8581-fa9414ec7d1a","resolution":{"observed_at":"2026-08-06T18:50:49.633004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.697847Z","title":"Improving language models by retrieving from trillions of tokens,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.697847Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ae91f48a74508f04ded519ce3ebe82d8685654709f09f21c7865a2dff7e6b7eb","observation_id":"6abaf47c-5112-4a2f-9d2d-4bc41a12d153","resolution":{"observed_at":"2026-08-06T18:50:49.697847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-06T18:50:49.785560Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.785560Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:768ffd9e981e14d98f39a5788d9379741e38a8ce523fddc23dd0d4ad2e5bc85b","observation_id":"ad1cc1f3-8f4d-4aa9-b791-18906dfe0490","resolution":{"observed_at":"2026-08-06T18:50:49.785560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08910","last_updated":"2020-10-05T21:26:45Z","snapshot_observed_at":"2026-08-03T03:30:56.636820Z","submitted_at":"2020-02-10T18:55:58Z","title":"How Much Knowledge Can You Pack Into the Parameters of a Language Model?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08910","snapshot_observed_at":"2026-08-06T18:50:49.872748Z","title":"How much knowledge can you pack into the parameters of a language model?","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.872748Z"},"links":{"cited_paper":"/paper/2002.08910","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:760d31b8c79a6d8e9b58f888b326eb7a9f359e8878f921b32781a3870bef45b3","observation_id":"5fd623e4-e2a4-498f-8dd7-f679d22a3529","resolution":{"observed_at":"2026-08-06T18:50:49.872748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:49.938398Z","title":"Pipedream: generalized pipeline parallelism for dnn training,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:49.938398Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:52b573ca79823d5f65b3127e7de11b679e684176fff4c910ffc4adef9d3e3957","observation_id":"cc938e01-2d74-4ec3-84ff-7ed3d3851811","resolution":{"observed_at":"2026-08-06T18:50:49.938398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.005542Z","title":"Number of parameters in gpt-4 (latest data),","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.005542Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:9b623e7b9e0710c4cd1c89ded1e9f906015a5a20bad88b653f53a657854ddf00","observation_id":"72163969-a342-4f63-bccd-49060ae35bb6","resolution":{"observed_at":"2026-08-06T18:50:50.005542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.070127Z","title":"NVIDIA GB200 NVL72","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.070127Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:fdcd1eb71e86bba145821dc99798ba7bcd8bc1adc631f2bca881828684cb40ba","observation_id":"fa00673f-bea8-4376-b300-31c63625aabf","resolution":{"observed_at":"2026-08-06T18:50:50.070127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.156769Z","title":"NVIDIA GB300 NVL72","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.156769Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:7d8b22dca6cf97c637ed2eb3171538239e035842fb20bab9d2d5023eec2fcbf0","observation_id":"b22a1f94-3158-4dcb-a281-edc8b83a7dc3","resolution":{"observed_at":"2026-08-06T18:50:50.156769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.224150Z","title":"NVIDIA DGX GB300","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.224150Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5d0f918a4d74d714c19b2aebba0e3e4098be6bfa203eafa785a2a7f8b5e47212","observation_id":"3818b815-baf6-40d4-a591-367491c0162a","resolution":{"observed_at":"2026-08-06T18:50:50.224150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.324135Z","title":"Understanding communication characteristics of distributed training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.324135Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a9746f26227ad072b3db135c8ba1e0e12a5ee970b5820f3328aab48cf18fea7f","observation_id":"c3f6e128-acb6-4590-929f-faf76ad6794f","resolution":{"observed_at":"2026-08-06T18:50:50.324135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.407491Z","title":"MAD-Max Beyond Single-Node: Enabling Large Machine Learning Model Acceleration on Distributed Systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.407491Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:55e0501b98acfe92fefb488fe14a167a341bd680034d0c6e9db5d8bd3600f4f1","observation_id":"cd589e9a-f548-497f-b789-fbd9755e7b40","resolution":{"observed_at":"2026-08-06T18:50:50.407491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-08-07T05:35:13.505081Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-06T18:50:50.463847Z","title":"Flux: fast software-based communication overlap on gpus through kernel fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.463847Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:45d8c4991cc4fbada658b19d56135687e2ce424ebf287464076aec70bd56bc64","observation_id":"169b84dd-eb35-4d65-8765-b7364f8470bc","resolution":{"observed_at":"2026-08-06T18:50:50.463847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.531679Z","title":"Collective communication library NCCL,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.531679Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:28f77888388e5280e1bcedbae26d1937a9b1bff7efa0cf0be471f3905ebdae48","observation_id":"46abc68b-1e72-4eaa-98c6-089714962a1d","resolution":{"observed_at":"2026-08-06T18:50:50.531679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.586469Z","title":"Lancet: Accelerating mixture-of-experts training via whole graph computation-communication overlapping,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.586469Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:4a5ca74d9061977c75186fa0298c2b98757873b4fc7f5e560b51a0708af52445","observation_id":"aca4cb32-e627-4872-86f0-1456b4214eb4","resolution":{"observed_at":"2026-08-06T18:50:50.586469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5053.37311","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:56.459018Z","title":"Traci: Network acceleration of input-dynamic communication for large-scale deep learning recommendation model,","venue":null,"work_id":"c4c6189c-e351-476c-a384-87368f15291b","year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.686463Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:73df25e83731b5d70aeb2a0a71081479cea4a1e1de6f28cb8d94c629ad76d241","observation_id":"1c4d3d5b-b99a-44a5-b246-645605945842","resolution":{"observed_at":"2026-08-06T18:50:56.469937Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.771412Z","title":"GPU graph processing on cxl-based microsecond-latency external memory,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.771412Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ffb64fd797c16ad8f229e84946f2e32633ebc9304146633ea94f994daefb330d","observation_id":"471bbb5c-5a05-4a5c-9cf5-fda77f7e335a","resolution":{"observed_at":"2026-08-06T18:50:50.771412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.839408Z","title":"Understanding routable{PCIe} performance for composable infrastructures,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.839408Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2cf338724883518322620e35709171c821d0604b0ea4f4c21f1bf0ed70dea51b","observation_id":"384a5e5c-0585-4f59-816a-35cb297168eb","resolution":{"observed_at":"2026-08-06T18:50:50.839408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.922505Z","title":"Understanding PCIe performance for end host networking,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.922505Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:4bd9bad94183d4f9ac21e88bbf377f63fd8004530b1a5bf145aef7a2f473f98b","observation_id":"30621a73-9791-4094-b55c-09cf1298a79e","resolution":{"observed_at":"2026-08-06T18:50:50.922505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:50.962356Z","title":"CXL 1.0 specification,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:50.962356Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:82a0e769877486524faae0eb1610257c191f6754886a495d0560f8c366ff4cda","observation_id":"841d44a9-30e2-43be-8d86-9e77e01648f1","resolution":{"observed_at":"2026-08-06T18:50:50.962356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.007942Z","title":"CXL 2.0 specification,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.007942Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:75f5e0d99fb781cf5a59b17c1a58bc9af527c3e9c9bd6b44cb4f8cd78395ba64","observation_id":"bb516739-9b5e-49d5-b7bd-c50bda4ccffd","resolution":{"observed_at":"2026-08-06T18:50:51.007942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.145890Z","title":"CXL 3.2 specification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.145890Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a81019e53d18d4c4b7e98eae8abe6166a21d530a1665a52307a9eadd42af41e6","observation_id":"b9ed063f-1f98-4bb9-a208-cfc37af202b0","resolution":{"observed_at":"2026-08-06T18:50:51.145890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.321615Z","title":"Overcoming the memory wall with CXL-Enabled SSDs,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.321615Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:87c55ec2095df05f88a54498172d4a97746e79dc1822a3e407c5d53dbd4b7373","observation_id":"a26f8c62-0d99-410a-b902-9805103c873e","resolution":{"observed_at":"2026-08-06T18:50:51.321615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.497367Z","title":"An introduction to the compute express link (cxl) interconnect,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.497367Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:90e55594ee5b7ff8a3483d7eef6d9b919f81f6d6c20dae81076e93420c93cb15","observation_id":"24c01a0a-fe55-4b2d-83d5-28555188efb3","resolution":{"observed_at":"2026-08-06T18:50:51.497367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.592359Z","title":"Hello bytes, bye blocks: Pcie storage meets compute express link for memory expansion (cxl- ssd),","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.592359Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:22e1cd626761fc13022a338a3644e6a3e6d39aa030b2f20b7efb2aede0a58245","observation_id":"f547036c-fa1a-48f2-9ade-afaed31ea7c9","resolution":{"observed_at":"2026-08-06T18:50:51.592359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.698491Z","title":"Pond: CXL-Based Memory Pooling Systems for Cloud Platforms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.698491Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d3b556b2256d30a02276ec02736f4ddd0bb0a54aed6b02ae1b04d43ab7614636","observation_id":"82da996e-dfcc-425a-924f-599f1447b1f9","resolution":{"observed_at":"2026-08-06T18:50:51.698491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.855162Z","title":"Breaking the Memory Wall with Compute Express Link (CXL),","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.855162Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:efc32ea1b2025893cede851a3eb312db8040a03bcade3d3808525a1ea7657ef9","observation_id":"ff480925-c66a-48f1-90df-47112c03486f","resolution":{"observed_at":"2026-08-06T18:50:51.855162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:51.978517Z","title":"Direct access,{High-Performance} memory disaggregation with {DirectCXL},","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:51.978517Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:dd961413e3ba7bf3ff2025d8642081be785ae85de09ba425371cf71af2fc6346","observation_id":"f68a0c7c-ec19-412b-be8f-7ec0cdc963ca","resolution":{"observed_at":"2026-08-06T18:50:51.978517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.098820Z","title":"Retrieval-Augmented Generation for Knowledge- Intensive NLP Tasks,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.098820Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:02187c70e318acf88278a4dc1629a5a0e0a2d11fc7727fbb318610c1f70be282","observation_id":"c7687572-0c16-4271-9ff6-d708d5201e6b","resolution":{"observed_at":"2026-08-06T18:50:52.098820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.250936Z","title":"Active retrieval augmented generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.250936Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d1780226c1bd3499f81d6632cf17623e085cb64137686a9b1adf0e463de3ecc0","observation_id":"a0e41e77-acd9-42ee-9fb5-3b0c00fbbe77","resolution":{"observed_at":"2026-08-06T18:50:52.250936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.273606Z","title":"Benchmarking large language models in retrieval-augmented generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.273606Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:7f236698642935efb358f84c3a93387dde656afc115112209a516fb1296b286d","observation_id":"bc36a144-68c5-4bea-a581-9335f12d6625","resolution":{"observed_at":"2026-08-06T18:50:52.273606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16130","snapshot_observed_at":"2026-08-06T18:50:52.278520Z","title":"From local to global: A graph rag approach to query-focused summarization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.278520Z"},"links":{"cited_paper":"/paper/2404.16130","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a454c9437fe9ff8177292d0372998503028cd5c9461151c25efaef7f686b07a7","observation_id":"d9633924-eb71-482b-afd5-f45472ed02e3","resolution":{"observed_at":"2026-08-06T18:50:52.278520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.282773Z","title":"KV Cache is 1 Bit Per Channel: Efficient Large Language Model Inference with Coupled Quantization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.282773Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:d7ab40084ce4a0975f0a190063f0632cbc9cdd3380626f6b89398746440195a6","observation_id":"06914274-d58b-457b-8d19-abd0f881ab54","resolution":{"observed_at":"2026-08-06T18:50:52.282773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.286774Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.286774Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:6aad1f39a94eb2ac7d44c22c10ca97a9fb44c05e3506deda36db987279146575","observation_id":"2b512ef9-215c-46e6-8276-0a7e88ee8044","resolution":{"observed_at":"2026-08-06T18:50:52.286774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.295326Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.295326Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:3d8f9262bec2a1129399b957071fd8df800ab6e2bf1f231e9019267eb4e08e85","observation_id":"cd5008a8-7a74-49ce-b623-cf7ef4fcb953","resolution":{"observed_at":"2026-08-06T18:50:52.295326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.299507Z","title":"UALink 200G 1.0 Specification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.299507Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5b00349802ec6b1783246cf1b5cdbeb77fd7c4de688ed5fc2e07723f741c740b","observation_id":"4e619249-3789-4d1a-b210-d866683c063d","resolution":{"observed_at":"2026-08-06T18:50:52.299507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.304004Z","title":"[Online]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.304004Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:e7a97a2a34603955022f60d58a51f79e79269d59b676a69920c860e741d0a1c1","observation_id":"0648a33f-7136-4ac6-b069-f1d56f84b3dc","resolution":{"observed_at":"2026-08-06T18:50:52.304004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.307870Z","title":"How Ultra Ethernet and UALink Enable High-Performance, Scalable AI Net- works,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.307870Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:844a9493815b507e1d7e8087dacd9e7a32a30d2f539671bfe6abe6db846246ea","observation_id":"eb1fa165-8f59-43ed-8ad9-299a250c5d4a","resolution":{"observed_at":"2026-08-06T18:50:52.307870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.312269Z","title":"What is NVLink?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.312269Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:2e223f3106743e03d525905451d93132a1bc72efce60855f7a5e34742114a05a","observation_id":"56a82bf3-06c3-4ccb-b828-cd3aef461c0b","resolution":{"observed_at":"2026-08-06T18:50:52.312269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.316486Z","title":"NVLink NVIDIA","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.316486Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f153c78534b02721d8d808dce59b2039c39049a5d88310d7023e6aeb686dae4a","observation_id":"7cf12210-d465-4efd-bb1e-0ff26e842dde","resolution":{"observed_at":"2026-08-06T18:50:52.316486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.320597Z","title":"WNVIDIA NVLink and NVLink Switch,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.320597Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:5b5376f07a0e64e79828397f22f0d979d8aaca436024b5cdff845605034ebabd","observation_id":"46b9b429-6b4d-4d19-ad94-3b5522fb34dd","resolution":{"observed_at":"2026-08-06T18:50:52.320597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.325885Z","title":"NVIDIA Fusion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.325885Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:fc164f139a488ee778cf3730f8222b7f7a4e952ce8cac8b706987b575f2f40f5","observation_id":"934bb20d-f772-4c9b-92df-c6c03597161e","resolution":{"observed_at":"2026-08-06T18:50:52.325885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.330598Z","title":"NVIDIA Unveils NVLink Fusion for Industry to Build Semi-Custom AI Infrastructure With NVIDIA Partner Ecosystem,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.330598Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:282d83bb6f9f64a08513dd9169908155621faa7ed5e94a95bd0078f712b66623","observation_id":"abe2fbb5-ab79-4646-84d3-f4a186d36bf0","resolution":{"observed_at":"2026-08-06T18:50:52.330598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.335714Z","title":"Design guidelines for high performance RDMA systems,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.335714Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a65654fdc471142412e06611e0e870ab03a8407acbc7592d42512e1642a77c62","observation_id":"2c3d6217-7bca-42b3-b630-3322f6115450","resolution":{"observed_at":"2026-08-06T18:50:52.335714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.340336Z","title":"An optimized rdma qp communication mechanism for hyperscale ai infrastructure,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.340336Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a58aeeeb1e84b5d71c62cf96202006188be90bc740cfaa0cdb59f1177e5cfd7c","observation_id":"00107cb5-d202-45bc-9945-85443b3620ad","resolution":{"observed_at":"2026-08-06T18:50:52.340336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.344945Z","title":"Rdma over commodity ethernet at scale,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.344945Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:969c78233cc8692fff3fcf10214c60e8c2994b22e4cd6a472eba12944932da2f","observation_id":"8930f5e3-5903-4a69-9dae-15bcfe274ece","resolution":{"observed_at":"2026-08-06T18:50:52.344945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.349414Z","title":"Rdma over ethernet for distributed training at meta scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.349414Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:1c30186c206263a5b48b10078392c9dd9997448925c25b6ca66f86c0947d17ba","observation_id":"73cf4e6c-14cb-4bf8-b9f0-d9ba13039319","resolution":{"observed_at":"2026-08-06T18:50:52.349414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.354129Z","title":"Graph 500 benchmarks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.354129Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:8cec1766cd1648d64b3afb6dcc38accbe7e25630e736b0459bbb5d0386385053","observation_id":"c6752674-f8d7-42d1-8955-2a70fdc79b8a","resolution":{"observed_at":"2026-08-06T18:50:52.354129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.358617Z","title":"NASA Parallel Benchmarks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.358617Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:1c5c276e8fec0a18bcbafff6a8e98618d2941dd8c1415dcbfc70ff107ad9447d","observation_id":"0cbfd1c4-2aa3-4710-97ab-01553aa7803d","resolution":{"observed_at":"2026-08-06T18:50:52.358617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.362917Z","title":"Lattice Boltzmann Method Benchmarks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.362917Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:32684763e34f5dcec9e3c5d8032d7bba17a4843063bb832e8405a1c9644f017a","observation_id":"b079bcc4-4f69-4538-88a1-67e2a3d2a180","resolution":{"observed_at":"2026-08-06T18:50:52.362917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.368008Z","title":"Tealeaf: A mini-application to enable design-space explorations for iter- ative sparse linear solvers,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.368008Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:4ec61ef989654e6d3072fb2a870075ab7b0cc8aa6da2969ba02f74b7227927ac","observation_id":"9eadc4c9-ba07-4553-a645-e7379d2df155","resolution":{"observed_at":"2026-08-06T18:50:52.368008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.373255Z","title":"Advances in Numerical Modeling for Heat Transfer and Thermal Management: A Review of Computational Approaches and Environmental Impacts,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.373255Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:26a626a82288d2a17fdb0a4a06ed60bdf21b37bc94ad07b822a3a0ba940a8b84","observation_id":"a3c2b24c-ff96-4394-96e0-379e07187362","resolution":{"observed_at":"2026-08-06T18:50:52.373255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.377684Z","title":"Sequence to sequence learning with neural networks,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.377684Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:dab8cc0b2bacc1a2b38e46b1a21fee09068e5a0e21966b6990427fc353a6367f","observation_id":"28ac1eaa-66f3-4df4-ac04-895eedf55958","resolution":{"observed_at":"2026-08-06T18:50:52.377684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.382589Z","title":"State-of-the-Art Speech Recognition with Sequence-to-Sequence Models,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.382589Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:f8d079d7944b18e3c5157d0898989a376f3c6fcf3f8c2c4c0cbffa8e2ef02404","observation_id":"5a373215-d156-48c6-b4a4-efc312586920","resolution":{"observed_at":"2026-08-06T18:50:52.382589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06114","last_updated":"2016-03-01T10:55:58Z","snapshot_observed_at":"2026-08-01T19:23:26.365417Z","submitted_at":"2015-11-19T10:24:14Z","title":"Multi-task Sequence to Sequence Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06114","snapshot_observed_at":"2026-08-06T18:50:52.387160Z","title":"Multi-task Sequence to Sequence Learning,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.387160Z"},"links":{"cited_paper":"/paper/1511.06114","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ab7710792faf8fc575e3c78a560101c4f7323da22c80a32a9392f6dc353b95b3","observation_id":"96a0f40e-6fc5-4f28-9edc-39dac6ccafc8","resolution":{"observed_at":"2026-08-06T18:50:52.387160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.391709Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.391709Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:a2405c6be1d9bdf10f695cbdfb4b9eb130da07318379ea7a65af0c67cddd9e46","observation_id":"52159462-23da-4ded-b9ea-d1eb5d68801b","resolution":{"observed_at":"2026-08-06T18:50:52.391709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.396528Z","title":"New models and developer products announced at devday,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.396528Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c9acaa5680b56b46879fb7ef5ada6c3e30f84bf9875dbdd31b6853c775279c87","observation_id":"3ad91b25-060f-4df5-b3be-a912d60c31ca","resolution":{"observed_at":"2026-08-06T18:50:52.396528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.401383Z","title":"Models. Llama3.1, 3.2, 3.3, Llama4","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.401383Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:de3337c0e0c12a08e7beb69ae83a14b03a408514e1d27a432426716cf7c839cc","observation_id":"90d55f46-fc11-435e-b221-471e0fc7b53e","resolution":{"observed_at":"2026-08-06T18:50:52.401383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.406098Z","title":"GPT-4 Turbo,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.406098Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:cf545165aa7111cb41a97ed609c24286581a04aea05de8849fa23fba076c2437","observation_id":"b0939831-f130-44e4-8f90-42609091dea7","resolution":{"observed_at":"2026-08-06T18:50:52.406098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.410359Z","title":"Gemini 2.5: Our most intelligent AI model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.410359Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:fcfd97dfce20bb7903fc6b146e7da9f8f46ea84ad6b71719d782006d8a1c8833","observation_id":"034394ad-decb-4ee1-b18a-097dd6a12cf2","resolution":{"observed_at":"2026-08-06T18:50:52.410359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:50:52.414527Z","title":"Report: Google DeepMind Gemini,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.414527Z"},"links":{"citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:c52e3d9f392c9b7d23a7643e068edd8c402f002ef96d087c3cbc6982302d74fd","observation_id":"a1b23261-f358-4822-8701-3df548b49dcf","resolution":{"observed_at":"2026-08-06T18:50:52.414527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-07-06T03:45:28.546418Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-06T18:50:52.423393Z","title":"Learning phrase representations using rnn encoder-decoder for statistical machine translation,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:52.423393Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2507.07223"},"observation_digest":"sha256:ed9a3feee37ba1f4508b94e369cd06f1dcd22542f746a9a3cd754babbd022bfa","observation_id":"e3ebedf8-4822-4a8d-965b-a541e76b50f9","resolution":{"observed_at":"2026-08-06T18:50:52.423393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07223","last_updated":"2025-07-13T15:21:59Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-06T18:43:46.576511Z","submitted_at":"2025-07-09T18:57:04Z","title":"Compute Can't Handle the Truth: Why Communication Tax Prioritizes Memory and Interconnects in Modern AI Infrastructure"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":97,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":296},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 296 outbound references and 0 inbound Pith citation observations for arXiv:2507.07223."}