{"as_of":"2026-08-09T16:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13200a27e3965fd1c9125474776ddffb1728f906ce7747fe3f8a93a622671995","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:19:43.247215Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.07578/citation-record","integrity":"/paper/2502.07578/integrity","json":"/paper/2502.07578/citation-record.json","paper":"/paper/2502.07578"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.861786Z","title":"URL: https://azure.microsoft.com/en-us/ pricing/calculator/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.861786Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:c5bd7a8f73c8cfbdaa5894dc91ca9858e0268194add59074eaeb9dba997536f9","observation_id":"07bac523-f739-4068-87a5-c1bcda05eaac","resolution":{"observed_at":"2026-08-08T12:19:42.861786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.866044Z","title":"Enabling cxl memory expansion for in-memory database management systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.866044Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:19306bc8e53d47fae54c711d0c3096a29a22d01acd0dbeac2299121dda0ea169","observation_id":"f50db636-43f6-481c-b096-45b2a2d8b8c8","resolution":{"observed_at":"2026-08-08T12:19:42.866044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-08T12:19:42.869539Z","title":"Gqa: Training generalized multi- query transformer models from multi-head checkpoints, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.869539Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:8b88a3f792ff73dc1fe5bdd7400c1a08a41b992d772ebcdd1eab3215b3f37cc5","observation_id":"5089bf48-f3a9-4e3d-91cb-1453f5c22089","resolution":{"observed_at":"2026-08-08T12:19:42.869539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.873549Z","title":"Introducing the next generation of claude","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.873549Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ef8e58a846dc0eae91e5b299ed9ed642aea957fe9289161f3fcaebf38984fe66","observation_id":"a3d5d758-2180-4b31-b598-d9b0e46d418d","resolution":{"observed_at":"2026-08-08T12:19:42.873549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.877646Z","title":"Exploiting CXL-based memory for distributed deep learn- ing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.877646Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:09d82777bfa2454e2271e556382b90347d28b1f593fb3577994c190a976e474b","observation_id":"ea5c3df5-c2e5-413d-ab17-fb19b56d3d23","resolution":{"observed_at":"2026-08-08T12:19:42.877646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.881241Z","title":"Llama 2 70b: An mlperf inference benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.881241Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a42a9db1465c0c4cebf94226ad1d3a5647b64d365f09a4fb95a5983d58850500","observation_id":"5a0cd7bb-5661-46a5-b1b2-fb361d8d7820","resolution":{"observed_at":"2026-08-08T12:19:42.881241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.884793Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.884793Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:17d32d515477fc2a2d5280e2d1304bf2f633cb0984625e2674d530c1f8788a46","observation_id":"a3965f40-faf1-48a8-8170-6704fd7edf22","resolution":{"observed_at":"2026-08-08T12:19:42.884793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.888201Z","title":"144-lane, 72-port, pci express gen 5.0 pex89144 express- fabric platform","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.888201Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a5b180d5b1191197a2a9f81e36ba93f5c1b2ca9ec425c3acbb9dbd31c06d314c","observation_id":"24294e30-8d96-4e91-bc5c-60cdcf8f0080","resolution":{"observed_at":"2026-08-08T12:19:42.888201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.891765Z","title":"The berkeley out-of-order machine (boom): An open-source industry- competitive, synthesizable, parameterized risc-v processor","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.891765Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e85e8e01e8aec4aebe51fd2132c8264cc0825140cbadd0d8ed4cfcf89dba36a9","observation_id":"7d94f444-8173-4e1f-9ad4-c70dc261920b","resolution":{"observed_at":"2026-08-08T12:19:42.891765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.896429Z","title":"Patterson, and Krste Asanović","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.896429Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b96e4e58ae9ee49ef7c243b22f5735065a613a48fc9f8f13d63c7f2c5f7de284","observation_id":"5bbabc2f-30e6-4979-aaf5-7321ed902eef","resolution":{"observed_at":"2026-08-08T12:19:42.896429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.899955Z","title":"Eyeriss: An energy-efficient reconfigurable accelerator for deep convolutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.899955Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:d625983a90ec271a0c97ba0f733d91911979ac9539f9d8cb4fa4c0d759ec14f9","observation_id":"bbaeb890-7147-48e2-9b19-32d4dddaccfe","resolution":{"observed_at":"2026-08-08T12:19:42.899955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12307","last_updated":"2024-03-08T15:26:38Z","snapshot_observed_at":"2026-07-06T16:21:57.649550Z","submitted_at":"2023-09-21T17:59:11Z","title":"LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12307","snapshot_observed_at":"2026-08-08T12:19:42.903454Z","title":"Longlora: Efficient fine-tuning of long-context large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.903454Z"},"links":{"cited_paper":"/paper/2309.12307","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:c1f3eef1aae14155895c983e8642498270c0fa966c8828922e46b66e10916b1b","observation_id":"5a3e52fd-7d4b-4141-b10d-809ffeee38ff","resolution":{"observed_at":"2026-08-08T12:19:42.903454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.907410Z","title":"The true processing in memory accelerator","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.907410Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ed2435682633b3b4350e421aeea90fa9d860d3e38d217dc4e71ccacf0597c6dc","observation_id":"2469b9de-ad81-44cc-9436-8113f685dad5","resolution":{"observed_at":"2026-08-08T12:19:42.907410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.910828Z","title":"To pim or not for emerging general purpose processing in ddr memory systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.910828Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:24389e7103405a27a311df7997eacaab7ac712d30d964cf7431d871ed776f420","observation_id":"004a9ef1-3dcb-4734-b9bd-d136be30c219","resolution":{"observed_at":"2026-08-08T12:19:42.910828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T12:19:42.917902Z","title":"BERT: pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.917902Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:62b89367d4ffce22c8a058d05a20f2e0a97cc974ef6fd7ba5b5cf913045ab691","observation_id":"338a6725-26d1-48f7-b93b-c2cf52df2949","resolution":{"observed_at":"2026-08-08T12:19:42.917902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.921715Z","title":"Dram spot price","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.921715Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:bbff5bc5c6768fbcb6135b5be6320d68334e7a523206b84bb369b94b10390e88","observation_id":"cd1e20ff-666e-4342-a52f-208a3b487efe","resolution":{"observed_at":"2026-08-08T12:19:42.921715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T12:19:42.926165Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.926165Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:644697aeed57bc751935df77930f61e305ead775838fb56a41afa38571add13f","observation_id":"49a53810-bc51-4a1c-9f6b-e73e391f1e6e","resolution":{"observed_at":"2026-08-08T12:19:42.926165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.930080Z","title":"The inference cost of search disruption – large language model cost analysis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.930080Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:f1914dbf77f467157adb5abffd666129b7cdef5526add083b930c622de2e2868","observation_id":"67955ca7-fbde-4b9f-8eb0-223e80525b45","resolution":{"observed_at":"2026-08-08T12:19:42.930080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.934251Z","title":"Nvidia tesla a100 80gb gpu sxm4 deep learning com- puting graphics card oem","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.934251Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2cac75ff15183dcfb8216405748abc8c81df0efa591e6a1bad4abc5cfc8620b2","observation_id":"12ba10d4-ae69-4261-a872-0cc372b2d438","resolution":{"observed_at":"2026-08-08T12:19:42.934251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.938373Z","title":"Pci interface ic","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.938373Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ada380d64ee0d5bd48cecb51b87206b957511d4c100b57b35655d9e10d7f8f9b","observation_id":"c3f77fda-f121-4c79-a0de-2993503f6b9d","resolution":{"observed_at":"2026-08-08T12:19:42.938373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.03118","last_updated":"2017-11-02T02:48:38Z","snapshot_observed_at":"2026-08-02T23:09:11.731136Z","submitted_at":"2017-02-10T10:04:30Z","title":"Sigmoid-Weighted Linear Units for Neural Network Function Approximation in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.03118","snapshot_observed_at":"2026-08-08T12:19:42.942471Z","title":"Sigmoid-weighted linear units for neural network function approximation in reinforcement learning, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.942471Z"},"links":{"cited_paper":"/paper/1702.03118","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:38dd77d879f573982b5c49b05da90a9ae1fcdec7b4351ec0f82b3487e929121a","observation_id":"2f0894fd-ced2-40d0-91ef-bbda10643519","resolution":{"observed_at":"2026-08-08T12:19:42.942471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.946555Z","title":"Adaptable Butterfly Accelerator for Attention-based NNs via Hardware and Algorithm Co-design","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.946555Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:650d2a0833a84dad58e381eb69c776de7b0aa888ccacbf67b7213b844f4416a7","observation_id":"fde56906-0e9f-4ce9-a19b-78ad37b29a88","resolution":{"observed_at":"2026-08-08T12:19:42.946555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.950787Z","title":"NDA: Near-DRAM acceleration architecture lever- aging commodity DRAM devices and standard memory modules","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.950787Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:00dd51b747300ba127155da349ce4b071cb80d076121aa27d02e2c8c75e4a846","observation_id":"40162986-cd5d-489c-9cb5-40d60ace121d","resolution":{"observed_at":"2026-08-08T12:19:42.950787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.954152Z","title":"Reinhardt, Adrian M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.954152Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:4fbf872a6237825985933bfe82508f7cdce1164822dfbe67de5c8fa8fd688574","observation_id":"5c1f2059-3400-449b-b31b-ff9222b4fa4d","resolution":{"observed_at":"2026-08-08T12:19:42.954152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.961275Z","title":"Sparsep: Towards ef- ficient sparse matrix vector multiplication on real processing-in- memory architectures","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.961275Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a733bc8f5b8d967e8d62f17d62d5bc49fde75dd6cdbf6a84dd91635ddc12513e","observation_id":"6456e43a-4f47-40ce-ba0a-2873b1e4bee8","resolution":{"observed_at":"2026-08-08T12:19:42.961275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.964664Z","title":"Benchmarking a new paradigm: Experimental analysis and characterization of a real processing-in- memory system","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.964664Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:11a1a1d90730338a24982de3c06dcbeac497655ba58bd627ef1a69a75fd7aa5f","observation_id":"77b8ec34-0861-4634-9898-0ae60995e6eb","resolution":{"observed_at":"2026-08-08T12:19:42.964664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.968712Z","title":"Evaluating machine learningworkloads on memory-centric comput- ing systems","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.968712Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:4b75d71350123bd01afc947b6b4759e3b502131603d1cfc0c5eb76f40adf392b","observation_id":"931f5695-aaf7-4f1c-9352-0a50f9f63405","resolution":{"observed_at":"2026-08-08T12:19:42.968712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.972030Z","title":"Our next-generation model: Gemini 1.5","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.972030Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a9e3d9304687d5301d399a39080824daf9a6ec802b6b5e73f9352cf3a852da31","observation_id":"c6cc619e-5bb2-46e2-a359-a533ca66c343","resolution":{"observed_at":"2026-08-08T12:19:42.972030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.975332Z","title":"Memory pooling with cxl.IEEE Micro, 43(2):48– 57, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.975332Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1408ef20ed9eb16f7c3263a4b949b646cea18cf072d3f98430423d076056b324","observation_id":"834a3a4f-a801-4228-9c53-1d452bad5f9f","resolution":{"observed_at":"2026-08-08T12:19:42.975332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.978839Z","title":"Direct access, High-Performance memory disaggregation with DirectCXL","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.978839Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:519756fe74516b71001f579c59adfd48e9794eab8e5ce30a3dae68b81871013c","observation_id":"49574b5b-b973-451a-8eed-66df7d31407a","resolution":{"observed_at":"2026-08-08T12:19:42.978839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.982214Z","title":"OliVe: Acceler- ating Large Language Models via Hardware-friendly Outlier-Victim Pair Quantization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.982214Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e729e43d683da10e33b91ffc909953799d7b016d59e3fb853dbc13eabf45a3ab","observation_id":"f5295c49-69b5-4e67-8994-0e33a8f01a05","resolution":{"observed_at":"2026-08-08T12:19:42.982214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-08T12:19:42.985722Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforce- ment learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.985722Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e28df85ad5a276a718d0ff68cc63dd60348d5dfae4f91d6178d32fa71c412bf9","observation_id":"61eaf1de-bd24-4108-903c-c4c1a42c4044","resolution":{"observed_at":"2026-08-08T12:19:42.985722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.989518Z","title":"ELSA: Hardware-software co-design for efficient, lightweight self-attention mechanism in neural networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.989518Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:db7ae30893fe123e5ecb7b4a07c4ae9a820e8f11c486857ca2db0d4693f81cbe","observation_id":"9b69936e-63a4-47c0-955d-64219e5c4490","resolution":{"observed_at":"2026-08-08T12:19:42.989518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.992996Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.992996Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:613dbc5f78228eb5ceedf00dce971545606bb5e53fdee95dbf864e435580a408","observation_id":"5e296e87-2f2c-4d9a-b59c-ac1b3e695651","resolution":{"observed_at":"2026-08-08T12:19:42.992996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-08T12:19:42.996285Z","title":"Gaussian error linear units (gelus)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.996285Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1c78beca8799c523a427331de9efad13ac91b192212d020b7245dfc8a6bcb3ed","observation_id":"55134ec4-639a-426d-8520-975c003e047c","resolution":{"observed_at":"2026-08-08T12:19:42.996285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:42.999831Z","title":"Neupims: Npu-pim heterogeneous acceleration for batched llm inferencing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:42.999831Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:8d8c19bb10cd13aa4ed2d9b2ee4539c35c67b06e3705b982ed390205b8e303ee","observation_id":"cb395ee5-4e1b-416a-ae1e-4824d597c81c","resolution":{"observed_at":"2026-08-08T12:19:42.999831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.007401Z","title":"Le, Yonghui Wu, and Zhifeng Chen","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.007401Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e343fa3a0983bf19b0939d35cb9c2e2ae4551e359dbc89380dcf399eb38abcc6","observation_id":"63c96630-b1d1-448b-b1fc-ed12aa84ec4d","resolution":{"observed_at":"2026-08-08T12:19:43.007401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.011573Z","title":"BEACON: Scalable Near-Data-Processing Accelerators for Genome Analysis near Memory Pool with the CXL Support","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.011573Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1e22b0dac320eb90df2d9a1a5a4384fe8bdf40934a82cdecfe33ba6156b1ff05","observation_id":"6ffc5613-87bf-401f-8af7-621eb91e81f2","resolution":{"observed_at":"2026-08-08T12:19:43.011573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.015085Z","title":"Floatpim: In-memory acceleration of deep neural network training with high precision","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.015085Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:d1be9d7d424231d690b77d5d85d0cba994aab8b17f1c6b7551f4b50235710985","observation_id":"ba3a06f7-092e-4df1-a37c-510a3da0fa64","resolution":{"observed_at":"2026-08-08T12:19:43.015085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.018239Z","title":"Ultra-efficient processing in-memory for data intensive applications","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.018239Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:c5fb812d80006d26ad4d8215ae483c933fcc550875a7f2247c4ebd7da1c2d65a","observation_id":"9ba074ee-9d04-4044-a038-a29e28cb3de0","resolution":{"observed_at":"2026-08-08T12:19:43.018239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.021491Z","title":"Intel xeon gold 6430 processor, 60m cache, 2.10 ghz","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.021491Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:724fdc393b13d6456c5c00f77b2345159879abfd22c1449d184558c069150f6c","observation_id":"fed0dce8-a0f9-46db-bfbe-c59958960241","resolution":{"observed_at":"2026-08-08T12:19:43.021491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.025589Z","title":"Intel ® xeon® gold 6430 processor","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.025589Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:f87684736db28c23807a3de5c90ca270ce8b92440764364287b25dbf0268c758","observation_id":"bfa1399a-05e0-4d73-a5a6-e7ba13adfdf0","resolution":{"observed_at":"2026-08-08T12:19:43.025589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.029008Z","title":"CXL-ANNS: Software- Hardware Collaborative Memory Disaggregation and Computation for Billion-Scale Approximate Nearest Neighbor Search","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.029008Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b814ae1b9be2fb1b1b3633640e9132334fcec35c5406813df4819621002a089c","observation_id":"3d974faa-ce32-4c60-9c7f-19365e6705cd","resolution":{"observed_at":"2026-08-08T12:19:43.029008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.032314Z","title":"Tpu v4: An optically reconfigurable supercomputer for machine learning with hardware support for embeddings","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.032314Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:d988fbfac08f7ff449edabce0c7bc747370368b2adef0e129df23d09f8e2484e","observation_id":"bf1c202c-5700-43bd-b906-d8d3953b23e6","resolution":{"observed_at":"2026-08-08T12:19:43.032314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.035525Z","title":"Noise-resilient DNN: Tolerating noise in PCM- based AI accelerators via noise-aware training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.035525Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:0c47530a23580cc1cd92e6ea42885179b19804d6e761a63ad1c3b56143d3cbee","observation_id":"f3183397-8d8e-4962-b7fd-85ba7ed408bb","resolution":{"observed_at":"2026-08-08T12:19:43.035525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.039355Z","title":"ChatGPT for good? On opportunities and challenges of large language models for education","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.039355Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:3116d8f2d1ca25ff5fa4958eaf9c5da7eb08e0df853668f27cd0d09a2dddd86a","observation_id":"551d1872-b606-4835-927f-e7255e0853e1","resolution":{"observed_at":"2026-08-08T12:19:43.039355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.043715Z","title":"Rec- nmp: Accelerating personalized recommendation with near-memory processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.043715Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2b3aa63ce0421048f4b21734f1ab9b2cb998cdb6485a9703001f6900853c1c01","observation_id":"fc0b1791-a46a-4a6c-bef5-518b86cd102e","resolution":{"observed_at":"2026-08-08T12:19:43.043715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.047402Z","title":"Moonwalk: Nre optimization in asic clouds.ACM SIGARCH Computer Architecture News, 45(1):511–526, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.047402Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b614c723cafb0def559523e61190d8edb5b0c2b0d58273ffe89198706adc02e3","observation_id":"40984173-3fef-493d-8435-905a989496c9","resolution":{"observed_at":"2026-08-08T12:19:43.047402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.051215Z","title":"Aquabolt-XL HBM2-PIM, LPDDR5-PIM with in-memory processing, and AXDIMM with accel- eration buffer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.051215Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a3b511a8224411c0eb436214b13a9fc26cb96e7898008aee8d572cad86bf4b9c","observation_id":"21964e30-ba5f-42c4-93fe-95844210fa51","resolution":{"observed_at":"2026-08-08T12:19:43.051215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.420068Z","title":"Samsung PIM/PNM for Transfmer Based AI: Energy Efficiency on PIM/PNM Cluster","venue":null,"work_id":"03248578-ccdc-42fa-8e4d-d2b028fb2fda","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.055256Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:49f006397c5d6f3572a9fa0e430dcb89291460ed9bd465ccad5f9add38122813","observation_id":"815bf70f-471f-4ee4-9d71-5072dcb57c42","resolution":{"observed_at":"2026-08-08T12:19:44.424550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.059497Z","title":"A 1ynm 1.25v 8gb 16gb/s/pin gddr6-based accelerator-in-memory supporting 1tflops mac operation and various activation functions for deep learning application","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.059497Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:6ffdd8303e48118a2202efa352bd7bcd0f7f0c67ce77205fd8c60cf95b2be300","observation_id":"24dbc041-3b61-4467-884a-3dfc5ade2e11","resolution":{"observed_at":"2026-08-08T12:19:43.059497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.406545Z","title":"Maeri: Enabling flexible dataflow mapping over dnn accelerators via recon- figurable interconnects","venue":null,"work_id":"3de9cc56-f502-4f11-92fc-9ad3cbd5b614","year":2018},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.063790Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:159b130631bc0980fff23d3cd26251d3fe36317d5d00ba24c3bed2d86633e9a2","observation_id":"b6cef06e-7a03-471a-b491-2f78bf7b2609","resolution":{"observed_at":"2026-08-08T12:19:44.411377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.067968Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.067968Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:3b2ea82689d1d85817d07f1c234f4041d82fe5b31815546054ae9c1f481e5367","observation_id":"6588b9e2-114f-418f-a03a-f1a17dc44c75","resolution":{"observed_at":"2026-08-08T12:19:43.067968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.072246Z","title":"Memory-centric computing with sk hynix’s domain-specific memory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.072246Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:bdbc88aad31e2e4243444ae36d29b178d98f55a0124bd9bfac3376fb29d3b8dc","observation_id":"0be80827-8f78-46d0-aab6-14544a8d6650","resolution":{"observed_at":"2026-08-08T12:19:43.072246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.387400Z","title":"System architecture and software stack for GDDR6-AiM","venue":null,"work_id":"194f92d5-4cb9-44c1-8e0f-de31ddb31f68","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.076737Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b0fd9c1b1c21ec22254e8c3fb994575ff65396a00f6ed721e40a1b6b75f8f080","observation_id":"c7b25c34-da8e-45b6-a33f-722a70341f7f","resolution":{"observed_at":"2026-08-08T12:19:44.391031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.376563Z","title":"25.4 a 20nm 6gb function-in-memory DRAM, based on HBM2 with a 1.2 tflops pro- grammable computing unit using bank-level parallelism, for machine learning applications","venue":null,"work_id":"86f4dc03-2b08-4d13-9fb1-06de7846a417","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.080673Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:06df70bc2b7de627c28a563a68a174fb8336e9a996be32256a7900d4033c7ee2","observation_id":"7b24437a-9736-4834-b18c-7bb0c0f435ba","resolution":{"observed_at":"2026-08-08T12:19:44.380426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.365325Z","title":"Improving in-memory database operations with acceleration DIMM (AxDIMM)","venue":null,"work_id":"bf57d69c-3285-45ef-ac87-cac4ba34edfe","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.084956Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e1f5e46e8664eba517dcc7456cba3e91551ceb97b0feda37d0174fbb536eb646","observation_id":"66bdc8f1-1e91-4704-bee7-d804f371433f","resolution":{"observed_at":"2026-08-08T12:19:44.369207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.353973Z","title":"Using machine learning to increase yield and lower packaging costs","venue":null,"work_id":"961b37cb-2c8e-4ee3-a048-7e69ee58f116","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.088957Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ffc85c0e4152b4edb2d2659c4860fb208c98f6dae2985002b8860a12e4564e64","observation_id":"bc0b94e1-27db-470f-a9be-167adc88e9e6","resolution":{"observed_at":"2026-08-08T12:19:44.357587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.343761Z","title":"A 1ynm 1.25 v 8gb, 16gb/s/pin gddr6-based accelerator-in-memory supporting 1tflops mac operation and various activation functions for deep-learning applications","venue":null,"work_id":"0698653d-2bb8-4e6b-a1b2-93468e9d8eba","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.093213Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:8276647ac09f09648258d19eef8bcbb760deacf7756508a6636b568e036c6349","observation_id":"5d1065ab-8c94-415c-9c2c-93facde77733","resolution":{"observed_at":"2026-08-08T12:19:44.347503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.332594Z","title":"Berger, Lisa Hsu, Daniel Ernst, Pantea Zardoshti, Stanko Novakovic, Monish Shah, Samir Ra- jadnya, Scott Lee, Ishwar Agarwal, Mark D","venue":null,"work_id":"f3c0a3b5-7fa9-42d7-8c7d-22b0bb51da85","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.097580Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:c7f6181d4646e535900cb3bf3364c89e7549f653de2efb5c9257d75e7ba510e0","observation_id":"06c69c93-84af-4188-b7d6-b4ebf002e139","resolution":{"observed_at":"2026-08-08T12:19:44.336520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.322418Z","title":"Accelerating distributed reinforcement learning with in-switch computing","venue":null,"work_id":"c943cc6a-1f01-468d-af8e-340130b46188","year":2019},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.101725Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:2fd0c151333bd3f71ecf745eef4badbd6651b00ba933b69bd50184d72a8e4687","observation_id":"4cdfb794-01a7-46ab-a526-cb5ae6f9a145","resolution":{"observed_at":"2026-08-08T12:19:44.326047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.312264Z","title":"Specification","venue":null,"work_id":"1e31d436-b09d-4f7d-83f9-282412515878","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.105664Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:8011b98cc0d5b5f525cf54dbcda14290daa143abf9678532ec50d3a86e085dbc","observation_id":"8ed1efdb-7d91-4d21-8099-e68bb427a939","resolution":{"observed_at":"2026-08-08T12:19:44.315839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-08T12:19:43.109950Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.109950Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:874e547f764a8965c69d3287cc5731071a7bd6c9b8403dc8e211da74d337ddfa","observation_id":"7f709682-02b2-49d6-829d-af86e7374b5a","resolution":{"observed_at":"2026-08-08T12:19:43.109950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.301795Z","title":"Enmc: Extreme near-memory classification via approximate screening","venue":null,"work_id":"5221e3e5-50a8-4c7f-b93b-cc8522d9d9d5","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.113850Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:0364a969e84dc12eff39db9de635bb9f9f71b4f28f4e21d5c40c275c356d4bfa","observation_id":"510e802c-84e8-47b2-af67-c7f69a80ffe1","resolution":{"observed_at":"2026-08-08T12:19:44.305602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.291291Z","title":"Sanger: A co-design framework for enabling sparse attention using reconfigurable architecture","venue":null,"work_id":"fdfd2dac-3a0c-45d7-b19a-40201026b342","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.118085Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ae4a19222f32cd5f3c7b385afc96295c2a0832f33bf7bc552f1372ad1944fe13","observation_id":"9ccfcc69-ef8b-44b3-a38d-05032c7029c6","resolution":{"observed_at":"2026-08-08T12:19:44.294964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11030","last_updated":"2023-11-29T00:21:13Z","snapshot_observed_at":"2026-07-06T16:08:45.401095Z","submitted_at":"2023-08-21T20:39:10Z","title":"Ramulator 2.0: A Modern, Modular, and Extensible DRAM Simulator","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11030","snapshot_observed_at":"2026-08-08T12:19:43.122136Z","title":"Ramulator 2.0: A Modern, Modular, and Extensible DRAM Simulator","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.122136Z"},"links":{"cited_paper":"/paper/2308.11030","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:bf8128acea3290b839f4d1fce466e8295d706ad152744665b1ac0bc5d3cf112e","observation_id":"0ae30fee-06ff-434c-8ca7-5fb36673ebfc","resolution":{"observed_at":"2026-08-08T12:19:43.122136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.280085Z","title":"A Binary-activation, Multi-level Weight RNN and Training Algorithm for ADC-/DAC- free and Noise-resilient Processing-in-memory Inference with eNVM","venue":null,"work_id":"42152be8-f884-4332-b0d5-13b7c3d6e014","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.126343Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:0a37409eee7ce87cc06bc5b855a3d86dbaa4b237c652f55209285df7c05d6a9f","observation_id":"bac7644a-2243-4259-a206-b048edc8780a","resolution":{"observed_at":"2026-08-08T12:19:44.283985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.270166Z","title":"Dram power calculator","venue":null,"work_id":"7d905f38-d1d0-4f4f-b873-8e767c96595a","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.129668Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:50f64667358dd220dce7a39b8cb7db8e16b725d0f70041e766ee0592354e37d4","observation_id":"91daf12f-993f-4c47-a980-e9d882c50483","resolution":{"observed_at":"2026-08-08T12:19:44.273545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.259704Z","title":"Nvidia shipped 3.76m data center gpus in 2023","venue":null,"work_id":"2f9716f0-2ffe-4bfa-9c2b-279ef1d6495d","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.133028Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:abdc5ad94706d379289a02eb2deb0d87a17de4d8401cd0164e971cb6c3c54ae1","observation_id":"b421ff6f-4c59-477b-b23b-21d96fadea73","resolution":{"observed_at":"2026-08-08T12:19:44.263356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.249773Z","title":"Supply chain aware computer architecture","venue":null,"work_id":"c88d87dc-356b-4c65-8706-679f856eb573","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.136219Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:5c1ac5f9e8ed91f0bf1e9439a2c905f6bbd401c531b80f4d695e5142bb5bd58b","observation_id":"ab8cb036-44dc-4216-915c-da2638c00132","resolution":{"observed_at":"2026-08-08T12:19:44.253293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.239608Z","title":"184QPS/W 64Mb/mm 2 3D logic-to-DRAM hybrid bonding with process-near-memory engine for recommendation system","venue":null,"work_id":"a78e2e39-1a08-4a6c-9f1a-f025dfb53377","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.139776Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:7779c9f49795a65ccf3117c7eee64ccedb930b52b03b262a7a2c0bda1ccb0645","observation_id":"7d85537c-4844-4d37-9329-0f38af56f576","resolution":{"observed_at":"2026-08-08T12:19:44.243312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.229148Z","title":"Introduction to the nvidia dgx a100 system","venue":null,"work_id":"c1c814d3-2473-4ab1-8c2d-af39a38ad125","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.143328Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1a9bdc6954f82ca0b3c389f3ceb11283e240edee823d54db50b96faea8e1e247","observation_id":"ff55d8ee-85ff-4168-86b3-cdfc2e145b2e","resolution":{"observed_at":"2026-08-08T12:19:44.232936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.219169Z","title":"Nvidia a100 tensor core gpu","venue":null,"work_id":"e606923f-3ed6-4a88-96f5-f5cc20493827","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.146694Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:1e866831a01e8c0bdb80a54783add6712cddddf2ef44ad64192ce341f24f3a4f","observation_id":"87ffbc70-e3a9-4f62-a1c7-08606df975ee","resolution":{"observed_at":"2026-08-08T12:19:44.222631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.208870Z","title":"Nvidia hgx a100, the most powerful end-to-end ai supercom- puting platform","venue":null,"work_id":"5432199d-0970-4136-aa1e-05295b48b3e4","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.150077Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:453f8ee5b35eaf6b3dd918229f29cb7b00699078b0243042fdf74cdabe3bf37f","observation_id":"b9db1fba-f9ff-41f1-839c-6a6dfc0ed566","resolution":{"observed_at":"2026-08-08T12:19:44.212585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.198763Z","title":"Nvlink and nvlink switch","venue":null,"work_id":"4c232a2a-3204-4dc9-a635-4d7d852bd6e6","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.153989Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a6ce20092c6e6ec2759e543d27c3ea21df2b9f254a6936a422034163210fbc63","observation_id":"4f6571af-9e27-4194-9641-a9036d6ecbba","resolution":{"observed_at":"2026-08-08T12:19:44.202214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.188541Z","title":null,"venue":null,"work_id":"a06f95dd-79d9-49c6-bc5e-2d5951ccde5e","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.157526Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:52ad180ba85497e3e0864359cf55f5b001e734c54f3c0355cf7b5399f8a52287","observation_id":"3cb0cb57-9174-4a9d-8d7c-0057f438580d","resolution":{"observed_at":"2026-08-08T12:19:44.191897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.177500Z","title":"Fine- grained dram: Energy-efficient dram for extreme bandwidth systems","venue":null,"work_id":"46de0665-3ffe-4939-94e3-ba9ba49a5e29","year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.160924Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ed2ce476be3902d05e8152c6956cbc2483223249e3a5cc619790147d0ac8e64f","observation_id":"48f7f33b-48ef-4d04-9e6f-567b0376ba51","resolution":{"observed_at":"2026-08-08T12:19:44.181932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.167830Z","title":"Bureau of Labor Statistics","venue":null,"work_id":"7ee54a43-15bb-44fb-b0b7-01d074676286","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.164318Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:5d453b3a5bb59b6d29049a215b189d2c77720fd2d6c0bf92e5527b8cc5ab5b47","observation_id":"001a95ce-8a7c-4781-a9a6-d1e1842e31df","resolution":{"observed_at":"2026-08-08T12:19:44.171164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.158073Z","title":"Accelerating neural network inference with processing-in-dram: From the edge to the cloud","venue":null,"work_id":"ab1fb5c9-7c29-4625-9fc5-9b04928f7b72","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.168553Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:844172476cb9575f940529d8e4ff5e0089f230ecd8897acb011e8e35f9faddf1","observation_id":"93dc2701-7455-4c73-a6e6-33f54ddaa771","resolution":{"observed_at":"2026-08-08T12:19:44.161590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.147722Z","title":"Gpt-4 turbo and gpt-4","venue":null,"work_id":"62185b77-6e5f-4e61-8d20-55af88d07b2f","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.172611Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:6166810d0b9c1ea3defb9a6ca06bbec04b96266d692ff59bfb7065b5e635efcd","observation_id":"53c05752-51aa-45d7-a70a-58eac2fb0983","resolution":{"observed_at":"2026-08-08T12:19:44.151325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.137420Z","title":"Learning to reason with llms","venue":null,"work_id":"45d06caf-ca82-4d13-923e-968a52d85fe1","year":2025},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.176883Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:b3255d913202b8136aaa973d1355ec4c200878494580531b5425a57a6a21f069","observation_id":"89e01c35-16d1-4ced-bc9e-a20aeb8f2d32","resolution":{"observed_at":"2026-08-08T12:19:44.140848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.126493Z","title":"Video generation models as world simulators","venue":null,"work_id":"18dc3504-ebe9-4b7b-ac18-1063c6d8577e","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.180173Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:0e39e59cea80c7b45d0b9ab48b861ca58aa3e6354cd9b7670f4a30ed6a9b149a","observation_id":"72d9eac6-99da-4454-9711-51cc0a1679c7","resolution":{"observed_at":"2026-08-08T12:19:44.130360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T12:19:43.183524Z","title":"GPT-4 Technical Report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.183524Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a93b12d703dbc34d67c0b800a6678df20eee3ddfda53872126f6fc9526cb41e5","observation_id":"05f5e22d-b5ed-44e4-91e8-f04aa921dd0d","resolution":{"observed_at":"2026-08-08T12:19:43.183524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.111892Z","title":"Cost and yield analysis of multi-die packaging using 2.5 d technology compared to fan-out wafer level packaging","venue":null,"work_id":"27c35a3b-6dbb-4aed-bcec-8af7d0f7f40a","year":2014},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.186916Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:dd53e06555ff9a67159f002e6304ede786f48a34464f74b27af1839d8c32ec83","observation_id":"b83c9968-c212-40fa-9f43-80d845986aac","resolution":{"observed_at":"2026-08-08T12:19:44.116094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.100190Z","title":"Attacc! unleashing the power of pim for batched transformer-based generative model inference","venue":null,"work_id":"873f77c2-63d7-48fe-9fae-7d272f9c3eb9","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.190248Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:5dad34caf11b1fb709e4c67dd88356328e3022f9cf0efa18c398ec582a2c1831","observation_id":"1d76f3a5-652f-412f-a3fa-fa8c10785fb6","resolution":{"observed_at":"2026-08-08T12:19:44.104257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.088702Z","title":"Trim: Enhancing processor-memory interfaces with scalable tensor reduction in memory","venue":null,"work_id":"2afd715b-bf0d-4c39-92ac-52b071389483","year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.197770Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a6b8a5b8051c5777a3670c2bfcf75983ec01279f7d2825ab0f8ec4fa0c78cba2","observation_id":"49de6f65-d730-407d-8c97-2d2b9afe42ae","resolution":{"observed_at":"2026-08-08T12:19:44.092592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.077402Z","title":"An LPDDR-based CXL-PNM Platform for TCO-efficient Inference of Transformer-based Large Language Models","venue":null,"work_id":"512fc176-ebdc-43d4-bd34-857eae34c383","year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.201368Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:68d19275ceed4574ebf34b1c4811f8e60ea6937e80ea34a1b3a473bdab7b151d","observation_id":"a1d117e2-4a53-43a7-8f1d-f5aca6135e4e","resolution":{"observed_at":"2026-08-08T12:19:44.081069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.193719Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.193719Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:59bc1beab45b93210087bb0bafa0e8446709fad966ecea5315701263911534e3","observation_id":"c2b6d119-1ac8-4b0c-8f60-3eb64c6beb38","resolution":{"observed_at":"2026-08-08T12:19:43.193719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.054300Z","title":"Splitwise: Efficient gen- erative llm inference using phase splitting","venue":null,"work_id":"6b70dbe5-df58-431e-b0c9-a6ea75cb9845","year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.208695Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a013aea2df9b6b02e3e121790d7ef0d9e8c6fca7b094df89787fe8ec5b88e3b4","observation_id":"5b2912e3-6b3b-4e5b-ba80-6981b4c294a7","resolution":{"observed_at":"2026-08-08T12:19:44.059017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-08T12:19:43.212984Z","title":"Movie gen: A cast of media foundation models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.212984Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:3cc2f25fcb8ddc533c765487fa450fd63165222fb5b7a979bcb0b325f8d3787d","observation_id":"b30cd212-45ff-4832-aeff-ec2c75b2361f","resolution":{"observed_at":"2026-08-08T12:19:43.212984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.066830Z","title":"Nvidia ada lovelace leaked specifications, die sizes, architecture, cost, and performance analysis","venue":null,"work_id":"c2da41ab-3b6f-4b1c-9389-f8703a63f6a6","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.204959Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:95630e7b91f8d8b3881dd7a5e432c521be1d661104e920109a0f31a2dcad7f37","observation_id":"cb0aafde-3aa6-426a-ac18-5890ceeaef73","resolution":{"observed_at":"2026-08-08T12:19:44.070811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.043079Z","title":"FACT: FFN- Attention Co-optimized Transformer Architecture with Eager Cor- relation Prediction","venue":null,"work_id":"8b4377a0-18b0-45c8-b0c2-c8f14fba233c","year":2023},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.221118Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:77f651b70d26210279380247ec317d8ff56655268b78141f54640a98f21f84ce","observation_id":"50869f67-984a-48bc-a6f2-53098521ce11","resolution":{"observed_at":"2026-08-08T12:19:44.046764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.032697Z","title":"Dota: detect and omit weak attentions for scalable transformer acceleration","venue":null,"work_id":"ac906625-b17d-4ca9-90ff-cebf65bad881","year":2022},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.225224Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:107e97f8d51396d9d5d51d89296d093d27da0775095b3432bfaf1568d61f9c25","observation_id":"7770edb4-b003-40ce-8c5b-e8e21091736f","resolution":{"observed_at":"2026-08-08T12:19:44.036444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12409","last_updated":"2022-04-22T18:20:48Z","snapshot_observed_at":"2026-08-07T11:26:24.970964Z","submitted_at":"2021-08-27T17:35:06Z","title":"Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12409","snapshot_observed_at":"2026-08-08T12:19:43.216975Z","title":"Train short, test long: Attention with linear biases enables input length extrapolation.arXiv preprint arXiv:2108.12409, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.216975Z"},"links":{"cited_paper":"/paper/2108.12409","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:e5d222bbfc28b072e3eb09aa754ab6dc1f8ea3a2f110f2835490fb24a6e42801","observation_id":"31adadca-0d46-4a13-9f5d-f7a7364b8f78","resolution":{"observed_at":"2026-08-08T12:19:43.216975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.021802Z","title":"Impala: Algorithm/architecture co-design for in- memory multi-stride pattern matching","venue":null,"work_id":"8fa7f3d9-ccb1-41be-908e-0e99a6b9cbe9","year":2020},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.233212Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:ccca99789fbc116bb6c5164df95a89097b0967a57c2c9f60c2a53aa15c36c00b","observation_id":"a8ad555e-ed1a-4fa2-9fc5-6b722b428f21","resolution":{"observed_at":"2026-08-08T12:19:44.025911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"lcsc/2204251","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:43.529496Z","title":"8gb gddr6 sgram c-die","venue":null,"work_id":"031830c2-82ba-4536-8094-8e8fbd67acea","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.236583Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:bf9016de43313c6f5a51d3aa751773cabaeb5e47975001876e4735502e226e8b","observation_id":"52e7404c-5666-46c4-bf2d-99a4b3108973","resolution":{"observed_at":"2026-08-08T12:19:43.535628Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.05941","last_updated":"2017-10-27T17:45:21Z","snapshot_observed_at":"2026-08-08T18:23:31.977872Z","submitted_at":"2017-10-16T18:05:45Z","title":"Searching for Activation Functions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.05941","snapshot_observed_at":"2026-08-08T12:19:43.229683Z","title":"Searching for activation functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.229683Z"},"links":{"cited_paper":"/paper/1710.05941","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:89439c96191b22774a6f70b53c54f9874a8dcdc7026d77f427b26e40225e3fdf","observation_id":"347e29e6-146d-4f10-8c3c-f9e18db03e1d","resolution":{"observed_at":"2026-08-08T12:19:43.229683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-08-08T12:19:43.243256Z","title":"Glu variants improve transformer","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.243256Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:af7c60a893de1ca2ea4c696357fba0d2cbf42190051cd968b37df9b803d8f7f9","observation_id":"36b826bd-1753-4dde-8de6-b8fb57a89e45","resolution":{"observed_at":"2026-08-08T12:19:43.243256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-08T12:19:43.247215Z","title":"Megatron-lm: Training multi- billion parameter language models using model parallelism","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.247215Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:a374f60bc919370b9374f54c45ef8830d0b8b9226f87b5211e8e003c298efa4c","observation_id":"1106256b-df8e-4e41-a921-c63c4186a17a","resolution":{"observed_at":"2026-08-08T12:19:43.247215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T12:19:44.011054Z","title":"Generative ai winds in memory semiconduc- tors, total demand for server drams is declining","venue":null,"work_id":"f09d2340-a54a-4be2-aff7-bf503c53234d","year":null},"citing_paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference","version":3},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-08T12:19:43.239755Z"},"links":{"citing_paper":"/paper/2502.07578"},"observation_digest":"sha256:de95280a74f25083beeeb2cb0886f3a6762479985c0496c32af8e44ea475378f","observation_id":"7992e68b-9baf-43c4-87c3-91a2b39d4c87","resolution":{"observed_at":"2026-08-08T12:19:44.015080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.07578","last_updated":"2025-05-03T04:07:07Z","latest_version":3,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-08T12:12:54.462941Z","submitted_at":"2025-02-11T14:25:20Z","title":"PIM Is All You Need: A CXL-Enabled GPU-Free System for Large Language Model Inference"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":1,"verified_fuzzy":37},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 0 inbound Pith citation observations for arXiv:2502.07578."}