{"as_of":"2026-08-19T13:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f450b272e37b30c7c63b6e295870df30d0b106d27f6e3d3eb54987167cb3441","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:40:41.404354Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T04:43:41.912918Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T21:36:18.155064Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":"2504.17584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.17584","snapshot_observed_at":"2026-08-10T01:09:04.439649Z","title":null,"venue":null,"work_id":"07fb5b01-7ab1-4d15-87c4-4c166b92f051","year":2025},"citing_paper":{"arxiv_id":"2605.05639","last_updated":"2026-08-12T14:28:27Z","snapshot_observed_at":"2026-08-15T23:12:05.817598Z","submitted_at":"2026-05-07T03:47:18Z","title":"TokenStack: A Heterogeneous HBM-PIM Architecture and Runtime for Efficient LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T04:43:41.912918Z"},"links":{"cited_paper":"/paper/2504.17584","citing_paper":"/paper/2605.05639"},"observation_digest":"sha256:b8c49f52752ead27403f5eeff15ad0509be14f60964e2e30354f08325b410042","observation_id":"37105552-e859-4341-bee5-297ce80df73e","resolution":{"observed_at":"2026-08-10T01:09:04.439649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.17584/citation-record","integrity":"/paper/2504.17584/integrity","json":"/paper/2504.17584/citation-record.json","paper":"/paper/2504.17584"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.066181Z","title":"DDR4 SDRAM LRDIMM","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.066181Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:113742a3e88621d479d139357fc5b6bcdac62372a6851ed56e3bb5e77bd60014","observation_id":"10be7620-6106-4c61-b57b-35fb397e9fab","resolution":{"observed_at":"2026-08-16T10:40:41.066181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.070389Z","title":"JEDEC Standard: DDR4 SDRAM Load Reduced DIMM (LRDIMM) Design Specification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.070389Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:37bff37eb0eba24f4152ed8143f59e3ab5c7d74c22597c8215f9d7256faa9693","observation_id":"4457eadd-40ca-4481-bd71-0094efced50b","resolution":{"observed_at":"2026-08-16T10:40:41.070389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.073658Z","title":"NVIDIA DGX A100","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.073658Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:e9dddf0331fb3b69df3e24be8f4a7ce9f162fcb348e79c05b96e478d21a02b63","observation_id":"cbc9f7ea-fef9-4188-a8a1-d5ad3a99b973","resolution":{"observed_at":"2026-08-16T10:40:41.073658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.077117Z","title":"cognitivecomputations/dolphin-r1 · Datasets at Hugging Face","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.077117Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:84ed2524ad402cc4ecc901912800cb1a01ad7bc8c5702435d4e327c4112b39e2","observation_id":"e5470d0d-d0c4-42a6-82c5-41c8648454e8","resolution":{"observed_at":"2026-08-16T10:40:41.077117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.080517Z","title":"open-r1/OpenR1-Math-220k · Datasets at Hugging Face","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.080517Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:a335daf088f5d9543050352f80e4a8867d8eb4f2ad12430dd32e3f20939bc1be","observation_id":"1070ebea-9b20-46b4-9c24-770a339534ce","resolution":{"observed_at":"2026-08-16T10:40:41.080517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.084027Z","title":"open-r1/OpenThoughts-114k-math · Datasets at Hugging Face","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.084027Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:5cbac15c01d028ce7b9bec20e378333acd64a922dfefc5edac50def38b3c54dd","observation_id":"d87c7697-73a1-40a6-9e26-ad0b2542801a","resolution":{"observed_at":"2026-08-16T10:40:41.084027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.087717Z","title":"Gulavani, Alexey Tumanov, and Ramachandran Ramjee","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.087717Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:ade131b6917fcc554366b7d0e2ebb475f7a60634919502f5543a933687b8169f","observation_id":"42041ed7-5b20-4730-855d-5622a48e74c3","resolution":{"observed_at":"2026-08-16T10:40:41.087717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.090834Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.090834Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:f2234558d48ce8c71968fe8dd1eb20aefd6a572cd76c7e5e1721e299f29cd86a","observation_id":"bce301ad-6c88-4f70-a98f-1a3a81cc4d4e","resolution":{"observed_at":"2026-08-16T10:40:41.090834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-16T10:40:41.094461Z","title":"Dai, Orhan Firat, Melvin Johnson, Dmitry Lepikhin, Alexandre Passos, Siamak Shakeri, Emanuel Taropa, Paige Bailey, Zhifeng Chen, Eric Chu, Jonathan H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.094461Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:1a11ba1a9d12fd20a761396cbdfbc6314dbdb2bdfac6413f2cddf3aeb9cdb77d","observation_id":"a554d7d2-08e2-4766-ac4b-d312df1e2545","resolution":{"observed_at":"2026-08-16T10:40:41.094461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.102508Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.102508Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:9e22c2429026db2f90325364e4ffd1790161758eb548ceecd3f2a68b33392cbd","observation_id":"6cc82030-8eb3-4642-9b99-5b1a9a4c1c66","resolution":{"observed_at":"2026-08-16T10:40:41.102508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-16T10:40:41.109531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.109531Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4fd518e969bd4e7ec34d178298fc8ef964d254d841320b8ff15e8ace35c92c3b","observation_id":"5cb427b0-e871-4686-9bb1-aa1cc33e9f74","resolution":{"observed_at":"2026-08-16T10:40:41.109531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.113213Z","title":"Malladi, Hongzhong Zheng, and Onur Mutlu","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.113213Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4f29201e3830cd7da1eb215eb89ff5c4419e37bb34087171adec55ea859104c7","observation_id":"d9d2560f-0cc7-40fe-bf8c-ce3b9e516f53","resolution":{"observed_at":"2026-08-16T10:40:41.113213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.116385Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.116385Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:91fae7ea997141606b1f5d2b1eb999e494fadd70c4722fbd709d39e9c3799db9","observation_id":"ed7badf1-8f21-4af4-bff4-9ea16ea728bd","resolution":{"observed_at":"2026-08-16T10:40:41.116385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.119927Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.119927Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:096082737554ebdfd539cc6628d11c06af4e7d510789717672699062f257f16b","observation_id":"3e65b66e-d14d-438b-a8c6-2ba62da5f7a3","resolution":{"observed_at":"2026-08-16T10:40:41.119927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.126736Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.126736Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:bf1fd6fb4a5203fafe753870a7cda3cf4c93ddf7ae62ceb17862a265cd991442","observation_id":"6e7c87eb-e21c-42d4-9563-ee148860660b","resolution":{"observed_at":"2026-08-16T10:40:41.126736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.130023Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.130023Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:5529374ec87c880b4ee15c73870e0cb93bb1cdad1066aecc527d2eabd68f1b69","observation_id":"000b0a03-87bb-4ca0-8842-edf4454d3f12","resolution":{"observed_at":"2026-08-16T10:40:41.130023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T10:40:41.137240Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.137240Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:fa4ce1293054770783c2cc16e4e5f136c5c7610bb81ae2d451937ed36aee24c5","observation_id":"0e8f845a-1fe9-4aac-b530-d3fc0b3a74ba","resolution":{"observed_at":"2026-08-16T10:40:41.137240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.141027Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.141027Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:57b5f94bfbda18be8abb139768527c140b0688667d6152f1d5cdf474953c62f6","observation_id":"710379ee-0492-4979-b2af-d01d65d0a89b","resolution":{"observed_at":"2026-08-16T10:40:41.141027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-16T10:40:41.148690Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.148690Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:319946c21f435104cc204f4833030e0a3789e11babc84d178c30ad22b4262f7c","observation_id":"140d2ae0-bfe3-4a04-b19a-debfd9366868","resolution":{"observed_at":"2026-08-16T10:40:41.148690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.153307Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.153307Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:25e1a81a9e4adf4a9096e5cd5bcd9d0637457564698b70c246e7e49df01a8a39","observation_id":"e78598b4-d57d-4e6a-89d3-bdb64213e5d8","resolution":{"observed_at":"2026-08-16T10:40:41.153307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.317154Z","title":null,"venue":null,"work_id":"e5dd1f11-ba88-46ff-9036-396cc70945a8","year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.156264Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:e9aad8d9e0509813f26292efa463c173175bf214b513403583221e880fc3b52d","observation_id":"bf130c75-5bee-4b18-8129-39de3964f249","resolution":{"observed_at":"2026-08-16T10:40:44.320448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.307852Z","title":null,"venue":null,"work_id":"6f40b1f8-ac5d-4400-b06c-9c46e34cc6a8","year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.159838Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:85a53e41491893d8ded18333a575632bc9d7c322418b518823218e68023f0213","observation_id":"af2425c3-a51b-4f1f-8188-5f3cb5e15225","resolution":{"observed_at":"2026-08-16T10:40:44.310948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-16T14:39:45.917951Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-16T10:40:41.163221Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.163221Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:12c218ebf9ae8adfefb6fa3464f5ac905c4f6f79d8c5b44fdac207a62d2ca0f3","observation_id":"39412359-e9d2-477d-a7af-dc9924585838","resolution":{"observed_at":"2026-08-16T10:40:41.163221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T10:40:41.166672Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.166672Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:1529141d11e34dd64a2cf74fc97ced99caca2c8ee83ddcfaa96437a3f106f85e","observation_id":"0e80309c-5087-49ec-a210-68dcbf625af2","resolution":{"observed_at":"2026-08-16T10:40:41.166672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.170616Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.170616Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4b2b9bb6836bb77074eed9760fd4c064c6376d7eb057da9dcae0fef4432d3c90","observation_id":"ce9f1253-24fa-4b7d-9816-831a7895dca8","resolution":{"observed_at":"2026-08-16T10:40:41.170616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.174067Z","title":"Oliveira, and Onur Mutlu","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.174067Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:100ee90c411a6f702222bd24e7358156ca1105116411d31fda2b2df6b7da8cfd","observation_id":"2eb0ad0f-468d-45c5-aa41-e754f44a9e31","resolution":{"observed_at":"2026-08-16T10:40:41.174067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11421","last_updated":"2024-03-18T02:30:23Z","snapshot_observed_at":"2026-08-16T14:08:58.432540Z","submitted_at":"2024-03-18T02:30:23Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11421","snapshot_observed_at":"2026-08-16T10:40:41.177186Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.177186Z"},"links":{"cited_paper":"/paper/2403.11421","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:58ec68ddde0ddf9e85fcb0b04df5f414ead392e7988d50ef8748e57734fbd78d","observation_id":"e59e1e7d-63d8-4feb-90d0-b0f79630fe8f","resolution":{"observed_at":"2026-08-16T10:40:41.177186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.299031Z","title":null,"venue":null,"work_id":"c7209984-c0d4-457e-8bda-3df50db47d72","year":2020},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.180947Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:d52e9eb900cab6ef528936c00b11166d0117814536f35353831cd69e0505e385","observation_id":"1ba2daf5-95e7-4e92-891d-70a579d66800","resolution":{"observed_at":"2026-08-16T10:40:44.302055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.187204Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.187204Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:34af5d2a3106828afb0ff30ff5f5fac014c34e8f41b27314e79e7adb56a95ab3","observation_id":"2bd84dcc-b97a-452a-8adc-8e10a33db8bd","resolution":{"observed_at":"2026-08-16T10:40:41.187204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10403","last_updated":"2023-05-26T17:59:33Z","snapshot_observed_at":"2026-08-06T19:23:30.079167Z","submitted_at":"2022-12-20T16:29:03Z","title":"Towards Reasoning in Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10403","snapshot_observed_at":"2026-08-16T10:40:41.194582Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.194582Z"},"links":{"cited_paper":"/paper/2212.10403","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:808ee287493a9b7ff67f76a955753a9e2762cd6de8d92e23358bb3228ca5de60","observation_id":"1b26cd30-92dd-485d-96e1-d6a5d677f3e9","resolution":{"observed_at":"2026-08-16T10:40:41.194582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.197863Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.197863Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:57dc56bba4707cf1f85ba0ca830dfb3ace8768b6b376871c426687cbe7c7f043","observation_id":"42f66b4d-8ac5-41ad-b44f-35888ea94d81","resolution":{"observed_at":"2026-08-16T10:40:41.197863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.290723Z","title":null,"venue":null,"work_id":"933174f7-ec20-49cd-9518-5ade7ff5b715","year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.201701Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:251c6de5f753f35cd347b31e5a5052e00457c97e27b9cef38f5df5c826a0b6de","observation_id":"73857616-9805-4016-9605-bb5283d551b1","resolution":{"observed_at":"2026-08-16T10:40:44.293526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.209786Z","title":"Malladi, Andrew Chang, and Yuan Xie","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.209786Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:ff6cfbd1f2ba16f0aa9f8dbe2a6079ef06901285d6e0c8538f01a376aef9c669","observation_id":"581d0b8b-1132-492e-a3b6-98b94ffea03b","resolution":{"observed_at":"2026-08-16T10:40:41.209786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.281719Z","title":null,"venue":null,"work_id":"027fd239-9bc6-4b61-afb0-c480ece99011","year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.212960Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:722d1ae1fed662401bc6d4bd89463a37a39145e9e543e1bd2a327832c31d87f5","observation_id":"8a731392-3ddf-4db1-90c1-aa0dfad04493","resolution":{"observed_at":"2026-08-16T10:40:44.284790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01142","last_updated":"2024-11-02T05:15:44Z","snapshot_observed_at":"2026-08-16T13:03:37.355506Z","submitted_at":"2024-11-02T05:15:44Z","title":"NEO: Saving GPU Memory Crisis with CPU Offloading for Online LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01142","snapshot_observed_at":"2026-08-16T10:40:41.218541Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.218541Z"},"links":{"cited_paper":"/paper/2411.01142","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:e17b6547c7680fa14ec532b7c372b9531d44a1cfa82caf0a5ff4fe56e35b7926","observation_id":"e9ea9c74-183f-4f56-bd17-0d410a536153","resolution":{"observed_at":"2026-08-16T10:40:41.218541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.79390","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:43.060246Z","title":null,"venue":null,"work_id":"bac54a98-a814-4221-a524-30417ac65c34","year":2017},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.222342Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:a75af543ff88d34056b15c50697d6a4026598f7658d1d38994b3b63ff05180de","observation_id":"6b1849d5-358e-47eb-b474-de2a61ddfb59","resolution":{"observed_at":"2026-08-16T10:40:43.065278Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.225865Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.225865Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:490d3f532a7f263a1d6a18c064a9b3e24e732606802ca0dae88f83ebaa2fbe9f","observation_id":"d2837073-852b-46b5-a796-11cb252f5d7f","resolution":{"observed_at":"2026-08-16T10:40:41.225865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12321","last_updated":"2023-10-04T16:37:05Z","snapshot_observed_at":"2026-08-18T03:27:31.101366Z","submitted_at":"2023-10-04T16:37:05Z","title":"A Survey of GPT-3 Family Large Language Models Including ChatGPT and GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12321","snapshot_observed_at":"2026-08-16T10:40:41.229523Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.229523Z"},"links":{"cited_paper":"/paper/2310.12321","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:7b2807f67b1b40fe59ca0cc8e70717e3d2636a4aa73befe43ce7dc1823756d1a","observation_id":"e39a0edb-968b-48b5-86eb-9d5159320253","resolution":{"observed_at":"2026-08-16T10:40:41.229523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.233141Z","title":"Kamath, Ramya Prabhu, Jayashree Mohan, Simon Peter, Ramachan- dran Ramjee, and Ashish Panwar","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.233141Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4fa441685b2b863e234edf69ccc578e86d5fe83f70c0fce432229de5cc49f90a","observation_id":"50e6aa00-527e-48a9-b67d-0f9c4ab20678","resolution":{"observed_at":"2026-08-16T10:40:41.233141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.236548Z","title":"Lee, Meng Li, Bert Maher, Dheevatsa Mudigere, Maxim Naumov, Martin Schatz, Mikhail Smelyanskiy, Xiaodong Wang, Brandon Reagen, Carole-Jean Wu, Mark Hempstead, and Xuan Zhang","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.236548Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:3b988997bf5ef5fdd6d3f6ff770b0532432f0720ae8162d82fe701d8d0ae5ab3","observation_id":"a54afd8c-cb5d-4b5c-a26b-c3b89fdbb1cf","resolution":{"observed_at":"2026-08-16T10:40:41.236548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.242904Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.242904Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:693a0fe16e2404d92f015656ae42247e1c78748dec2787076eb14346b1f85970","observation_id":"773e1964-142d-4ee5-b437-f3fe54f3d4b3","resolution":{"observed_at":"2026-08-16T10:40:41.242904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.245766Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.245766Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:39f03b4e838b2d0cbe55edcab4fdd24e63961f7e69e30b1cf73e0189b7214604","observation_id":"905d2fa0-211b-4ba4-a46f-f0729ff07dc4","resolution":{"observed_at":"2026-08-16T10:40:41.245766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.249237Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.249237Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:29485b52b434248d5d1d9d061fa82315643f6d284634f850e3272da426dd5cf4","observation_id":"395c5a12-0dbd-4a6d-8fc4-31e1eb8a2b09","resolution":{"observed_at":"2026-08-16T10:40:41.249237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.256190Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.256190Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:e3fdf734598461d0530c8e05f0adb91652ec48dfc4c87b2f778f154f8692bb91","observation_id":"6e98b943-0a03-4e11-a959-ed8ca756b71f","resolution":{"observed_at":"2026-08-16T10:40:41.256190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.259517Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.259517Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:bb46a456cfe290fd7539c2e0d460e1dfc242a812ef4f94bfe2e4b6990155ee75","observation_id":"0010db3c-971f-4b60-9984-5ff53230cecc","resolution":{"observed_at":"2026-08-16T10:40:41.259517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.272796Z","title":null,"venue":null,"work_id":"03f87fff-c7b8-45a1-9f3a-858bf061f5e1","year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.263136Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:cec6ad58289cf8c62fa1f513ba1ee619b629cb2814d90753da085813169cfc37","observation_id":"a37763ce-21a7-48e7-99a1-c510694b38a2","resolution":{"observed_at":"2026-08-16T10:40:44.275949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.270233Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.270233Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4949dd59c72ed7d92745c108687c78a39c36b74b708110203c89a59ecc4694d0","observation_id":"1764da59-6391-45eb-baf7-9bf15474e9b4","resolution":{"observed_at":"2026-08-16T10:40:41.270233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.273645Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.273645Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:a8603b480e015f18e9c2efc00dc255d00bf2d44188fcde93ffc22494d007f678","observation_id":"a0117ff7-e235-4dab-a480-a3957a996264","resolution":{"observed_at":"2026-08-16T10:40:41.273645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.277237Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.277237Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:7513491b06fb9018df7ed95267ed62ce154a378fc772e4aed15fc8004397862e","observation_id":"f8270986-4fef-4568-be72-726b3e7a7f68","resolution":{"observed_at":"2026-08-16T10:40:41.277237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.280868Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.280868Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:82cf8bd487fb52ef427f9ed59f79318f77a6af6655df02918ab19073be3acf32","observation_id":"7219955a-590b-4d15-bcb0-72b042f354a1","resolution":{"observed_at":"2026-08-16T10:40:41.280868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.257409Z","title":null,"venue":null,"work_id":"931d671c-562e-45d6-901d-40cf2b75bda9","year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.284487Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:3beab8b7804c0247dbc4c383cc96db1b7ca28f1b6ccb65db258ee703b7fc577c","observation_id":"f3774be8-44e0-4fca-a458-248fdb6c1191","resolution":{"observed_at":"2026-08-16T10:40:44.260766Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.291590Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.291590Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:6568e631dd4801c8a6acff7efad7798fc3cca09feab5cf54011407179c6cd599","observation_id":"d432b36f-4424-4a5d-8c45-9d9b2e0d1836","resolution":{"observed_at":"2026-08-16T10:40:41.291590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.294883Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.294883Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:9063acb3e6123e9a80adfc587d924cb631f94675cc17bb0dea6236ee8d869033","observation_id":"3a927f67-41f4-4fa7-8444-35e0955946f0","resolution":{"observed_at":"2026-08-16T10:40:41.294883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.298217Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.298217Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:8fc729ff0ae35cd57d347dd9a871938f1ad8e1dce45abc3cdcaeb1435d9d4f38","observation_id":"bca7e5ea-c03c-45aa-a36b-d5e6b25e114e","resolution":{"observed_at":"2026-08-16T10:40:41.298217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.301514Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.301514Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:d18d526c8194f05ad431c31e183f5fc756cc370e06086249a5946496f3f0b95f","observation_id":"26f0af2e-4321-4910-88d9-3a0999decf2e","resolution":{"observed_at":"2026-08-16T10:40:41.301514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.247299Z","title":null,"venue":null,"work_id":"d53acc96-5fe9-4513-ad66-13425ac5b774","year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.304691Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:d39d4f0e1a5b6c2dec588f1a4aa077054769b38f2117a94c0cdc58fcab8db1c7","observation_id":"e0122b30-5efd-4c96-9e15-78891a15c4ab","resolution":{"observed_at":"2026-08-16T10:40:44.250786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.287985Z","title":"In 2022 IEEE Hot Chips 34 Symposium (HCS)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.287985Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:d784c8a524450e59f2e8b94d3187b2b3448380016428465bec8312882a84f19f","observation_id":"fdfdbefa-ded9-4739-85ad-e71b0b74bfd6","resolution":{"observed_at":"2026-08-16T10:40:41.287985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04466","last_updated":"2025-06-13T12:20:54Z","snapshot_observed_at":"2026-08-18T03:27:30.778322Z","submitted_at":"2024-10-06T12:42:04Z","title":"Large Language Model Inference Acceleration: A Comprehensive Hardware Perspective","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04466","snapshot_observed_at":"2026-08-16T10:40:41.315536Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.315536Z"},"links":{"cited_paper":"/paper/2410.04466","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:5093c78e2a853eca9b5d36ce5dab036c9937b1a07ae86d7a9e92d35aac8a6569","observation_id":"30e4bf4a-5f76-4169-9ef4-3a866363e3d4","resolution":{"observed_at":"2026-08-16T10:40:41.315536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.319315Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.319315Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:24f2332ad6b6af453d3bfeb6203ac4b6cd2a75feae869379060bfd79dcd9c51b","observation_id":"bc584aa1-1c1c-48b6-8707-f3f92c5a67e5","resolution":{"observed_at":"2026-08-16T10:40:41.319315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.323146Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.323146Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:ab35653ea7e072d8b1226cb0eae39137ddcaf5b0a2e52fc3f0cfb78261235c92","observation_id":"e1c4d494-e2f3-45f4-815f-602d32c75c1f","resolution":{"observed_at":"2026-08-16T10:40:41.323146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.326350Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.326350Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:52005d354a8274acf0551045570fad990929b8df5f2f58ff9dbefb5d5f24606c","observation_id":"ee7f9808-e957-4381-904e-96ace3aae847","resolution":{"observed_at":"2026-08-16T10:40:41.326350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.308401Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.308401Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:50a92334c2b810d27c79707d93b38d402ef663de7005ae74a5854452b057aadc","observation_id":"39e2c0db-a73e-4baa-b2ff-befb02dd1f58","resolution":{"observed_at":"2026-08-16T10:40:41.308401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.335988Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.335988Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4e3c63eb16d86f5d6a5bd5cf17cc196570108e732b5762d41d5b291e40587bdc","observation_id":"fb4e96dd-37e9-408a-a623-058cfdb44d6f","resolution":{"observed_at":"2026-08-16T10:40:41.335988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.339767Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.339767Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:f15b710e82fd5c5379ddf87b2d557953aaa0dcdf43da4dba6677ad3f361ef478","observation_id":"c6d3ca00-80fa-4e5c-8f05-a5458fc40c8b","resolution":{"observed_at":"2026-08-16T10:40:41.339767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.342546Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.342546Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:f1ff1770d5c1e289360ebe45dc67d984578aa4fc95d9ac357744c7b282cad526","observation_id":"046b5818-09e8-428a-a0e6-88639140691b","resolution":{"observed_at":"2026-08-16T10:40:41.342546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.346434Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.346434Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:e9fd79d6035d31a2e90eea863c724bf12114b4950f48f6a891694cd9c25bf9f5","observation_id":"6ac0f3db-4355-4dc3-9235-292aff7a8abc","resolution":{"observed_at":"2026-08-16T10:40:41.346434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.350161Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.350161Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:c9bd078d98397456ce990bdd5ef46767374ecae10bf7a96b5e38d50684b3d250","observation_id":"88446b08-4a17-464a-8c6b-c8431bd2cc20","resolution":{"observed_at":"2026-08-16T10:40:41.350161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.353550Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.353550Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:7af37289480a447d8c85edb31cc355305b7c6213a42cc7d1432073ca54239689","observation_id":"a0136a77-ab50-4dfa-83d5-a29c68d6ffc4","resolution":{"observed_at":"2026-08-16T10:40:41.353550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16963","last_updated":"2025-02-24T08:41:19Z","snapshot_observed_at":"2026-08-19T08:24:54.252313Z","submitted_at":"2025-02-24T08:41:19Z","title":"Make LLM Inference Affordable to Everyone: Augmenting GPU Memory with NDP-DIMM","version":1},"cited_work":{"arxiv_id":"2502.16963","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.16963","snapshot_observed_at":"2026-08-16T10:40:41.944850Z","title":"Make LLM Inference Affordable to Everyone: Augmenting GPU Memory with NDP-DIMM","venue":"cs.AR","work_id":"38b6a29e-3c6d-4455-8db2-6815943a25c0","year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.332585Z"},"links":{"cited_paper":"/paper/2502.16963","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:8b4da699c450e5784d8fefef4239d51408e73c450f85f05a5934fade33b85333","observation_id":"6e9185f7-4878-4c3c-8f86-a46e6358818f","resolution":{"observed_at":"2026-08-16T10:40:41.950822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.360037Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.360037Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:a82cd034a1fc2c282b016053a489a635b31bf43a55b86533c22c60c7cad0018a","observation_id":"8e11c73a-911a-466c-9da8-dab63458a0d8","resolution":{"observed_at":"2026-08-16T10:40:41.360037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.363503Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.363503Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:bdf6ac7edae85856f1014ffd6b37518ce4f87c7843bc3303e2e1a3a4c0dc9554","observation_id":"a23c5ca4-5395-48fb-aaa2-241cb6805290","resolution":{"observed_at":"2026-08-16T10:40:41.363503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.369537Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.369537Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:570f27f6ba55d719c4a119c62599eb12991c6e04230f0d7cd6dd15d5962bc13a","observation_id":"51e8e575-06c0-4c8d-a64b-3bdea628f8a9","resolution":{"observed_at":"2026-08-16T10:40:41.369537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.372683Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.372683Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:58a34f48df9fed470e43f2cdb91678ad284bc6a0a0388892bb0f6104b2b9c107","observation_id":"a53577ec-c2d8-4e24-bc6d-421e4f90355a","resolution":{"observed_at":"2026-08-16T10:40:41.372683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.221022Z","title":null,"venue":null,"work_id":"245fd16b-df8a-4c98-bed3-7fa1a84a1c8a","year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.375344Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:02213f9a27b70b1113f81719f64f9794f281bdf138f481f0968833d305691c7d","observation_id":"bff4c5e6-60f3-4913-97e3-5cb454aa8f2d","resolution":{"observed_at":"2026-08-16T10:40:44.224094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03285","last_updated":"2024-06-05T06:06:43Z","snapshot_observed_at":"2026-08-16T14:45:35.195361Z","submitted_at":"2023-11-06T17:26:17Z","title":"S-LoRA: Serving Thousands of Concurrent LoRA Adapters","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03285","snapshot_observed_at":"2026-08-16T10:40:41.356526Z","title":"Gon- zalez, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.356526Z"},"links":{"cited_paper":"/paper/2311.03285","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:c0a447442ef73fbc1e564e04c88062afefc1b72aa4ee65a18c57c367f80c50f3","observation_id":"19e3bfb4-15a7-473b-9aac-48891f553f15","resolution":{"observed_at":"2026-08-16T10:40:41.356526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-16T16:29:35.500686Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-16T10:40:41.381550Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.381550Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4abdb82a2320803a50a0782cf3f7d4b78ba0d1e0dba79df5bd9feeb58f503c34","observation_id":"4f34390e-18a9-4f6d-bc73-aa2ffef598b5","resolution":{"observed_at":"2026-08-16T10:40:41.381550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.201576Z","title":null,"venue":null,"work_id":"ade15f7a-17bf-42f1-9b6f-2bde7e7c2f23","year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.385503Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4667fd336cdb0f6f2dfd33022a53453887cce699bb68a5eabebfae5747892d39","observation_id":"65d94926-a2eb-4ef5-8155-39fa55fbd6f2","resolution":{"observed_at":"2026-08-16T10:40:44.204752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.191226Z","title":null,"venue":null,"work_id":"5bbee2d8-062d-4e65-a1f0-969cfa926611","year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.388402Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:750a3fcf11d84b97eba361c5abc9fc8d0b3c9573cfb900f693db22d72130c687","observation_id":"4a0a4b18-71ce-4004-b026-ae7692014edd","resolution":{"observed_at":"2026-08-16T10:40:44.194733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.394806Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.394806Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:3a62583127bbe8fae1fcf955d34602696210d9066039ff80186326471a63bd5f","observation_id":"573d63cf-61a4-40b3-833f-0d195fd4f6f2","resolution":{"observed_at":"2026-08-16T10:40:41.394806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.398274Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.398274Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:97e9bd0c1af803bdc9ce8d195c57c45a8c822db763c4bd0e253226c1d342374a","observation_id":"04f95845-5192-4a48-857e-0ef53f021275","resolution":{"observed_at":"2026-08-16T10:40:41.398274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.401543Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.401543Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:5448ea6a50dd6ed3bd8081e31154b828e3de35a72a8ad3100d39ff5b68c215c3","observation_id":"b621d894-6b7a-4ec6-94e8-b8729e8623b0","resolution":{"observed_at":"2026-08-16T10:40:41.401543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:44.211399Z","title":null,"venue":null,"work_id":"705768f2-9abb-4038-8154-e0abfba8e659","year":2022},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.378477Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:2a77016710c6544b8542b50ed51da4f1305f6e1a3019d77a7a89913a25c99765","observation_id":"b03ad3b6-446c-4fc4-8244-605cc7f9da8f","resolution":{"observed_at":"2026-08-16T10:40:44.214621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.391879Z","title":"In 2024 ACM/IEEE 51st Annual International Symposium on Computer Architecture (ISCA)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.391879Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:2cf70bfda1c1a1ac03bcde0fea2292e5ff0377eb450b64992ca028d4334a1fe7","observation_id":"aee43e73-0f4d-45c3-9958-a21b90845932","resolution":{"observed_at":"2026-08-16T10:40:41.391879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-16T10:40:41.404354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.404354Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:0e5836915478c30ffe61206c613308c78ccca56604ff5456dd95f95302f92a8a","observation_id":"f5311479-87fd-4d4d-85e6-4e1ba95306eb","resolution":{"observed_at":"2026-08-16T10:40:41.404354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.184232Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":385,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.184232Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:64e78ccbe85231c8443c47dd73c3e05860350c0911f583f499ace288521ce343","observation_id":"da278b19-43ed-4b53-a46f-62ffa14a40b2","resolution":{"observed_at":"2026-08-16T10:40:41.184232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.105926Z","title":"InThe 49th Annual IEEE/ACM International Symposium on Microarchitecture (Taipei, Taiwan) (MICRO-49)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.105926Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:70e2a5144921ab2bb3c831eaf9244889f39dee3d6186470a96e0d3f37f9ba08a","observation_id":"4c6ce528-544e-45cd-92d7-d5c28c2267a5","resolution":{"observed_at":"2026-08-16T10:40:41.105926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.205640Z","title":"In Proceedings of the 52nd Annual IEEE/ACM International Symposium on Microarchitecture (Columbus, OH, USA) (MICRO ’52)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.205640Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:99062544311daeff3eeebe80d390209dfc1dd88c417cfcb98b0640213309987b","observation_id":"e0ed2b05-e244-457a-a28e-f27beb48e068","resolution":{"observed_at":"2026-08-16T10:40:41.205640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.133592Z","title":"In Proceedings of the 36th International Conference on Neural Informa- tion Processing Systems (New Orleans, LA, USA) (NIPS ’22)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.133592Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:4e9eb62afd5d56689716fef307c788c00f4e7b211924844d04fee6c5ebbb2469","observation_id":"8764124d-b3e7-4e01-af3e-abb4edfa9f98","resolution":{"observed_at":"2026-08-16T10:40:41.133592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:40:41.266616Z","title":"arXiv:2412.20166 [cs.AR] https://arxiv.org/abs/2412.20166","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T10:40:41.266616Z"},"links":{"citing_paper":"/paper/2504.17584"},"observation_digest":"sha256:d7747c1d4e20cccbd83677c9e6b6c2aa36604fb25c4893047439548eaf17cbeb","observation_id":"536b71fe-b495-4ede-b8b4-2da817a7131f","resolution":{"observed_at":"2026-08-16T10:40:41.266616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.17584","last_updated":"2025-04-24T14:14:07Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-17T14:28:11.830719Z","submitted_at":"2025-04-24T14:14:07Z","title":"L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":87,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 1 inbound Pith citation observation for arXiv:2504.17584."}