{"as_of":"2026-08-08T12:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21b96407ab706b645cf912caaf827c6938f0c9b31b5c9faf889e93c54959839b","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T16:35:35.426577Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.12993/citation-record","integrity":"/paper/2509.12993/integrity","json":"/paper/2509.12993/citation-record.json","paper":"/paper/2509.12993"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:29.783859Z","title":"Language Models are Few-shot Learners,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:29.783859Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:6fcb7861e3487f025436e95bcdadc247667c210045704012c1a6bdd3806cee07","observation_id":"55e3c3f3-6dde-4b1f-bca1-8531a485b9af","resolution":{"observed_at":"2026-08-04T16:35:29.783859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:29.879160Z","title":"Language Models are Unsupervised Multitask Learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:29.879160Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:0718f6be99ff75fe6f0e325d4b5ac461816ea8f03823c3b6b61a3ad6824155ca","observation_id":"539b469b-dec8-4352-9cd3-702931516b18","resolution":{"observed_at":"2026-08-04T16:35:29.879160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T16:35:29.975362Z","title":"The Llama 3 Herd of Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:29.975362Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:7f9f9330ad92790dee1617df7b4435f2ae6f1e04ec52a1be23393df5a8a2790b","observation_id":"0f7029b4-940b-4fc8-9ed3-c07f0608e51d","resolution":{"observed_at":"2026-08-04T16:35:29.975362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T16:35:30.185854Z","title":"LLaMA: Open and Efficient Foundation Language Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:30.185854Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:c5dda4009b95bbf141ac48e241324eef429c588d9512f4a58181e5f3efceb636","observation_id":"d9298850-d00c-4b54-ab18-14baab848e01","resolution":{"observed_at":"2026-08-04T16:35:30.185854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-04T16:35:30.323850Z","title":"LLAMA 2: Open Foundation and Fine-Tuned Chat Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:30.323850Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:a779c8a9c1f2957814a7228e155428d9a8f61e90f8bd22a90398420378c7ca7d","observation_id":"c394fa82-02fb-4b67-b908-f2a6ee150e78","resolution":{"observed_at":"2026-08-04T16:35:30.323850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:30.489832Z","title":"Gorilla: Large Language Model Connected with Massive APIs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:30.489832Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:3add0311daea45a46083cc6570ef79ed81c6f169d3130879f9e018856fa55138","observation_id":"0acf7df9-42e4-4e87-868d-846a56fa17ef","resolution":{"observed_at":"2026-08-04T16:35:30.489832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:30.636940Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:30.636940Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:3a41c9726d77208bf2c3bfb63e34fb6c71a51daeb91c420f88d618f348a8cb4e","observation_id":"96419213-16d0-49cb-8a47-00f387981659","resolution":{"observed_at":"2026-08-04T16:35:30.636940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:30.762787Z","title":"FlashAt- tention: Fast and Memory-Efficient Exact Attention with IO- Awareness,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:30.762787Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:b96346c42fdf4d0579ae31ed1c481cfaadc23a60d23dbbc6f7e9a9fe15679f1d","observation_id":"11d50650-9c76-4c78-a20b-16dd986c319a","resolution":{"observed_at":"2026-08-04T16:35:30.762787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:30.968441Z","title":"CodeGen: An Open Large Lan- guage Model for Code with Multi-Turn Program Synthesis,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:30.968441Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:73181ba803bd151e8770a2fc6c0b18be02a39343a7c81675ef27e1457a0569dd","observation_id":"a324c9d2-589b-4e43-a641-95bbad295abb","resolution":{"observed_at":"2026-08-04T16:35:30.968441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:31.116711Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:31.116711Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:41a3119c40ae89b0b9edb01760c65a1a91f56a8738375f0c821a7863dcadef6b","observation_id":"bc7bea0c-9fbf-4911-9150-2fe4a0190830","resolution":{"observed_at":"2026-08-04T16:35:31.116711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:31.255235Z","title":"Au- toCodeRover: Autonomous Program Improvement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:31.255235Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:065d18891c21b40ffdaf3dc9903cf5e0892103cb6b1cef8eaaa3b0639f755c15","observation_id":"9df8fc92-8400-49a5-81f6-daa3467cd030","resolution":{"observed_at":"2026-08-04T16:35:31.255235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:31.455325Z","title":"A 28nm 74.34 TFLOPS/W BF16 Heterogenous CIM-Based Accelerator Exploiting Denoising- Similarity for Diffusion Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:31.455325Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:7ad2f97f609de789ee019508359fa88c8b3217cb258559a6e525daeb26dfc102","observation_id":"39e34a5a-4ed9-40ae-910d-d5b796719652","resolution":{"observed_at":"2026-08-04T16:35:31.455325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:31.558636Z","title":"SHMT: An SRAM and HBM Hybrid Computing-in-Memory Architec- ture With Optimized KV Cache for Multimodal Transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:31.558636Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:76e6db44bc0eb8608126aedba27f49c06d40460e06beff4c8ffd0a2aa0728237","observation_id":"c1dc6e1f-9b81-4eda-92cb-ba60dea9fa9a","resolution":{"observed_at":"2026-08-04T16:35:31.558636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:31.722495Z","title":"DDC-PIM: Efficient Algorithm/Architecture Co-Design for Doubling Data Capac- ity of SRAM-based Processing-in-Memory,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:31.722495Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:c82d69f786156f5a75af3f3eba1352bbbe514b7c7ddf3c6ebd38eb7a09d8eb98","observation_id":"ca90df65-b5a4-4841-a626-3537493b4995","resolution":{"observed_at":"2026-08-04T16:35:31.722495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:31.813997Z","title":"Towards Efficient SRAM- PIM Architecture Design by Exploiting Unstructured Bit-Level Sparsity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:31.813997Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:f968ff3f11fe69db653ee6e29f362d009bac1cc2f6d29d8a52b483e7228471dd","observation_id":"09e720b3-298a-4319-9a34-fba5c0afd4a4","resolution":{"observed_at":"2026-08-04T16:35:31.813997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:31.902969Z","title":"CIMFlow: An Integrated Framework for Systematic Design and Evaluation of Digital CIM Architec- tures,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:31.902969Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:33accca580acd280151e8c2f4507cacaae4e43ad58eb8e437893a42efb1ba6f8","observation_id":"43e68926-0808-4416-b839-4ee73c70d1af","resolution":{"observed_at":"2026-08-04T16:35:31.902969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:32.044140Z","title":"APIM: An Antiferromagnetic MRAM-Based Processing-In-Memory System for Efficient Bit-Level Opera- tions of Quantized Convolutional Neural Networks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:32.044140Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:8ea6e316f607d90241cefa307e30bcfa9b2ad7bb9a7205ae029e8b47f53f6153","observation_id":"f23560e2-06fa-4315-a431-acea52597587","resolution":{"observed_at":"2026-08-04T16:35:32.044140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:32.153878Z","title":"TensorCIM: A 28nm 3.7 nJ/Gather and 8.3 TFLOPS/W FP32 Digital-CIM Tensor Processor for MCM-CIM-Based Beyond- NN Acceleration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:32.153878Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:3630452a2522f8b6c52a517cb44b1daa1f64c88f015e6d7a212846d260aefa2f","observation_id":"6f4aca76-0d1e-4c24-a842-284dd8172c52","resolution":{"observed_at":"2026-08-04T16:35:32.153878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:32.348498Z","title":"P 3ViT: A CIM-Based High-Utilization Architecture With Dynamic Pruning and Two-Way Ping-Pong Macro for Vision Transformer,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:32.348498Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:51b7ad35f722c44e372e87a2a1ba9d81c20063ba2fdf542cf65aad2d93d4250a","observation_id":"3b0f795f-6e35-4962-8eb1-bad3115eee24","resolution":{"observed_at":"2026-08-04T16:35:32.348498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:32.526309Z","title":"PAPI: Exploiting Dynamic Parallelism in Large Language Model Decoding with a Processing-In-Memory-Enabled Computing System,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:32.526309Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:530c7aac64107763d30c699206d588571aaf3998c435e3aa3c777ad3acdec3b4","observation_id":"d709bead-196e-4ad3-aca5-e18159443b7d","resolution":{"observed_at":"2026-08-04T16:35:32.526309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:32.682558Z","title":"SpecPIM: Accelerating Speculative Inference on PIM-Enabled System via Architecture-Dataflow Co-Exploration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:32.682558Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:812c63b1475659a9dac5a6f37aff3b2ce73b71daaecbc9aa64bee7b418e16b18","observation_id":"8165e141-110a-40e2-980e-22fa7c866f33","resolution":{"observed_at":"2026-08-04T16:35:32.682558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:32.835843Z","title":"An LPDDR-based CXL- PNM Platform for TCO-efficient Inference of Transformer- based Large Language Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:32.835843Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:0289f58e59f5479419bc9ee67e6c3a8fc8541d2d2a44008289ab275c36c561df","observation_id":"2e67c3a8-1591-4ab6-b2d0-5dd8efeeda6b","resolution":{"observed_at":"2026-08-04T16:35:32.835843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:32.979354Z","title":"Samsung PIM/PNM for Transfmer Based AI: Energy Efficiency on PIM/PNM Cluster,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:32.979354Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:da91384f1d44630eef122d1525acd126e4f7581cea88a5b9bd4a3d052c196cce","observation_id":"1330221f-2ec0-4232-b915-5185dd7bb2ed","resolution":{"observed_at":"2026-08-04T16:35:32.979354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:33.110041Z","title":"3D-FPIM: An Extreme Energy-Efficient DNN Acceleration System Using 3D NAND Flash-Based In- Situ PIM Unit,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:33.110041Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:95a2a2431b28b486591e777723498c1f5eacca80d6c064db117b3cb049b9f5d6","observation_id":"a4b6f34b-8a53-4b68-b480-dd6378257666","resolution":{"observed_at":"2026-08-04T16:35:33.110041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:33.312729Z","title":"S- FLASH: A NAND Flash-Based Deep Neural Network Acceler- ator Exploiting Bit-Level Sparsity,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:33.312729Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:37ff89d8ca795ba8f7daeb84dbbc64cf33ec4f4f60bb43312f2a630daf0ee082","observation_id":"c5eb2248-28d9-45d4-a2fc-2bc76717baa8","resolution":{"observed_at":"2026-08-04T16:35:33.312729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:33.506814Z","title":"Attention is All You Need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:33.506814Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:f1a6fdc3c4baefe4be1928fb30db84c6f629eeccf90fefa9664844955ac3d5d6","observation_id":"01172cf3-0b92-4b00-845e-a4dd9035b37b","resolution":{"observed_at":"2026-08-04T16:35:33.506814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:33.624563Z","title":"Deepspeed: System Optimizations Enable Training Deep Learning Models with Over 100 Billion Parameters,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:33.624563Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:08a3df1d5e8226f2aaac559ae7b696e14b9e25033cf7653d07fdd22682cd1311","observation_id":"1f9b910a-d679-40c1-8a37-5ee456650718","resolution":{"observed_at":"2026-08-04T16:35:33.624563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:33.759682Z","title":"DeepSpeed-Inference: Enabling Efficient Inference of Trans- former Models at Unprecedented Scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:33.759682Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:0e2dae03e2ae18557a7d26d065302345667d69f049cb433d69ec6e57bb589afa","observation_id":"5111c646-bd43-44ea-92d3-22169b5cf35d","resolution":{"observed_at":"2026-08-04T16:35:33.759682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-01T22:52:35.092898Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-08-04T16:35:33.896184Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:33.896184Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:d0b49017d887324360c41e2b65876139de4d85f6a8413b81bb932a428d78cce3","observation_id":"56688505-a8b2-4bcc-9b9b-e778f36b9c4e","resolution":{"observed_at":"2026-08-04T16:35:33.896184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:33.993870Z","title":"NeuPIMs: NPU-PIM Heterogeneous Acceleration for Batched LLM Inferencing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:33.993870Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:7664a5091e957f3741bee37472c0fc61c7a7a3221d4f0d9dd187e5a1425c2f88","observation_id":"db60f078-4690-430c-ab28-11ab198a8403","resolution":{"observed_at":"2026-08-04T16:35:33.993870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:34.198323Z","title":"AttAcc! Unleashing the Power of PIM for Batched Transformer-based Generative Model Inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:34.198323Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:823861aa72c520c4b8cb91fa0876aa92161ce71939b8676c9489bda80f0e720d","observation_id":"da08b751-8300-4cf5-8f0a-ff638df022e2","resolution":{"observed_at":"2026-08-04T16:35:34.198323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:34.395525Z","title":"TransPIM: A Memory-based Acceleration via Software-Hardware Co-Design for Transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:34.395525Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:a05b0aeceecdcf557851bd35a6f993bee9f1fff9bfadae68c791704e8235dffd","observation_id":"424c1670-4686-4c76-b120-3ae9d2ba89f1","resolution":{"observed_at":"2026-08-04T16:35:34.395525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:34.512136Z","title":"IANUS: Integrated Accelerator based on NPU-PIM Unified Memory System,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:34.512136Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:4bf9b8d8bb3602ea821c148679f91ada3c0e1af43e44463c93f5bdd5c608b75d","observation_id":"bad27cd6-f250-470f-a59d-2d355d1644ca","resolution":{"observed_at":"2026-08-04T16:35:34.512136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:34.703201Z","title":"Cambricon-LLM: A Chiplet- Based Hybrid Architecture for On-Device Lnference of 70B LLM,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:34.703201Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:0a93d8406e414abce377578226d44e31861335533978b47560145b8a2ee81dce","observation_id":"021fe882-f553-4575-918e-a616a790ba24","resolution":{"observed_at":"2026-08-04T16:35:34.703201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:34.875866Z","title":"Newton: A DRAM-maker’s Accelerator-in-Memory (AiM) Architecture for Machine Learn- ing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:34.875866Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:bed41cb28015d9f99161405b1b5d145457bbcc42b4dd49585372546093311fa6","observation_id":"8015d819-f95c-4fc1-8666-5b0c48c64001","resolution":{"observed_at":"2026-08-04T16:35:34.875866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-04T16:35:35.054410Z","title":"OPT: Open Pre-trained Trans- former Language Models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:35.054410Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:f76b272afbe07c90a75fbacae363a3db2397478b2764517d9e72402a15590506","observation_id":"36fa493c-0c0a-4a70-a32e-12a051198d4b","resolution":{"observed_at":"2026-08-04T16:35:35.054410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-04T16:35:35.202801Z","title":"Hugging- Face’s Transformers: State-of-the-art Natural Language Process- ing,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:35.202801Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:946656f26316247a6c5562673879e43262c37f40d2fe5fe7b25aa6169ddd86c3","observation_id":"0c2f1230-647b-4771-b556-c5290196b8c8","resolution":{"observed_at":"2026-08-04T16:35:35.202801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:35.322780Z","title":"DRAM- sim3: A Cycle-Accurate, Thermal-Capable DRAM Simulator,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:35.322780Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:6ac776b23fb1811c3ac6f403d7eaf9683cb77a38af223a68a67d449bdb60ee65","observation_id":"b10845d5-da08-4f4e-8865-d15d589abb9b","resolution":{"observed_at":"2026-08-04T16:35:35.322780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T16:35:35.426577Z","title":"High Bandwidth Memory DRAM (HBM3),","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T16:35:35.426577Z"},"links":{"citing_paper":"/paper/2509.12993"},"observation_digest":"sha256:a015fe1811f8077de91ca143a4eb7492980f1e6c3f5371789e010db0f20c61cd","observation_id":"74fdb4bd-decf-4125-9733-0993a1020a45","resolution":{"observed_at":"2026-08-04T16:35:35.426577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.12993","last_updated":"2026-07-03T09:21:53Z","latest_version":3,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-04T16:35:28.483412Z","submitted_at":"2025-09-16T12:04:00Z","title":"HPIM: Heterogeneous Processing-In-Memory-based Accelerator for Large Language Models Inference"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2509.12993."}