{"as_of":"2026-08-18T21:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0bb5167f082d51cd3d87cf9c97d8e8ade31679f723bf52190dca06c8777ec7d9","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:41:52.507073Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-12T11:19:44.400939Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T09:04:32.877338Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2504.14893","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14893","snapshot_observed_at":"2026-06-30T09:04:32.877338Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference,","venue":null,"work_id":"875c3442-8bff-4363-97c2-58e8e592a2fe","year":2025},"citing_paper":{"arxiv_id":"2606.28754","last_updated":"2026-07-06T08:22:51Z","snapshot_observed_at":"2026-07-12T11:19:43.619026Z","submitted_at":"2026-06-27T06:02:23Z","title":"SHIFT: Dynamic Compute Relocation Framework for Communication-Aware Chiplet-Based Systems","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-30T08:57:23.580353Z"},"links":{"cited_paper":"/paper/2504.14893","citing_paper":"/paper/2606.28754"},"observation_digest":"sha256:17a8576a3181f2cfd320407ec4a183ebd7bfdd813a0f885fb0099843d4020182","observation_id":"b098b778-b34f-41f5-8ebc-065634551baf","resolution":{"observed_at":"2026-06-30T09:04:32.878727Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14893","snapshot_observed_at":"2026-07-12T11:19:44.400939Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.28754","last_updated":"2026-07-06T08:22:51Z","snapshot_observed_at":"2026-07-12T11:19:43.619026Z","submitted_at":"2026-06-27T06:02:23Z","title":"SHIFT: Dynamic Compute Relocation Framework for Communication-Aware Chiplet-Based Systems","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-12T11:19:44.400939Z"},"links":{"cited_paper":"/paper/2504.14893","citing_paper":"/paper/2606.28754"},"observation_digest":"sha256:574d215d1942d8f82d6703190bf4d3b8085c346cf49cc38c7a93333e820f2b64","observation_id":"b214aa48-08ee-4fc9-986b-fe1b33d499fe","resolution":{"observed_at":"2026-07-12T11:19:44.400939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.14893/citation-record","integrity":"/paper/2504.14893/integrity","json":"/paper/2504.14893/citation-record.json","paper":"/paper/2504.14893"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.11514","last_updated":"2024-07-30T23:37:20Z","snapshot_observed_at":"2026-08-18T05:43:52.396323Z","submitted_at":"2023-12-12T18:57:08Z","title":"LLM in a flash: Efficient Large Language Model Inference with Limited Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11514","snapshot_observed_at":"2026-08-16T11:41:52.244879Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.244879Z"},"links":{"cited_paper":"/paper/2312.11514","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:4d422eb11704ae3e07ef12a6c66dbaa191f26e8768ba55166fb984819a0b59f7","observation_id":"afb9372d-a947-4da3-8b20-7fcb5ffb5e5d","resolution":{"observed_at":"2026-08-16T11:41:52.244879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.250854Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.250854Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:a2b646d659d5ab03b4c376cad66513fc4614f76b72603de4d0296c85762a41ea","observation_id":"25420201-a64a-421f-a9e6-7ac624216de3","resolution":{"observed_at":"2026-08-16T11:41:52.250854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-16T11:41:52.256079Z","title":"Dai, Orhan Firat, Melvin Johnson, Dmitry Lepikhin, Alexandre Passos, Siamak Shakeri, Emanuel Taropa, Paige Bailey, Zhifeng Chen, et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.256079Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:b763b1ec0a4f549102f0137fc3b0f668ad7cad475e898e0af4a3f01056b685c6","observation_id":"0c0fad3f-6ad7-485b-93eb-efa57971e10f","resolution":{"observed_at":"2026-08-16T11:41:52.256079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.550435Z","title":null,"venue":null,"work_id":"a45c3691-cbde-4762-b451-d582caaeccad","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.261415Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:61fd3fd22d63214c836d8eeeedef164536cf73fd336c95468a4d29c413611b02","observation_id":"e0c02288-5aa3-457d-bda0-7ec32986b5b0","resolution":{"observed_at":"2026-08-16T11:41:53.555263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.533516Z","title":null,"venue":null,"work_id":"b464674e-603a-4acd-ae2a-6af0974dbcc6","year":2020},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.266493Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:1fd022090ed5f1a55e14abe65105c7aeb0d269f5ba4976e9c385078d1e70ae66","observation_id":"e9a705eb-836d-491f-980f-40d8c32f28fc","resolution":{"observed_at":"2026-08-16T11:41:53.539235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.518006Z","title":null,"venue":null,"work_id":"580ceeeb-06c7-4646-8236-ebe679864403","year":2016},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.271426Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:e4e8d876cd264245bca6edd100660139a2599ecb6e2f6abfa2a80eee73af96f1","observation_id":"65e0f988-27b0-405c-9cf5-b3777505ac1f","resolution":{"observed_at":"2026-08-16T11:41:53.522922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-16T11:41:52.276774Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.276774Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:a204d5c38712c9055b31c0939c92d23598a42f2b856b59359bfc21ea4ad79559","observation_id":"12d32b0f-fc37-48f7-a350-977bdece630b","resolution":{"observed_at":"2026-08-16T11:41:52.276774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.281716Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.281716Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:bfe4589776c16dad6f1f6b2f78b587c084debf111148d7440b1dfab50c9e1040","observation_id":"65b85384-19a6-4901-a3c0-cb3b8c3eecb4","resolution":{"observed_at":"2026-08-16T11:41:52.281716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.480640Z","title":null,"venue":null,"work_id":"b961ee79-50e5-4cbf-8db9-f741a321aa80","year":2017},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.291234Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:058645bceee0733e13e5eeb267ec2e3240924edb070c6a259460cb6464c990f1","observation_id":"8b240510-4447-4595-b884-8704f9467fed","resolution":{"observed_at":"2026-08-16T11:41:53.485632Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.463410Z","title":null,"venue":null,"work_id":"4e2fa05b-c768-4795-b642-2952d998db19","year":2019},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.296139Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:e9146869c3a5b338454ab5c9b20675de4846b2a67d3eaa31e1b8ce04114d74d0","observation_id":"7a6670a5-aff1-40ec-97a9-9c1aaf48cf1b","resolution":{"observed_at":"2026-08-16T11:41:53.468977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.446280Z","title":null,"venue":null,"work_id":"88890f0e-30bf-479c-b459-95d71d83832f","year":2018},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.300713Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:2df7d1ca6a5a48f2a6b8b3ec003cf70ea1baf96000d65b620a5d2524ba27f843","observation_id":"a60d5985-8ce2-44a9-8156-4ce29473668a","resolution":{"observed_at":"2026-08-16T11:41:53.451257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-16T11:41:52.305199Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.305199Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:3b116a0de2ec74f10864a990c91564254ef87b5cec749cd91a5c4af86675f44a","observation_id":"71f2af5d-1ed2-4c1a-8a8b-5e0bc8619502","resolution":{"observed_at":"2026-08-16T11:41:52.305199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.430415Z","title":null,"venue":null,"work_id":"260c876c-7832-4bfa-b237-4b8f8b1be3fe","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.309897Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:f8da2994fc113868616c3e993a79b7868dadbb5c69e2eb392bd162d0bbec9821","observation_id":"364c1367-9a13-4f74-9668-97bf840d9939","resolution":{"observed_at":"2026-08-16T11:41:53.435155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-16T11:41:52.314420Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.314420Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:898b22a51071505dd2a61dbe989d931b631ea8d5d9e784512d4df890d8739b00","observation_id":"d8ab2947-d9b0-4a3b-ad5b-fb94879b8e8a","resolution":{"observed_at":"2026-08-16T11:41:52.314420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.413629Z","title":null,"venue":null,"work_id":"1d7d0620-06ae-4275-827e-fecbc1d74a09","year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.319246Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:c663edec3eb4c38f5192ee68e19754faf21da9d46d9e503d83037fa0bd3243fc","observation_id":"a1826bd4-3571-4e99-8665-919f15406bb0","resolution":{"observed_at":"2026-08-16T11:41:53.418777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.396993Z","title":null,"venue":null,"work_id":"d485b686-3ddb-41b3-a597-dfb163abc9cd","year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.323652Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:0281bea2d7894dec8e91d22e76b1e4bb92e672f105f586bffa5b22f04a02108a","observation_id":"b90cf049-cd75-4898-baf2-595e6d8f8e1b","resolution":{"observed_at":"2026-08-16T11:41:53.402555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.381199Z","title":null,"venue":null,"work_id":"9fed50fe-bd96-4ec9-b2ef-aceafa78c96d","year":2020},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.328125Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:6361fd238469dcbeedb0f704e78a730fa0b6a04806df8f8367d6415484a3c274","observation_id":"e440a1f2-5c3e-4982-911d-0d9cce4914e1","resolution":{"observed_at":"2026-08-16T11:41:53.386040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.333018Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.333018Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:d6c7d24425eb3f00fdcd4e96e12086edd79fb7a81eebb71437021f072d552881","observation_id":"8dae34ab-fd8e-4523-8f3b-4c6486117cb7","resolution":{"observed_at":"2026-08-16T11:41:52.333018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.337625Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.337625Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:b48e9f3585dfbab6594e69c195cc286cf0d308c53eec4a31b1b373e909d7e9f4","observation_id":"331541bc-208f-47d0-9187-75089f513cdf","resolution":{"observed_at":"2026-08-16T11:41:52.337625Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.355834Z","title":null,"venue":null,"work_id":"06b179bb-2462-4d58-92d6-87b485ae169a","year":2017},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.341916Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:ddbe34a919ea9939e6429abeee881291ab6587c2adfc3754f87e43cde77a0d44","observation_id":"49fee697-66ee-496d-a53e-0735d3c4f0a9","resolution":{"observed_at":"2026-08-16T11:41:53.360612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.339879Z","title":null,"venue":null,"work_id":"c7ac13ee-df4c-4889-86da-994751dbfb81","year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.346443Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:f9a2a7abd114ade67c4f818dae8d2f25df23758874ca9df4d2524d674648c4dd","observation_id":"860b130e-7b5c-4f49-bd58-813c9eaac801","resolution":{"observed_at":"2026-08-16T11:41:53.344799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.350911Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.350911Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:1b2a25d7adc66102293532ec93f9314c2fa246d0bc42b5c3024d676efcbe810c","observation_id":"ae84309e-124b-415a-acec-4ee73e52a474","resolution":{"observed_at":"2026-08-16T11:41:52.350911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.313592Z","title":null,"venue":null,"work_id":"1b8ce243-51eb-43a7-8a6c-120b0090558e","year":2019},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.355449Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:d951051ac8401c90a1240796d99a7563b861f41b5a2574d740d6838f9052dfcb","observation_id":"13d8ceb6-eefc-473b-ae1f-d2b94ab7765f","resolution":{"observed_at":"2026-08-16T11:41:53.318371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.360161Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.360161Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:cafc766dbc03e498a76a3afabe83e69a51e8a82529633156726ab8678cc43346","observation_id":"dac3a8c7-81a7-496b-86d9-80315a7148b5","resolution":{"observed_at":"2026-08-16T11:41:52.360161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.286713Z","title":null,"venue":null,"work_id":"645b2105-5b76-4d82-9de2-58ae7ad70913","year":2021},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.369546Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:5f2b0bd8760dc1917f017ac9d71577cfce9d04fa92a4b76db0e3bddc50c5cf69","observation_id":"4326203b-f4d5-4e64-88ce-81f45406cf45","resolution":{"observed_at":"2026-08-16T11:41:53.291721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.269293Z","title":null,"venue":null,"work_id":"d2869705-3a5f-463f-ae2c-bae087af0111","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.373882Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:a7c900216ac15c8dcc34ab0a41741e36e64ebd91e551acd041fb092542fa7135","observation_id":"34ee4ab8-87fe-4857-bb09-14f2fa115950","resolution":{"observed_at":"2026-08-16T11:41:53.276481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03294","last_updated":"2024-03-31T21:11:08Z","snapshot_observed_at":"2026-08-16T14:54:55.175376Z","submitted_at":"2023-10-05T03:47:57Z","title":"DISTFLASHATTN: Distributed Memory-efficient Attention for Long-context LLMs Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03294","snapshot_observed_at":"2026-08-16T11:41:52.378079Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.378079Z"},"links":{"cited_paper":"/paper/2310.03294","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:3c16f617b3db3527908d18fab88dfd85b557032d44f71516cc91dfa4854f4ed2","observation_id":"39ce444c-fad4-4d95-93f5-da367e68217b","resolution":{"observed_at":"2026-08-16T11:41:52.378079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.13120","last_updated":"2022-05-21T06:03:54Z","snapshot_observed_at":"2026-08-16T18:22:05.145735Z","submitted_at":"2021-05-26T13:40:58Z","title":"Sequence Parallelism: Long Sequence Training from System Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.13120","snapshot_observed_at":"2026-08-16T11:41:52.382649Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.382649Z"},"links":{"cited_paper":"/paper/2105.13120","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:53e64c1e5694894b860e485952d6b039e7179540420df50b3abddda00df65288","observation_id":"f6254f2b-4b05-4c3d-ab9c-5cdff437d306","resolution":{"observed_at":"2026-08-16T11:41:52.382649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.253581Z","title":null,"venue":null,"work_id":"581ced59-fe02-4454-bd3c-d8180f5a3759","year":2020},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.387367Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:a509d45b59175081ed61d070a6d7f9621de2c2865935b64437e20071e250081f","observation_id":"01feb4d9-8de6-465f-a004-4fb9c4f693a7","resolution":{"observed_at":"2026-08-16T11:41:53.258819Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.238282Z","title":null,"venue":null,"work_id":"b9652076-934a-4065-975d-36f706bb8d51","year":2006},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.392182Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:0c8448371ade47b4bc1e09bebeb5c6d35f313bc08a5ab3d07add15bf58519911","observation_id":"22c6cca9-11d4-4cb9-b957-771c28d310a4","resolution":{"observed_at":"2026-08-16T11:41:53.243064Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.223293Z","title":null,"venue":null,"work_id":"f5362fc1-a97a-40e0-bb17-ed177921b869","year":2014},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.396556Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:269af8ab28e4343783c9d4994d3d0cc99217ead55a23d4c59dadfbcdc587ddc7","observation_id":"e024eb0a-b627-48aa-8cd6-10c68a9159bc","resolution":{"observed_at":"2026-08-16T11:41:53.227805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.207650Z","title":null,"venue":null,"work_id":"c4f2067f-941d-4fbe-b5cc-7249da047417","year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.401256Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:ccf5d3c45a5731d87dddd04cdd9ca883a540ee0735dbe4d5c85d3f842e423896","observation_id":"e8b10e17-8d91-4a25-8e35-2770a9796fb7","resolution":{"observed_at":"2026-08-16T11:41:53.212587Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.191651Z","title":null,"venue":null,"work_id":"536d9c9d-a086-4c90-a6b9-8b45afc065cd","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.405972Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:4e8e4e3a1da98be709a4c6b62465df07738aa79fc8d6a1d2f0d9b27f5b7579ad","observation_id":"7575f573-f383-4909-89e1-8d00ecdbc9e2","resolution":{"observed_at":"2026-08-16T11:41:53.196382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T11:41:52.410642Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.410642Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:f19ae7c055960c3ee3af8eda84f1e83bab265cdb70e2f74cb05bffc7a16f7839","observation_id":"f03d16a4-871f-45bb-aa6f-1ecd7d1770b7","resolution":{"observed_at":"2026-08-16T11:41:52.410642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.175017Z","title":null,"venue":null,"work_id":"ed4375df-1872-487d-8a49-f87f64356b60","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.415357Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:8fb316b17850f7dda86349c024cd0ebb493d6f2d085f0b88cb47b7df58a46c50","observation_id":"9de54a1b-47c2-4f2e-afb8-4d4f58652fc9","resolution":{"observed_at":"2026-08-16T11:41:53.180348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.158430Z","title":null,"venue":null,"work_id":"8b086fcd-f39a-4d3a-965b-0736483c6953","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.420220Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:3774c8918545ab6b6301f45f1127c2155a589711d5d20fe735a9a53c8c529740","observation_id":"699c7137-9632-4ba6-8a89-722f96514b67","resolution":{"observed_at":"2026-08-16T11:41:53.163045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.143334Z","title":null,"venue":null,"work_id":"124c739b-861f-4d33-a12a-e9d3317c00bb","year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.424947Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:355cde316a35ea57628e2ae607798523f3ec3559fa9ade5f8249dca4f927f45e","observation_id":"0fe05b47-d697-4907-87c4-6373bc90dc98","resolution":{"observed_at":"2026-08-16T11:41:53.147832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04437","last_updated":"2025-01-29T04:10:41Z","snapshot_observed_at":"2026-08-18T11:18:23.884084Z","submitted_at":"2024-05-07T16:00:32Z","title":"vAttention: Dynamic Memory Management for Serving LLMs without PagedAttention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04437","snapshot_observed_at":"2026-08-16T11:41:52.429599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.429599Z"},"links":{"cited_paper":"/paper/2405.04437","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:5925dbe6d33402e653aba8bf3f47ac8ad7b30c3cb5c9c12ef70092b89430d672","observation_id":"19100b76-fc1d-437f-9237-a407e8affcd4","resolution":{"observed_at":"2026-08-16T11:41:52.429599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.127580Z","title":null,"venue":null,"work_id":"f0def035-deb7-4c37-a22f-fb88b2890116","year":2016},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.434392Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:71bfa9ac6ce7ccb7c02eb431119a6e0fb8cb21229b03d751a7fab9a21a042a2c","observation_id":"52d1a943-c91f-40d2-a3ed-e66844aa793d","resolution":{"observed_at":"2026-08-16T11:41:53.132663Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-16T11:41:52.439103Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.439103Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:2dbf6805b866e19aa0510093353db51aa8c6718f3e2a0dd124597c59fcc56bff","observation_id":"3c8f53ed-6708-408d-b14c-ca659182e156","resolution":{"observed_at":"2026-08-16T11:41:52.439103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.111708Z","title":null,"venue":null,"work_id":"0b2c2919-3eac-4dc4-9850-087966b1d661","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.444286Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:3ed642210a23c5b63e8b398d6af134b55993411cfeccce63234e490088650f73","observation_id":"ca2ed4e0-3cc8-4d8e-9269-90e67aff60ca","resolution":{"observed_at":"2026-08-16T11:41:53.116695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.095816Z","title":null,"venue":null,"work_id":"2025c99c-e7ea-45c1-9e31-6cf7df067a3b","year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.448888Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:98bec780976aad17f11df7adda687f62151f26b7d20ba12a7c18fca2ef5b4584","observation_id":"cd47bfb8-553a-456b-a4be-16b38d0eb7b5","resolution":{"observed_at":"2026-08-16T11:41:53.100720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-16T11:41:52.453219Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.453219Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:2360c1328abe1ba78f98db36feabc08a57e34b1e4fae51487bceeff629fa7c70","observation_id":"c732348a-c74b-44ea-b092-88778fc5d29d","resolution":{"observed_at":"2026-08-16T11:41:52.453219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.458093Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.458093Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:2fa91dfa4cddb62209d8ac1ffba6e5516e3592c0181b1f471ec92a61e9bbd214","observation_id":"a98dc4b6-b57c-42b0-93dc-cbd79728e100","resolution":{"observed_at":"2026-08-16T11:41:52.458093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T11:41:52.462599Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.462599Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:991f06839f31c647e0e0d24a8293ce61ffd825afdcef9ff350d00ea4b6c662e9","observation_id":"13e065cd-0daa-405e-9225-7a28a8434891","resolution":{"observed_at":"2026-08-16T11:41:52.462599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-16T11:41:52.467703Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.467703Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:de2faad58558ed8ba967edce54f8fab1018e2794fe91e586e799bb99dde572e4","observation_id":"07e24ac5-d29d-4244-9428-3d2ea8120fda","resolution":{"observed_at":"2026-08-16T11:41:52.467703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.068863Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"09f1e732-231a-46c4-abf7-e20a2f8ee692","year":2017},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.472715Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:571771572c28a9a3f32e402dee7f2cd160e937622a390300a924f4c3ddf95ccf","observation_id":"6fdd2666-2115-4a3a-84cb-90eee86a0c8d","resolution":{"observed_at":"2026-08-16T11:41:53.073831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.052080Z","title":null,"venue":null,"work_id":"71186fac-7123-4175-b9f8-8f2ec7a63177","year":2019},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.477368Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:94b0e1a83a7ae4d8d8f850ce4c201498fb80e368121e8b0f815282e40a4c4f52","observation_id":"0e1886ce-26a3-472f-b23b-d06ddff363d9","resolution":{"observed_at":"2026-08-16T11:41:53.057223Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.482370Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.482370Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:33999e734c18221c5a392092470877571619f4b24044ed4a99b9d5e350aea574","observation_id":"7e559fdf-e0eb-493e-922f-eac79a035856","resolution":{"observed_at":"2026-08-16T11:41:52.482370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03868","last_updated":"2024-01-09T06:47:46Z","snapshot_observed_at":"2026-08-17T04:43:59.970614Z","submitted_at":"2024-01-08T13:00:53Z","title":"FlightLLM: Efficient Large Language Model Inference with a Complete Mapping Flow on FPGAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03868","snapshot_observed_at":"2026-08-16T11:41:52.486937Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.486937Z"},"links":{"cited_paper":"/paper/2401.03868","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:57a42f414f27e58a7f114c784f825f8d6329cf817480fb3fd41a37c33b11b7fc","observation_id":"3ed591f2-8fc1-4d6c-b3cf-95db460634a3","resolution":{"observed_at":"2026-08-16T11:41:52.486937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-16T11:41:52.492027Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.492027Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:a11e1f3c4f2082c455abe81e01972aee444fc2676fccad1f3253bf95f0b32f35","observation_id":"22e90b44-c051-40d7-9326-eb161e3a2629","resolution":{"observed_at":"2026-08-16T11:41:52.492027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-16T11:41:52.497025Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.497025Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:84a0f8538ccb3204b5ceef9ea9d32bfb7e18f7fde974680fce9bf75da9234832","observation_id":"c2aaa510-4873-4e77-9b8e-aea650b1aff3","resolution":{"observed_at":"2026-08-16T11:41:52.497025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.026847Z","title":null,"venue":null,"work_id":"e2d571d8-101e-4176-9871-deed2ebbdded","year":2024},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.502033Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:cb8af4b69105ac49f4f8398b9be733248d5f964a1285a50516d9c59cb9b4e68a","observation_id":"9d05f9eb-bac0-4eff-9bcc-3c1ac1a4e61b","resolution":{"observed_at":"2026-08-16T11:41:53.031565Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:53.009385Z","title":"Xing, Joseph E","venue":null,"work_id":"4ab92b78-ddaa-47a7-9d0c-20f5419f931a","year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.507073Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:734e9279f55c0c4070e69708f9b7b26ecb0556b144545e4d2cb9431cdca7c072","observation_id":"948a2c04-5bfe-4484-8cde-b31e7ae370b2","resolution":{"observed_at":"2026-08-16T11:41:53.015138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.286429Z","title":"Advances in Neural Information Processing Systems 35 (2022), 16344–16359","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.286429Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:4539de3ade6563ca49780234dba4954a5dbc6835c0ae9b237caa07910ef41769","observation_id":"220a7299-5299-4ac5-aa61-19c49f25af12","resolution":{"observed_at":"2026-08-16T11:41:52.286429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:41:52.364788Z","title":"In Proceedings of the 29th Symposium on Operating Systems Principles (Koblenz, Germany) (SOSP’23)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:52.364788Z"},"links":{"citing_paper":"/paper/2504.14893"},"observation_digest":"sha256:d60782f8a54f17216e808008c90dcfe64aa2bdb7a8b562233897b79d2e0a4073","observation_id":"a29f9a89-0c29-4d8c-beee-fa0bcea9aa70","resolution":{"observed_at":"2026-08-16T11:41:52.364788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.14893","last_updated":"2025-04-21T06:45:41Z","latest_version":1,"primary_category":"cs.AR","snapshot_observed_at":"2026-08-18T11:19:21.875069Z","submitted_at":"2025-04-21T06:45:41Z","title":"Hardware-based Heterogeneous Memory Management for Large Language Model Inference"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 2 inbound Pith citation observations for arXiv:2504.14893."}