{"as_of":"2026-08-06T01:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:521744f8a0e69172f478019654d2b58b683a1d8f67f58efa90d4b2b7967cb3ed","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T09:41:45.544399Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.15155/citation-record","integrity":"/paper/2506.15155/integrity","json":"/paper/2506.15155/citation-record.json","paper":"/paper/2506.15155"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nair, Ilya Soloveychik, and Purushotham Kamath","venue":null,"work_id":"6391eee3-3682-40d7-84fe-7f09b34df543","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:5bedf43323f9e8da15fee7a326829f23cc7de22e5d1cff0cf35c41a2a65880a6","observation_id":"08116f84-6143-4c11-9c54-60fb3c67ad79","resolution":{"observed_at":"2026-05-19T09:42:14.165395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2409.17264","doi":"10.48550/arxiv.2409.17264","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025.No Request Left Behind: Tackling Heterogeneity in Long-Context LLM Inference with Medha","venue":"arXiv (Cornell University)","work_id":"3eb4a0fb-50a0-4b35-a96e-ac065a397497","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:59cb0b4e34fb6766e09ec82044eb14399b0264423f21ab1458e812cff13b2b7a","observation_id":"92385b3e-770e-4114-8f84-4e2015168d05","resolution":{"observed_at":"2026-05-19T09:42:13.884834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gulavani, Alexey Tumanov, and Ramachandran Ramjee","venue":null,"work_id":"a4dbc01e-812a-4004-98e4-28768d79026b","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:daa3499af643a0f9c41b023660e5f5b9ec4adda2cedb19bdd8a38f01ac6ae5c0","observation_id":"aa7a8490-5824-4231-bc7b-7837c206179d","resolution":{"observed_at":"2026-05-19T09:42:14.174832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b421cdf8-776c-4f18-b029-c0b9cacc69f6","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:434d9185bbb2b7daca14a1ea26929bff46937264a09b0190296b24dc6eee07df","observation_id":"ca2cf43d-4cc1-4cc5-9904-d341810dcae5","resolution":{"observed_at":"2026-05-19T09:42:14.172399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:35:27.376106Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":"0e3c45ca-6ccf-4ec0-925b-aa9735a23f6c","year":null},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:9ec67c4820caf37e840c8b7b2181c2a10b8d400050fd9d28cc933073b4af3d5b","observation_id":"d40d475a-c038-416f-9fd4-b57258ac2d99","resolution":{"observed_at":"2026-05-19T09:42:14.170073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5bb0b030-584c-4d1a-8e55-382162eaf96a","year":2022},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:2a65b0950f44f42c467353dac091a6c6325170b8608e93e3103bb7e822c1a142","observation_id":"2eb3ff69-47e7-4402-b6a0-3a9ec7b6782f","resolution":{"observed_at":"2026-05-19T09:42:14.177232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:98eab4a79eda00ae0f34e1bf35dc564a95b01192b6f2e01c659424f33ec031cb","observation_id":"7e545f5a-7fcb-4d6a-a268-9c4ea1520eae","resolution":{"observed_at":"2026-05-19T09:42:13.888124Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bfce9545-3448-41ce-84b5-13686fe63158","year":null},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:931bb53b134b7b266ec4bd4191f8d4069f085970e691e46671df30526ef3e422","observation_id":"51ebb91d-405c-4a07-8248-dc7efbf88bbb","resolution":{"observed_at":"2026-05-19T09:42:14.167697Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8294dfc9-e9c2-4516-80d3-387ccdec2307","year":2019},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:b188c49fe57293706bf06bd534ff0c010a4a38ac73baf32a800339020a84be64","observation_id":"665e635c-7820-4ede-ba03-51e2fecf1a24","resolution":{"observed_at":"2026-05-19T09:42:14.146781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02486","last_updated":"2023-07-19T12:25:35Z","snapshot_observed_at":"2026-08-05T18:04:01.030198Z","submitted_at":"2023-07-05T17:59:38Z","title":"LongNet: Scaling Transformers to 1,000,000,000 Tokens","version":2},"cited_work":{"arxiv_id":"2307.02486","doi":"10.48550/arxiv.2307.02486","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02486","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2307.02486 (2023)","venue":"arXiv (Cornell University)","work_id":"d2bcbcf1-3536-4da3-a03e-007066557381","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2307.02486","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:ea5ea0fba18a57ef77ccbf14486eb3cd77c9e03695eef305b51ee0cb29b4e7f4","observation_id":"01f2c97b-f5b0-4c38-aaac-ce18708df54b","resolution":{"observed_at":"2026-05-19T09:42:13.860674Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0665.364042","doi":"10.1145/3620665.3640422","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attacc! unleashing the power of pim for batched transformer- based generative model inference","venue":null,"work_id":"b4ef66d1-2dd7-4df5-98e2-dd6a6c893027","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:dd0faf0a4437c0e1ebc0836fefeb50aab56b00f19ad0e0c55f9bcab15f8dfd22","observation_id":"7ddc1182-90f8-4bf7-9321-6c3f6b6f7c1e","resolution":{"observed_at":"2026-05-19T09:42:13.856522Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T15:23:32.222991Z","title":"Generalizable multilingual hate speech detection on low resource indian languages using fair selection in federated learning","venue":null,"work_id":"ba13cded-3598-4d92-978b-17abc8fccde5","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:bed4e4e8e14a151cfa381bfbea40c436103bcd3527a8706bcf0823e4d69bc81b","observation_id":"e9d7fb1d-4487-4de1-83c3-65ac78cd98c3","resolution":{"observed_at":"2026-05-19T09:42:13.848106Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa91b679-283e-4b5f-b334-8fdb0f20a3db","year":2016},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:ea3ad017184b0d1da6c3c9a8259e87ce3a4a39113845d05ba34b42010ec17888","observation_id":"a711aa0f-a8d0-4225-aeee-200d8dffb10f","resolution":{"observed_at":"2026-05-19T09:42:14.134858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2449a66d-1fd6-41c5-8c24-6f6156b0d17e","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:ab1475389175ede711f48b94870c46223cb1c037c773125c7361f0626a285e1e","observation_id":"8e862c10-5cb6-4aba-91ec-bc7116d6c001","resolution":{"observed_at":"2026-05-19T09:42:14.161171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"2534936f-6139-4481-a9af-0ba80eaeb568","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:8f9819c106bde0522fc2c58c81b44ac77806eb439c430c6c9ba79b6e912b0bcc","observation_id":"0deecb88-c65d-40c0-9637-000a9a3a2cdf","resolution":{"observed_at":"2026-05-19T09:42:14.163270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T20:46:34.417090Z","title":null,"venue":null,"work_id":"36114d7f-e448-4db4-b8c6-bf9f86274172","year":null},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:60e8e4a9625f275ea7156543ede720abc54136b6ef21eeac8e08843899c4bd16","observation_id":"0b52c722-4e44-4fdb-b866-244dacedde0c","resolution":{"observed_at":"2026-05-19T09:42:14.142920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0006.361316","doi":"10.1145/3600006.3613163","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention , booktitle =","venue":null,"work_id":"1b10f2a9-a178-4d23-97fb-8db2354c7e6c","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:9934cb36bdc335bfc892e3946baf65f943b5fb9da36164b34ad5f13bf3e599ca","observation_id":"9b2bdbe9-d304-4799-8097-5215844028ba","resolution":{"observed_at":"2026-05-19T09:42:13.864855Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8d4b005f-9b83-4e80-952f-6fd210bfaee9","year":null},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:20a1aee5ce04780a65b5f13bc435f1f164e9f596c75c7df89e504c7abd0f8098","observation_id":"8c7a8058-c6d4-4df6-86eb-ae4b0a07b61b","resolution":{"observed_at":"2026-05-19T09:42:14.126396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19887","last_updated":"2024-07-03T14:30:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-28T23:55:06Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","version":2},"cited_work":{"arxiv_id":"2403.19887","doi":"10.48550/arxiv.2403.19887","metadata_source":"pith","pith_arxiv_id":"2403.19887","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jamba: A Hybrid Transformer-Mamba Language Model","venue":"cs.CL","work_id":"129df0fe-8a66-4077-8991-3557cfa38274","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2403.19887","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:79a24d8bab817b5fec2e79f90e436dd8939b0f2e6dc1a6f527ad2ec91c246935","observation_id":"277fd8ea-b5f1-4448-9336-9e287f9e98d7","resolution":{"observed_at":"2026-05-19T09:42:13.903110Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08268","last_updated":"2025-02-03T21:47:31Z","snapshot_observed_at":"2026-08-05T16:01:06.026395Z","submitted_at":"2024-02-13T07:47:36Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","version":4},"cited_work":{"arxiv_id":"2402.08268","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.08268","snapshot_observed_at":"2026-07-04T10:59:46.566942Z","title":"World Model on Million-Length Video And Language With Blockwise RingAttention","venue":"cs.LG","work_id":"162054d2-6f8e-4dc0-87b8-ebff78210c7c","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2402.08268","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:d865e094abdf8ea602a40cac37d7715029aa12348fc46ef1065407ffd81159bd","observation_id":"aa411028-6135-4ab1-b46e-6c56d418d7ac","resolution":{"observed_at":"2026-05-19T09:42:13.907641Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"05c22b46-e3fa-439a-839c-84bfee3b6614","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:d3eaf3cb11e35adec9ccf95c6b25527dae8f4f4915ee3e66c1b79f2a388492a8","observation_id":"9d7a3a35-ffde-449b-a315-558c57d2e23b","resolution":{"observed_at":"2026-05-19T09:42:14.138609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:005b27cdeb54c4884132348cc5a9907d9ad204c011959454b71d56b26250c788","observation_id":"765c8f0b-b281-4583-99c7-aaabb8a4c31a","resolution":{"observed_at":"2026-05-19T09:42:13.834794Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yang, Zachary DeVito, Martin Raison, Alykhan Tejani, Sasank Chil- amkurthy, Benoit Steiner, Lu Fang, Junjie Bai, and Soumith Chintala","venue":null,"work_id":"bcd96ae7-0698-4a0c-a402-8a06c5f71840","year":null},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:90316561c08693f5aacea46767f683f5f7ca92278fe1977ec0300e355370a177","observation_id":"2374b34b-f16f-4ec8-a92d-d6af761ebbbb","resolution":{"observed_at":"2026-05-19T09:42:14.130987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8076dacf-f224-4f87-b166-220e45b7ce69","year":2019},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:eff7b9faf307f343dace7a5630a5876949c10860ecea0a63a7d7631d95dffeb8","observation_id":"083eb00f-f979-4e18-80cc-15e8d9da183e","resolution":{"observed_at":"2026-05-19T09:42:14.140495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a4673ad8-2f08-4180-8e07-cb459fb2668f","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:c66eea6e3d6863cdc5fc360a82a33b6a33169a0aa12c6ca522a8e67bef758b40","observation_id":"ee4e80f2-84ba-48c6-9eb0-e938a9638b80","resolution":{"observed_at":"2026-05-19T09:42:14.136744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12146111-d018-4c35-bc15-de8e964aa8f7","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:4e04cace35119180409b4447f5547f0da00c36856de924bc564a43d64545f179","observation_id":"c655c304-39be-4418-b641-389c04ec21d8","resolution":{"observed_at":"2026-05-19T09:42:14.150688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04437","last_updated":"2025-01-29T04:10:41Z","snapshot_observed_at":"2026-08-05T02:13:00.249260Z","submitted_at":"2024-05-07T16:00:32Z","title":"vAttention: Dynamic Memory Management for Serving LLMs without PagedAttention","version":3},"cited_work":{"arxiv_id":"2405.04437","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.04437","snapshot_observed_at":"2026-07-10T01:36:44.326797Z","title":"vAttention: Dynamic Memory Management for Serving LLMs without PagedAttention","venue":"cs.LG","work_id":"3610d9ca-4370-41c0-9fcb-cc624f5b4d77","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2405.04437","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:0f83961ffb5085088acbf219cf686cb06d0024f167b6ed1f63531267a2b52cb3","observation_id":"4cbac68f-45a7-42af-88ab-5209a864596e","resolution":{"observed_at":"2026-05-19T09:42:13.910745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cda622f0-ca25-4858-a27c-abfe250a43c5","year":2025},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:cf19fa6c02bb80828acf0a0245c99cebc65b6ddbdd8225734582f0f0c1630ea1","observation_id":"7017eb3d-a69a-4995-a8d9-9200c188ed37","resolution":{"observed_at":"2026-05-19T09:42:14.155253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"73961232-b359-40f8-86b2-afd4b0edccf6","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:0b4eb90f98e8acb155758c5997b7dd2bab8f590dfdb2add75f5cd7c642e5689d","observation_id":"09adaa6c-022a-44ba-b55f-2585c6b3cccf","resolution":{"observed_at":"2026-05-19T09:42:14.144809Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"61b01101-a9c2-4737-a840-044157024933","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:e1af2e422ec5c54320dcda565ad6ace3630b119a982aaf94ba7d0687eef5734c","observation_id":"f1827fa8-13d7-45f7-b711-101ee85d7788","resolution":{"observed_at":"2026-05-19T09:42:14.128442Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:fa3f237e33b8c4b17ce013c8be9b1b9434acf0092b1dbeddcd1dfa7a681e596a","observation_id":"bc5c8807-e51f-4a03-bd53-48556f1942cb","resolution":{"observed_at":"2026-05-19T09:42:13.843144Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T11:08:05.851253+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:eacbc7b704fd98a11020c0909ff5c7ee8af664a191d33b2b4d30fcf4d24735b1","observation_id":"a24131b0-3d2b-486c-8ea8-1109c0f9273f","resolution":{"observed_at":"2026-05-19T09:42:13.895615Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chi, Quoc V","venue":null,"work_id":"ca683b71-f910-4b31-9ba4-f2da331dfcc6","year":2022},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:75e43c5e95bcbe2c19145962f2bc584ad0d81e9cb37dc7cf99f2a2fe64769e19","observation_id":"c40853c4-66cf-4435-a7fa-92faadc8d3cd","resolution":{"observed_at":"2026-05-19T09:42:14.132915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4715.369594","doi":"10.1145/3694715.3695942","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In Proceedings of the ACM SIGOPS 30th Symposium on Operating Systems Principles (SOSP '24), 2024","venue":null,"work_id":"e2683fd1-07ef-4b19-8011-f1f427683ccc","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:dff9e9bdfa2b6fbea80a0e8740a494fa598a1dcab7723ce0cb0486c1943a6163","observation_id":"d21fa459-3f09-4542-92b9-32f22042464c","resolution":{"observed_at":"2026-05-19T09:42:13.852331Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa03335a-9846-4281-84d5-fc225c987fe6","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:e2abb9c3544b2ff1c287a185bf1b24b6f272c9c25205e864cdb2dfc856d35702","observation_id":"47382779-3f89-4d45-98d6-da0c7e97a3b9","resolution":{"observed_at":"2026-05-19T09:42:14.159159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08464","last_updated":"2024-10-07T01:45:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T17:52:30Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","version":2},"cited_work":{"arxiv_id":"2406.08464","doi":"10.48550/arxiv.2406.08464","metadata_source":"pith","pith_arxiv_id":"2406.08464","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing","venue":"cs.CL","work_id":"4df6cdce-69a0-402e-ab53-59e5c10b8cae","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2406.08464","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:81e726bda8187e968f8fda30975e6f7c07ce305508599dbc31b7e9173873beca","observation_id":"bb554d37-9451-4ee4-bc13-f1c5136123bb","resolution":{"observed_at":"2026-05-19T09:42:13.899168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ba50caf9-312f-428a-a354-33c78e7e3d58","year":2022},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:c4fd00f3078aa0ffcf91c4cd2f44971f05ac359453d6b674da93bf89da90323c","observation_id":"53d74e01-93bc-4ae7-ba1d-d313779d38e4","resolution":{"observed_at":"2026-05-19T09:42:14.153047Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-07-06T13:05:54.518154Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":"2205.01068","doi":"10.48550/arxiv.2205.01068","metadata_source":"pith","pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-07-11T03:37:45.880117Z","title":"OPT: Open Pre-trained Transformer Language Models","venue":"cs.CL","work_id":"d7ff3b21-1fff-4cf4-952a-4714e3ef2307","year":2022},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:c4bf51f5b69a0d1a41957b8d029c8b28fc25c09235fa6ee6aaad087bcc80e786","observation_id":"94ea2934-3b6a-4dab-ae13-a48d80aeffb2","resolution":{"observed_at":"2026-05-19T09:42:13.892191Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":"ace64f0e-7055-4d70-9297-4cbe28a4150b","year":2023},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:d562f2eebac5d86834d0d93a87f5ee8bcafe15830cc98c53df1fe95bd5be5052","observation_id":"df184fe1-a8da-47c9-bbe7-825529a706dd","resolution":{"observed_at":"2026-05-19T09:42:14.148797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d0893483-174c-4d51-b40e-d983a23fc6ff","year":2024},"citing_paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T09:41:45.544399Z"},"links":{"citing_paper":"/paper/2506.15155"},"observation_digest":"sha256:67d94bdb248acccec03e42bca9b18f2a121afc877923dd4678187bddc322a5c5","observation_id":"d91bca19-b71c-4ae0-b50a-ad326eba72ca","resolution":{"observed_at":"2026-05-19T09:42:14.157222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.15155","last_updated":"2026-05-06T17:46:08Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T21:44:04.066471Z","submitted_at":"2025-06-18T05:56:01Z","title":"eLLM: Elastic Memory Management Framework for Efficient LLM Serving"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":2,"metadata_mismatch":7,"parse_uncertain":0,"unresolved":18,"verified_exact":6,"verified_fuzzy":7},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.15155."}