{"as_of":"2026-08-09T14:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b2220289f6c9d638f5588e9b7713802cc4899323e006d395e227995b6ab7a4a","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:32:01.436765Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.03589/citation-record","integrity":"/paper/2502.03589/integrity","json":"/paper/2502.03589/citation-record.json","paper":"/paper/2502.03589"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.093806Z","title":"01-ai Model Yi","venue":null,"work_id":"b85acdd5-ab8d-4084-b806-a51bd486f1f9","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.894208Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:f368671cf5743bb14cd72107d75afb4413f22abd1369c3da5fb69004d8241571","observation_id":"a2ba7df7-36d3-4a78-9046-e1f3f217cef9","resolution":{"observed_at":"2026-08-09T04:32:03.098044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.079563Z","title":"The code of HKVQ","venue":null,"work_id":"187b3624-c611-485d-b260-ef8c3c0e36e4","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.899952Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:7ba7592ef8169ed4ba5de5f2d422fc9be15625dfd1746683d802e0d72e7d8a1d","observation_id":"5854c212-5933-451a-8341-4562f7fa0dec","resolution":{"observed_at":"2026-08-09T04:32:03.084134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.064816Z","title":"Falcon-180B","venue":null,"work_id":"a0e6ef35-51fe-4513-aa3e-d6f6dc307ef8","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.905385Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8d5e2c57812889d90b63caa8af2377ede9a409bee975c1657a42ea178832a62a","observation_id":"bd4341a2-d886-43dd-9535-6e9a8572f1c4","resolution":{"observed_at":"2026-08-09T04:32:03.069761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.050397Z","title":"GPT-4 explaining Self-Attention Mechanism","venue":null,"work_id":"b3050b79-888c-4e48-a69a-75a881d1e4c9","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.910371Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:2ef6fe9f1bcc72c14a54a5b469a983cb6adf6bcda3f6f5c160f12818bfb275c9","observation_id":"e5cb92bd-4660-418d-a5ab-40a8aeae0dcc","resolution":{"observed_at":"2026-08-09T04:32:03.055142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.035870Z","title":"Meta Llama-3.1","venue":null,"work_id":"2605c1b0-a33b-411c-819f-6f9142c7ee42","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.939057Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:94f79754a54957d65c49f64fc115e7ec078dd98c735dcfa665188a9058247191","observation_id":"c21cbef9-aa4b-4df8-aa37-214429fbd23d","resolution":{"observed_at":"2026-08-09T04:32:03.040318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.021557Z","title":"Microsoft Phi-3","venue":null,"work_id":"b1fbca8f-7387-4e44-a482-8bde01f8a969","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.963268Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:e6e4933ae43446075c09210426865ae0392b63bdd156599b893b7507b4ca4234","observation_id":"9ff9a508-597f-4b3c-a97e-4bc61994a4bf","resolution":{"observed_at":"2026-08-09T04:32:03.026102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:03.007122Z","title":"Mistral-v0.3","venue":null,"work_id":"72c06fb2-e129-4d39-b4dc-e347be068e68","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:00.984003Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0839d8c0c021f545748e3d9bac9af23241b7b7d097b13bc0b946129eebd7336c","observation_id":"163b85a9-07f8-4024-9df5-71603d79ce3b","resolution":{"observed_at":"2026-08-09T04:32:03.011753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.992804Z","title":"Open Compute Project","venue":null,"work_id":"19566981-2096-43b0-9d15-d10d5e0b12f0","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.012004Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:ed66e3d1c45c622cbc75572301def2556a93ce6f4cd91e33f92cd9fd25360149","observation_id":"02973831-aee7-4f0b-bda8-4f53338cb54c","resolution":{"observed_at":"2026-08-09T04:32:02.997340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.978512Z","title":null,"venue":null,"work_id":"ef0ad179-a77b-41d8-a429-2eeea050730c","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.031821Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:77179e1cbba3abfc0fcb3dc166a2421b7485ab74d6d88eac7f55e51443575bea","observation_id":"6dcc1684-1bd2-40c3-b2b3-f7cd9862d832","resolution":{"observed_at":"2026-08-09T04:32:02.983111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.964230Z","title":"Amazon Web Services","venue":null,"work_id":"7bbda64b-b5cc-4dad-90e0-175660674d98","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.051883Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:2b50164f9a4c48e0e98dc602624988a3796224a6a67f2142f58aa6cfa8a17eb8","observation_id":"23e2105c-de90-403f-a26f-480b948be9ee","resolution":{"observed_at":"2026-08-09T04:32:02.968849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.949211Z","title":null,"venue":null,"work_id":"d7694f73-0bf1-4bab-ad8a-26a8ef407698","year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.070817Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:eb3f66995361ebebbb3bc7a38c02c335af2b9e4da8ada44a406c1a2dcf989876","observation_id":"0e9fb43d-1b58-494f-86c7-1d6742b9abee","resolution":{"observed_at":"2026-08-09T04:32:02.954404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.934832Z","title":null,"venue":null,"work_id":"a849b46c-96d1-4882-8bda-83cbd1af9f8d","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.090781Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0ef9280e6e5c58484b1db7f6193244beb6c50533b372ef50cf2a584e5a8a9e96","observation_id":"4acdba96-c182-4a45-8e84-30aa83e51501","resolution":{"observed_at":"2026-08-09T04:32:02.939427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T04:32:01.111833Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.111833Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0db1aff1f4f143ec40eff74f4ebd6ca332510a8e0e1ab12a616f1e692237ef64","observation_id":"11043b35-3024-42d6-8f60-8a03c50dccc5","resolution":{"observed_at":"2026-08-09T04:32:01.111833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.920060Z","title":null,"venue":null,"work_id":"15a2a203-76c2-449d-8abb-e2c8787ef587","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.129220Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8b8b1523ae1412269eb6655410d80615ca91473ce66eb53c208a9e7b1bee9bf1","observation_id":"34f3ef10-7653-40f8-8a64-605c83bcb907","resolution":{"observed_at":"2026-08-09T04:32:02.924597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.05685","last_updated":"2018-05-22T13:06:37Z","snapshot_observed_at":"2026-08-08T21:17:23.383530Z","submitted_at":"2018-04-16T13:55:20Z","title":"A Discourse-Aware Attention Model for Abstractive Summarization of Long Documents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.05685","snapshot_observed_at":"2026-08-09T04:32:01.137495Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.137495Z"},"links":{"cited_paper":"/paper/1804.05685","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:22a2ec7c72b468ea131ea1711e0c405d02b673bec62924fe49ee9b20430865be","observation_id":"1ff33bc0-3d6e-4e1d-8462-35c0521e1580","resolution":{"observed_at":"2026-08-09T04:32:01.137495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.905200Z","title":null,"venue":null,"work_id":"46771f69-5d05-4c3e-b9ad-c5996e884b0f","year":2025},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.145652Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:344e19d9e327f76ab7a711d87936fa81ae07cb09b9ef3d7d5b280ff6220b0b63","observation_id":"9c1b44c0-fe71-44a6-a672-d123ae50fcf2","resolution":{"observed_at":"2026-08-09T04:32:02.909728Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16546","last_updated":"2024-07-02T12:23:37Z","snapshot_observed_at":"2026-07-06T18:20:05.707144Z","submitted_at":"2024-05-26T12:30:20Z","title":"Cocktail: A Comprehensive Information Retrieval Benchmark with LLM-Generated Documents Integration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16546","snapshot_observed_at":"2026-08-09T04:32:01.161788Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.161788Z"},"links":{"cited_paper":"/paper/2405.16546","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:4e71521cb84b68e75b74f664a3e72d34276ba7f932ba4ee96e71b1737d39e1d5","observation_id":"3916f688-24a1-48c6-b73c-ea8ff5124090","resolution":{"observed_at":"2026-08-09T04:32:01.161788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-09T04:32:01.167087Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.167087Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:ec948b709d7af8d6b83c00fa19e991071d8c431d88056e3b5d15b4525c6887db","observation_id":"40c9fab2-64d4-4312-9ec5-935173b45f97","resolution":{"observed_at":"2026-08-09T04:32:01.167087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.890789Z","title":null,"venue":null,"work_id":"8740785c-a7d7-48aa-9604-9f7d9037cd7c","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.172720Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0896d46f613860d7b57e6ca15e834dc9b1dd3151626e653b42b659b5ec958456","observation_id":"fc836456-25c5-443f-8225-5952f92ded69","resolution":{"observed_at":"2026-08-09T04:32:02.895532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01801","last_updated":"2024-10-29T18:26:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T05:17:08Z","title":"Model Tells You What to Discard: Adaptive KV Cache Compression for LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01801","snapshot_observed_at":"2026-08-09T04:32:01.182854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.182854Z"},"links":{"cited_paper":"/paper/2310.01801","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:c62382671f91e25c4ca24a9c96fcf02f92baea3ef423654698c0693327c3843d","observation_id":"88ea88ac-368e-4b14-9b73-62d7d2e45d53","resolution":{"observed_at":"2026-08-09T04:32:01.182854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.875894Z","title":null,"venue":null,"work_id":"d998b95c-d162-4979-9109-f3a249629f71","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.187928Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:637a45086c546300fac51983aa97788e5dce445d373911a5c7e43a430341e7c3","observation_id":"205d1710-fe8e-42da-8476-8cb6c576a0c0","resolution":{"observed_at":"2026-08-09T04:32:02.880794Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14256","last_updated":"2024-05-23T07:37:16Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T07:37:16Z","title":"ZipCache: Accurate and Efficient KV Cache Quantization with Salient Token Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14256","snapshot_observed_at":"2026-08-09T04:32:01.192677Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.192677Z"},"links":{"cited_paper":"/paper/2405.14256","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:beb24e05c745ba35c8bf678690f3092284bf283e61fc8d26f19d89df0e0129ef","observation_id":"274878eb-54ab-4a3f-b47c-6cb7c37c1241","resolution":{"observed_at":"2026-08-09T04:32:01.192677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.860809Z","title":"Mahoney, Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"01b514f6-84c5-41ba-b62f-b225117831b2","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.197825Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:410b3ead39594441adb8e0a18b696fbdb1df81c01fa523a28991b691cbec9e79","observation_id":"f448ce07-40a7-4590-96ec-aeee0f670564","resolution":{"observed_at":"2026-08-09T04:32:02.865340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-07-06T18:36:42.830927Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-09T04:32:01.202215Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.202215Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:20c090a18ed2637cb6486e9cdf4102b02e20a6a41b14756ae9b75a748d8f3a88","observation_id":"08a01091-abe2-435f-a039-308069137136","resolution":{"observed_at":"2026-08-09T04:32:01.202215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11181","last_updated":"2024-01-20T09:43:36Z","snapshot_observed_at":"2026-08-05T23:35:16.350557Z","submitted_at":"2024-01-20T09:43:36Z","title":"Inference without Interference: Disaggregate LLM Inference for Mixed Downstream Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11181","snapshot_observed_at":"2026-08-09T04:32:01.206880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.206880Z"},"links":{"cited_paper":"/paper/2401.11181","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:5337845489ed4b15f27cad0f536e78c8f9f77bc3d77a724181139e2791754a4e","observation_id":"7c56cfd0-de8d-4781-a1f1-ec29bb3f2ef0","resolution":{"observed_at":"2026-08-09T04:32:01.206880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.846551Z","title":null,"venue":null,"work_id":"5c833e26-0904-429f-a343-6a852a7c1833","year":2020},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.211610Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8457a6076dbfe12783985b71ea76f15fcac131c71af746b045677904df5eb673","observation_id":"97c23686-db7e-4b51-8a8f-ec6db3e583c3","resolution":{"observed_at":"2026-08-09T04:32:02.851131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.832005Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":"d11b97a3-713e-4220-8683-b17a73c39796","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.215898Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:fc46fd15388be0486a5b8de45acf71fa8eca9819ca50b84cf275b48e9e63c86e","observation_id":"278e1116-92ab-49ce-a207-f6e0189758c4","resolution":{"observed_at":"2026-08-09T04:32:02.836716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08585","last_updated":"2024-12-17T05:40:09Z","snapshot_observed_at":"2026-07-06T20:05:23.685854Z","submitted_at":"2024-12-11T18:03:05Z","title":"TurboAttention: Efficient Attention Approximation For High Throughputs LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08585","snapshot_observed_at":"2026-08-09T04:32:01.220321Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.220321Z"},"links":{"cited_paper":"/paper/2412.08585","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:828177d48586f6975f4b0d1c140e6635b6b5e060489a941047eb9f1d90bf6360","observation_id":"e93c6383-835c-4d41-a09f-8d5f598c669e","resolution":{"observed_at":"2026-08-09T04:32:01.220321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-07T12:20:18.370756Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-09T04:32:01.224806Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.224806Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:96d417e6b8287581d236d7bf3c587a2274bdd583749bf1e26d69f7f3739c202b","observation_id":"a312f7a9-8693-4c31-a9e8-20d62d99656f","resolution":{"observed_at":"2026-08-09T04:32:01.224806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.818244Z","title":null,"venue":null,"work_id":"5c90e972-1ddd-4e83-94e2-afd2ad508c41","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.229542Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:5c000c158fdc23e7d39b701458f6d72ab8228d320fd9bf4de5fcf1a68135637d","observation_id":"afd68f26-a247-43aa-8f31-a41cd4897bed","resolution":{"observed_at":"2026-08-09T04:32:02.822612Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.804121Z","title":null,"venue":null,"work_id":"7f0fed0b-e88d-477c-951c-fb3faceb78d4","year":1983},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.233899Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:99e07dbcbb6834c2fb4c6995144bd1da2da3f2c804c20a71c0058e685d8d2ac1","observation_id":"a1c35189-21a7-4b4e-bfcc-825de178e8ab","resolution":{"observed_at":"2026-08-09T04:32:02.808544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.246076Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.246076Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:dc8d94f8d0855c1a2714d6af1d2d858bcdd95d8277855804f1299d648462c0c1","observation_id":"34d1d726-cca1-4989-87c7-f656023d394b","resolution":{"observed_at":"2026-08-09T04:32:01.246076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.780571Z","title":null,"venue":null,"work_id":"78f2b712-7e8d-4c1e-8bf9-e1f028be3eb4","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.299578Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:2564c849c632c510b405794ff33a4b5868b45dce762e443a604075fbf1bc0f3c","observation_id":"b7313fc8-ecb5-4591-9dca-a8117548d204","resolution":{"observed_at":"2026-08-09T04:32:02.785061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.765937Z","title":null,"venue":null,"work_id":"319d2fc1-34c9-43ae-85c7-01fd56d857e3","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.330702Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:ee5acc3a2b2667777b5abdcbeb59ccf9388ba39fa5b60c69fadb26c884405501","observation_id":"a0410b61-cd43-4383-a6a3-a9a0328a870f","resolution":{"observed_at":"2026-08-09T04:32:02.770500Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.347729Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.347729Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:339fbbdb24c14ca120741962a56af824bcf0739cd37bafab540877258933bce3","observation_id":"6562a816-020d-4bda-af14-24cbae0127fd","resolution":{"observed_at":"2026-08-09T04:32:01.347729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.194402Z","title":null,"venue":null,"work_id":"7b44b166-a107-4bb4-94a0-620c63a17d8b","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.355654Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:1bdd0c366091d2086a7f69cfa2e9d13fefe99d357f6889c7d49b474487edfdd9","observation_id":"af63ab59-ca79-4cf5-a240-478204840bb5","resolution":{"observed_at":"2026-08-09T04:32:02.199037Z","resolver_source":"arxiv_id_nonexistent","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.742039Z","title":null,"venue":null,"work_id":"c04e3936-1ac7-4b79-b876-7970986aa47f","year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.359758Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:3f9ced94336a77e2cde3676310b30b137f9a6418f7caebf908b8ea2136968488","observation_id":"9491ba51-c74a-4e9a-957d-15551c576bca","resolution":{"observed_at":"2026-08-09T04:32:02.746448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.728003Z","title":null,"venue":null,"work_id":"7fa5587d-5a97-4499-8ece-1d20d8a4913e","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.363656Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:1e35c8f0a328c305aa2a438ecdd8bab64ff23e90ed1d41d9cc4ebbefe84ca8c1","observation_id":"677af7c4-5aeb-43c3-825c-e06c4b0a669a","resolution":{"observed_at":"2026-08-09T04:32:02.732455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.713676Z","title":null,"venue":null,"work_id":"9b227b80-7632-4a2b-b18b-2f88d49eae7b","year":2021},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.367667Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:32470a390457305edd9b6c6af1f7a5d0e135cb8ba2de8f3ff8127e309c2e4826","observation_id":"17dabb12-3d8a-4376-a7a3-08931c0a49bc","resolution":{"observed_at":"2026-08-09T04:32:02.718185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.027510Z","title":null,"venue":null,"work_id":"2bf8de8f-e203-4f90-b55d-0fa89fe291ad","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.371430Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:0c7b94a03c5ca6814a76029893b2f08ce43ab57fc9a96ee38daa17853132ce90","observation_id":"faac764e-f192-4b76-a627-ff89abdeb381","resolution":{"observed_at":"2026-08-09T04:32:02.031876Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00079","last_updated":"2025-09-03T14:56:29Z","snapshot_observed_at":"2026-08-07T12:08:57.217593Z","submitted_at":"2024-06-24T02:05:32Z","title":"Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00079","snapshot_observed_at":"2026-08-09T04:32:01.375623Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.375623Z"},"links":{"cited_paper":"/paper/2407.00079","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:9e37828004c357e8b7d379aa4f75c792d814ce064459507e4a19edb199a47497","observation_id":"5f39808e-8b62-4c56-8038-1967e987706c","resolution":{"observed_at":"2026-08-09T04:32:01.375623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.699121Z","title":null,"venue":null,"work_id":"c83318a9-04a9-480e-8a93-439fc5a42180","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.380570Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:24da4a6596560bd9e88003edbf4bab8cc6b158274a2875a6af9e1cd3dddbf535","observation_id":"40dd6b79-f0f8-4152-837b-ecda2eb40778","resolution":{"observed_at":"2026-08-09T04:32:02.703991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.684509Z","title":null,"venue":null,"work_id":"fd7dd83c-3613-4d4b-94bb-6005739e818c","year":2020},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.385124Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:e6deb8e7d743f330657ac9d39c343417b3bfe086a69861e3b32a5b3cfc784877","observation_id":"2047d041-1f96-424a-bcff-546d06e3ae79","resolution":{"observed_at":"2026-08-09T04:32:02.689339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.669965Z","title":null,"venue":null,"work_id":"eb88fae8-502d-4c14-8d60-29333ea7694a","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.389791Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:172cf3167cf566622c6b03e6b60909773fe3f6f7d3748220a0e87c2508851070","observation_id":"d9d133c9-8e81-4a92-9f7e-cdd4ed11e529","resolution":{"observed_at":"2026-08-09T04:32:02.674377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.854744Z","title":null,"venue":null,"work_id":"29ee3450-4c59-467c-9f32-9f09bd6155a8","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.394372Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:eb777d0b8d5969c0a544184330a8676b9bb65cfef94559db12311be6670c084e","observation_id":"254e552f-d338-4896-9083-775b66e68b27","resolution":{"observed_at":"2026-08-09T04:32:01.859716Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.654730Z","title":null,"venue":null,"work_id":"c6c42a2e-3919-4c7b-8c2d-8596c1a0023d","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.398968Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:2eca904294d77db70bf40779cd494ec16fce23d0e257505cca23dffcbecb0e7c","observation_id":"307e8010-7f9a-4177-b493-6f9ae3976a48","resolution":{"observed_at":"2026-08-09T04:32:02.659248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14112","last_updated":"2024-03-04T02:30:21Z","snapshot_observed_at":"2026-07-06T17:20:21.209197Z","submitted_at":"2024-01-25T11:46:38Z","title":"FP6-LLM: Efficiently Serving Large Language Models Through FP6-Centric Algorithm-System Co-Design","version":2},"cited_work":{"arxiv_id":"2401.14112","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.14112","snapshot_observed_at":"2026-08-09T04:32:01.537073Z","title":"FP6-LLM: Efficiently Serving Large Language Models Through FP6-Centric Algorithm-System Co-Design","venue":"cs.LG","work_id":"061598f2-013d-46b6-b530-be51d7d5ea77","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.403532Z"},"links":{"cited_paper":"/paper/2401.14112","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:8575e75cb324413fa4b4d8da4045782213d4773950a2750cddf9515052fc3e13","observation_id":"cca5ef1f-3fee-444d-8c42-d78f9b5e852b","resolution":{"observed_at":"2026-08-09T04:32:01.542534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12532","last_updated":"2024-06-05T09:01:24Z","snapshot_observed_at":"2026-07-06T18:17:08.160308Z","submitted_at":"2024-05-21T06:46:37Z","title":"PyramidInfer: Pyramid KV Cache Compression for High-throughput LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12532","snapshot_observed_at":"2026-08-09T04:32:01.408211Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.408211Z"},"links":{"cited_paper":"/paper/2405.12532","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:c1930481345f98689ef6a3a028b0c297b335314de19a50508f5fe1a5d8096c8e","observation_id":"cd6b8efe-e3fa-4474-a515-8ec7e9cc7aae","resolution":{"observed_at":"2026-08-09T04:32:01.408211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02328","last_updated":"2024-07-02T14:58:44Z","snapshot_observed_at":"2026-08-05T00:30:49.640680Z","submitted_at":"2024-07-02T14:58:44Z","title":"Efficient Sparse Attention needs Adaptive Token Release","version":1},"cited_work":{"arxiv_id":"2407.02328","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02328","snapshot_observed_at":"2026-08-09T04:32:01.497646Z","title":"Efficient Sparse Attention needs Adaptive Token Release","venue":"cs.CL","work_id":"9b1f71e9-155d-4151-96ea-905764a08ac0","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.413110Z"},"links":{"cited_paper":"/paper/2407.02328","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:790982e863e65f31cca7625a940222ecfed2e1642141355878318ceb9e0903b5","observation_id":"eea89336-f7b2-4247-a02e-c49c6117cfe8","resolution":{"observed_at":"2026-08-09T04:32:01.504847Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.640172Z","title":null,"venue":null,"work_id":"f5d4428a-8889-46cd-a782-180c74d5e3bd","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.418143Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:40e952cd861d0b54bf991d21c43a0729e6c359289c7ccc7062b000c9e1d873c2","observation_id":"055b31a0-fd46-4bd4-bc6b-e6501e20a04e","resolution":{"observed_at":"2026-08-09T04:32:02.644603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.626127Z","title":null,"venue":null,"work_id":"3afc4639-b5eb-44a6-8306-06d3504a7977","year":2023},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.427705Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:772da426f2fae7a68659343d147aeeac16893b2139f49e3817310a7d1e06cac9","observation_id":"b4a436e4-ddd6-4423-af60-93370e252956","resolution":{"observed_at":"2026-08-09T04:32:02.630591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.611880Z","title":null,"venue":null,"work_id":"4e2debc3-b7e7-4891-89a7-c7c104a14304","year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.432313Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:5bdafec92fa929f51c549b3ce8d0104534c882fc0c85b7b1cf7f4f23e9aff163","observation_id":"cbeba9c0-585c-4ec7-a3eb-e10292816068","resolution":{"observed_at":"2026-08-09T04:32:02.616630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18294","last_updated":"2024-06-27T04:40:52Z","snapshot_observed_at":"2026-08-03T16:36:54.993208Z","submitted_at":"2024-06-26T12:26:16Z","title":"Hierarchical Context Pruning: Optimizing Real-World Code Completion with Repository-Level Pretrained Code LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18294","snapshot_observed_at":"2026-08-09T04:32:01.422886Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.422886Z"},"links":{"cited_paper":"/paper/2406.18294","citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:cd955baf820fa8a14f317af28d6b4f05a6ca6e12c9a4ece3fb5144098426d2e8","observation_id":"16274fcd-7937-4808-8ca9-47af324fe340","resolution":{"observed_at":"2026-08-09T04:32:01.422886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.597844Z","title":null,"venue":null,"work_id":"5a00dfe5-49f8-4896-864f-4d7e2732d367","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":210,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.436765Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:ceb3ca56a15b7d424ce1557236478adefb5e221ca2cc32f29cddc01b1a25ce60","observation_id":"ad085163-5b7d-4e62-996f-caa301007be1","resolution":{"observed_at":"2026-08-09T04:32:02.602407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:02.434289Z","title":"In Proceedings of the 29th Symposium on Operating Systems Principles (SOSP ’23)","venue":null,"work_id":"7c34b0e3-6559-4f08-b75b-511130167a4a","year":null},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.272605Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:391cf906f833621e860926ccebe287d9f15fcdf186d29aab390ec87027fe080e","observation_id":"120be18e-c3b2-4a1c-b23e-b089ca252665","resolution":{"observed_at":"2026-08-09T04:32:02.438778Z","resolver_source":"arxiv_id_nonexistent","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T04:32:01.178053Z","title":"In Proceedings of the 2024 Conference on Empirical Meth- ods in Natural Language Processing , Yaser Al-Onaizan, Mohit Bansal, and Yun-Nung Chen (Eds.)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T04:32:01.178053Z"},"links":{"citing_paper":"/paper/2502.03589"},"observation_digest":"sha256:a4c24f2615b6f8beb303c6cbb4a224738dd8766f3a6eafcb318fb01bd7f23f7c","observation_id":"e22e2b6e-089a-437f-8be9-ea3f7eafbbe0","resolution":{"observed_at":"2026-08-09T04:32:01.178053Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.03589","last_updated":"2025-02-05T20:09:51Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-09T04:23:35.804076Z","submitted_at":"2025-02-05T20:09:51Z","title":"HACK: Homomorphic Acceleration via Compression of the Key-Value Cache for Disaggregated LLM Inference"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":4,"verified_fuzzy":11},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2502.03589."}