{"as_of":"2026-08-17T18:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b4af68343c68f1b372b1c3bd23d7f6f165c1d2f59f8f438253ccb390a15063c1","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T23:39:09.503875Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01657/citation-record","integrity":"/paper/2608.01657/integrity","json":"/paper/2608.01657/citation-record.json","paper":"/paper/2608.01657"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:14.542262Z","title":"Efficient memory management for large language model serving with PagedAttention,","venue":null,"work_id":"c1117a27-0849-4119-be93-20f59b6bab2f","year":2023},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:06.876542Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:c57ff7e29575b6a554a2a8ec9121ca21f7f67993a85c5df7705b36b9a06b89dd","observation_id":"387b4860-b496-471e-819e-ee815ad404f2","resolution":{"observed_at":"2026-08-04T23:39:14.650177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:14.285528Z","title":"SGLang: Efficient execution of structured language model programs,","venue":null,"work_id":"38e87608-7611-4b00-9b23-e085043e1856","year":2024},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:06.945638Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:69d6759beecd528cbb3d30a3543a56ac9771be746ccc0c91c39017aa54499ced","observation_id":"8970443a-57a6-494f-b853-f566639fa1f5","resolution":{"observed_at":"2026-08-04T23:39:14.387815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:13.962438Z","title":"Stateful large language model serving with Pensieve,","venue":null,"work_id":"c861484b-454f-4c15-911c-a894add0e998","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.068100Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:4ee0d303e354bb045acda15bb38f778983ef3f2d037bc3945f71723ec5408b2f","observation_id":"475d677f-11ba-4d0f-bdf3-d532130e5e82","resolution":{"observed_at":"2026-08-04T23:39:14.115636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:13.717467Z","title":"Online context caching for distributed large language models serving,","venue":null,"work_id":"852fe4ed-1153-4561-bfd4-e4d47dda2701","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.206965Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:d1babd3399a70be4a5e9fd8897d23c2e6f03aa82d116b2e2e52317488ad0d39d","observation_id":"ec41eb9c-d281-446c-a7e8-5441c48b0ba4","resolution":{"observed_at":"2026-08-04T23:39:13.837447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:13.470008Z","title":"MELL: Memory-efficient large language model serving via multi-GPU KV cache management,","venue":null,"work_id":"0875f5b1-d7c4-4ca1-9ef8-b0c125e3c735","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.337094Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:8d6c279b538f6ab026191f6d7080e7df705c96b0ec536c03ae375d8206870f2b","observation_id":"b438ddf6-5854-4404-873f-7603880d0a9b","resolution":{"observed_at":"2026-08-04T23:39:13.586664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:13.230389Z","title":"Mooncake: Trading more storage for less computation—a KVCache-centric architecture for serving LLM chatbot,","venue":null,"work_id":"27826241-32d0-47d1-be20-ae6c2167d64a","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.446449Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:26f5e68584ae9e19a2a16cfd0fd44b6e93f2bc40eadb6a8f7d0ea012b05a853b","observation_id":"ac31c024-14e6-427f-8c54-89d9bd68a6cc","resolution":{"observed_at":"2026-08-04T23:39:13.352980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:13.039355Z","title":"KVCache cache in the wild: Characterizing and optimizing KVCache cache at a large cloud provider,","venue":null,"work_id":"1a7ec1a9-3ca4-4fb5-9e35-0bb13b502382","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.564760Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:93d6f8966b5a8e26b6b6b58e873883463942ea16b73c992c23e1740e186cc0c1","observation_id":"a628dc5c-0bd3-4956-85f9-a1a1ac216f76","resolution":{"observed_at":"2026-08-04T23:39:13.134184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:12.823145Z","title":"Fairness in serving large language models,","venue":null,"work_id":"b0b6b4c3-9c7c-42c0-8bf7-be6a3549734c","year":2024},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.673297Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:c360d2b553c1b51bcfa4fa56ef0ef501a84d7b763c436fd9969d8f09f0fb432b","observation_id":"5c1e0539-4df6-4216-9724-927c2e65c6cc","resolution":{"observed_at":"2026-08-04T23:39:12.948052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:12.526075Z","title":"FIFO queues are all you need for cache eviction,","venue":null,"work_id":"c501a4d6-fbe1-4a12-9515-3e0c65079baa","year":2023},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.774046Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:93f52ddae8f61a79c0ae7900367a0ca7ae4f99ff0aac7a18ace6059db294ad73","observation_id":"31e2e63d-7eda-42e8-91fe-a42e51674042","resolution":{"observed_at":"2026-08-04T23:39:12.670748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:12.282144Z","title":"FairRide: Near- optimal, fair cache sharing,","venue":null,"work_id":"4a97a573-e4f8-46fc-9fdf-2d6058d5095a","year":2016},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:07.938840Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:d5ec0e1c4c1e71220fc937bb26714ebbccd107770107780334a717d4d38f5173","observation_id":"2393ba6f-3e14-4d71-8e14-73a252c42dc4","resolution":{"observed_at":"2026-08-04T23:39:12.411005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:11.988956Z","title":"NyxCache: Flexible and efficient multi-tenant persistent memory caching,","venue":null,"work_id":"a68ee2c8-0d7f-4138-b67c-9d2a0d40c8d8","year":2022},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:08.088152Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:d90fbfd21cd20ead795ad5351a6ea44a5d4a0b96e975b2b61a301d7114749a26","observation_id":"34140d50-9b9f-47c3-bac6-4390299b0e00","resolution":{"observed_at":"2026-08-04T23:39:12.107542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:11.831575Z","title":"TinyLFU: A highly efficient cache admission policy,","venue":null,"work_id":"3e4a8a28-2469-421a-86df-c82e4ae74354","year":2017},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:08.228622Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:c08a5d1db83c9bdfce99457c3ef57167a245fa820f07869713ab0cd530467f85","observation_id":"7cd55043-5d03-49bd-934d-f70664315653","resolution":{"observed_at":"2026-08-04T23:39:11.916770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:11.616366Z","title":"CacheBlend: Fast large language model serving for RAG with cached knowledge fusion,","venue":null,"work_id":"de954920-d300-483c-b3e9-d679e1fe59af","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:08.376122Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:feb6449e28cf2a7dd550ebd6713c8063c12aaec5472b7804e121d780c66914ee","observation_id":"e52f807e-2837-49e9-a41a-94b75d625a4d","resolution":{"observed_at":"2026-08-04T23:39:11.739259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:11.385156Z","title":"Oneiros: KV cache optimization through parameter remapping for multi-tenant LLM serving,","venue":null,"work_id":"22a5c219-446a-4532-bec8-79ceb6bea1f9","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:08.488487Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:a42ecf961154146aed0b78f2ca3d053c5d3f4a627a1e26073184fd7f17f0a690","observation_id":"9843a93a-fc54-491c-a553-03b251c23e44","resolution":{"observed_at":"2026-08-04T23:39:11.494632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:11.140069Z","title":"ServeGen: Workload characterization and generation of large language model serving in production,","venue":null,"work_id":"86da886f-4587-4736-b24c-e80f393bf06b","year":2026},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:08.612608Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:acc2b206eae301c17b13573e67e7c1fd2da525887d1691e51c913d000bea5b74","observation_id":"e80bb4ab-9b9d-4c1f-9d3e-bc2eaa8f2c3e","resolution":{"observed_at":"2026-08-04T23:39:11.250527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:10.893710Z","title":"IC-Cache: Efficient large language model serving via in-context caching,","venue":null,"work_id":"6809c0fd-c363-48cc-a8ca-9a516647a58b","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:08.814744Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:452de0edeaf6df3d0f84548fe1609cb0c36d0aec2e195e99860f38432b4130e8","observation_id":"f7b9beaf-771a-439a-be53-4e5b1b3dec39","resolution":{"observed_at":"2026-08-04T23:39:11.003651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:10.650924Z","title":"CacheGen: KV cache compression and streaming for fast large language model serving,","venue":null,"work_id":"fb79dfc8-b34a-45d7-bc53-77501701e0b2","year":2024},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:08.956548Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:45cf5f0fff2f22c5a900c2ab49f5b79f892b8b183cb822f879d489796af53d36","observation_id":"75cb134f-501c-4873-a8b6-340314b8e29b","resolution":{"observed_at":"2026-08-04T23:39:10.782441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:10.404474Z","title":"ThunderServe: High-performance and cost-efficient LLM serving in cloud environments,","venue":null,"work_id":"b506da28-ce2a-4c66-abe2-536ee643cb5f","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:09.072073Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:ccb3eba3c1d1761ac6cf651d230691a80193eaffdd3e1c8c551300006127af01","observation_id":"7bab2b8f-4ad4-4afd-8566-958bb6a29a01","resolution":{"observed_at":"2026-08-04T23:39:10.531597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:10.183352Z","title":"Jenga: Effective memory management for serving LLM with heterogeneity,","venue":null,"work_id":"f2ffe881-6710-4ce4-bac4-c32a0f7bb13f","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:09.242678Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:ce959b070afe6819874ac3841527c65409d236e3f64db51180e4cbc37bc2bd27","observation_id":"ce5eac51-163c-412e-94ac-9437cde73904","resolution":{"observed_at":"2026-08-04T23:39:10.329498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:09.885992Z","title":"LServe: Efficient long-sequence LLM serving with unified sparse attention,","venue":null,"work_id":"8b6cc694-dbc2-4684-ae73-b08c60fd1601","year":2025},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:09.394838Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:916fca99524a652c941ba4c3c4c2fceed9ddc70becc5c6d1eec3aca7b2163704","observation_id":"370e30f8-fc6a-476c-a98b-35f1b71f4d59","resolution":{"observed_at":"2026-08-04T23:39:10.003418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T23:39:09.671850Z","title":"Memory- efficient KV cache optimization for large language model inference at the edge,","venue":null,"work_id":"d0d4797e-c1a1-4903-8961-4fd1a87ceb4c","year":2026},"citing_paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T23:39:09.503875Z"},"links":{"citing_paper":"/paper/2608.01657"},"observation_digest":"sha256:0f09a682b3912462df2278881cdf3851f82ea5c6b5b2d5a3fe608c191155b749","observation_id":"7a66cbfc-27fd-4516-9ab4-d4402cda02e8","resolution":{"observed_at":"2026-08-04T23:39:09.787520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01657","last_updated":"2026-08-03T03:47:14Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-15T11:33:41.016269Z","submitted_at":"2026-08-03T03:47:14Z","title":"Preserving Admission Responsibility in Multi-Tenant Large Language Model Prefix Caches"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2608.01657."}