{"as_of":"2026-08-11T06:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:50e21e2d5b39783a33d509f8bed1a3bb8acca3e02d225bf76e9d904511349ccc","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T04:14:44.387842Z","state":"measured"},{"denominator":68,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":68,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.23640/citation-record","integrity":"/paper/2605.23640/integrity","json":"/paper/2605.23640/citation-record.json","paper":"/paper/2605.23640"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:cb42614dbd7fdeda9e3388930e6936129568da1d3b2be0f4051dbec3bc356b44","observation_id":"fb99ecfc-704e-4e06-a7f5-9a46ffc33ae4","resolution":{"observed_at":"2026-05-25T04:15:19.806963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"90d6de4c-5af6-4e26-b7fb-d5df5190165e","year":2001},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:f596344f06381dd2f98229b54860d28868e2dcab453cee18c3da59d79d952cc0","observation_id":"05691cad-bfd5-4185-84ce-81d6896f77fa","resolution":{"observed_at":"2026-05-25T04:15:21.071978Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"def3e10a-bb97-45d3-9727-b291948ea45c","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:ebc7d90adfe820cdd35bb579b5a4176b49cd08c2b3b7b0b511dce68edea27bc9","observation_id":"565c5081-21a6-4398-ba9d-4e397124d5ef","resolution":{"observed_at":"2026-05-25T04:15:21.088017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3c194fb8-7b13-4c32-91f7-de5b87753584","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:48c13df8ee797df9281256caf5385dfbcff68f3af7c63205036151e8c348089d","observation_id":"b7c2383e-96a5-4649-8b32-881712e75617","resolution":{"observed_at":"2026-05-25T04:15:21.169215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9b13a686-9499-4b99-81d5-c1fb2f2fa11f","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:9feaa1fb06174f6532d603095a2debf9fc52a8f325051a4e779797c4f465f539","observation_id":"9cc1c2ae-05bf-4295-ac3a-df57ab9a3ac6","resolution":{"observed_at":"2026-05-25T04:15:21.164900Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06821","last_updated":"2021-10-13T16:08:02Z","snapshot_observed_at":"2026-08-10T02:23:16.913491Z","submitted_at":"2021-10-13T16:08:02Z","title":"Leveraging redundancy in attention with Reuse Transformers","version":1},"cited_work":{"arxiv_id":"2110.06821","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2110.06821","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2110.06821 , year=","venue":null,"work_id":"1a9b19df-2396-41ba-9653-887eb5bb7965","year":2021},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2110.06821","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:73d84c8962c17e54f0ee05dfa33fc2c1debc49e231c951bb91c6703a4ddc8249","observation_id":"c396f4bf-1406-446a-9cb9-849f69097a87","resolution":{"observed_at":"2026-05-25T04:15:19.884310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d4fa2a08-ab40-4c2a-ac5b-d50a5486d4d6","year":2021},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:4d5012a2ee98b12346cb7a05119b433e807fdc360e7cbefcfca9f7325b9c1e18","observation_id":"06b66c85-b000-4fa3-94a6-92388c1a3b3e","resolution":{"observed_at":"2026-05-25T04:15:21.146155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3e83fa7d-ddc2-49e8-83be-8f84f0717e01","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:e0f4c1e1b3cd6d73166831ef45f76ce1babd93d6398ee95901271b1af8d65b31","observation_id":"25bda473-9b46-4a83-959f-e88ab3ce80d5","resolution":{"observed_at":"2026-05-25T04:15:21.153589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"17adb3d5-0dca-44ff-b9b6-c7a8a0cfbf28","year":1984},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:877c16389a2b0d2b1774777c7e470571ebd4f5843bf8ed27ffbf24a57ebe4a1c","observation_id":"735b3cea-97c4-4194-b2e6-3637244b3608","resolution":{"observed_at":"2026-05-25T04:15:21.160860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0d9bf87d-cdc6-4fd0-85b3-27a532e9b34c","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:556fa9528f5557ed28f714aa9abda298591f55a8ebe222cc4898b13ce09ddefd","observation_id":"db72557c-d74a-4523-ae84-617681605481","resolution":{"observed_at":"2026-05-25T04:15:21.173347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12ed4e78-5d4e-4f00-9d2e-c895774513a2","year":2018},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:d473637a25bf10bca33d6cab4f19cb9fcfcbde2a97f879fd61993ca32a553ebf","observation_id":"2afc1b16-e6fc-413c-84e9-8fdb16f82c7d","resolution":{"observed_at":"2026-05-25T04:15:21.181540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04212","last_updated":"2022-10-22T02:00:36Z","snapshot_observed_at":"2026-08-08T23:48:58.627701Z","submitted_at":"2022-03-08T17:21:27Z","title":"Measuring the Mixing of Contextual Information in the Transformer","version":3},"cited_work":{"arxiv_id":"2203.04212","doi":"10.48550/arxiv.2203.04212","metadata_source":"arxiv_reference","pith_arxiv_id":"2203.04212","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ferrando, G","venue":"arXiv (Cornell University)","work_id":"69fb16ba-26c1-44dc-b3fe-e4eecf9c78ed","year":2022},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2203.04212","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:199282fa0d0685ec914146f2cd8a0ad479e8e04f1e9eee51108272c1fd3825db","observation_id":"42fe8108-5bb5-4044-b53a-8cd85212fbb7","resolution":{"observed_at":"2026-05-25T04:15:19.906657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8dc52f8c-cd62-455b-8eee-a3c559ac16a9","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:41df496e3b02305d00c4aac22af5e2d3fdcef2e233a8966df4f2534c1362a8cb","observation_id":"48f3aa18-887f-413a-b96c-cd73f0b9af02","resolution":{"observed_at":"2026-05-25T04:15:21.192836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9696d49d-ba5c-4f7c-bae7-f21ecbfc0c35","year":2007},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:05e354b0291d9a4d8790675c368d565ba6cb65635c3bc93bf31b1e86f2917ba7","observation_id":"4d5cdf28-8052-44b3-ba9f-934c8680a4f8","resolution":{"observed_at":"2026-05-25T04:15:21.099873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"21a111fd-8f20-4121-ba5c-e37eb6ad6641","year":2005},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:2081b4d4979e75c7aa464d7a4a534a06d2460138eca7ff4b3f7252d66f5981b4","observation_id":"6e64e0ac-0cd1-4898-a7f5-88fa0d03e8c3","resolution":{"observed_at":"2026-05-25T04:15:21.044100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"74c6879f-a6ae-4988-8e21-07be273da71b","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:56f60b1b1c6246848e8cca7ec95af9074d9c54e9b3d9437356cd2ba9c2d4afce","observation_id":"1ad88e9a-5fd3-4542-96ed-af6fbdaa52d3","resolution":{"observed_at":"2026-05-25T04:15:21.048384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15332","last_updated":"2025-05-27T09:24:50Z","snapshot_observed_at":"2026-08-10T10:34:43.132720Z","submitted_at":"2024-10-20T08:42:29Z","title":"EPIC: Efficient Position-Independent Caching for Serving Large Language Models","version":3},"cited_work":{"arxiv_id":"2410.15332","doi":"10.48550/arxiv.2410.15332","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.15332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Epic: Efficient position-independent context caching for serving large language models","venue":"arXiv (Cornell University)","work_id":"ddb50312-3d0b-4bf6-82fa-cbe4972a4870","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2410.15332","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:d342f3a218f650969d65bfbce68dbe7b08e2312d1404ea09905a86671bc186c9","observation_id":"4acad4f8-620e-4e68-9a0e-771e8987acdd","resolution":{"observed_at":"2026-05-25T04:15:19.801774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1aebdbb0-b2b7-44d5-9841-b55be226a277","year":2020},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:4803dccc45d7acd28ac22cf6d432fc55cf33c4f8e7e527176251259cefb8e218","observation_id":"d7b15634-3c6b-4d25-9b0a-47317c0d8ab5","resolution":{"observed_at":"2026-05-25T04:15:21.014190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03065","last_updated":"2025-02-20T23:28:01Z","snapshot_observed_at":"2026-08-04T08:18:44.624754Z","submitted_at":"2024-10-04T01:11:09Z","title":"Compute Or Load KV Cache? Why Not Both?","version":2},"cited_work":{"arxiv_id":"2410.03065","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03065","snapshot_observed_at":"2026-07-02T01:36:26.266282Z","title":"Compute or load kv cache? why not both?","venue":null,"work_id":"6a5491ee-7696-49c3-8f7f-e68805f0095e","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2410.03065","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:7a8b4e0954d1215fef0a38d33ea0eefa4e71b7760009b6a5454f9445912acf27","observation_id":"520a9206-8d88-4a4b-a550-a6029e536c10","resolution":{"observed_at":"2026-05-25T04:15:19.855517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:46.302612Z","title":null,"venue":null,"work_id":"b48c7dbc-a37d-4a43-8cf4-4654d76acec3","year":2023},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:2832ec19761eef24be079d371231cd22cf27ee59a15cff77c4045d1188754370","observation_id":"6e7cf232-4d1c-4448-9d0f-2bfb518d1a70","resolution":{"observed_at":"2026-05-25T04:15:21.028795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T09:14:47.285692Z","title":null,"venue":null,"work_id":"065f81af-7c89-448e-9f7b-34b497637567","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:c2f1885b51f896462002f45450be852ba88ff567a42dbc7a28c7c4159aa2f9f0","observation_id":"683f5594-ccfb-419b-8acd-fa15ee824b23","resolution":{"observed_at":"2026-05-25T04:15:21.075893Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-08-11T00:33:34.388194Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"cited_work":{"arxiv_id":"2412.19442","doi":"10.48550/arxiv.2412.19442","metadata_source":"pith","pith_arxiv_id":"2412.19442","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A survey on large lan- guage model acceleration based on kv cache management","venue":"cs.AI","work_id":"5ad86189-256c-4911-bb00-fbfc90ae9a4e","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2412.19442","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:345042965e6f34cb2a57a2963564a64bc8138b724e7312df9a1c4889319e3b8d","observation_id":"2d3da708-27d3-4455-90a2-8660c097cc49","resolution":{"observed_at":"2026-05-25T04:15:19.844139Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:05.433835+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:05.433835+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:e5f1092c9667aca0f66ffd47e7deaeb02fd0b6e4c6539290120bc27a2068efc1","observation_id":"7384dd1a-bc63-4a6e-8038-9f1c4302d017","resolution":{"observed_at":"2026-05-25T04:15:19.895015Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7f264c77-9634-4d34-95cc-41d4198d5ede","year":2016},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:63e680aa183586d7c45d218ff2393e42be47801083412538d01ceacf39e4349e","observation_id":"283c4afa-b33c-43f6-bada-71ae2498a8e1","resolution":{"observed_at":"2026-05-25T04:15:21.185259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3d5f0e61-0191-449e-a802-d1d3b8838ef6","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:7c020659eec129757bd41041640c93534938f2e2c417a8428905e4df5c6e10b4","observation_id":"4f43529b-08cb-47fe-a8a0-c76adef93a48","resolution":{"observed_at":"2026-05-25T04:15:21.142137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12574","last_updated":"2025-02-18T06:26:05Z","snapshot_observed_at":"2026-08-07T18:10:05.234466Z","submitted_at":"2025-02-18T06:26:05Z","title":"HeadInfer: Memory-Efficient LLM Inference by Head-wise Offloading","version":1},"cited_work":{"arxiv_id":"2502.12574","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.12574","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Headinfer: Memory-efficient llm inference by head-wise offloading","venue":null,"work_id":"cc512f42-8c1a-43bd-8633-48ad0e20f9d4","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2502.12574","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:bbab21ac980cf9da2ae7ebe41186ae64cb985fb6ca135e2a42eb8c758cb17b6a","observation_id":"ce3b0670-1ab6-40f6-a70b-f415b16f32d4","resolution":{"observed_at":"2026-05-25T04:15:19.866746Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.09442","doi":"10.48550/arxiv.2508.09442","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Shadow in the cache: Unveiling and mitigating privacy risks of kv-cache in llm inference","venue":"arXiv (Cornell University)","work_id":"4401ea0d-ef04-4a70-9e41-444288d0fb08","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:106cba7b84b5eca6d90d1825d8b885ac85fc7ba87b7a5db3b945f338a50b0cb8","observation_id":"f9802fd4-55b2-4a94-b33c-472f7c3130dc","resolution":{"observed_at":"2026-05-25T04:15:19.872471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2010.Guide to protecting the confidentiality of personally identifiable information","venue":null,"work_id":"a7e8f415-ae83-4d06-9fa3-b3f3971679c6","year":2010},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:d381b5cc64abfe3c17acceaf93611c361a12d9daa75187bab095a93279699304","observation_id":"239df5c7-0e4b-4cdf-9cd3-70992c947b3e","resolution":{"observed_at":"2026-05-25T04:15:21.126565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"43068caf-4406-4e3b-97cc-ec60e7c0f741","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:f2757f4c3a70ef608075d4547cbdeb7d526bad25b35e734eaf9503b1fea515d4","observation_id":"5b9456b0-7f30-478f-85cd-890a5fd632de","resolution":{"observed_at":"2026-05-25T04:15:21.130550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c6be2ff0-d567-4b3c-b5e9-b5de65c97746","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:cabeb6c81066a888bceb9e4f0f7637b548314b7ca0e60cc677b62bc9649d3cf4","observation_id":"7988345d-d7b5-4976-a767-7edac79db759","resolution":{"observed_at":"2026-05-25T04:15:21.138229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d13bf98c-4f48-4df4-acea-2c58fe53ecab","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:8ebae827a56c47b5c2c576faf967c736d0c194516ab1faec502918fbf651b19f","observation_id":"0edb045b-bb40-4408-a2de-8f11d7d35e8a","resolution":{"observed_at":"2026-05-25T04:15:21.111267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"129dbc83-6ebf-4827-949c-d847c059b4b1","year":2014},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:4349c99fcd74934b58fd7932d99382aa50c8111208869a2440bfe34e610f5494","observation_id":"0c8be333-b950-492c-81ab-4080119f6e3b","resolution":{"observed_at":"2026-05-25T04:15:21.107460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4e4e9828-577c-46c4-9755-1f6873fb845f","year":2007},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:550773f1860b3a24aa621b5e458e69cb3d68138a430814d055c6bf37f5878982","observation_id":"3344b0b5-d764-4c1c-9f3e-a1b9e628bca1","resolution":{"observed_at":"2026-05-25T04:15:21.114971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01474","last_updated":"2023-10-14T04:34:00Z","snapshot_observed_at":"2026-08-09T23:14:05.415823Z","submitted_at":"2023-02-03T00:41:01Z","title":"Defensive ML: Defending Architectural Side-channels with Adversarial Obfuscation","version":2},"cited_work":{"arxiv_id":"2302.01474","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2302.01474","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1be61e7f-3f20-4091-acce-faf20d8205d1","year":2023},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2302.01474","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:3b03a3bcf39a48a5d3f3cd67e190ec08502303a105afc250867ff857fa41f53a","observation_id":"b792bf42-51bc-408a-b31c-cdcc7d738d56","resolution":{"observed_at":"2026-05-25T04:15:19.849450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"personally identifiable information","venue":null,"work_id":"197954e4-5ff5-4c4f-9ffa-5dea6f835f2d","year":2010},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:40fc6e8eb5fa916cfa5e07ed294659c290d6677930e36cbacd85f713de2300be","observation_id":"df68ec6b-50c5-40be-8d04-ab34c22ba9c4","resolution":{"observed_at":"2026-05-25T04:15:21.118967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5f6c9357-2fc9-48d6-a754-74890f88df85","year":2023},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:0b3e6172bfd71f7d6cb7ece19a5e5f8ff2a4879988feb57f3a6bc37808d0c6ea","observation_id":"8f6a361f-8e77-43a5-9017-a60f229cba4a","resolution":{"observed_at":"2026-05-25T04:15:21.122499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"37a80a5d-5ce6-4479-a9f4-889bd8b73fd4","year":2018},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:cae7e89620bcd5616325a43a2f02ee06c80e3ef5856f68b34678d02fe6016dd0","observation_id":"bdef8d38-36c6-4f44-b3b7-81e133cd376f","resolution":{"observed_at":"2026-05-25T04:15:21.134533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22305","last_updated":"2025-06-27T15:16:43Z","snapshot_observed_at":"2026-08-10T01:26:41.558624Z","submitted_at":"2025-06-27T15:16:43Z","title":"Detection of Personal Data in Structured Datasets Using a Large Language Model","version":1},"cited_work":{"arxiv_id":"2506.22305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.22305","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"26b5df19-0e29-4add-a64b-d7fc90cb76d7","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2506.22305","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:6b1fb518b284b1aef71ef257c244c89c8eee4afa7d81f1b3ebf0a7b80b857a08","observation_id":"dd30253c-df3a-4d70-9b46-c57295e81f60","resolution":{"observed_at":"2026-05-25T04:15:19.861071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d7f001a0-9957-41f3-8622-e48ad45cd84b","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:8290e39e07a59b6c5a3a71d0972433d71e4ff7ea0d849cb5d469878c927a7caf","observation_id":"020c82c0-5962-4443-97e4-4cde70aa2f75","resolution":{"observed_at":"2026-05-25T04:15:21.189133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9aeaad5b-c9e8-469a-8c8e-af281182b23c","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:96941802adca2ee15e2a9c1b5c0d2f384946154ed384ed877bafc130d07aaa1f","observation_id":"8022297b-e3ab-4492-9c12-a8fb9fc681ff","resolution":{"observed_at":"2026-05-25T04:15:21.095895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d481cb39-4222-4dd8-8774-ca25ffe6e175","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:478ea3b39601a74c25456317cea2c457689a4624b7349fc1b13c0795c09b8d8e","observation_id":"92e49d20-c60a-46ed-90c8-824bab3b9cef","resolution":{"observed_at":"2026-05-25T04:15:21.103917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bc8e2fb2-fb9a-4b2a-977b-8828a1c6d381","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:317583fe7f67f69ca519415e3d93377e2aadb8f73a1a70d9c257aca29cb8f01d","observation_id":"9f3505e9-97bf-4f8f-a3ac-cfbbc802f994","resolution":{"observed_at":"2026-05-25T04:15:21.055874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"211b8bbd-d005-45ac-abc9-60d97bf88ceb","year":2026},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:d1eb0010e22b04ddd28932f0a1b4020c8dba5905b7dc180eec5d76e665c923e9","observation_id":"974b53ae-b35b-45ef-984a-97ce07b32392","resolution":{"observed_at":"2026-05-25T04:15:21.059941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"12700e9d-4f73-4f5e-aeb4-34c3b465cefd","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:144799aaf47d431fb36904a1bb6b997c55d3bc568508fc9dd540979aab0ae93d","observation_id":"3b7c6daa-cf3e-40d3-aec7-85faf4efba44","resolution":{"observed_at":"2026-05-25T04:15:21.064510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"53f0842f-a349-4507-8d00-5ee7162f0fef","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:397ae9b64261fff4044a9f48b290fe907659665b1f96ac40ed3a4b37e0ecfe44","observation_id":"3d293e41-5bcb-4676-b7af-46e3ffd63c16","resolution":{"observed_at":"2026-05-25T04:15:21.068246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b7f0196f-2598-42c9-ae2c-a69c382f20df","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:9e7bdc7a8f95e76a0acbfc60784c6cffd487f54369ed39f3c66cd7baeef9b1d7","observation_id":"2c4beb66-af46-4abb-92cd-0e3e64d6fec8","resolution":{"observed_at":"2026-05-25T04:15:21.084499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7066af47-993d-4199-a1ee-b3f9ca2336bc","year":null},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:2f8ec0dc681478db7110e36c1e42666a10433572884fa0c586a4a4dd6fbf632a","observation_id":"5ac5268d-2091-4929-a07e-edbd06e8e61a","resolution":{"observed_at":"2026-05-25T04:15:21.052072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.12302","last_updated":"2019-09-26T01:54:19Z","snapshot_observed_at":"2026-08-09T19:33:00.247170Z","submitted_at":"2019-09-26T01:54:19Z","title":"New Attacks and Defenses for Randomized Caches","version":1},"cited_work":{"arxiv_id":"1909.12302","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1909.12302","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"32d6a274-6825-4004-87c5-8f617c7fc7c2","year":1909},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/1909.12302","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:c4f70a941439cd07f8f5f3a094c01405e3ad4ff25b3311e2b686e4faba6437a0","observation_id":"509c0358-046e-428d-97d5-1b319d47f835","resolution":{"observed_at":"2026-05-25T04:15:19.831374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4d7e7011-6533-4bc6-9aef-672e1469d59b","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:6a6ba6c26578af4d6f3a405ca1c224e128fee5e2b0dc6fa4dcdec0b4e4f5f7bd","observation_id":"b6c62621-1c8c-4301-aff8-d15f9520be69","resolution":{"observed_at":"2026-05-25T04:15:21.197190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3adb5751-d5d2-4a23-adcc-99b6a49b1baa","year":2011},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:3290e07575b2878ee3d445c41975b02b51cf2791eb5c47b3497a4decffd104b3","observation_id":"d0981300-c825-413a-be18-c3173170f043","resolution":{"observed_at":"2026-05-25T04:15:21.177507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2409.20002","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T08:29:42.318575Z","title":"The early bird catches the leak: Unveiling timing side channels in llm serving systems","venue":null,"work_id":"bea348f9-cc91-4a48-9935-0a340621d89f","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:c257f3d6ee5971eafc587c8a049cc51392214332a5f89627a592690ad87e6fae","observation_id":"0bec9581-da6e-45af-b2d3-309a1700e107","resolution":{"observed_at":"2026-05-25T04:15:19.889824Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07298","last_updated":"2024-05-06T15:52:03Z","snapshot_observed_at":"2026-08-09T16:12:48.621980Z","submitted_at":"2023-10-11T08:32:46Z","title":"Beyond Memorization: Violating Privacy Via Inference with Large Language Models","version":2},"cited_work":{"arxiv_id":"2310.07298","doi":"10.48550/arxiv.2310.07298","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.07298","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Staufer, D.; and Morehouse, K","venue":"arXiv (Cornell University)","work_id":"33dae504-7a1a-4a23-a82f-5624d3f3ce73","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2310.07298","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:46ea7f4ce2da452dbacac21975d625919948c50983bd5910c5903aaecdf4fd31","observation_id":"ed8933f9-7a0d-4e19-bcab-7a0c60671543","resolution":{"observed_at":"2026-05-25T04:15:19.901013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10938","last_updated":"2025-05-16T07:23:12Z","snapshot_observed_at":"2026-08-07T15:44:49.055288Z","submitted_at":"2025-05-16T07:23:12Z","title":"Accurate KV Cache Quantization with Outlier Tokens Tracing","version":1},"cited_work":{"arxiv_id":"2505.10938","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.10938","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Bell System Technical Jour- nal, 27(3):379–423","venue":null,"work_id":"344ac850-3254-4a9b-ae5a-58766f7e9140","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2505.10938","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:084ff405c6ff329d39cb051a0b97662c0e0d382f4e13b655ef9201ed680d319e","observation_id":"28514feb-dc3e-4535-8cb4-f46ed89f621c","resolution":{"observed_at":"2026-05-25T04:15:19.938439Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15891","last_updated":"2024-07-22T01:12:23Z","snapshot_observed_at":"2026-07-06T18:50:13.559866Z","submitted_at":"2024-07-22T01:12:23Z","title":"RazorAttention: Efficient KV Cache Compression Through Retrieval Heads","version":1},"cited_work":{"arxiv_id":"2407.15891","doi":"10.48550/arxiv.2407.15891","metadata_source":"pith","pith_arxiv_id":"2407.15891","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RazorAttention: Efficient KV cache compression through retrieval heads","venue":"cs.LG","work_id":"0e066643-af21-4206-a9bf-da8439d52d13","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2407.15891","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:a32b03e3fcce7c07ddd804af64db73a79ddb3bfd203e6fe8b6134e4ca64dcd20","observation_id":"3a1288c0-d724-4f1b-913c-a620b875bd93","resolution":{"observed_at":"2026-05-25T04:15:19.878777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:df442aefaf88c0ab1651cc41e7ad2fbba51937b7cf30b32b98eb55d1b772a0c8","observation_id":"cfc5539f-b50b-4991-a4c4-c8e0f189623b","resolution":{"observed_at":"2026-05-25T04:15:19.949666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.350515+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T09:26:09.599187Z","title":null,"venue":null,"work_id":"cc7706e1-24dd-411e-b9a3-4ca23c1fe501","year":2017},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:5bf64fbb38f167eed7b55f514644a8aa6abed407e376d43f42147784294a7e25","observation_id":"0707532f-7260-4ecd-b0a8-666f495920f7","resolution":{"observed_at":"2026-05-25T04:15:21.092071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04284","last_updated":"2019-06-18T19:42:31Z","snapshot_observed_at":"2026-07-06T07:59:23.899551Z","submitted_at":"2019-06-07T13:58:49Z","title":"Analyzing the Structure of Attention in a Transformer Language Model","version":2},"cited_work":{"arxiv_id":"1906.04284","doi":"10.48550/arxiv.1906.04284","metadata_source":"pith","pith_arxiv_id":"1906.04284","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Analyzing the Structure of Attention in a Transformer Language Model","venue":"cs.CL","work_id":"45dd9488-8b79-4e73-be3f-59f47605b22e","year":2019},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/1906.04284","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:685d417e7e30097bf300071680466af4477bf21e46bb190628c5eb4e81528703","observation_id":"5aa506b7-1a0c-455f-aefb-4df74bb1766b","resolution":{"observed_at":"2026-05-25T04:15:19.819560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08879","last_updated":"2025-03-11T20:45:02Z","snapshot_observed_at":"2026-08-11T02:55:45.516067Z","submitted_at":"2025-03-11T20:45:02Z","title":"LLMs Know What to Drop: Self-Attention Guided KV Cache Eviction for Efficient Long-Context Inference","version":1},"cited_work":{"arxiv_id":"2503.08879","doi":"10.48550/arxiv.2503.08879","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08879","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wei, J., Wang, X., Schuurmans, D., Bosma, M., Ichter, B., Xia, F., Chi, E., Le, Q., and Zhou, D","venue":"ArXiv.org","work_id":"e12f679e-9f5f-4fd4-9160-306a9bb2d556","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2503.08879","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:c513101746a2394fdc5f5d795db4a5c3a0c427a3d31186af29ec286b62d3d586","observation_id":"f3425303-f25c-4e0a-b991-7560c2f8ba62","resolution":{"observed_at":"2026-05-25T04:15:19.813677Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:09.968526+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20595","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ec0f6c3c-53e0-44c0-b865-ca03f57ab2a8","year":2026},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:f91f579574e33f4a2ed8291e324d9561ff5a04920e923f2a44dbefde2f2baa53","observation_id":"8376708a-a7c3-4656-9478-5b0ea528fbea","resolution":{"observed_at":"2026-05-25T04:15:19.944630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6aa8929b-5902-4fa7-a2d2-de4b8e2a9911","year":2019},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:e1f3202f10a241fce029b01ea1dcfe40a4f75d99afdcb58e3d062bd6c904cd7a","observation_id":"4efc8d56-2573-49df-81e9-d2ad1306e603","resolution":{"observed_at":"2026-05-25T04:15:21.080469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4595ba00-349c-480e-869d-e1d03a954e7f","year":2026},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:4df7d0624c435cc1284c1f8ffb94bac6f6db65f4da3d631f1f843682eec4b3f2","observation_id":"14a9d855-c1c2-4fd1-9afe-b9f42f48db2f","resolution":{"observed_at":"2026-05-25T04:15:21.032565Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1fb64a01-0aca-4556-8d92-4951e78016f6","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:2d9b0b7e7cc53d802d80fc443b1dcf38e0e3a94a05d54a0bc5ca593604bae414","observation_id":"80895161-4038-4e59-9203-fd7d438cde70","resolution":{"observed_at":"2026-05-25T04:15:21.036558Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"25c26b8d-c224-4cd1-8e44-d49df623859d","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:0f6c95d66d53a9d7591ee6969fff33a90f2ef06759fb8f42ed96a3b90da77056","observation_id":"f7d7fd37-5b6f-4e15-9575-d79f9dd48ae1","resolution":{"observed_at":"2026-05-25T04:15:21.021430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2ccdc88f-ebc6-4f8b-aacc-7f62f6d91d39","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:d114e94590ef8f0da1f4276a680c2764c6089f9a59023617383f261e35907580","observation_id":"9709c33f-2a33-4253-a51c-3b16a6f8a8bb","resolution":{"observed_at":"2026-05-25T04:15:21.017874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b211fb17-6b0d-4b7b-9f2f-0d8faf7c721d","year":2025},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:1d2c9cd7fb8f60cc6c83b58151bd8cea8c9fd36caf56104de0f9f597d89d59d2","observation_id":"d8a2c4b1-23bd-491a-a627-53ef5c0afdcf","resolution":{"observed_at":"2026-05-25T04:15:21.024967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:08b053fa284c839f02eef53375142ad1ce877f2c49f71e153b2f34b32095993f","observation_id":"8f267c12-267a-4518-a9a3-4c09ca510dfc","resolution":{"observed_at":"2026-05-25T04:15:19.825215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T07:53:27.986740Z","title":null,"venue":null,"work_id":"8fd449f5-db08-4e53-9c24-29d53ebde02e","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:35fbbea3c39199e5eca79eb85e7096f95952033a0c324fa9f95de7af70ea7bc8","observation_id":"2a2b4ff2-22d7-4236-a16f-ad55fa632a6b","resolution":{"observed_at":"2026-05-25T04:15:21.040615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18191","last_updated":"2024-11-29T08:33:49Z","snapshot_observed_at":"2026-08-10T21:51:56.098472Z","submitted_at":"2024-11-27T10:14:38Z","title":"InputSnatch: Stealing Input in LLM Services via Timing Side-Channel Attacks","version":2},"cited_work":{"arxiv_id":"2411.18191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18191","snapshot_observed_at":"2026-07-04T08:29:42.345373Z","title":"Inputsnatch: Stealing input in llm services via timing side-channel attacks","venue":null,"work_id":"10691862-b5f3-4004-9363-4a9d5fe7697d","year":2024},"citing_paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-25T04:14:44.387842Z"},"links":{"cited_paper":"/paper/2411.18191","citing_paper":"/paper/2605.23640"},"observation_digest":"sha256:e331e110b634b626f445c616a9c5ae4b7336cadc37ec257b11f509fbd733881f","observation_id":"698b1973-37d7-4b42-b6a7-f5812744baa2","resolution":{"observed_at":"2026-05-25T04:15:19.795495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.23640","last_updated":"2026-05-22T13:54:21Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T23:33:49.013121Z","submitted_at":"2026-05-22T13:54:21Z","title":"CachePrune: Privacy-Aware and Fine-Grained KV Cache Sharing for Efficient LLM Inference"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":22,"verified_fuzzy":2},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 0 inbound Pith citation observations for arXiv:2605.23640."}