{"as_of":"2026-08-08T22:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7570d9c5e6b655eb6270e1b0f7564e8eb26ca338441133cc57c24cee25545275","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:42:22.203859Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-07T15:42:22.203859Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14085","last_updated":"2025-05-20T08:46:23Z","snapshot_observed_at":"2026-08-08T11:21:29.807119Z","submitted_at":"2025-05-20T08:46:23Z","title":"CE-LSLM: Efficient Large-Small Language Model Inference and Communication via Cloud-Edge Collaboration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:22.203859Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2505.14085"},"observation_digest":"sha256:af04e6c7dec3ca187e57a3de1c935791fa29ce7f0e9e565365f4453ff5b712e2","observation_id":"cb0bdeff-ff8b-439d-9382-c80aa88a7e44","resolution":{"observed_at":"2026-08-07T15:42:22.203859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-06T18:46:58.887052Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08045","last_updated":"2025-08-26T01:55:27Z","snapshot_observed_at":"2026-08-06T18:40:17.677334Z","submitted_at":"2025-07-10T01:51:17Z","title":"Krul: Efficient State Restoration for Multi-turn Conversations with Dynamic Cross-layer KV Sharing","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:46:58.887052Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2507.08045"},"observation_digest":"sha256:781f0f69ac86ea2aa4913221ba8af2e22d09cadb6b19ed3d53f94cbf5ecc26eb","observation_id":"a2afa0d6-aa70-47a2-b4a8-3a10d64c8654","resolution":{"observed_at":"2026-08-06T18:46:58.887052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-06T17:05:38.032536Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11942","last_updated":"2025-07-16T06:16:06Z","snapshot_observed_at":"2026-08-06T16:55:31.791744Z","submitted_at":"2025-07-16T06:16:06Z","title":"DAC: A Dynamic Attention-aware Approach for Task-Agnostic Prompt Compression","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:05:38.032536Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2507.11942"},"observation_digest":"sha256:aebf3c9aa7f3eaafd9552186562c268c6597a17b89757700b3f1b2ab592ad8ac","observation_id":"4fc64448-48af-47d5-9ec4-07d0718bf081","resolution":{"observed_at":"2026-08-06T17:05:38.032536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T17:55:09.149968Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.15881","last_updated":"2025-08-25T02:24:20Z","snapshot_observed_at":"2026-08-05T17:55:04.790166Z","submitted_at":"2025-08-21T15:25:40Z","title":"TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T17:55:09.149968Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2508.15881"},"observation_digest":"sha256:c29a9ccdb1fd3799aae60dd88d126db117515de2bccaea81b10f1fcb54218e92","observation_id":"9d040f08-9e60-418b-ae63-6fe5022c1419","resolution":{"observed_at":"2026-08-05T17:55:09.149968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2604.08426","last_updated":"2026-05-15T16:23:48Z","snapshot_observed_at":"2026-08-03T00:42:33.853267Z","submitted_at":"2026-04-09T16:30:44Z","title":"KV Cache Offloading for Context-Intensive Tasks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-10T16:49:13.353700Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2604.08426"},"observation_digest":"sha256:57adaa78ce9e6eb557fe95f95f052328c71c40cbe890ee23b1573715f4bb3d81","observation_id":"4efdeef7-1341-44fd-a637-566c5873af2b","resolution":{"observed_at":"2026-05-11T08:06:01.070207Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2604.08426","last_updated":"2026-05-15T16:23:48Z","snapshot_observed_at":"2026-08-03T00:42:33.853267Z","submitted_at":"2026-04-09T16:30:44Z","title":"KV Cache Offloading for Context-Intensive Tasks","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-11T01:48:21.341462Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2604.08426"},"observation_digest":"sha256:dfd967e103ee90577e2b06f32c3378b9e00e53a24b4600af1b462beaac466dd8","observation_id":"b6eb3bc7-4b7c-4e77-a754-ab30c7a569d8","resolution":{"observed_at":"2026-05-11T04:20:56.329773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2604.08426","last_updated":"2026-05-15T16:23:48Z","snapshot_observed_at":"2026-08-03T00:42:33.853267Z","submitted_at":"2026-04-09T16:30:44Z","title":"KV Cache Offloading for Context-Intensive Tasks","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-13T07:35:30.155592Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2604.08426"},"observation_digest":"sha256:da81772fcd3bdc516871bc0774ad471b2fbc4a9d8cef7b6cb73ace1f6ff69c68","observation_id":"e5bbb768-7ef9-428b-bdb8-f331390ed779","resolution":{"observed_at":"2026-05-13T07:37:29.359925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2604.08426","last_updated":"2026-05-15T16:23:48Z","snapshot_observed_at":"2026-08-03T00:42:33.853267Z","submitted_at":"2026-04-09T16:30:44Z","title":"KV Cache Offloading for Context-Intensive Tasks","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-19T16:41:30.021302Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2604.08426"},"observation_digest":"sha256:d60797bc6e8823996476abd2fc21a1cbf3a97f8b4118f4fcc8f8d4c536c33330","observation_id":"68c3de40-ec0f-4cd0-ab8e-2ce7dfac54f4","resolution":{"observed_at":"2026-05-19T16:42:39.678397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2605.12464","last_updated":"2026-05-12T17:50:08Z","snapshot_observed_at":"2026-08-02T04:50:55.914032Z","submitted_at":"2026-05-12T17:50:08Z","title":"Search Your Block Floating Point Scales!","version":1},"reference_index":165,"source":"arxiv_source","source_observed_at":"2026-05-13T05:52:26.558984Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2605.12464"},"observation_digest":"sha256:c8d532bb5aa899bdf17b2633d945b353ef2300652d4d8b5b1d95c2b15d07c87d","observation_id":"e244df9e-48c9-4a49-825a-6c22cdd40548","resolution":{"observed_at":"2026-05-13T06:02:24.086901Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2605.15852","last_updated":"2026-05-28T02:32:12Z","snapshot_observed_at":"2026-07-06T23:27:05.961780Z","submitted_at":"2026-05-15T11:07:33Z","title":"GHOST: Geometry-Hierarchical Online Streaming Token Eviction for Efficient 3D Reconstruction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T19:53:19.060333Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2605.15852"},"observation_digest":"sha256:8362cf4bcedae04e8e77d1fa6dc97dc6e1f2a8f7bd069f886a0df81c31fa07f1","observation_id":"2f11208f-d422-4ec3-9aff-6a8a2356a084","resolution":{"observed_at":"2026-05-20T19:53:42.112014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2605.15852","last_updated":"2026-05-28T02:32:12Z","snapshot_observed_at":"2026-07-06T23:27:05.961780Z","submitted_at":"2026-05-15T11:07:33Z","title":"GHOST: Geometry-Hierarchical Online Streaming Token Eviction for Efficient 3D Reconstruction","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T19:19:55.184680Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2605.15852"},"observation_digest":"sha256:cbe7b33146386007e975b7a4575dc70d5215608cf6d3f47d944994f0865fa441","observation_id":"e6679aa2-1413-4742-8cce-17d7eea2c94c","resolution":{"observed_at":"2026-06-30T19:25:01.149534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2606.31093","last_updated":"2026-06-30T03:29:21Z","snapshot_observed_at":"2026-08-01T17:26:20.214245Z","submitted_at":"2026-06-30T03:29:21Z","title":"Omni-Flow: A Unified Workflow Orchestration and Distributed KV Cache Sharing Framework for Multimodal Inference","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-01T04:13:53.722933Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2606.31093"},"observation_digest":"sha256:c98915ca58cebfb2b4e55f7c2ed82bd1b5322c88076644b1037d5df7f13004d4","observation_id":"8d14f86a-fa42-4725-bef5-1dbce3df122b","resolution":{"observed_at":"2026-07-01T11:35:43.609661Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-07-12T09:50:23.266920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.02574","last_updated":"2026-06-30T16:12:40Z","snapshot_observed_at":"2026-07-12T09:50:22.497230Z","submitted_at":"2026-06-30T16:12:40Z","title":"From Tensor Buffer to Distributed Memory Hierarchy: A Survey of KV Cache Management for LLM Serving","version":1},"reference_index":131,"source":"pdf_text","source_observed_at":"2026-07-12T09:50:23.266920Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2607.02574"},"observation_digest":"sha256:03088ff3123e468586b385fd0da6664fc4ffa5f9cb7826b4310716f0858d86b3","observation_id":"fb14401e-9525-4195-aa45-540bc482c6cb","resolution":{"observed_at":"2026-07-12T09:50:23.266920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2607.06519","last_updated":"2026-07-07T17:26:28Z","snapshot_observed_at":"2026-08-06T13:47:36.380110Z","submitted_at":"2026-07-07T17:26:28Z","title":"FreqDepthKV: Frequency-Guided Depth Sharing for Robust KV Cache Compression in Long-Context LLM Inference","version":1},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-07-11T00:12:13.830917Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2607.06519"},"observation_digest":"sha256:1566e1cfd9969d96c30c3fae070375eb068884628115469ada55bf8ab798884f","observation_id":"1b0a132e-55d5-4960-adb1-3de21e0f800d","resolution":{"observed_at":"2026-07-11T00:17:45.947772Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing","version":1},"cited_work":{"arxiv_id":"2410.18517","doi":"10.48550/arxiv.2410.18517","metadata_source":"pith","pith_arxiv_id":"2410.18517","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kvsharer: Efficient inference via layer-wise dissimilar kv cache sharing","venue":"cs.LG","work_id":"eb8d4c57-78da-40bd-9d68-ecb60a0c3dc2","year":2024},"citing_paper":{"arxiv_id":"2607.06523","last_updated":"2026-07-07T17:29:01Z","snapshot_observed_at":"2026-07-10T23:18:28.096764Z","submitted_at":"2026-07-07T17:29:01Z","title":"DepthWeave-KV: Token-Adaptive Cross-Layer Residual Factorization for Long-Context KV Cache Compression","version":1},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-07-08T03:07:23.648382Z"},"links":{"cited_paper":"/paper/2410.18517","citing_paper":"/paper/2607.06523"},"observation_digest":"sha256:cbe7beab5f2667ebbf857784ae9d51410a4f8ec025867b36c1208dacafca8b5b","observation_id":"6b814c58-4305-4ff3-8b33-9d9f0ce0a61d","resolution":{"observed_at":"2026-07-08T03:14:31.597711Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:19.778483+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2410.18517/citation-record","integrity":"/paper/2410.18517/integrity","json":"/paper/2410.18517/citation-record.json","paper":"/paper/2410.18517"},"outbound":[],"paper":{"arxiv_id":"2410.18517","last_updated":"2024-10-24T08:06:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T20:05:52.541270Z","submitted_at":"2024-10-24T08:06:41Z","title":"KVSharer: Efficient Inference via Layer-Wise Dissimilar KV Cache Sharing"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2410.18517."}