{"as_of":"2026-08-08T01:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:33db13fa016dcf470f4ef07c94c2dabde13c7126541627fb7601ca687f866647","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:16:42.984625Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:45:12.553567Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T17:55:13.328095Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19586","snapshot_observed_at":"2026-08-06T19:45:12.553567Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.04723","last_updated":"2025-07-07T07:33:24Z","snapshot_observed_at":"2026-08-07T06:43:20.530023Z","submitted_at":"2025-07-07T07:33:24Z","title":"LOOM-Scope: a comprehensive and efficient LOng-cOntext Model evaluation framework","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T19:45:12.553567Z"},"links":{"cited_paper":"/paper/2505.19586","citing_paper":"/paper/2507.04723"},"observation_digest":"sha256:f4872fe761d6513b320598f6f7a330bc9fe1f5a27e5b5a477ba5d11e6c586e25","observation_id":"c81e1b24-b203-471f-98e7-755364f2c47d","resolution":{"observed_at":"2026-08-06T19:45:12.553567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"cited_work":{"arxiv_id":"2505.19586","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.19586","snapshot_observed_at":"2026-08-05T17:55:13.328095Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","venue":"cs.CL","work_id":"5513fbf1-372d-4b64-a37e-eafa041e9116","year":2025},"citing_paper":{"arxiv_id":"2508.15881","last_updated":"2025-08-25T02:24:20Z","snapshot_observed_at":"2026-08-05T17:55:04.790166Z","submitted_at":"2025-08-21T15:25:40Z","title":"TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T17:55:10.372511Z"},"links":{"cited_paper":"/paper/2505.19586","citing_paper":"/paper/2508.15881"},"observation_digest":"sha256:978096f4998a5de3e25062ad733a5b15bb254b490ac72111c02cc101d58ddae7","observation_id":"06792c92-3127-4413-b66c-d107532327c0","resolution":{"observed_at":"2026-08-05T17:55:13.365091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19586/citation-record","integrity":"/paper/2505.19586/integrity","json":"/paper/2505.19586/citation-record.json","paper":"/paper/2505.19586"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:46.240055Z","title":null,"venue":null,"work_id":"0fe2d842-694a-4e23-85b8-43d19f5bdc85","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:38.963314Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:9ac06e46b7931672f4b80af6e44cec24e6e0431be64aa488c6d68bbe4754c049","observation_id":"0009c9d3-4a69-441a-84cb-52e148f9e73e","resolution":{"observed_at":"2026-08-07T14:16:46.286667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:46.064402Z","title":null,"venue":null,"work_id":"cf337ce7-a74a-433c-8b42-001c046237a1","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.013330Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:2990923394c01cd8b72b68090bbe667beea5f99b427b16692519cbbbf8e2b59b","observation_id":"e61ec203-ee94-4a34-acf9-b5da69754873","resolution":{"observed_at":"2026-08-07T14:16:46.145966Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:16:39.105730Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.105730Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:ceb9bfccbd1ba88d35b9a61e1efa0ecd281f9de58d71409ef1bc9a26772fd38a","observation_id":"56da942a-5538-4a0f-801a-95e2e1113a05","resolution":{"observed_at":"2026-08-07T14:16:39.105730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.190085Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.190085Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:5ee480a8da6d87f151483f20b8d60ae68255e76757a48c9e4d4d255a8c390ad9","observation_id":"bff1fdef-e70e-4e89-ae0f-f8f661f4b18d","resolution":{"observed_at":"2026-08-07T14:16:39.190085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-07T14:16:39.266790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.266790Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:039c99098f1e7abfe0d2efdb770f15b624a7d96763c282633ec835d14bcd3308","observation_id":"3da24f0b-5d7d-4529-b2cc-5e6e828b937e","resolution":{"observed_at":"2026-08-07T14:16:39.266790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.854816Z","title":null,"venue":null,"work_id":"24e070e6-6dad-431e-8d0c-861478d46a0f","year":2025},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.358085Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:83b7d5de3e6e17688062087dbb27147d7246acf1e8b23f7799ed5c451aad8b55","observation_id":"b0700a1d-b0be-4d48-a286-c8dc4035002d","resolution":{"observed_at":"2026-08-07T14:16:45.978753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.438404Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.438404Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:e2989e6ea1ed3f9d15f3e8c5069b97adb84c405e872270ff226b875ecf225267","observation_id":"c358e741-9b03-4389-adaa-4897f3af5a9c","resolution":{"observed_at":"2026-08-07T14:16:39.438404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.530091Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.530091Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:f8f17f435d9c7c94ee5afe8d2b47493e283c0190dfa2504eb15f48cf94d0a654","observation_id":"7917efbd-44f6-4c9b-adca-9457f47d1654","resolution":{"observed_at":"2026-08-07T14:16:39.530091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:16:39.619435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.619435Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:2577fd2bcb360ad1f5f9890925c2fa04cf75e2a5b9618e941ebce89fcdee0cda","observation_id":"050c77f7-e884-40c9-8c1c-5b1a9e8b8769","resolution":{"observed_at":"2026-08-07T14:16:39.619435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11550","last_updated":"2025-10-16T13:25:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-16T09:53:32Z","title":"Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11550","snapshot_observed_at":"2026-08-07T14:16:39.736272Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.736272Z"},"links":{"cited_paper":"/paper/2407.11550","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:4c52bc522876d922eb6ef03d6708025e8eecf0c41da6f0081007f08c91c73e37","observation_id":"be925673-3d0b-4f96-ba40-04959777713c","resolution":{"observed_at":"2026-08-07T14:16:39.736272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.639767Z","title":null,"venue":null,"work_id":"e08d99fc-55c1-4409-b0fb-fc559db87320","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.882527Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:4543bd8481c7a7e5855983d06e2b9f9946ef33362b37fb21d96c606080418bbe","observation_id":"e5b8f505-a5b4-486f-add0-f3ca2a95bc1c","resolution":{"observed_at":"2026-08-07T14:16:45.756652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:39.957230Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:39.957230Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:3fd0c019795c328c527cfeb6c58c2f111c76ab317d62f1e40033fc4887306438","observation_id":"75d60ba6-1429-42b5-9726-e7d47c12acd8","resolution":{"observed_at":"2026-08-07T14:16:39.957230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.059217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.059217Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:a9a38dc0cbf3489220aec362b5a439eb0cdfd7af8a2eb6d8f268c3c5f99cb371","observation_id":"1d546562-dc02-475e-9b47-73266fb0ab03","resolution":{"observed_at":"2026-08-07T14:16:40.059217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.185668Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.185668Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:404ee9fb599a220f25d7c3a45dea2c7c4af8799342730af29ac3e03a06a55a0e","observation_id":"4d09a508-089b-47bb-a5f2-97700cf23728","resolution":{"observed_at":"2026-08-07T14:16:40.185668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-07T12:20:18.370756Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-07T14:16:40.300614Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.300614Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:ab60fead8fc2138e2eabfd0f16a239097eb45081170a9d6d1e3e963dd87e9691","observation_id":"7e68ccd2-51c8-47b1-a411-fa6b04f267a7","resolution":{"observed_at":"2026-08-07T14:16:40.300614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.399838Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.399838Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:988ef71b7448dea71efb21335cfde48999add680eddc0f36b6cd569e66339acc","observation_id":"83393d5b-049a-4ca5-bb72-3ce241205685","resolution":{"observed_at":"2026-08-07T14:16:40.399838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.533731Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.533731Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:bff11eb344f1a2551956f2a4e94c3c71bd153054eeea1fa2cdcf003a99d811ef","observation_id":"0ba4e595-50ed-412f-a995-e05f8a7aeaea","resolution":{"observed_at":"2026-08-07T14:16:40.533731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.602920Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.602920Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:7b73e8176819352030d487e72362be6acbdac293d2d70be1c34ec764899580fa","observation_id":"9c533e52-2d32-4895-af8c-64dc29d1e3eb","resolution":{"observed_at":"2026-08-07T14:16:40.602920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:40.733388Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.733388Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:7367fa294ce1890f801ae56a17724401f5947d11263fad77fe77b2ea84de3ec1","observation_id":"2a066f05-082b-49cb-b01b-6ee0622ab53b","resolution":{"observed_at":"2026-08-07T14:16:40.733388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T14:16:40.840599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.840599Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:41f9d870928574af0934a562decb2d2b62db32b7aa86f9e1f47408ee91933078","observation_id":"fd7275c9-816b-45ff-96c9-3afbc57e709d","resolution":{"observed_at":"2026-08-07T14:16:40.840599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.317763Z","title":null,"venue":null,"work_id":"5ac93e76-4c81-47ef-8acb-51e3517e80ba","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.929427Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:2898649fd57b0f54bb42ff08de875f688dd3d23aeb1842f2c75caa505dd46bea","observation_id":"9a04388b-1d84-45e3-b2ab-1a747ca1e589","resolution":{"observed_at":"2026-08-07T14:16:45.426399Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10516","last_updated":"2024-12-31T07:11:00Z","snapshot_observed_at":"2026-08-07T09:13:28.333702Z","submitted_at":"2024-09-16T17:59:52Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10516","snapshot_observed_at":"2026-08-07T14:16:40.998220Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:40.998220Z"},"links":{"cited_paper":"/paper/2409.10516","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:b61fce5f02e517222a0397417df7d0c067231b2295629f3f14d213491ad0360e","observation_id":"8cd1bf44-9bf8-486c-96b6-084e41673e6f","resolution":{"observed_at":"2026-08-07T14:16:40.998220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:45.033379Z","title":null,"venue":null,"work_id":"2cb35df8-7b3f-4c53-be0a-f13e2ba2e839","year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.097932Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:1cfb258ae596457204392fcf8956bfa2de118dd9474814c0478533ba9ed1a4f0","observation_id":"f66f4c85-15b0-439d-8ff4-9ce75c957d13","resolution":{"observed_at":"2026-08-07T14:16:45.178131Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.831261Z","title":null,"venue":null,"work_id":"3be208b7-419f-43a5-81b0-29df352b3461","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.196983Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:650389ebbd3f64c7a9cc24aec551fc80b5657167f769a788011aa9a9bb552483","observation_id":"663a592d-2f60-412c-b8b6-82a99ede768d","resolution":{"observed_at":"2026-08-07T14:16:44.909157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.676561Z","title":null,"venue":null,"work_id":"d81c555d-c8f0-453a-9f14-4b927bbaa8f5","year":2025},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.296524Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:ac759d0e3a12e6799b1bed0b0a52a31ed652f440ddeb131eee36b385e51f7a79","observation_id":"a079a4d3-391c-45f9-b92e-54d21c51123b","resolution":{"observed_at":"2026-08-07T14:16:44.754722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.543876Z","title":null,"venue":null,"work_id":"cf3b644e-784f-44f8-a9b8-973859a8a427","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.372786Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:8bcdee256ff416c8018451679c61081f1ddc3aa3727a5dc247e1cc9a28f093ca","observation_id":"1a8fe988-6039-4b96-bfdf-7a2269b3c748","resolution":{"observed_at":"2026-08-07T14:16:44.592866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.386013Z","title":null,"venue":null,"work_id":"1105c693-9d93-46b5-8106-18de44bca86a","year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.464856Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:2281de8ddc755286acb06a54f1d62efd57a86834fda46281a9d04e89c5e275a0","observation_id":"52e8d0bc-9369-454a-a3b1-c7267ef526cd","resolution":{"observed_at":"2026-08-07T14:16:44.434457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.202719Z","title":null,"venue":null,"work_id":"c293bd8d-8d53-452b-9a86-5b4a5d270f6d","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.553509Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:0742b7760e7452d744ede81fce5942b62156c6bb591c98227387e7827f2f12da","observation_id":"83f3bebf-fe43-41b5-ae85-56d670b907ed","resolution":{"observed_at":"2026-08-07T14:16:44.304156Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:16:41.649120Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.649120Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:b852f76d3b03cad52561566506ed2c524e9ed0db542793b8d00268ec483730d8","observation_id":"b100b888-b2b6-4049-839b-082a781e0eac","resolution":{"observed_at":"2026-08-07T14:16:41.649120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:44.001679Z","title":null,"venue":null,"work_id":"be951e2f-5799-4423-9f13-6be9117b7361","year":2025},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.769077Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:82c8230ec175998a9454e51de74997fad8b692596f2d91338c68b64ddde9b737","observation_id":"868b6744-535c-4cc2-8824-f3fd5b1dad29","resolution":{"observed_at":"2026-08-07T14:16:44.083353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01315","last_updated":"2020-08-25T15:46:13Z","snapshot_observed_at":"2026-07-06T08:18:46.549511Z","submitted_at":"2019-09-03T17:10:28Z","title":"Deep Graph Library: A Graph-Centric, Highly-Performant Package for Graph Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01315","snapshot_observed_at":"2026-08-07T14:16:41.882697Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.882697Z"},"links":{"cited_paper":"/paper/1909.01315","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:141f34ef14c4ba4fad37137ed6448b545f5359a0ea648530872938f721fe0f72","observation_id":"c4e447d9-8d09-4019-8676-3864b2e16da2","resolution":{"observed_at":"2026-08-07T14:16:41.882697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:43.789776Z","title":null,"venue":null,"work_id":"6887516d-1f67-49cc-9186-139772f431a9","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:41.976279Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:7a22285415067000a32e28f474ddbbf2879636702c2cf0a0c94cac6f6b6984cc","observation_id":"7924559a-cd26-4bca-b90b-b394ea4b6781","resolution":{"observed_at":"2026-08-07T14:16:43.891966Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:43.590154Z","title":null,"venue":null,"work_id":"d71a70c4-0a7e-47d0-9f71-635e5e476a94","year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.074404Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:59d28d8e80de88a8242f2a6f0d868540a19b29e31afe9bbba372569b0972d296","observation_id":"0fa3dd3c-f37c-4e1f-a563-75bc8879d05f","resolution":{"observed_at":"2026-08-07T14:16:43.696181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18096","last_updated":"2024-02-28T06:34:54Z","snapshot_observed_at":"2026-07-06T17:36:40.933805Z","submitted_at":"2024-02-28T06:34:54Z","title":"No Token Left Behind: Reliable KV Cache Compression via Importance-Aware Mixed Precision Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18096","snapshot_observed_at":"2026-08-07T14:16:42.177025Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.177025Z"},"links":{"cited_paper":"/paper/2402.18096","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:21c077306a250b315ca352657ec57274c89d447b7666e84b97bfdba3b22a5eb3","observation_id":"e3a1e404-48ed-442b-abc8-6981acdd4d24","resolution":{"observed_at":"2026-08-07T14:16:42.177025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.07092","last_updated":"2024-08-18T17:27:17Z","snapshot_observed_at":"2026-08-05T16:40:54.770070Z","submitted_at":"2024-08-11T18:40:36Z","title":"Post-Training Sparse Attention with Double Sparsity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.07092","snapshot_observed_at":"2026-08-07T14:16:42.302352Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.302352Z"},"links":{"cited_paper":"/paper/2408.07092","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:c4f6589cbc14bd3a63460fdf3b51049834d1c825eae69a2685b0cafcec4bb57a","observation_id":"8bae7c40-8cad-4de8-b326-6a4e6348b460","resolution":{"observed_at":"2026-08-07T14:16:42.302352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12820","last_updated":"2025-03-30T08:13:50Z","snapshot_observed_at":"2026-07-06T18:48:00.070861Z","submitted_at":"2024-07-01T13:05:42Z","title":"PQCache: Product Quantization-based KVCache for Long Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12820","snapshot_observed_at":"2026-08-07T14:16:42.391215Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.391215Z"},"links":{"cited_paper":"/paper/2407.12820","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:4b90006cad3b69a8cfaef53e29433cb02b15ffcec0de110870220822ccc93f7d","observation_id":"d06da1e1-b521-4fa2-8675-91a428ba9431","resolution":{"observed_at":"2026-08-07T14:16:42.391215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18934","last_updated":"2025-09-09T14:27:58Z","snapshot_observed_at":"2026-08-02T13:30:05.452811Z","submitted_at":"2024-12-25T15:45:18Z","title":"Dovetail: A CPU/GPU Heterogeneous Speculative Decoding for LLM inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18934","snapshot_observed_at":"2026-08-07T14:16:42.476185Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.476185Z"},"links":{"cited_paper":"/paper/2412.18934","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:5bbf9314230ddf96485cfc635dbf9ccd6b182c1be9fe99643656290ff3692c96","observation_id":"32ac6e75-29cb-4ae5-8a7b-7d439bd44850","resolution":{"observed_at":"2026-08-07T14:16:42.476185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:42.573762Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.573762Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:da3b508fb1c1dfd414bd7c4b848ecc800e6719822cf677b1a2357c211328122b","observation_id":"11eb4041-968b-4b28-860f-0d80e8b8c153","resolution":{"observed_at":"2026-08-07T14:16:42.573762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13846","last_updated":"2026-05-18T05:12:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-17T17:58:14Z","title":"LightTransfer: Your Long-Context LLM is Secretly a Hybrid Model with Effortless Adaptation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13846","snapshot_observed_at":"2026-08-07T14:16:42.683728Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.683728Z"},"links":{"cited_paper":"/paper/2410.13846","citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:fcbd16ba5b0df5ed8f3b0207226f284df730cdef158c794c2653f9cdd04a09b1","observation_id":"ceee1b52-8eca-48c7-8c1e-6345ac942997","resolution":{"observed_at":"2026-08-07T14:16:42.683728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:43.426640Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":"da201c99-ebc8-4f51-a4d5-8d653c90e612","year":2023},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.793624Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:26ab20496e6f4044bdd62d924cd640eed557dd6125985dd2b07b3eb09141b923","observation_id":"ef746939-1c9f-47a3-9895-200ca4c889e3","resolution":{"observed_at":"2026-08-07T14:16:43.494267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:42.896424Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.896424Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:7cde98661081c333c8a3378cd98bcc7ce548dd1cf2079c34990b2c0d3c41e2fd","observation_id":"ba9f6c0b-ec83-4895-932f-6a81fdad01d7","resolution":{"observed_at":"2026-08-07T14:16:42.896424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:16:42.984625Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:16:42.984625Z"},"links":{"citing_paper":"/paper/2505.19586"},"observation_digest":"sha256:ce8c8dc330c6921592b3bd2165af70efc27ad763a324e2e77b8d04468ea876de","observation_id":"5a44742e-afbb-46f6-8f28-6abae5b91aea","resolution":{"observed_at":"2026-08-07T14:16:42.984625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.19586","last_updated":"2025-05-27T03:16:32Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T14:09:10.072359Z","submitted_at":"2025-05-26T07:00:04Z","title":"TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2505.19586."}