{"as_of":"2026-08-03T16:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f5d5c237ff9aee059ad9ab1100240cdbe4ef040ba79cba1e45bea79d4fb2ef1","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T23:46:59.863921Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-03T06:30:56.289259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:09:07.252227Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.19769","snapshot_observed_at":"2026-08-01T21:09:07.252227Z","title":"TTKV: Temporal-tiered KV cache for long-context LLM inference, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16184","last_updated":"2026-07-17T17:58:29Z","snapshot_observed_at":"2026-08-03T15:40:28.200309Z","submitted_at":"2026-07-17T17:58:29Z","title":"PagedWeight: Efficient MoE LLM Serving with Dynamic Quality-Aware Weight Quantization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T21:09:07.252227Z"},"links":{"cited_paper":"/paper/2604.19769","citing_paper":"/paper/2607.16184"},"observation_digest":"sha256:66ea93b0b76bec087dbba7c5f2281145876012ede939c2228d78636859a459d1","observation_id":"c758b92d-0a3e-4a3c-9ab5-6252a2e02f4a","resolution":{"observed_at":"2026-08-01T21:09:07.252227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.19769/citation-record","integrity":"/paper/2604.19769/integrity","json":"/paper/2604.19769/citation-record.json","paper":"/paper/2604.19769"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LongBench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":"3716b8b5-032e-4532-9442-7c999581a0ef","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:ad69cb6ae6cffaaaf0305ed3253506d78d9a74ffb248f3c83cd664e2a3cdd6ff","observation_id":"29ddb2a5-6661-4574-8292-f5ea4a6da519","resolution":{"observed_at":"2026-05-14T23:48:19.438410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"244b85b9-3dc0-4758-afac-dbe56f76e9c4","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:bf11c1597d7eca03915000c189944622b343a65f1aca2678313c3c1e61e81780","observation_id":"72188809-63a1-469f-ae2f-4cbd91f52452","resolution":{"observed_at":"2026-05-14T23:48:19.434347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"2fe3c64a-9174-46b5-8cf9-5ff1a25bb4e3","year":2025},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:0f31aa16a8eef24972bec3095fc58a327974dd429e18c2a2d509319021d30147","observation_id":"031e9997-33ae-4377-88c0-6fac96767e37","resolution":{"observed_at":"2026-05-14T23:48:19.430208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ruler: What’s the real context size of your long-context language models?","venue":null,"work_id":"57aaccc5-aeaa-4b14-9fc2-da1bf1cf55c9","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:6ca5310576b532940d48c18e949e9198f2dccf1cebfc13c99c3d75bc9815a33b","observation_id":"c4b586df-b9e7-405c-8e79-9edf7d377d8a","resolution":{"observed_at":"2026-05-14T23:48:19.425546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qwen2.5-coder technical report","venue":null,"work_id":"db0e625b-4b4f-4f23-b34f-425003335d5b","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:1bab1a8ff8691d35ca304c21afa29c321cb4793fb1deb02785497d2a86afd768","observation_id":"bb6d5432-39d0-445a-a660-77f9b0b38cf7","resolution":{"observed_at":"2026-05-14T23:48:19.498603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f1ff5531-1b9f-4ace-a3ae-4beba2661aa4","year":2023},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:7297caab1d813903bad5546ec41fc61f32baa4f138953d38b37dfd21e4474f45","observation_id":"665954c3-1d4a-4ad8-b0ec-0231bf90ee5f","resolution":{"observed_at":"2026-05-14T23:48:19.460331Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"KVPR: Efficient LLM in- ference with I/O-aware KV cache partial recomputation","venue":null,"work_id":"e2f8dba8-4bc5-4000-9895-7fad62a65e24","year":2025},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:dacb144ff4331b15127f3708406ed6da4cd045d858afc29990e0d48fc094dc0c","observation_id":"bbfb79de-7fd1-4f14-a545-8bd5ab549c36","resolution":{"observed_at":"2026-05-14T23:48:19.464413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[Jianget al., 2026 ] Bo Jiang, Taolue Yang, Youyuan Liu, Xubin He, Sheng Di, and Sian Jin","venue":null,"work_id":"cdb9cca4-a536-4206-ac3a-c209c1ecd554","year":2026},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:ab2287f6c09027003fc0c1ec92f769a96224fd38e1ca7e4f74a0246c3f09df39","observation_id":"78f74fd8-0de9-47c0-9e61-78802fb8e95d","resolution":{"observed_at":"2026-05-14T23:48:19.522699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reformer: The efficient transformer","venue":null,"work_id":"b8af3735-cdb1-43be-a76e-081d1329f7e5","year":2020},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:6a0738d97ea49fc223c697221457f155a24cc38730f497854ac918bf899e37e4","observation_id":"8aec22ed-6b29-4f7e-af93-2730afc50783","resolution":{"observed_at":"2026-05-14T23:48:19.476854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cachegen: Kv cache compression and streaming for fast large language model serving","venue":null,"work_id":"186f834b-c787-4c6f-8fe1-8952f53d9a8a","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:04f68c5c0894c14ecf1c85c4540b4cfae8479f9c10fcf9ab55873908aa094d49","observation_id":"4a9bde02-e4e0-4b1b-8458-99c1e830c54e","resolution":{"observed_at":"2026-05-14T23:48:19.491644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-07-06T17:25:18.238343Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"cited_work":{"arxiv_id":"2402.02750","doi":"10.48550/arxiv.2402.02750","metadata_source":"pith","pith_arxiv_id":"2402.02750","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","venue":"cs.CL","work_id":"735737c3-24e5-41c3-ab4f-04edcb36731c","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"cited_paper":"/paper/2402.02750","citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:17ac0d9fc48dcffb44c99961ad52533c82eb8f557e41406e85b9f2058eff8693","observation_id":"32f5ccc4-85cf-425f-86b8-afd6adfd0a48","resolution":{"observed_at":"2026-05-14T23:48:19.056976Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Freekv: Boosting kv cache retrieval for efficient llm inference","venue":null,"work_id":"ae218869-1ef7-492d-9892-0f33ea6c6a12","year":2026},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:004e037378306c770ebefe47d00fc162f83477755757f4bdfccae9bdec0eba51","observation_id":"3fb4c6b4-fb6f-490e-addd-e96cb520112a","resolution":{"observed_at":"2026-05-14T23:48:19.451759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MiniKV: Pushing the limits of 2-bit KV cache via compression and system co-design for efficient long context inference","venue":null,"work_id":"08d504fc-5805-4ea9-98ae-a21e0e7b1f1a","year":2025},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:a1cf0781c3e4b70b272878d1f588e58c5f624f764c29893718a4a4e861bdb348","observation_id":"80c4a8ef-c933-43cd-91e3-e8a9cb5aeeeb","resolution":{"observed_at":"2026-05-14T23:48:19.502500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[Shenget al., 2023 ] Ying Sheng, Lianmin Zheng, Binhang Yuan, Zhuohan Li, Max Ryabinin, Beidi Chen, Percy Liang, Christopher Re, Ion Stoica, and Ce Zhang","venue":null,"work_id":"ada30a10-03c5-42a7-8801-243b5d212443","year":2023},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:749076396620d58fba8a0093aee85acbb5e8f71bebfac842df1a8dfd4f87ae10","observation_id":"8a5ebbf6-a19d-47cb-8ff1-76c3f7f96e58","resolution":{"observed_at":"2026-05-14T23:48:19.495342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shadowkv: Kv cache in shadows for high-throughput long-context llm inference","venue":null,"work_id":"3a6cf039-cd47-4492-8281-338565debeb1","year":2025},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:995c6c9ee17fae196213a6448a6e4a40867d7d912cc394fd8100bccf04787d98","observation_id":"155289ca-e674-4f90-aa5b-72ed8b94d694","resolution":{"observed_at":"2026-05-14T23:48:19.481161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":"14cc01c3-6acd-48a7-8060-56d49351cc3b","year":2023},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:789fcef0f75bf62cdbcc22af7cbe574d6e7beb04959f34fc434fddf33c668ec0","observation_id":"998898b5-b396-4997-9aee-6206a0d8b1f3","resolution":{"observed_at":"2026-05-14T23:48:19.485461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Leave no document behind: Benchmarking long-context LLMs with extended multi-doc QA","venue":null,"work_id":"ba96ca07-eace-4a0d-962b-d7e0e6a84ba8","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:498966069969954683ed82c69ef44f133d84d3a3434a737089bd18b0035d7bd1","observation_id":"1525ca07-aedf-4f8e-b6e6-15973a7367fa","resolution":{"observed_at":"2026-05-14T23:48:19.549878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[Wanget al., 2025 ] Dongwei Wang, Zijie Liu, Song Wang, Yuxin Ren, Jianing Deng, Jingtong Hu, Tianlong Chen, and Huanrui Yang","venue":null,"work_id":"c8cfb7bf-3a89-4f1c-b24b-3a3b39e86b71","year":2025},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:f5dacbe9de2672d8d7fc717b55eb58ab65b966a910fd3ed7bd75fe1a3ede9420","observation_id":"811fba38-13a6-4b3f-8364-a0fdeb32bd69","resolution":{"observed_at":"2026-05-14T23:48:19.557757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"27deb9b8-866b-41f9-a096-13e6c219e56f","year":2024},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:4e352df7cbf703d8b0c349c753dc13eeb5ba160a9c3291508b2d048048930060","observation_id":"7ff87bee-b022-4eca-a3a7-7a6a9ef61a1a","resolution":{"observed_at":"2026-05-14T23:48:19.447436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H 2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"c4ab7215-30a8-469f-913b-3896b6119fc5","year":2023},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:7f5fd9c12924267430ba61e23381ae04551cd00a76b0d1bdc1e5f31ffface3f9","observation_id":"311491fb-a1f3-4324-a233-f63d5b7a9d7c","resolution":{"observed_at":"2026-05-14T23:48:19.472189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1661789a-099b-468d-a100-d74628f672a7","year":2025},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:ff6af7d49946c60003e1520f1a686708f1b8674ead671d3981a5e08bfc4040a2","observation_id":"8632b857-300a-4f2e-b393-00db69115fa9","resolution":{"observed_at":"2026-05-14T23:48:19.442909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ProcessBench: Identify- ing process errors in mathematical reasoning","venue":null,"work_id":"d18f17b0-8d27-47e1-b0f2-5fb60fca32ff","year":2025},"citing_paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T23:46:59.863921Z"},"links":{"citing_paper":"/paper/2604.19769"},"observation_digest":"sha256:e417dab89b02c7e6a8ef970f1a08eed2c17ae620b0678d429a7601c21dc78792","observation_id":"9f456916-6588-4b93-bcd4-7ba6904fd3d4","resolution":{"observed_at":"2026-05-14T23:48:19.456353Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-03T06:30:56.289259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.19769","last_updated":"2026-03-27T09:01:23Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:06:21.774788Z","submitted_at":"2026-03-27T09:01:23Z","title":"TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-03T06:30:56.289259+00:00","source":"crossref"},{"observed_at":"2026-08-03T06:30:50.922721+00:00","source":"retraction_watch"}],"thesis":"As of 3 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2604.19769."}