{"as_of":"2026-08-09T03:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f85ea758be2d43cc8a7a4f95e4ab24973217a68c5284a30bc5a5397d7b5177da","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:39:08.367652Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":"2406.11430","doi":"10.48550/arxiv.2406.11430","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A simple and effective l\\_2 norm-based strategy for kv cache compression","venue":"arXiv (Cornell University)","work_id":"59e9df41-570b-4e6e-b6e7-5da0c45917b4","year":2024},"citing_paper":{"arxiv_id":"2410.10781","last_updated":"2025-03-02T14:37:53Z","snapshot_observed_at":"2026-08-02T20:46:05.666977Z","submitted_at":"2024-10-14T17:50:28Z","title":"When Attention Sink Emerges in Language Models: An Empirical View","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-16T17:41:03.674759Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2410.10781"},"observation_digest":"sha256:672c1212a9dd0a4a4a0971dba6bc32e3b3eabb63c5ee6373ef2173755d5110e7","observation_id":"a62c97bd-5090-4f34-9e62-aa822fa6f755","resolution":{"observed_at":"2026-05-16T17:41:03.828492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-07T12:39:08.367652Z","title":"A simple and effectivel_2 norm-based strategy for kv cache compression,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24179","last_updated":"2025-05-30T03:40:24Z","snapshot_observed_at":"2026-08-09T00:29:42.217756Z","submitted_at":"2025-05-30T03:40:24Z","title":"SALE : Low-bit Estimation for Efficient Sparse Attention in Long-context LLM Prefilling","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:39:08.367652Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2505.24179"},"observation_digest":"sha256:6b0757bdcd6406758e5f5fd0376a2d6ed2bf7bf7158edcfd9fdd3e61bc196bee","observation_id":"dbc3a49e-e94f-44ed-96cd-72c9db4abe33","resolution":{"observed_at":"2026-08-07T12:39:08.367652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-06T17:20:26.160156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11273","last_updated":"2025-07-15T12:52:12Z","snapshot_observed_at":"2026-08-08T10:53:21.517764Z","submitted_at":"2025-07-15T12:52:12Z","title":"KV-Latent: Dimensional-level KV Cache Reduction with Frequency-aware Rotary Positional Embedding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:20:26.160156Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2507.11273"},"observation_digest":"sha256:026e96bf325e903feb35594b30c3cc430e3d472832cc946fd784aeb128fec2ef","observation_id":"60672b7e-4d12-4246-9c56-11c619b53d82","resolution":{"observed_at":"2026-08-06T17:20:26.160156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-06T13:57:15.680442Z","title":"A simple and effective l_2 norm-based strategy for kv cache compression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19906","last_updated":"2025-08-04T08:19:26Z","snapshot_observed_at":"2026-08-08T09:20:56.167689Z","submitted_at":"2025-07-26T10:34:53Z","title":"CaliDrop: KV Cache Compression with Calibration","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:57:15.680442Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2507.19906"},"observation_digest":"sha256:1d3f591aee7a56f48b3e13655648717d4333c25ea07dc8d5feda74d3ebed59ab","observation_id":"7806b74f-bbdc-40fc-8703-d73765ce6bdd","resolution":{"observed_at":"2026-08-06T13:57:15.680442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T17:46:45.299545Z","title":"A simple and effectivel_2 norm-based strategy for kv cache compression.arXiv preprint arXiv:2406.11430,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.15717","last_updated":"2025-08-21T16:56:29Z","snapshot_observed_at":"2026-08-09T03:26:41.028758Z","submitted_at":"2025-08-21T16:56:29Z","title":"StreamMem: Query-Agnostic KV Cache Memory for Streaming Video Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T17:46:45.299545Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2508.15717"},"observation_digest":"sha256:182d104f1aa229e354ccfd5ce0f7750432a01935793cf0a582ee16b5f28ab897","observation_id":"fbe10147-0ccd-42fa-9a46-3cbf0ea91116","resolution":{"observed_at":"2026-08-05T17:46:45.299545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T13:44:17.507439Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00388","last_updated":"2025-08-30T06:56:28Z","snapshot_observed_at":"2026-08-07T13:56:33.547626Z","submitted_at":"2025-08-30T06:56:28Z","title":"GraphKV: Breaking the Static Selection Paradigm with Graph-Based KV Cache Eviction","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T13:44:17.507439Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2509.00388"},"observation_digest":"sha256:6617f01843969fb515bedfec6dbac8570e1a725f6006ea6804c357579948d443","observation_id":"674fd864-1aac-4111-b8c3-180d13dcd441","resolution":{"observed_at":"2026-08-05T13:44:17.507439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T10:16:13.044374Z","title":"arXiv preprint arXiv:2406.11430","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04377","last_updated":"2025-09-04T16:40:01Z","snapshot_observed_at":"2026-08-06T07:33:15.787399Z","submitted_at":"2025-09-04T16:40:01Z","title":"PagedEviction: Structured Block-wise KV Cache Pruning for Efficient Large Language Model Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:16:13.044374Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2509.04377"},"observation_digest":"sha256:1b681576c29f8aca023d23d1f33a609e78212993f7766273e42bbfad60387279","observation_id":"d2ddc671-e855-460e-9491-2b1147384554","resolution":{"observed_at":"2026-08-05T10:16:13.044374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-03T08:04:55.832204Z","title":"Devoto, A., Zhao, Y ., Scardapane, S., and Minervini, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.18383","last_updated":"2026-06-04T11:15:25Z","snapshot_observed_at":"2026-08-04T07:38:28.847864Z","submitted_at":"2026-01-26T11:31:40Z","title":"Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T08:04:55.832204Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2601.18383"},"observation_digest":"sha256:9105c37d9255301ea4a95a3d779f398c0bc77c0fe65668a1a8210d7ceb0740a0","observation_id":"6cff6c78-94f5-47ae-82ba-cae63bb1010b","resolution":{"observed_at":"2026-08-03T08:04:55.832204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-03T01:18:03.085122Z","title":"Alessio Devoto, Maximilian Jeblick, and Simon Jégou","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.10238","last_updated":"2026-06-26T10:01:58Z","snapshot_observed_at":"2026-08-07T12:13:56.561734Z","submitted_at":"2026-02-10T19:34:15Z","title":"Learning to Evict from Key-Value Cache","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T01:18:03.085122Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2602.10238"},"observation_digest":"sha256:15339353f4648b868bd450dd79f60ee9a091a6682e517a8f12805a95d4f0c7fe","observation_id":"ba1ff632-0a9f-401d-8330-81560d364fa7","resolution":{"observed_at":"2026-08-03T01:18:03.085122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":"2406.11430","doi":"10.48550/arxiv.2406.11430","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A simple and effective l\\_2 norm-based strategy for kv cache compression","venue":"arXiv (Cornell University)","work_id":"59e9df41-570b-4e6e-b6e7-5da0c45917b4","year":2024},"citing_paper":{"arxiv_id":"2604.25975","last_updated":"2026-04-28T12:28:04Z","snapshot_observed_at":"2026-07-06T23:11:43.764239Z","submitted_at":"2026-04-28T12:28:04Z","title":"Rethinking KV Cache Eviction via a Unified Information-Theoretic Objective","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-07T16:41:23.234607Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2604.25975"},"observation_digest":"sha256:1d2ca77c474ec30fabc9011ad69a9d159dad80b0853e7fb1d4b50aa3ff8b43c1","observation_id":"edbce6e0-b62f-4bc3-afbc-708a74d0cfe6","resolution":{"observed_at":"2026-05-11T23:36:24.606837Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":"2406.11430","doi":"10.48550/arxiv.2406.11430","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A simple and effective l\\_2 norm-based strategy for kv cache compression","venue":"arXiv (Cornell University)","work_id":"59e9df41-570b-4e6e-b6e7-5da0c45917b4","year":2024},"citing_paper":{"arxiv_id":"2605.07234","last_updated":"2026-05-08T04:37:22Z","snapshot_observed_at":"2026-08-06T04:40:19.152385Z","submitted_at":"2026-05-08T04:37:22Z","title":"Reformulating KV Cache Eviction Problem for Long-Context LLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T02:37:52.545943Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2605.07234"},"observation_digest":"sha256:fa672f50f4683e12a0e0048eb0d812f0ff054d8cf3e5b406f26ea7d47b190556","observation_id":"33fd9260-a53e-4000-9413-94d1b188c8c0","resolution":{"observed_at":"2026-05-11T03:10:53.494944Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":"2406.11430","doi":"10.48550/arxiv.2406.11430","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A simple and effective l\\_2 norm-based strategy for kv cache compression","venue":"arXiv (Cornell University)","work_id":"59e9df41-570b-4e6e-b6e7-5da0c45917b4","year":2024},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:75da38f21f90ba3f5b0d951e9b241ced5322ddfcc483be24a1a94b7f1435cacb","observation_id":"174d9356-0d4c-4bc2-9b4c-bec9ae96ae62","resolution":{"observed_at":"2026-06-28T23:32:46.699386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":"2406.11430","doi":"10.48550/arxiv.2406.11430","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A simple and effective l\\_2 norm-based strategy for kv cache compression","venue":"arXiv (Cornell University)","work_id":"59e9df41-570b-4e6e-b6e7-5da0c45917b4","year":2024},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":154,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:b4349f9a2f8763230a66ddc40d1deb2be8abb1c842f92fc35047074b82f95157","observation_id":"66c5c197-f762-49f1-b022-23819c713c87","resolution":{"observed_at":"2026-06-28T23:32:47.323987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-02T11:58:28.898360Z","title":"A Simple and Effective L_2 Norm-Based Strategy for KV Cache Compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22586","last_updated":"2026-06-09T04:56:59Z","snapshot_observed_at":"2026-08-06T10:04:16.098099Z","submitted_at":"2026-06-09T04:56:59Z","title":"MM-ShiftKV: Decode-Aware Prefill-Stage KV Selection for Multimodal Large Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-02T11:58:28.898360Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2607.22586"},"observation_digest":"sha256:0fcb799c752dfa0eb1fb45ed90a55d0f61c46e5998f03dec8e5be131fe0180a9","observation_id":"5d9ccd38-9620-42e3-8271-7f82ef51b2a7","resolution":{"observed_at":"2026-08-02T11:58:28.898360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11430","snapshot_observed_at":"2026-08-03T00:43:49.007920Z","title":"A simple and effective L2 norm-based strategy for KV cache compression.arXiv:2406.11430, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28699","last_updated":"2026-08-06T10:44:15Z","snapshot_observed_at":"2026-08-09T03:09:44.080260Z","submitted_at":"2026-07-30T11:04:45Z","title":"WitCert: Sound Runtime Risk Observability and Gating for KV-Cache Quantization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T00:43:49.007920Z"},"links":{"cited_paper":"/paper/2406.11430","citing_paper":"/paper/2607.28699"},"observation_digest":"sha256:6352d9edde3e6277bc0879239c4b2f1449c598f29c28221f6479af5895e0943b","observation_id":"c7829b40-f46f-4391-98fa-37d7932303ae","resolution":{"observed_at":"2026-08-03T00:43:49.007920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.11430/citation-record","integrity":"/paper/2406.11430/integrity","json":"/paper/2406.11430/citation-record.json","paper":"/paper/2406.11430"},"outbound":[],"paper":{"arxiv_id":"2406.11430","last_updated":"2024-11-03T09:42:35Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T19:20:38.764086Z","submitted_at":"2024-06-17T11:35:16Z","title":"A Simple and Effective $L_2$ Norm-Based Strategy for KV Cache Compression"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2406.11430."}