{"as_of":"2026-08-12T14:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97d9514cb02e2c2df5b2933254fc9b0b58da4a7848d290bd9faa9d89bbd1b8ba","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T19:44:35.753794Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:36:44.285178Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-05T20:37:11.923378Z","title":"xkv: Cross-layer svd for kv-cache compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10395","last_updated":"2025-08-14T06:52:38Z","snapshot_observed_at":"2026-08-08T07:14:54.239021Z","submitted_at":"2025-08-14T06:52:38Z","title":"XQuant: Breaking the Memory Wall for LLM Inference with KV Cache Rematerialization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T20:37:11.923378Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2508.10395"},"observation_digest":"sha256:defe9ea6032628dde3cbcfa37c5830869d16ecd89843bf2f1675804645106f25","observation_id":"2323e10e-2681-401c-858c-2587f9bb0dbb","resolution":{"observed_at":"2026-08-05T20:37:11.923378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-05T17:55:06.405836Z","title":"xkv: Cross-layer svd for kv-cache compression","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15881","last_updated":"2025-08-25T02:24:20Z","snapshot_observed_at":"2026-08-05T17:55:04.790166Z","submitted_at":"2025-08-21T15:25:40Z","title":"TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T17:55:06.405836Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2508.15881"},"observation_digest":"sha256:6eead9517a3bee3c004a900ac70c665bc59098e0339794bdee2d8fcf5855dd8f","observation_id":"ec240f3a-ad6f-416e-a183-1e108f27f7a8","resolution":{"observed_at":"2026-08-05T17:55:06.405836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-03T05:54:01.125260Z","title":"acl-long.466/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.01053","last_updated":"2026-05-31T04:23:14Z","snapshot_observed_at":"2026-08-08T08:12:44.495688Z","submitted_at":"2026-02-01T06:36:46Z","title":"LRAgent: Efficient KV Cache Sharing for Multi-LoRA LLM Agents","version":2},"reference_index":466,"source":"pdf_text","source_observed_at":"2026-08-03T05:54:01.125260Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2602.01053"},"observation_digest":"sha256:7841fb0ac27297f1edde9bf2f26cfa320c9916ec97e852017aae03459a638d3b","observation_id":"3012c4ce-845f-4f86-8624-3788abb276c6","resolution":{"observed_at":"2026-08-03T05:54:01.125260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-03T05:54:01.193753Z","title":"URL https: //arxiv.org/abs/2503.18893","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.01053","last_updated":"2026-05-31T04:23:14Z","snapshot_observed_at":"2026-08-08T08:12:44.495688Z","submitted_at":"2026-02-01T06:36:46Z","title":"LRAgent: Efficient KV Cache Sharing for Multi-LoRA LLM Agents","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T05:54:01.193753Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2602.01053"},"observation_digest":"sha256:9e3b343ee2b88751cdadb05679043e81eecf54cb0db80902b2ba0c2596349d13","observation_id":"a6d2683b-74f7-4df0-8bec-af1ed20f5162","resolution":{"observed_at":"2026-08-03T05:54:01.193753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2603.22910","last_updated":"2026-05-13T05:25:05Z","snapshot_observed_at":"2026-08-11T06:44:06.632171Z","submitted_at":"2026-03-24T07:58:42Z","title":"EchoKV: Efficient KV Cache Compression via Similarity-Based Reconstruction","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T01:09:07.983785Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2603.22910"},"observation_digest":"sha256:cbb5280cc8f8d9178d0d026ef0b9a2431caf9db003007c28fb5c34daad9a0e22","observation_id":"ba6ebe7e-1688-4b82-a02c-389449dc5f23","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2604.02525","last_updated":"2026-05-07T21:33:53Z","snapshot_observed_at":"2026-08-11T01:47:33.577783Z","submitted_at":"2026-04-02T21:24:15Z","title":"AdaHOP: Fast and Accurate Low-Precision Training via Outlier-Pattern-Aware Rotation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T20:51:39.641700Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2604.02525"},"observation_digest":"sha256:c7bf5814b290eee52edf2ea1c8a5def05327b709960dd9e04ee58e7696d777c4","observation_id":"0c6b4727-c12e-4048-bee7-acd8f4a0bc8a","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2604.21231","last_updated":"2026-05-04T22:59:12Z","snapshot_observed_at":"2026-08-11T10:10:15.248500Z","submitted_at":"2026-04-23T02:55:31Z","title":"SparKV: Overhead-Aware KV Cache Loading for Efficient On-Device LLM Inference","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T14:09:30.821354Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2604.21231"},"observation_digest":"sha256:e66c9deb5fddb897abcfeb559c590f28ff0e9d213e4255a5149c266c8c29d317","observation_id":"55865eb6-1c62-44ec-a185-19dfd7c6da72","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2605.02905","last_updated":"2026-04-06T02:05:52Z","snapshot_observed_at":"2026-08-11T13:40:20.680814Z","submitted_at":"2026-04-06T02:05:52Z","title":"eOptShrinkQ: Near-Lossless KV Cache Compression Through Optimal Spectral Denoising and Quantization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T20:18:04.392331Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2605.02905"},"observation_digest":"sha256:024aa5a956c78a8fb6af08bad818547b9fb46666a8e205f0e66b968020a0b1f1","observation_id":"18a0dfb7-6c22-4aa4-a986-128f62934bf9","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2605.08314","last_updated":"2026-05-08T14:20:42Z","snapshot_observed_at":"2026-08-02T20:58:18.012548Z","submitted_at":"2026-05-08T14:20:42Z","title":"FlashSVD v1.5: Making Low-Rank Transformers Inference Actually Fast","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-12T00:59:43.488204Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2605.08314"},"observation_digest":"sha256:a277e5e6e11d69950d0d3dd6191aea41e4700118451af846e8c39ae91d8a9923","observation_id":"c136ed24-8591-49dd-b7a3-8a79b3aedca4","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2605.10875","last_updated":"2026-05-11T17:27:15Z","snapshot_observed_at":"2026-08-11T00:54:56.127421Z","submitted_at":"2026-05-11T17:27:15Z","title":"Compute Where it Counts: Self Optimizing Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T04:57:58.649358Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2605.10875"},"observation_digest":"sha256:afea448916cfbf8fdedd25c90b08f276d3e9439a43813fe724d34913c610aaeb","observation_id":"2ec35399-e247-45bf-87cc-74ab27a3b098","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2605.12770","last_updated":"2026-05-19T21:54:38Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T21:32:45Z","title":"WriteSAE: Sparse Autoencoders for Recurrent State","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T07:46:41.159688Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2605.12770"},"observation_digest":"sha256:0d590623b263ea7602747faf35f018dbe28784f17bf357fdf31c5b210603b07d","observation_id":"82c84bf0-82e1-44bc-8cc9-70ac19d372a5","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2605.16439","last_updated":"2026-05-14T23:01:58Z","snapshot_observed_at":"2026-08-01T17:11:05.881460Z","submitted_at":"2026-05-14T23:01:58Z","title":"KVCapsule: Efficient Sequential KV Cache Compression for Vision-Language Models with Asymmetric Redundancy","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T19:55:35.051834Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2605.16439"},"observation_digest":"sha256:caeb1b2db20ece78a32bb9990cc59577b0602b377ed89c5974ab460c2e128e57","observation_id":"c00266c9-6829-445c-bd9c-7b8eaea65b94","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2605.17757","last_updated":"2026-05-18T02:24:29Z","snapshot_observed_at":"2026-07-06T23:28:45.646975Z","submitted_at":"2026-05-18T02:24:29Z","title":"OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quantization","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T12:16:07.797702Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2605.17757"},"observation_digest":"sha256:a432f99e81a039eb24559ddab564629763d4ad282ad5c799cf646c555836da68","observation_id":"808b7faa-baa7-4d25-923e-602faf626270","resolution":{"observed_at":"2026-05-28T02:04:08.438618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2605.25475","last_updated":"2026-05-25T06:29:43Z","snapshot_observed_at":"2026-08-02T08:45:15.831498Z","submitted_at":"2026-05-25T06:29:43Z","title":"IndexMem: Learned KV-Cache Eviction with Latent Memory for Long-Context LLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T22:03:07.685253Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2605.25475"},"observation_digest":"sha256:4c8b8259a19ff9e7af0f5536d9da783837b8f88c575482471e2090378305bf83","observation_id":"6d7159a8-d923-4297-80c7-13120b7a0b7b","resolution":{"observed_at":"2026-06-29T22:03:59.868109Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":"2503.18893","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-07-10T01:36:44.285178Z","title":"Arthur Conmy, Augustine Mavor-Parker, Aengus Lynch, Stefan Heimersheim, and Adrià Garriga- Alonso","venue":"cs.CL","work_id":"16dc86cb-7b66-400c-be1f-dd459db6f94e","year":2025},"citing_paper":{"arxiv_id":"2607.08032","last_updated":"2026-07-09T01:15:03Z","snapshot_observed_at":"2026-08-02T16:38:21.894642Z","submitted_at":"2026-07-09T01:15:03Z","title":"What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T01:26:59.421158Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2607.08032"},"observation_digest":"sha256:0929e6a848c1bbaabcb0f7390b0657ebd865bb4a302ae793edd4abb7541ea8a1","observation_id":"2cb6eef6-da4e-4ff3-ac06-09f6a9f5f949","resolution":{"observed_at":"2026-07-10T01:36:44.286421Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-02T06:31:50.156692Z","title":"Abdelfattah","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.12550","last_updated":"2026-07-17T17:45:07Z","snapshot_observed_at":"2026-08-07T16:25:57.752265Z","submitted_at":"2026-07-14T09:23:20Z","title":"A JoLT for the KV Cache: Near-Lossless KV Cache Compression via Joint Tucker and JL-Residual Allocation for LLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T06:31:50.156692Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2607.12550"},"observation_digest":"sha256:619b30fcd581eee7f43ac2c398a727063e5a4e5fd0f286c56446c4b923093697","observation_id":"f2df317c-2521-41b6-87bb-340aba0b43c5","resolution":{"observed_at":"2026-08-02T06:31:50.156692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-05T10:17:13.142422Z","title":"Abdelfattah","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03893","last_updated":"2026-08-04T16:26:47Z","snapshot_observed_at":"2026-08-08T19:02:49.662782Z","submitted_at":"2026-08-04T16:26:47Z","title":"Cross-Model KV Cache Transfer in LLM Families: A Closed-Form Linear Mapping for Prefill Reuse","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T10:17:13.142422Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2608.03893"},"observation_digest":"sha256:f291439b30eee59db07566f58bfa244879debf8a497018eb3bf0e38084914952","observation_id":"28732b28-1bca-497d-b0b4-51481a81a173","resolution":{"observed_at":"2026-08-05T10:17:13.142422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-06T17:07:00.541065Z","title":"Chang,C.-C.;Lin,W.-C.;Lin,C.-Y.;Chen,C.-Y.;Hu,Y.-F.; Wang,P.-S.;Huang,N.-C.;Ceze,L.;Abdelfattah,M.S.;and Wu,K.-C.2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04771","last_updated":"2026-08-05T12:36:28Z","snapshot_observed_at":"2026-08-10T23:00:33.217022Z","submitted_at":"2026-08-05T12:36:28Z","title":"Fewer Tokens, Smaller Cache: Reward-Coordinated Efficient Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:07:00.541065Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2608.04771"},"observation_digest":"sha256:5f0f2709c93d2a8bde48ae12cdf7e6bf7d66b9bf9e53e90e8b2493f7f419d0b5","observation_id":"3f7401b1-e66e-4a35-82f9-b95cfafdcffa","resolution":{"observed_at":"2026-08-06T17:07:00.541065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18893","snapshot_observed_at":"2026-08-10T19:44:35.753794Z","title":"arXiv preprint arXiv:2503.18893 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.06849","last_updated":"2026-08-07T06:18:18Z","snapshot_observed_at":"2026-08-12T14:10:22.717868Z","submitted_at":"2026-08-07T06:18:18Z","title":"Autonomy-of-Heads: Data-Free Sparse Attention from Frozen Query-Key Geometry","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T19:44:35.753794Z"},"links":{"cited_paper":"/paper/2503.18893","citing_paper":"/paper/2608.06849"},"observation_digest":"sha256:325ac90dfb664e4ced7a85999f62f27f93a601a44149bd8de9cb08fc44abcb9e","observation_id":"7221584d-8357-49d7-8281-3bca7ca1802a","resolution":{"observed_at":"2026-08-10T19:44:35.753794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.18893/citation-record","integrity":"/paper/2503.18893/integrity","json":"/paper/2503.18893/citation-record.json","paper":"/paper/2503.18893"},"outbound":[],"paper":{"arxiv_id":"2503.18893","last_updated":"2026-05-27T05:57:00Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:40:35.127363Z","submitted_at":"2025-03-24T17:06:37Z","title":"xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2503.18893."}