{"as_of":"2026-08-20T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:56076a62bcb1c922874ca9ab1cfe2eaae9dff1241d6ee74025c4997c57d224d1","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-25T05:22:47.198185Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T11:49:11.776915Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23200","snapshot_observed_at":"2026-07-31T11:49:11.776915Z","title":"Adaptive mass-segmented KV compression for long-context reasoning.arXiv preprint arXiv:2605.23200, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24555","last_updated":"2026-07-27T15:28:52Z","snapshot_observed_at":"2026-08-19T20:20:37.133533Z","submitted_at":"2026-07-27T15:28:52Z","title":"LOCKS: Page-Local Compact Key Summaries for Efficient Long-Context Decoding","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-31T11:49:11.776915Z"},"links":{"cited_paper":"/paper/2605.23200","citing_paper":"/paper/2607.24555"},"observation_digest":"sha256:d12dcf034f6c6b9fd6b385cd078f84ad68be225cfc34e30ff0b16722128972a5","observation_id":"fb304ee9-3e1a-4e57-9269-b67b116de627","resolution":{"observed_at":"2026-07-31T11:49:11.776915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.23200/citation-record","integrity":"/paper/2605.23200/integrity","json":"/paper/2605.23200/citation-record.json","paper":"/paper/2605.23200"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H2O: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"327aab9f-e156-4fcb-baba-68655e6a11c9","year":2023},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:066d434fba27e852263f2a74fb263420cc43b5304ec6aa0c99a10dd33a214b5a","observation_id":"47d7dafa-e7e1-49c3-a1e4-23504f6b75df","resolution":{"observed_at":"2026-05-25T11:56:56.485249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0006.361316","doi":"10.1145/3600006.3613163","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention , booktitle =","venue":null,"work_id":"1b10f2a9-a178-4d23-97fb-8db2354c7e6c","year":2023},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:27510f1e8515680dfb63c37353cf4ddc228e4e85e22f940b1d34bb99c2dd9492","observation_id":"fb1e026e-cfb4-49f4-8a0e-915ee2b7bb2a","resolution":{"observed_at":"2026-05-25T05:25:22.801192Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.18079","last_updated":"2025-05-28T18:58:29Z","snapshot_observed_at":"2026-08-20T02:16:11.463896Z","submitted_at":"2024-01-31T18:58:14Z","title":"KVQuant: Towards 10 Million Context Length LLM Inference with KV Cache Quantization","version":6},"cited_work":{"arxiv_id":"2401.18079","doi":"10.48550/arxiv.2401.18079","metadata_source":"pith","pith_arxiv_id":"2401.18079","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":"cs.LG","work_id":"f8884df2-70de-43af-832d-ca9ba2eab327","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2401.18079","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:ace367ae724973fcf548dd1f08232944884b5bc0b022dfe50730a4db9339ed5c","observation_id":"4bfb4e11-c9c5-404c-906c-7a5c0666f1d5","resolution":{"observed_at":"2026-05-25T05:25:23.488548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":"2201.11903","doi":"10.48550/arxiv.2201.11903","metadata_source":"pith","pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","venue":"cs.CL","work_id":"d1cf6693-a082-403c-ada9-dac7b96341f9","year":2022},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:45d2eb070985b5af9f6c160c3133fa4d5678f8573d1aca932e272d7457a4ba02","observation_id":"d3eec471-38d6-4772-8839-2152578a6869","resolution":{"observed_at":"2026-05-25T05:25:23.493343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:38:16.194749+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:38:16.194749+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.24133","doi":"10.48550/arxiv.2505.24133","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R-KV: Redundancy-aware KV cache compression for reasoning models","venue":"PubMed","work_id":"08344675-41be-4f15-be42-98a70e11f174","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:2d17f39f156627ba3c06585db0bc1d17248f8d5636dca2785eddda89d9622a95","observation_id":"3edd48f8-8567-48c5-b3cb-31e363df5aeb","resolution":{"observed_at":"2026-05-25T05:25:22.808246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:24.844272+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:24.844272+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning path compression: Compressing generation trajectories for efficient LLM reasoning","venue":null,"work_id":"1bca4f5b-07eb-405f-ae4f-c1ccc5daee8a","year":null},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:b07e6e4cb9fe1efe94600bff49a649a515793e386913e2ede7552e85750868b1","observation_id":"ec7e0a2d-cbb2-4d58-b567-5a53d0c9d029","resolution":{"observed_at":"2026-05-25T11:56:56.499401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NeurIPS 2025 Poster","venue":null,"work_id":"ec826d4b-1f5c-4841-a75d-f06d2fcc49a6","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:f76f21327ba363e491add663e840602554acfe15f4c097e1988cc232a49407d9","observation_id":"872c8772-af5a-427b-baf2-199cdcba217d","resolution":{"observed_at":"2026-05-25T11:56:56.522328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04921","last_updated":"2026-04-06T17:58:42Z","snapshot_observed_at":"2026-08-12T23:14:44.419087Z","submitted_at":"2026-04-06T17:58:42Z","title":"TriAttention: Efficient Long Reasoning with Trigonometric KV Compression","version":1},"cited_work":{"arxiv_id":"2604.04921","doi":"10.48550/arxiv.2604.04921","metadata_source":"pith","pith_arxiv_id":"2604.04921","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"TriAttention: Efficient Long Reasoning with Trigonometric KV Compression","venue":"cs.CL","work_id":"988b5b75-a187-41c5-a62f-61ceb5a37920","year":2026},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2604.04921","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:95f4607d9a935f80d9caf59bfdbb34f568e17cfa843eeab04b436d1056ccd443","observation_id":"585c9d86-b34e-410e-87fb-15c9d8aeb1d6","resolution":{"observed_at":"2026-05-25T05:25:23.483565Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:25.269811+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:25.269811+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04921","last_updated":"2026-04-06T17:58:42Z","snapshot_observed_at":"2026-08-12T23:14:44.419087Z","submitted_at":"2026-04-06T17:58:42Z","title":"TriAttention: Efficient Long Reasoning with Trigonometric KV Compression","version":1},"cited_work":{"arxiv_id":"2604.04921","doi":"10.48550/arxiv.2604.04921","metadata_source":"pith","pith_arxiv_id":"2604.04921","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"TriAttention: Efficient Long Reasoning with Trigonometric KV Compression","venue":"cs.CL","work_id":"988b5b75-a187-41c5-a62f-61ceb5a37920","year":2026},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2604.04921","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:9f34f173544ec26e3d25cd0baee3afe50b18e73ec33d6239728074a57d0f6046","observation_id":"9ec922cb-5ab8-452e-87f7-cce24f22df58","resolution":{"observed_at":"2026-05-25T05:25:22.790851Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:25.269811+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:25.269811+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.14135","last_updated":"2022-06-23T17:53:32Z","snapshot_observed_at":"2026-07-06T13:14:48.753329Z","submitted_at":"2022-05-27T17:53:09Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","version":2},"cited_work":{"arxiv_id":"2205.14135","doi":"10.48550/arxiv.2205.14135","metadata_source":"pith","pith_arxiv_id":"2205.14135","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with IO-Awareness","venue":"cs.LG","work_id":"efa96825-0830-4cfc-a250-fdaf6af302ab","year":2022},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2205.14135","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:4bba263bb223feafbbf099bca773f1d88ab7e5394d67abcd73e2592f5cff156a","observation_id":"a236cba2-8f0b-45aa-9f3f-5b057acc0283","resolution":{"observed_at":"2026-05-25T05:25:22.796195Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:18.534404+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:18.534404+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-08-20T03:52:57.605866Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":"2309.17453","doi":"10.48550/arxiv.2309.17453","metadata_source":"pith","pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Efficient Streaming Language Models with Attention Sinks","venue":"cs.CL","work_id":"a8d25452-c237-48c9-88a4-682717c3979a","year":2023},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:0daef8833661f97544fc7aa59fcb79e4996f6afb041bfe5f3f6461a3b60637f8","observation_id":"6b004f1c-b16b-4823-b4ba-b3d9833e2108","resolution":{"observed_at":"2026-05-25T05:25:23.500159Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.10","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transformers are multi-state RNNs","venue":null,"work_id":"33497ea7-307a-4c6d-9f53-8a9b094f3d69","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:2ac397e91335bad74746dc0cac5b5b27e0fb414a1455268ce19a041b33d69b36","observation_id":"deaddc38-fd8b-4a00-b0a9-a450bee7d478","resolution":{"observed_at":"2026-05-25T05:25:22.844753Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:25.619667+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:25.619667+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1d6d6f61-74fe-4729-b28c-6215b1cbe520","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:be2fd018434a273ca96e8096043a2fcd30d6d53989ac36f937ce8fa2421089db","observation_id":"66bd86df-7bcf-4680-bd7d-f0fe7b4158ef","resolution":{"observed_at":"2026-05-25T11:56:56.474810Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":"2406.02069","doi":"10.48550/arxiv.2406.02069","metadata_source":"pith","pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","venue":"cs.CL","work_id":"6317700d-f903-4ce1-8f53-b43cb146d48b","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:21d17e092366b604521a8ebbad324e45e9448d251bb79665c378cc8828269da0","observation_id":"39be823e-c8cd-4e40-9f5d-f9be27e03428","resolution":{"observed_at":"2026-05-25T05:25:22.830790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Omnikv: Dynamic context selection for efficient long-context LLMs","venue":null,"work_id":"9b59ea18-5cf0-4e33-979b-72f1ebf8dad1","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:81088917e6d3e6781d6a0a2239247ec4f026719df1a975fd1303388284d6a957","observation_id":"77d77e80-9eaf-4657-bc06-0d1495c20bd8","resolution":{"observed_at":"2026-05-25T11:56:56.516073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lacache: Ladder-shaped KV caching for efficient long-context modeling of large language models","venue":null,"work_id":"54d2aa68-23b2-426f-8cd4-c3c808f4d257","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:e0b3b3c1abd761d6932d7771140293caf2079aaccb4f326404c8e937287ae06a","observation_id":"fdc12e03-b86d-439d-8fa7-f8f5c6a9afc0","resolution":{"observed_at":"2026-05-25T11:56:56.502962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11550","last_updated":"2025-10-16T13:25:38Z","snapshot_observed_at":"2026-08-12T20:32:53.188699Z","submitted_at":"2024-07-16T09:53:32Z","title":"Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference","version":5},"cited_work":{"arxiv_id":"2407.11550","doi":"10.48550/arxiv.2407.11550","metadata_source":"pith","pith_arxiv_id":"2407.11550","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ada-KV: Optimizing KV Cache Eviction by Adaptive Budget Allocation for Efficient LLM Inference","venue":"cs.CL","work_id":"b41eb6db-193f-48ba-8278-6b1698524755","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2407.11550","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:83431197e9b9e26960ca1f4618d9e397084247896a12a12e84056040ff60d6d6","observation_id":"f6ef1f4f-8a40-4a43-8f63-a5272cdff75d","resolution":{"observed_at":"2026-05-25T05:25:22.824928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:26.442662+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:26.442662+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Duoattention: Efficient long-context LLM inference with retrieval and streaming heads","venue":null,"work_id":"2232d074-cbce-4ee8-9f2e-9dc8fcf57384","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:67e3e9b80de1b6df77bc5485d8be17c307f974a8b86ccb6671db30b6a15d4b09","observation_id":"04a61047-c70c-49ff-9da9-265f8a944d75","resolution":{"observed_at":"2026-05-25T11:56:56.535094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2410.19258","doi":"10.48550/arxiv.2410.19258","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Not all heads matter: A head-level KV cache compression method with integrated retrieval and reasoning","venue":"arXiv (Cornell University)","work_id":"fef1d60f-7438-4fe3-98bf-842ff43eac33","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:3676010248bd8e1e02f6ff268fc3de45f57f3ee671b55184ab153521d1977292","observation_id":"4411b3e0-230f-4d3a-9aee-7c98427b3f52","resolution":{"observed_at":"2026-05-25T05:25:22.836196Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:26.795347+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:26.795347+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Razorattention: Efficient kv cache compression through retrieval heads","venue":null,"work_id":"ef7efd0d-75f0-4349-9fc2-731a07bc3405","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:7fd99b0660d883a6953e5f9a0254fda3f92662ded6e1983f3559c049490502fe","observation_id":"f0765777-e841-4e2a-9689-e3fad1c48fef","resolution":{"observed_at":"2026-05-25T11:56:56.538152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-14T12:21:04.886717Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":"2404.14469","doi":"10.48550/arxiv.2404.14469","metadata_source":"pith","pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","venue":"cs.CL","work_id":"4afe6cb0-dba4-42b6-b553-e685e5730d61","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:2e1358d3a911fde853efa93afcb78930f329ee6b534d30758b4dba18eefad445","observation_id":"76bdaba2-da55-4d83-a34e-de2eb30fc050","resolution":{"observed_at":"2026-05-25T05:25:22.925216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:27.134462+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:27.134462+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22556","doi":"10.48550/arxiv.2510.22556","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sablock: Semantic-aware KV cache eviction with adaptive compression block size","venue":"arXiv (Cornell University)","work_id":"a353d32c-6976-4b7b-abca-684118fb4857","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:4de832a9c3eb56d5192f7783e8602ecee791cb5a9bc45057c56445a751cec61c","observation_id":"d0127d42-256f-4fa7-9068-dd540bef59e3","resolution":{"observed_at":"2026-05-25T05:25:22.813646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:27.557479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:27.557479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03213","last_updated":"2025-06-14T06:17:33Z","snapshot_observed_at":"2026-08-14T21:26:50.903212Z","submitted_at":"2024-12-04T10:58:27Z","title":"ClusterKV: Manipulating LLM KV Cache in Semantic Space for Recallable Compression","version":2},"cited_work":{"arxiv_id":"2412.03213","doi":"10.48550/arxiv.2412.03213","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.03213","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Clusterkv: Manipulating LLM KV cache in semantic space for recallable compression","venue":"arXiv (Cornell University)","work_id":"a9a2d115-42e6-4cad-8332-1533a18c30ec","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2412.03213","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:bd1f37a68c954d05990d7aac0e2fd82d6893d69ea6ae57a7037f30a022e09003","observation_id":"21e7a736-04de-4a3f-a0cd-e564770cedfe","resolution":{"observed_at":"2026-05-25T05:25:22.818782Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:27.93325+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:27.93325+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Protokv: Long-context knowledges are already well-organized before your query","venue":null,"work_id":"d5208bfb-362d-453d-a8f5-819527f563f6","year":2026},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:9646e857490c4d017ebf086cd1d3aaeb80602f6f40c919f34a5ee0a508a99454","observation_id":"b56acc4e-0235-4b0f-82c4-ac8b0f226949","resolution":{"observed_at":"2026-05-25T11:56:56.509669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04987","last_updated":"2025-05-16T12:32:36Z","snapshot_observed_at":"2026-08-15T18:26:51.078891Z","submitted_at":"2025-01-09T06:00:27Z","title":"TreeKV: Smooth Key-Value Cache Compression with Tree Structures","version":3},"cited_work":{"arxiv_id":"2501.04987","doi":"10.48550/arxiv.2501.04987","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.04987","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Treekv: Smooth key-value cache compression with tree structures","venue":"arXiv (Cornell University)","work_id":"9a60c9b4-1738-4f2c-9031-c03c852a6bc2","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2501.04987","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:072ab9c37f4847b9cc04f07fdfcc6dbb15ea2dbf016e22e84af8f115df741097","observation_id":"7a0673d6-ba0f-47f9-ba61-5c114be5d4de","resolution":{"observed_at":"2026-05-25T05:25:22.841372Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:28.351502+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:28.351502+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.13684","last_updated":"2026-04-18T08:34:09Z","snapshot_observed_at":"2026-08-17T05:04:07.975490Z","submitted_at":"2026-01-20T07:35:06Z","title":"HeteroCache: A Dynamic Retrieval Approach to Heterogeneous KV Cache Compression for Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":"2601.13684","doi":"10.48550/arxiv.2601.13684","metadata_source":"pith","pith_arxiv_id":"2601.13684","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"HeteroCache: A Dynamic Retrieval Approach to Heterogeneous KV Cache Compression for Long-Context LLM Inference","venue":"cs.CL","work_id":"784824ce-7f9d-4f3c-89bc-d1618ac6f5d6","year":2026},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2601.13684","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:e70e4caf75b1ca23a2ab36e3d69873e8ff40a70d9ff3832d24e93ccb8d9db7e1","observation_id":"3e02c168-b4cd-47a0-9f10-bc9227dd97f8","resolution":{"observed_at":"2026-05-25T05:25:22.915182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:28.750719+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:28.750719+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.00636","doi":"10.48550/arxiv.2510.00636","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expected attention: KV cache compression by estimating attention from future queries distribution","venue":"arXiv (Cornell University)","work_id":"06043450-dbd9-4e7f-92b5-07811314b835","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:2ed732f6cec6c517179b0a705715d04f25b1a3caa3172349bc09e9730f3840cc","observation_id":"099d8e43-74be-400a-b109-d68ff2d18a07","resolution":{"observed_at":"2026-05-25T05:25:22.906104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:29.197878+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:29.197878+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.00299","doi":"10.48550/arxiv.2502.00299","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chunkkv: Semantic-preserving KV cache compression for efficient long-context LLM inference","venue":"ArXiv.org","work_id":"fa935769-1d44-441f-9bac-780428c056d9","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:34974f1f75f90d6736726a97ccec15450d98a8fd7e0579ee8a4333cbc56c6b9c","observation_id":"70f175fd-eaf1-4b77-9e30-30a292b444f7","resolution":{"observed_at":"2026-05-25T05:25:22.900743Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:17.31981+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:17.31981+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ReST-KV: Robust KV cache eviction with layer-wise output reconstruction and spatial-temporal smoothing","venue":null,"work_id":"bd5430b9-ef2f-4021-834c-b0eae774f128","year":2026},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:43109766b2ba20e5c209e630eb3deae58006c54ab2088a87a338afd8d69c4161","observation_id":"f80f96d5-4bdc-451d-8af6-57f8d28139a8","resolution":{"observed_at":"2026-05-25T11:56:56.495550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.15364","doi":"10.48550/arxiv.2504.15364","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kediff: Key similarity-based KV cache eviction for long-context LLM inference in resource-constrained environments","venue":"arXiv (Cornell University)","work_id":"88d9d4c4-afc1-412a-968d-d8c0feb878cc","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:8cd2962e1bd5ae231624e180a4109e5f79bbfefc358d5a626c57d827ff458625","observation_id":"4c3e7acf-4664-40f4-9dac-e7392da40686","resolution":{"observed_at":"2026-05-25T05:25:22.910954Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:29.99463+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:29.99463+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13649","last_updated":"2025-06-03T01:55:18Z","snapshot_observed_at":"2026-08-18T11:01:50.775782Z","submitted_at":"2024-12-18T09:27:33Z","title":"SCOPE: Optimizing Key-Value Cache Compression in Long-context Generation","version":3},"cited_work":{"arxiv_id":"2412.13649","doi":"10.48550/arxiv.2412.13649","metadata_source":"pith","pith_arxiv_id":"2412.13649","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SCOPE: Optimizing key-value cache compression in long-context generation","venue":"cs.CL","work_id":"a1ff40d1-20ab-4092-b866-97e65daf1117","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2412.13649","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:26e976e6e9ea660e5c4a7d6758bf47357dd1cb91fcac76657e2e03b9175d08f9","observation_id":"cc45516e-0e19-40b4-9b17-2300cc497529","resolution":{"observed_at":"2026-05-25T05:25:22.920136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:30.411284+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:30.411284+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.00504","doi":"10.48550/arxiv.2512.00504","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"G-KV: Decoding-time KV cache eviction with global attention","venue":"ArXiv.org","work_id":"68912c8f-f593-4f26-848c-579edb4cbd05","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:337479e110652222d9db7712f1a5e24b6ff7888459455985d971bba6c34edaac","observation_id":"afa7b4e2-11d3-4e6d-bb09-7afe42e3635e","resolution":{"observed_at":"2026-05-25T05:25:22.895992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:30.829287+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:30.829287+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scissorhands: Exploiting the persistence of importance hypothesis for llm kv cache compression at test time","venue":null,"work_id":"fa99840c-92c1-4b3e-bcee-65a70ba1234a","year":2023},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:3f65b148bb894865c2dabe02dcb6b3dc58c5a75aef2f0dd43c6603f8362ab5c8","observation_id":"8d02ed1a-8487-4593-ac03-aa78281f361c","resolution":{"observed_at":"2026-05-25T11:56:56.548601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00161","last_updated":"2024-10-07T15:07:09Z","snapshot_observed_at":"2026-08-18T07:53:09.156899Z","submitted_at":"2024-09-30T19:09:13Z","title":"KV-Compress: Paged KV-Cache Compression with Variable Compression Rates per Attention Head","version":2},"cited_work":{"arxiv_id":"2410.00161","doi":"10.48550/arxiv.2410.00161","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.00161","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"KV-compress: Paged KV-cache compression with variable compression rates per attention head","venue":"arXiv (Cornell University)","work_id":"b58e490e-0e12-47af-8228-1da00c49e245","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2410.00161","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:dbc0283f3d86499718d4888e7efb108c7a2d4b8d53a2519a788c79806e3d5814","observation_id":"cdcd8753-33e6-4825-a0c9-53568346a642","resolution":{"observed_at":"2026-05-25T05:25:22.891170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:31.187596+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:31.187596+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/tacl_a_00638","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:45.037248Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":"Transactions of the Association for Computational Linguistics","work_id":"9c9c91f9-a321-4e33-8897-d66f6ad0f659","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:5c481f48ca7d3e07a93e97eb94d888bca821b101263dd01ae5b84bc89425445b","observation_id":"ba2d0acf-50a1-4ab3-82db-b89108d65011","resolution":{"observed_at":"2026-05-25T05:25:22.885884Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-12T23:38:04.9173+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-12T23:38:04.9173+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The curious case of neural text degeneration","venue":null,"work_id":"d0d6aaf1-4886-4798-8132-9c653055d275","year":2020},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:a89c1006a50d24d50ecd31c0e10975d735977c850d4443c56bec1f4731f64351","observation_id":"286f1144-6852-4b20-9d6d-c98dfba57b4b","resolution":{"observed_at":"2026-05-25T11:56:56.513042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.13334","doi":"10.48550/arxiv.2510.13334","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kevin Zhou, and Xike Xie","venue":"ArXiv.org","work_id":"ca3bfd30-1098-41b4-a97b-529e179bded6","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:f13ef8ae40a983c38c8c5f1e686fe4618fe19f275262d421900dc31bf7cacb32","observation_id":"653dd828-8a57-47f0-9efd-106439da8f25","resolution":{"observed_at":"2026-05-25T05:25:22.871512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:31.596221+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:31.596221+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.11504","last_updated":"2026-04-25T08:28:07Z","snapshot_observed_at":"2026-08-18T07:49:09.368602Z","submitted_at":"2026-03-12T03:46:35Z","title":"LongFlow: Efficient KV Cache Compression for Reasoning Models","version":2},"cited_work":{"arxiv_id":"2603.11504","doi":"10.48550/arxiv.2603.11","metadata_source":"pith","pith_arxiv_id":"2603.11504","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"LongFlow: Efficient KV Cache Compression for Reasoning Models","venue":"cs.LG","work_id":"3e0d57c1-73dc-4d10-a564-39ebd26ceb18","year":2026},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2603.11504","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:1ced0f7ac1399a25fde73d1b22f83988908fa48de6f61158e81c835a40884c7a","observation_id":"d10bef2c-5053-48fa-b8c4-1ab0b0f55879","resolution":{"observed_at":"2026-05-25T05:25:22.879156Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:31.93389+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:31.93389+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.11504","last_updated":"2026-04-25T08:28:07Z","snapshot_observed_at":"2026-08-18T07:49:09.368602Z","submitted_at":"2026-03-12T03:46:35Z","title":"LongFlow: Efficient KV Cache Compression for Reasoning Models","version":2},"cited_work":{"arxiv_id":"2603.11504","doi":"10.48550/arxiv.2603.11","metadata_source":"pith","pith_arxiv_id":"2603.11504","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"LongFlow: Efficient KV Cache Compression for Reasoning Models","venue":"cs.LG","work_id":"3e0d57c1-73dc-4d10-a564-39ebd26ceb18","year":2026},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2603.11504","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:cfdf09241e0db7f4761582a5ffde47b0f762130a0b1ff9da3859081d361bb3ed","observation_id":"08965108-e33e-4a4d-a554-c7b6ab65dd56","resolution":{"observed_at":"2026-05-25T05:25:23.505112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:31.93389+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:31.93389+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.06029","doi":"10.48550/arxiv.2511.06029","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lethe: Layer- and time-adaptive kv cache pruning for reasoning-intensive llm serving","venue":"ArXiv.org","work_id":"cfb7df6d-1a9f-484a-8145-a2a403597dfc","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:d7bbad3539cd2e87340ff3ae9cb3b2dacdeee567bbeb306486d0082fdd5e17e7","observation_id":"9c59b3d2-70db-46ba-8099-0942ca04da86","resolution":{"observed_at":"2026-05-25T05:25:22.859630Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:32.382601+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:32.382601+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.01290","last_updated":"2026-05-07T18:13:59Z","snapshot_observed_at":"2026-08-18T07:49:12.693242Z","submitted_at":"2025-10-01T04:09:02Z","title":"ThinKV: Thought-Adaptive KV Cache Compression for Efficient Reasoning Models","version":2},"cited_work":{"arxiv_id":"2510.01290","doi":"10.48550/arxiv.2510.01290","metadata_source":"pith","pith_arxiv_id":"2510.01290","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"ThinKV: Thought-Adaptive KV Cache Compression for Efficient Reasoning Models","venue":"cs.LG","work_id":"5ad7daa8-9125-4fb5-ba94-3517e19f89f7","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2510.01290","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:14d73b8c1d0e82925b93c913bbbaefc4b87bd793dbc20ae70704475d1b86621e","observation_id":"3f3a449f-4149-4e1b-bcdc-abcf6df48112","resolution":{"observed_at":"2026-05-25T05:25:22.865447Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:32.799364+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:32.799364+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:95639aca4ae457b0908b6ed00e2a3a3f7da358a1c9525e7d957754daa2748615","observation_id":"d1050df4-6db3-466b-a9b8-ae92b4c0f6ab","resolution":{"observed_at":"2026-05-25T05:25:22.853864Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s verify step by step","venue":null,"work_id":"a5effdc0-f511-485e-a8bb-592bd7bb29c2","year":2024},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:c02a986049c17b5561f9220e28e448e5dd7554822275cc9ae7e392383226a95f","observation_id":"432c82e3-8083-4a43-a185-2ed756185742","resolution":{"observed_at":"2026-05-25T11:56:56.478442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e95af6c7-7944-40b1-883a-3f091d1010c4","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:dc57a51d2cf7ee8ab825629ef94a0bfc528e06fd100687c593a2d34507a057c1","observation_id":"64968117-e6c0-4ccd-b9f1-12d4e657f983","resolution":{"observed_at":"2026-05-25T11:56:56.488768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:9895f0ab6fb3aac87a8ad349ca6d2972454ebe57538524df5d39fc60523bdbde","observation_id":"62f6a1d4-beae-4c40-ae8e-e9c9d68e6590","resolution":{"observed_at":"2026-05-25T05:25:22.849059Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseek-r1-distill-qwen-7b","venue":null,"work_id":"f4379c32-b28c-4077-90c3-25242a8acee4","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:226c02ceb29795855807a20154cf559142e435e4b3b1c9ebf2c37e9fbaa1e725","observation_id":"13b99926-8d00-4aee-b18f-a55847821a1f","resolution":{"observed_at":"2026-05-25T11:56:56.528849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseek-r1-distill-qwen-32b","venue":null,"work_id":"9194bb6a-e4ef-4e05-a571-0a5d287004f7","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:b72abe234b1bd1ad3f78a80e4b59cd89464086c4b5cfdb59dd62002fc71b7818","observation_id":"3db0515e-d7d5-4465-994f-dac415d5d83a","resolution":{"observed_at":"2026-05-25T11:56:56.481650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"lost in the middle","venue":null,"work_id":"0cc05a8d-adc3-49b9-8ea7-d2ba5d9332cc","year":2025},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:7eb6167d6e1169ef3c09eec30c18a4611bc646ed22d9f08bdfb7528e31f0e9a0","observation_id":"2990f303-9a6e-4acf-b933-5d75301c31ec","resolution":{"observed_at":"2026-05-25T11:56:56.506203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6bf6d126-ae0a-439e-a7dc-8a5912fd4975","year":null},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:b6f9e554079ab8a78b3097f078e77ab63256498694d627e9d81731a592803320","observation_id":"644d0bba-ab12-4ef0-b2b6-c610d1954223","resolution":{"observed_at":"2026-05-25T11:56:56.492078Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pass@1 is computed from metric_main / num_samples in the csv","venue":null,"work_id":"e9ff3f15-06de-48f0-96ff-0c359ce5be75","year":2048},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:54c33861b3336da180385243c893cf9688979ee5cfaebd7e2ce4a0ab82a02cc1","observation_id":"eb63684a-c8eb-4416-a27d-1d00ee7445e8","resolution":{"observed_at":"2026-05-25T11:56:56.531866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b6c0f772-865f-4d5b-b4ec-7db178610a57","year":null},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:2615c569d802f81c1532e9983f72315ba8cd53509f8962209ab468ae0f169b5f","observation_id":"98763174-6935-4f39-ba41-d8a3f7b95619","resolution":{"observed_at":"2026-05-25T11:56:56.525650Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8e1a0407-ee74-4e6d-a7d3-ea66549810f6","year":null},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:7166a628052dac4ee250f87c8a50235dae456a758744ba9668586ec78ad17730","observation_id":"8e26c9b0-c4da-4aa4-a04a-23ed96a65df0","resolution":{"observed_at":"2026-05-25T11:56:56.519133Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4f8e4646-29f9-4ee6-91c5-8427af7990ab","year":null},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:7936fbb5abe9d437df5b2fea30b8fe649242aa6d84162eeeed0f07b04a058fa9","observation_id":"8545ba2d-a254-42f5-bac8-77da825a6c3a","resolution":{"observed_at":"2026-05-25T11:56:56.540889Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simplify (u+ 4)(u−1)−(u+ 4)(u−1)","venue":null,"work_id":"416aa348-385e-4209-a07e-92d9479aea55","year":null},"citing_paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-25T05:22:47.198185Z"},"links":{"citing_paper":"/paper/2605.23200"},"observation_digest":"sha256:a2f8b2ecbdf48fc685d4c7ad26ee440d5a08d41636b59f19d9e619be1a91e391","observation_id":"450c1818-f43d-492b-82f3-197d02763788","resolution":{"observed_at":"2026-05-25T11:56:56.545357Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.23200","last_updated":"2026-05-22T03:32:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T12:58:20.920773Z","submitted_at":"2026-05-22T03:32:52Z","title":"Adaptive Mass-Segmented KV Compression for Long-Context Reasoning"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":1,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":6,"verified_exact":27,"verified_fuzzy":16},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2605.23200."}