{"as_of":"2026-08-19T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dbd74b970d1c8dbc17f92152c939ec74024409f092d5b1ff5599d54e0197a8a8","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T11:52:50.864071Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T10:41:08.967261Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.24786","snapshot_observed_at":"2026-07-14T10:41:08.967261Z","title":"CONF-KV: Confidence-aware KV cache eviction with mixed-precision storage for long-horizon LLM,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10582","last_updated":"2026-07-12T05:35:26Z","snapshot_observed_at":"2026-08-16T19:36:08.444701Z","submitted_at":"2026-07-12T05:35:26Z","title":"MemDecay: Region-Aware KV Cache Eviction for Efficient LLM Agent Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T10:41:08.967261Z"},"links":{"cited_paper":"/paper/2605.24786","citing_paper":"/paper/2607.10582"},"observation_digest":"sha256:7186d3eda8ab47163f49dd8ee738148188b05f5822a46acb9dce6248d465813f","observation_id":"9b41a0b9-8670-4a03-8d63-59bc1651e080","resolution":{"observed_at":"2026-07-14T10:41:08.967261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.24786/citation-record","integrity":"/paper/2605.24786/integrity","json":"/paper/2605.24786/citation-record.json","paper":"/paper/2605.24786"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":"2004.05150","doi":"10.48550/arxiv.2004.05150","metadata_source":"pith","pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Longformer: The Long-Document Transformer","venue":"cs.CL","work_id":"abea7a44-6668-4de7-aab6-f53a6e5aa088","year":2020},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:e76d9de0a48fdbc75d91cda192d7e7e6971d0df17533ed8acf57a2d26be7880c","observation_id":"a1bc029c-2c26-4abd-9883-38f9899bba81","resolution":{"observed_at":"2026-06-30T11:54:38.180010Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.909610Z","title":"Don’t waste bits! adaptive KV-cache quantization for lightweight on-device LLMs","venue":null,"work_id":"e2710583-23cb-4585-8edc-e7caf67d55e2","year":2026},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:8ed677540552ae736fa90dd2a252ded67b33b7a52a89afcfd7d2d4f439d4d9b8","observation_id":"c17f3790-9252-48b8-8446-e0d1ec4cd2a8","resolution":{"observed_at":"2026-07-09T08:06:04.910956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.920773Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"edbf28fa-6c2b-42a1-a79a-ab4c981502d2","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:7f5ba6ce201d48f552265bfb758f3d726e9f7fa85ec2f500846bc2870037bea3","observation_id":"936ac0db-5d5c-4b52-8df5-32a70327af2a","resolution":{"observed_at":"2026-07-09T08:06:04.921912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":"2406.02069","doi":"10.48550/arxiv.2406.02069","metadata_source":"pith","pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","venue":"cs.CL","work_id":"6317700d-f903-4ce1-8f53-b43cb146d48b","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:d4cf5bb8a845d9754d8df47e0ef947db18e121700879b41dec29f4887c9b6bf3","observation_id":"6cb3f8bb-9b81-41a5-a48b-b3de21a55b6d","resolution":{"observed_at":"2026-06-30T11:54:38.177115Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T13:53:26.042348+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.455817Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"3c743fc7-8c9b-4a72-ad8a-26c5a7636140","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:85e7b46bf5715ba7311ea377e008be3d1c64feb52905350cf8e3cbb12c2cc788","observation_id":"dc8d1351-2e37-46a3-8edb-8f73e70e7303","resolution":{"observed_at":"2026-07-09T08:06:04.929325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:07:50.752282Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher Ré","venue":null,"work_id":"1cf6266d-32d5-4dff-91d5-07b87fc70d1e","year":2022},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:094ac8d11e13145adf1819635dd971cf10a1315973b95a5e630a2702ce7efb91","observation_id":"641b5c0f-e1d9-4a60-a41d-e9d1e67cc7c4","resolution":{"observed_at":"2026-07-09T08:06:04.931052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.933254Z","title":"Kevin Zhou","venue":null,"work_id":"affe53a3-5182-423d-bd84-81140f200b55","year":2025},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:4d2d92c1081c7d945773aceb92ae9afbe6c3aadfc1b675da80a2ee8b6b420f88","observation_id":"909b1b3f-23ba-48f0-a06e-d52acd190257","resolution":{"observed_at":"2026-07-09T08:06:04.934358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.926213Z","title":"Model tells you what to discard: Adaptive KV cache compression for LLMs","venue":null,"work_id":"02773985-bbec-4f6b-bd13-255ccc495b18","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:94255879c6b78df3a3101ebf8a06d137d321a4ce3ba0b3c764e17647b7f2bb34","observation_id":"f107b549-213c-433a-b995-53616b3c2761","resolution":{"observed_at":"2026-07-09T08:06:04.927548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:49.805633Z","title":"Mahoney, Yakun Sophia Shao, Kurt Keutzer, and Amir Gholami","venue":null,"work_id":"78953019-8f03-471c-b366-c2ade0049322","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:148b6c822a8872f33b7eabb8fa202822f8ebfd8165ceb04f393073bfbb5cfca6","observation_id":"0b79e633-e71b-4028-9780-cbe1cee68b58","resolution":{"observed_at":"2026-07-09T08:06:04.939878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.924461Z","title":"Needle in a haystack — pressure testing LLMs","venue":null,"work_id":"bf333483-e813-4dbd-95c4-63f05d970a5d","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:4aa3d4442c6125d41f630df463ac7f15af53c1cd02f04ee3b5f56595f696a283","observation_id":"e1d9e33d-82e6-4438-bee2-0f3608a74bc1","resolution":{"observed_at":"2026-07-09T08:06:04.925707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.922589Z","title":"VisualWebArena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":"fe40de9b-4f11-4ef9-b9f2-112b40482399","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:ac0baf5ed1bc9f55a0e7bf3044ca8eae2aebd4a1932404d5ac4ff3a40841c51f","observation_id":"237a378f-5692-49ea-b0ed-094b92a47f0b","resolution":{"observed_at":"2026-07-09T08:06:04.923919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.934908Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":"32e54831-94f6-4594-aeb7-5f8a27691888","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:d9210b565c840bf05a0c7d4b327136937d3658f715f1c1ee14af424620f3bd59","observation_id":"0af25a82-f27e-49c6-90f6-edb0fcdb56df","resolution":{"observed_at":"2026-07-09T08:06:04.935985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.913384Z","title":"SnapKV: LLM knows what you are looking for before generation","venue":null,"work_id":"a8e810f0-c233-45fc-b3ce-94e50d2b9d8c","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:ab9b1b3b315b8422c496f0cfdd598060eed498f73a8614300ec64de00c0f7e50","observation_id":"b7a13331-c404-410f-9386-a80dbbc0cbe8","resolution":{"observed_at":"2026-07-09T08:06:04.914598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.915103Z","title":"Scissorhands: Exploiting the persistence of importance hypothesis for LLM KV cache compression at test time","venue":null,"work_id":"36d97233-640e-4eaf-871d-241f89ca5991","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:a991765550c3f09d9221bcd024e8fdb98f2d9f0abd3e18a1892277255fe644ad","observation_id":"c0ce2a79-b786-4449-8e17-c83d845f1f43","resolution":{"observed_at":"2026-07-09T08:06:04.916347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.916918Z","title":"KIVI: A tuning-free asymmetric 2bit quantization for KV cache","venue":null,"work_id":"d8c3c392-76d5-4160-935c-6e91ab70b2f4","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:1de8c1d569d8e8d2ff192a30d86c50391b66d415ee33d214697457bc9ec689fb","observation_id":"b38c4277-fda9-422d-9f2a-cf8726c25072","resolution":{"observed_at":"2026-07-09T08:06:04.918376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.936755Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"21acdf5f-9104-47d4-bd74-669e5604f099","year":2017},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:b7f66ca1000ad7eb350b7f5f70e8d3b91e7e43a54b0682358e883ea0aeda9798","observation_id":"7d12ed73-7d97-4316-8c85-bfd7b3428f0a","resolution":{"observed_at":"2026-07-09T08:06:04.938125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.907589Z","title":"SpecInfer: Accelerating large language model serving with tree-based speculative inference and verification","venue":null,"work_id":"5e395e8a-4b08-455e-938e-44d9d601fe6c","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:0b73d0351249d75cd14ec2890d663f1959e3fd1bab889c712520cf6b0799753e","observation_id":"3490ae96-86a2-406a-9f75-e829982ce10a","resolution":{"observed_at":"2026-07-09T08:06:04.908972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.949547Z","title":"gpt-oss-120b and gpt-oss-20b model card","venue":null,"work_id":"9d7c8bd3-ca0f-472f-a60c-b858aad6d573","year":2025},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:e64889a7409986674218dc9029cb96fe32a41c77b599a9d2966f36ef1021cea9","observation_id":"120e942b-0291-4d91-a5bf-737daeba8ec0","resolution":{"observed_at":"2026-07-09T08:06:04.950715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.911438Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"03adf024-9e9f-4c25-9b7e-ed30760b020f","year":2019},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:d64a3d828e6b2193f47ec508488987781deb0139d19a8524ae4836be09c73cd3","observation_id":"ac59b018-36da-4654-bf43-a9abe4f800a4","resolution":{"observed_at":"2026-07-09T08:06:04.912724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.918916Z","title":"SparQ attention: Bandwidth-efficient LLM inference","venue":null,"work_id":"de2d3458-d441-40b9-b839-06fe278a5269","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:cf724ac95f50e10a71b3134686abababa3baa338fffa353393cc242d7dcce533","observation_id":"1b2c2939-76c0-4124-9fea-5f7d70d2c013","resolution":{"observed_at":"2026-07-09T08:06:04.920264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.931538Z","title":"Tran, Yi Tay, and Donald Metzler","venue":null,"work_id":"ec824e2b-f888-4c9f-83d9-b2b2b8de05d1","year":2022},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:f484b1c7ad649e8c797d619e496012f7d167dad37370e89a3a49af076dd95984","observation_id":"51385273-83b5-4d4b-bd22-7ab2a4d072fb","resolution":{"observed_at":"2026-07-09T08:06:04.932662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.945525Z","title":"Quest: Query-aware sparsity for efficient long-context LLM inference","venue":null,"work_id":"4ba6ee47-3aa1-4432-ac07-75bd2998bf4e","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:578b3cd541997c41b12a06d0dd5ef732b706ac9c1682821d6a003e098f1f1440","observation_id":"e5bb450e-3763-40a6-ae8b-aa86de536add","resolution":{"observed_at":"2026-07-09T08:06:04.947048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:50.067047Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"153fd63e-49a6-41a2-ae73-882541c89257","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:87b656d3644fb324fbe96e93b5dfe7e6f8030b4b24ee19a4fd38f758bdd82b8e","observation_id":"26294ba7-a41b-41ff-bbb9-da6889a95bbb","resolution":{"observed_at":"2026-07-09T08:06:04.948943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.943861Z","title":"UNComp: Can matrix entropy uncover sparsity? a compressor design from an uncertainty-aware perspective","venue":null,"work_id":"7af1dafc-3b6e-4a41-bc43-ca7137c6513d","year":2025},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:614bc72b22d7d0298de6bb597b8da57dc3bbf287c01d7116a7aa2dbc6965b279","observation_id":"290d5321-04b0-417b-a409-aed13e10db3a","resolution":{"observed_at":"2026-07-09T08:06:04.944997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":"2309.16609","doi":"10.48550/arxiv.2309.16609","metadata_source":"pith","pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen Technical Report","venue":"cs.CL","work_id":"bb1fd52f-6b2f-437c-9516-37bdf6eb9be8","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:603e992e54dadb70d829a1d0c6cf9247a41cadda7b423538eeaa47a15dcaabb4","observation_id":"6eb7760b-962b-459e-92b9-0945d84f751d","resolution":{"observed_at":"2026-06-30T11:54:38.184689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:14.101106+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:14.101106+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:49.708611Z","title":"H2O: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"bfb332dd-b361-4b48-8344-2a3bb200d983","year":2023},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:6a2ca8422c48c724067cf2f4a0589b9fda81fccc328cef55530469c3c3ccb4f1","observation_id":"54c63ac9-97eb-4811-aa6a-22b6294eff83","resolution":{"observed_at":"2026-07-09T08:06:04.941651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09036","last_updated":"2024-12-12T07:52:56Z","snapshot_observed_at":"2026-08-17T22:49:01.152893Z","submitted_at":"2024-12-12T07:52:56Z","title":"ZigZagkv: Dynamic KV Cache Compression for Long-context Modeling based on Layer Uncertainty","version":1},"cited_work":{"arxiv_id":"2412.09036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09036","snapshot_observed_at":"2026-06-30T11:54:38.180786Z","title":"Limitations","venue":null,"work_id":"76372867-6fa9-4de9-be17-344cb47eadac","year":2024},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"cited_paper":"/paper/2412.09036","citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:ba31f5769b7587e0b36ef29488f5dd5545ec4ae0fc20b9c83c7b0dbbdb238f32","observation_id":"fd1b4ba8-56e7-44b9-ad00-d1000099beb8","resolution":{"observed_at":"2026-06-30T11:54:38.182377Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:06:04.942138Z","title":"Justification: The work does not involve human subjects, so IRB approval is not applicable","venue":null,"work_id":"97b0b4b9-3c6a-41f3-b7c5-a969781a6712","year":null},"citing_paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T11:52:50.864071Z"},"links":{"citing_paper":"/paper/2605.24786"},"observation_digest":"sha256:e7baae9d9eb3476963dfc1d258dffe33f5c6ff031ac233a7bfbad6bf17cede3a","observation_id":"4db70534-4856-471a-9c90-e36e08fb79f2","resolution":{"observed_at":"2026-07-09T08:06:04.943280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24786","last_updated":"2026-05-24T00:15:34Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T11:17:29.962837Z","submitted_at":"2026-05-24T00:15:34Z","title":"CONF-KV: Confidence-Aware KV Cache Eviction with Mixed-Precision Storage for Long-Horizon LLM"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":2,"verified_fuzzy":24},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 1 inbound Pith citation observation for arXiv:2605.24786."}