{"as_of":"2026-08-07T09:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6904950f4703a367cc33a6afa8333e97ecc945eb9732630c4a8f23102f2b475c","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:00:04.960649Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:45:48.497849Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:58.010890Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-05T17:55:08.361255Z","title":"Compresskv: Semantic retrieval heads know what tokens are not important before generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.15881","last_updated":"2025-08-25T02:24:20Z","snapshot_observed_at":"2026-08-05T17:55:04.790166Z","submitted_at":"2025-08-21T15:25:40Z","title":"TPLA: Tensor Parallel Latent Attention for Efficient Disaggregated Prefill and Decode Inference","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T17:55:08.361255Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2508.15881"},"observation_digest":"sha256:fbb055e808390e2956d2162e0fd65cebd63831c89bf6f4ac95c9dcbe26cffcde","observation_id":"74ef57b3-bd3a-4e58-9d51-25808beb877d","resolution":{"observed_at":"2026-08-05T17:55:08.361255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2606.06256","last_updated":"2026-07-29T11:03:07Z","snapshot_observed_at":"2026-08-02T22:42:55.789883Z","submitted_at":"2026-06-04T14:57:07Z","title":"RedKnot: Efficient Long-Context LLM Serving with Head-Aware KV Reuse and SegPagedAttention","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T00:59:58.150808Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.06256"},"observation_digest":"sha256:93242cba98ead3474b8a1e9120cdfbccf44af3c3e7b7fbdb5bc75a705f621512","observation_id":"3a5817d4-406b-4e47-aac6-a9ec47d5c553","resolution":{"observed_at":"2026-07-02T13:46:59.563761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2606.06256","last_updated":"2026-07-29T11:03:07Z","snapshot_observed_at":"2026-08-02T22:42:55.789883Z","submitted_at":"2026-06-04T14:57:07Z","title":"RedKnot: Efficient Long-Context LLM Serving with Head-Aware KV Reuse and SegPagedAttention","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T05:07:15.772855Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.06256"},"observation_digest":"sha256:583b7510b2553698afa6b57ce626c3f63443e8d619440f773c784b3382f2eec1","observation_id":"b6c4184e-7440-4a1e-8d3f-f2fc5b4e473b","resolution":{"observed_at":"2026-06-29T18:23:51.286192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-02T12:21:12.951114Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.06256","last_updated":"2026-07-29T11:03:07Z","snapshot_observed_at":"2026-08-02T22:42:55.789883Z","submitted_at":"2026-06-04T14:57:07Z","title":"RedKnot: Efficient Long-Context LLM Serving with Head-Aware KV Reuse and SegPagedAttention","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T12:21:12.951114Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.06256"},"observation_digest":"sha256:8797b40c8570ba13dfb6dddf36d2f5fa98f61e64e892fe716a931b4b435bf11d","observation_id":"73f9c723-cfc9-4014-964a-9d40153a4680","resolution":{"observed_at":"2026-08-02T12:21:12.951114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2606.24957","last_updated":"2026-06-23T08:51:20Z","snapshot_observed_at":"2026-08-06T21:01:25.213982Z","submitted_at":"2026-06-23T08:51:20Z","title":"Dustin: Draft-Augmented Sparse Verification for Efficient Long-Context Generation with Speculative Decoding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T00:11:58.636939Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2606.24957"},"observation_digest":"sha256:4116d78f3efad43f6ec34e09e292f63cc9a5b9dcb2efced88bb422439886a877","observation_id":"7bd4a058-0963-4f14-8896-5d35a218da9a","resolution":{"observed_at":"2026-07-04T16:49:58.012411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":"2508.02401","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-07-04T16:49:58.010890Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation.arXiv preprint arXiv:2508.02401, 2025","venue":null,"work_id":"340be3e3-71e8-4f5a-82e4-4e1c6102f113","year":2025},"citing_paper":{"arxiv_id":"2607.01002","last_updated":"2026-07-01T14:41:07Z","snapshot_observed_at":"2026-08-02T15:45:38.734888Z","submitted_at":"2026-07-01T14:41:07Z","title":"Logit-Contribution Scoring Identifies Non-Literal Retrieval Heads","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-02T12:55:48.518068Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2607.01002"},"observation_digest":"sha256:d6172b6971682b5f64b8f210309011737a795427d9a5d3aeeed1cfcceffb6f8c","observation_id":"cb7f3924-44fd-4157-b2f2-e6892b24057f","resolution":{"observed_at":"2026-07-02T12:56:56.481008Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-02T05:58:47.023358Z","title":"CompressKV: Seman- tic retrieval heads know what tokens are not important before generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13205","last_updated":"2026-07-14T18:55:20Z","snapshot_observed_at":"2026-08-07T03:50:03.504618Z","submitted_at":"2026-07-14T18:55:20Z","title":"Adaptive Filtering of the KV Cache: Diagnosing and Correcting Structural-Role Bias in LLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T05:58:47.023358Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2607.13205"},"observation_digest":"sha256:bc44f772d9d918efbd0229e22032f6b2c86698bd51edb9e73a2919a33291adae","observation_id":"c4c6b158-d9d8-4ea5-a3db-76de214a1547","resolution":{"observed_at":"2026-08-02T05:58:47.023358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-07T00:45:48.497849Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-07T09:17:06.723355Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.497849Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:b3e70408d3f4e91993803e00e414a9c86835275a618646d37243b48ef37198f6","observation_id":"5cbfbc9c-57d0-48b7-a240-4400d564416c","resolution":{"observed_at":"2026-08-07T00:45:48.497849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.02401/citation-record","integrity":"/paper/2508.02401/integrity","json":"/paper/2508.02401/citation-record.json","paper":"/paper/2508.02401"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:04.779838Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.779838Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:6234b0c5f695332012203003dc560f058ccd4e2bf3bdab60ad279078c506ba74","observation_id":"3a02f6cf-deb4-4025-aa64-a653838170ff","resolution":{"observed_at":"2026-08-06T05:00:04.779838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:04.786401Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.786401Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:0ff358d73599a84870762459ec935038701f5fc8c15d5a605015ea2018d1984a","observation_id":"27f24123-5625-4518-bb6d-ade1b4f74603","resolution":{"observed_at":"2026-08-06T05:00:04.786401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T05:00:04.793764Z","title":"L.; Almeida, D.; Altenschmidt, J.; Altman, S.; Anadkat, S.; et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.793764Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:db40fa42e1089211eac54646efabdbde26084092703c6e8271a88df325da93a0","observation_id":"d35d4ff9-9bcd-4f7c-9ba6-7225b7b00128","resolution":{"observed_at":"2026-08-06T05:00:04.793764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.568968Z","title":null,"venue":null,"work_id":"184e00df-bcfe-42bd-9b76-7691ef53a477","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.799587Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:0dc4c84ea03437bcc5af7793933feeed406297933825a5b846e58a8becce8a08","observation_id":"29409de1-d8e0-4a14-9cb3-d8fe2c293499","resolution":{"observed_at":"2026-08-06T05:00:06.573417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.504457Z","title":null,"venue":null,"work_id":"e872db21-4c25-41f1-b495-152d3d825dc2","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.804998Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:3555e98bac9d6996829d3ea1fe4e0e8675b2e63931f048c4b0076d3177fa9b7a","observation_id":"a98a3025-0163-4f9f-889c-a1555ac9658a","resolution":{"observed_at":"2026-08-06T05:00:06.558665Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.288057Z","title":null,"venue":null,"work_id":"e318e26f-1e99-43a9-a8ff-bea4eafc7c41","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.810924Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:c58641e076f450afc8b469514a3ded00c8042adae363fc711a3bf0f0924bd30f","observation_id":"184f0cd2-9907-46dc-b54d-70bb15275c2b","resolution":{"observed_at":"2026-08-06T05:00:06.392314Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-06T05:00:04.815941Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.815941Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:ee3ffacfc79d8250abec7592c1b116098f89ecf631d8a48ea18bc18e2cc36498","observation_id":"8c878f50-e796-4a0e-bff9-99634a5bdaa3","resolution":{"observed_at":"2026-08-06T05:00:04.815941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:06.139309Z","title":null,"venue":null,"work_id":"b63b6165-307c-42e0-986a-30c9d5826442","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.822374Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:e870829ffa4d290963763a481190c9feb0e62ac869335f13c58fdf418fb766f5","observation_id":"84ed15f5-85b1-4afc-a7ef-2aa92570c212","resolution":{"observed_at":"2026-08-06T05:00:06.210840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T05:00:04.828588Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.828588Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:6d4038eb78b1d8957e60bfa1904da8f4cc8c09c3fcd4c6895605b2d12b3906c7","observation_id":"26dc0eb0-c611-4196-b4b1-2e5f2e029558","resolution":{"observed_at":"2026-08-06T05:00:04.828588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.964379Z","title":null,"venue":null,"work_id":"f9a9c5ae-f9f6-4f80-9e25-61eff47ac5cc","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.834223Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:cf7d77df47d7236873b4a40609875f9dad1dce7d1df42d250eb32fed1dc2dbf7","observation_id":"8f3a3bae-6a3c-45ec-b188-bf28b077236a","resolution":{"observed_at":"2026-08-06T05:00:06.029166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.813831Z","title":null,"venue":null,"work_id":"d36613d5-3ab4-45bd-9f2d-0721ef7a4d4f","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.839504Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:942da98510bb1ca5736d1049c0e1eea5ed2de453c795020f7d72908afc77b35e","observation_id":"40aa3301-c05b-4827-ae76-844e2120e222","resolution":{"observed_at":"2026-08-06T05:00:05.870810Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T05:00:04.844683Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.844683Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:33e28e4b56477baa77e9406a00a34bac7d878bd8f60573495c058b398999e1cd","observation_id":"d078d48f-b356-4f6f-88ad-62ae9762ad7a","resolution":{"observed_at":"2026-08-06T05:00:04.844683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08825","last_updated":"2024-03-08T02:49:12Z","snapshot_observed_at":"2026-08-06T19:26:27.412366Z","submitted_at":"2023-10-13T02:41:55Z","title":"From CLIP to DINO: Visual Encoders Shout in Multi-modal Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08825","snapshot_observed_at":"2026-08-06T05:00:04.849995Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.849995Z"},"links":{"cited_paper":"/paper/2310.08825","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:e20730b468dcfa1578bf3998021ff479795a9b56140219372f3718891e66c64e","observation_id":"6d5705cf-9e95-4c13-baa3-b7bdb6ecc9bd","resolution":{"observed_at":"2026-08-06T05:00:04.849995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.658588Z","title":null,"venue":null,"work_id":"608f7522-428a-44f0-82f1-bddbd77fe325","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.855134Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:84777f0d20271b8c20435fc71240a640b26dcd9349f64de9e64417ffa34f9f52","observation_id":"1ced2924-ce9e-4a4f-9fc1-de6b2f1b1e86","resolution":{"observed_at":"2026-08-06T05:00:05.717892Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05527","last_updated":"2024-09-30T22:44:58Z","snapshot_observed_at":"2026-08-07T06:21:29.497754Z","submitted_at":"2024-03-08T18:48:30Z","title":"GEAR: An Efficient KV Cache Compression Recipe for Near-Lossless Generative Inference of LLM","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05527","snapshot_observed_at":"2026-08-06T05:00:04.860070Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.860070Z"},"links":{"cited_paper":"/paper/2403.05527","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:587c449f220108e6ca4abd17b7a4c25d943195d0b960464548b27fb47fcffb2b","observation_id":"8c0fae0e-b197-4574-816e-8b75130645d1","resolution":{"observed_at":"2026-08-06T05:00:04.860070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.569850Z","title":"W.; Hassoun, J.; Keutzer, K.; and Gholami, A","venue":null,"work_id":"df75ce26-f23b-4a7a-b935-8f43359d4690","year":2022},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.865352Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:2c0e780183eefbf152e03938fd62067f3d27727f6e912200e315cdb61b2db498","observation_id":"d879762a-4373-4993-a9cb-18c01300240e","resolution":{"observed_at":"2026-08-06T05:00:05.583593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.538010Z","title":null,"venue":null,"work_id":"26748359-e5e4-4e61-9d90-8f75eea36bcb","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.870062Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:656106d1d55a6a40f72f8231a6319e67e9d5894a0da960e30eade2cd616d8e31","observation_id":"7bcaff39-b696-41ee-b68a-2714272fe34c","resolution":{"observed_at":"2026-08-06T05:00:05.551971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.498752Z","title":null,"venue":null,"work_id":"d37abba5-651e-41bb-b0db-ab24a904cc84","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.875443Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:9b9c2a37a042f81c310f8cc1799ef81da863d61bad53b8868d520ad5a138344a","observation_id":"3f2a0ce4-018a-4b16-807b-aa3d3c12c121","resolution":{"observed_at":"2026-08-06T05:00:05.518917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.451596Z","title":null,"venue":null,"work_id":"3fb8653f-64b5-4072-94ac-f27afcf4c039","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.882201Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:7283ba490bfc659b8e8900e1dbc8accd6171d25cd33fab3a476564b3a7ce69fc","observation_id":"13c1d72a-dab8-4db1-8802-b93013336e6d","resolution":{"observed_at":"2026-08-06T05:00:05.474642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-06T05:00:04.888968Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.888968Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:a1455019930889d50455d238567a13d169075b8f44d03f3268e5a6ab867025a3","observation_id":"e77090e4-efae-4abd-a79c-1ab8e7b9dce8","resolution":{"observed_at":"2026-08-06T05:00:04.888968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.422158Z","title":null,"venue":null,"work_id":"ccfc6ea5-4209-4ab1-a693-d7d0ecc299e4","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.895117Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:bf3ecb2c918d31644b2629e3dfddd1cefdb2606d5e9fb5f76d70fd8d92a8a6dd","observation_id":"deaabee4-fd31-4276-84ab-77e032f2bc63","resolution":{"observed_at":"2026-08-06T05:00:05.433406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.384089Z","title":null,"venue":null,"work_id":"e3e79a62-ce40-4157-b3be-46198c8dfba8","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.901167Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:a1011c77c2b8de08a7fade4a4ff384bcdaa5286a7693f171ce672ac7e58b01b5","observation_id":"c15ab8df-5f20-4cc3-b2b8-aa06a8f67add","resolution":{"observed_at":"2026-08-06T05:00:05.394304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.357304Z","title":null,"venue":null,"work_id":"a9513f1c-9fd1-4f3d-bef6-a37bfbf6586d","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.906299Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:9153e3d4d7817139757ef20e1309f26044f53c51603b6d03c5ba53580946656a","observation_id":"7a4c5a16-b72c-46d0-8de1-a9b4aeae8428","resolution":{"observed_at":"2026-08-06T05:00:05.368266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.328367Z","title":"S.; Mueller, A.; Wallace, B","venue":null,"work_id":"c0aa73cb-789f-4406-9666-e34feb527277","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.911260Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:41c66215ba6041b1518b25450633226290da92f95beae7c3c950a213eda8afd4","observation_id":"8cd0f08a-073b-4a78-908e-d72ddbd2c551","resolution":{"observed_at":"2026-08-06T05:00:05.340020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.303873Z","title":null,"venue":null,"work_id":"58e52682-d036-4eef-82c1-ee860dc4e5d4","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.916770Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:3d42346d08870c57541a644a5f4f8b52609eb57276e6aee1bdbef5cbb72546ad","observation_id":"1dd5fdba-5518-44ba-b0b2-06ee75489207","resolution":{"observed_at":"2026-08-06T05:00:05.312877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.280147Z","title":null,"venue":null,"work_id":"9cff25ed-50ed-4b1b-acaa-a049e672997d","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.922227Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:2159eada91b9c40a6b58fe0091ae5132bff1f7bb32a265c852af69ef6e427434","observation_id":"72e1750b-60d2-4b68-802d-972fcb93b502","resolution":{"observed_at":"2026-08-06T05:00:05.286136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.261105Z","title":null,"venue":null,"work_id":"83ae1203-acbb-44ed-a9f9-98bd639f15bd","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.927132Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:9f1b52266987009944408b4759ce2dac1c447f155b1817875662557faa490a43","observation_id":"796bbb22-98d9-44f4-b3b8-d8f223e9624d","resolution":{"observed_at":"2026-08-06T05:00:05.267210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.244394Z","title":null,"venue":null,"work_id":"a739665a-2e8e-4eeb-9271-6474ff317f5b","year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.933197Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:bae3b392e0b473c2bac6b0a007341589192d29328f64fb3c2cc62c2b9b26fe49","observation_id":"a1a835be-7f60-47f0-9cdb-b4fcfcaf23e8","resolution":{"observed_at":"2026-08-06T05:00:05.249883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.224530Z","title":null,"venue":null,"work_id":"e1c93de9-7544-49a6-b4f6-18a4fde53b4e","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.939407Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:ad6001a325ecb12602b2eee700e0c7a02b2aa50172a57e5e6df7c122157c7b4e","observation_id":"40396696-54d0-46ab-ac12-01f4f16c3c70","resolution":{"observed_at":"2026-08-06T05:00:05.230188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.205677Z","title":null,"venue":null,"work_id":"02afd7fd-aa24-4caa-a831-e5eb0353c881","year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.945402Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:4cfcaafd464a68909230941bf5715682b3e2677ebd63d7dcdf87947b1127015f","observation_id":"02531ed0-ac6e-4216-b7b9-95e72124d791","resolution":{"observed_at":"2026-08-06T05:00:05.211749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14010","last_updated":"2025-02-19T12:25:02Z","snapshot_observed_at":"2026-07-06T20:39:24.018489Z","submitted_at":"2025-02-19T12:25:02Z","title":"Which Attention Heads Matter for In-Context Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14010","snapshot_observed_at":"2026-08-06T05:00:04.950853Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.950853Z"},"links":{"cited_paper":"/paper/2502.14010","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:3f7bcff5f815c3f97d88e595fc7413446d571725eab09efe2397b876bd25b703","observation_id":"559f2c11-27d4-4467-990f-fef5903a6315","resolution":{"observed_at":"2026-08-06T05:00:04.950853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:00:05.182639Z","title":null,"venue":null,"work_id":"f645cda6-5aab-4b48-898e-e89d9bea9ba9","year":2023},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.955991Z"},"links":{"citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:abef13f3389bd1b3ea6fba8514736c1e2f8af999df66967a2c66d93674053cd3","observation_id":"879b0e84-2314-4f70-8203-4ad5c9b152bf","resolution":{"observed_at":"2026-08-06T05:00:05.192752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03752","last_updated":"2024-12-23T17:57:29Z","snapshot_observed_at":"2026-08-04T07:16:36.104421Z","submitted_at":"2024-09-05T17:59:12Z","title":"Attention Heads of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03752","snapshot_observed_at":"2026-08-06T05:00:04.960649Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:00:04.960649Z"},"links":{"cited_paper":"/paper/2409.03752","citing_paper":"/paper/2508.02401"},"observation_digest":"sha256:8593c498cf78fe51e2c88c4b1c0dabae4eb2472d3d1c8f7589659e3419caa02a","observation_id":"f850a8c1-c2d6-4877-a7ec-11ac5ecdee6f","resolution":{"observed_at":"2026-08-06T05:00:04.960649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T06:22:02.645345Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 8 inbound Pith citation observations for arXiv:2508.02401."}