{"as_of":"2026-08-13T08:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:16d1a658f91206dfccde69af7c6684b23b7e09b99ebc5919ba62fceb850b4e90","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:32:37.769236Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.08097/citation-record","integrity":"/paper/2608.08097/integrity","json":"/paper/2608.08097/citation-record.json","paper":"/paper/2608.08097"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-12T00:32:37.548174Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.548174Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:06d3cdd2a53ed91c7826579341b1653e25d17547a4cb05389fbcee1fe57219ca","observation_id":"af0bf56f-bea9-4b5e-a05b-06bc139976ee","resolution":{"observed_at":"2026-08-12T00:32:37.548174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.085971Z","title":null,"venue":null,"work_id":"73e9027b-51ed-4a31-80ca-0c2b1028371c","year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.553554Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:6d6190be25b2808d63c2713e1818583e7956066671e07cdd22540dfe6a171664","observation_id":"937ab863-a18a-42ae-a550-4a1027d23276","resolution":{"observed_at":"2026-08-12T00:32:39.090364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.14778/379","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.759088Z","title":null,"venue":null,"work_id":"f390f9dd-b826-440b-8b69-b669af9607c2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.558655Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:c84f7734f77797a4e17f96c2bb8f6e3b331ce79b3ab67ab6da884a4a75608de3","observation_id":"6eac5927-acb2-444f-ae13-9fd74da242e5","resolution":{"observed_at":"2026-08-12T00:32:38.764098Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-12T00:32:37.563550Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.563550Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:78f5524660ac524180b767ea0fc8595eab8aa5134500ba2808cb72b1e950bee0","observation_id":"91792a2e-9c4e-4213-aa3f-fc6d13aa6f0e","resolution":{"observed_at":"2026-08-12T00:32:37.563550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-08-12T08:24:59.243273Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-12T00:32:37.568595Z","title":"DeepSeek-AI","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.568595Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:e447d2f0fe2f7e17ecaeff93bacd43f4b15afd2f1036c895563f9d74da6ffb4a","observation_id":"ccc1fac3-887d-4ef5-876f-b9b69b509e7b","resolution":{"observed_at":"2026-08-12T00:32:37.568595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.071502Z","title":"Hendryx, Zifan Wang, Chen Bo Calvin Zhang, Noah Jacobson, Bing Liu, and Brad Kenstler","venue":null,"work_id":"56a4f0e4-2c1d-4fb6-8c83-1d390f170c4b","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.573482Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:d9f93eae8659abea707c838811803ff6c135a10a8aa71f2ad38a7e29e6d54bc5","observation_id":"c7e8b1f0-4b3d-4ecb-a5e3-9373abf35d6f","resolution":{"observed_at":"2026-08-12T00:32:39.076004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.056920Z","title":null,"venue":null,"work_id":"2ce00280-3b3a-47f8-a523-0529ee3a1ef6","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.578640Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:001075f84f781e6c1fcf00651d913c72337c3889eab7e26f4fab9f3a9301c9af","observation_id":"8eac5092-a1c1-407b-8f13-ce05c7903430","resolution":{"observed_at":"2026-08-12T00:32:39.061475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13276","last_updated":"2025-02-17T02:24:47Z","snapshot_observed_at":"2026-08-12T22:21:14.844495Z","submitted_at":"2024-10-17T07:07:09Z","title":"SeerAttention: Learning Intrinsic Sparse Attention in Your LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13276","snapshot_observed_at":"2026-08-12T00:32:37.587787Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.587787Z"},"links":{"cited_paper":"/paper/2410.13276","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:24ca940170dde6ef642b04e58aad5880e7510c831bd7f679ae4b5f014d4354a5","observation_id":"38edf940-1fcd-4116-8a21-b25c5827e5e4","resolution":{"observed_at":"2026-08-12T00:32:37.587787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.042835Z","title":null,"venue":null,"work_id":"c97eae23-0326-4812-ad4e-475646f6c466","year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.592360Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:374c0fa498bbff845e76b7a30bc899c2c6445153927998e798585ac59b82c0f7","observation_id":"a018605d-1938-4fb8-81b5-005e03e0d0c1","resolution":{"observed_at":"2026-08-12T00:32:39.047160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.028507Z","title":null,"venue":null,"work_id":"570e3384-db6c-46c9-8496-56a5ca6ab02c","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.596804Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:75d2cfe6df8b79e6646eb8d3704a1d24cd03c8886f0236443b861bda5f26a6a1","observation_id":"2c61d42a-e2bd-4aaa-b41d-f29dfa8b0c6f","resolution":{"observed_at":"2026-08-12T00:32:39.032925Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02490","last_updated":"2024-10-30T14:53:22Z","snapshot_observed_at":"2026-08-12T23:30:11.201041Z","submitted_at":"2024-07-02T17:59:56Z","title":"MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02490","snapshot_observed_at":"2026-08-12T00:32:37.605595Z","title":"Abdi, Dongsheng Li, Chin-Yew Lin, Yuqing Yang, and Lili Qiu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.605595Z"},"links":{"cited_paper":"/paper/2407.02490","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:8171e2f3b1f60a0e46b77f8d8ea7013b9522c87d1f36683471b72910128ad532","observation_id":"ac14ab7f-d113-4e76-9b76-816b3b767422","resolution":{"observed_at":"2026-08-12T00:32:37.605595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.22910","last_updated":"2026-05-13T05:25:05Z","snapshot_observed_at":"2026-08-13T08:00:34.413924Z","submitted_at":"2026-03-24T07:58:42Z","title":"EchoKV: Efficient KV Cache Compression via Similarity-Based Reconstruction","version":2},"cited_work":{"arxiv_id":"2603.22910","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.22910","snapshot_observed_at":"2026-08-12T00:32:38.593562Z","title":"EchoKV: Efficient KV Cache Compression via Similarity-Based Reconstruction","venue":"cs.CL","work_id":"7b0cc31f-b307-42ab-9d57-93ecf7a916e3","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.600976Z"},"links":{"cited_paper":"/paper/2603.22910","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:6d1865969a22b191d7fb9b5257c8c8f065494e15934ad5e32f7c969939f55dff","observation_id":"8c68286f-d414-45b1-8740-242bdbc633fd","resolution":{"observed_at":"2026-08-12T00:32:38.599090Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20766","last_updated":"2025-02-28T06:34:53Z","snapshot_observed_at":"2026-08-07T17:40:46.337382Z","submitted_at":"2025-02-28T06:34:53Z","title":"FlexPrefill: A Context-Aware Sparse Attention Mechanism for Efficient Long-Sequence Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20766","snapshot_observed_at":"2026-08-12T00:32:37.614058Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.614058Z"},"links":{"cited_paper":"/paper/2502.20766","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:3d44627d73f952d41cc2269b00bac60d1afab756e9ee54f208870178768b9cf9","observation_id":"78017947-a256-42b2-af92-388ef4ebc6e2","resolution":{"observed_at":"2026-08-12T00:32:37.614058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:39.013902Z","title":null,"venue":null,"work_id":"3046c845-dbf4-40da-9672-8f04ed9a94d0","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.609953Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:7feeb9e62b4533fbef776fd8631f5630c96d0543d467eb986b0f92055eadbf95","observation_id":"8d9f0df2-b4ba-4e0c-b6ac-3093900edb9f","resolution":{"observed_at":"2026-08-12T00:32:39.018204Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.998314Z","title":null,"venue":null,"work_id":"6b0bd302-2a48-433f-bb8c-c77b3e6a6f23","year":2023},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.623507Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:682c36eb2a76b0a4dc3ef1921164919267466e2af2c6c133c9bc8304c1c125a4","observation_id":"6fd73aff-c8f0-43c4-a4eb-ac8ac045daa9","resolution":{"observed_at":"2026-08-12T00:32:39.003234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19707","last_updated":"2024-06-28T07:41:26Z","snapshot_observed_at":"2026-08-12T23:33:03.580232Z","submitted_at":"2024-06-28T07:41:26Z","title":"InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19707","snapshot_observed_at":"2026-08-12T00:32:37.618708Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.618708Z"},"links":{"cited_paper":"/paper/2406.19707","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:5a15b2efc2bbe3b9ce6da5aca60cacdbb7de09628d8cb16232e9dd8268bbb693","observation_id":"fde42d2b-c679-4b89-b9d4-d136330f7f74","resolution":{"observed_at":"2026-08-12T00:32:37.618708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18071","last_updated":"2026-05-18T08:54:16Z","snapshot_observed_at":"2026-08-02T15:32:20.092680Z","submitted_at":"2026-05-18T08:54:16Z","title":"KVDrive: A Holistic Multi-Tier KV Cache Management System for Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":"2605.18071","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.18071","snapshot_observed_at":"2026-08-12T00:32:38.522268Z","title":"KVDrive: A Holistic Multi-Tier KV Cache Management System for Long-Context LLM Inference","venue":"cs.CL","work_id":"6e6ae37d-4fb0-486e-9974-c7f47184acb2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.632695Z"},"links":{"cited_paper":"/paper/2605.18071","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:112fc8095548612700c5fb71ad7817d67163fdd8ca58dabcb26eec89b8aa6cc3","observation_id":"f1af8768-1358-4810-8225-43936f42a85a","resolution":{"observed_at":"2026-08-12T00:32:38.527345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.980568Z","title":null,"venue":null,"work_id":"6d161668-56bb-4621-b39a-bb069805a55e","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.627988Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:b9be8f4762a3c66b9167bd28b9d569216766de493299914994dcc670b900aa6e","observation_id":"90eaca20-1378-4ee7-abee-fe8262d687d2","resolution":{"observed_at":"2026-08-12T00:32:38.987077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.963633Z","title":null,"venue":null,"work_id":"8433819c-9d67-414b-a427-c4d573f6ddb2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.642228Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:48b235cf3a7d9ce1e1df65f7c1f3123ec4d90d16188410b5e15320194580e144","observation_id":"329c59ab-7894-4f2a-b291-92dac0dd6381","resolution":{"observed_at":"2026-08-12T00:32:38.969312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.00101","last_updated":"2026-07-30T20:51:51Z","snapshot_observed_at":"2026-08-12T22:05:17.093446Z","submitted_at":"2026-07-30T20:51:51Z","title":"Agentic Coding in the Wild: Characterizing GitHub Copilot Traces at Production Scale","version":1},"cited_work":{"arxiv_id":"2608.00101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00101","snapshot_observed_at":"2026-08-12T00:32:38.501178Z","title":"Agentic Coding in the Wild: Characterizing GitHub Copilot Traces at Production Scale","venue":"cs.AI","work_id":"35ddbaf0-4d0c-4bfe-9fdf-8464c4953d5a","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.637449Z"},"links":{"cited_paper":"/paper/2608.00101","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:5006e020df4e3c0ae2ac537fcab9aaabe608af4e05653817fe90aa8a835aadc8","observation_id":"fa98d9e0-05c9-4048-8494-33111dac299e","resolution":{"observed_at":"2026-08-12T00:32:38.505931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.25852","last_updated":"2026-07-29T07:31:33Z","snapshot_observed_at":"2026-08-07T17:12:03.331999Z","submitted_at":"2026-07-28T15:25:05Z","title":"AngelSpec: Towards Real-World High Performance Inference with Speculative Decoding","version":2},"cited_work":{"arxiv_id":"2607.25852","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.25852","snapshot_observed_at":"2026-08-12T00:32:38.388730Z","title":"AngelSpec: Towards Real-World High Performance Inference with Speculative Decoding","venue":"cs.CL","work_id":"7d44d086-b23e-4123-b0e4-c22c0be3e132","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.651350Z"},"links":{"cited_paper":"/paper/2607.25852","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:7634dfb3aa4a521953e2a20e194fdf74596aabe05f368874f0562bc32c6e62ee","observation_id":"bb8e88f1-9d60-4275-92e9-ebbfc6a509e8","resolution":{"observed_at":"2026-08-12T00:32:38.393837Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.646859Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.646859Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:e3c0b53eb120f2196be7a616100adc6e1a6a1a83c077069164013db78ca8cf35","observation_id":"7340ac47-0189-4b09-a9d8-188fa296265c","resolution":{"observed_at":"2026-08-12T00:32:37.646859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.930786Z","title":null,"venue":null,"work_id":"7354e0dc-a09e-40fa-820c-b77279703fb2","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.659855Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:351272fdcb216db43b4425ef6787300917e4121f391645ca4dab4ce5360e13ad","observation_id":"76cc6429-15e8-406e-8cb8-5edf2bfcd724","resolution":{"observed_at":"2026-08-12T00:32:38.935417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.946756Z","title":null,"venue":null,"work_id":"33969b08-e491-4124-9f15-cd6d47d226fc","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.655699Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:7868f7948e94e28ac376883229d542e83271eb6885c4b8fa8044db95a54efd3f","observation_id":"956f4cbe-a696-466f-a363-0827e0387c53","resolution":{"observed_at":"2026-08-12T00:32:38.951813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.916037Z","title":null,"venue":null,"work_id":"3aabde6e-1274-497e-b0e4-a0e9eef2fff8","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.668311Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:f721eb3c135a4242819fc02ec1279dedefe1eaecc5b6b04e37f52f59850ae8ad","observation_id":"550cb5d8-15a7-4894-93e3-f5624139423c","resolution":{"observed_at":"2026-08-12T00:32:38.920419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.663878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.663878Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:c91241bd18a2d0afed05b735a6d69ae93d7d1e103b9ae2c1113d21005d01a46d","observation_id":"f3a94a7a-f955-4c64-88b8-71a87606046b","resolution":{"observed_at":"2026-08-12T00:32:37.663878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-12T00:32:37.676424Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.676424Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:d7fa9e2f03a46a9a592c3559b7cde3d2bb96427f75408adcaf757146029caea6","observation_id":"29f2e448-e553-43b8-b173-3b20bc724e73","resolution":{"observed_at":"2026-08-12T00:32:37.676424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.901663Z","title":null,"venue":null,"work_id":"a4d7984f-8e91-4770-924d-a625ab8d8a0d","year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.672425Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:594945cadec344ce073300ba048d2b9c7218d397da993712780612bdc8c1969b","observation_id":"e808feac-a137-4a0d-961a-ef5d0a3a755c","resolution":{"observed_at":"2026-08-12T00:32:38.906117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.685118Z","title":"Graham Lopez, Matthew B","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.685118Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:25ca61212bb98f9ded4483e2aae674d77dc8316dfcc47f3c6082acc40367074f","observation_id":"34de9866-6f3f-4ba6-ba4e-a08d451285af","resolution":{"observed_at":"2026-08-12T00:32:37.685118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.886939Z","title":null,"venue":null,"work_id":"d8ce996c-47cd-43cb-88bc-6630732b72d3","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.681078Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:7a424982d610faa3df670f1356f5bbb9d8995b1f23a7511cdb33626f6c7c87a5","observation_id":"1972923b-11ba-4575-9ffe-b25ed95ee239","resolution":{"observed_at":"2026-08-12T00:32:38.891328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10774","last_updated":"2024-08-26T21:01:02Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T01:33:02Z","title":"Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10774","snapshot_observed_at":"2026-08-12T00:32:37.694091Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.694091Z"},"links":{"cited_paper":"/paper/2406.10774","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:3e2bff335213cc5c25653db17aea026543d366ae3a97d2514736c9fa944c0634","observation_id":"18f2639a-c252-41ff-bc85-258af43f0643","resolution":{"observed_at":"2026-08-12T00:32:37.694091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21465","last_updated":"2025-04-25T19:40:54Z","snapshot_observed_at":"2026-08-12T22:13:26.137322Z","submitted_at":"2024-10-28T19:08:12Z","title":"ShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21465","snapshot_observed_at":"2026-08-12T00:32:37.689283Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.689283Z"},"links":{"cited_paper":"/paper/2410.21465","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:a9eff07fe484d82a904d46c9809b58fd17021fc1a075ed0deb00b9cfa6385785","observation_id":"3a033333-3dc6-44ff-94f6-e1e6a600920c","resolution":{"observed_at":"2026-08-12T00:32:37.689283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.845639Z","title":null,"venue":null,"work_id":"64f42f4b-dd3e-409d-85d0-56fccfe45755","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.703202Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:47e69de48dc44e30bc2c7d8fe97f7a35f5158aa868489bfa190c7b7f0c1c25a4","observation_id":"1735977b-82d3-4f0f-b7b3-151147e1617f","resolution":{"observed_at":"2026-08-12T00:32:38.850226Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.861011Z","title":null,"venue":null,"work_id":"28a9b9fe-36d2-4f10-bdd9-7d8237686bb0","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.698629Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:71d05242255a8e4d92aa45c9c3fe84f927f67da02794722c7b5fd37ebb4a4b2c","observation_id":"52ae3910-5989-4d31-9cbd-42caa94de572","resolution":{"observed_at":"2026-08-12T00:32:38.865753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14158","last_updated":"2024-08-31T13:33:22Z","snapshot_observed_at":"2026-08-12T22:57:30.987830Z","submitted_at":"2024-08-26T10:11:56Z","title":"Fire-Flyer AI-HPC: A Cost-Effective Software-Hardware Co-Design for Deep Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14158","snapshot_observed_at":"2026-08-12T00:32:37.711516Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.711516Z"},"links":{"cited_paper":"/paper/2408.14158","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:1e68f1058bef75fe36d7cf67de5c59bc9d05b7398a0b898f7c73c889d986a9dc","observation_id":"84ba5465-a7bf-442f-aa8c-3bb71bcb65a2","resolution":{"observed_at":"2026-08-12T00:32:37.711516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09079","last_updated":"2026-07-20T13:38:48Z","snapshot_observed_at":"2026-08-09T07:43:31.481405Z","submitted_at":"2026-06-08T06:25:54Z","title":"FlashMemory-DeepSeek-V4: Lightning Index Ultra-Long Context via Lookahead Sparse Attention","version":3},"cited_work":{"arxiv_id":"2606.09079","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.09079","snapshot_observed_at":"2026-08-12T00:32:38.243091Z","title":"FlashMemory-DeepSeek-V4: Lightning Index Ultra-Long Context via Lookahead Sparse Attention","venue":"cs.LG","work_id":"c729628e-5a41-465b-ba58-2dfdccc5aac0","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.707312Z"},"links":{"cited_paper":"/paper/2606.09079","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:6f5fee4287bddb4a464751d7f0fc4d94a6367168eacaf8a63f25ef140bfa5b0f","observation_id":"5b25bf9d-d2b2-443f-a215-5b1f0bcb48f7","resolution":{"observed_at":"2026-08-12T00:32:38.249021Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-12T00:32:37.720042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.720042Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:72ef98f2b02ab0549e4a3f12cabbec60a977237866780cb59815d9e95e8f2b26","observation_id":"a7f522f9-59a4-488e-9dd9-1c179cdfe35f","resolution":{"observed_at":"2026-08-12T00:32:37.720042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.715845Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.715845Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:5c7495ea93008cde9d17f6292292e5fed5ebe36af274e390b17995d9ca4e4e1a","observation_id":"9424f8df-2c5d-4652-9a75-be74b4a95630","resolution":{"observed_at":"2026-08-12T00:32:37.715845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.729048Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.729048Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:c8eda7a4bab8642b84928c13df7890b41e8e1fd5a988f01cbb0374efd210aadf","observation_id":"821ccd77-a208-41b5-8e0d-a3dea65effac","resolution":{"observed_at":"2026-08-12T00:32:37.729048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-13T02:44:49.555221Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-12T00:32:37.724381Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.724381Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:f24e0af75f2e4a69087ad3cde085dffd1b7739d8c9fc20ed894151908240387a","observation_id":"fda8b57d-e692-49fc-bc62-15f0d07d7de8","resolution":{"observed_at":"2026-08-12T00:32:37.724381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.14510","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.994037Z","title":null,"venue":null,"work_id":"2b078321-fb70-430a-8eab-9d3d74b30a60","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.744673Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:37a546c7003b7db27c671a50ae07130e88b63df39a049d753aeced77f4943319","observation_id":"a5edb732-acd9-4849-a066-44e9b495d50b","resolution":{"observed_at":"2026-08-12T00:32:38.001102Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.830123Z","title":"Can Xiao, Sukmin Cho, Junbong We, Zhixiong Niu, Jianyi Cheng, Yiren Zhao, Youngjin Kwon, Yongqiang Xiong, Rui Ma, and Junyi Liu","venue":null,"work_id":"2f9c37ef-6561-4094-9fb4-2e254fe5a72a","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.733811Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:996255c806b0c9e4024da7e2a1218a5ea6152685f14440f8a5c9e6a3e0663c09","observation_id":"398d303e-d41c-4071-8155-f5b2a672ed24","resolution":{"observed_at":"2026-08-12T00:32:38.834752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2026.36592","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.892324Z","title":null,"venue":null,"work_id":"01f77632-a925-4bb2-8f27-c1647857c435","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.754805Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:bc19f8f18f5a73168401521b726be95fdd79bf757bded739d3bc137f355540e9","observation_id":"ea420bec-81ba-4fef-8e2f-2b0d3f8aaf0c","resolution":{"observed_at":"2026-08-12T00:32:37.900572Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26837","last_updated":"2026-04-29T16:02:00Z","snapshot_observed_at":"2026-08-11T10:04:20.893138Z","submitted_at":"2026-04-29T16:02:00Z","title":"Unifying Sparse Attention with Hierarchical Memory for Scalable Long-Context LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26837","snapshot_observed_at":"2026-08-12T00:32:37.759572Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.759572Z"},"links":{"cited_paper":"/paper/2604.26837","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:58558cf91394358cdba71f0290c2c9b5573742afa639a51e923e5f64d6eb3250","observation_id":"c59c5c3a-4062-4d2f-900e-fd9265d8d609","resolution":{"observed_at":"2026-08-12T00:32:37.759572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-12T00:32:37.749739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.749739Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:2da88e588bf1a72cc766b268f78762b10bd14d4e81c93b0c99f0e220b08e3823","observation_id":"83ef0856-0ebf-466a-9b1d-29f6f273156f","resolution":{"observed_at":"2026-08-12T00:32:37.749739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:37.769236Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.769236Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:b6ffb3d006371d21c795b279cf84a7c8c2c930606dd221b4d8c886e92e76b584","observation_id":"214eeae0-b4f1-48b2-b965-3bdfb1f762c2","resolution":{"observed_at":"2026-08-12T00:32:37.769236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.799991Z","title":"2026.HiSparse: Turbocharging Sparse Attention with Hierarchical Memory","venue":null,"work_id":"d9bd1f51-580a-421f-a1ec-08bfa567a6e5","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.764484Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:21eced53970e8c085df40c20dda73de0fbc0d47164b3048a570591bcceb78a19","observation_id":"ea346f1f-94eb-4812-a2b2-f75700aec759","resolution":{"observed_at":"2026-08-12T00:32:38.804338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T00:32:38.814719Z","title":"InAdvances in Neural Information Processing Systems, Vol","venue":null,"work_id":"1fb7586d-ed5d-4eae-bc87-a24356479cb5","year":null},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.739218Z"},"links":{"citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:73c402fe6df467b2a7b1444f6fc8857c0cd9e565f56f720cd3372707a6acf30a","observation_id":"fed2ad1a-cd36-457a-af62-634b0ac2cb8b","resolution":{"observed_at":"2026-08-12T00:32:38.819315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.04511","last_updated":"2026-06-03T06:42:05Z","snapshot_observed_at":"2026-07-06T23:44:37.797802Z","submitted_at":"2026-06-03T06:42:05Z","title":"SparDA: Sparse Decoupled Attention for Efficient Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":"2606.04511","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.04511","snapshot_observed_at":"2026-08-12T00:32:38.634413Z","title":"SparDA: Sparse Decoupled Attention for Efficient Long-Context LLM Inference","venue":"cs.CL","work_id":"0a065daa-4151-4656-b867-965493d5e598","year":2026},"citing_paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-12T00:32:37.583190Z"},"links":{"cited_paper":"/paper/2606.04511","citing_paper":"/paper/2608.08097"},"observation_digest":"sha256:d3a46956c58dfca9f54cc65148862a6334638da300e998059af0ce1a0301e4d3","observation_id":"1f666ac2-23c8-493e-95a0-a9848418dffe","resolution":{"observed_at":"2026-08-12T00:32:38.640375Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.08097","last_updated":"2026-08-08T12:27:03Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-13T08:11:53.164934Z","submitted_at":"2026-08-08T12:27:03Z","title":"OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":36,"verified_exact":5,"verified_fuzzy":4},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2608.08097."}