{"as_of":"2026-08-07T20:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fd154b869011c04b46607b66d44dbcdfed549b8c390b77e4ed14fd796e89f4b","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:06:54.344008Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.26475/citation-record","integrity":"/paper/2607.26475/integrity","json":"/paper/2607.26475/citation-record.json","paper":"/paper/2607.26475"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.170950Z","title":"Gulavani, Alexey Tumanov, and Ramachandran Ramjee","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.170950Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:3e4ba0204de682af96ac8615722e11af9ab92f776083ea73bcf0b80021059c7f","observation_id":"4c452bd7-4d8b-4f78-9cd6-342c182fa6bf","resolution":{"observed_at":"2026-08-01T15:06:54.170950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.175744Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.175744Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:079a8280ffff4f4e36cd2b82f395e90dc4dfe9eea456959490cd97b0491067bf","observation_id":"4eefe7e0-0764-45e4-9a18-fab534c0bd48","resolution":{"observed_at":"2026-08-01T15:06:54.175744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-01T15:06:54.180960Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.180960Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:930352916605aba4e07593c27e126a2f9d7dfd6b2e9a4e73a75f02240a0bf3ab","observation_id":"2564b0b3-500b-440b-889f-443761bd7ee2","resolution":{"observed_at":"2026-08-01T15:06:54.180960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.185869Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.185869Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:650e435e1d9728a1f4818b892c0f303bff62e16044c1b435a861ed62ef511480","observation_id":"1b8efbff-a2fb-4b46-9da0-d096620cbe75","resolution":{"observed_at":"2026-08-01T15:06:54.185869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.189836Z","title":"Aly, Beidi Chen, and Carole-Jean Wu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.189836Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:b5f69b23011e62bbba23755ec635582c501f8588923a57195adf046592eb94a4","observation_id":"09fd9b61-80b0-4d90-87a5-7115e6cec634","resolution":{"observed_at":"2026-08-01T15:06:54.189836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.197927Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.197927Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:2d254ef49d22a8c250626b6b3550d341f8674423fdf49e51b798c4df23480e2c","observation_id":"79958e84-a838-4fb0-9351-44aeacdc9073","resolution":{"observed_at":"2026-08-01T15:06:54.197927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.202233Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.202233Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:cab79cfbdfd3db602c930e8eb2a47d6648c273c52db875c917ab14e7e9e2e7b5","observation_id":"bf9e74ee-e9f3-48cb-9228-bfd48a7098dc","resolution":{"observed_at":"2026-08-01T15:06:54.202233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.205989Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.205989Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:e208d15f200dd245fd6e1c081e967b7659e66c861124a781f2ff5d06ea3f7bb8","observation_id":"1183dc5a-ecb9-466f-a6ce-67d9c5e53850","resolution":{"observed_at":"2026-08-01T15:06:54.205989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11421","last_updated":"2024-03-18T02:30:23Z","snapshot_observed_at":"2026-08-06T20:15:05.193939Z","submitted_at":"2024-03-18T02:30:23Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11421","snapshot_observed_at":"2026-08-01T15:06:54.210093Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.210093Z"},"links":{"cited_paper":"/paper/2403.11421","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:8530c08dfe098b6f19c99b33c6e87c44796dad03db4ee543034e548cc78af3e1","observation_id":"63dae347-e822-4f8a-80ad-d723fa99cf1c","resolution":{"observed_at":"2026-08-01T15:06:54.210093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.214313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.214313Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:fa72f5626205e95bc9ad5829ded119ea89269fb2649573db2d46df1bdb4b0ef2","observation_id":"98423e8e-b5ee-4fd2-b5e6-4ba7a0d74e38","resolution":{"observed_at":"2026-08-01T15:06:54.214313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-01T15:06:54.218393Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.218393Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:99bebc4f5c05138a327cc4f15655050c2a0e0129430ea1903e66c067f75ff8bc","observation_id":"9748d17e-21b8-4f59-9696-5cf628b8f66f","resolution":{"observed_at":"2026-08-01T15:06:54.218393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17565","last_updated":"2024-12-21T13:55:49Z","snapshot_observed_at":"2026-07-06T18:36:42.830927Z","submitted_at":"2024-06-25T14:02:08Z","title":"MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17565","snapshot_observed_at":"2026-08-01T15:06:54.222623Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.222623Z"},"links":{"cited_paper":"/paper/2406.17565","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:da60e1d912da0ca44ab49d01e86878caf83b2075e74043efc553ee3e477842c4","observation_id":"98f1939f-4852-44c6-ad80-d2c249913367","resolution":{"observed_at":"2026-08-01T15:06:54.222623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.226779Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.226779Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:8c42e2c5d38d3403a188cfad19fc3489631055b2cf53cd40c446bb3c7c07a08b","observation_id":"97335c9f-704d-411d-95ee-3218daf482ac","resolution":{"observed_at":"2026-08-01T15:06:54.226779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.230724Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.230724Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:1d5f25ee6c720eaf48515b5a5a96423482c44510e34ea1425d91483db30f8de6","observation_id":"9a07d110-f620-40dc-8898-f37a195a2a7f","resolution":{"observed_at":"2026-08-01T15:06:54.230724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.239207Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.239207Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:2eea694f905444d0f44767ef0666475d9f5c537c399e98db793f167c918c2b81","observation_id":"33b7382a-6022-4121-be07-fe8c73787743","resolution":{"observed_at":"2026-08-01T15:06:54.239207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.243103Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.243103Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:0d59d83c8951cdf66950264c3a7613e8aa8b70315d9e4eca1c8a883afe0cfbf1","observation_id":"d228155d-2d7a-4eef-938f-e03a7647ae9e","resolution":{"observed_at":"2026-08-01T15:06:54.243103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.247010Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.247010Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:bdedf904bd869579ff6e30291866caf94d5e2a26933504862f9f1e8e4ed39685","observation_id":"23479e2f-7291-4257-8865-668f9463c5ce","resolution":{"observed_at":"2026-08-01T15:06:54.247010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22101","last_updated":"2025-05-28T08:27:12Z","snapshot_observed_at":"2026-08-07T13:12:47.234798Z","submitted_at":"2025-05-28T08:27:12Z","title":"MemOS: An Operating System for Memory-Augmented Generation (MAG) in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22101","snapshot_observed_at":"2026-08-01T15:06:54.250769Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.250769Z"},"links":{"cited_paper":"/paper/2505.22101","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:48dd0c1cb8e614f7a3e22e6d4e823b2cdb6806487d92120357628ad87840aa60","observation_id":"e252f059-912e-4cba-8b5d-bd908f8bb083","resolution":{"observed_at":"2026-08-01T15:06:54.250769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10516","last_updated":"2024-12-31T07:11:00Z","snapshot_observed_at":"2026-08-07T09:13:28.333702Z","submitted_at":"2024-09-16T17:59:52Z","title":"RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10516","snapshot_observed_at":"2026-08-01T15:06:54.254928Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.254928Z"},"links":{"cited_paper":"/paper/2409.10516","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:f24796cb9e44c6cd419f53fafa244b0a4a0b2d8311d12571033373ba21ab7e15","observation_id":"792b288a-5629-4875-a7a3-0eadd081c27c","resolution":{"observed_at":"2026-08-01T15:06:54.254928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.259154Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.259154Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:f3a5b823a2d3185d59944c9ae09af2455283a90629331fda80226340856ac4fa","observation_id":"2bd00e49-b66c-4432-a6a7-56c0a2b9944f","resolution":{"observed_at":"2026-08-01T15:06:54.259154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.262956Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.262956Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:b76fac7ba031f7b675c47a1460cce3540896cd9ea54e8a933eca13c8eaf8abed","observation_id":"ddc9f0db-8cf0-45c3-a86e-272a458abfc8","resolution":{"observed_at":"2026-08-01T15:06:54.262956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-01T15:06:54.266552Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.266552Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:34722f2d966f8beba2cc857a2c71175df82cedf57e9f5665f3d2e29aee0e75c7","observation_id":"09843e44-e451-4ba3-a1d9-21da068b0745","resolution":{"observed_at":"2026-08-01T15:06:54.266552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-01T15:06:54.270844Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.270844Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:d140d90edea939670035b73b1487cb304c63dbc33d95b217b6c10dd3f6b1b49e","observation_id":"85f66a4f-aa3b-4e19-a567-13069e5ccb7d","resolution":{"observed_at":"2026-08-01T15:06:54.270844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.274650Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.274650Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:8e96d18ce8f7fc638ea995991efe0062f2883169505bd5983510e79e8a43fd9f","observation_id":"dcad6095-135b-4efc-87cd-ba66181bb4aa","resolution":{"observed_at":"2026-08-01T15:06:54.274650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-01T15:06:54.278421Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.278421Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:08fd06abd66b22c10078e581dcd66aed4c5e0afe3af897ee523ce9089ba95615","observation_id":"58f20d5d-1fcf-4a96-b5e5-37bfa9edeb1a","resolution":{"observed_at":"2026-08-01T15:06:54.278421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.282627Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.282627Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:2a0b103429e3584c88ad7f5eab8a68f995f336816aa06aeb8f7b5438a5004926","observation_id":"d0d44c84-d350-481f-a96f-059836c33170","resolution":{"observed_at":"2026-08-01T15:06:54.282627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-01T15:06:54.286507Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.286507Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:61947f31fa362c752cf3b5176d6fc6712f691db5270cc2b2f9f0de4852781503","observation_id":"cc52335d-66ae-48ec-9852-793794367816","resolution":{"observed_at":"2026-08-01T15:06:54.286507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.291069Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.291069Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:7e4f346097b458e904a2565bf3ee0889beac406a3de9cef0c19dec380a6a1ee4","observation_id":"269daa92-ecca-401d-9b8c-7f3ab60f3e19","resolution":{"observed_at":"2026-08-01T15:06:54.291069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.294613Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.294613Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:09142c26567a0eda173e6d2085c30842fc21016c1f9b8031357fbd2ab4c9685b","observation_id":"e90decea-93a0-450f-92de-c7c09d3ec2f9","resolution":{"observed_at":"2026-08-01T15:06:54.294613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.298239Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.298239Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:f6fded3f066cdb693aaef8dfba6aac5abbc3982fb2d124ad40e6a1698aaecfc9","observation_id":"6edad205-356a-4f9b-823e-2bc6a5ea71cc","resolution":{"observed_at":"2026-08-01T15:06:54.298239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.301769Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.301769Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:c8d1df1696d87e380e7463a32a80a6800538ca3187939bb237fde7167239de59","observation_id":"5e4181d1-05e3-476a-9459-c8495ce10012","resolution":{"observed_at":"2026-08-01T15:06:54.301769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.305564Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.305564Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:5b9f94eeb9c17679f07142fdc28f5ced02810b7b49964d147853b93d11731e5b","observation_id":"e31308b7-64c8-4cf0-813a-f2be4ad5523c","resolution":{"observed_at":"2026-08-01T15:06:54.305564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.309209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.309209Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:de405256c0cb44d8ad0f0a52c39969ef32c74a32be7a917427d850826686a26f","observation_id":"4c852c2a-63c3-4e5f-a077-7ffccd88ea75","resolution":{"observed_at":"2026-08-01T15:06:54.309209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.313322Z","title":"2026.SpeContext:Enabling Efficient Long-context Reasoning with Speculative Context Sparsity in LLMs","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.313322Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:4665ebaa016832e6fc7a500f2ce43951616ed88abde900bc820823f195081a18","observation_id":"b17f8006-8d23-4ff8-abf5-8c441c6c2a92","resolution":{"observed_at":"2026-08-01T15:06:54.313322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.317118Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.317118Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:68a95a44b4c028d6b42e34dbc51544665cccaaf67a3bbcbc6d95cf7d078d1048","observation_id":"c202f01d-ffa8-44ac-be14-31cc044adcde","resolution":{"observed_at":"2026-08-01T15:06:54.317118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.320698Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.320698Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:84dd6e59197a15cdf369a1edef44eb5daaeb71abfea51c1a8db0edf7c025f59e","observation_id":"e32c5e24-579e-4c09-af90-242c64cbed12","resolution":{"observed_at":"2026-08-01T15:06:54.320698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.324420Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.324420Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:0501713df89395c4c96abdc4746d4c5f56ee38f2e1e333c5a7586141ea6ae96e","observation_id":"63b37f6c-fe01-46b1-8791-52e31648eb5f","resolution":{"observed_at":"2026-08-01T15:06:54.324420Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.328130Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.328130Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:572002fcba044f987c42bcfdd5fd738211d7891a3d92292374eaf6ec3f7e6a12","observation_id":"56d8e877-0643-41ce-b2dd-c6820612372d","resolution":{"observed_at":"2026-08-01T15:06:54.328130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.332025Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.332025Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:ba982550dab70607cdca32722db16d0556a772cdd47fdfd57801b92c73ceadd5","observation_id":"47f875e5-b963-4b55-b0fe-01d743783f1e","resolution":{"observed_at":"2026-08-01T15:06:54.332025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.335715Z","title":"Barrett, Zhangyang Wang, and Beidi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.335715Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:d3fc23a5cdde7f82271ecae4ebf8524bc85c38ca36f09216e1bee7644d380184","observation_id":"25dcbd49-b8cc-43c3-b0d0-4ae08f66900d","resolution":{"observed_at":"2026-08-01T15:06:54.335715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.339854Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.339854Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:a4a9662d99fffd417691a91dd9e7f5ab6b237b371f4c1f39056a157ff9621b32","observation_id":"856fe18b-3dc1-44a3-bc39-d3e7fc27f804","resolution":{"observed_at":"2026-08-01T15:06:54.339854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.344008Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.344008Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:47a79668d5bed5935833aa5acc27d36a66b1f60eec2ae73c5572594323258d04","observation_id":"ee8b9ccc-c701-4315-8646-a4c81e53dcc3","resolution":{"observed_at":"2026-08-01T15:06:54.344008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.235148Z","title":"InProceedings of the 29th ACM Symposium on Operating Systems Principles (SOSP)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.235148Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:69d5bf118615948039f8810f3e25005c44a27a058020200085f72423b790a069","observation_id":"02836f98-6a69-4f83-ab3f-17d8e6771212","resolution":{"observed_at":"2026-08-01T15:06:54.235148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T15:06:54.193881Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T15:06:54.193881Z"},"links":{"citing_paper":"/paper/2607.26475"},"observation_digest":"sha256:b59f5d3644aa160e2204411ee3aa534bc1e8220d56a1d07d0da37d1e0bb75041","observation_id":"07b5298d-e673-4f36-a5f4-058153f598b5","resolution":{"observed_at":"2026-08-01T15:06:54.193881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.26475","last_updated":"2026-07-29T05:01:42Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T15:06:08.198308Z","submitted_at":"2026-07-29T05:01:42Z","title":"DualDecoder: Accelerate Long Context LLM Inference by Predictive Prefetch"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2607.26475."}