{"as_of":"2026-08-09T22:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:766d14c775f2bf3530bc89dd54344bafb8f2bff58c1c9cabdbf1ead49818f160","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:03:52.902518Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:57:38.712067Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-08-06T19:03:52.902518Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06608","last_updated":"2025-08-07T12:26:15Z","snapshot_observed_at":"2026-08-06T18:56:52.854557Z","submitted_at":"2025-07-09T07:27:18Z","title":"Nexus:Proactive Intra-GPU Disaggregation of Prefill and Decode in LLM Serving","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:03:52.902518Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2507.06608"},"observation_digest":"sha256:fbf216f3acdb2d44a49e106b8e79fadee4103354f12b64d384ed62016da69175","observation_id":"fd7d91d0-44e7-4401-95ab-fb53c88276eb","resolution":{"observed_at":"2026-08-06T19:03:52.902518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-08-03T23:39:06.362657Z","title":"semi-pd: Towards efficient llm serving via phase-wise disaggre- gated computation and unified storage.arXiv preprint arXiv:2504.19867,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.04791","last_updated":"2026-05-30T23:27:43Z","snapshot_observed_at":"2026-08-03T23:39:04.093171Z","submitted_at":"2025-11-06T20:18:34Z","title":"DuetServe: Harmonizing Prefill and Decode for LLM Serving via Adaptive GPU Multiplexing","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T23:39:06.362657Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2511.04791"},"observation_digest":"sha256:c79e0dfceae1470cd8a8eaea47c36f2f79329b40e4dba765a824f9940effcf88","observation_id":"633d21dc-2e09-4afa-a53e-f7dfe3ee0580","resolution":{"observed_at":"2026-08-03T23:39:06.362657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-08-07T20:25:38.013655Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:c2dcbd4de5edcc58e5911670ccc9567e1a826c25aac39c53c869eaadb4b2fe5a","observation_id":"e2ba28d7-9b2c-4bf3-9bb3-e753026a5fc8","resolution":{"observed_at":"2026-05-11T20:16:10.262035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2605.13734","last_updated":"2026-05-13T16:12:33Z","snapshot_observed_at":"2026-08-09T15:04:19.889122Z","submitted_at":"2026-05-13T16:12:33Z","title":"KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T17:42:06.870534Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2605.13734"},"observation_digest":"sha256:53642c97d6847a583b60ea3d10a92642ed7b1bc586b3a9b2d9806ff67d6553a0","observation_id":"e3cf6b4c-9744-43e2-b0f6-bc0407270db5","resolution":{"observed_at":"2026-05-14T17:42:31.180388Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:2858690509ae7c2a95faab7a8a602f3bd27ada886522855c35adbb3c1f54ba45","observation_id":"249612ad-faab-49d3-b2e2-9277affae70a","resolution":{"observed_at":"2026-07-02T10:46:52.308744Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2606.10537","last_updated":"2026-06-09T08:06:22Z","snapshot_observed_at":"2026-08-06T08:45:04.024766Z","submitted_at":"2026-06-09T08:06:22Z","title":"Prefilling-dLLM: Predictive Prefilling for Long-Context Inference in Diffusion Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T13:30:19.620692Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2606.10537"},"observation_digest":"sha256:5c0f53096105f4070aab34c25c2aa23b37cbf1876801e90b966ee63add764980","observation_id":"478a67f2-2dab-4a49-9434-6844a04c21d7","resolution":{"observed_at":"2026-07-03T04:57:38.713663Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.19867/citation-record","integrity":"/paper/2504.19867/integrity","json":"/paper/2504.19867/citation-record.json","paper":"/paper/2504.19867"},"outbound":[],"paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T15:58:35.107523Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2504.19867."}