{"as_of":"2026-08-11T13:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef2e6d469ef72edfd2accaa6e4cd454e884ad663b9f6d8d93a38e8a8dbc4c858","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T04:57:08.746551Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.04415/citation-record","integrity":"/paper/2606.04415/integrity","json":"/paper/2606.04415/citation-record.json","paper":"/paper/2606.04415"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T04:57:08.746551Z","title":"Does FlexNPU introduce noticeable overhead compared with direct NPU passthrough? (2) Dynamic PD co-location vs","venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:2f76de7f190b5db0fe31f75de0bcc1898c7ce0813a4986167f5a50171b25a0e6","observation_id":"1f85bfb3-65f8-4962-a13c-64c5c8aef64b","resolution":{"observed_at":"2026-06-28T04:57:08.746551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-08-10T19:01:02.574750Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:39d0318b5e235b0994fea9ef8d8dcc6ec114fb45fa9600f6e496ae618a20f270","observation_id":"249612ad-faab-49d3-b2e2-9277affae70a","resolution":{"observed_at":"2026-07-02T10:46:52.308744Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.11743","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T10:46:52.302895Z","title":"Nixie: Efficient, Transparent Temporal Multiplexing for Consumer GPUs","venue":null,"work_id":"ac932d04-e7f9-4288-823c-0d7b28c52993","year":null},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:cd0426017f21bcc7c30f04fd158d49e8fe7b190a5e622bacab2d4ca0a65ee9c0","observation_id":"07b84d3b-e19d-4f09-9e95-7ed35415c4fe","resolution":{"observed_at":"2026-07-02T10:46:52.304403Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T04:57:08.746551Z","title":"StreamBox: A Lightweight GPU SandBox for Serverless Inference Workflow","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:c7ef3144b2b25cefb2756d5d2bf0e56bad895766d2c58ffde78b14d7341aff5d","observation_id":"6364194d-4a2f-40d1-ba21-a39fa04f04bc","resolution":{"observed_at":"2026-06-28T04:57:08.746551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07848","last_updated":"2022-02-21T05:17:56Z","snapshot_observed_at":"2026-08-10T08:59:22.543513Z","submitted_at":"2022-02-16T04:02:10Z","title":"Singularity: Planet-Scale, Preemptive and Elastic Scheduling of AI Workloads","version":2},"cited_work":{"arxiv_id":"2202.07848","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2202.07848","snapshot_observed_at":"2026-07-04T19:10:04.596069Z","title":"Singularity: Planet-Scale, Preemptive and Elastic Scheduling of AI Workloads,","venue":null,"work_id":"5128aba7-9be1-41e3-a5f7-fab319848a5d","year":2022},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2202.07848","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:fc6501868b7f722f68778ecaa5d46ee7ea6b179715fde3f91efb07a25c835d3a","observation_id":"c27a46e5-9ec3-4e1d-a457-603bc1358061","resolution":{"observed_at":"2026-07-02T10:46:52.303080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04021","last_updated":"2026-06-10T23:04:53Z","snapshot_observed_at":"2026-08-10T08:58:53.746600Z","submitted_at":"2025-05-06T23:38:33Z","title":"Prism: Cost-Efficient Multi-LLM Serving via GPU Memory Ballooning","version":3},"cited_work":{"arxiv_id":"2505.04021","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.04021","snapshot_observed_at":"2026-07-03T17:18:43.284498Z","title":"Prism: Unleashing gpu sharing for cost-efficient multi- llm serving","venue":"cs.DC","work_id":"b06d977c-d2bf-4367-bdeb-cd88d2f6fa4f","year":2025},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2505.04021","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:66134fa90f2af5e30c43ea0b4d2532423857b30a5a82d407ccadc4d4956cea69","observation_id":"2946dcdf-102c-415b-9d4d-8d55f1e2bfdf","resolution":{"observed_at":"2026-07-02T10:46:52.314989Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T04:57:08.746551Z","title":"Tetris: Memory-Efficient Serverless Inference Through Tensor Sharing","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:37214a7d8f5f67b1ad7e1be7fc3805659e46d199ba8079e8d5d5618726c4ba93","observation_id":"3e9ddfb4-444e-444a-8c46-5a5f34b82c67","resolution":{"observed_at":"2026-06-28T04:57:08.746551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T04:57:08.746551Z","title":"Pre-warming Is Not Enough: Accelerating Serverless Inference With Opportunistic Pre-loading","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:1f3f0f294427d2197231ec8a19d890934ca485f6f15ee1159af0e7c69dab2f57","observation_id":"d18f28ca-ef34-4cac-987b-0e6cf618207b","resolution":{"observed_at":"2026-06-28T04:57:08.746551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T04:57:08.746551Z","title":"Torpor: GPU-Enabled Serverless Computing for Low-Latency, Resource-Efficient Inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:8eabf8cda076c387e7a92285ab63f2868557d261ce30592013138f4b46f562c1","observation_id":"9417f6ac-efe6-462a-a6a7-4678f10da5a9","resolution":{"observed_at":"2026-06-28T04:57:08.746551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T04:57:08.746551Z","title":"Splitwise: Efficient Generative LLM Inference Using Phase Splitting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:bc41c5335a1a582f9a5e04c0b0606c3a71b58de345ac0be9a48f882ca19f281a","observation_id":"3d22f5b6-1caf-4750-9ef7-bb22ad742fba","resolution":{"observed_at":"2026-06-28T04:57:08.746551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02015","last_updated":"2024-06-13T02:53:29Z","snapshot_observed_at":"2026-08-05T03:20:40.748106Z","submitted_at":"2024-04-02T14:56:43Z","title":"MuxServe: Flexible Spatial-Temporal Multiplexing for Multiple LLM Serving","version":2},"cited_work":{"arxiv_id":"2404.02015","doi":"10.48550/arxiv.2404.02015","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.02015","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2024-06-13","venue":"arXiv (Cornell University)","work_id":"57cdeb96-5d8f-4ffd-a184-75f36cf3c109","year":2024},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2404.02015","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:1f37d661839e57b27a57dea278a78d93ccc519116c76c516e31d6724e2c16e4a","observation_id":"907e3f9b-a739-4dc9-854e-e64753a0d43d","resolution":{"observed_at":"2026-07-02T10:46:52.317722Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06608","last_updated":"2025-08-07T12:26:15Z","snapshot_observed_at":"2026-08-10T19:01:37.041658Z","submitted_at":"2025-07-09T07:27:18Z","title":"Nexus:Proactive Intra-GPU Disaggregation of Prefill and Decode in LLM Serving","version":5},"cited_work":{"arxiv_id":"2507.06608","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06608","snapshot_observed_at":"2026-07-03T06:07:40.898496Z","title":"Nexus: Proactive Intra-GPU Disaggregation of Prefill and Decode in LLM Serving","venue":null,"work_id":"582c52e8-2a74-49c4-be74-2d23590374b7","year":2025},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2507.06608","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:5591a013be3129605d16152710b8dd82ac1a811c7808b51fe7dd701bee95102b","observation_id":"5d615ec3-c1c4-4a6d-bf8a-55b0ab92bae6","resolution":{"observed_at":"2026-07-02T10:46:52.305907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.04791","last_updated":"2026-05-30T23:27:43Z","snapshot_observed_at":"2026-08-10T13:50:51.313192Z","submitted_at":"2025-11-06T20:18:34Z","title":"DuetServe: Harmonizing Prefill and Decode for LLM Serving via Adaptive GPU Multiplexing","version":2},"cited_work":{"arxiv_id":"2511.04791","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.04791","snapshot_observed_at":"2026-07-02T10:46:52.298443Z","title":"DuetServe: Harmonizing Prefill and Decode for LLM Serving via Adaptive GPU Multiplexing","venue":"cs.LG","work_id":"66f6ea18-b287-47e8-8944-e51e8fc43101","year":2025},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2511.04791","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:2b451b198e4ba645d0b0b678a8f037ca29666ab4234455ad4692ebf306c3fb83","observation_id":"8c40914f-5fa0-4995-8bc9-b0d978ebdeeb","resolution":{"observed_at":"2026-07-02T10:46:52.299777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10907","last_updated":"2026-06-22T01:50:05Z","snapshot_observed_at":"2026-07-12T22:15:56.872005Z","submitted_at":"2026-04-13T02:13:13Z","title":"RouterWise: Joint Resource Allocation and Routing for Latency-Aware Multi-Model LLM Serving","version":2},"cited_work":{"arxiv_id":"2604.10907","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.10907","snapshot_observed_at":"2026-07-02T10:46:52.309964Z","title":"RouterWise: Joint Resource Allocation and Routing for Latency-Aware Multi-Model LLM Serving","venue":"cs.NI","work_id":"3710c00a-5fcd-425e-bf46-40d8405e20ec","year":2026},"citing_paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T04:57:08.746551Z"},"links":{"cited_paper":"/paper/2604.10907","citing_paper":"/paper/2606.04415"},"observation_digest":"sha256:7676f2075f00fe99b3a35ec0ecc00c31598b23ad013d2c39eb473048f7e12943","observation_id":"bcc3c02e-c147-4c78-b25a-ed843b950361","resolution":{"observed_at":"2026-07-02T10:46:52.312389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.04415","last_updated":"2026-06-03T03:49:34Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T23:44:33.095008Z","submitted_at":"2026-06-03T03:49:34Z","title":"FlexNPU: Transparent NPU Virtualization for Dynamic LLM Prefill-Decode Co-location"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":6,"verified_exact":6,"verified_fuzzy":0},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2606.04415."}