{"as_of":"2026-08-07T16:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:502189f6351766888294e7f5deaf34a7b33eb35ede1d81368950c53eda3bfe15","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T12:55:10.063756Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T08:51:08.950391Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.07203","last_updated":"2025-05-12T03:22:29Z","snapshot_observed_at":"2026-08-07T15:48:00.384817Z","submitted_at":"2025-05-12T03:22:29Z","title":"PrefillOnly: An Inference Engine for Prefill-only Workloads in Large Language Model Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07203","snapshot_observed_at":"2026-08-04T12:55:10.063756Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.01565","last_updated":"2026-06-18T01:08:24Z","snapshot_observed_at":"2026-08-07T13:00:11.048060Z","submitted_at":"2025-10-02T01:23:32Z","title":"TetriServe: Efficiently Serving Mixed DiT Workloads","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T12:55:10.063756Z"},"links":{"cited_paper":"/paper/2505.07203","citing_paper":"/paper/2510.01565"},"observation_digest":"sha256:5130fdc1fbf5119377ce185e7d284ab4e1f4cd969a76deda4a21b1d6a895e643","observation_id":"eb2e10b5-71de-4c19-8415-8f9c15abf136","resolution":{"observed_at":"2026-08-04T12:55:10.063756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07203","last_updated":"2025-05-12T03:22:29Z","snapshot_observed_at":"2026-08-07T15:48:00.384817Z","submitted_at":"2025-05-12T03:22:29Z","title":"PrefillOnly: An Inference Engine for Prefill-only Workloads in Large Language Model Applications","version":1},"cited_work":{"arxiv_id":"2505.07203","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07203","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PrefillOnly: An Inference Engine for Prefill-only Workloads in Large Language Model Applications.arXiv preprint arXiv:2505.07203","venue":null,"work_id":"23f46b9d-8549-49c9-955d-9dff02ed53f4","year":2025},"citing_paper":{"arxiv_id":"2510.08055","last_updated":"2026-04-16T12:39:23Z","snapshot_observed_at":"2026-08-07T14:10:12.842070Z","submitted_at":"2025-10-09T10:41:35Z","title":"From Tokens to Layers: Redefining Stall-Free Scheduling for MoE Serving with Layered Prefill","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T08:47:29.759674Z"},"links":{"cited_paper":"/paper/2505.07203","citing_paper":"/paper/2510.08055"},"observation_digest":"sha256:fe458347691492f0b32270873f63d3220cd9f6251eed14bcdd92c032d638168b","observation_id":"80f2c909-7b31-4f36-b684-7462641c5c4f","resolution":{"observed_at":"2026-05-18T08:51:08.952905Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07203","last_updated":"2025-05-12T03:22:29Z","snapshot_observed_at":"2026-08-07T15:48:00.384817Z","submitted_at":"2025-05-12T03:22:29Z","title":"PrefillOnly: An Inference Engine for Prefill-only Workloads in Large Language Model Applications","version":1},"cited_work":{"arxiv_id":"2505.07203","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.07203","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"PrefillOnly: An Inference Engine for Prefill-only Workloads in Large Language Model Applications.arXiv preprint arXiv:2505.07203","venue":null,"work_id":"23f46b9d-8549-49c9-955d-9dff02ed53f4","year":2025},"citing_paper":{"arxiv_id":"2604.18529","last_updated":"2026-04-20T17:25:44Z","snapshot_observed_at":"2026-08-02T10:24:06.103567Z","submitted_at":"2026-04-20T17:25:44Z","title":"HybridGen: Efficient LLM Generative Inference via CPU-GPU Hybrid Computing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T02:48:18.330339Z"},"links":{"cited_paper":"/paper/2505.07203","citing_paper":"/paper/2604.18529"},"observation_digest":"sha256:5187c7be5025ae4c5da3cf9ca93db86db95de819437b174f8051218b1390ba87","observation_id":"f8d7267a-7304-4f84-a113-e6452afaff3c","resolution":{"observed_at":"2026-05-10T02:48:27.073874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07203","last_updated":"2025-05-12T03:22:29Z","snapshot_observed_at":"2026-08-07T15:48:00.384817Z","submitted_at":"2025-05-12T03:22:29Z","title":"PrefillOnly: An Inference Engine for Prefill-only Workloads in Large Language Model Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07203","snapshot_observed_at":"2026-08-01T19:51:03.178136Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16836","last_updated":"2026-07-27T11:12:03Z","snapshot_observed_at":"2026-08-07T14:34:28.665365Z","submitted_at":"2026-07-18T14:21:39Z","title":"Beyond Storage: State as a Runtime Control Problem in Parallel and Distributed Systems","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T19:51:03.178136Z"},"links":{"cited_paper":"/paper/2505.07203","citing_paper":"/paper/2607.16836"},"observation_digest":"sha256:f5a38710c3b51f578d7bea888d6e4072a10d30f77277bc37d08cb84b71db7d39","observation_id":"5179647a-9af1-4c01-919e-362ad2d2382b","resolution":{"observed_at":"2026-08-01T19:51:03.178136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.07203/citation-record","integrity":"/paper/2505.07203/integrity","json":"/paper/2505.07203/citation-record.json","paper":"/paper/2505.07203"},"outbound":[],"paper":{"arxiv_id":"2505.07203","last_updated":"2025-05-12T03:22:29Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T15:48:00.384817Z","submitted_at":"2025-05-12T03:22:29Z","title":"PrefillOnly: An Inference Engine for Prefill-only Workloads in Large Language Model Applications"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:2505.07203."}