{"as_of":"2026-08-07T16:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7855f28ad3568add404f7b268b5a3bcc370fc619542c72eb60bd3433d511e68","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:16:49.848682Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T07:29:39.047838Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-05T07:51:51.048261Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":"2501.14312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-07-04T07:29:39.047838Z","title":"Locality-aware fair scheduling in llm serving","venue":null,"work_id":"5062f5cf-3a0d-40d2-90ae-0a968d1c5258","year":2025},"citing_paper":{"arxiv_id":"2505.09999","last_updated":"2026-05-11T03:41:00Z","snapshot_observed_at":"2026-07-30T05:05:51.180006Z","submitted_at":"2025-05-15T06:24:08Z","title":"ServeGen: Workload Characterization and Generation of Large Language Model Serving in Production","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T15:42:05.266854Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2505.09999"},"observation_digest":"sha256:4b950cbe63cbce26dc49958ab9669a68a005449ccedb73ea69aa3829ae23c7b4","observation_id":"be1b53a0-fd3b-40e0-b162-faf220e64753","resolution":{"observed_at":"2026-05-22T15:44:58.174166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-05T07:51:51.048261Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-08-06T18:16:49.848682Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08954","last_updated":"2025-07-11T18:28:25Z","snapshot_observed_at":"2026-08-06T18:05:53.899491Z","submitted_at":"2025-07-11T18:28:25Z","title":"MQFQ-Sticky: Fair Queueing For Serverless GPU Functions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:49.848682Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2507.08954"},"observation_digest":"sha256:66cf4faf2be2923bb8f0ec9472cc9676807c45b17ae58b94bd8c3d369b20526f","observation_id":"2b2a4a07-aebe-4f29-834e-c3028398f480","resolution":{"observed_at":"2026-08-06T18:16:49.848682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-05T07:51:51.048261Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":"2501.14312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-07-04T07:29:39.047838Z","title":"Locality-aware fair scheduling in llm serving","venue":null,"work_id":"5062f5cf-3a0d-40d2-90ae-0a968d1c5258","year":2025},"citing_paper":{"arxiv_id":"2512.19179","last_updated":"2026-05-15T11:32:47Z","snapshot_observed_at":"2026-08-03T00:09:02.053747Z","submitted_at":"2025-12-22T09:13:40Z","title":"CascadeInfer: Length-Aware Scheduling of LLM Serving with Low Latency and Load Balancing","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T17:24:59.556926Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2512.19179"},"observation_digest":"sha256:a55b79519b9272c8c66eb0d8a801d88b9037c626fb66e77b2b21e981e8d359e1","observation_id":"e6af1bdc-6072-4929-9cb7-fda60eb9d9b9","resolution":{"observed_at":"2026-05-21T17:25:25.292292Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-05T07:51:51.048261Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":"2501.14312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-07-04T07:29:39.047838Z","title":"Locality-aware fair scheduling in llm serving","venue":null,"work_id":"5062f5cf-3a0d-40d2-90ae-0a968d1c5258","year":2025},"citing_paper":{"arxiv_id":"2602.09725","last_updated":"2026-05-12T14:12:11Z","snapshot_observed_at":"2026-07-06T22:45:15.978102Z","submitted_at":"2026-02-10T12:29:02Z","title":"Efficient Remote KV Cache Reuse with GPU-native Video Codec","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T05:21:04.555356Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2602.09725"},"observation_digest":"sha256:8e06fd7347c5bca3af88394823f86481b14caed1c9ce6121c9f3224eeecd6b1a","observation_id":"ec7be858-6faa-44cd-9403-22f9a60797da","resolution":{"observed_at":"2026-05-16T05:22:22.829821Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-05T07:51:51.048261Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":"2501.14312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-07-04T07:29:39.047838Z","title":"Locality-aware fair scheduling in llm serving","venue":null,"work_id":"5062f5cf-3a0d-40d2-90ae-0a968d1c5258","year":2025},"citing_paper":{"arxiv_id":"2606.09643","last_updated":"2026-06-08T15:38:16Z","snapshot_observed_at":"2026-07-06T23:48:58.206424Z","submitted_at":"2026-06-08T15:38:16Z","title":"FMplex: Model Virtualization for Serving Extensible Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T14:50:35.584259Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2606.09643"},"observation_digest":"sha256:15980b8a98a20fe2de97252e34993afa6f7db3965752a6fa2631c541336c6571","observation_id":"006f4cd1-3711-47d9-a179-d390ad8a3a80","resolution":{"observed_at":"2026-07-03T03:47:35.372686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","snapshot_observed_at":"2026-08-05T07:51:51.048261Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving","version":1},"cited_work":{"arxiv_id":"2501.14312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14312","snapshot_observed_at":"2026-07-04T07:29:39.047838Z","title":"Locality-aware fair scheduling in llm serving","venue":null,"work_id":"5062f5cf-3a0d-40d2-90ae-0a968d1c5258","year":2025},"citing_paper":{"arxiv_id":"2606.21238","last_updated":"2026-06-19T09:05:01Z","snapshot_observed_at":"2026-08-07T12:20:29.118971Z","submitted_at":"2026-06-19T09:05:01Z","title":"Recency/Frequency Adaptive KV Caching for Large Language Model Serving","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-26T13:24:44.218871Z"},"links":{"cited_paper":"/paper/2501.14312","citing_paper":"/paper/2606.21238"},"observation_digest":"sha256:e835c0a0e3ee0c928570dd85b952229f218946b1aa0a74bfc300000d5c4e9531","observation_id":"cdf7d4ed-7260-49b5-b85e-2318034ef8ae","resolution":{"observed_at":"2026-07-04T07:29:39.049826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.14312/citation-record","integrity":"/paper/2501.14312/integrity","json":"/paper/2501.14312/citation-record.json","paper":"/paper/2501.14312"},"outbound":[],"paper":{"arxiv_id":"2501.14312","last_updated":"2025-01-24T08:12:47Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-05T07:51:51.048261Z","submitted_at":"2025-01-24T08:12:47Z","title":"Locality-aware Fair Scheduling in LLM Serving"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2501.14312."}