{"as_of":"2026-08-09T16:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bc989408ba2da5d8ee28a649f2ec957181dee2578f2af93b211a80e8696a90c","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:54:03.289004Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02244/citation-record","integrity":"/paper/2608.02244/integrity","json":"/paper/2608.02244/citation-record.json","paper":"/paper/2608.02244"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:00.908542Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.908542Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:2b273bef1d244de5ae51915b18446da21d9c3fcab313cc025e3f9760024b6939","observation_id":"e7973ad6-073e-4949-9cf5-cf86c4b8eaec","resolution":{"observed_at":"2026-08-04T10:54:00.908542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.018364Z","title":"Bo Chen, Chris N Potts, and Gerhard J Woeginger","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.018364Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:38f1276982fe300bc51d0f7e97abd7bb9e1f3b6e863634aa6c1167f2305ca5b8","observation_id":"2c6cbed0-7a3d-47ba-ac04-8671d85aed5f","resolution":{"observed_at":"2026-08-04T10:54:01.018364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14544","last_updated":"2025-09-01T07:38:03Z","snapshot_observed_at":"2026-08-05T18:31:39.149369Z","submitted_at":"2025-08-20T08:55:26Z","title":"Adaptively Robust LLM Inference Optimization under Prediction Uncertainty","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14544","snapshot_observed_at":"2026-08-04T10:54:01.285290Z","title":"Aakanksha Chowdhery, Sharan Narang, Jacob Devlin, Maarten Bosma, Gaurav Mishra, Adam Roberts, Paul Barham, Hyung Won Chung, Charles Sutton, Sebastian Gehrmann, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.285290Z"},"links":{"cited_paper":"/paper/2508.14544","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:8e8ffe23bf7a89d956afb0a8802bea1f3f3be83e94ab333af9ccfb97e94b4fc8","observation_id":"df53f8bc-474a-4790-9a86-10abbd444944","resolution":{"observed_at":"2026-08-04T10:54:01.285290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.350872Z","title":"40 DeepSeek","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.350872Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:b65e2d22fbdcd966bb41504719253a665a3f25e5c832a9d6c106c1b02076217c","observation_id":"5f6f5cf8-53dd-4cff-98ea-f88c73790568","resolution":{"observed_at":"2026-08-04T10:54:01.350872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.383420Z","title":"Accessed: 2026-06-10","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.383420Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:16da7123c4620ae4b9ec92f06f3bb59080b960451936097465e5ce635ab98211","observation_id":"cf9fde2a-7409-466c-9bd2-f4b44b203437","resolution":{"observed_at":"2026-08-04T10:54:01.383420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12282","last_updated":"2026-05-15T18:42:55Z","snapshot_observed_at":"2026-07-06T15:45:10.138095Z","submitted_at":"2023-06-21T14:09:33Z","title":"Online Resource Allocation with Convex-set Machine-Learned Advice","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12282","snapshot_observed_at":"2026-08-04T10:54:01.521832Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.521832Z"},"links":{"cited_paper":"/paper/2306.12282","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:fe9cd2f5a6e3a6fad360f8c934573fbf999735f4a0194771c2c4c9b0d5c78339","observation_id":"2af17c6a-1691-456d-8e74-c68d5ec88bb5","resolution":{"observed_at":"2026-08-04T10:54:01.521832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.629578Z","title":"Ac- cessed: 2026-06-10","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.629578Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:70da3c71ee8645d180ba5bbd6fb22c69583a1e6826f8b335a343288c80b59876","observation_id":"2571490d-1d02-41c2-8867-b5b9a920d62f","resolution":{"observed_at":"2026-08-04T10:54:01.629578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.788171Z","title":"Patrick Jaillet, Jiashuo Jiang, Konstantina Mellou, Marco Molinaro, Chara Podimata, and Zijie Zhou","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.788171Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:6f309a9ba744d51a7a8ef2c33c48cc5daaddf9dd44acf2e5537b4cb47d4992dc","observation_id":"5ad9925b-cd20-4058-9865-074128677b22","resolution":{"observed_at":"2026-08-04T10:54:01.788171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.847860Z","title":"Redwan Ibne Seraj Khan, Kunal Jain, Haiying Shen, Ankur Mallick, Anjaly Parayil, Anoop Kulkarni, Steve Kofsky, Pankhuri Choudhary, Renee St Amant, Rujia Wang, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.847860Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:7510c7c7a015dfb30a9d8fa0d0f33ebdad1243d9443ee7325d9c5ffdfe1a3cb6","observation_id":"4f84c343-0ef8-4ec0-86cf-166c78aa7bb0","resolution":{"observed_at":"2026-08-04T10:54:01.847860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15997","last_updated":"2024-11-24T22:35:44Z","snapshot_observed_at":"2026-08-06T20:53:54.863271Z","submitted_at":"2024-11-24T22:35:44Z","title":"Ensuring Fair LLM Serving Amid Diverse Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15997","snapshot_observed_at":"2026-08-04T10:54:01.930191Z","title":"Qingxia Kong, Chung-Yee Lee, Chung-Piaw Teo, and Zhichao Zheng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.930191Z"},"links":{"cited_paper":"/paper/2411.15997","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:e7da5d6522b00dd0454ae7f1ac561633d42ccfc0fc4ea7b281e5572678682b45","observation_id":"5f8dbb02-5c22-47fd-b8be-a10e48552223","resolution":{"observed_at":"2026-08-04T10:54:01.930191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.214600Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.214600Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:75c8a05d0a1b6b2ad29b19eff1446285faaa67fd48926296e9b6d59a6a86d962","observation_id":"f2e77c7e-5fe4-49f3-a623-5e6b83fc75fd","resolution":{"observed_at":"2026-08-04T10:54:02.214600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.456372Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.456372Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:6a1886e73964237948ae20e3779b8e12b08e272e7293d0b88201dbe8f2ebaab6","observation_id":"668ffd06-84ce-4678-919d-6f8fe449c161","resolution":{"observed_at":"2026-08-04T10:54:02.456372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T10:54:02.588106Z","title":"arxiv 2303.08774.View in Article2, 5 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.588106Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:1eb5f9e38e6fcebae92d4f20773f1d56617fbd3820b97c828ac071a8d498b14d","observation_id":"6a3abbdd-bbda-463c-9b30-0398b321c20a","resolution":{"observed_at":"2026-08-04T10:54:02.588106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.719597Z","title":"Accessed: 2026-06-10","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.719597Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:4341c82d3168411efbc5768f5b70f972bf8eece1b0e0f5aa810cd8b9247e4f72","observation_id":"7e181c7d-b3da-4e49-9fe9-7dc5e00ecd21","resolution":{"observed_at":"2026-08-04T10:54:02.719597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.813457Z","title":"Julien Robert and Nicolas Schabanel","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.813457Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:2c74681fd3ec0a06e1269619327f12feb4e394bdb199e3913839f0499004e1ac","observation_id":"641ec49e-2bf3-476b-bfca-41d7dcb912e9","resolution":{"observed_at":"2026-08-04T10:54:02.813457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.883870Z","title":"In Proceedings of the Nineteenth Annual ACM-SIAM Symposium on Discrete Algorithms, SODA 2008, San Francisco, California, USA, January 20-22, 2008, Shang-Hua Teng (Ed.)","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.883870Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:ebf387fa7c23d2ae74054add10a36a2dd9f565fee9d1f8704db423a0e1ca3356","observation_id":"e187760f-dbe4-42ce-bd71-3f81186a6a64","resolution":{"observed_at":"2026-08-04T10:54:02.883870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.973735Z","title":"Rana Shahout, Eran Malach, Chunwei Liu, Weifan Jiang, Minlan Yu, and Michael Mitzenmacher","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.973735Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:3a9b0590f2ac8c131a1ffb7f328b00865dd86e530db687e626af3e561ae00307","observation_id":"70da5781-0ec5-496e-bbc3-17de77757ce7","resolution":{"observed_at":"2026-08-04T10:54:02.973735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01035","last_updated":"2024-10-01T19:51:07Z","snapshot_observed_at":"2026-08-06T13:32:41.475152Z","submitted_at":"2024-10-01T19:51:07Z","title":"Don't Stop Me Now: Embedding Based Scheduling for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01035","snapshot_observed_at":"2026-08-04T10:54:03.018347Z","title":"Ying Sheng, Shiyi Cao, Dacheng Li, Banghua Zhu, Zhuohan Li, Danyang Zhuo, Joseph E Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:03.018347Z"},"links":{"cited_paper":"/paper/2410.01035","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:bbf8e096bb0cb92a341bc0bbda522f28ca77ae8d43d57f1070d69afb81cb5afc","observation_id":"7a132beb-3140-4865-aba1-858a953f1282","resolution":{"observed_at":"2026-08-04T10:54:03.018347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06133","last_updated":"2026-06-28T02:08:15Z","snapshot_observed_at":"2026-08-09T06:10:09.984852Z","submitted_at":"2025-08-08T08:54:21Z","title":"LLM Serving Optimization with Variable Prefill and Decode Lengths","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06133","snapshot_observed_at":"2026-08-04T10:54:03.079660Z","title":"Zhixiang Wei, James Yen, Jingyi Chen, Ziyang Zhang, Zhibai Huang, Chen Chen, Xingzi Yu, Yicheng Gu, Chenggang Wu, Yun Wang, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:03.079660Z"},"links":{"cited_paper":"/paper/2508.06133","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:094f0cc4697d4433ef0fdbb8905d5fabe8c4dca181643dd6e08e0c3f3ffda90f","observation_id":"a0baf015-af7d-44f8-a8b5-2be04de56ed9","resolution":{"observed_at":"2026-08-04T10:54:03.079660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16646","last_updated":"2025-08-19T06:17:17Z","snapshot_observed_at":"2026-08-05T18:59:10.546347Z","submitted_at":"2025-08-19T06:17:17Z","title":"Equinox: Holistic Fair Scheduling in Serving Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16646","snapshot_observed_at":"2026-08-04T10:54:03.143633Z","title":"Gyeong-In Yu, Joo Seong Jeong, Geon-Woo Kim, Soojeong Kim, and Byung-Gon Chun","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:03.143633Z"},"links":{"cited_paper":"/paper/2508.16646","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:e515f5d689394724491c3636afe382e995a5ba5e20b1ffea097d0364b50af90f","observation_id":"db97d505-d2a9-403b-98fa-7ec2732478f8","resolution":{"observed_at":"2026-08-04T10:54:03.143633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11998","last_updated":"2024-03-10T19:34:57Z","snapshot_observed_at":"2026-07-06T16:21:45.588487Z","submitted_at":"2023-09-21T12:13:55Z","title":"LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11998","snapshot_observed_at":"2026-08-04T10:54:03.201603Z","title":"Yinmin Zhong, Shengyu Liu, Junda Chen, Jianbo Hu, Yibo Zhu, Xuanzhe Liu, Xin Jin, and Hao Zhang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:03.201603Z"},"links":{"cited_paper":"/paper/2309.11998","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:2ea53815158881664df85907ed5f3f7f0e782d49a7ce150c0e2ba404ddb1986a","observation_id":"cdef2cf6-f521-4abe-b227-83ae8c4a340d","resolution":{"observed_at":"2026-08-04T10:54:03.201603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09670","last_updated":"2024-06-06T15:50:51Z","snapshot_observed_at":"2026-08-05T00:28:57.370523Z","submitted_at":"2024-01-18T01:03:38Z","title":"DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09670","snapshot_observed_at":"2026-08-04T10:54:03.289004Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:03.289004Z"},"links":{"cited_paper":"/paper/2401.09670","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:391b2f4e937da053e902021f7b5ab95a2fd210d08305abe8b8b1ae2ee0d9514d","observation_id":"1fc05e27-74b7-4cb7-ac38-3710fe703192","resolution":{"observed_at":"2026-08-04T10:54:03.289004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.225727Z","title":"2023.Dissecting Batching Effects in GPT Inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":1641,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.225727Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:1d29bd05d3753997b716793faf58e94475bd0072dde4f411f3b0adca33ed1c38","observation_id":"087a142a-1a32-4d3d-885f-4d9a4fb9f36b","resolution":{"observed_at":"2026-08-04T10:54:01.225727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.699637Z","title":null,"venue":null,"work_id":null,"year":1969},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":1969,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.699637Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:e581eb62473eb9d3abe831daac0b44e4922d92121080525510ccb24520cf9f69","observation_id":"ddcb80a6-0fc5-4b22-b1e3-ba91dabb83d5","resolution":{"observed_at":"2026-08-04T10:54:01.699637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.138037Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":1998,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.138037Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:0b2fdcae5a42851b9195019c7aa7a234ac46e37c92c193361f7f16811714b6e9","observation_id":"4b9c7015-8c18-420d-bd5b-f1a797240a87","resolution":{"observed_at":"2026-08-04T10:54:01.138037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.116767Z","title":"Wenhua Li, Libo Wang, Xing Chai, and Hang Yuan","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.116767Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:4d7bbac1b1c4806b8f779554803eb8e2504b606a336f64751608e24060fddd8a","observation_id":"dff2a208-8646-43ab-8ac6-2911380ffef2","resolution":{"observed_at":"2026-08-04T10:54:02.116767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0166-218x(01)00272-4special","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:58:25.610332Z","title":"doi:10.1016/S0166-218X(01)00272-4Special Issue devoted to Foundation of Heuristics in Combinatoria l Optimization","venue":null,"work_id":"bdc819c0-e2ed-42b0-9885-7348826c8bc6","year":2002},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.678116Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:015524ae3f732b676234c66bdd87e8d937bf7b2a6e604e42cdf25eade696a636","observation_id":"ead3a966-1d85-46d4-9779-90fa2866b0b7","resolution":{"observed_at":"2026-08-04T10:58:25.697257Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:00.361206Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.361206Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:2a6afcceb7829bf9f7c10b20401e54d183e93ea392fad07d5030f840d82f72d8","observation_id":"9afc8553-44a8-4c1c-ac54-a1d4fb79d120","resolution":{"observed_at":"2026-08-04T10:54:00.361206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.024754Z","title":"Woosuk Kwon, Zhuohan Li, Siyuan Zhuang, Ying Sheng, Lianmin Zheng, Cody Hao Yu, Joseph Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.024754Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:d702e85ae14684edb1822dfbf2cabd847382c8d9ff7beedcf7cb63d43c92de7b","observation_id":"0b1737ba-9f9c-4cb7-a2bc-edcccf6749d6","resolution":{"observed_at":"2026-08-04T10:54:02.024754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.323278Z","title":"Thodoris Lykouris and Sergei Vassilvitskii","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.323278Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:906714a70ec0124725a769220edc6528e1936cc1d3378adab4745f5c9d3e2fea","observation_id":"c9c7c267-c5d7-411c-817a-c603298c68e3","resolution":{"observed_at":"2026-08-04T10:54:02.323278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:01.447992Z","title":"In46th International Colloquium on Automata, Languages, and Programming, ICALP 2019, July 9-12, 2019, Patras, Greece (LIPIcs, Vol","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:01.447992Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:abf12e205bfa4834598f0041766eade2cc1f2cd9765eb22339cb928a31ba9afe","observation_id":"34dedbdf-e758-49cf-8dad-677d2e5335b7","resolution":{"observed_at":"2026-08-04T10:54:01.447992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:00.786896Z","title":"Marco Cascella, Jonathan Montomoli, Valentina Bellini, and Elena Bignami","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.786896Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:bb0f8d73a0812ec1a301e97344f5051f66a16b03a4b54ccda8e1eed951862b35","observation_id":"1f639b82-11bb-4afa-83d6-0ffab48c67e9","resolution":{"observed_at":"2026-08-04T10:54:00.786896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:02.396636Z","title":"Ho-Yin Mak, Ying Rong, and Jiawei Zhang","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:02.396636Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:da748c741ee5b977e0290ad01884d03dee9f72cf8484f1235be327f013820b91","observation_id":"dbf90813-f4f7-461c-9da8-eaafb5296015","resolution":{"observed_at":"2026-08-04T10:54:02.396636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16369","last_updated":"2023-08-31T00:03:02Z","snapshot_observed_at":"2026-08-06T15:43:00.292272Z","submitted_at":"2023-08-31T00:03:02Z","title":"SARATHI: Efficient LLM Inference by Piggybacking Decodes with Chunked Prefills","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16369","snapshot_observed_at":"2026-08-04T10:54:00.298222Z","title":"Susanne Albers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.298222Z"},"links":{"cited_paper":"/paper/2308.16369","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:5cc2caf3ce00bd089b53fce299963a46d5f869056b0bfdedc22a2fecbe3b8b16","observation_id":"33809743-9fe6-4fe0-afd9-442265d89329","resolution":{"observed_at":"2026-08-04T10:54:00.298222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02310","last_updated":"2024-06-17T21:10:46Z","snapshot_observed_at":"2026-07-06T17:39:24.823145Z","submitted_at":"2024-03-04T18:47:08Z","title":"Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02310","snapshot_observed_at":"2026-08-04T10:54:00.179459Z","title":"Amey Agrawal, Ashish Panwar, Jayashree Mohan, Nipun Kwatra, Bhargav S Gulavani, and Ramachandran Ramjee","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.179459Z"},"links":{"cited_paper":"/paper/2403.02310","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:5f5ad51451c99f7efa34bb9ed29a58e7786e0eb54f44c90602ea6300743809ab","observation_id":"46da00a1-c551-488c-8393-79b665384216","resolution":{"observed_at":"2026-08-04T10:54:00.179459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11320","last_updated":"2026-05-14T23:11:43Z","snapshot_observed_at":"2026-08-02T11:51:09.028246Z","submitted_at":"2025-04-15T16:00:21Z","title":"Optimizing LLM Inference: Fluid-Guided Online Scheduling with Memory Constraints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11320","snapshot_observed_at":"2026-08-04T10:54:00.567728Z","title":"Yossi Azar and Leah Epstein","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.567728Z"},"links":{"cited_paper":"/paper/2504.11320","citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:49673c67cfdefe373f4a2991712ad763dbb166e718b9e71db922d4f6f578076a","observation_id":"17797206-444c-43c2-b75e-c2251d36ac58","resolution":{"observed_at":"2026-08-04T10:54:00.567728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:54:00.460788Z","title":"Accessed: 2026-06-10","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-04T10:54:00.460788Z"},"links":{"citing_paper":"/paper/2608.02244"},"observation_digest":"sha256:a8b825fa25aee0e7fd12979c9307e9f15bb427c64c24ba53ae16aa081db2bebc","observation_id":"fdbdf55b-6bee-4ffd-97a8-c5705fbf8826","resolution":{"observed_at":"2026-08-04T10:54:00.460788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02244","last_updated":"2026-08-03T13:55:20Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-08T06:39:19.636143Z","submitted_at":"2026-08-03T13:55:20Z","title":"Efficiency and Cost Alignment in Batched LLM Serving via Resource-Fair Scheduling"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2608.02244."}