{"as_of":"2026-08-16T06:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1f84af26c22031fd8f53efa15f2a071cd404d02b1aca7ba4183e71c0775eb317","coverage":[{"denominator":100,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:55:56.738248Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03036/citation-record","integrity":"/paper/2608.03036/integrity","json":"/paper/2608.03036/citation-record.json","paper":"/paper/2608.03036"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.21901","last_updated":"2025-06-27T04:38:20Z","snapshot_observed_at":"2026-08-11T17:40:24.826706Z","submitted_at":"2025-06-27T04:38:20Z","title":"A Survey of LLM Inference Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.21901","snapshot_observed_at":"2026-08-15T14:55:56.344634Z","title":"A survey of llm inference systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.344634Z"},"links":{"cited_paper":"/paper/2506.21901","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:733db169122afe52c65d59d84ebef70c5adebb343b81c681c95c91ebbf8911be","observation_id":"a3673a36-0aec-45ff-bdbb-d2efb3f18b83","resolution":{"observed_at":"2026-08-15T14:55:56.344634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.350275Z","title":"A survey on evaluation of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.350275Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:8445012dc1baef1eb80b1a30d2360eda1f023fcebbc84553d0d803537ae4ec82","observation_id":"e052671b-2ac7-412c-9ed1-46f88f719403","resolution":{"observed_at":"2026-08-15T14:55:56.350275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.354459Z","title":"Towards efficient generative large language model serving: A survey from algorithms to systems,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.354459Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d37cb6af085d816a370a260829065faae39020e94459e1304a36d9f4f90e27eb","observation_id":"a444923f-0b42-4494-b014-1fd7ee42d66c","resolution":{"observed_at":"2026-08-15T14:55:56.354459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.358230Z","title":"Thunderserve: High-performance and cost-efficient llm serving in cloud environments,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.358230Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d6521d35d067aa22d288b0e6fb6da3fea80281da0cbbdc36a952df19dae58e07","observation_id":"be419be5-d137-4cbc-a76c-4673cf824697","resolution":{"observed_at":"2026-08-15T14:55:56.358230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.362518Z","title":"Efficient memory management for large language model serving with page- dattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.362518Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:4da5c7c867c6e9b17e690c3930018a50ae61ec4b885b48db31dd3f204307d691","observation_id":"1a593f6f-8d64-4687-9eda-7fb9492f8522","resolution":{"observed_at":"2026-08-15T14:55:56.362518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.366508Z","title":"Sglang: Efficient execution of structured language model pro- grams,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.366508Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:17465ca99012377f3a2749c66d9153ffa72474ecb5948e94869dc926de227988","observation_id":"97a8ab5b-6ef9-4536-bcc7-6f47b6043a1b","resolution":{"observed_at":"2026-08-15T14:55:56.366508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.370426Z","title":"Official document of tensorrt,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.370426Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9a3e1247da842ea164f7be93c3ede85fd06a7e24a7e846cc43e5c326f01beb54","observation_id":"5533bfcc-abeb-4f38-b73e-1d70731c25e3","resolution":{"observed_at":"2026-08-15T14:55:56.370426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.374482Z","title":"Official document of lmdeploy,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.374482Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:135afcb4ecab548740c125ef3a323b93185cca0e6f0f7ff9ed732c312a3c76d5","observation_id":"a355b0e5-8cd3-4eaa-a0ed-df71cb5a72f1","resolution":{"observed_at":"2026-08-15T14:55:56.374482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.377992Z","title":"Official document of flashinfer,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.377992Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:dcd4c87642aebdaf38acd635b2ae3acf938e8f79eaf5d8673c1e409cdab40b74","observation_id":"e9df915f-3e37-4ed3-a527-2226fa50f0ea","resolution":{"observed_at":"2026-08-15T14:55:56.377992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00625","last_updated":"2024-12-29T17:38:32Z","snapshot_observed_at":"2026-08-15T16:33:19.679814Z","submitted_at":"2024-01-01T01:12:42Z","title":"Beyond Efficiency: A Systematic Survey of Resource-Efficient Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00625","snapshot_observed_at":"2026-08-15T14:55:56.381697Z","title":"Beyond efficiency: A systematic survey of resource-efficient large language mod- els,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.381697Z"},"links":{"cited_paper":"/paper/2401.00625","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9c89b53abe9c77ba54c8247adde4b6e49cb66e82ba9dea9f5e66f0226ad0398e","observation_id":"a1676db1-6079-4001-8d51-2da8faf011ae","resolution":{"observed_at":"2026-08-15T14:55:56.381697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03863","last_updated":"2024-05-23T06:08:37Z","snapshot_observed_at":"2026-08-13T05:08:25.522951Z","submitted_at":"2023-12-06T19:18:42Z","title":"Efficient Large Language Models: A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03863","snapshot_observed_at":"2026-08-15T14:55:56.385913Z","title":"Efficient large language models: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.385913Z"},"links":{"cited_paper":"/paper/2312.03863","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2228348b4f90ce3f6d19b3ea8266bc727caa54bcc29656d39c01b949209af06b","observation_id":"ec33ef9f-be68-476f-8a3e-c89ac65c5000","resolution":{"observed_at":"2026-08-15T14:55:56.385913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08092","last_updated":"2024-09-23T07:37:34Z","snapshot_observed_at":"2026-08-13T04:42:19.813596Z","submitted_at":"2024-01-16T03:35:26Z","title":"A Survey of Resource-efficient LLM and Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08092","snapshot_observed_at":"2026-08-15T14:55:56.390091Z","title":"A survey of resource-efficient llm and multimodal foundation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.390091Z"},"links":{"cited_paper":"/paper/2401.08092","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2b73ccf3fb9095cbfec2a928ce8c6b586f0309e466d8312d8dfa231faeba096b","observation_id":"d6ffad8b-2c7e-4e33-997d-4f4dd601b778","resolution":{"observed_at":"2026-08-15T14:55:56.390091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.397429Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.397429Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d85bb71ad4f30e361467af57c348c9b3fb8b09a5c44adadab03c484f37443c48","observation_id":"5df508dc-a31c-424f-828c-90152a5cc94c","resolution":{"observed_at":"2026-08-15T14:55:56.397429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09748","last_updated":"2024-02-15T06:58:30Z","snapshot_observed_at":"2026-08-14T21:16:42.407609Z","submitted_at":"2024-02-15T06:58:30Z","title":"Model Compression and Efficient Inference for Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09748","snapshot_observed_at":"2026-08-15T14:55:56.400818Z","title":"Model compression and efficient inference for large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.400818Z"},"links":{"cited_paper":"/paper/2402.09748","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:6e16b75cae529d7e223465ffe37d4d581d01e6e55dbd751c8468a8f2789064b2","observation_id":"689dfee7-f42a-425c-9be6-262a46233833","resolution":{"observed_at":"2026-08-15T14:55:56.400818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.404285Z","title":"A survey on model compression for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.404285Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:95806aef0b836b149f9c109fab2604f8540e5fe67a6ad1b394dc76333b39bbe0","observation_id":"bbb05503-d6d7-459e-8704-7e3ab046db8f","resolution":{"observed_at":"2026-08-15T14:55:56.404285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14618","last_updated":"2024-04-22T23:06:42Z","snapshot_observed_at":"2026-08-13T00:24:15.944344Z","submitted_at":"2024-04-22T23:06:42Z","title":"Hybrid LLM: Cost-Efficient and Quality-Aware Query Routing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14618","snapshot_observed_at":"2026-08-15T14:55:56.408267Z","title":"Hybrid llm: Cost-efficient and quality-aware query routing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.408267Z"},"links":{"cited_paper":"/paper/2404.14618","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:34372aaadcf1613473c9dcb2e5f1c9b11d4cb9186493223ffdb5c6d8fee11fe3","observation_id":"5835481e-a495-4a67-b0b1-29c78bc9202a","resolution":{"observed_at":"2026-08-15T14:55:56.408267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.413557Z","title":"{Cost-Efficient}large language model serving for multi-turn conversations with{CachedAttention},","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.413557Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:351a55ebecee7bf0e78771db4bf9eb49b5fdd6c60c25a89f8f80be836f08681e","observation_id":"90d5df3a-1865-46fa-834e-b508b34b7a38","resolution":{"observed_at":"2026-08-15T14:55:56.413557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10285","last_updated":"2023-09-19T03:20:02Z","snapshot_observed_at":"2026-08-15T17:35:19.408043Z","submitted_at":"2023-09-19T03:20:02Z","title":"Flash-LLM: Enabling Cost-Effective and Highly-Efficient Large Generative Model Inference with Unstructured Sparsity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10285","snapshot_observed_at":"2026-08-15T14:55:56.417189Z","title":"Flash-llm: Enabling cost-effective and highly-efficient large generative model inference with unstructured sparsity,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.417189Z"},"links":{"cited_paper":"/paper/2309.10285","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:64b3b791a6507ccb73f9d5eb3dc2002cedb7f4235c0e6d8a1fd16e62dbbac335","observation_id":"8b0c0ae6-aea2-4b2f-be65-e4d50e01addb","resolution":{"observed_at":"2026-08-15T14:55:56.417189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.420832Z","title":"Evaluation of tools and frame- works for machine learning model serving,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.420832Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:20c2457ea5315793e67c92829c280469cab1cb3178a7d7fe15e0534aa283c453","observation_id":"51420edf-b54f-4994-895d-517031d632bc","resolution":{"observed_at":"2026-08-15T14:55:56.420832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03648","last_updated":"2025-02-22T07:07:38Z","snapshot_observed_at":"2026-08-15T07:42:34.001187Z","submitted_at":"2025-02-22T07:07:38Z","title":"AIBrix: Towards Scalable, Cost-Effective Large Language Model Inference Infrastructure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03648","snapshot_observed_at":"2026-08-15T14:55:56.424216Z","title":"Aibrix: Towards scalable, cost-effective large language model inference infrastructure,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.424216Z"},"links":{"cited_paper":"/paper/2504.03648","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:6151af2566b8981074c51683a0da167534a4fc7666ddc87e3ef1158b6eac6154","observation_id":"3fd652c3-fb28-401e-8674-b525ca14bc30","resolution":{"observed_at":"2026-08-15T14:55:56.424216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.427615Z","title":"Majidi, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.427615Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:702ae90ad0c5206b1d64c02eed2ebdb773770164a03c06da893c41ce4782341a","observation_id":"49beadff-3266-48e5-ac2f-55b1f20591be","resolution":{"observed_at":"2026-08-15T14:55:56.427615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.431184Z","title":"What is artificial intelligence (ai)?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.431184Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:b825ddd0aa91a5fd1af5e7f18639de595712b55b4d971f4008783ddd56114913","observation_id":"4fc7c856-2ce8-43c5-91f8-a1b6d37cc651","resolution":{"observed_at":"2026-08-15T14:55:56.431184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.434447Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.434447Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f115425be959c2df703ab7a09b7d98e570329f473972db382ee8fd6d3438e2e6","observation_id":"06ee8274-b6c8-4cd4-9a77-07c008dfec4c","resolution":{"observed_at":"2026-08-15T14:55:56.434447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.437948Z","title":"Defining intelligence: Bridging the gap between human and artificial perspectives,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.437948Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e43e59305ffcf56ac6d9296b4069f9853d5403c2189356a93910748c20ef6ef8","observation_id":"f8aed055-b4ce-4386-bc90-eecca482c520","resolution":{"observed_at":"2026-08-15T14:55:56.437948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.441337Z","title":"Generative ai,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.441337Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:bd960e5997cc4a782aa3d34d06f17a1a107f037445d3ff20d644812751aed85e","observation_id":"a6156760-6396-491a-b093-fd00ef40b5a4","resolution":{"observed_at":"2026-08-15T14:55:56.441337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.444957Z","title":"Generative artificial intelligence,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.444957Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:ce6bfe3658009c00b7bede910bbf183893cdcb9824847a8d73e4ae3fada86177","observation_id":"7293cc59-7ed0-4d35-86c2-b40bc2d4e7f4","resolution":{"observed_at":"2026-08-15T14:55:56.444957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.448436Z","title":"What is generative ai?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.448436Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:636b1218ae735131b4e8dcbeb8958505d8860ee9e745123c281555bfba907efd","observation_id":"52292cf6-a111-4115-949f-751e87e6ae09","resolution":{"observed_at":"2026-08-15T14:55:56.448436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-15T14:55:56.451963Z","title":"A comprehensive overview of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.451963Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d220d320a3be3156593e45e732be566b06592c12ced2dceb1fa760a9ecc7c9a4","observation_id":"205b5eae-0d39-49c0-b184-5a39a1b01124","resolution":{"observed_at":"2026-08-15T14:55:56.451963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.455877Z","title":"What are large language models (llms)?","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.455877Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9854fa726e40430599de474ba466a4890442f4289a719fd927f310a1c0429ccc","observation_id":"4833ccf9-aaab-4962-af0e-576380656b31","resolution":{"observed_at":"2026-08-15T14:55:56.455877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.713730Z","title":"Large language models meet nlp: A survey,","venue":null,"work_id":"b2b79d4c-4d17-46bf-999e-c124f009c745","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.459288Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7378086d80ba7f9b0bf8a70639eb53a9309a3b27a6821817598dc36db2bf2477","observation_id":"f05dd931-24fb-4f40-97a1-95c4bcd6a7fa","resolution":{"observed_at":"2026-08-15T14:55:57.717611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-15T14:55:56.462860Z","title":"Large language models: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.462860Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e5678a4987d3942c14fad62ba6bcbb90f0dbad31c440a64357e0ce3e6a18beb1","observation_id":"6bf6f9b4-1226-488f-a548-774416c90592","resolution":{"observed_at":"2026-08-15T14:55:56.462860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.466417Z","title":"A survey on multimodal large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.466417Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f2cf628b9bfac19d43616e44d543225ad128da12c91a41ef0dcaa64e765493a5","observation_id":"c718c359-8348-4b6d-a05a-c22ca13b928c","resolution":{"observed_at":"2026-08-15T14:55:56.466417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.695567Z","title":"A survey of state of the art large vision language models: Benchmark evaluations and challenges,","venue":null,"work_id":"888b04be-8513-425f-a4bb-669437f8a243","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.469632Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:176c028e0419763c6a3a10a321604f0be5c6a6fe6ba5b60501effe2c6c7e2ff3","observation_id":"4d129d69-039e-410d-b9a0-61dc78d136cf","resolution":{"observed_at":"2026-08-15T14:55:57.699422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.684980Z","title":"Large language models in medical and healthcare fields: applications, advances, and challenges,","venue":null,"work_id":"1a20939c-47f3-473e-b5c2-8985dfe18289","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.474119Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c29355ea47a3d4540afbbe81ff952ff0d60a765299b8a3161a67e8441fd03b28","observation_id":"c7285766-be12-450d-b2dd-7c9808334726","resolution":{"observed_at":"2026-08-15T14:55:57.688799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14165","last_updated":"2024-11-30T22:21:30Z","snapshot_observed_at":"2026-08-14T14:35:20.845144Z","submitted_at":"2024-09-21T15:07:37Z","title":"A Survey on Large Language Model-empowered Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14165","snapshot_observed_at":"2026-08-15T14:55:56.481199Z","title":"A survey on large language model-empowered autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.481199Z"},"links":{"cited_paper":"/paper/2409.14165","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:bf240fcfbe03cb279fe0814537125966a76c0b916e774598e483cfd108542b8d","observation_id":"d9d65e2a-35af-47e7-aace-bd47879eaa4c","resolution":{"observed_at":"2026-08-15T14:55:56.481199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.674616Z","title":"Actuarygpt: Applications of large language models to insurance and ac- tuarial work,","venue":null,"work_id":"e7c8fbe3-bcf1-4608-80d3-05dd31c22716","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.484767Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9e23ad4038317232a3d2aaa335fcf28d860b97c8238cf57b1543b27685e45987","observation_id":"f6c7899e-710a-4547-adc7-559069842108","resolution":{"observed_at":"2026-08-15T14:55:57.678448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11903","last_updated":"2024-06-15T16:11:35Z","snapshot_observed_at":"2026-08-14T08:35:48.053147Z","submitted_at":"2024-06-15T16:11:35Z","title":"A Survey of Large Language Models for Financial Applications: Progress, Prospects and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11903","snapshot_observed_at":"2026-08-15T14:55:56.488867Z","title":"A survey of large language models for financial applications: Progress, prospects and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.488867Z"},"links":{"cited_paper":"/paper/2406.11903","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:045b9d0a02d4cf94a7739a5c67a908f35425a66669003d9a18591603c1198a95","observation_id":"22b1023a-e8a0-462f-be27-d48ff8304e2c","resolution":{"observed_at":"2026-08-15T14:55:56.488867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-15T14:55:56.492897Z","title":"A survey on efficient inference for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.492897Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:30956f7c7a42dab370b19156cc5492289a4db05e7791ddf36172118e78ece400","observation_id":"5cdbc65a-d476-4065-995d-633553ff63fb","resolution":{"observed_at":"2026-08-15T14:55:56.492897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.664068Z","title":"An efficient model maintenance ap- proach for mlops,","venue":null,"work_id":"0b4c7598-c12a-49b6-a4b0-718e88048445","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.496739Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:6cab101d0db7c73a9048539e4d98cf21a3245e5447a9b973afc4a042a543e7af","observation_id":"6fbaf3cc-a677-418e-8cd6-2a0e0d9f82a5","resolution":{"observed_at":"2026-08-15T14:55:57.667615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.653442Z","title":"Sprout: Green generative ai with carbon- efficient llm inference,","venue":null,"work_id":"cdad5062-94c7-4556-b705-b409ab0a512a","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.500582Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:807cba04a3c7159a1acfe97dfa309dabd8f6e46fb6b00459f4226b910d572a60","observation_id":"93cc29c3-d876-434e-b738-9137fc52438f","resolution":{"observed_at":"2026-08-15T14:55:57.657256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.640965Z","title":"Measuring and improving the energy effi- ciency of large language models inference,","venue":null,"work_id":"22e1e936-ae73-4a3b-9244-493f44ea8ea7","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.504833Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d13533c5197eb7ae127e91feb8082ca9a87f8f1d1b76b775761d580741904d08","observation_id":"625cb309-6809-4c0f-91b8-19299cb14870","resolution":{"observed_at":"2026-08-15T14:55:57.644823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.630563Z","title":"An empirical study on the usage of au- tomated machine learning tools,","venue":null,"work_id":"45ad961d-0e38-4699-a47e-6a333b536902","year":2022},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.508805Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:5cfc353c2094aff9647e3b64471008c20697ad0a275917d59bf2d401bb3b17ac","observation_id":"219c144b-7d78-43c2-9905-b4567c2a87fd","resolution":{"observed_at":"2026-08-15T14:55:57.634208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.619878Z","title":"Github rest api,","venue":null,"work_id":"bd830318-ffa0-46a7-b4dd-8e26187b98f6","year":2021},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.513108Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9dbd0dcbfd7d94439b9ba171cad57c6210764605748ce6b8aef6559d0658fe0e","observation_id":"fa04e472-1d81-4c54-9ab0-ae4e4143b3b0","resolution":{"observed_at":"2026-08-15T14:55:57.623460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.05637","last_updated":"2026-08-03T15:19:02Z","snapshot_observed_at":"2026-08-07T17:01:33.563160Z","submitted_at":"2026-03-05T19:47:26Z","title":"Real Faults in Model Context Protocol (MCP) Software: a Comprehensive Taxonomy","version":2},"cited_work":{"arxiv_id":"2603.05637","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.05637","snapshot_observed_at":"2026-08-15T14:55:57.065573Z","title":"Real Faults in Model Context Protocol (MCP) Software: a Comprehensive Taxonomy","venue":"cs.SE","work_id":"29909d41-f469-44af-9a35-59e31541919d","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.517402Z"},"links":{"cited_paper":"/paper/2603.05637","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7d12c61a9d19e4759b6edbf266e2bcfbf54d1aea4eba978159ee5c494fa2ab4e","observation_id":"147f1170-cb17-4c54-ab00-a9c96bbc7e6b","resolution":{"observed_at":"2026-08-15T14:55:57.069621Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.06847","last_updated":"2026-05-07T16:46:46Z","snapshot_observed_at":"2026-08-12T19:29:28.939078Z","submitted_at":"2026-03-06T20:12:29Z","title":"Characterizing Faults in Agentic AI: A Taxonomy of Types, Symptoms, and Root Causes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.06847","snapshot_observed_at":"2026-08-15T14:55:56.521463Z","title":"Characterizing faults in agentic ai: A taxonomy of types, symptoms, and root causes,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.521463Z"},"links":{"cited_paper":"/paper/2603.06847","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:a2cbd50a3336e58f4ff801541f3b7f39aeafc73e7dde4217df882996d57c4d6d","observation_id":"20350623-d13c-4078-a282-0b5eb82422d4","resolution":{"observed_at":"2026-08-15T14:55:56.521463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15003","last_updated":"2025-07-20T15:15:58Z","snapshot_observed_at":"2026-08-14T15:15:22.164722Z","submitted_at":"2025-07-20T15:15:58Z","title":"The Rise of AI Teammates in Software Engineering (SE) 3.0: How Autonomous Coding Agents Are Reshaping Software Engineering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.15003","snapshot_observed_at":"2026-08-15T14:55:56.526054Z","title":"The rise of ai teammates in software engineering (se) 3.0: How autonomous coding agents are reshaping software engineering,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.526054Z"},"links":{"cited_paper":"/paper/2507.15003","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9ffcfc08f2de8084ce8e89d61c65aa869ffcabcda4082ea16f8bcf0a5a918a2b","observation_id":"9a4e3fc1-a82b-4b69-ba6a-1e75fa6dbccf","resolution":{"observed_at":"2026-08-15T14:55:56.526054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.608976Z","title":"Bug character- ization in machine learning-based systems,","venue":null,"work_id":"89cd68b0-8aa8-4593-9c3b-fb3319f458e2","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.530416Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:206f50668370b3c2a63c1196592bf6b352725a71276e21638ec31b2c022d3341","observation_id":"da7f103a-799b-4d3f-8885-db3ae56842a1","resolution":{"observed_at":"2026-08-15T14:55:57.613124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08172","last_updated":"2024-11-12T20:32:36Z","snapshot_observed_at":"2026-08-15T14:45:51.619234Z","submitted_at":"2024-11-12T20:32:36Z","title":"Fault Localization in Deep Learning-based Software: A System-level Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08172","snapshot_observed_at":"2026-08-15T14:55:56.534446Z","title":"Fault localization in deep learning- based software: A system-level approach,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.534446Z"},"links":{"cited_paper":"/paper/2411.08172","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:273267bb47099360288df3483286e010a312a210c539224a7a0612625fba7acb","observation_id":"119aeb00-9a17-4e66-93c0-011282f4c180","resolution":{"observed_at":"2026-08-15T14:55:56.534446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.598772Z","title":"Bugs in machine learning- based systems: a faultload benchmark,","venue":null,"work_id":"104fee8e-dc0a-46a5-8ff8-67ed9a052461","year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.538915Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:76fa903cd454c6330eb37391c4b506b5ad83a606d53690e49f1e64629cf0f7ff","observation_id":"663148f4-c589-4b8d-9978-0d8b1d596766","resolution":{"observed_at":"2026-08-15T14:55:57.602363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.588811Z","title":"Official document of vllm,","venue":null,"work_id":"f97544ec-3d80-4aac-820b-331728a9f4f6","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.542930Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:698a36cd1edced4a289e4580b9650dbf489dce4f510f026edaeee5cddd582f32","observation_id":"8fb0cac4-0a9d-4619-a098-9d5b5419d5f0","resolution":{"observed_at":"2026-08-15T14:55:57.592224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.578267Z","title":"Abstract syntax tree,","venue":null,"work_id":"d3beeaf3-0df6-48a1-96a9-0992c0953903","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.546682Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:b0937719be93d594c2373ab49dfade79b795d9835e75627fd2fff6d0e8938bb2","observation_id":"233b346d-d04d-4891-aff1-e68d7816e3c1","resolution":{"observed_at":"2026-08-15T14:55:57.581807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.567449Z","title":"About readmes,","venue":null,"work_id":"5dbde51d-d099-4f44-becf-a203e5421b04","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.551260Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:5c8202b3eb17347a754e9c6da863d84106142414b33b09be7fa39705fcd0fee2","observation_id":"568902fa-dfa8-4be8-b60d-a58e50ff187f","resolution":{"observed_at":"2026-08-15T14:55:57.571366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.556715Z","title":"Study the correlation between the readme file of github projects and their popularity,","venue":null,"work_id":"799dfa77-9cc7-4b24-8288-f4cebf2fb558","year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.556285Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:33f3b7f9f9614bf8e0651ed9f081c338fd0dc5237f99f42c7e62c267e41f8a62","observation_id":"4a71f241-c938-4098-a0fa-730335c44cf3","resolution":{"observed_at":"2026-08-15T14:55:57.560480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.545972Z","title":"Classifying your repository with topics,","venue":null,"work_id":"2d622134-c4ae-4d7a-ae7f-366efba593a6","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.560238Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:b618f3558a7790a1c1ef7c97c9ee25941f0f394d29952e37eab1775ffc8fa8f4","observation_id":"230de082-ba69-4f03-9b83-a72331ec6f7d","resolution":{"observed_at":"2026-08-15T14:55:57.549530Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.536223Z","title":"(2026) Gpt-4o mini","venue":null,"work_id":"ca615e55-17de-4a24-a270-391647eaf792","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.564302Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d886d3caaeae545a72a3c495b7e14d8cf7778bf4522c9fe81a05a060c0e3f4b5","observation_id":"4115aaaa-a834-4cac-8b3b-cf5e5c1e362d","resolution":{"observed_at":"2026-08-15T14:55:57.539557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.13283","last_updated":"2021-10-25T21:50:21Z","snapshot_observed_at":"2026-08-13T17:46:01.651756Z","submitted_at":"2021-10-25T21:50:21Z","title":"Generating GitHub Repository Descriptions: A Comparison of Manual and Automated Approaches","version":1},"cited_work":{"arxiv_id":"2110.13283","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.13283","snapshot_observed_at":"2026-08-15T14:55:57.020426Z","title":"Generating GitHub Repository Descriptions: A Comparison of Manual and Automated Approaches","venue":"cs.SE","work_id":"c0441e9a-87e7-4755-8199-31bb4c8451b4","year":2021},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.568147Z"},"links":{"cited_paper":"/paper/2110.13283","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:0923ba948d691a3dd0907630a4c812b7f28ab16f85098b664ed72d78c7668b5b","observation_id":"79e4948d-3af9-4534-8d71-b3071fcfc877","resolution":{"observed_at":"2026-08-15T14:55:57.024863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.524854Z","title":"Mining software reposito- ries for software architecture—a systematic mapping study,","venue":null,"work_id":"a23baa66-b9ac-46e2-af54-1bce24b0e954","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.572312Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:3a8b6c91d2cc8524dc99121d00c8ed3b19a4ffc2546bb035b05cdecde85ba09d","observation_id":"4a2081d3-4ceb-4b47-8413-9f3f50fdafe4","resolution":{"observed_at":"2026-08-15T14:55:57.529568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.514465Z","title":"Uncovering concerns of citizens through machine learning and social network sentiment analysis,","venue":null,"work_id":"186188ae-cac1-4925-bcff-9a13ede3cf0b","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.576130Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:5fe4d3c17adca765886a2fa37f27f1425059f13174347abac42fd4a7b52a2b1a","observation_id":"c25d43a7-5d1c-461a-8638-3f6271a93321","resolution":{"observed_at":"2026-08-15T14:55:57.517971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01520","last_updated":"2025-02-03T16:56:08Z","snapshot_observed_at":"2026-08-15T23:07:49.317192Z","submitted_at":"2025-02-03T16:56:08Z","title":"Prioritizing App Reviews for Developer Responses on Google Play","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01520","snapshot_observed_at":"2026-08-15T14:55:56.580296Z","title":"Prioritizing app reviews for developer responses on google play,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.580296Z"},"links":{"cited_paper":"/paper/2502.01520","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9d32d608082da0c434a67235768a2e4c25bf267d28952a5b0a99b5e2d43076d9","observation_id":"7c71447d-61ae-4520-aa30-57f746a34966","resolution":{"observed_at":"2026-08-15T14:55:56.580296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.504092Z","title":"Sentence-bert: Sentence embeddings using siamese bert- networks,","venue":null,"work_id":"bac1af10-cb00-4bbb-ad49-15e4f8e21fd8","year":2019},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.584347Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:4ad4f3e6302b38a4fb429ecb96728338efe4e45b6d764705a364f2e2f6a73e48","observation_id":"a18d5f94-057a-402b-a738-920493e98e2f","resolution":{"observed_at":"2026-08-15T14:55:57.507735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19365","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.990498Z","title":"Llm-assisted topic reduction for bertopic on social media data,","venue":null,"work_id":"3f9ed370-05cd-4221-b751-92481d21f106","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.588056Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:ef9cc5e42d02d9155f25ee1aaec130017bf48ab46717ff96dfbdd7b5e8d4c9d0","observation_id":"9d2d3e66-3bc5-484f-8375-8b3caf4bbee6","resolution":{"observed_at":"2026-08-15T14:55:56.996567Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.492932Z","title":"Security vulnerabilities in ai-generated code: A large-scale analysis of public github repositories,","venue":null,"work_id":"50110828-3186-45b1-a68a-12c3f9c332d6","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.591911Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e1c24571fa563464f275baa52450a127500b168e812a700b801e0b2e00a7ba1f","observation_id":"9e997147-2d58-4a1d-a749-2f409b2163b6","resolution":{"observed_at":"2026-08-15T14:55:57.496809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.482344Z","title":"An empirical study of blockchain repositories in github,","venue":null,"work_id":"429b5bf6-ea62-4854-80b8-837b440dce9b","year":2022},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.595737Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:0c7bef88ed93e1f79a5df9bbb00c1b96e64bd5c29d2f2b50e4dddcd887cc3618","observation_id":"12360636-8f0d-4252-b93d-44bee94fc1ad","resolution":{"observed_at":"2026-08-15T14:55:57.485807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.472295Z","title":"Ray: A distributed framework for emerging{AI}applica- tions,","venue":null,"work_id":"440cc7cb-385f-43cb-ad39-921bb3042d16","year":2018},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.599852Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:8f4d3cc460228b104b16e600cb08f578fda2097f990a17affaef16e069f14196","observation_id":"5e873c3e-7d3b-48b4-9549-5509f6dcc8df","resolution":{"observed_at":"2026-08-15T14:55:57.475711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.462162Z","title":"Official document of openllm,","venue":null,"work_id":"4c01a55f-d9ac-4b76-80f6-e60e28c9cd49","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.603835Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f4c4cecc9802a6c1217c84953aa412ff9a8403b0268b50ae8b6431270670739f","observation_id":"43c24151-d9e2-48c4-8cd5-3711688439d1","resolution":{"observed_at":"2026-08-15T14:55:57.465565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.450433Z","title":"Official document of routellm,","venue":null,"work_id":"3d05a8cb-3577-49a3-8b49-b856354b0123","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.607780Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:9a861a6a2be68812a9b2466a7f2aeffc0f22d12fd1a6e8e2dbf585cc8ffb6299","observation_id":"71fd8b85-737f-4d26-b777-051b3a015437","resolution":{"observed_at":"2026-08-15T14:55:57.453789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.439154Z","title":"Official document of sglang,","venue":null,"work_id":"fc0437d9-c50d-44c6-a762-1526b56f00b1","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.611729Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:e530309b334036f8c2c5899ca9bea5dbddca2667ade9d83c413b9f6ed825d154","observation_id":"d2324a7b-271f-4bad-a74c-2bb86b68ba66","resolution":{"observed_at":"2026-08-15T14:55:57.443311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.428438Z","title":"Official document of ray,","venue":null,"work_id":"6f95343a-669c-4e67-b74e-db74ea9ce91d","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.615872Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7e4265d50468c2925d786fb1766ad63d7a92519d8433bd7e13ab33a9ceb392e4","observation_id":"03b5b94a-5d94-4b95-a877-8af975eef4d9","resolution":{"observed_at":"2026-08-15T14:55:57.432118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.417848Z","title":"Official document of lightllm,","venue":null,"work_id":"d66ee172-6830-4139-a86f-442d568a115c","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.619642Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:3fd5ee9c944ec72b7fb6580a0ebd9dcff2713a06540ebe30a6a748514304ac2c","observation_id":"9bad6075-9da0-4da4-b9e1-31b822136084","resolution":{"observed_at":"2026-08-15T14:55:57.421356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.407418Z","title":"Official document of fastdeploy,","venue":null,"work_id":"c82d07c4-bfe0-4fe0-b72d-2c6c1bfcd452","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.623760Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:6b3bbb3b487b2629d3714ea7750b0adbdc2bff12032cd3a0b9f86b5ea6394fc5","observation_id":"3a7c6662-97b8-41f3-ad7f-70b41ce76994","resolution":{"observed_at":"2026-08-15T14:55:57.411029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.396886Z","title":"Flashinfer: Efficient and customizable attention engine for llm inference serving,","venue":null,"work_id":"3fee71ec-8066-433a-872a-93a6f4a7fef0","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.627564Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7f78f28ffb9a4cf7e77aeaf21275517f6433ad12674a305c89a22aa0c6af7af6","observation_id":"4d926ca6-5db6-4c6f-9c7c-25a4960d64e8","resolution":{"observed_at":"2026-08-15T14:55:57.400858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06709","last_updated":"2025-01-12T04:29:39Z","snapshot_observed_at":"2026-08-13T22:44:57.229111Z","submitted_at":"2025-01-12T04:29:39Z","title":"Mell: Memory-Efficient Large Language Model Serving via Multi-GPU KV Cache Management","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06709","snapshot_observed_at":"2026-08-15T14:55:56.631328Z","title":"Mell: Memory-efficient large language model serving via multi-gpu kv cache management,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.631328Z"},"links":{"cited_paper":"/paper/2501.06709","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:7638618f9a340912f5280ad970a1754f5d3249a3c11c0197b297932acf7a064c","observation_id":"87c72b18-1423-4970-92e9-e9b572cdfcb1","resolution":{"observed_at":"2026-08-15T14:55:56.631328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.635306Z","title":"A universal load balanc- ing principle and its application to large language model serving,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.635306Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:519998af51d07402702845613cfb9c730eb12952c94b334ce08eee9bcfea9d6f","observation_id":"c7ca2c38-8a98-4558-a2ac-70554602d9cb","resolution":{"observed_at":"2026-08-15T14:55:56.635306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.386067Z","title":"Layerskip: Enabling early exit inference and self-speculative decoding,","venue":null,"work_id":"e2c23486-3acf-411d-b6f0-2879069cfd62","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.639026Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:14240b4e3a6f744ce7951647ab9eabed6a22ee68fb89bf89b6c1f69255f93729","observation_id":"d0d9493b-b3e0-48a0-b357-12967a5b239f","resolution":{"observed_at":"2026-08-15T14:55:57.389994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.375978Z","title":"Llm inference serving: Survey of recent advances and opportunities,","venue":null,"work_id":"55610f82-9e60-4148-9eab-ea18591fab65","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.642710Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:bf0a59b2e91459e6377201217ef09b62ed32dbe6245ec51ff640028a9f6e67bd","observation_id":"6a861287-9e5e-4a0f-9a27-43f70c7f2f76","resolution":{"observed_at":"2026-08-15T14:55:57.379657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.646376Z","title":"Efficiently scaling transformer inference,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.646376Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:75154b8e813a5de56fee408d2369166908f4ff2719f7e4c0a5bc59b4ff98fdc3","observation_id":"554022d7-55d5-4ee5-9109-d323309fb824","resolution":{"observed_at":"2026-08-15T14:55:56.646376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16712","last_updated":"2025-08-22T14:59:23Z","snapshot_observed_at":"2026-08-16T05:43:37.028746Z","submitted_at":"2025-08-22T14:59:23Z","title":"Systematic Characterization of LLM Quantization: A Performance, Energy, and Quality Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16712","snapshot_observed_at":"2026-08-15T14:55:56.649990Z","title":"Systematic characterization of llm quantization: A performance, energy, and quality perspective,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.649990Z"},"links":{"cited_paper":"/paper/2508.16712","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:63efafe76175845c748956ca7811bbb52465216961329950227a61e846141d94","observation_id":"06070ec0-ff47-4d03-9eaa-e1f5f9863956","resolution":{"observed_at":"2026-08-15T14:55:56.649990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.653752Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.653752Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:07f63ffdc7c890976d45d65a6e78622f64aeef57b9d653ba32e905bcfcec9f9c","observation_id":"f3d52ff8-0ba8-4744-8eb2-0dd4dc50c257","resolution":{"observed_at":"2026-08-15T14:55:56.653752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.353221Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"3a2c93a8-f8c6-4782-9dfb-832e775b876a","year":2022},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.657509Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:94e196367cbb7855f0f455d32f1b46246b10f50b3e5919f81db21172254a3ee6","observation_id":"e5e830db-a1d9-4681-90f6-41d890492775","resolution":{"observed_at":"2026-08-15T14:55:57.356960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.342132Z","title":"A survey on lora of large language models,","venue":null,"work_id":"c3f0329e-5e8e-4cf5-817a-b9cd09662f79","year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.661068Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:52005b9c1a85202a6177f7c01bbe827a94b11bbad7641cdfafa17488b5fc31e5","observation_id":"76375f0f-5095-4700-9843-426a27d14a46","resolution":{"observed_at":"2026-08-15T14:55:57.345808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08621","last_updated":"2023-08-09T08:53:08Z","snapshot_observed_at":"2026-08-02T13:21:32.251959Z","submitted_at":"2023-07-17T16:40:01Z","title":"Retentive Network: A Successor to Transformer for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08621","snapshot_observed_at":"2026-08-15T14:55:56.665126Z","title":"Reten- tive network: A successor to transformer for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.665126Z"},"links":{"cited_paper":"/paper/2307.08621","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:396b1771efa2a976c3fea8e663b8c45c71c65581e2f5e557137e927a82454ae9","observation_id":"496a5b22-079e-4db8-86cd-4c02b61f12ed","resolution":{"observed_at":"2026-08-15T14:55:56.665126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.668960Z","title":"Rwkv: Reinventing rnns for the transformer era,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.668960Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:15e3f445c4e4f89c3d036abb7ee592c0ff5b31d7aef704c07747abfb3c5614e4","observation_id":"7c3f2ae8-1e60-48f9-805c-417d72994f9e","resolution":{"observed_at":"2026-08-15T14:55:56.668960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02281","last_updated":"2018-03-09T03:37:52Z","snapshot_observed_at":"2026-08-14T20:16:17.375580Z","submitted_at":"2017-11-07T04:42:48Z","title":"Non-Autoregressive Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02281","snapshot_observed_at":"2026-08-15T14:55:56.672535Z","title":"Non-autoregressive neural machine translation,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.672535Z"},"links":{"cited_paper":"/paper/1711.02281","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:242d1b943a4d299e3a14ae8078889a6cebf24c4505ec45f35b3be24081a0cee0","observation_id":"51364055-1a37-4d9b-9f29-044e4e139b1c","resolution":{"observed_at":"2026-08-15T14:55:56.672535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.324864Z","title":"Parallelism and scaling,","venue":null,"work_id":"d5a5967e-4565-4a37-927b-ba137e4e2b76","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.676499Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:651b3bdde188584f15c32f479da4336390818e26ccb492d5b1fd6094ec671ac8","observation_id":"748413d1-95e3-4c70-b502-411f6d1d5367","resolution":{"observed_at":"2026-08-15T14:55:57.328674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.314285Z","title":"Performance and tuning: Chunked prefill,","venue":null,"work_id":"ecaefc91-8cb2-46ab-82ad-c080f550ea21","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.680080Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:14b6822bfe28d4c699905d43d26d36c398ec83de2d3f48bf6f3d336b4e22b089","observation_id":"592c4a65-c676-44d9-8455-1b5b528f2304","resolution":{"observed_at":"2026-08-15T14:55:57.317920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.303905Z","title":"Quantization,","venue":null,"work_id":"22a6a0ec-6b7a-4ac0-9605-18df8dd4f4ba","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.683861Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:aba809fe537ec9cadb8f04b2225b7f83ac2f75966328098bce6295b8b8deca28","observation_id":"ed466b52-5300-4f47-ae7d-2fcb52c50d34","resolution":{"observed_at":"2026-08-15T14:55:57.307349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.293397Z","title":"Overview,","venue":null,"work_id":"01599f4b-5d76-4425-a4fb-44788818c9fc","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.687284Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:42b903449c82c535bfe442d394bb75c9aa71f5acb7efef6817c94c37409826c7","observation_id":"283c8bc8-5eaf-4dc4-81d1-1184fef86652","resolution":{"observed_at":"2026-08-15T14:55:57.296897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.281803Z","title":"Multi-head, multi-query, and group-query attention,","venue":null,"work_id":"38c7fb3d-2f5b-4acb-888f-59c3455df0b2","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.690786Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:3aeb0ec1114332633bd66ded5188a97b4e8d301487b7f7fc3a13bbfc426655dd","observation_id":"6edda610-8161-4981-b982-74b05aad2510","resolution":{"observed_at":"2026-08-15T14:55:57.286012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.270770Z","title":"Parallelism in tensorrt llm,","venue":null,"work_id":"0b88a367-eae9-436d-b018-61dac1ce44bb","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.694831Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:92999233e10119bb961b295acebcf9b89225e2ba66bee8c8e668d054b86800c1","observation_id":"a457f8ad-baad-483a-b778-486b1194f0f9","resolution":{"observed_at":"2026-08-15T14:55:57.274793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.259717Z","title":"Quantization,","venue":null,"work_id":"ae587052-9400-413d-ab25-57e55f05d2df","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.698485Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:c46522609ffa930663e853a80507373f8d0df60a5f801c5693352a67933f905d","observation_id":"9a9eeff6-34cc-454e-a3dd-428aa712d656","resolution":{"observed_at":"2026-08-15T14:55:57.263490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.247985Z","title":"FlexGen: High-throughput generative inference of large language models with a single GPU,","venue":null,"work_id":"709674b8-77ad-4e15-97df-a771a7caa0cc","year":2023},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.702164Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:bc27ecc66c1d0f3303e91806cefcc7c217f74005bd9c4367c96a281b85248f4c","observation_id":"dace80fa-6d51-48a0-8e36-548887227b73","resolution":{"observed_at":"2026-08-15T14:55:57.251723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.236925Z","title":"DISP-LLM: Dimension-independent structural pruning for large language models,","venue":null,"work_id":"f1c8bf87-1002-4727-811c-b072f73e92ea","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.705921Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:36ce409ba21438d6ba0a19e7410070137b74ff01b1ce992509e95f64c737afb0","observation_id":"73187ce2-58d1-417a-840e-3e7a7745b292","resolution":{"observed_at":"2026-08-15T14:55:57.240861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.226390Z","title":"Challenges in deploying machine learning: A survey of case studies,","venue":null,"work_id":"1c7e6a8a-81a1-405d-acbb-a261a7b2fa58","year":null},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.709693Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:3d97e42c325b4f2d43c649629fc3cc71c498ee43ef8981dfb84707fd90e862a5","observation_id":"a83e8c32-0a1b-4330-8389-015c3ff38218","resolution":{"observed_at":"2026-08-15T14:55:57.229967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/technologies12060081","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.767833Z","title":"A survey of machine learning in edge computing: Techniques, frameworks, applications, issues, and research directions,","venue":null,"work_id":"24b3f8d9-ecd6-44f1-b47d-36b7b428e03e","year":2024},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.718080Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:1448e4edcf55274d11a39b2e32b2e55d83196f360776e63745f713a59122e576","observation_id":"583995c2-ab6b-48c8-86de-041c811c935b","resolution":{"observed_at":"2026-08-15T14:55:56.773616Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21931","last_updated":"2025-07-29T15:46:26Z","snapshot_observed_at":"2026-08-14T04:35:11.044756Z","submitted_at":"2025-07-29T15:46:26Z","title":"Post-Training Large Language Models via Reinforcement Learning from Self-Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.21931","snapshot_observed_at":"2026-08-15T14:55:56.722273Z","title":"Post-training large language models via reinforcement learning from self-feedback,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.722273Z"},"links":{"cited_paper":"/paper/2507.21931","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:5e1b888b6bc4b0aaf929bbdefe499322ab116a5d742a027c72a6a3c16557bb17","observation_id":"4ee668c2-3338-4fac-9708-332017d83d63","resolution":{"observed_at":"2026-08-15T14:55:56.722273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-08-15T17:20:54.840134Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.20571","snapshot_observed_at":"2026-08-15T14:55:56.726629Z","title":"Reinforcement learning for reasoning in large language models with one training example, 2025,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.726629Z"},"links":{"cited_paper":"/paper/2504.20571","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:2a6babed301ef4b3b2f5541138f79312c7e19358676be442b89aa45e95c19b18","observation_id":"eb5d1063-ebb3-4017-a5a0-6497f7720951","resolution":{"observed_at":"2026-08-15T14:55:56.726629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00722","last_updated":"2025-06-05T07:54:05Z","snapshot_observed_at":"2026-08-14T13:57:55.592899Z","submitted_at":"2025-02-02T08:44:43Z","title":"Demystifying Cost-Efficiency in LLM Serving over Heterogeneous GPUs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00722","snapshot_observed_at":"2026-08-15T14:55:56.730544Z","title":"Demystifying cost-efficiency in llm serving over heterogeneous gpus,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.730544Z"},"links":{"cited_paper":"/paper/2502.00722","citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:fe6de869583600e70a099ac33f504a860d96c0daee67a1988967bfda94027e99","observation_id":"fe3d2808-d092-423a-8882-fa0b635a7de0","resolution":{"observed_at":"2026-08-15T14:55:56.730544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.215745Z","title":"A study of llms’ preferences for libraries and programming languages,","venue":null,"work_id":"0398cceb-6910-48fa-bfb1-f0727cf5f722","year":2026},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.734487Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:d9485d87319b7d0d7046ba3175c7fa5864ad3dead59aa34e8f22f78836d9c184","observation_id":"1ff31554-cb92-4038-98a2-64061ab87ccc","resolution":{"observed_at":"2026-08-15T14:55:57.219332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:57.204746Z","title":"The promises and perils of mining github,","venue":null,"work_id":"1c43f562-4494-4034-b1b7-005409d08d6e","year":2014},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.738248Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:68338c02f03f5d57129de380fcbe188c5a3a8122f406b6fb23f15ad13c4f3de5","observation_id":"936fbff5-9ebc-410a-aabd-7b63b1fad746","resolution":{"observed_at":"2026-08-15T14:55:57.208455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:55:56.713551Z","title":"Available: https://doi.org/10.1145/3533378","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-15T14:55:56.713551Z"},"links":{"citing_paper":"/paper/2608.03036"},"observation_digest":"sha256:f60a570951e93f74ebb3896c45a68bce251be8604ddc578e4ed66c49870ce36b","observation_id":"4c301483-5469-4739-af58-26596bd809f9","resolution":{"observed_at":"2026-08-15T14:55:56.713551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.03036","last_updated":"2026-08-04T02:33:16Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-16T05:34:24.767054Z","submitted_at":"2026-08-04T02:33:16Z","title":"LLM Serving in the Wild: An Empirical Study of Frameworks, Methods, and System Designs"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":4,"verified_fuzzy":46},"total_outbound_references":100},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 100 outbound references and 0 inbound Pith citation observations for arXiv:2608.03036."}