{"as_of":"2026-08-11T09:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dba3591972374fdbd90666984e61ff5a64a04186689f7d8348d5d015c2a8a995","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:35:13.172282Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T06:58:36.525442Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"cited_work":{"arxiv_id":"2501.08090","doi":"10.48550/arxiv.2501.08090","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08090","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HIERARCHICAL AUTOSCALING FOR LARGE LANGUAGE MODEL SERVING WITH CHI- RON","venue":"ArXiv.org","work_id":"db4efd20-2be1-44f3-a5c4-a7f703a0255a","year":2025},"citing_paper":{"arxiv_id":"2604.16682","last_updated":"2026-04-17T20:39:25Z","snapshot_observed_at":"2026-08-11T08:29:06.896911Z","submitted_at":"2026-04-17T20:39:25Z","title":"KAIROS: Stateful, Context-Aware Power-Efficient Agentic Inference Serving","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T06:58:36.525442Z"},"links":{"cited_paper":"/paper/2501.08090","citing_paper":"/paper/2604.16682"},"observation_digest":"sha256:4bb5796f32cde64f82d3848910e128668ed38a637c9664363d1cf1acfe0b2f1a","observation_id":"0854c67d-f439-43bb-9bae-802e001f6533","resolution":{"observed_at":"2026-05-10T07:01:48.829960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"cited_work":{"arxiv_id":"2501.08090","doi":"10.48550/arxiv.2501.08090","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08090","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HIERARCHICAL AUTOSCALING FOR LARGE LANGUAGE MODEL SERVING WITH CHI- RON","venue":"ArXiv.org","work_id":"db4efd20-2be1-44f3-a5c4-a7f703a0255a","year":2025},"citing_paper":{"arxiv_id":"2605.05467","last_updated":"2026-05-06T21:42:55Z","snapshot_observed_at":"2026-08-10T23:58:54.590895Z","submitted_at":"2026-05-06T21:42:55Z","title":"Nitsum: Serving Tiered LLM Requests with Adaptive Tensor Parallelism","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T15:45:54.816102Z"},"links":{"cited_paper":"/paper/2501.08090","citing_paper":"/paper/2605.05467"},"observation_digest":"sha256:f057a2847b6d51e5b6ef2190590648a50ee5ed67c92441a5a51340d9269c838b","observation_id":"fae924ce-7013-48dd-8105-37e30f77fd6b","resolution":{"observed_at":"2026-05-11T18:31:11.971214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.08090/citation-record","integrity":"/paper/2501.08090/integrity","json":"/paper/2501.08090/citation-record.json","paper":"/paper/2501.08090"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.01869","last_updated":"2024-05-30T04:18:03Z","snapshot_observed_at":"2026-07-06T17:24:37.090243Z","submitted_at":"2024-02-02T19:47:57Z","title":"InferCept: Efficient Intercept Support for Augmented Large Language Model Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01869","snapshot_observed_at":"2026-08-10T20:35:13.085003Z","title":"APIServe: Efficient API support for large-language model inferencing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.085003Z"},"links":{"cited_paper":"/paper/2402.01869","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:977a50fd3366e258d379d323ac7108fe48e2dee9fba854f58eaeafd713d5f5be","observation_id":"206c5431-b95c-4ede-8227-e8da88232496","resolution":{"observed_at":"2026-08-10T20:35:13.085003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.488532Z","title":"Serving DNNs like clockwork: Performance predictabil- ity from the bottom up","venue":null,"work_id":"821bbdc6-618e-4233-b13d-773deae9d1c0","year":2020},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.102942Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:9986b278a216c6182d24c37deb2dbd14971077fc80afc086a75c5ad8ad168779","observation_id":"d5e75acf-bb5a-46a9-8707-fb3959a0be9e","resolution":{"observed_at":"2026-08-10T20:35:13.492331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.475614Z","title":"Cocktail: A multidi- mensional optimization for model serving in cloud","venue":null,"work_id":"5d7c667a-f7a8-43c1-b3e4-cbe53bf21e77","year":2022},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.107717Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:9eeb9db3b76ee9ae27674b81064207728ffef7c7a266ae9b783cda3aecc6e21a","observation_id":"7ccdaa54-cfcd-4b7e-9651-61be46751b82","resolution":{"observed_at":"2026-08-10T20:35:13.480608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16283","last_updated":"2024-12-13T07:01:16Z","snapshot_observed_at":"2026-08-07T14:36:50.079243Z","submitted_at":"2024-04-25T01:56:00Z","title":"Andes: Defining and Enhancing Quality-of-Experience in LLM-Based Text Streaming Services","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16283","snapshot_observed_at":"2026-08-10T20:35:13.116727Z","title":"Jiachen Liu, Zhiyu Wu, Jae-Won Chung, Fan Lai, Myungjin Lee, and Mosharaf Chowdhury","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.116727Z"},"links":{"cited_paper":"/paper/2404.16283","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:3bd952fcb90b452c0047faaa638b8f93772b5606e93c176991a5206cd9e5df05","observation_id":"95b21701-e3b7-400b-aa3b-8ad94a975b98","resolution":{"observed_at":"2026-08-10T20:35:13.116727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00047","last_updated":"2025-02-25T17:54:13Z","snapshot_observed_at":"2026-07-06T18:38:38.104034Z","submitted_at":"2024-06-05T21:17:34Z","title":"Queue management for slo-oriented large language model serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00047","snapshot_observed_at":"2026-08-10T20:35:13.130836Z","title":"One queue is all you need: Resolving head- of-line blocking in large language model serving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.130836Z"},"links":{"cited_paper":"/paper/2407.00047","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:bea4153ec5abac8f748edf8b9bc0bd122aacc4583e15e1205a4eabee6bfe7455","observation_id":"2ff84f9a-3174-4556-b5be-b792d0ffeb26","resolution":{"observed_at":"2026-08-10T20:35:13.130836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.440238Z","title":"FIRM: An intel- ligent fine-grained resource management framework for SLO-oriented microservices","venue":null,"work_id":"338a85dc-1572-4957-9328-cb31d1d67f71","year":2020},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.135534Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:b6c4abcb7090c984b24530f1e8f0816833d37d46214adb6d4bd0f069da2d6cf4","observation_id":"f2895897-a03b-444b-a9fc-4c31be18d0fd","resolution":{"observed_at":"2026-08-10T20:35:13.444865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.427920Z","title":"INFaaS: Automated model-less in- ference serving","venue":null,"work_id":"9115cddf-800b-4ca7-82ad-29b18aa56fcd","year":2021},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.139937Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:f4bb91226c4e26487c856f82191e7798a2369e63cce14efe4b6fbdd6d7176eab","observation_id":"c01c5857-4115-4984-9274-a10cf4a5d9f5","resolution":{"observed_at":"2026-08-10T20:35:13.432079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03243","last_updated":"2024-06-05T13:20:18Z","snapshot_observed_at":"2026-08-10T08:10:14.738489Z","submitted_at":"2024-06-05T13:20:18Z","title":"Llumnix: Dynamic Scheduling for Large Language Model Serving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03243","snapshot_observed_at":"2026-08-10T20:35:13.144196Z","title":"Ying Sheng, Shiyi Cao, Dacheng Li, Coleman Hooper, Nicholas Lee, Shuo Yang, Christopher Chou, Banghua Zhu, Lianmin Zheng, Kurt Keutzer, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.144196Z"},"links":{"cited_paper":"/paper/2406.03243","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:78aa638a352c82f26b06386ce96593473043b69174208a70b07265937d19161d","observation_id":"61a8e9f1-e8e6-413d-97f5-cec861972ef5","resolution":{"observed_at":"2026-08-10T20:35:13.144196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.415917Z","title":null,"venue":null,"work_id":"92ab79f3-6df7-4283-b82b-4683f27fa91f","year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.148624Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:8e8a0d246ee5ecf4d30746440b47401605806f184b753001e768fb148997fbe7","observation_id":"9a0d30f1-e83f-427a-91eb-4a700205ef6b","resolution":{"observed_at":"2026-08-10T20:35:13.420114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T20:35:13.153146Z","title":"Hugo Touvron, Thibaut Lavril, Gautier Izacard, Xavier Martinet, Marie-Anne Lachaux, Timoth´ee Lacroix, Bap- tiste Rozi`ere, Naman Goyal, Eric Hambro, Faisal Azhar, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.153146Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:d53db2dee983674eea2da4f8a4ddacafb87d0ac550a62abe3f694918754c5745","observation_id":"22d56eaf-9306-4611-9a48-5b3f75555985","resolution":{"observed_at":"2026-08-10T20:35:13.153146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.402088Z","title":"Yuxin Wang, Yuhan Chen, Zeyu Li, Zhenheng Tang, Rui Guo, Xin Wang, Qiang Wang, Amelie Chi Zhou, and Xi- aowen Chu","venue":null,"work_id":"edb39283-3a54-409b-9e1a-1d921854b178","year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.157148Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:79925b8f64d7c18db069e31590b7596ec8884b42da7314432be995e7bb40032d","observation_id":"579cba31-9e2e-4911-80ee-585c62ec7d67","resolution":{"observed_at":"2026-08-10T20:35:13.406838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05920","last_updated":"2024-09-25T05:57:51Z","snapshot_observed_at":"2026-08-09T14:08:47.340904Z","submitted_at":"2023-05-10T06:17:50Z","title":"Fast Distributed Inference Serving for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05920","snapshot_observed_at":"2026-08-10T20:35:13.160613Z","title":"Fast distributed infer- ence serving for large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.160613Z"},"links":{"cited_paper":"/paper/2305.05920","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:e1233046f978317227c40839ba7c94dfd9c45244c4b48020cde9aa8000372d62","observation_id":"ed95b696-47ca-460a-af24-20c9020f173b","resolution":{"observed_at":"2026-08-10T20:35:13.160613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.377116Z","title":"MArk: Exploiting cloud services for cost-effective, SLO-aware machine learning inference serving","venue":null,"work_id":"e4d4eca1-3053-4352-a03c-0216b2844525","year":2019},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.168707Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:a8dbfaa45e3ac154e303ff42db1c4a6912a4312411099ed33697df096271db95","observation_id":"32e29fd0-6499-4b1a-89ec-b3ccdc6344fa","resolution":{"observed_at":"2026-08-10T20:35:13.381763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15566","last_updated":"2023-11-27T06:31:17Z","snapshot_observed_at":"2026-07-06T16:52:53.954856Z","submitted_at":"2023-11-27T06:31:17Z","title":"SpotServe: Serving Generative Large Language Models on Preemptible Instances","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15566","snapshot_observed_at":"2026-08-10T20:35:13.120818Z","title":"SpotServe: Serv- ing generative large language models on preemptible in- stances","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":1967,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.120818Z"},"links":{"cited_paper":"/paper/2311.15566","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:8b2cb371a3147c1830bc6fd6c6353407ae2431a6b520b9aefcc78f68947e6bf6","observation_id":"2255268d-2f2a-4b0c-9bf2-c152436d7af7","resolution":{"observed_at":"2026-08-10T20:35:13.120818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.500293Z","title":"Clipper: A low-latency online prediction serving system","venue":null,"work_id":"15d93da8-dc5c-4831-a48e-e423c35e97a2","year":2017},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2005,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.093941Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:040b50408b7d9d46b38e7a85d56fe9a8ba7f7afa3797dc2c5d090383f35e7cd2","observation_id":"34e29414-9d8a-4a57-b0e9-760d64184849","resolution":{"observed_at":"2026-08-10T20:35:13.504719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.465349Z","title":"Efficient memory management for large language model serving with PagedAttention","venue":null,"work_id":"c45fc169-1e98-459d-a344-3ec7acb87852","year":2023},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.112566Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:6d9e089c4893359398e9ea415d8f14102dd1ab0b84ad6db32b88f101bec93b46","observation_id":"ef95858c-9031-48ab-ac43-26165ecd9874","resolution":{"observed_at":"2026-08-10T20:35:13.468933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.363244Z","title":"Shepherd: Serving DNNs in the wild","venue":null,"work_id":"076a3790-d2d5-4251-acfb-35bb24f23984","year":2023},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.172282Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:892ef4d35c35d70d041d4b649297586db039e6d21a98cc625fcf73c2d6796fe9","observation_id":"21c8c925-2b41-4c93-8bb2-912251937640","resolution":{"observed_at":"2026-08-10T20:35:13.369586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.098878Z","title":"ISBN 9781450381376","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.098878Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:0d89e31501bfac49825b4cb925069e64f46288bc1835fd86630bc42fcf9428ca","observation_id":"1fc7497b-214c-4343-8e33-f0e38ee16cc5","resolution":{"observed_at":"2026-08-10T20:35:13.098878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.389320Z","title":"The shift from models to compound AI systems","venue":null,"work_id":"9798845d-6cc2-4c47-849f-58ebc3929150","year":2024},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.164815Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:c2f3ccd448f965334577b3b7365aeb94b55afca24975fc35ae5681c5ffeeaf64","observation_id":"5b00cca3-4aef-42f9-a5b8-b7fbc0a0eee8","resolution":{"observed_at":"2026-08-10T20:35:13.393173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:35:13.454032Z","title":"TensorFlow-Serving: Flexible, high-performance ML serving","venue":null,"work_id":"1200642c-60b1-4343-b990-d2a55f5208d8","year":2017},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.127198Z"},"links":{"citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:924fd727e84ea356437a4772f4a5338d3191ecef0f6f6ddf11b423a1aa37f856","observation_id":"1b874990-aab1-4bc3-afed-a9cff19af95f","resolution":{"observed_at":"2026-08-10T20:35:13.458000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-10T20:35:13.089909Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T20:35:13.089909Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2501.08090"},"observation_digest":"sha256:d4461937c440df0052065270d31fc426fae64b07e1cd0f4cfce67105cfb62e0f","observation_id":"6d303f27-b015-494d-b5ba-b1a888838a6b","resolution":{"observed_at":"2026-08-10T20:35:13.089909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.08090","last_updated":"2025-01-14T12:57:40Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-10T20:27:14.594664Z","submitted_at":"2025-01-14T12:57:40Z","title":"Hierarchical Autoscaling for Large Language Model Serving with Chiron"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 2 inbound Pith citation observations for arXiv:2501.08090."}