{"as_of":"2026-08-09T00:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e1083978e7d3c3c1a7245363adc2d0b3776ce2e34ea0b0e80e24ff6a4754a5c0","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:32:21.565332Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T19:23:10.356881Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:39:25.561444Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"cited_work":{"arxiv_id":"2502.07903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07903","snapshot_observed_at":"2026-07-04T02:39:25.561444Z","title":"Hexgen-2: Disaggregated generative inference of llms in heterogeneous environment","venue":null,"work_id":"e5cd6b0a-5cb4-46fa-96dd-da9963b4109c","year":2025},"citing_paper":{"arxiv_id":"2409.01143","last_updated":"2026-05-12T22:15:30Z","snapshot_observed_at":"2026-08-02T14:15:27.581253Z","submitted_at":"2024-09-02T10:27:47Z","title":"HexiScale: Facilitating Large Language Model Training over Heterogeneous Hardware","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-23T21:21:03.598124Z"},"links":{"cited_paper":"/paper/2502.07903","citing_paper":"/paper/2409.01143"},"observation_digest":"sha256:33d5b63a31ce38691256b699b4eb6864eb6427f73a6a73e074dee236ccab9b92","observation_id":"f6af0e65-dc06-4bd5-a5a4-4f94f0c43ad5","resolution":{"observed_at":"2026-05-23T21:23:27.647282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"cited_work":{"arxiv_id":"2502.07903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07903","snapshot_observed_at":"2026-07-04T02:39:25.561444Z","title":"Hexgen-2: Disaggregated generative inference of llms in heterogeneous environment","venue":null,"work_id":"e5cd6b0a-5cb4-46fa-96dd-da9963b4109c","year":2025},"citing_paper":{"arxiv_id":"2604.07144","last_updated":"2026-04-08T14:37:17Z","snapshot_observed_at":"2026-07-06T22:55:28.855291Z","submitted_at":"2026-04-08T14:37:17Z","title":"Autopoiesis: A Self-Evolving System Paradigm for LLM Serving Under Runtime Dynamics","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T17:30:40.021376Z"},"links":{"cited_paper":"/paper/2502.07903","citing_paper":"/paper/2604.07144"},"observation_digest":"sha256:1ee4989c782d5ead59fe1262485e1ab64bbb37dbe0cfb65e358f1e2963def6e3","observation_id":"36654a16-284c-4825-bb95-a5e3912bb6d8","resolution":{"observed_at":"2026-05-11T06:41:20.938460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"cited_work":{"arxiv_id":"2502.07903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07903","snapshot_observed_at":"2026-07-04T02:39:25.561444Z","title":"Hexgen-2: Disaggregated generative inference of llms in heterogeneous environment","venue":null,"work_id":"e5cd6b0a-5cb4-46fa-96dd-da9963b4109c","year":2025},"citing_paper":{"arxiv_id":"2604.10180","last_updated":"2026-07-09T07:28:08Z","snapshot_observed_at":"2026-07-12T23:17:28.794767Z","submitted_at":"2026-04-11T12:19:11Z","title":"Tessera: Unlocking Heterogeneous GPUs through Kernel-Granularity Disaggregation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-10T15:50:39.600498Z"},"links":{"cited_paper":"/paper/2502.07903","citing_paper":"/paper/2604.10180"},"observation_digest":"sha256:9b4a274136795c0c2e5bed604e046e6910ecb4632f7869e48435b401b3589c46","observation_id":"a48c718a-0f5e-43f4-81d0-06a71f91a7b1","resolution":{"observed_at":"2026-05-11T09:46:07.159142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"cited_work":{"arxiv_id":"2502.07903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07903","snapshot_observed_at":"2026-07-04T02:39:25.561444Z","title":"Hexgen-2: Disaggregated generative inference of llms in heterogeneous environment","venue":null,"work_id":"e5cd6b0a-5cb4-46fa-96dd-da9963b4109c","year":2025},"citing_paper":{"arxiv_id":"2605.07569","last_updated":"2026-05-08T10:41:04Z","snapshot_observed_at":"2026-07-06T23:19:56.415523Z","submitted_at":"2026-05-08T10:41:04Z","title":"HexiSeq: Accommodating Long Context Training of LLMs over Heterogeneous Hardware","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T03:00:19.355357Z"},"links":{"cited_paper":"/paper/2502.07903","citing_paper":"/paper/2605.07569"},"observation_digest":"sha256:88a3ece4be398791bd26215ecf99fcd40af853836e7dcf9a7a43a33241c9eaf1","observation_id":"794abd5e-649c-49c7-a89f-20efa4d69804","resolution":{"observed_at":"2026-05-11T03:00:55.538297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"cited_work":{"arxiv_id":"2502.07903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07903","snapshot_observed_at":"2026-07-04T02:39:25.561444Z","title":"Hexgen-2: Disaggregated generative inference of llms in heterogeneous environment","venue":null,"work_id":"e5cd6b0a-5cb4-46fa-96dd-da9963b4109c","year":2025},"citing_paper":{"arxiv_id":"2605.16637","last_updated":"2026-05-15T21:09:34Z","snapshot_observed_at":"2026-07-06T23:27:43.762904Z","submitted_at":"2026-05-15T21:09:34Z","title":"HexAGenT: Efficient Agentic LLM Serving via Workflow- and Heterogeneity-Aware Scheduling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T20:58:51.630574Z"},"links":{"cited_paper":"/paper/2502.07903","citing_paper":"/paper/2605.16637"},"observation_digest":"sha256:85199e944d30bd3bfcb17eb7971cc92f6c56179bf6e12eec383784318fa2336b","observation_id":"35c006a8-a506-458e-acef-ad8a7a1fe53c","resolution":{"observed_at":"2026-05-19T21:02:47.427981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"cited_work":{"arxiv_id":"2502.07903","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07903","snapshot_observed_at":"2026-07-04T02:39:25.561444Z","title":"Hexgen-2: Disaggregated generative inference of llms in heterogeneous environment","venue":null,"work_id":"e5cd6b0a-5cb4-46fa-96dd-da9963b4109c","year":2025},"citing_paper":{"arxiv_id":"2606.19271","last_updated":"2026-06-17T16:48:36Z","snapshot_observed_at":"2026-08-05T21:43:31.886249Z","submitted_at":"2026-06-17T16:48:36Z","title":"TurboServe: Serving Streaming Video Generation Efficiently and Economically","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T19:23:10.356881Z"},"links":{"cited_paper":"/paper/2502.07903","citing_paper":"/paper/2606.19271"},"observation_digest":"sha256:d9992ddfbaa5bfefd4aeac49d7642393a2977544e84b67eb9e2a9a4f2b5c386d","observation_id":"04200cc2-3edc-4b7c-8fa8-1a9f54813cec","resolution":{"observed_at":"2026-07-04T02:39:25.563163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07903/citation-record","integrity":"/paper/2502.07903/integrity","json":"/paper/2502.07903/citation-record.json","paper":"/paper/2502.07903"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.02310","last_updated":"2024-06-17T21:10:46Z","snapshot_observed_at":"2026-07-06T17:39:24.823145Z","submitted_at":"2024-03-04T18:47:08Z","title":"Taming Throughput-Latency Tradeoff in LLM Inference with Sarathi-Serve","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02310","snapshot_observed_at":"2026-08-08T11:32:21.500409Z","title":"Taming throughput-latency tradeoff in llm inference with sarathi-serve","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.500409Z"},"links":{"cited_paper":"/paper/2403.02310","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:bf04d45c275b51ff9fe67ad8fc3a6ecdadd568f2465073e33675ffe6cdc779bf","observation_id":"b5cefa72-6c65-47b6-9438-289231eddfde","resolution":{"observed_at":"2026-08-08T11:32:21.500409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00079","last_updated":"2025-09-03T14:56:29Z","snapshot_observed_at":"2026-08-07T12:08:57.217593Z","submitted_at":"2024-06-24T02:05:32Z","title":"Mooncake: A KVCache-centric Disaggregated Architecture for LLM Serving","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00079","snapshot_observed_at":"2026-08-08T11:32:21.534466Z","title":"Mooncake: Kimi’s kvcache-centric architecture for llm serving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.534466Z"},"links":{"cited_paper":"/paper/2407.00079","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:38069c6d972feb42d51f89a17a3e3d719a002ffe0a3ad3f26854790176c733b1","observation_id":"423abc3b-70e3-4084-8020-fa01aed8be71","resolution":{"observed_at":"2026-08-08T11:32:21.534466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-08T11:32:21.538918Z","title":"Gem- ini 1.5: Unlocking multimodal understanding across millions of tokens of context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.538918Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:c9edcd14a54f0794de0b11e334a0d88efda9f2ac202d20c04336734855b98684","observation_id":"79bed0e8-68bf-4c79-8f88-7801c21e777c","resolution":{"observed_at":"2026-08-08T11:32:21.538918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-08T11:32:21.544002Z","title":"Hugo Touvron, Louis Martin, Kevin Stone, Peter Albert, Amjad Almahairi, Yasmine Babaei, Niko- lay Bashlykov, Soumya Batra, Prajjwal Bhargava, Shruti Bhosale, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.544002Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:b7575c0f3774c2ae98ab781a65fda69419615c314f182b1e22683e968ba49b59","observation_id":"4fd71096-76f5-4be3-a0b4-44301976be9d","resolution":{"observed_at":"2026-08-08T11:32:21.544002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:32:21.554868Z","title":"Jintao Zhang, Jia Wei, Pengle Zhang, Jun Zhu, and Jianfei Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.554868Z"},"links":{"citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:b95b84e3c8b6675275e38b7a7ba051c991b73a3595a4e51ca92e81580ee4c8e9","observation_id":"87f543d8-c790-49e1-ba96-7c5c0d3bdf2a","resolution":{"observed_at":"2026-08-08T11:32:21.554868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01136","last_updated":"2024-03-02T08:40:07Z","snapshot_observed_at":"2026-08-05T08:03:09.194343Z","submitted_at":"2024-03-02T08:40:07Z","title":"LLM-PQ: Serving LLM on Heterogeneous Clusters with Phase-Aware Partition and Adaptive Quantization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01136","snapshot_observed_at":"2026-08-08T11:32:21.559881Z","title":"Llm-pq: Serving llm on heterogeneous clusters with phase-aware partition and adaptive quantization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.559881Z"},"links":{"cited_paper":"/paper/2403.01136","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:0593449db0e95c71cc1bdc3b1ada4a71aa436d1f5eb274d413f65b21b3a4edad","observation_id":"f3a00386-2e4a-4270-b859-6f0331b02722","resolution":{"observed_at":"2026-08-08T11:32:21.559881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:32:21.975482Z","title":"{PetS}: A unified framework for {Parameter-Efficient} transformers serving","venue":null,"work_id":"7db72647-811f-41ae-ac01-349254a5a174","year":2022},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.565332Z"},"links":{"citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:ace388c1a2701b3e9dee38206de2af5ef87159b3f6fabf12a0b61918d082df76","observation_id":"2cd526f8-3ccf-484c-8d4e-4e9859f2fc5c","resolution":{"observed_at":"2026-08-08T11:32:21.981265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05920","last_updated":"2024-09-25T05:57:51Z","snapshot_observed_at":"2026-07-06T15:25:24.491136Z","submitted_at":"2023-05-10T06:17:50Z","title":"Fast Distributed Inference Serving for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05920","snapshot_observed_at":"2026-08-08T11:32:21.550145Z","title":"Fast distributed inference serving for large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":1994,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.550145Z"},"links":{"cited_paper":"/paper/2305.05920","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:609ea4f7e8af18b89b8ccf954862133fdec7a1d10bb6fc7d0c6e23cc46299f92","observation_id":"2285e570-6cee-4516-8a86-235903b03ff1","resolution":{"observed_at":"2026-08-08T11:32:21.550145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11181","last_updated":"2024-01-20T09:43:36Z","snapshot_observed_at":"2026-08-05T23:35:16.350557Z","submitted_at":"2024-01-20T09:43:36Z","title":"Inference without Interference: Disaggregate LLM Inference for Mixed Downstream Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11181","snapshot_observed_at":"2026-08-08T11:32:21.510038Z","title":"Inference without interference: Disaggregate llm inference for mixed downstream workloads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.510038Z"},"links":{"cited_paper":"/paper/2401.11181","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:2fd50d82ba99feebff6bef2b970f8729b8a68b843ea336358b563548a417ceb4","observation_id":"24f5124e-0c28-4768-96ea-f48d73ec1a13","resolution":{"observed_at":"2026-08-08T11:32:21.510038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-08T11:32:21.514573Z","title":"Mixtral of experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.514573Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:bbbeef2fa36adecff65ea9e7ccb77ac769c4b370fbd193b78756ae8b485aa336","observation_id":"f871e621-bd67-44ef-8d0c-a1b5ae884e5e","resolution":{"observed_at":"2026-08-08T11:32:21.514573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14527","last_updated":"2024-07-22T10:56:19Z","snapshot_observed_at":"2026-07-06T18:04:00.217896Z","submitted_at":"2024-04-22T18:56:18Z","title":"M\\'elange: Cost Efficient Large Language Model Serving by Exploiting GPU Heterogeneity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14527","snapshot_observed_at":"2026-08-08T11:32:21.505463Z","title":"M \\’elange: Cost efficient large language model serving by exploiting gpu heterogeneity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.505463Z"},"links":{"cited_paper":"/paper/2404.14527","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:79ee5dc45874ccd13dff51ee39339b7094061873c31080d5b510c455219f2046","observation_id":"a53e3198-57e8-440d-903e-54aa16bc353f","resolution":{"observed_at":"2026-08-08T11:32:21.505463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01566","last_updated":"2025-03-05T20:00:57Z","snapshot_observed_at":"2026-08-01T21:33:05.315458Z","submitted_at":"2024-06-03T17:47:53Z","title":"Helix: Serving Large Language Models over Heterogeneous GPUs and Network via Max-Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01566","snapshot_observed_at":"2026-08-08T11:32:21.524538Z","title":"Helix: Distributed serving of large language models via max-flow on heterogeneous gpus","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.524538Z"},"links":{"cited_paper":"/paper/2406.01566","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:7d81c7fc6160fa8048c964fc90ae5fb2f29d66884a2a7d13da6b83243a0a5a76","observation_id":"3200e3ad-3931-4619-a58f-92ab2c9c5492","resolution":{"observed_at":"2026-08-08T11:32:21.524538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:32:21.990925Z","title":"12 Pratyush Patel, Esha Choukse, Chaojie Zhang, Aashaka Shah, ´I˜nigo Goiri, Saeed Maleki, and Ri- cardo Bianchini","venue":null,"work_id":"fe4a67f2-bc87-4223-8a83-1a55ea745ff3","year":2024},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.530161Z"},"links":{"citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:78068f6827ce877ba19586a9e537522a70d53429a667b181bf6168207cadb8cb","observation_id":"fed70cf4-1107-4109-992e-f6b781c62f4b","resolution":{"observed_at":"2026-08-08T11:32:21.994984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08147","last_updated":"2024-08-15T13:32:25Z","snapshot_observed_at":"2026-07-06T19:01:06.124684Z","submitted_at":"2024-08-15T13:32:25Z","title":"P/D-Serve: Serving Disaggregated Large Language Model at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08147","snapshot_observed_at":"2026-08-08T11:32:21.519527Z","title":"P/d-serve: Serving disaggregated large language model at scale","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-08T11:32:21.519527Z"},"links":{"cited_paper":"/paper/2408.08147","citing_paper":"/paper/2502.07903"},"observation_digest":"sha256:181a2ac4e63cf15ba143696adef00acf37f21f0dc38ea05732628621100eb91f","observation_id":"9669077d-a821-4144-b871-35e595bbefee","resolution":{"observed_at":"2026-08-08T11:32:21.519527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07903","last_updated":"2025-02-11T19:17:35Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-08T11:25:21.209697Z","submitted_at":"2025-02-11T19:17:35Z","title":"HexGen-2: Disaggregated Generative Inference of LLMs in Heterogeneous Environment"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 6 inbound Pith citation observations for arXiv:2502.07903."}