{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:QXG4QFRYSEF3Y2QNWB7XIDTC5R","short_pith_number":"pith:QXG4QFRY","schema_version":"1.0","canonical_sha256":"85cdc81638910bbc6a0db07f740e62ec529027b4d79d5ad9c24d8dd569137715","source":{"kind":"arxiv","id":"2505.09319","version":1},"attestation_state":"computed","paper":{"title":"Statistical Modeling and Uncertainty Estimation of LLM Inference Systems","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.PF","authors_text":"Bruno Wassermann, Dean H. Lorenz, Kaustabha Ray, Nelson Mimura Gonzalez, Rachel Tzoref-Brill","submitted_at":"2025-05-14T12:16:40Z","abstract_excerpt":"Large Language Model (LLM) inference systems present significant challenges in statistical performance characterization due to dynamic workload variations, diverse hardware architectures, and complex interactions between model size, batch processing, and throughput requirements. Accurate statistical characterization enables better workload scheduling, adaptive resource provisioning, and cost-aware inference optimization, making it crucial for improving efficiency in large-scale AI deployments. Traditional analytical models provide explainability but cannot cover the vast diversity of real-worl"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2505.09319","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.PF","submitted_at":"2025-05-14T12:16:40Z","cross_cats_sorted":[],"title_canon_sha256":"ea2affb512d41662ed411d80be84aeb50f5d3ce464fef88670471c90abd3ef2a","abstract_canon_sha256":"c7329d7b1a583f1862776b3bc20011a0c16c5cd8f7199a971a49dde36089fb77"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:03:06.315793Z","signature_b64":"3TGiM4irqJDJsnRNBTQtXoabC8yndoCSEC57r7MkqOORA9zSKCgz0la6v3CxgbyZ12fs1qZKGrvPRVmpvlJlBw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"85cdc81638910bbc6a0db07f740e62ec529027b4d79d5ad9c24d8dd569137715","last_reissued_at":"2026-07-05T11:03:06.315270Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:03:06.315270Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Statistical Modeling and Uncertainty Estimation of LLM Inference Systems","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.PF","authors_text":"Bruno Wassermann, Dean H. Lorenz, Kaustabha Ray, Nelson Mimura Gonzalez, Rachel Tzoref-Brill","submitted_at":"2025-05-14T12:16:40Z","abstract_excerpt":"Large Language Model (LLM) inference systems present significant challenges in statistical performance characterization due to dynamic workload variations, diverse hardware architectures, and complex interactions between model size, batch processing, and throughput requirements. Accurate statistical characterization enables better workload scheduling, adaptive resource provisioning, and cost-aware inference optimization, making it crucial for improving efficiency in large-scale AI deployments. Traditional analytical models provide explainability but cannot cover the vast diversity of real-worl"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2505.09319","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2505.09319/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2505.09319","created_at":"2026-07-05T11:03:06.315348+00:00"},{"alias_kind":"arxiv_version","alias_value":"2505.09319v1","created_at":"2026-07-05T11:03:06.315348+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2505.09319","created_at":"2026-07-05T11:03:06.315348+00:00"},{"alias_kind":"pith_short_12","alias_value":"QXG4QFRYSEF3","created_at":"2026-07-05T11:03:06.315348+00:00"},{"alias_kind":"pith_short_16","alias_value":"QXG4QFRYSEF3Y2QN","created_at":"2026-07-05T11:03:06.315348+00:00"},{"alias_kind":"pith_short_8","alias_value":"QXG4QFRY","created_at":"2026-07-05T11:03:06.315348+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R","json":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R.json","graph_json":"https://pith.science/api/pith-number/QXG4QFRYSEF3Y2QNWB7XIDTC5R/graph.json","events_json":"https://pith.science/api/pith-number/QXG4QFRYSEF3Y2QNWB7XIDTC5R/events.json","paper":"https://pith.science/paper/QXG4QFRY"},"agent_actions":{"view_html":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R","download_json":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R.json","view_paper":"https://pith.science/paper/QXG4QFRY","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2505.09319&json=true","fetch_graph":"https://pith.science/api/pith-number/QXG4QFRYSEF3Y2QNWB7XIDTC5R/graph.json","fetch_events":"https://pith.science/api/pith-number/QXG4QFRYSEF3Y2QNWB7XIDTC5R/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R/action/timestamp_anchor","attest_storage":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R/action/storage_attestation","attest_author":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R/action/author_attestation","sign_citation":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R/action/citation_signature","submit_replication":"https://pith.science/pith/QXG4QFRYSEF3Y2QNWB7XIDTC5R/action/replication_record"}},"created_at":"2026-07-05T11:03:06.315348+00:00","updated_at":"2026-07-05T11:03:06.315348+00:00"}