{"as_of":"2026-08-22T10:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4ecc7b3293b51a8112a68996688891c6ac3677c07be09182e744e6a68ba31f95","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:14:22.749975Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:34:35.546299Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T19:25:31.164622Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"cited_work":{"arxiv_id":"2507.14392","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14392","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7bec2a36-9b63-4e12-bbe3-adb88bebb6fb","year":null},"citing_paper":{"arxiv_id":"2511.09557","last_updated":"2026-05-20T17:50:51Z","snapshot_observed_at":"2026-08-08T17:02:49.917616Z","submitted_at":"2025-11-12T18:59:26Z","title":"Understanding and Improving Communication Performance in Multi-node LLM Inference","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T19:24:34.459446Z"},"links":{"cited_paper":"/paper/2507.14392","citing_paper":"/paper/2511.09557"},"observation_digest":"sha256:1395f3ffcba8a8770879346f587e128e3b77114278efb47a82f6a0ec89b79067","observation_id":"d649301e-62ca-41af-bccd-8ab53678fa17","resolution":{"observed_at":"2026-05-21T19:25:31.166510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.14392","snapshot_observed_at":"2026-08-14T04:34:35.546299Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08611","last_updated":"2026-08-09T09:49:40Z","snapshot_observed_at":"2026-08-18T00:51:29.769969Z","submitted_at":"2026-08-09T09:49:40Z","title":"C2C-Explorer: An Exploration Framework for Chip-to-Chip Interconnect Architectures in LLM Cloud Computing Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:34:35.546299Z"},"links":{"cited_paper":"/paper/2507.14392","citing_paper":"/paper/2608.08611"},"observation_digest":"sha256:086faf08bcf45d3962fa6fa1180b6ddb221be7d0c52dc0b47a35b06c63d3395d","observation_id":"a11c5779-1500-4ce1-b256-9c3d2477a22c","resolution":{"observed_at":"2026-08-14T04:34:35.546299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14392/citation-record","integrity":"/paper/2507.14392/integrity","json":"/paper/2507.14392/citation-record.json","paper":"/paper/2507.14392"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T16:14:20.245558Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.245558Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:fa4d9892c3bd92d0bbee444a3eb7b883eb999ff2123008b588d9f78e2057b047","observation_id":"f7f6f7e4-9ee7-4650-9f79-c075fda31072","resolution":{"observed_at":"2026-08-06T16:14:20.245558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:26.067191Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"a3988841-0813-448b-b1aa-d73865e1f2d1","year":null},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.287481Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:3611ba4481c13f2e61f7f0b67b8438ded7326fd73b1ef10227aaa498164d076e","observation_id":"c0c5e37e-36e5-4e85-8b19-282596ea2fb7","resolution":{"observed_at":"2026-08-06T16:14:26.105224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:25.863391Z","title":"GPT-4 Technical Report,","venue":null,"work_id":"02485eaa-56f4-4842-bf8c-24de8542f4c4","year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.335679Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:3376c3f67fe212a3e69f2a6d1d8a9407be8f849847904cb6e6e35c9645ed8281","observation_id":"898989ce-65f5-4ddb-bcf9-5c3e7e650b35","resolution":{"observed_at":"2026-08-06T16:14:25.965133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-06T16:14:20.382826Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.382826Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:d3a1aba8f11d4dc23668a2b285b18e44092e26f64e9d22fe333b6b467509e95d","observation_id":"27d8bde2-d49f-4812-850e-d17b5404749f","resolution":{"observed_at":"2026-08-06T16:14:20.382826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24235","last_updated":"2025-05-04T15:48:08Z","snapshot_observed_at":"2026-08-20T06:16:23.875749Z","submitted_at":"2025-03-31T15:46:15Z","title":"A Survey on Test-Time Scaling in Large Language Models: What, How, Where, and How Well?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24235","snapshot_observed_at":"2026-08-06T16:14:20.447921Z","title":"A survey on test-time scaling in large language models: What, how, where, and how well?","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.447921Z"},"links":{"cited_paper":"/paper/2503.24235","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:94d33304b54dd1fa73cd741dfe0f2cbf86c02a6c3f8efe0d4288b457a9fe899c","observation_id":"c4cb8a95-8abc-48c5-8e85-1c29b7e8435b","resolution":{"observed_at":"2026-08-06T16:14:20.447921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T16:14:20.590854Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.590854Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:7f7e4a556ed9fea605c5e0d639a35ffe3114d059799f6b4862b17ede69676b10","observation_id":"03030386-c598-4799-b07a-eb9f12089f0a","resolution":{"observed_at":"2026-08-06T16:14:20.590854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-08-19T11:46:55.171293Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T16:14:20.608396Z","title":"Openai o1 system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.608396Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:ac99f9991cce86e06c40da7566dc5a5dc8528e7e8f67e40bb37410b95dd674ef","observation_id":"c34bfb05-6296-4239-8975-0a0b0aa6423d","resolution":{"observed_at":"2026-08-06T16:14:20.608396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:25.726968Z","title":"Gemini 2.5: Our most intelligent AI model,","venue":null,"work_id":"a793fe96-de49-4c7f-bce1-26bbeefe6ae6","year":2025},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.655747Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:f823a247d3ae14fd721da7834ff3b936aee9959a1f794ea7425d3507b5003b20","observation_id":"c5b1c772-17ab-4f31-9007-07f811b2aac8","resolution":{"observed_at":"2026-08-06T16:14:25.795760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-06T16:14:20.720354Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.720354Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:00ad2632a046993d48ef832439273494b6e33c2d1b196c02ef4ad7ee03f834fd","observation_id":"b333776e-13d3-4eba-a190-ef04acb32e40","resolution":{"observed_at":"2026-08-06T16:14:20.720354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:25.553611Z","title":"Demystifying the communication characteristics for distributed transformer models,","venue":null,"work_id":"2b2ead62-4c15-4059-9e5f-db8893d986c2","year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:20.785791Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:54a00eca54f31e58edb7bd58b6e8e2104279dbd57140111a91618edfb0b162bb","observation_id":"845e3374-414d-47cd-b33a-9f5e5c42641e","resolution":{"observed_at":"2026-08-06T16:14:25.623647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-06T16:14:21.055631Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.055631Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:ff88e07719c5b0e5a86dc6ff0c70260805657faf91aa94c25ebd1043f5a9db13","observation_id":"3debe541-997b-460e-9697-166d699269ca","resolution":{"observed_at":"2026-08-06T16:14:21.055631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-06T16:14:21.167584Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models using GPU Model Parallelism,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.167584Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:d5d3e355d54866c0985173d1f8b93a184b111a3ac1673a42242359f3e932957b","observation_id":"b5ae1b48-232b-4652-a54b-0d6975bfcae3","resolution":{"observed_at":"2026-08-06T16:14:21.167584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:25.265544Z","title":"GPipe: Efficient Training of Giant Neural Networks using Pipeline Parallelism,","venue":null,"work_id":"ed1cafaa-d704-458f-8234-274770b841d4","year":2019},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.222246Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:fb14960539dad2e0e8adbb91899413212d8ab5764ad1c890bc8fff6f9c5e3583","observation_id":"242a8cbc-fd82-4444-8051-22ccef1a81e0","resolution":{"observed_at":"2026-08-06T16:14:25.331733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:25.029572Z","title":"NCCL Test Performance Measure- ment Guide,","venue":null,"work_id":"4a4ed577-2ed8-47a7-8116-a75c18b31740","year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.281480Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:5afad3e88011215d249e1ffac8aaf6ed104f4e33b1f231361dec455f3be5cfa5","observation_id":"8af64244-a685-45ea-a63d-a93f03303454","resolution":{"observed_at":"2026-08-06T16:14:25.157754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6347.31463","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:23.053330Z","title":"An In-depth Performance Characterization of CPU- and GPU-based DNN Training on Modern Architectures,","venue":null,"work_id":"9a8d71a9-57ff-4b4a-99c8-b8fe612bff28","year":2017},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.441415Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:73d3498086706af126f8f0a96c063eb48fca55b306118cbbc105de8ba8da78f9","observation_id":"daf7e9f3-996b-4732-a0ea-e640103098fa","resolution":{"observed_at":"2026-08-06T16:14:23.153240Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:24.839855Z","title":"Performance Characterization of DNN Training using TensorFlow and PyTorch on Modern Clusters,","venue":null,"work_id":"2f24addc-0bb0-4696-b115-4464be47e89a","year":2019},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.543405Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:52b01e85dcb301ef47f1cbe9d041be3f8ded266bcc1abc42360ff0311134e791","observation_id":"482e231a-eb75-4407-a0be-b604861d9f41","resolution":{"observed_at":"2026-08-06T16:14:24.953590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:24.592200Z","title":"Scalable Distributed DNN Training using TensorFlow and CUDA-Aware MPI: Characterization, Designs, and Performance Evaluation,","venue":null,"work_id":"a9b70b61-be82-4716-9216-895a7ad838ae","year":2019},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.633853Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:88b071b92fbc42661920fd85be3c7b5366bb87011be76b20825be5078a6ae5a5","observation_id":"dfb4f6fb-d07d-4ed2-acc4-bbbd519c443d","resolution":{"observed_at":"2026-08-06T16:14:24.698379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:24.340046Z","title":"Comparative Study of Large Language Model Architectures on Frontier ,","venue":null,"work_id":"5f7fcc6f-63ea-41b4-b0cc-5c80e7e0bcb9","year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.773804Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:3957d8661a6bcc2b3d22515036e8f4387ccc3ac6bcff8f0f6731942e898ac68a","observation_id":"d4e483c4-8f3b-4ea7-be31-ed4979f56158","resolution":{"observed_at":"2026-08-06T16:14:24.473029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:24.118069Z","title":"Characterization of Large Language Model Development in the Datacenter,","venue":null,"work_id":"10421d8a-0cf5-48da-8877-19581a8faf16","year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:21.877748Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:828d57b52d72b227f913d09db01b546b22d6960609c38a861324e07543c4e8f9","observation_id":"b68e47cb-fcd8-4149-8c10-ea5aa4f93914","resolution":{"observed_at":"2026-08-06T16:14:24.228109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10197","last_updated":"2024-08-19T17:54:29Z","snapshot_observed_at":"2026-08-16T13:25:26.190917Z","submitted_at":"2024-08-19T17:54:29Z","title":"Demystifying the Communication Characteristics for Distributed Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10197","snapshot_observed_at":"2026-08-06T16:14:22.052155Z","title":"Demystifying the communication characteristics for distributed transformer models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.052155Z"},"links":{"cited_paper":"/paper/2408.10197","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:4b41da325ef5b8c426dbe3fa9d2b738ff872607e1b4e27fc0b3a790f5570da45","observation_id":"2f7cb0fb-29f3-41d6-b638-0edf2f867004","resolution":{"observed_at":"2026-08-06T16:14:22.052155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:23.955707Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":"1c968836-adb4-45bc-be91-4055d40a6689","year":2023},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.118860Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:6477c18c30182e07e2aa4a986ce43b5f1f6bd1f4e97e833620b84c4adf605252","observation_id":"d4d275a9-d7ad-4fde-87e6-5fc5e6a13512","resolution":{"observed_at":"2026-08-06T16:14:24.043171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:23.753113Z","title":"Deepspeed inference: Enabling efficient inference of transformer models at unprecedented scale,","venue":null,"work_id":"765a5f94-e971-4d0a-a058-e33fe2257197","year":2022},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.253090Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:c2fd4b7711954ba73d569277b27536c29b4b1a576739ffdf4d2560fa147c11ed","observation_id":"4d04d49b-f238-49a7-b758-7743138205b5","resolution":{"observed_at":"2026-08-06T16:14:23.853610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09670","last_updated":"2024-06-06T15:50:51Z","snapshot_observed_at":"2026-08-20T15:45:31.966631Z","submitted_at":"2024-01-18T01:03:38Z","title":"DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09670","snapshot_observed_at":"2026-08-06T16:14:22.357463Z","title":"Distserve: Disaggregating prefill and decoding for goodput-optimized large language model serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.357463Z"},"links":{"cited_paper":"/paper/2401.09670","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:0ccdbb2a3c8a1a5bf254da92215371cf1ab26b23d46829802ef0274d8356f484","observation_id":"33c06c03-c0e1-4092-b01d-0c5dfc994302","resolution":{"observed_at":"2026-08-06T16:14:22.357463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:23.544850Z","title":"Orca: A distributed serving system for Transformer-Based generative models,","venue":null,"work_id":"2de247a3-911a-4ec5-9f5a-e0621725315b","year":2022},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.502133Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:bfc764a817566a69cd2995cc13aaa17ef629ca06bbed5587d2c333eec0b95fe3","observation_id":"66bb4cc1-ebc0-44eb-a40f-257602f420aa","resolution":{"observed_at":"2026-08-06T16:14:23.664814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12023","last_updated":"2022-06-28T19:36:44Z","snapshot_observed_at":"2026-08-16T17:25:18.177208Z","submitted_at":"2022-01-28T10:13:35Z","title":"Alpa: Automating Inter- and Intra-Operator Parallelism for Distributed Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12023","snapshot_observed_at":"2026-08-06T16:14:22.505766Z","title":"Alpa: Automating inter- and intra-operator parallelism for distributed deep learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.505766Z"},"links":{"cited_paper":"/paper/2201.12023","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:0b55520b7b956115edaf7a344f204c2832965d6c832d5173694067ca333e70a7","observation_id":"9b2c8f17-1800-4909-966c-c30e70aec4c7","resolution":{"observed_at":"2026-08-06T16:14:22.505766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:25.415406Z","title":"Efficiently scaling transformer inference,","venue":null,"work_id":"777f55bd-6efa-4914-982a-0b8da6c22f5e","year":null},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.509011Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:b7772c260a9eb6209d5a9a255237f0601cbe63776f411c5af42d52e3359ffb40","observation_id":"20a70581-634a-44df-8f16-9b2b623cabd6","resolution":{"observed_at":"2026-08-06T16:14:25.486252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3639034","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Thorough characterization and analysis of large transformer model training at-scale,","venue":"Proceedings of the ACM on Measurement and Analysis of Computing Systems","work_id":"719169b0-101f-44db-b75c-29d3640fb891","year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.603655Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:76ca4853b3968e73529c9f73e782188eac92787bba02c15f8b30a5d5bf08b633","observation_id":"59ab3ef0-57f1-440a-bdd6-4c5d0389c22c","resolution":{"observed_at":"2026-08-06T16:14:22.884430Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05102","last_updated":"2022-11-09T18:50:38Z","snapshot_observed_at":"2026-08-16T16:17:24.089886Z","submitted_at":"2022-11-09T18:50:38Z","title":"Efficiently Scaling Transformer Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05102","snapshot_observed_at":"2026-08-06T16:14:22.520713Z","title":"Available: https://arxiv.org/abs/2211.05102","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.520713Z"},"links":{"cited_paper":"/paper/2211.05102","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:798764b2eb4f8508f87f0f1c3e146c2dbdad7dcea8b94a9d803a02e3b932dcf3","observation_id":"8b7f616e-de53-44e7-bf53-42aa1e695d13","resolution":{"observed_at":"2026-08-06T16:14:22.520713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:14:23.368126Z","title":"Welcome to TensorRT-LLM Documentation! ; TensorRT-LLM — nvidia.github.io,","venue":null,"work_id":"86169cba-bf7b-4aa5-9e59-8d2f1bd54f56","year":2025},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.749975Z"},"links":{"citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:ee4e3a0b468fded0edcf0ddfc7555d6dd5005b1c0c0ebe404ca2a309f466c281","observation_id":"065ee7ae-a938-4bf9-a5d7-733b5d6072fd","resolution":{"observed_at":"2026-08-06T16:14:23.458514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07104","last_updated":"2024-06-06T00:10:06Z","snapshot_observed_at":"2026-08-18T16:18:58.765617Z","submitted_at":"2023-12-12T09:34:27Z","title":"SGLang: Efficient Execution of Structured Language Model Programs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07104","snapshot_observed_at":"2026-08-06T16:14:22.675122Z","title":"Sglang: Efficient execution of structured language model programs,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:14:22.675122Z"},"links":{"cited_paper":"/paper/2312.07104","citing_paper":"/paper/2507.14392"},"observation_digest":"sha256:16ec1955e1595dba32534955a94eefc3c6aca4f446ac38e35eacedf4c20f8b79","observation_id":"0655cc2d-f92d-449e-a4f6-5846106c0f0a","resolution":{"observed_at":"2026-08-06T16:14:22.675122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.14392","last_updated":"2025-07-18T22:43:38Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-16T01:22:42.074100Z","submitted_at":"2025-07-18T22:43:38Z","title":"Characterizing Communication Patterns in Distributed Large Language Model Inference"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":15},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 2 inbound Pith citation observations for arXiv:2507.14392."}