{"as_of":"2026-08-07T05:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0189339f5a2d8492db4ee680bd80a884ef690b6377f2966a6c64f602c558f544","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:51:53.413520Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T15:43:00.586927Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-11T01:07:43.951069Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2508.16809","last_updated":"2026-04-11T18:53:48Z","snapshot_observed_at":"2026-07-06T22:16:57.749138Z","submitted_at":"2025-08-22T21:30:59Z","title":"PICO: Performance Insights for Collective Operations","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-18T20:45:50.417794Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2508.16809"},"observation_digest":"sha256:90a3997b57d6d01d850cce3ff2af15fa572cc8d710bd00df3b085e4fae203c3e","observation_id":"b63c8a89-2330-464e-937a-eaff5d71555e","resolution":{"observed_at":"2026-05-18T20:46:51.452340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2601.21351","last_updated":"2026-05-12T02:35:02Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T07:22:27Z","title":"Analytical Provisioning for Attention-FFN Disaggregated LLM Serving under Stochastic Workloads","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T09:53:13.057587Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2601.21351"},"observation_digest":"sha256:b5b8875a3172f15b354c92df0132c51efe9416cce125e3952aae561bc8581e22","observation_id":"0f8f060e-9eac-40db-b466-caa97ec4097c","resolution":{"observed_at":"2026-05-16T09:57:43.026990Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2604.03298","last_updated":"2026-04-07T13:42:14Z","snapshot_observed_at":"2026-08-02T08:21:56.727699Z","submitted_at":"2026-03-28T16:11:56Z","title":"ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.684104Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2604.03298"},"observation_digest":"sha256:b309f096bc186097c93dabcb7003decf34ff70470d451dccb2b6f8acae476385","observation_id":"32d311be-1946-4067-a296-b65c2d8c4e77","resolution":{"observed_at":"2026-05-14T21:58:03.084298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2604.08250","last_updated":"2026-04-09T13:41:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T13:41:05Z","title":"SMC-AI: Scaling Monte Carlo Simulation to Four Trillion Atoms with AI Accelerators","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:30:25.240578Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2604.08250"},"observation_digest":"sha256:614becaf6774e55313c90660a96d22856e0d874eee9f889998c999f3a9718044","observation_id":"f06f0228-7107-421a-99f1-117cdee05f56","resolution":{"observed_at":"2026-05-11T06:41:28.008614Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2604.18788","last_updated":"2026-04-20T19:52:56Z","snapshot_observed_at":"2026-07-31T18:40:43.182032Z","submitted_at":"2026-04-20T19:52:56Z","title":"Efficient Mixture-of-Experts LLM Inference with Apple Silicon NPUs","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-10T05:31:25.826205Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2604.18788"},"observation_digest":"sha256:4360d8e13892cb179d3f3908a6dfd263317596b4d66c404a7e79d49c1ca87c3d","observation_id":"884e9708-4445-49f5-ad04-f19c87015e29","resolution":{"observed_at":"2026-05-10T05:36:02.181415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2605.01280","last_updated":"2026-05-02T06:31:11Z","snapshot_observed_at":"2026-08-03T03:47:16.035466Z","submitted_at":"2026-05-02T06:31:11Z","title":"Position: LLM Serving Needs Mathematical Optimization and Algorithmic Foundations, Not Just Heuristics","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-09T18:53:29.089882Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2605.01280"},"observation_digest":"sha256:95aefae28db98e384562a586b968643f1c7d11655eee331433afbb29faf8b580","observation_id":"b4513a85-93c5-4e3d-952a-34cca667b15d","resolution":{"observed_at":"2026-05-11T16:01:20.491809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2605.16007","last_updated":"2026-05-15T14:37:18Z","snapshot_observed_at":"2026-07-06T23:27:15.745896Z","submitted_at":"2026-05-15T14:37:18Z","title":"Ascend-RaBitQ: Heterogeneous NPU-CPU Acceleration of Billion-Scale Similarity Search with 1-bit Quantization","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T22:11:08.273883Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2605.16007"},"observation_digest":"sha256:78b45601ae033c0293498df8a37029ed7b78734271203ed986f93a8d3b412f0c","observation_id":"51cb68f3-cef3-48ae-909b-2338905c4ac7","resolution":{"observed_at":"2026-05-19T22:12:50.687598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2606.04101","last_updated":"2026-06-18T09:05:09Z","snapshot_observed_at":"2026-08-06T18:51:08.635305Z","submitted_at":"2026-06-02T18:07:51Z","title":"UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T08:09:19.921804Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2606.04101"},"observation_digest":"sha256:9aec3c2643dcab9703a38e78eec3f568111b58e8b3c1bd3115cc75dc73e56753","observation_id":"cf2e897a-cf69-4a9e-90f6-74c77b6f1086","resolution":{"observed_at":"2026-07-02T05:26:40.120807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2606.09061","last_updated":"2026-06-08T05:55:50Z","snapshot_observed_at":"2026-08-06T04:57:54.337763Z","submitted_at":"2026-06-08T05:55:50Z","title":"Fairness-Aware and Latency-Controllable Scheduling for Chunked-Prefill LLM Serving","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T15:09:37.157629Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2606.09061"},"observation_digest":"sha256:6b372ff2bc46eadac53aa1d8a29ca9953f56bd8063a563ab45f27a592279c2d3","observation_id":"d8f060b4-8588-4bc6-afc9-2220fc8e751a","resolution":{"observed_at":"2026-07-03T03:37:35.518268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2606.10493","last_updated":"2026-06-09T07:17:34Z","snapshot_observed_at":"2026-08-02T12:04:13.074478Z","submitted_at":"2026-06-09T07:17:34Z","title":"Achieving Cloud-Grade SLOs for Local Mixture-of-Experts Inference through CPU-GPU Hybrid Design","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T12:06:46.806138Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2606.10493"},"observation_digest":"sha256:643f0019940794643e2792d58b6349e6097cdf7669886fa1e756f1471e2ef636","observation_id":"364ce7fc-e394-4782-a1ef-fe96fafeb7c5","resolution":{"observed_at":"2026-07-03T07:27:44.456033Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2606.22541","last_updated":"2026-06-21T14:57:45Z","snapshot_observed_at":"2026-08-05T19:10:35.929740Z","submitted_at":"2026-06-21T14:57:45Z","title":"ASAP: A Disaggregated and Asynchronous Inference System for MoE Prefill","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-26T09:42:39.573568Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2606.22541"},"observation_digest":"sha256:99f0cd981d73cb01eee799ad7174501333533c703d3370d728a30cff565df5d9","observation_id":"18a90714-7375-4a52-a134-3460c469c5e5","resolution":{"observed_at":"2026-07-04T09:39:46.817497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2607.01831","last_updated":"2026-07-02T07:52:43Z","snapshot_observed_at":"2026-07-07T00:07:23.664493Z","submitted_at":"2026-07-02T07:52:43Z","title":"Lynx: Progressive Speculative Quantization for accelerating KV Transfer in Long-Context Inference","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-03T06:19:27.536803Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2607.01831"},"observation_digest":"sha256:c280ab70e373f3f644e2a2c297ce00f542f08d7dc3d4d6c0093da0a2ff75c978","observation_id":"4341fc55-78df-43d4-be73-06f6b0948cf4","resolution":{"observed_at":"2026-07-03T06:27:41.885034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-12T03:59:36.809043Z","title":"arXiv preprint arXiv:2506.12708 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03229","last_updated":"2026-07-03T11:41:14Z","snapshot_observed_at":"2026-08-02T21:21:37.970993Z","submitted_at":"2026-07-03T11:41:14Z","title":"HyperParallel-Mpipe: A Composable Algebra System for Optimizing MLLM Training over Supernode Clusters","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-12T03:59:36.809043Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2607.03229"},"observation_digest":"sha256:4057125d201a3dcafe83aedcec9681615151309da518f15f4238d451390aae07","observation_id":"da2aa0f4-c83f-40b2-851f-a16d9b041c8f","resolution":{"observed_at":"2026-07-12T03:59:36.809043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2607.06202","last_updated":"2026-07-08T01:17:01Z","snapshot_observed_at":"2026-07-31T18:13:20.224549Z","submitted_at":"2026-07-07T12:25:16Z","title":"UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-08T13:43:17.950000Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2607.06202"},"observation_digest":"sha256:5dccd8faed2f1c9d208cdd7f9c144ba3c8d3d352f6bdf5ecbcc95dd2216e340a","observation_id":"5e4f616e-41dd-47e9-9460-c26478f857a7","resolution":{"observed_at":"2026-07-08T13:44:54.948253Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":"2506.12708","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-07-11T01:07:43.951069Z","title":"Serving large lan- guage models on huawei cloudmatrix384.arXiv preprint arXiv:2506.12708","venue":"cs.DC","work_id":"37cf160b-817f-4b02-9f59-aeb09fe886eb","year":2025},"citing_paper":{"arxiv_id":"2607.06202","last_updated":"2026-07-08T01:17:01Z","snapshot_observed_at":"2026-07-31T18:13:20.224549Z","submitted_at":"2026-07-07T12:25:16Z","title":"UBEP: Re-architecting Expert Parallelism Communication Library for Production Superpods","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-11T01:06:46.426582Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2607.06202"},"observation_digest":"sha256:4be5a4b8d42e42397564ae17059f25c1556fa778178cd858055f47f6553758a7","observation_id":"f4a8c8c2-d018-44fb-bb62-605547ddcf8f","resolution":{"observed_at":"2026-07-11T01:07:43.978082Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-08-01T10:42:47.382100Z","title":"arXiv preprint arXiv:2506.12708 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20145","last_updated":"2026-07-30T09:30:44Z","snapshot_observed_at":"2026-08-03T18:47:24.558536Z","submitted_at":"2026-07-22T13:49:17Z","title":"SLAI T-Rex: Full-Parameter Post-training of the DeepSeek-V4 Family on Ascend SuperPOD","version":2},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-08-01T10:42:47.382100Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2607.20145"},"observation_digest":"sha256:61732721e05c05776b6ce8b47efdc93c8f7bf329a057f5deac9b094c9274148b","observation_id":"e8709930-f72c-4f37-a8cf-43bbd9ee8c88","resolution":{"observed_at":"2026-08-01T10:42:47.382100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12708","snapshot_observed_at":"2026-08-01T15:43:00.586927Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26444","last_updated":"2026-07-29T03:45:05Z","snapshot_observed_at":"2026-08-04T05:29:48.166950Z","submitted_at":"2026-07-29T03:45:05Z","title":"StrataCL: Fabric-Native Communication Library for Production Supernodes","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T15:43:00.586927Z"},"links":{"cited_paper":"/paper/2506.12708","citing_paper":"/paper/2607.26444"},"observation_digest":"sha256:a1a658fa70d1c458f707b3aaeb60adcd0bdc317062ef97ca5ce726a127aae939","observation_id":"6798fdff-6e96-41df-ae49-85083d10365d","resolution":{"observed_at":"2026-08-01T15:43:00.586927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.12708/citation-record","integrity":"/paper/2506.12708/integrity","json":"/paper/2506.12708/citation-record.json","paper":"/paper/2506.12708"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.430736Z","title":"Chinese National High School Mathematics Olympiad (CNMO 2024) Problems","venue":null,"work_id":"99ab74e8-603a-4a99-ac62-3f2c58c92813","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.097009Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:7cbdae3451c0a11de607e1edd381202c5667e01b7d7f8c115de8b3847f625567","observation_id":"0187c812-934c-4175-8446-fb49522601b1","resolution":{"observed_at":"2026-08-07T00:51:54.435564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.413955Z","title":null,"venue":null,"work_id":"396024e5-4eb9-4d2f-ae8c-d34f4c5a99c8","year":2016},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.102780Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:44ce217c5a8970b1e26e4ceb915cd7250a7424f6ef7d8e1bca76c884fc838a89","observation_id":"831fec3f-9d12-49e9-8847-7567e7721d8c","resolution":{"observed_at":"2026-08-07T00:51:54.419486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.398075Z","title":null,"venue":null,"work_id":"4d1dcc40-3a92-452d-b3f3-91e08ecf8574","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.107647Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:eb6234c60b0fd963346b348271131f019e46a370ca75d39086e08399076a4e0b","observation_id":"2c9311ad-bd79-4e6e-96f2-fcb8a41fd75f","resolution":{"observed_at":"2026-08-07T00:51:54.403012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.382666Z","title":null,"venue":null,"work_id":"b302fdc2-02d3-47c4-8efb-5b8dcdac4a71","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.112470Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:56cdbac5d42ce0884c7fa879e7646fe9a9defc16ba368fd49fc152e9a24c59ee","observation_id":"09bf6d7b-6767-4495-8e91-1d06f866f96b","resolution":{"observed_at":"2026-08-07T00:51:54.387615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.365440Z","title":null,"venue":null,"work_id":"91540b68-d693-48c0-a507-44dbf637aa73","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.117264Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:1043ebee545c8be05ecb6d6d649d7dcf80fc30e780ebe41099dbedd9e7ee3133","observation_id":"18226d44-87ff-4ab5-a585-a8980084541f","resolution":{"observed_at":"2026-08-07T00:51:54.370384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.348211Z","title":null,"venue":null,"work_id":"92030dc3-fcbb-45e3-bac1-81a52111fad6","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.121786Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:13b41ba7f1e941ca31ad179a5c4baf46c61ab5ff05c4a3970f66c7f49661267a","observation_id":"f9a5d86d-30a2-477a-9a25-4ad93c3cc5ef","resolution":{"observed_at":"2026-08-07T00:51:54.353387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T00:51:53.127478Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.127478Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:1f0ed27459814835f1997a3dff588fc5be1d6b2ec2a77cd61bd77d6a1d282081","observation_id":"20b3f21f-8309-4009-863b-043f7d7a1f9c","resolution":{"observed_at":"2026-08-07T00:51:53.127478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.332181Z","title":null,"venue":null,"work_id":"de05941a-3169-4e3a-bc92-5b4bbc097e0a","year":2023},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.132311Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:b45312d9b47fc7618b294e5486a68d98eb6cd77b1c9456805dee0d1d388ff035","observation_id":"b368ab50-e2cd-479c-9aab-73ebf93c8318","resolution":{"observed_at":"2026-08-07T00:51:54.336732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09390","last_updated":"2024-01-28T20:38:39Z","snapshot_observed_at":"2026-07-06T17:16:55.291514Z","submitted_at":"2024-01-17T18:05:19Z","title":"On Better Approximation Order for the Nonlinear q-Bernstein Operator of Maximum Product Kind","version":2},"cited_work":{"arxiv_id":"2401.09390","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.09390","snapshot_observed_at":"2026-08-07T00:51:53.787377Z","title":"On Better Approximation Order for the Nonlinear q-Bernstein Operator of Maximum Product Kind","venue":"math.FA","work_id":"2a0b91ea-170a-4438-81f1-924cec240af7","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.136931Z"},"links":{"cited_paper":"/paper/2401.09390","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:cf0290ab6f4fe527e099108a478ef33fc7e3fdf4e2aeedb7b40b93648fbea1e0","observation_id":"93a23653-f9d9-4ef6-bd36-f5a8af6e9f6b","resolution":{"observed_at":"2026-08-07T00:51:53.794410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.316283Z","title":null,"venue":null,"work_id":"3a96ff10-c9e4-404a-8834-70454b42d0bd","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.141764Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:e09e6941a9ad62749140c4abd7a1fffc7a88b7e822989ca631918a074196d209","observation_id":"b8af525c-bd9d-4270-aba4-5d75c69dbb8b","resolution":{"observed_at":"2026-08-07T00:51:54.321243Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.301235Z","title":null,"venue":null,"work_id":"06a142ee-b4ab-4c84-b0d1-849cc5e7ca64","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.146590Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:3ddbce500a1d6269ff01f9039538081842fb12145727347042eed13d644228e0","observation_id":"f069999c-b65f-4148-9a23-690f4bca6a93","resolution":{"observed_at":"2026-08-07T00:51:54.306182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.285382Z","title":null,"venue":null,"work_id":"497f9aa5-5153-4c36-81ec-69f86c30bfc0","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.151507Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:918859c185041d52c3b669864dfae95f77f6b1b52d2955fce034d2671e2f4a9c","observation_id":"43a10a1c-2423-418a-b52a-4a893a1cf165","resolution":{"observed_at":"2026-08-07T00:51:54.290821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T00:51:53.156184Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.156184Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:32fcaef4d39c2a9725066395b54b387dfd3b19a787bbafd94600f12b647607d1","observation_id":"bc14e7ce-4029-4af0-8d2c-22175a7619e5","resolution":{"observed_at":"2026-08-07T00:51:53.156184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-07T00:51:53.162338Z","title":"Zhang, Hanwei Xu, Hao Yang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.162338Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:e8fbe9fc5cdaebda4c914f3b1d80dc08a8d3a84afae64f36d56603cc69bc31bf","observation_id":"bbe5fe6f-9962-4dfc-8e8e-6e7d0a43bb21","resolution":{"observed_at":"2026-08-07T00:51:53.162338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T00:51:53.167471Z","title":"Zhang, Han Bao, Hanwei Xu, Haocheng Wang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.167471Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:2654bd74a2ce27e96c551b36db1d767fbebb832ff221d0205ca7c577722d6b92","observation_id":"25ea8fc4-11e0-424f-8b30-783ac05237ee","resolution":{"observed_at":"2026-08-07T00:51:53.167471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.269105Z","title":null,"venue":null,"work_id":"19d2a288-70c8-43db-885f-badc78841a28","year":2019},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.173064Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:119c5f586984e4f8a52d2714d2fa9d7827d68012278fd0a57d06cfc6917b09fc","observation_id":"357d751c-909f-449a-86d9-38afc12787a0","resolution":{"observed_at":"2026-08-07T00:51:54.273968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04475","last_updated":"2025-03-10T09:27:03Z","snapshot_observed_at":"2026-07-06T17:56:23.317089Z","submitted_at":"2024-04-06T02:29:02Z","title":"Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04475","snapshot_observed_at":"2026-08-07T00:51:53.178386Z","title":"Hashimoto","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.178386Z"},"links":{"cited_paper":"/paper/2404.04475","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:a091c60f7db7db603962bd9d0fac849cd490ca3c53e447c2802e83a6e536a5a7","observation_id":"f2a26483-8cf9-46e7-888e-ddb9927cf993","resolution":{"observed_at":"2026-08-07T00:51:53.178386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.183360Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.183360Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:231f0c3697d925ef24b6145c8bc9371013a8de16d952dc89f4e1b7df594b6abd","observation_id":"2a5db0b8-2c4e-46c9-94a4-f8e1a410f17d","resolution":{"observed_at":"2026-08-07T00:51:53.183360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.242726Z","title":null,"venue":null,"work_id":"35084b99-f622-4c85-b648-e1fd0a89d7f0","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.187645Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:178e04d54c10a138ada71e7b24d7cd808bfd983010aa6d7d0e38a93f96736956","observation_id":"23ce7ab8-fc53-493c-8e0b-e7004eb7c8b5","resolution":{"observed_at":"2026-08-07T00:51:54.247698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.226172Z","title":null,"venue":null,"work_id":"af531424-8368-4de8-922b-319efc74ef53","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.192682Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:8949c08fea26fe061c1251630ffcf807207d505bcd75c7439b3f4c1328c49f9f","observation_id":"7abfd12c-6341-4e77-affe-4fcf88b70d5e","resolution":{"observed_at":"2026-08-07T00:51:54.231492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.210518Z","title":null,"venue":null,"work_id":"f97618fa-42bf-4c17-a42d-1eb5d5af4c05","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.198255Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:5f2072ae76ba43cd2b10c7e28612d3d07c6b0563c14e8c58bc25b6786f7f4d76","observation_id":"8cf9956a-4e3f-4a96-b73a-238faa636036","resolution":{"observed_at":"2026-08-07T00:51:54.215471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07140","last_updated":"2024-11-13T16:27:43Z","snapshot_observed_at":"2026-07-06T19:48:36.508447Z","submitted_at":"2024-11-11T17:10:56Z","title":"Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07140","snapshot_observed_at":"2026-08-07T00:51:53.202975Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.202975Z"},"links":{"cited_paper":"/paper/2411.07140","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:ac57b60628642c9613ab68f6b89f66515798e0b8ea00726603b5c3a0c6631e3b","observation_id":"84ff8279-091f-47ab-a4df-d27a0a27c866","resolution":{"observed_at":"2026-08-07T00:51:53.202975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T00:51:53.208203Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.208203Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:3ac73ec546e6833b768f492a7332b23fdd540ec62f7dfa23213afb6f35c8d4c4","observation_id":"9e64d592-a6df-4d94-a9e7-c9e12f2f5317","resolution":{"observed_at":"2026-08-07T00:51:53.208203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.214566Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.214566Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:39c6a81f3693644fd1444b29d135d3fcc3d147b22dd59cf965b699f79a0a8545","observation_id":"c9450df4-50a7-41f4-a0f3-f9a1662fc077","resolution":{"observed_at":"2026-08-07T00:51:53.214566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08322","last_updated":"2023-11-06T13:24:16Z","snapshot_observed_at":"2026-08-03T16:27:29.675478Z","submitted_at":"2023-05-15T03:20:19Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08322","snapshot_observed_at":"2026-08-07T00:51:53.224167Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.224167Z"},"links":{"cited_paper":"/paper/2305.08322","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:d9cc347916343b99b8e6585de1c48199f673c8133159144231ad7b167f4fcbb8","observation_id":"7734fe64-924e-4039-af11-349f17e26416","resolution":{"observed_at":"2026-08-07T00:51:53.224167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.183393Z","title":null,"venue":null,"work_id":"403934a4-34b3-41a9-a1ac-66322936a9c7","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.229716Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:fc790e0f1eb9b1930c4a07ee9bf1b583709f3ccbae5b21ed4681f1c86bedc52e","observation_id":"32d557f6-bf76-4478-8a91-73dee2bb276a","resolution":{"observed_at":"2026-08-07T00:51:54.188829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.168229Z","title":null,"venue":null,"work_id":"dca8fb34-2652-4df5-a92c-1eef74999433","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.234865Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:1a9fab1dd45fa73f3313db67fcc053345a5141f51a02596ab20856c93390412a","observation_id":"e9057fb0-9734-4a60-b836-e98c305940bd","resolution":{"observed_at":"2026-08-07T00:51:54.173220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.152147Z","title":"Huawei Technologies Co","venue":null,"work_id":"244b0a1f-fd37-487a-855e-e1f281ecc502","year":2020},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.239659Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:d94f5dc503b917a4a3c4a2b0197f2b915a04fd5939f16906f77757effb3b7e6c","observation_id":"3d817277-53d5-4ee9-a5c0-0763c55bc3ad","resolution":{"observed_at":"2026-08-07T00:51:54.157952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.136645Z","title":null,"venue":null,"work_id":"6659838f-f7fa-46e8-9abe-47ce323b6354","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.244184Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:fac3fa607fb10ad4029608762dff8c075dce1432d84ef9d480e978c51ac37d4b","observation_id":"c717a2da-1c9e-49b2-8b04-c4ad804163a1","resolution":{"observed_at":"2026-08-07T00:51:54.141559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.119798Z","title":null,"venue":null,"work_id":"a4d31d66-1728-4ab6-8c69-cff2e140278e","year":1991},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.250219Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:59cc63def22503ad0f1023e0ace535652b061ca5649d8010ea6593ae6f2784d9","observation_id":"1b9e9310-cf15-4648-8eab-730094d267d9","resolution":{"observed_at":"2026-08-07T00:51:54.125709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T00:51:53.254538Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.254538Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:77947f4272c16d8e93ba8fff8f1933142d594eb603534a1ea7fd166109fb73b6","observation_id":"c90d3269-4dbc-4831-b001-a61a7df985f4","resolution":{"observed_at":"2026-08-07T00:51:53.254538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.103728Z","title":null,"venue":null,"work_id":"633d833a-68b8-41a9-8039-3cae9e1e0ecf","year":null},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.259465Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:9ab05c6772eb928ef50af84c0d8a5b1041d16d76836fd8389993bc5bd9a71ad5","observation_id":"694ab900-2eea-43de-98db-a3257119e62e","resolution":{"observed_at":"2026-08-07T00:51:54.108659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T00:51:53.270291Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.270291Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:231ee1480e7c374f591a187a8fe278b7e26b0aafc45baf5091fe5d5409ccc28a","observation_id":"d5e8c144-6516-4744-b6e7-b0e7b6d71ec2","resolution":{"observed_at":"2026-08-07T00:51:53.270291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-07-06T09:33:58.857566Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16668","snapshot_observed_at":"2026-08-07T00:51:53.275966Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.275966Z"},"links":{"cited_paper":"/paper/2006.16668","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:23be18c3b654e27cf3a58421501b74f6c391a6358fffed39b85500679e80ac9c","observation_id":"a2218483-d2e9-416e-8f63-25cad3bf5753","resolution":{"observed_at":"2026-08-07T00:51:53.275966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.280955Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.280955Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:e1ce1178de6a97c0f09675335dc3b6a3d7bad441272e4dfc7f0b2c96680e2bd0","observation_id":"e3a8532c-31af-4f4f-a405-f13860e380c4","resolution":{"observed_at":"2026-08-07T00:51:53.280955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.088856Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"41bd64b9-123b-4218-873a-dd0362847a20","year":null},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.286284Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:a192ac57e7deff7ac7bd5e9d4442057326a06fb65d76a791553592f6f1446849","observation_id":"1d09175b-03d7-4a00-be41-cdc49e7575c0","resolution":{"observed_at":"2026-08-07T00:51:54.093675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20552","last_updated":"2025-03-26T13:48:35Z","snapshot_observed_at":"2026-07-06T20:59:00.415760Z","submitted_at":"2025-03-26T13:48:35Z","title":"Injecting Adrenaline into LLM Serving: Boosting Resource Utilization and Throughput via Attention Disaggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20552","snapshot_observed_at":"2026-08-07T00:51:53.296205Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.296205Z"},"links":{"cited_paper":"/paper/2503.20552","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:08429e48fe4cfe022ee7bc9d0e6eed3b3f422040d826f31d2bdd8367df627fb3","observation_id":"f71bca3b-0307-4582-a210-56e50cda3acf","resolution":{"observed_at":"2026-08-07T00:51:53.296205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20377","last_updated":"2025-05-17T13:35:01Z","snapshot_observed_at":"2026-07-06T20:58:55.703373Z","submitted_at":"2025-03-26T09:56:07Z","title":"UB-Mesh: a Hierarchically Localized nD-FullMesh Datacenter Network Architecture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20377","snapshot_observed_at":"2026-08-07T00:51:53.301299Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.301299Z"},"links":{"cited_paper":"/paper/2503.20377","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:1b8d736600aed71980fb821d28db3307b8034ac4e18cc3fb3409d03d97bf8cc7","observation_id":"f7c9d50c-7134-42aa-8490-3afda4f28bb6","resolution":{"observed_at":"2026-08-07T00:51:53.301299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-07T00:51:53.291133Z","title":"https://arxiv.org/abs/2406.11939","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.291133Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:369a94f2712235352bff38f6534235099afed221499a6ed67c22d7a4bc2f3100","observation_id":"5a2648eb-de9e-4479-855f-8aa39cd3a911","resolution":{"observed_at":"2026-08-07T00:51:53.291133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.056366Z","title":null,"venue":null,"work_id":"2687d22e-0b3c-49e1-b0ff-48fd168b631e","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.312071Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:6b9e07e33f903320bb5b607514c55074b47eb83e5a0074322dd92593fd568577","observation_id":"8138d2b1-d84d-4089-bffd-4dacdca64be3","resolution":{"observed_at":"2026-08-07T00:51:54.062012Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.041392Z","title":null,"venue":null,"work_id":"3b8a8381-cfdf-4811-943c-c52d99a24879","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.317796Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:567153393d4c6eacab29839335d3b3a84764b4100cd82d03ae358840e472978e","observation_id":"c2342127-e9e0-418f-b9bf-ed82a1661e90","resolution":{"observed_at":"2026-08-07T00:51:54.046315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.072387Z","title":null,"venue":null,"work_id":"e1e54e6e-d616-4c10-a88a-89ac907ad2c0","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.306300Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:96c95ebd82cf522ce33054106d97d58c3c6083b740e956c230aa59f48e063880","observation_id":"2f6f96e2-c4a8-4990-86ff-5400cc25e24c","resolution":{"observed_at":"2026-08-07T00:51:54.078043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.009313Z","title":null,"venue":null,"work_id":"3d9a5648-5963-41dd-bc36-21c6fc168eef","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.327921Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:844035b71a54a0afa0a673ebea4c4f1998330d00b56c38b8c7d9755b2d07952d","observation_id":"4621e39f-0644-4bf5-81c4-b40b5e68177a","resolution":{"observed_at":"2026-08-07T00:51:54.015014Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.993446Z","title":null,"venue":null,"work_id":"441c5994-2676-4543-bfd3-d89ed8c6378f","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.332769Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:e21ae241bf7f29c4fbcead7641ab4f8c9aa417dc5a2233550216ec5df52c4356","observation_id":"828e0b06-4a99-4631-9c1f-35cbd181158d","resolution":{"observed_at":"2026-08-07T00:51:53.998267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:54.025504Z","title":null,"venue":null,"work_id":"988f7baf-2e2d-4904-8625-98d5e0feae9c","year":2019},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.322445Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:95d96c46b901f8123fecd1325f2db87d20bdd8905f4ddd6e60f24dfd4191dd1f","observation_id":"ff971715-ef81-4283-81dc-7ea4646231ac","resolution":{"observed_at":"2026-08-07T00:51:54.030909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.961813Z","title":null,"venue":null,"work_id":"8a65fe68-12f4-4374-96ba-4ab99cb516d7","year":2019},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.343510Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:dbe9f8bb8bb6f101abea6d0f50da986ad37a618c1a4bd4aba8b60961cdbcf748","observation_id":"afae37f2-e56d-46c2-95b6-476df3df1c08","resolution":{"observed_at":"2026-08-07T00:51:53.966868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.946844Z","title":null,"venue":null,"work_id":"d4dc7a47-8934-40b3-8cd9-e4b8e007dc96","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.348171Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:e66f953ba9fbff11ee51c00736b5399d55f9906cde7f098beba5a5bf4d496f32","observation_id":"8841ff06-2175-41c2-bb2a-c152437772a9","resolution":{"observed_at":"2026-08-07T00:51:53.951409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.977642Z","title":null,"venue":null,"work_id":"6a9aa1ad-a91a-41da-a448-487f468c0f4a","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.338100Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:b527c59cc001fdebbbb8cbac673e9263e71e601d023f3da98bcd29355a709d68","observation_id":"df3deffd-5ed2-49de-8331-daf03ff22dc9","resolution":{"observed_at":"2026-08-07T00:51:53.982449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.914797Z","title":null,"venue":null,"work_id":"9ddf807f-39d7-4037-9716-4f40ff3b11db","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.358521Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:0a662701ad5e0a0def7d3ae7bf4e79562918a42b8afc528955b8772744c59501","observation_id":"54f743bf-4a90-413c-b174-63274c6d95d8","resolution":{"observed_at":"2026-08-07T00:51:53.921066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T00:51:53.364358Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.364358Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:f27dab7264fa6c54f9b07eb076b6ccffa55822525c5bdb0e565ea9c849e3f8e0","observation_id":"5de067e1-e8aa-4060-ba7a-99c9ab9d1a3e","resolution":{"observed_at":"2026-08-07T00:51:53.364358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.932091Z","title":null,"venue":null,"work_id":"6b747fa8-15bf-456c-ba04-27f422484f6c","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.353314Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:90cac807d6132a5f6cd95115760dd08f00fa104de4305a3bf43b03cd50085fac","observation_id":"d4999657-2a08-4e1a-a206-18116bb3d051","resolution":{"observed_at":"2026-08-07T00:51:53.936566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04519","last_updated":"2025-05-07T15:46:36Z","snapshot_observed_at":"2026-07-06T21:20:22.224369Z","submitted_at":"2025-05-07T15:46:36Z","title":"Pangu Ultra MoE: How to Train Your Big MoE on Ascend NPUs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04519","snapshot_observed_at":"2026-08-07T00:51:53.375231Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.375231Z"},"links":{"cited_paper":"/paper/2505.04519","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:2d6d77e6e2ee1c5f33a327dfeb968b2c137d746dfe0621dc1a546d76bce30325","observation_id":"2796a3e0-6168-466b-9bdb-8b380bb04e78","resolution":{"observed_at":"2026-08-07T00:51:53.375231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.898803Z","title":null,"venue":null,"work_id":"cb4222ec-ff43-4ca0-aa7a-963908c52e0b","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.380323Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:781defbaf710b895409e2e3f9b4392d0e881dae103a61c416aa8a6a908dfe0b5","observation_id":"f093ffb4-f98f-4988-9eba-c8f1f2072f2f","resolution":{"observed_at":"2026-08-07T00:51:53.903390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03057","last_updated":"2022-10-06T17:03:34Z","snapshot_observed_at":"2026-07-06T14:00:37.875054Z","submitted_at":"2022-10-06T17:03:34Z","title":"Language Models are Multilingual Chain-of-Thought Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03057","snapshot_observed_at":"2026-08-07T00:51:53.369962Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.369962Z"},"links":{"cited_paper":"/paper/2210.03057","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:453afdf40e6904130c38c38ad9677eb7750f6d654b03c4c8da2a5c5d9ab0e320","observation_id":"d43308a6-6d53-4171-8396-2699b2a66e67","resolution":{"observed_at":"2026-08-07T00:51:53.369962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.867086Z","title":null,"venue":null,"work_id":"b54ef7fd-e5da-4545-a560-5de96f0d1e47","year":2020},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.389643Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:87e83cd61caff8036049a003d9844ac79f2f8201e0559eed61469a94f6616996","observation_id":"576660a0-ebee-4c88-b900-deb28153e9f9","resolution":{"observed_at":"2026-08-07T00:51:53.871471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.851922Z","title":null,"venue":null,"work_id":"0b2fd34f-8ce8-479f-a796-c1de740a1b1b","year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.394224Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:c4e311195b30a3587e481ae39ccc57e3a039d9aba7ed39cb687eb269213cab0b","observation_id":"32ae9d42-a2a7-4568-8319-10007110b535","resolution":{"observed_at":"2026-08-07T00:51:53.856513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.882095Z","title":null,"venue":null,"work_id":"5171cfc3-e0c3-4911-bde3-72ee79bc767c","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.384989Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:c72eff6fe7ea9b98daa8cbf969a9d5dad73194d7c859f5f866be0e3c7d8cc71a","observation_id":"9322bdc6-c890-4863-9664-9f42dfc3c161","resolution":{"observed_at":"2026-08-07T00:51:53.886776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.822975Z","title":null,"venue":null,"work_id":"877258fc-c01d-4801-a400-c8102fd5a24a","year":null},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.403590Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:81a660b0ca550fcd2dd1f531b61e8b58e307eeb755aca3ce9b5b57a4667f35e9","observation_id":"f1000e0c-73db-4a7c-98ef-2638470cbc84","resolution":{"observed_at":"2026-08-07T00:51:53.827563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02263","last_updated":"2025-07-26T15:29:10Z","snapshot_observed_at":"2026-08-03T23:12:06.869265Z","submitted_at":"2025-04-03T04:20:44Z","title":"MegaScale-Infer: Serving Mixture-of-Experts at Scale with Disaggregated Expert Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02263","snapshot_observed_at":"2026-08-07T00:51:53.413520Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.413520Z"},"links":{"cited_paper":"/paper/2504.02263","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:6e13065fa876d2209ade9b1d88ca40709235419f76b1a3f77430cef7352837f5","observation_id":"2b2bcd0a-b077-4d22-9232-50cf9913c523","resolution":{"observed_at":"2026-08-07T00:51:53.413520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:51:53.837495Z","title":null,"venue":null,"work_id":"88e1ebb1-0a73-4aca-ac76-e829b51f692b","year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.398968Z"},"links":{"citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:899a083da5b7dd777c42d8d72a2ecc3e70c43213a7d6a4bad2fb783e55e5509d","observation_id":"a146892c-00d9-4271-95f2-59f3131bb80d","resolution":{"observed_at":"2026-08-07T00:51:53.841968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T00:51:53.219311Z","title":"https://arxiv.org/abs/2103.03874","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.219311Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:881ddb3ff0fe3bbd139691929d5c84cf750442e12835b9fd293e03cc799af8ac","observation_id":"fc65d491-3f67-494b-a9d2-e36d974359d6","resolution":{"observed_at":"2026-08-07T00:51:53.219311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-07T00:51:53.408331Z","title":"https://arxiv.org/abs/2311.07911","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.408331Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:ae192b84fa45dd7bdfe376644ddd6725cfd03d166ed2000d75833c872f76ca5d","observation_id":"75f99cce-4576-4434-86cc-d04acb98e7a4","resolution":{"observed_at":"2026-08-07T00:51:53.408331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T00:51:53.265131Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:51:53.265131Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.12708"},"observation_digest":"sha256:db227b15d069ecf125ed1438f04093076ed60959db4f65b371088142853a1e16","observation_id":"b07c6b92-9b44-4cb2-9224-94552ccfe1dc","resolution":{"observed_at":"2026-08-07T00:51:53.265131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12708","last_updated":"2025-06-19T12:27:10Z","latest_version":3,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T00:41:26.353928Z","submitted_at":"2025-06-15T03:41:34Z","title":"Serving Large Language Models on Huawei CloudMatrix384"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 17 inbound Pith citation observations for arXiv:2506.12708."}