{"as_of":"2026-08-11T07:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7c83aa1afb7024afd3c55f04d2584a95d2fa1d94d64ead6febb806a01f6add2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":28,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:20:58.789532Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":97,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:34:44.807534Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/1909.08053"},"observation_digest":"sha256:c053a642f0e408c5eaeff7a39c2f7f2b6a34d68c99d043afa769653982faedbd","observation_id":"8f99c712-d1bb-448e-a4d6-9732757e5846","resolution":{"observed_at":"2026-05-10T18:34:44.836255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"1910.02054","last_updated":"2020-05-13T06:45:15Z","snapshot_observed_at":"2026-07-06T08:27:00.558613Z","submitted_at":"2019-10-04T17:29:39Z","title":"ZeRO: Memory Optimizations Toward Training Trillion Parameter Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T09:24:35.826882Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/1910.02054"},"observation_digest":"sha256:28b76b9c53ee2e476e322b4501f3ec3908624a34c42773b571364545e6b4de53","observation_id":"5405b971-f3cd-4a37-8850-60e169e1c25f","resolution":{"observed_at":"2026-05-16T09:24:35.867064Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2006.16668","last_updated":"2020-06-30T10:42:02Z","snapshot_observed_at":"2026-08-07T09:27:36.420559Z","submitted_at":"2020-06-30T10:42:02Z","title":"GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T02:26:44.624137Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2006.16668"},"observation_digest":"sha256:0dc981e1c2b2c157b067fdf6f32a928803798e487b5cb7fb3985e1f53b9cbcaa","observation_id":"3efc4f73-603d-488e-a080-3756f8fb6d6f","resolution":{"observed_at":"2026-05-11T02:26:44.805619Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2101.03961","last_updated":"2022-06-16T20:36:07Z","snapshot_observed_at":"2026-08-10T10:13:42.613798Z","submitted_at":"2021-01-11T16:11:52Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T23:57:10.953617Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2101.03961"},"observation_digest":"sha256:e2a776424b16d0c641ed66478b1135d28649de406dbe078ef47bea448f2e073a","observation_id":"54a09fd4-1241-4169-b150-b087037a10e1","resolution":{"observed_at":"2026-05-12T23:57:11.048267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2202.08906","last_updated":"2022-04-29T23:24:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-17T21:39:10Z","title":"ST-MoE: Designing Stable and Transferable Sparse Expert Models","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-12T23:14:25.431471Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2202.08906"},"observation_digest":"sha256:cc2593ba06c97305c967b7957cbb74c5e91c7ac500c1345582d1771a994eea81","observation_id":"af61a47e-b27d-4f06-98ad-f7133b7bbb2c","resolution":{"observed_at":"2026-05-12T23:14:25.548820Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2204.06745","last_updated":"2022-04-14T04:00:27Z","snapshot_observed_at":"2026-07-06T13:00:12.148951Z","submitted_at":"2022-04-14T04:00:27Z","title":"GPT-NeoX-20B: An Open-Source Autoregressive Language Model","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-24T12:33:37.701655Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2204.06745"},"observation_digest":"sha256:7d20de1862d1bdd34b3876f52201b3edd52113cae96f6ba615a4d2eee2d9cfcf","observation_id":"70ce4c06-9ed9-491f-bc29-cd60621b7424","resolution":{"observed_at":"2026-05-24T12:34:28.303900Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2208.07339","last_updated":"2022-11-10T18:14:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-15T17:08:50Z","title":"LLM.int8(): 8-bit Matrix Multiplication for Transformers at Scale","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-13T13:35:35.972596Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2208.07339"},"observation_digest":"sha256:924f7112865d933e73ebcbafbeb21afca2b9eddcc79904dc4c90225797608a1f","observation_id":"e4ecba00-e008-45be-8f6f-888fd6110f9c","resolution":{"observed_at":"2026-05-13T13:35:36.081409Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2304.11277","last_updated":"2023-09-12T16:28:00Z","snapshot_observed_at":"2026-08-01T19:01:47.393546Z","submitted_at":"2023-04-21T23:52:27Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T04:15:20.027659Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2304.11277"},"observation_digest":"sha256:5a520b877e4189442a1efc36702c8e12524dd9ab77d5b3625c0d818e237f1877","observation_id":"d5fa683c-080d-4f90-80c6-d0c86f35f8ee","resolution":{"observed_at":"2026-05-12T04:15:20.068407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-04T19:27:31.715261Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-13T01:07:22.166595Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2309.14509"},"observation_digest":"sha256:37215e6c66f1b561bbe0edbabd096819f87fdda2cceca668b2500907c7f0fe93","observation_id":"aff25c00-436b-4564-af9a-7f1b056038f1","resolution":{"observed_at":"2026-05-13T01:07:22.247126Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-11T22:50:06.399707Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2401.06066"},"observation_digest":"sha256:66b4b2aa8fa9e81019d166be39c28d54947a2ca95507a8d784cbbba1dc158523","observation_id":"af27a4c9-7849-4c41-8384-4732354c24f0","resolution":{"observed_at":"2026-05-11T22:50:11.837908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2408.12935","last_updated":"2026-05-13T07:56:42Z","snapshot_observed_at":"2026-08-02T12:48:59.218457Z","submitted_at":"2024-08-23T09:33:48Z","title":"AI Safety Landscape for Large Language Models: Taxonomy, State-of-the-art, and Future Directions","version":4},"reference_index":298,"source":"pdf_text","source_observed_at":"2026-05-23T21:54:26.670284Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2408.12935"},"observation_digest":"sha256:a3bc4ff08890288415214ba9b9910471fdd511f21717346fd408e1f513edcd4c","observation_id":"0a6bbe57-34e5-4909-9cd8-049a27289036","resolution":{"observed_at":"2026-05-23T21:55:50.703652Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-10T22:20:58.789532Z","title":"Pipedream: Fast and efficient pipeline parallel dnn training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.01951","last_updated":"2025-02-24T22:02:47Z","snapshot_observed_at":"2026-08-10T22:12:19.854787Z","submitted_at":"2025-01-03T18:54:46Z","title":"MixGCN: Scalable GCN Training by Mixture of Parallelism and Mixture of Accelerators","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T22:20:58.789532Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2501.01951"},"observation_digest":"sha256:bbc4e9d5e05b43fc9be26ef656caf08cacfd7471ddd0562ccf68d8dc04aab8d5","observation_id":"0d08922e-937e-4b4f-8655-414507764227","resolution":{"observed_at":"2026-08-10T22:20:58.789532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-10T20:14:58.823417Z","title":"Pipedream: Fast and efficient pipeline parallel dnn training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.09223","last_updated":"2025-06-15T13:24:11Z","snapshot_observed_at":"2026-08-10T20:07:27.554415Z","submitted_at":"2025-01-16T01:03:56Z","title":"Foundations of Large Language Models","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-10T20:14:58.823417Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2501.09223"},"observation_digest":"sha256:1f8d620c64631368b966aab4a06f5e1ffe48a1475f8eb89b20d09d2a58bf83d9","observation_id":"e8c95e2a-01a0-4983-be3a-0787005b17af","resolution":{"observed_at":"2026-08-10T20:14:58.823417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-07T15:31:08.413191Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.15020","last_updated":"2025-05-21T01:57:22Z","snapshot_observed_at":"2026-08-07T15:23:13.934927Z","submitted_at":"2025-05-21T01:57:22Z","title":"COSMIC: Enabling Full-Stack Co-Design and Optimization of Distributed Machine Learning Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:31:08.413191Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2505.15020"},"observation_digest":"sha256:615180a2a993a8c603cc6765834ca39c65e0f5c26706abe8310ea4d566644923","observation_id":"73f3d9ae-05b6-4a92-a784-b02222c5483c","resolution":{"observed_at":"2026-08-07T15:31:08.413191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-06T22:15:28.228455Z","title":"Pipedream: Fast and efficient pipeline parallel dnn training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22175","last_updated":"2025-06-27T12:41:53Z","snapshot_observed_at":"2026-08-06T22:07:13.608902Z","submitted_at":"2025-06-27T12:41:53Z","title":"MPipeMoE: Memory Efficient MoE for Pre-trained Models with Adaptive Pipeline Parallelism","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T22:15:28.228455Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2506.22175"},"observation_digest":"sha256:a9371ebe7548f37ba23ece6be7855206bf6b1df1b8c52b86fee37fc4defc4a23","observation_id":"fcc388e8-10f4-48cc-a89d-78c841b56b78","resolution":{"observed_at":"2026-08-06T22:15:28.228455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T17:49:27.926646Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2507.20534"},"observation_digest":"sha256:52cba029c20619dd97e6c07562967ec84c0673389cad796100f3a9deccec7e74","observation_id":"85e46ada-e053-4c71-8814-64457dc87646","resolution":{"observed_at":"2026-05-10T17:49:28.128081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2509.05276","last_updated":"2026-05-08T09:41:26Z","snapshot_observed_at":"2026-08-11T05:30:18.498214Z","submitted_at":"2025-09-05T17:34:00Z","title":"SpikingBrain: Spiking Brain-inspired Large Models","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T18:51:06.243305Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2509.05276"},"observation_digest":"sha256:498ad17e62755d3ef5872e6959cae594a27bb6bc94ce3dc7ff6e0a3579cac558","observation_id":"25377506-779f-42c7-8987-e064d909e00b","resolution":{"observed_at":"2026-05-18T18:51:45.602853Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-04T14:42:57.952940Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.23722","last_updated":"2026-07-03T02:44:15Z","snapshot_observed_at":"2026-08-04T14:42:54.705316Z","submitted_at":"2025-09-28T08:05:13Z","title":"OctoPipe: Reducing Pipeline Bubbles for Heterogeneous Models via Co-Optimizing Partitioning, Placement, and Scheduling","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T14:42:57.952940Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2509.23722"},"observation_digest":"sha256:d1ebdcfa90caab65298eaee80f16b19862641f82b6b5b76577e5072f88f3789e","observation_id":"054bdcd8-5793-454b-92ca-0a6f6a9321b3","resolution":{"observed_at":"2026-08-04T14:42:57.952940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-03T22:28:45.455385Z","title":"Pipedream: Fast and efficient pipeline parallel dnn training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.10480","last_updated":"2026-06-26T19:59:05Z","snapshot_observed_at":"2026-08-09T19:17:08.259662Z","submitted_at":"2025-11-13T16:44:56Z","title":"Scalable Synthesis of distributed LLM workloads through Symbolic Tensor Graphs","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T22:28:45.455385Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2511.10480"},"observation_digest":"sha256:e3a91d2dfd4e168901232116dbe845853b468b8d97535a6ec79858a38ee3e6f4","observation_id":"597bdd83-b4f5-4542-b453-a181c5219d31","resolution":{"observed_at":"2026-08-03T22:28:45.455385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2512.16776","last_updated":"2025-12-18T17:08:12Z","snapshot_observed_at":"2026-07-06T22:39:28.855621Z","submitted_at":"2025-12-18T17:08:12Z","title":"Kling-Omni Technical Report","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T21:00:58.473043Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2512.16776"},"observation_digest":"sha256:0abcc0ff3f76893eda5ffd20bb322be5addbd350bb4d3a4804f3fbd404865f53","observation_id":"7eddbc0a-8973-4737-8561-d409de6d01ae","resolution":{"observed_at":"2026-05-15T21:00:58.638539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2604.27085","last_updated":"2026-04-29T18:26:13Z","snapshot_observed_at":"2026-07-06T23:12:38.453388Z","submitted_at":"2026-04-29T18:26:13Z","title":"Efficient Training on Multiple Consumer GPUs with RoundPipe","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-07T10:37:22.251566Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2604.27085"},"observation_digest":"sha256:2e48205b7a030b48ea54f6290aa9586318127859a3250aa02b9cd32bb0b56526","observation_id":"05b648a2-08d4-4458-a1d0-fa2137678b43","resolution":{"observed_at":"2026-05-12T09:31:26.754534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2605.13434","last_updated":"2026-05-13T12:27:22Z","snapshot_observed_at":"2026-07-06T23:25:01.951546Z","submitted_at":"2026-05-13T12:27:22Z","title":"Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-05-14T19:31:12.149482Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2605.13434"},"observation_digest":"sha256:4e0af95455c1c8e08b982fccc6f1612ceb7a50b7ed0d215eabb55faa290ad39f","observation_id":"5403e35d-eb3f-4600-89da-66815d1f9523","resolution":{"observed_at":"2026-05-14T19:32:51.333375Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2606.03498","last_updated":"2026-06-02T11:14:57Z","snapshot_observed_at":"2026-08-03T10:17:06.732734Z","submitted_at":"2026-06-02T11:14:57Z","title":"Demystifying Pipeline Parallelism: First Theory for PipeDream","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-28T11:21:52.068934Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2606.03498"},"observation_digest":"sha256:53faaa3d6b047f1ead59e5737f6def327ef993883e41959a5e5e0ac333577504","observation_id":"7ef6ffc8-8e92-4591-9c1a-977506cb0111","resolution":{"observed_at":"2026-07-02T01:56:28.486918Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2606.07881","last_updated":"2026-06-05T22:33:57Z","snapshot_observed_at":"2026-08-03T04:13:36.304742Z","submitted_at":"2026-06-05T22:33:57Z","title":"Breaking the Bubble: Asynchronous Pipeline Parallel Training with Bounded Weight Inconsistency","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T22:19:15.307830Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2606.07881"},"observation_digest":"sha256:caef9c55c46486426e5664e11b8521d970ce08d5cbfe47e0ac4d72e202b213ed","observation_id":"0d016fad-29fb-487c-bc0b-673c9e4f078a","resolution":{"observed_at":"2026-07-02T16:57:09.398018Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2606.11169","last_updated":"2026-06-09T17:48:41Z","snapshot_observed_at":"2026-08-03T00:36:26.241446Z","submitted_at":"2026-06-09T17:48:41Z","title":"Piper: A Programmable Distributed Training System","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T11:34:02.562929Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2606.11169"},"observation_digest":"sha256:5e9a2e4e6871236a696e3dceef61b6d56962e9903dc2e10ef54fdb80382b969f","observation_id":"cc59b262-0f21-4dbe-9b22-e66bdc41825e","resolution":{"observed_at":"2026-07-03T07:57:44.641164Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":"1806.03377","doi":"10.48550/arxiv.1806.03377","metadata_source":"pith","pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","venue":"cs.DC","work_id":"335ca03b-43f7-43d8-af32-3eaeb6735100","year":2018},"citing_paper":{"arxiv_id":"2606.26633","last_updated":"2026-06-25T05:50:46Z","snapshot_observed_at":"2026-08-06T17:28:20.433752Z","submitted_at":"2026-06-25T05:50:46Z","title":"Simulating Unified Tensor Resharding in heterogeneous AI systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-26T04:00:26.409243Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2606.26633"},"observation_digest":"sha256:437bb970c6b20d33022029b86be647f0ef0d06f2daa1c79add6e859284083307","observation_id":"7f33d645-9fea-44e7-856c-e4fd06c44dcd","resolution":{"observed_at":"2026-07-04T14:19:54.709742Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-01T20:54:12.759516Z","title":"Pipedream: Fast and efficient pipeline parallel dnn training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16488","last_updated":"2026-07-17T20:27:26Z","snapshot_observed_at":"2026-08-07T14:52:50.399447Z","submitted_at":"2026-07-17T20:27:26Z","title":"Auto-Scaling Heterogeneous Neural Processing Units for Energy and Cost-Efficient LLM Serving","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T20:54:12.759516Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2607.16488"},"observation_digest":"sha256:11177375b6ab9cad107934aa643efac4639d8c5ff16ea2f3a651569899f1eed3","observation_id":"5022126f-bf39-4c78-8384-9400b1cc8d5f","resolution":{"observed_at":"2026-08-01T20:54:12.759516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03377","snapshot_observed_at":"2026-08-05T18:13:13.750734Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.03487","last_updated":"2026-08-04T11:23:19Z","snapshot_observed_at":"2026-08-10T06:00:57.248166Z","submitted_at":"2026-08-04T11:23:19Z","title":"RAG-Stack: Co-Optimizing RAG Serving Performance and Quality","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T18:13:13.750734Z"},"links":{"cited_paper":"/paper/1806.03377","citing_paper":"/paper/2608.03487"},"observation_digest":"sha256:d2d60ac10b771ea0dd46c91139d643959350dea28718acd30f4d50346d7e4305","observation_id":"736d81f2-aaf5-4acc-83d5-acc22127cca2","resolution":{"observed_at":"2026-08-05T18:13:13.750734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1806.03377/citation-record","integrity":"/paper/1806.03377/integrity","json":"/paper/1806.03377/citation-record.json","paper":"/paper/1806.03377"},"outbound":[],"paper":{"arxiv_id":"1806.03377","last_updated":"2018-06-08T23:18:08Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-02T18:12:03.258298Z","submitted_at":"2018-06-08T23:18:08Z","title":"PipeDream: Fast and Efficient Pipeline Parallel DNN Training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 28 inbound Pith citation observations for arXiv:1806.03377."}