{"as_of":"2026-08-05T03:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:371db95979f0beebc20162bb73352ead4e63d09867be959aa11e28a9b84b78b7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":27,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T17:17:26.613570Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T05:26:04.960844Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2505.07062"},"observation_digest":"sha256:f775248941250f6d2fccc1b2c2372fd59b6e2573f4b62a83ef3818d1f386356b","observation_id":"b78cbcf5-abcd-4ff4-88d0-d514868036a1","resolution":{"observed_at":"2026-05-11T05:26:05.905725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2511.06605","last_updated":"2026-04-10T17:41:06Z","snapshot_observed_at":"2026-08-02T17:48:25.735846Z","submitted_at":"2025-11-10T01:28:58Z","title":"DMA-Latte: Expanding the Reach of DMA Offloads to Latency-bound ML Communication","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T00:27:43.845408Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2511.06605"},"observation_digest":"sha256:2b2ddffdc1585eedc455f978e94b433c05ebb2370c42780b891eaff9a323a398","observation_id":"6234bd18-0851-4f19-bf58-ca78097e27f9","resolution":{"observed_at":"2026-05-18T00:30:33.074100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-03T17:17:26.613570Z","title":"FLUX: fast software-based communication overlap on gpus through kernel fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.10236","last_updated":"2026-06-03T13:48:53Z","snapshot_observed_at":"2026-08-03T17:17:24.452516Z","submitted_at":"2025-12-11T02:43:27Z","title":"Design Space Exploration of DMA based Finer-Grain Compute Communication Overlap","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T17:17:26.613570Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2512.10236"},"observation_digest":"sha256:8143b433fcc0713d5090f2eccfeb03c8094537247527a0e8359ec1a74bfa590c","observation_id":"36560a66-9cab-4c92-b8b5-e8ead0d488de","resolution":{"observed_at":"2026-08-03T17:17:26.613570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-03T08:23:02.055646Z","title":"Flux: Fast software-based commu- nication overlap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.17654","last_updated":"2026-06-11T05:10:51Z","snapshot_observed_at":"2026-08-03T08:22:55.789384Z","submitted_at":"2026-01-25T02:17:05Z","title":"Kareus: Joint Reduction of Dynamic and Static Energy in Large Model Training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T08:23:02.055646Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2601.17654"},"observation_digest":"sha256:4e41d311e96dea155e3b8e86b3b3667db127ca3183a287017971fdac6f6ea259","observation_id":"5a55e24b-f663-41e9-bce7-61a6d0ac6096","resolution":{"observed_at":"2026-08-03T08:23:02.055646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2601.20595","last_updated":"2026-07-01T05:30:30Z","snapshot_observed_at":"2026-08-03T07:21:21.756646Z","submitted_at":"2026-01-28T13:29:51Z","title":"Syncopate: Efficient Multi-GPU AI Kernels via Automatic Chunk-Centric Compute-Communication Overlap","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T10:06:41.150046Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2601.20595"},"observation_digest":"sha256:a059ba4a5063dc54d4569d632fd9d1a3507ce1cda97e402fe9707152dc7faefd","observation_id":"66a69f32-dddc-49f4-a323-e604a0241173","resolution":{"observed_at":"2026-05-16T10:07:43.192888Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-03T07:21:23.050371Z","title":"Flux: fast software-based communication overlap on gpus through kernel fusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.20595","last_updated":"2026-07-01T05:30:30Z","snapshot_observed_at":"2026-08-03T07:21:21.756646Z","submitted_at":"2026-01-28T13:29:51Z","title":"Syncopate: Efficient Multi-GPU AI Kernels via Automatic Chunk-Centric Compute-Communication Overlap","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T07:21:23.050371Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2601.20595"},"observation_digest":"sha256:66e2f63fe9d707c42ab7155b0adc64018692531d113b994fe25d18b95f5c3966","observation_id":"75a4fb2f-d353-4a89-af7c-d4aa47922422","resolution":{"observed_at":"2026-08-03T07:21:23.050371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2604.04750","last_updated":"2026-04-09T14:13:19Z","snapshot_observed_at":"2026-07-06T22:53:37.357996Z","submitted_at":"2026-04-06T15:16:35Z","title":"DeepStack: Scalable and Accurate Design Space Exploration for Distributed 3D-Stacked AI Accelerators","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T19:04:17.725111Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2604.04750"},"observation_digest":"sha256:756d0d2fd1c15acfe345129316d9e8cfa3b5018f39938d83d8bb466e227673f5","observation_id":"ded769fd-618c-4cfd-8e1c-05085d49689c","resolution":{"observed_at":"2026-05-10T23:30:52.155399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2604.17172","last_updated":"2026-04-21T04:46:04Z","snapshot_observed_at":"2026-08-02T14:49:40.944781Z","submitted_at":"2026-04-19T00:05:36Z","title":"UCCL-Zip: Lossless Compression Supercharged GPU Communication","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T06:36:43.101810Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2604.17172"},"observation_digest":"sha256:499002e2ae8713aaf9796707677630cc9b57b8199c06eb9c20bd063fdf41da7e","observation_id":"149779f0-7572-4a28-bc9a-3fe110071f81","resolution":{"observed_at":"2026-05-10T06:41:37.154204Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2604.19241","last_updated":"2026-04-21T08:49:27Z","snapshot_observed_at":"2026-07-06T23:05:58.167533Z","submitted_at":"2026-04-21T08:49:27Z","title":"UniEP: Unified Expert-Parallel MoE MegaKernel for LLM Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T02:20:00.625923Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2604.19241"},"observation_digest":"sha256:af17d0f218f3060999a377f1b6ab6ef26802e17b82e4aaabf6a04e7871199f3a","observation_id":"07f0e3c7-1f59-4311-8ea7-3f5818b42a26","resolution":{"observed_at":"2026-05-10T02:22:20.756427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2604.24013","last_updated":"2026-04-29T15:12:16Z","snapshot_observed_at":"2026-07-06T23:10:07.178566Z","submitted_at":"2026-04-27T03:48:21Z","title":"CommFuse: Hiding Tail Latency via Communication Decomposition and Fusion for Distributed LLM Training","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T04:25:11.075964Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2604.24013"},"observation_digest":"sha256:f75a747b5b7be2f18268a6b97da4ac9ff7f4e4d3832ac3405ff60e2a741418fc","observation_id":"b65b1355-0268-416d-a3a2-5ce181ef3430","resolution":{"observed_at":"2026-05-11T21:46:41.075961Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.00686","last_updated":"2026-05-01T14:18:30Z","snapshot_observed_at":"2026-08-02T20:53:50.589820Z","submitted_at":"2026-05-01T14:18:30Z","title":"Eliminating Hidden Serialization in Multi-Node Megakernel Communication","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-09T18:35:12.493334Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.00686"},"observation_digest":"sha256:4edbd1045d72f2b21e7b905790c9e637e966b0c91e39bc7bef0b4023b470a8fe","observation_id":"c38437b1-1815-4e53-a38c-390ddc3e9605","resolution":{"observed_at":"2026-05-11T16:11:09.187848Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.02953","last_updated":"2026-05-02T09:59:56Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-05-02T09:59:56Z","title":"DITRON: Distributed Multi-level Tiling Compiler for Parallel Tensor Programs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:57:35.983246Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.02953"},"observation_digest":"sha256:98f9e08e3824c8cf4ec3a1ef6451824c5a5bc4ee02be3090545a255ee9717868","observation_id":"5cde0bf3-bdb3-46fb-b1be-c9d9a26652be","resolution":{"observed_at":"2026-05-10T16:00:34.257503Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.08639","last_updated":"2026-05-09T03:18:50Z","snapshot_observed_at":"2026-07-06T23:20:52.521341Z","submitted_at":"2026-05-09T03:18:50Z","title":"ReLibra: Routing-Replay-Guided Load Balancing for MoE Training in Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-12T01:38:03.841465Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.08639"},"observation_digest":"sha256:71ab21a18b3adac8cd9349144ab839024597e64a6fba426a5d9a56d030aadd54","observation_id":"77edfa72-05a8-4614-b0ab-497e1a131a5b","resolution":{"observed_at":"2026-05-12T01:46:14.822291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.08962","last_updated":"2026-05-09T13:59:27Z","snapshot_observed_at":"2026-07-06T23:21:06.773761Z","submitted_at":"2026-05-09T13:59:27Z","title":"MegaScale-Omni: A Hyper-Scale, Workload-Resilient System for MultiModal LLM Training in Production","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-12T02:04:07.344134Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.08962"},"observation_digest":"sha256:6a09883f5193f138a437c02fbe485b95bf10de6e9970bdfdc88909f2676c7d18","observation_id":"ec067641-9638-4f11-b05a-fc3b1175138c","resolution":{"observed_at":"2026-05-12T02:06:14.929283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.10501","last_updated":"2026-05-11T12:58:25Z","snapshot_observed_at":"2026-07-06T23:22:28.318343Z","submitted_at":"2026-05-11T12:58:25Z","title":"Accelerating Compound LLM Training Workloads with Maestro","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T05:11:46.845356Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.10501"},"observation_digest":"sha256:4fd7f4eb28e04ab400f8c7d38999c11d64ec07ab01d41ad253158fe06e042032","observation_id":"4c6317c2-539f-45bb-a7a9-2486fe295f97","resolution":{"observed_at":"2026-05-12T05:31:25.582680Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.10905","last_updated":"2026-05-14T17:37:37Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:46:01Z","title":"TLX: Hardware-Native, Evolvable MIMW GPU Compiler for Large-scale Production Environments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:55:15.475044Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.10905"},"observation_digest":"sha256:9fed587ce3163a85fd68a0be53af0eb8c4e7d590a4fa2dc55a822242af8b0e61","observation_id":"d9d49c1d-c31e-41fa-b91b-1395b8b888dc","resolution":{"observed_at":"2026-05-12T03:56:21.770249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.10905","last_updated":"2026-05-14T17:37:37Z","snapshot_observed_at":"2026-07-06T23:22:47.781940Z","submitted_at":"2026-05-11T17:46:01Z","title":"TLX: Hardware-Native, Evolvable MIMW GPU Compiler for Large-scale Production Environments","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T05:08:56.760052Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.10905"},"observation_digest":"sha256:1716e944770f2910ad1e4f47ec0f345236b0386b325f4b2c5adb558f3485eff1","observation_id":"7c39fc60-040f-49e6-a4bd-16362d558f1c","resolution":{"observed_at":"2026-05-15T05:09:44.740788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.15617","last_updated":"2026-05-15T04:58:20Z","snapshot_observed_at":"2026-08-04T23:30:34.660097Z","submitted_at":"2026-05-15T04:58:20Z","title":"A Few GPUs, A Whole Lotta Scale: Faithful LLM Training Emulation with PrismLLM","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T19:56:25.334846Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.15617"},"observation_digest":"sha256:33a494a171b3464f83d6757bb47ba8043a729c8c7b1f68b9bff174be78f505bc","observation_id":"33873138-bff7-4437-aa4c-9cef24c30730","resolution":{"observed_at":"2026-05-19T19:57:44.426109Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.17879","last_updated":"2026-05-18T05:40:52Z","snapshot_observed_at":"2026-08-01T20:13:09.834168Z","submitted_at":"2026-05-18T05:40:52Z","title":"Guard: Scalable Straggler Detection and Node Health Management for Large-Scale Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T01:19:28.044984Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.17879"},"observation_digest":"sha256:1952ee7ea7a70f7a3bd776ea18bc9aaa0dc204d3c83d9dfd87ab3548b6b2fd4b","observation_id":"ae85bc83-67ca-4a7f-9913-bee03d9430b2","resolution":{"observed_at":"2026-05-20T01:22:55.884632Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.21603","last_updated":"2026-05-20T18:09:13Z","snapshot_observed_at":"2026-07-06T23:32:01.202542Z","submitted_at":"2026-05-20T18:09:13Z","title":"DynaFlow: Transparent and Flexible Intra-Device Parallelism via Programmable Operator Scheduling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T08:34:47.923752Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.21603"},"observation_digest":"sha256:3bc32a658d20dc081257ba6ccf930a8e90f9240c10bb4dd740ecb13fec5079fe","observation_id":"cd568f4f-06ea-427e-9e82-52318b011536","resolution":{"observed_at":"2026-05-22T08:36:17.107636Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.23764","last_updated":"2026-06-01T05:30:13Z","snapshot_observed_at":"2026-08-02T20:06:32.213238Z","submitted_at":"2026-05-22T15:35:23Z","title":"HyperParallel-MoE: Multi-Core Interleaved Scheduling for Fast MoE Training on Ascend NPUs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-25T02:49:09.109990Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.23764"},"observation_digest":"sha256:26400b7c90ba9785eec0dae73ddda79ef002f530ef928068925bd5b589fd1f33","observation_id":"960b7ab6-2eda-4316-ae6a-e842017e4303","resolution":{"observed_at":"2026-05-25T02:55:16.772900Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2605.23764","last_updated":"2026-06-01T05:30:13Z","snapshot_observed_at":"2026-08-02T20:06:32.213238Z","submitted_at":"2026-05-22T15:35:23Z","title":"HyperParallel-MoE: Multi-Core Interleaved Scheduling for Fast MoE Training on Ascend NPUs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T15:10:25.071087Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2605.23764"},"observation_digest":"sha256:5b7a5c1bea7b5f2a92db1c78ab8c82edb430eb68bcd6d3e8f3b725556354ffeb","observation_id":"c781b13e-235b-44cf-a188-0b1c603b0626","resolution":{"observed_at":"2026-06-30T15:14:46.959202Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2606.09200","last_updated":"2026-06-08T08:33:03Z","snapshot_observed_at":"2026-07-06T23:48:35.190418Z","submitted_at":"2026-06-08T08:33:03Z","title":"Resource-aware Computation-Communication Overlap for multi-GPU ML Workloads","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T15:00:07.823857Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2606.09200"},"observation_digest":"sha256:2e4ba94db5347f6eef8287eb9a9f7c7932c37f9ee12c629faea528e6338a6eed","observation_id":"e069f1e0-dcf9-42e0-810f-69d4f84114f1","resolution":{"observed_at":"2026-07-03T03:37:35.978887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2606.11169","last_updated":"2026-06-09T17:48:41Z","snapshot_observed_at":"2026-08-03T00:36:26.241446Z","submitted_at":"2026-06-09T17:48:41Z","title":"Piper: A Programmable Distributed Training System","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T11:34:02.562929Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2606.11169"},"observation_digest":"sha256:ba5952ea0e960a1c60b8c7acf900976ec0e964197d924277f1b4783fb1f23490","observation_id":"f3af15ee-3cd5-4858-9954-930c5a3fe13b","resolution":{"observed_at":"2026-07-03T07:57:44.661496Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":"2406.06858","doi":"10.48550/arxiv.2406.06858","metadata_source":"pith","pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flux: Fast software-based communication over- lap on gpus through kernel fusion.arXiv preprint arXiv:2406.06858","venue":"cs.LG","work_id":"5d0e6adc-6dd2-49cc-8551-dc00433ed79f","year":2024},"citing_paper":{"arxiv_id":"2607.07862","last_updated":"2026-07-08T18:54:08Z","snapshot_observed_at":"2026-08-02T18:07:48.851195Z","submitted_at":"2026-07-08T18:54:08Z","title":"CTA-Pipelining: A Latency-Oriented Spatial Scaling Method for Multi-GPU Systems","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-10T16:30:09.561233Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2607.07862"},"observation_digest":"sha256:e4efe8c35a59d4a412f69cc0927840cb00f1ffed27a3a2d751080d37960c9b0a","observation_id":"60a77571-6f7c-4581-b4ad-e2f1058e3c8b","resolution":{"observed_at":"2026-07-10T16:37:23.034143Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-07-13T01:18:48.061500Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08973","last_updated":"2026-07-09T22:34:00Z","snapshot_observed_at":"2026-08-02T23:44:35.043572Z","submitted_at":"2026-07-09T22:34:00Z","title":"SiFAR: Synchronization-Free All-Reduce for Low-Latency LLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T01:18:48.061500Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2607.08973"},"observation_digest":"sha256:4b6fcc97fd7c567a7373b2c97fec2b689039f8c16520250934c5b425a2fd2081","observation_id":"bbed7484-4fc1-4b72-ac3d-6708d4c2539b","resolution":{"observed_at":"2026-07-13T01:18:48.061500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-01T00:00:11.581450Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23264","last_updated":"2026-07-25T16:04:36Z","snapshot_observed_at":"2026-08-01T00:00:10.493989Z","submitted_at":"2026-07-25T16:04:36Z","title":"X-Stage: An Overlooked Pipeline Stage for Communication-Computation Overlap in DiT Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T00:00:11.581450Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2607.23264"},"observation_digest":"sha256:a18749960c27f75da864e7039a5036dc4f4fb04106c261c0e7252b4eb5e2ccff","observation_id":"f31e81af-a01c-4acb-b7da-553543687284","resolution":{"observed_at":"2026-08-01T00:00:11.581450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.06858/citation-record","integrity":"/paper/2406.06858/integrity","json":"/paper/2406.06858/citation-record.json","paper":"/paper/2406.06858"},"outbound":[],"paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T18:28:33.795339Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 27 inbound Pith citation observations for arXiv:2406.06858."}