{"as_of":"2026-08-04T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:786747c4c3c2ae5d449d68d433e9d5ced95be78c0512261de5a76a80c04395c9","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T17:58:46.821857Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.06956/citation-record","integrity":"/paper/2604.06956/integrity","json":"/paper/2604.06956/citation-record.json","paper":"/paper/2604.06956"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0457.368812","doi":"10.1145/3640457.3688121","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"ISBN 9798400705052","venue":null,"work_id":"f67060d1-e8d3-4309-b6a1-8f65c7eea293","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:dc000991caefa94345e3b91850583f929b53133da1ca4f96b7e3e8903335f2ec","observation_id":"32e9ae4a-3a7d-4f5a-b7a7-ee8442ebe258","resolution":{"observed_at":"2026-05-10T18:00:41.443795Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6252.376156","doi":"10.1145/3746252.3761561","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"MTGR: industrial-scale generative recommendation framework in meituan","venue":null,"work_id":"8d61bb13-db9c-4da6-a907-1b0505349570","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:6f588cb6407ad67c4b1818106446d3450674115e4656a58990c9a081a11273ca","observation_id":"37360f58-a956-4eda-918b-d6588f4d4e42","resolution":{"observed_at":"2026-05-10T18:00:41.440060Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6252.376156","doi":"10.1145/3746252.3761561","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"MTGR: industrial-scale generative recommendation framework in meituan","venue":null,"work_id":"8d61bb13-db9c-4da6-a907-1b0505349570","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:997113ae48fd0b3379fb4cc38d8638d633edae863836f91d09c3cbf50fc250af","observation_id":"73cf06f4-b2a1-4839-ac11-899799e45321","resolution":{"observed_at":"2026-05-10T18:00:41.435871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.16986","doi":"10.48550/arxiv.2602.16986","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Bending the scaling law curve in large-scale recommendation systems","venue":null,"work_id":"4bc2582f-8526-4b59-a117-88b429b68f23","year":2026},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:bdd2de9a1898768ca95a25d489d7234b2cf7687b894ea53902b56e329698d8f3","observation_id":"53a12e2a-f9c1-4d73-bbbc-6a9c0fbb5f8d","resolution":{"observed_at":"2026-05-11T05:41:04.520085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.16986","doi":"10.48550/arxiv.2602.16986","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Bending the scaling law curve in large-scale recommendation systems","venue":null,"work_id":"4bc2582f-8526-4b59-a117-88b429b68f23","year":2026},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:9501d497d65a05b5bb6f5cc6635c3c35b46372c6aa879fe383bd01f5376700fb","observation_id":"ac21f146-f5c9-4172-9de8-e5f46ab93de6","resolution":{"observed_at":"2026-05-10T18:00:41.431562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05605","last_updated":"2025-05-08T19:18:32Z","snapshot_observed_at":"2026-07-06T21:21:10.492037Z","submitted_at":"2025-05-08T19:18:32Z","title":"The Evolution of Embedding Table Optimization and Multi-Epoch Training in Pinterest Ads Conversion","version":1},"cited_work":{"arxiv_id":"2505.05605","doi":"10.48550/arxiv.2505.05605","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05605","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"The evolution of embedding table optimization and multi-epoch training in pinterest ads conversion","venue":null,"work_id":"4fc08fb1-de20-4561-9364-507c669bdc98","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2505.05605","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:d6c9d96bf657f0c056a1bca7b8f25cdde51e4849bdd2cec7a895cd47cc38bd58","observation_id":"2ea7c232-a9f5-4622-9cc8-711b76575ad1","resolution":{"observed_at":"2026-05-10T18:00:41.387781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaembed: Adaptive embedding for large-scale recommendation models","venue":null,"work_id":"de64d13d-5ee9-4e03-bab1-72954a2dcb30","year":2023},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:03caad95963e713f63119d3a92d3412d23b07176a3316a89063aeaef18954ec0","observation_id":"b17401b1-c7f7-4896-b79a-b0c115685dff","resolution":{"observed_at":"2026-05-17T07:51:39.988106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.07372","last_updated":"2026-07-12T07:41:31Z","snapshot_observed_at":"2026-08-03T11:11:06.036270Z","submitted_at":"2026-01-12T09:54:49Z","title":"Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models","version":2},"cited_work":{"arxiv_id":"2601.07372","doi":"10.48550/arxiv.2601.07372","metadata_source":"pith","pith_arxiv_id":"2601.07372","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models","venue":"cs.CL","work_id":"942d7453-d7f7-4ad9-8180-e04bd226f6e5","year":2026},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2601.07372","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:cb3c8283618b57f986d911f6c939bfcb2d4adbb77c0bf9cf6bd36d6f237d2c94","observation_id":"d2132d71-7dc6-45fd-a27e-6ecf369e8154","resolution":{"observed_at":"2026-05-16T04:54:49.681471Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03854","last_updated":"2025-08-05T19:12:18Z","snapshot_observed_at":"2026-07-06T22:08:21.728198Z","submitted_at":"2025-08-05T19:12:18Z","title":"Two-dimensional Sparse Parallelism for Large Scale Deep Learning Recommendation Model Training","version":1},"cited_work":{"arxiv_id":"2508.03854","doi":"10.48550/arxiv.2508.03854","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.03854","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Two-dimensional sparse parallelism for large scale deep learning recommendation model training","venue":null,"work_id":"0a3e206f-5812-4591-99b2-970f9d395c05","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2508.03854","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:f843bd6aaec797422131115f8d5a2bc5d5493313886a531dc3571c4c41365113","observation_id":"8561a1d3-85a7-49bc-a172-e48067c9d1ec","resolution":{"observed_at":"2026-05-10T18:00:41.384440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17551","last_updated":"2025-06-24T02:28:50Z","snapshot_observed_at":"2026-07-06T21:45:34.096283Z","submitted_at":"2025-06-21T02:37:25Z","title":"Research on Model Parallelism and Data Parallelism Optimization Methods in Large Language Model-Based Recommendation Systems","version":2},"cited_work":{"arxiv_id":"2506.17551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Research on model parallelism and data parallelism optimization methods in large language model-based recommendation systems","venue":null,"work_id":"54dfa267-f0ca-4f6f-ba5e-bf687b8f71b4","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2506.17551","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:38b24f59cc1acfc0df1899ddf76c6ce25147b0cb50064c71179e956caa85ee5a","observation_id":"dc851432-b6d5-485f-beff-74f7dbb86999","resolution":{"observed_at":"2026-05-11T05:41:04.555772Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5693.357571","doi":"10.1145/3575693.3575710","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"InProceedings of the 28th ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Volume 2(Vancouver, BC, Canada)(ASPLOS 2023)","venue":null,"work_id":"2c54d747-8d80-4616-b574-a20896d3f223","year":2023},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:005b36630f93b41433406ade93ce04bf464ad860e90ebb46be382d914a41fbd7","observation_id":"70569ae2-561c-4fc7-a84a-fff156e264a8","resolution":{"observed_at":"2026-05-10T18:00:41.413836Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Distributed hierarchical GPU parameter server for massive scale deep learning ads systems","venue":null,"work_id":"5eef7643-a2a0-4312-b170-aa533cbace65","year":2020},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:a60015feb3b5057b40fc63febe04bc5d9ef3343d4d2a6107b64404fa242c5959","observation_id":"3db5c204-92e6-44a8-ae8f-707cbf4edcc6","resolution":{"observed_at":"2026-05-17T07:51:39.980297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4678.353907","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Persia: An open, hybrid system scaling deep learning-based recommenders up to 100 trillion parameters","venue":null,"work_id":"517eb967-e9b9-4580-90e8-884803608dee","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:0267481b05e05849e0aa577d1d43aac7dd771d68b4764f3cee0c2eeecb153e73","observation_id":"11b8bcd3-41aa-4a7b-9c41-7db99f077bea","resolution":{"observed_at":"2026-05-10T18:00:41.381294Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00778-025-00908-w","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient and scalable huge embedding model training via distributed cache management","venue":null,"work_id":"542ecefe-2523-4baf-a7aa-acadffc5e4f0","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:356355ff4dcd675dee90160db6c37da5170a752eaf68b71a7ac279ba6401062b","observation_id":"205f5784-34f2-4c08-876e-ac7bae80584a","resolution":{"observed_at":"2026-05-10T18:00:41.395864Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GBA: A tuning-free approach to switch between synchronous and asynchronous training for recommen- dation models","venue":null,"work_id":"93849aad-f961-4b75-8e75-6011b2afd76f","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:c19165eb19c47094446c7062d24bbabe0fb31d75d14f1e184b52840422a892fa","observation_id":"50c35153-bbd9-47d0-96f4-8a0f6727aaf5","resolution":{"observed_at":"2026-05-17T07:51:39.999260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7548.346708","doi":"10.1145/3447548.3467084","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"InProceedings of the 27th ACM SIGKDD Confer- ence on Knowledge Discovery & Data Mining(Virtual Event, Singapore)(KDD ’21)","venue":null,"work_id":"b284f059-1d28-4b2b-a038-9b9d60896f38","year":2021},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:95d236f09ab13fbfad800e12ef705fff1a152bfd875309e53f45d0cb63adcc23","observation_id":"6c8dfb2b-2400-42b1-b771-97f7da954c87","resolution":{"observed_at":"2026-05-10T18:00:41.399425Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3713072","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CAFE+: towards compact, adaptive, and fast embedding for large-scale online recommendation models","venue":null,"work_id":"4fc5913f-dd48-4cf8-a490-9676abc47e95","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:de57cfb7242eaa17a4ff8f1179585c37431bfa054aa703a87a8877cce6986dc9","observation_id":"cec6e6c2-bf3f-428e-9136-d8547067258c","resolution":{"observed_at":"2026-05-10T18:00:41.393408Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2024","last_updated":"2014-06-08T20:52:15Z","snapshot_observed_at":"2026-07-06T03:45:47.981395Z","submitted_at":"2014-06-08T20:52:15Z","title":"Hilfer fractional advection-diffusion equations with power-law initial condition; a Numerical study using variational iteration method","version":1},"cited_work":{"arxiv_id":"1406.2024","doi":"10.1109/cpem61406.2024.10646000","metadata_source":"pith","pith_arxiv_id":"1406.2024","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Hilfer fractional advection-diffusion equations with power-law initial condition; a Numerical study using variational iteration method","venue":"physics.flu-dyn","work_id":"29a71f51-4cec-4fce-bd5e-2543449fc4aa","year":2014},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/1406.2024","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:28950f6d54272ba04cf574574fde3b44d5c0114359f02de25407e90ea5c42537","observation_id":"6bb02ff7-c1ae-4abe-b6f6-1c400d079f0f","resolution":{"observed_at":"2026-05-10T18:00:41.402857Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2024","last_updated":"2014-06-08T20:52:15Z","snapshot_observed_at":"2026-07-06T03:45:47.981395Z","submitted_at":"2014-06-08T20:52:15Z","title":"Hilfer fractional advection-diffusion equations with power-law initial condition; a Numerical study using variational iteration method","version":1},"cited_work":{"arxiv_id":"1406.2024","doi":"10.1109/cpem61406.2024.10646000","metadata_source":"pith","pith_arxiv_id":"1406.2024","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Hilfer fractional advection-diffusion equations with power-law initial condition; a Numerical study using variational iteration method","venue":"physics.flu-dyn","work_id":"29a71f51-4cec-4fce-bd5e-2543449fc4aa","year":2014},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/1406.2024","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:4c7f6634bb030218835fbe23d42464053dbbddb86ea2bd0366e8d85c1129f324","observation_id":"1f9f79cc-139e-47fc-a62b-4068702975fc","resolution":{"observed_at":"2026-05-10T18:00:41.373954Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1716.371585","doi":"10.1145/3701716.3715856","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Generative recommendation models: Progress and directions","venue":null,"work_id":"5f103d01-3484-4a7c-9346-bd703e9ee534","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:de001e370602191c32239ceeb97afd3d4aa2efccc97ace3368fef2c746421138","observation_id":"a5ea9811-9bb9-4271-ad1d-5208e63b8357","resolution":{"observed_at":"2026-05-10T18:00:41.426985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Slimpipe: Memory-thrifty and efficient pipeline parallelism for long-context LLM training","venue":null,"work_id":"3a4416af-423e-471d-8978-e2706edf8dd2","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:8bf17be6db8a243cee9e3588abff3542a9a6a3437fcf9e21c695587fbd67205f","observation_id":"a896ca77-f6f3-4d07-8399-4964945dcc18","resolution":{"observed_at":"2026-05-17T07:51:39.969619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2285.375985","doi":"10.1145/3712285.3759855","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Available: https://doi.org/10.1145/3712285.3759855","venue":null,"work_id":"7614a1bb-79c8-44b5-bf45-2bf5bfdf02f8","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:3a37d6857fb2af74a6d3964d623e04a490b89015f460f96cb70eb8b574328aa4","observation_id":"d53bdb25-79f8-4dea-9278-5ee43375927b","resolution":{"observed_at":"2026-05-10T18:00:41.410036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pre-train and search: Efficient embedding table sharding with pre-trained neural cost models","venue":null,"work_id":"6fcd8c32-1612-48f0-8ab5-61f4ddffb298","year":2023},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:53a65bcaad02a057b6f924080cd9a8fb70d868f4d1e4bfa05daaad33cfdf685f","observation_id":"93a7940f-7820-4216-ae64-40cf04e6a610","resolution":{"observed_at":"2026-05-17T07:51:39.972820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0457.368811","doi":"10.1145/3640457.3688111","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Embedding optimization for training large-scale deep learning recommendation systems with embark","venue":null,"work_id":"0da27527-a549-4a22-9324-60c804e31485","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:d5238fd7e83052b539a15ce83a8107c53c7018780ab8d770ac89f429f8b8d6c2","observation_id":"54015905-e09d-495d-b8d8-1a55a2576071","resolution":{"observed_at":"2026-05-10T18:00:41.417958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autoshard: Automated embedding table sharding for recommender systems","venue":null,"work_id":"9905f738-0ee4-404c-8857-4b80024ea6d3","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:01da04a5df502e71d6b0e74d0792c22c4b2f40edb2de154111e76dd7188571f5","observation_id":"375ab948-9de5-4b54-9841-8bfbe2ce42e8","resolution":{"observed_at":"2026-05-17T07:51:39.966190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4678.353903","doi":"10.1145/3534678.3539034","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Available: https://doi.org/10.1145/3534678.3539034","venue":null,"work_id":"086e5b5e-b752-4335-91e9-39ecc619b9a2","year":null},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:d865d8de376f35c6407582953ef5ff643531141626d00ba869122be665a71937","observation_id":"d55bc863-5101-421a-8d35-69ab8aea431a","resolution":{"observed_at":"2026-05-10T18:00:41.391071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OPER: optimality-guided embedding table parallelization for large-scale recommendation model","venue":null,"work_id":"1b190088-2144-48dc-8822-194231dd37d1","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:2c024d2c1d74db5c73e1b521b4183728da0cc7eca981bf31e0c4e263c0d63cb1","observation_id":"c11ab777-0664-47e3-8440-61cf6b7cfc24","resolution":{"observed_at":"2026-05-17T07:51:39.976359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0496.353372","doi":"10.1145/3470496.3533727","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A., Gao, L., Ivchenko, D., Basant, A., Hu, Y., Yang, J., Ardestani, E","venue":null,"work_id":"92cfb73d-cb50-4098-8b17-60423f233508","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:d45856aa6ab90b2ecc2b5b804751b034c94d61399b791abf8c30a77734996d3e","observation_id":"af062372-9ed8-4494-b786-eb1e9f3f80c9","resolution":{"observed_at":"2026-05-10T18:00:41.406247Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Accelerating neural recommendation training with embedding schedul- ing","venue":null,"work_id":"acb28ef3-4bf1-4cd9-88cb-cb9087eeeb25","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:10d811f874305c3ab3d9f48e90f191f1b61a646bf2528c6a4a65e80391caae19","observation_id":"e5300932-8ae4-4e31-9197-042782070cf4","resolution":{"observed_at":"2026-05-17T07:51:39.984583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20305","last_updated":"2024-10-17T13:19:08Z","snapshot_observed_at":"2026-07-06T19:24:35.007698Z","submitted_at":"2024-09-30T14:04:27Z","title":"Mixed-Precision Embeddings for Large-Scale Recommendation Models","version":2},"cited_work":{"arxiv_id":"2409.20305","doi":"10.48550/arxiv.2409.20305","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.20305","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Mixed-precision embeddings for large-scale recommendation models","venue":null,"work_id":"2dad7ce6-4e06-477f-8042-89e604b896be","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2409.20305","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:e6386ae9a7fef1d40662f842181e8152d6ec394b555670f6d4f6494ba66153c9","observation_id":"4b108d88-37b5-47b1-8e43-6377b619cab3","resolution":{"observed_at":"2026-05-10T18:00:41.378012Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v40i17.38512","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fusedrec: Fused embedding communication for distributed recommendation training on gpus","venue":null,"work_id":"80b8908f-1618-4ae3-b4f5-61f50c977e9e","year":2026},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:d0106f68e6d8aaceed65cca77d8a2ae7f2903a3075e62a22535a9c46bddd40a6","observation_id":"a9286def-f096-46b6-9085-a05948e28b87","resolution":{"observed_at":"2026-05-10T18:00:41.464838Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20046","last_updated":"2024-10-26T02:33:52Z","snapshot_observed_at":"2026-08-03T10:13:54.905649Z","submitted_at":"2024-10-26T02:33:52Z","title":"DQRM: Deep Quantized Recommendation Models","version":1},"cited_work":{"arxiv_id":"2410.20046","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.20046","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DQRM: deep quantized recommendation models","venue":null,"work_id":"85c79c46-1053-409f-b448-f276602e8d74","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2410.20046","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:0878631048d2142f2ed67841f0a0c072eca7d5eb17e9b90d2fab3cbe2593f774","observation_id":"7b623c7a-6a2b-4a9f-b556-f9731ac4ff9c","resolution":{"observed_at":"2026-05-11T05:41:04.570750Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1404.2022","last_updated":"2014-04-08T06:50:36Z","snapshot_observed_at":"2026-07-06T03:40:36.456030Z","submitted_at":"2014-04-08T06:50:36Z","title":"Neutrino Production via $e^-e^+$ Collision at $Z$-boson Peak","version":1},"cited_work":{"arxiv_id":"1404.2022","doi":"10.1109/sc41404.2022","metadata_source":"pith","pith_arxiv_id":"1404.2022","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Neutrino Production via $e^-e^+$ Collision at $Z$-boson Peak","venue":"hep-ph","work_id":"0625ddd0-436d-4c7a-b66a-97409cfc830c","year":2014},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/1404.2022","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:656e6cb1a0f6ac658b4088c72e249fcd8a852e40c9b24228247c92990ae25e51","observation_id":"f2d78ac2-4c4a-4c07-9247-e00c30100a5b","resolution":{"observed_at":"2026-05-10T18:00:41.500283Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Disaggregated multi-tower: Topology-aware modeling technique for efficient large scale recommendation","venue":null,"work_id":"4e3268c3-a942-4dbb-b81b-bc9ae39c1305","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:17d10ba73e77967a7157a8f252c46852d86fd2c603c4466e995cdda83dd051a0","observation_id":"706258a9-0da2-49b7-8cf0-2d9c4bb81ee3","resolution":{"observed_at":"2026-05-17T07:51:39.992253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Actions speak louder than words: Trillion- parameter sequential transducers for generative recommendations","venue":null,"work_id":"b46c8423-5259-4418-8edd-56eb76f3dfd7","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:c74279623ca5ac9d1417fcfd9e98c02c89ecc21ff0dc7320d2487b2405fa1653","observation_id":"bf4613e0-f670-46ef-a935-fca85607eb54","resolution":{"observed_at":"2026-05-17T07:51:39.995993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3227.354740","doi":"10.1145/3523227.3547405","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Abel, Xu Guo, Jianbing Dong, Ji Shi, and Kunlun Li","venue":null,"work_id":"36e7251a-3f08-4f3a-8947-a7bd1cab7bbe","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:62ed0dc7b15c4c6f6dabfd35c8aaf6918f23c01a10789f0682e1a0b59c592272","observation_id":"976c1a6e-7beb-4c51-a1cb-08140170ad52","resolution":{"observed_at":"2026-05-10T18:00:41.468853Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.20883","doi":"10.48550/arxiv.2509.20883","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Recis: Sparse to dense, A unified training framework for recommendation models","venue":null,"work_id":"b5322d52-0e18-4975-8449-96bdf542b0c9","year":null},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:d3bdfc995f0e1b83d052d600381c9bbbee15e0f155bc5951a928a3b429ebf561","observation_id":"e43652a1-1ccf-463e-b7b0-a7ebc0fc076d","resolution":{"observed_at":"2026-05-11T05:41:04.506348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.20883","doi":"10.48550/arxiv.2509.20883","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Recis: Sparse to dense, A unified training framework for recommendation models","venue":null,"work_id":"b5322d52-0e18-4975-8449-96bdf542b0c9","year":null},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:dfc4ec832b55f6d63bfc6fca91bf42ee29ed94457cf688e1f7c64f85f0b2a5fc","observation_id":"56be5b4a-9413-4029-87ba-a123320bd5f1","resolution":{"observed_at":"2026-05-10T18:00:41.447929Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3767725","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unified and near-optimal multi-gpu cache for embedding-based deep learning","venue":null,"work_id":"05b756fa-1dd3-4553-bcd0-b49fa4ab3d66","year":2026},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:6ac8b39adad7ed59dd70b354e274799d22446767d7e0e433439fac8035a1545d","observation_id":"2937ddb1-cdf7-4049-9d2c-45eb2e0702f0","resolution":{"observed_at":"2026-05-10T18:00:41.454806Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3745.2022","doi":"10.1109/icde53745.2022","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"In38th IEEE International Conference on Data Engineering, ICDE 2022, Kuala Lumpur, Malaysia, May 9-12","venue":null,"work_id":"be5342bb-a570-4689-b78a-714cba902834","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:666cc5e296b7eb626da40b1f7b5a577d5042f1483381f9f9989d733c8235698a","observation_id":"c22681ac-4991-4320-b40f-0cb47786f236","resolution":{"observed_at":"2026-05-10T18:00:41.476915Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9077.2024","doi":"10.1109/isca59077.2024","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Reiner Pope, Sholto Douglas, Aakanksha Chowdhery, Jacob Devlin, James Bradbury, Anselm Lev- skaya, Jonathan Heek, Kefan Xiao, Shivani Agrawal, and Jeff Dean","venue":null,"work_id":"6a69794e-e9cd-48c9-9b7d-502b131ff6db","year":2024},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:78bab9b9f8857a41496e6aaee90cbfa9ae6d4aaddbdd98b83983e6c67a7be4e0","observation_id":"59b6e76c-0b94-4cb3-b3aa-206e53372a76","resolution":{"observed_at":"2026-05-11T05:41:04.487011Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0496.352738","doi":"10.1145/3470496.3527381","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training personalized recommendation systems from (GPU) scratch: look forward not backwards","venue":null,"work_id":"79d389ff-cb8d-4247-86be-82fce7169954","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:dd64caa89fcca63503c8ca68e176277723244d5d38c8cb6c85317a0c226ad942","observation_id":"7b0b9092-ab3f-49f7-b08f-9c8c2c2709fa","resolution":{"observed_at":"2026-05-10T18:00:41.458756Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hypereca: Distributed het- erogeneous in-memory embedding database for training recommender models","venue":null,"work_id":"f4c89b10-51f3-477b-a875-90954e7106e6","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:1705b1106641db5a2a5ba2b13240fa7f31fe07c7b45c9e009ce51149dcc8fd6e","observation_id":"9a9af451-6c53-47a3-ad4f-c471c7e4c8b8","resolution":{"observed_at":"2026-05-17T07:51:39.958489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23722","last_updated":"2026-07-03T02:44:15Z","snapshot_observed_at":"2026-08-04T14:42:54.705316Z","submitted_at":"2025-09-28T08:05:13Z","title":"OctoPipe: Reducing Pipeline Bubbles for Heterogeneous Models via Co-Optimizing Partitioning, Placement, and Scheduling","version":2},"cited_work":{"arxiv_id":"2509.23722","doi":"10.48550/arxiv.2509.23722","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.23722","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Adaptis: Reducing pipeline bubbles with adaptive pipeline parallelism on heterogeneous models","venue":null,"work_id":"85dca17e-3bbb-4782-9f4a-a0d83597f9e8","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2509.23722","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:e82e3ef770e2dd17db956f2f7194fdfec7964b740ca1ce65e1b3c25c382644c0","observation_id":"79af8c3d-abde-49c1-88c1-bc4c41464c9d","resolution":{"observed_at":"2026-07-07T02:15:57.736644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0006.361314","doi":"10.1145/3600006.3613140","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"URLhttps://doi.org/10.1145/3600006.3613145","venue":null,"work_id":"18b7dddd-4486-4b1b-a344-4c04f60d4fa3","year":2023},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:8a1faa3c46fa921aa420be9d047d4544e70a9307f65b254c372f5346b6dba8f2","observation_id":"fe185d4f-4ae6-4478-a44e-39660ce9e918","resolution":{"observed_at":"2026-05-10T18:00:41.504203Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03515","last_updated":"2026-05-27T11:36:21Z","snapshot_observed_at":"2026-08-03T08:36:47.513986Z","submitted_at":"2026-02-03T13:31:51Z","title":"Mitigating Staleness in Asynchronous Pipeline Parallelism via Basis Rotation","version":2},"cited_work":{"arxiv_id":"2602.03515","doi":"10.48550/arxiv.2602.03515","metadata_source":"pith","pith_arxiv_id":"2602.03515","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mitigating","venue":"cs.LG","work_id":"7ea9c49d-e35b-4881-8b8a-743890d099a9","year":2026},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2602.03515","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:7cd4950f878804851df69afa7871b22708184f801ce572e6dd9bcae75c8b3e49","observation_id":"be0ada0a-2700-4529-a187-43d3e416180d","resolution":{"observed_at":"2026-05-28T02:04:14.298512Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.03515","last_updated":"2026-05-27T11:36:21Z","snapshot_observed_at":"2026-08-03T08:36:47.513986Z","submitted_at":"2026-02-03T13:31:51Z","title":"Mitigating Staleness in Asynchronous Pipeline Parallelism via Basis Rotation","version":2},"cited_work":{"arxiv_id":"2602.03515","doi":"10.48550/arxiv.2602.03515","metadata_source":"pith","pith_arxiv_id":"2602.03515","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mitigating","venue":"cs.LG","work_id":"7ea9c49d-e35b-4881-8b8a-743890d099a9","year":2026},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"cited_paper":"/paper/2602.03515","citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:7fee251b2f0751b6a6ad67bd2348986613826d9e055f2274e4590a123ed2b10f","observation_id":"e25dba7b-d7c1-44c6-a764-122172d1bb08","resolution":{"observed_at":"2026-05-28T02:04:14.298512Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8071.267142","doi":"10.1145/2628071.2671423","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Design of a hybrid MPI-CUDA benchmark suite for CPU-GPU clusters","venue":null,"work_id":"0d86d593-3960-4c24-865d-dabd1ac4f3ff","year":2014},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:cfa71b64ead94432dba247c9143882a9c36ad6f95122aca9becb60668e69b9ef","observation_id":"2e80651b-8755-4f3a-96cf-8e41a2cc22c8","resolution":{"observed_at":"2026-05-10T18:00:41.485157Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3730582","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DCMA: accelerating parallel DMA transfers with a multi-port direct cached memory access in a massive-parallel vector processor","venue":null,"work_id":"a4bb14d9-29ca-4499-abe9-46a21c7818e4","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:0d15eb431ff4f99ecdd29fcaeeb963eb2b0aaee75939020ad33a42679833d122","observation_id":"174bbd77-9faf-41ed-8296-882743781988","resolution":{"observed_at":"2026-05-10T18:00:41.461969Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4598.375462","doi":"10.1145/3754598.3754621","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Td-pipe: Temporally-disaggregated pipeline parallelism architecture for high- throughput LLM inference","venue":null,"work_id":"46bd7f6e-681c-4174-96ab-e885c17a6795","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:1a782d9b612744cc97f37943492c4c94b6408c3bfdf24776e29c560e10bdf384","observation_id":"8ff95d63-791e-4f8e-a14a-5bdd12f12d2d","resolution":{"observed_at":"2026-05-10T18:00:41.492938Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.19362","doi":"10.48550/arxiv.2601.19362","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Revisiting parameter server in LLM post-training","venue":null,"work_id":"cbc69b95-6c41-4fd6-92a3-9135d845e3a3","year":null},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:e09c41ed5d027d5a6cb754851b2bad670508461a49d048ec98d0cd3d229c3204","observation_id":"85dcdb35-9dae-4172-bb50-483565ed9672","resolution":{"observed_at":"2026-05-11T05:41:04.475223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.19362","doi":"10.48550/arxiv.2601.19362","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Revisiting parameter server in LLM post-training","venue":null,"work_id":"cbc69b95-6c41-4fd6-92a3-9135d845e3a3","year":null},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:71b046432b5cdf90c18ae252fd11993c127f941d37440cbd560ea8c0b30e02be","observation_id":"2f46a396-bc0c-4365-80a7-5d8239c5ff28","resolution":{"observed_at":"2026-05-10T18:00:41.452179Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"COMET: fine-grained computation-communication overlapping for mixture-of- experts","venue":null,"work_id":"a345cc55-c3d5-44c9-88c1-4342f2c5c8e0","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:3d3e9856707588d98e3e7407fcead45545fe6be0e42b7e61ed6e7612e4a0a2e0","observation_id":"cd4a9e0b-48e4-43bc-9bd9-5afc4982687f","resolution":{"observed_at":"2026-05-17T07:51:39.962956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1808.355762","doi":"10.1145/3511808.3557624","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Kuairand: An unbiased sequential recommendation dataset with randomly exposed videos","venue":null,"work_id":"77869331-c9d7-41fd-82e8-ef685b2b0d97","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:1e5a3e38c2b69c2b436c97c6af637ce700e4cb38ee063404c8f3e550fb04867c","observation_id":"f0c0e135-1cc0-468e-a25d-23fdcddee4b9","resolution":{"observed_at":"2026-05-10T18:00:41.508061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1716.371544","doi":"10.1145/3701716.3715448","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Fuxi-α: Scaling recommendation model with feature interaction enhanced transformer","venue":null,"work_id":"bfaa2c8c-183b-474b-926e-183570dc134a","year":2025},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:11408aadcf859c9b2f3776524b4c813595c1b18f9839f9836d72c5e3bae76b51","observation_id":"dd2abcad-0d69-4fe4-ac01-e78d35c0966a","resolution":{"observed_at":"2026-05-10T18:00:41.472927Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3227.354738","doi":"10.1145/3523227.3547387","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Torchrec: a pytorch domain library for recommendation systems","venue":null,"work_id":"fc0c8d8c-8c15-4fdd-8476-654399c1d176","year":2022},"citing_paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-10T17:58:46.821857Z"},"links":{"citing_paper":"/paper/2604.06956"},"observation_digest":"sha256:9bae9956a26ffe16135026ca901fb1064407c77ba590b0188116106f21c9766c","observation_id":"a236ebce-4f8a-496a-803f-199eecf706b8","resolution":{"observed_at":"2026-05-10T18:00:41.496397Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.06956","last_updated":"2026-04-08T11:19:17Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T22:55:20.208897Z","submitted_at":"2026-04-08T11:19:17Z","title":"NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":2,"metadata_mismatch":17,"parse_uncertain":0,"unresolved":0,"verified_exact":25,"verified_fuzzy":12},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2604.06956."}