{"as_of":"2026-08-14T22:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f7fa9cded12d4ec86ead9ec2e0a28ae137fcba3c740a5d94a7b162d33dfd6a1","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:21:56.408830Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T15:48:34.312616Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T16:33:39.630527Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"cited_work":{"arxiv_id":"2602.17254","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.17254","snapshot_observed_at":"2026-07-13T01:18:02.798775Z","title":null,"venue":null,"work_id":"75eaad9c-e997-44f9-95c1-51034dd089dc","year":2026},"citing_paper":{"arxiv_id":"2605.12766","last_updated":"2026-05-12T21:30:46Z","snapshot_observed_at":"2026-08-01T18:00:56.187323Z","submitted_at":"2026-05-12T21:30:46Z","title":"Bridge: Optimizing Collective Communication Schedules in Reconfigurable Networks with Reusable Subrings","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T19:38:26.606829Z"},"links":{"cited_paper":"/paper/2602.17254","citing_paper":"/paper/2605.12766"},"observation_digest":"sha256:050798ebad20d07b91c4dd0df417bf9bf6a09245a548c7583d3c10b5f4f52540","observation_id":"9ce84a0c-cfb6-4d44-a194-7c668820466e","resolution":{"observed_at":"2026-07-13T01:18:02.798775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"cited_work":{"arxiv_id":"2602.17254","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2602.17254","snapshot_observed_at":"2026-07-13T01:18:02.798775Z","title":null,"venue":null,"work_id":"75eaad9c-e997-44f9-95c1-51034dd089dc","year":2026},"citing_paper":{"arxiv_id":"2605.26930","last_updated":"2026-07-09T20:49:11Z","snapshot_observed_at":"2026-08-03T11:04:44.451814Z","submitted_at":"2026-05-26T12:24:04Z","title":"Revisiting Bruck: Phase-Efficient All-to-All Communication in Reconfigurable Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T15:48:34.312616Z"},"links":{"cited_paper":"/paper/2602.17254","citing_paper":"/paper/2605.26930"},"observation_digest":"sha256:652b68d29410cb976e29c2869789d096baef62dbb795f6c8cfd91795b30f01d5","observation_id":"ef7de534-e9e6-476f-9f80-79a81e85f8aa","resolution":{"observed_at":"2026-07-13T01:18:02.798775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2602.17254/citation-record","integrity":"/paper/2602.17254/integrity","json":"/paper/2602.17254/citation-record.json","paper":"/paper/2602.17254"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.134044Z","title":"Evensky, Joseph P","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.134044Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:de169cb22c48fb203d376fa0b6cdd7f65be9c7e018ff496ab7377b8990118767","observation_id":"322e5e0a-a9c6-483c-90c4-2f4cde2f6d4d","resolution":{"observed_at":"2026-08-02T22:21:52.134044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.209068Z","title":"Adiga and G","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.209068Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:f4eafa92993cf1f84020a4be411df1fb2d71e7565bed99b67540007adc00daf4","observation_id":"7f46b8c8-d753-4284-8cf3-2a5a2025c5e3","resolution":{"observed_at":"2026-08-02T22:21:52.209068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.276309Z","title":"Chris Erway, José E","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.276309Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:1ec9faad271909d22104db0b2137b40585b0230e39119cd02720a12aacf9a65a","observation_id":"0a79478f-ba98-46ff-aa4b-ad572f96904d","resolution":{"observed_at":"2026-08-02T22:21:52.276309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.352631Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.352631Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:00efd426b7aeedb6abdb639dc9ad627690e86e0ea8c12b93342c418bf33dcb8e","observation_id":"89e47ed5-3236-42f6-a737-bad7d72ed947","resolution":{"observed_at":"2026-08-02T22:21:52.352631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.427315Z","title":"Efficient algorithms for all-to-all communications in multi-port message-passing systems","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.427315Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:f1f8f3ecb1d8eece9231c995cc75b018be0b519afe70a5ae06b7b3a43e90e6c4","observation_id":"77ae33fe-32dc-4d75-ac49-a1291f5cfcde","resolution":{"observed_at":"2026-08-02T22:21:52.427315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.539553Z","title":"Synthesizing optimal collective algorithms","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.539553Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:57867b0fe40c670bfc6cb6d84e62685dab1c07df3e3f571a476bdede58966777","observation_id":"e3b71ee7-e723-4cc3-b115-7889a8fb6152","resolution":{"observed_at":"2026-08-02T22:21:52.539553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.657307Z","title":"Syccl: Exploiting symmetry for efficient collective communication scheduling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.657307Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:b75b63833d6be93edcc72f1973d5d80ca008a362b7e0b4df2115f4e6d6f9b1e3","observation_id":"3d231c2d-ccda-4cbc-8d77-5c6e196dc8b2","resolution":{"observed_at":"2026-08-02T22:21:52.657307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.818036Z","title":"Collective communication on architectures that support simultaneous communication over multiple links","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.818036Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:93d416c92405bf61e212a0ef7006e502e9480daf0b03583ad9860647e544102e","observation_id":"887b1f97-7035-4e1b-91eb-fcd292762609","resolution":{"observed_at":"2026-08-02T22:21:52.818036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:52.918258Z","title":"InSC18: International Conference for High Performance Computing, Networking, Storage and Analysis, pages 386–400, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:52.918258Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:1ba147f1a179eaa119e19f86777c715cc4c2cad7020af8ef251627b94ca3f2b7","observation_id":"496e95d0-d97a-4207-a0b5-d60a0f18ec2a","resolution":{"observed_at":"2026-08-02T22:21:52.918258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.004734Z","title":"Canary: Congestion-aware in-network allreduce using dynamic trees.Future Generation Computer Systems, 152:70–82, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.004734Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:117c35a82c40f9a9f233f110a04694554a3ff03e449867331feef8d97d6d110a","observation_id":"c0cb7cc1-a1db-4d3f-bc0c-b0946d11ba86","resolution":{"observed_at":"2026-08-02T22:21:53.004734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.286790Z","title":"InProceedings of the 36th ACM International Conference on Supercomputing, ICS ’22","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.286790Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:5d30748e20491e6a571b6c756f171d86cca9904531270374acc03a2d6ee8e6bf","observation_id":"5a2aa6a8-989b-4526-90fa-d03c97e0a31a","resolution":{"observed_at":"2026-08-02T22:21:53.286790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.442089Z","title":"Distributed training of large language models on aws trainium","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.442089Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:6ea6812c272923a84779c1d22c09773c5b98a4175c4fb1f3ca80cfb0f31b8e7d","observation_id":"05eb34e1-06b7-4708-929c-dbb649f90ed7","resolution":{"observed_at":"2026-08-02T22:21:53.442089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.531861Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.531861Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:47180c3b9e36ee53335f28f86f5f49ac7b88d9b3bbd003f55e3840a0c65216f8","observation_id":"c6b383cf-15d3-4baf-8fa8-3f9fc34afd9b","resolution":{"observed_at":"2026-08-02T22:21:53.531861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.646442Z","title":"Hammingmesh: A network topology for large-scale deep learning.Commun","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.646442Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:df24c0f7979c98e95324b321f7c814bd1e50d4ccbb72cd72242ad7669c762bea","observation_id":"4f0434ef-4e3f-4f48-b5f4-561fb83c2890","resolution":{"observed_at":"2026-08-02T22:21:53.646442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.734139Z","title":"Optimal bucket algorithms for large mpicollectivesontorusinterconnects","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.734139Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:74893da8665d5c908a51ebc8be064495eb4cd91aa4a825475404650de166e4cb","observation_id":"5e91d508-9329-404e-8ab9-b356dc4c3af2","resolution":{"observed_at":"2026-08-02T22:21:53.734139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.791515Z","title":"A simulator for large-scale parallel computer architectures.International Journal of Distributed Systems and Technologies (IJDST), 1(2):57–73, 2010","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.791515Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:298464083c3f1a519d38d7fa79503cf6812ab32fcfc8e42834363bc733c6761f","observation_id":"2cc1f96d-b1ed-4fd5-88c6-f0a90e039b2e","resolution":{"observed_at":"2026-08-02T22:21:53.791515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.866620Z","title":"Pat: a new algorithm for all-gather and reduce-scatter operations at scale, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.866620Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:61cee2fc0c0a36f119c45ee00d73e61a116155d3300193fc97e796288168dc25","observation_id":"a21c9782-6cd9-4dbc-899b-115fdb9b9860","resolution":{"observed_at":"2026-08-02T22:21:53.866620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:53.972623Z","title":"An optimisation of allreduce communication in message-passing systems.Parallel Computing, 107:102812, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:53.972623Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:dc34b7eb3b13e02f9bdbfae7021657a4424e90a09e0cdbad70f3871579eaad97","observation_id":"9f837824-bc38-4862-be69-e932e803e926","resolution":{"observed_at":"2026-08-02T22:21:53.972623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.047483Z","title":"Tpuv4:Anopticallyreconfigurablesupercomputerforma- chine learning with hardware support for embeddings","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.047483Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:5c9c390e27bfc5d153fe3c87af8fc18052f71d33decdbd3443e8aacc829dda65","observation_id":"1da77d29-20b5-4ea4-a8be-bf766bc98b10","resolution":{"observed_at":"2026-08-02T22:21:54.047483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.174744Z","title":"Tpuv4:Anopticallyreconfigurablesupercomputerformachine learning with hardware support for embeddings","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.174744Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:35e865ef7056328a1f2408aa68f8118c71e62b58032ea46f7e991d42d0629424","observation_id":"45831edb-248b-4a05-a5fb-89fdfdc1c8cf","resolution":{"observed_at":"2026-08-02T22:21:54.174744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.272305Z","title":"An in-networkarchitectureforacceleratingshared-memorymultiprocessor collectives","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.272305Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:353ec65da531721a52f1364c9a9edae8e9da501dd8b8ed83e4ca9fa3ad87ffa9","observation_id":"202d7521-bc28-4ca3-87b2-1401560ee836","resolution":{"observed_at":"2026-08-02T22:21:54.272305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09362","last_updated":"2020-04-21T10:58:08Z","snapshot_observed_at":"2026-08-07T03:16:37.193983Z","submitted_at":"2020-04-20T15:08:56Z","title":"A Generalization of the Allreduce Operation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09362","snapshot_observed_at":"2026-08-02T22:21:54.349272Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.349272Z"},"links":{"cited_paper":"/paper/2004.09362","citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:414a818d9fbce30d29ee4a12e9845bcdbcb0ca927f66fcaf8a529712850796f7","observation_id":"83274d9d-5e32-4da2-a8bd-7a79135295bf","resolution":{"observed_at":"2026-08-02T22:21:54.349272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.453625Z","title":"Understanding com- munication characteristics of distributed training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.453625Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:42c229a0e48261ce5db7586b6596a90d3889df09699644077270e0727ed24476","observation_id":"b172be75-4911-4f9c-9b8e-eacc76bb27ce","resolution":{"observed_at":"2026-08-02T22:21:54.453625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.560436Z","title":"Resccl: Resource- efficient scheduling for collective communication","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.560436Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:bd88c2cda60bc4ed12b6a546e7a4e23ac28d9d5d98d032c13108b75a808ac9e9","observation_id":"1a675e45-f4b2-4f27-b6d8-bdeebe112276","resolution":{"observed_at":"2026-08-02T22:21:54.560436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.638758Z","title":"Rethinking machine learning collective communication as a multi- commodityflowproblem","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.638758Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:d0edb183ac5cef6d3b29a4a6f6f02a383aae52263c9472bde41519ef8725236f","observation_id":"4109228a-2cbf-4c15-ba8c-54b8367fd1c1","resolution":{"observed_at":"2026-08-02T22:21:54.638758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.859808Z","title":"Paard: Proximity-aware all-reduce communication for dragonfly networks","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.859808Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:b8b53a88b5e179ad7ad21697246e9e017fc05e720d518a48bbcf4504f01201e4","observation_id":"3bd17811-2af4-4c97-897c-8230a814d8d7","resolution":{"observed_at":"2026-08-02T22:21:54.859808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.982016Z","title":"Efficient large-scale language model training on gpu clusters using megatron-lm","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.982016Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:33f4052b4ced1b5959961c23aad163e0e6bc3293dedecee0fa1db6b958ee22a8","observation_id":"1e408c83-f66c-4233-968b-49fea9f0f0fc","resolution":{"observed_at":"2026-08-02T22:21:54.982016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.068145Z","title":"Bandwidthoptimalall-reducealgorithms for clusters of workstations.Journal of Parallel and Distributed Computing, 69:117–124, 02 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.068145Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:921feaf8d30ad9e2511041d05444459cdcd5675c42ff8a56ba467163877c7b93","observation_id":"05f89a51-3c66-4b93-b1d3-af551d714ae6","resolution":{"observed_at":"2026-08-02T22:21:55.068145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.142864Z","title":"Automatic mpi counter profiling of all users: First results on a cray t3e 900-512","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.142864Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:bdf1121a8a5f1fa7ae2d3d9eaac1a6f08a053d1e421e58a4b1e012b1289eb5a2","observation_id":"c3756497-7c6f-49a4-bfcf-87fd9f1d6f57","resolution":{"observed_at":"2026-08-02T22:21:55.142864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.256086Z","title":"Optimization of collective reduction operations","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.256086Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:fa5d374e4f4f0748d296f1d4981b705dc69cdef8bd4cbc2ea3d331a4e891fda2","observation_id":"b23b78c1-5f05-46ce-8d1a-6ab2a1d1ed9b","resolution":{"observed_at":"2026-08-02T22:21:55.256086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.342219Z","title":"Rico-Gallego, Juan C","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.342219Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:91766616925bfb4ee57561274e1d41ba326720825e081af64664d2ab14beffd4","observation_id":"6fb3da22-3769-47ba-a9f0-1b358135b026","resolution":{"observed_at":"2026-08-02T22:21:55.342219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.416050Z","title":"Generalisation of recursive doubling for allreduce: Now with simulation.Parallel Computing, 69:24–44, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.416050Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:c1fa6c44fa4267477cf8577f71c27679a02909a64ce63de8a2dcfc8ddfcf2e33","observation_id":"dcd8cdb8-76c9-4019-b876-92003f1ff019","resolution":{"observed_at":"2026-08-02T22:21:55.416050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.492669Z","title":"Collective algorithms for multiported torus networks.ACM Trans","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.492669Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:85eb51f771c2267ad1cde6fa93949b1f21a42578ca71fae06cd7041f12dc1238","observation_id":"7d5195c4-f741-4b89-8c96-1e3eac3d4715","resolution":{"observed_at":"2026-08-02T22:21:55.492669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.568421Z","title":"Swing: Short-cutting rings for higher bandwidth allreduce","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.568421Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:a15d76514063866cbc6ee8e8ec68a70e4d9f6d53eb88a5a806fdf2622e192087","observation_id":"c3e6d533-0dcb-4afa-b86b-6c58b5482aba","resolution":{"observed_at":"2026-08-02T22:21:55.568421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.661413Z","title":"TACCL: Guiding collective algorithm synthesis using communication sketches","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.661413Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:bdbc812cb31834d303287629709f8f9be596a0397e70d4fc15871e325b2e4309","observation_id":"4ca4331c-49d2-48a3-b9e4-4af643c9956f","resolution":{"observed_at":"2026-08-02T22:21:55.661413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-02T22:21:55.729564Z","title":"Megatron-lm: Training multi- billion parameter language models using model parallelism.arXiv preprint arXiv:1909.08053, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.729564Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:9ce061a2a4a09eba71bb6d520b5995830d185144f9af0a7ac35a3f5e3b603850","observation_id":"4d9932b0-00c7-430e-a7b4-ce268ad05652","resolution":{"observed_at":"2026-08-02T22:21:55.729564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-02T22:21:55.804757Z","title":"Lamda: Language models for dialog applications.arXiv preprint arXiv:2201.08239, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.804757Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:81df52be2e72695ba944caed204317c0aa7834ea68f149b5465629630cf5b4eb","observation_id":"652c6504-58f1-4d9a-92c0-8cb7daca7882","resolution":{"observed_at":"2026-08-02T22:21:55.804757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:55.882781Z","title":"Decomposing mpi collectives for exploiting multi-lane communication","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:55.882781Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:65742332983ee858b983d3234d06518082ce51a57aad15cb154ac0dab3d8930e","observation_id":"ea0eb7c0-3e45-4338-94a2-d80e27e9ea27","resolution":{"observed_at":"2026-08-02T22:21:55.882781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:56.012272Z","title":"Enabling next-generation ai work- loads: Announcing tpu v5p and ai hypercomputer.Google Cloud, December, 6, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:56.012272Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:cdd8a475c93f93b4c5c4461e2f21506bc3cf49d780478fed4b7e733d63365ba0","observation_id":"61ce2e87-45a9-4a02-b617-374aa2d36497","resolution":{"observed_at":"2026-08-02T22:21:56.012272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:56.119673Z","title":"TopoOpt: Co-optimizing network topology and parallelization strategy for distributed training jobs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:56.119673Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:03fc1e7539db4d7accd981d76e5cbf51cd1a9dc0dd7ebc5b96bd5255b05ee973","observation_id":"7f815212-b5e8-4517-a69b-9d1091ecf1d6","resolution":{"observed_at":"2026-08-02T22:21:56.119673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:56.197015Z","title":"Efficient direct-connect topologies for collective communications, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:56.197015Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:0e7536ed9022fb93afc3a8edf672334b9a46bb1de89d317b08eebaba32807599","observation_id":"ea90c4cf-bed2-4309-a24d-27464a62b243","resolution":{"observed_at":"2026-08-02T22:21:56.197015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:56.314548Z","title":"Resiliencyatscale:Managinggoogle’stpuv4machine learning supercomputer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:56.314548Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:8036e01ac899c043aaabe908a85ab91d26a95b5efd92859646cb4c67ce3a5570","observation_id":"cf80ddd8-8d1f-4441-b80e-2f0765f0889a","resolution":{"observed_at":"2026-08-02T22:21:56.314548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:56.408830Z","title":"Bruck’s data transmission follows the same pattern asTrivance, but in step𝑘 the communication distances are 3𝑘 and 2·3 𝑘, resulting in a total congestion of3·3 𝑘 per step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:56.408830Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:88fafe4ded32904c301a9bfee954ead0e2431fbb106742905e6aadc5e99811d7","observation_id":"1f31d6a9-76f7-4ba5-ae78-5591f5702d43","resolution":{"observed_at":"2026-08-02T22:21:56.408830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T22:21:54.744011Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T22:21:54.744011Z"},"links":{"citing_paper":"/paper/2602.17254"},"observation_digest":"sha256:af815039206a745229d9ecca738deb9b6900e175bb8df5af4da75151975027ad","observation_id":"a1a1f4b2-9619-448d-afc2-bafe0b4507a8","resolution":{"observed_at":"2026-08-02T22:21:54.744011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.17254","last_updated":"2026-07-09T22:19:48Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-03T19:18:08.094530Z","submitted_at":"2026-02-19T10:57:16Z","title":"Trivance: Latency-Optimal AllReduce by Shortcutting Multiport Networks"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 2 inbound Pith citation observations for arXiv:2602.17254."}