{"as_of":"2026-08-10T14:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:268b57b4ce3580cefc8f5e096b1904f506e763b02b0d1e6a5914b1ae910d0b17","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T12:37:34.639991Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:23:12.827343Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:54:01.330849Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.03434","snapshot_observed_at":"2026-08-03T05:23:12.827343Z","title":"Paris: A decentralized trained open-weight diffusion model.arXiv preprint arXiv:2510.03434, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.02685","last_updated":"2026-07-31T13:53:26Z","snapshot_observed_at":"2026-08-09T05:23:14.922464Z","submitted_at":"2026-02-02T19:03:14Z","title":"Expert-Data Alignment Governs Generation Quality in Decentralized Diffusion Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T05:23:12.827343Z"},"links":{"cited_paper":"/paper/2510.03434","citing_paper":"/paper/2602.02685"},"observation_digest":"sha256:ef43b3c89314ae5acfed71cd9fc0b44ef8bd3bbf976ff34f47657535de0cfb7d","observation_id":"326aa4a1-8bed-479c-a1ed-5b70fd028b49","resolution":{"observed_at":"2026-08-03T05:23:12.827343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"cited_work":{"arxiv_id":"2510.03434","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.03434","snapshot_observed_at":"2026-08-03T03:15:20.746338Z","title":"Paris: A decentralized trained open-weight diffusion model","venue":null,"work_id":"364f3f48-e84a-49ba-9f3e-827ee9419065","year":2025},"citing_paper":{"arxiv_id":"2605.26064","last_updated":"2026-05-28T12:35:02Z","snapshot_observed_at":"2026-08-04T02:40:33.640225Z","submitted_at":"2026-05-25T17:27:22Z","title":"Paris 2.0: A Decentralized Diffusion Model for Video Generation","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T22:46:36.367934Z"},"links":{"cited_paper":"/paper/2510.03434","citing_paper":"/paper/2605.26064"},"observation_digest":"sha256:b8ce0aba93ecec9b3eb383937e134c241f3771defaf155146dc408f713109d29","observation_id":"c7878e71-a3fa-491a-8d0a-77bce1c54218","resolution":{"observed_at":"2026-08-03T03:15:20.746338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.03434","snapshot_observed_at":"2026-08-03T01:48:45.352980Z","title":"Paris: A decentralized trained open-weight diffusion model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.23909","last_updated":"2026-07-31T13:02:33Z","snapshot_observed_at":"2026-08-06T19:35:04.807879Z","submitted_at":"2026-07-27T00:55:10Z","title":"WorldDiT: A Unified Diffusion Architecture for World and Action Modeling","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T01:48:45.352980Z"},"links":{"cited_paper":"/paper/2510.03434","citing_paper":"/paper/2607.23909"},"observation_digest":"sha256:747237baff35d9a7b7ce1ab4562dcf41a61856212e9b8b9e176820fc655c0a2e","observation_id":"6f0571ee-3b41-4206-a5c3-2c11a65a3369","resolution":{"observed_at":"2026-08-03T01:48:45.352980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2510.03434/citation-record","integrity":"/paper/2510.03434/integrity","json":"/paper/2510.03434/citation-record.json","paper":"/paper/2510.03434"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-04T12:37:32.921700Z","title":"Layer normalization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:32.921700Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:307652acf2063c5ce058fb88eca5e50598cc142e14eed6120491fe031c0e68be","observation_id":"72190659-5e59-4cdd-aa08-d0817dd10ff8","resolution":{"observed_at":"2026-08-04T12:37:32.921700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-04T12:37:32.990859Z","title":"Pixart- : Fast training of diffusion transformer for photorealistic text-to-image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:32.990859Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:ffed13b93a178d168c41a96e2c940fd9f487301cd0e4ff912627307d1fa5b4b4","observation_id":"3266fca7-6121-459c-9ea9-bd02715c1019","resolution":{"observed_at":"2026-08-04T12:37:32.990859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-04T12:37:33.063771Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.063771Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:d99e119fca29bdb43602fc5a2c99fb6f46e498d05c430785e60143da80071f2d","observation_id":"ebb36620-1e58-4f58-b2b8-24d06819bf02","resolution":{"observed_at":"2026-08-04T12:37:33.063771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08105","last_updated":"2024-09-23T10:41:27Z","snapshot_observed_at":"2026-08-04T10:53:01.395272Z","submitted_at":"2023-11-14T12:05:45Z","title":"DiLoCo: Distributed Low-Communication Training of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08105","snapshot_observed_at":"2026-08-04T12:37:33.139636Z","title":"Diloco: Distributed low-communication training of language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.139636Z"},"links":{"cited_paper":"/paper/2311.08105","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:e38aaee3ac866aed1d511a175bb0d9d7f7f436067157940dab3169707144a425","observation_id":"735fd172-a4bc-4a6b-a7b2-3b5eb52e84cb","resolution":{"observed_at":"2026-08-04T12:37:33.139636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-04T12:37:33.214940Z","title":"Gaussian error linear units ( GELU s)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.214940Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:649a5f74e6f1af4eb16729ab645a56b7acc203af7b21e65394192a6de9e4bdce","observation_id":"9f0cc554-e99c-44b9-8ee9-b7407e2186e8","resolution":{"observed_at":"2026-08-04T12:37:33.214940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.273427Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.273427Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:e4f43ae28eebed5f9a73fb5e3daba166ef63282e98c9c4414d0b36128a8d57b3","observation_id":"b69e7c38-4f18-4203-b630-77567aad8b14","resolution":{"observed_at":"2026-08-04T12:37:33.273427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.350621Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.350621Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:2f31453b30f963d72ba2f269af51cd75db55f45e03c97bc95cc162507570a131","observation_id":"f32d92c7-1fea-4d9d-81b5-0b78532682dd","resolution":{"observed_at":"2026-08-04T12:37:33.350621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.426820Z","title":"Auto-encoding variational B ayes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.426820Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:bccdd3991875849bc542c0ce3d8467fd2a3a2a31f1de2ba7f3cae56cb1cd5f47","observation_id":"fcc03b6f-bcbf-4232-a263-8c5de40ecbe3","resolution":{"observed_at":"2026-08-04T12:37:33.426820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.465089Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.465089Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:5dbc9b97f2da274b9628cc3acda4de1d6b29eaaaf4280c9741b0e7c103110164","observation_id":"2fe7bba0-96c8-4a1c-94ee-c0be2a47bd5c","resolution":{"observed_at":"2026-08-04T12:37:33.465089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.537066Z","title":"SGDR : Stochastic gradient descent with warm restarts","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.537066Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:0e15e59549a31c076de94fcbb94e011a998d24c99a5cc25246eb551318446c48","observation_id":"aa4f3678-a5f3-4288-bcfc-3852b9cb1f9f","resolution":{"observed_at":"2026-08-04T12:37:33.537066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.604333Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.604333Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:5b7e8ed2eb8dfe74b582e0e50b0b4d5e39a726ef5db6c8123717b86d892d647b","observation_id":"be925c22-19c6-4104-9930-7d76b993a11a","resolution":{"observed_at":"2026-08-04T12:37:33.604333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.707363Z","title":"Some methods for classification and analysis of multivariate observations","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.707363Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:420ec336006b183cb670b0bc0fa0af85113b779ffbb3195a923391db8c7bf61a","observation_id":"5cd085c7-33c6-4159-aa44-4bb688d8ece7","resolution":{"observed_at":"2026-08-04T12:37:33.707363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.780486Z","title":"Decentralized diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.780486Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:f2832fa6c4fdb1cca1ea7be3917a12dbb3c579c8a78cd4b6400c1d4fceb15628","observation_id":"ed527d9a-fc94-4264-94d2-a9484127beea","resolution":{"observed_at":"2026-08-04T12:37:33.780486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.820285Z","title":"Mixed precision training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.820285Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:54cddb3f72bf2c6efe1a49d953758369672be8dc95ffe5ba0c11e165c9bbc308","observation_id":"e1c0bc11-4be8-46d1-a7c1-62e319f34377","resolution":{"observed_at":"2026-08-04T12:37:33.820285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:33.891274Z","title":"Pipedream: generalized pipeline parallelism for dnn training","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.891274Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:16ec68bf26bbb8f90d8558e24902174c59d58ad030b1e0e9b4b32e777e531571","observation_id":"6ee1cdc5-7d89-4288-b30d-6ce6d29383b2","resolution":{"observed_at":"2026-08-04T12:37:33.891274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-04T12:37:33.964550Z","title":"Dinov2: Learning robust visual features without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:33.964550Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:506fb84bf506b6955378094445e7d59af482dc41fe2f0b762e77c173dbc529ff","observation_id":"32b2923c-5369-49fb-9da5-c53d54b68d2c","resolution":{"observed_at":"2026-08-04T12:37:33.964550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-04T12:37:34.026679Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.026679Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:98189e6e5a9df2a0090c47a53fbcbe3c1a5c782b99e4ca1b2f3d8c82e08cd4d9","observation_id":"a55515ea-9bcb-42cb-a51d-ca8c1da7f540","resolution":{"observed_at":"2026-08-04T12:37:34.026679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:34.100004Z","title":"Acceleration of stochastic approximation by averaging","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.100004Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:eed6e424a27c8ef297b628e47b87568d09725ce206a993b239e303ae19983c63","observation_id":"cbb04702-061a-4314-95e3-fd3e4994b6f2","resolution":{"observed_at":"2026-08-04T12:37:34.100004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:34.175483Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.175483Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:b56261abc24ec15164dfc084b6be049a09be12f28620b9f26e0658f6c730ddaf","observation_id":"93602a09-5f11-4bdb-952e-1b0f8f8aee53","resolution":{"observed_at":"2026-08-04T12:37:34.175483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:34.241316Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.241316Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:825e95a3dd93a0acd7c77667e8778e215b922c75a4857ab1601bdefcb4f04414","observation_id":"67e98256-4403-4dcf-a1a4-fe17f9bb52e4","resolution":{"observed_at":"2026-08-04T12:37:34.241316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:34.282957Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.282957Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:e0ad4cce6e7e83dcf458ae8130252e263535aa3d1f2cdb2e77b3da5339167341","observation_id":"1e8077c2-f2de-4808-8046-46ca22e8ea5a","resolution":{"observed_at":"2026-08-04T12:37:34.282957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:34.348119Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.348119Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:7f1a990ff2585249f29dc0a9f0685e04a1200b8e305851d8ef05ccb75046c76f","observation_id":"0b5980ef-3596-4b4a-95c9-c5f16b4b8354","resolution":{"observed_at":"2026-08-04T12:37:34.348119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:34.420183Z","title":"LAION -5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.420183Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:47e92210754c6b00e911b499847dfdc6fab7f2ae5020100019e3004b7ed69b7b","observation_id":"c7c31341-8965-4077-92a3-306489a1f130","resolution":{"observed_at":"2026-08-04T12:37:34.420183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-04T12:37:34.494938Z","title":"Megatron-lm: Training multi-billion parameter language models using model parallelism","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.494938Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:2c6350134389d973c492d435e09abfa731e0a48271558df9764d5e6dc54ef632","observation_id":"910c9db4-7a21-4434-a24f-66e4763a9188","resolution":{"observed_at":"2026-08-04T12:37:34.494938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09767","last_updated":"2019-05-03T12:58:04Z","snapshot_observed_at":"2026-07-06T06:41:03.009337Z","submitted_at":"2018-05-24T16:38:51Z","title":"Local SGD Converges Fast and Communicates Little","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09767","snapshot_observed_at":"2026-08-04T12:37:34.570796Z","title":"Local sgd converges fast and communicates little","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.570796Z"},"links":{"cited_paper":"/paper/1805.09767","citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:4d40315da6a5a6a7726255d881c4087cb60facb52dcb5ea45ca8a0f49de750d1","observation_id":"ea7c4030-4c06-4afa-81b5-7303a6c385ea","resolution":{"observed_at":"2026-08-04T12:37:34.570796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:37:34.639991Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T12:37:34.639991Z"},"links":{"citing_paper":"/paper/2510.03434"},"observation_digest":"sha256:a22946ea7e7404e447632be90bb5ef1a3a51452d2e013b06369b9e7c018db08f","observation_id":"86362449-6df3-4a77-93f3-8afefe93e581","resolution":{"observed_at":"2026-08-04T12:37:34.639991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.03434","last_updated":"2026-07-31T16:40:13Z","latest_version":3,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-08T01:35:00.151253Z","submitted_at":"2025-10-03T18:53:12Z","title":"Paris: A Decentralized Trained Open-Weight Diffusion Model"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 3 inbound Pith citation observations for arXiv:2510.03434."}