{"as_of":"2026-08-07T19:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f15a5842d8719249d6c32071e9d87dfde3c107db7037f98514ededdafc4553f7","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:21:33.430685Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05679/citation-record","integrity":"/paper/2509.05679/integrity","json":"/paper/2509.05679/citation-record.json","paper":"/paper/2509.05679"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.372794Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.372794Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:5851647bf83a9f91687e1070208c69066498bc1f54d27b6a12b137d4e5915dee","observation_id":"45c34ba4-4401-4925-b0e6-6fc481ed14d3","resolution":{"observed_at":"2026-08-05T05:21:33.372794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.603504Z","title":"Stochastic gradient push for distributed deep learning","venue":null,"work_id":"1ae22e93-9264-41e9-8f9c-cf8e55271ad8","year":2019},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.376884Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:1efe534e894e5a152a1b62056914fea9e1bef5bae417efcc6803892c806af6b9","observation_id":"d14408f8-0943-4bab-930d-db4521890332","resolution":{"observed_at":"2026-08-05T05:21:33.606472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.595645Z","title":"E., and Nocedal, J","venue":null,"work_id":"4f54e356-afa1-44ea-8595-f0db6b90b1cc","year":2018},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.379849Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:e7f519c7816f250df13167cea78726c00e6668556831b5fb16fcbb58e0a7af6b","observation_id":"5ecb43f6-4f4e-47fa-b92f-be0d0a71839f","resolution":{"observed_at":"2026-08-05T05:21:33.598531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.587665Z","title":"R., and Kumar, G","venue":null,"work_id":"068f67a2-e71b-4a43-a13c-9e93ce8592b3","year":2020},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.382736Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:26499fe5dd326ec772938ebedfa8ccfcfa7b18582b8b6f7386dfd0123ed4f2af","observation_id":"0bb4554e-c992-4b08-8988-b311671ca267","resolution":{"observed_at":"2026-08-05T05:21:33.590617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.579682Z","title":"V., Mazur, D., Kobelev, I., Jernite, Y., Wolf, T., and Pekhimenko, G","venue":null,"work_id":"70712201-bcc9-4788-b7be-6b2d557f842a","year":2021},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.386825Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:9c114179e9b8bcc1f091983e205c947df8fa8fde7c7c55aa808362823f87a6f1","observation_id":"6559bf91-b7aa-48d2-800e-91b18c94b145","resolution":{"observed_at":"2026-08-05T05:21:33.582636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.570734Z","title":"Skin lesion classification with ensembles of deep convolutional neural networks","venue":null,"work_id":"5ed5d489-2917-4d07-b88f-6b813a173340","year":2018},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.389721Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:50b507fa9c6c6602994df7c64743d1133a2a7cdf9a81731effd32924b9c0c70f","observation_id":"6c2a2149-d9f4-449f-b713-28d599ec19e6","resolution":{"observed_at":"2026-08-05T05:21:33.574234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.561449Z","title":"Decoupled parallel backpropagation with convergence guarantee","venue":null,"work_id":"f6e40f05-57d7-43d5-9c43-1cdef6059a77","year":2018},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.392565Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:9b1e284c2c4bfa23fa920151036db45517165fc07a168af4b6b5f19849fb9928","observation_id":"97224f71-195d-4118-855d-499e5440ca61","resolution":{"observed_at":"2026-08-05T05:21:33.565022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.551711Z","title":"M., Osindero, S., Vinyals, O., Graves, A., Silver, D., and Kavukcuoglu, K","venue":null,"work_id":"4d4bb20a-d4fb-49e4-92e1-a69b646188e2","year":2017},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.395791Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:53bfeba842731ab41b1a8eda7e251887c705e44273c92a90f3a6090d0d450f01","observation_id":"364409bb-8694-487c-8730-5aaac9e0f710","resolution":{"observed_at":"2026-08-05T05:21:33.554951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.542611Z","title":"I., Galambos, P., Kuti, J., and Rudas, I","venue":null,"work_id":"21f4ec6f-005a-4766-868a-85af1d872e97","year":2021},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.398888Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:1e0f3f48321726ce606a9e1c90990dd6364c0fa501e5fee06b171562f7e5024c","observation_id":"66f592ca-7560-4ce5-ac83-e6d5b8d488fd","resolution":{"observed_at":"2026-08-05T05:21:33.545643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09910","last_updated":"2020-04-21T11:27:00Z","snapshot_observed_at":"2026-07-06T09:14:01.227657Z","submitted_at":"2020-04-21T11:27:00Z","title":"torchgpipe: On-the-fly Pipeline Parallelism for Training Giant Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09910","snapshot_observed_at":"2026-08-05T05:21:33.401623Z","title":"torchgpipe: On-the-fly pipeline parallelism for training giant models","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.401623Z"},"links":{"cited_paper":"/paper/2004.09910","citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:72dd1066b45ab36bd7aa548fe2038c87044d98e30174761b21e718b8bdfc2859","observation_id":"004d58b6-965b-43dd-95ff-bb682bec1673","resolution":{"observed_at":"2026-08-05T05:21:33.401623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.532513Z","title":"Agrawal, D","venue":null,"work_id":"b45afb52-d506-49d5-8381-786e29bd93f2","year":2017},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.405112Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:9497949b69e1d7abe5741da65e941417c479f44f94592459f632646ff8316b01","observation_id":"4f452358-c745-4614-a139-30df05d97892","resolution":{"observed_at":"2026-08-05T05:21:33.536096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.523864Z","title":"Error-tolerant deep learning for remote sensing image scene classification","venue":null,"work_id":"4ad2949e-a077-46e6-9076-2f9e5b7dc238","year":2021},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.409272Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:cff8cf6dbf72d895709d4dfd648969ee338a17df968184b1714ee8375bff8dd1","observation_id":"a192df52-0fca-4b0b-962b-8a94ce72ab1d","resolution":{"observed_at":"2026-08-05T05:21:33.527282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.514905Z","title":"A review of deep learning techniques for speech processing","venue":null,"work_id":"370e71f8-7d6f-4fe6-94ae-0980f229e434","year":2023},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.413282Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:c1edea3a506f7cfee3c13065e612e0003ded47d8925c41d7dea336d255f2baba","observation_id":"043be1f3-b244-4dbe-bf0d-ec8b693297e5","resolution":{"observed_at":"2026-08-05T05:21:33.518578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.00562","last_updated":"2019-09-09T06:12:02Z","snapshot_observed_at":"2026-08-04T09:39:03.435955Z","submitted_at":"2019-09-02T06:41:34Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","version":2},"cited_work":{"arxiv_id":"1909.00562","doi":"10.48550/arxiv.1909.00562","metadata_source":"pith","pith_arxiv_id":"1909.00562","snapshot_observed_at":"2026-08-05T06:16:20.379382Z","title":"Hybrid Data-Model Parallel Training for Sequence-to-Sequence Recurrent Neural Network Machine Translation","venue":"cs.DC","work_id":"ba5b03de-9599-4783-b1fb-de2ba0a5e63f","year":2019},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.416076Z"},"links":{"cited_paper":"/paper/1909.00562","citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:6366f9b2a7a62dbcefa763a301f469f4ccf0ee4dcaf25f75a1a344092f6f96fb","observation_id":"8332ef49-80b5-4f9f-bad0-461154ebc150","resolution":{"observed_at":"2026-08-05T05:21:33.456547Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.505699Z","title":"E., Hinton, G","venue":null,"work_id":"71a76475-f7ee-457a-ac52-e91e352965e6","year":1986},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.419435Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:05dea749a88055f9a2ec2122b81c62bd3d65bafaf0b78949b8f32eaa91b7fdff","observation_id":"d751f7a2-9c45-430a-9cb0-fc3a20e17c95","resolution":{"observed_at":"2026-08-05T05:21:33.508618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.496678Z","title":"Hypar: Towards hybrid parallelism for deep learning accelerator array","venue":null,"work_id":"1764da11-6b51-408a-87b4-edb2d68d38e6","year":2019},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.422161Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:69c45405e81d568bd5636cdc87ad871cb3e8f6579241134d583da4145c71ec17","observation_id":"28a6a4a6-5c21-4d5a-850f-4aab2cfdbba3","resolution":{"observed_at":"2026-08-05T05:21:33.499829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.488032Z","title":"Drps: efficient disk-resident parameter servers for distributed machine learning","venue":null,"work_id":"4c6bd55f-8959-4c68-9639-3c6c18b66d7c","year":2021},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.424807Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:bb60c608addca9ada4b067d94409f1654a2e799e54d93ecb1edc0d4720a78a10","observation_id":"2ffc3f0c-0927-4b1a-a210-76b26e19e1a6","resolution":{"observed_at":"2026-08-05T05:21:33.491066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.479632Z","title":"and Boyd, S","venue":null,"work_id":"b6bd09ed-baf0-4887-ad66-d704ca68081f","year":2004},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.427553Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:6064c4aff57c2c78637a0c5802b443a621e01c5d451d19fc0bbf9f6a42689263","observation_id":"7f4b274d-86e1-4a52-a42b-9e1812971f05","resolution":{"observed_at":"2026-08-05T05:21:33.482600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:33.470405Z","title":"Fully decoupled neural network learning using delayed gradients","venue":null,"work_id":"2b468f59-ff42-40fe-b83c-0fd28f535777","year":2022},"citing_paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T05:21:33.430685Z"},"links":{"citing_paper":"/paper/2509.05679"},"observation_digest":"sha256:b077664bb591bdef598c02313ba631a18f8322db2766b7d418ce2356a2708a80","observation_id":"f603a47e-786d-4232-816c-4e1115272773","resolution":{"observed_at":"2026-08-05T05:21:33.473721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.05679","last_updated":"2025-09-06T11:05:40Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T05:21:28.868536Z","submitted_at":"2025-09-06T11:05:40Z","title":"Distributed Deep Learning using Stochastic Gradient Staleness"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":2,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:2509.05679."}