{"as_of":"2026-08-14T23:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:012f8e236f33a601a6cafe3ad15af28a58ee103be416c686052e96b2de62b31a","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:16:42.284264Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.05460/citation-record","integrity":"/paper/1908.05460/integrity","json":"/paper/1908.05460/citation-record.json","paper":"/paper/1908.05460"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.099777Z","title":"Tensorﬂow: A system for large-scale machine learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.099777Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:80f128d18290b155597c38d45bce18da538484e48054c4cd3f6a359e0b233bc1","observation_id":"7983f3b1-cdf4-4db8-bf40-ba9e0102f779","resolution":{"observed_at":"2026-08-14T13:16:42.099777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08079","last_updated":"2021-10-25T18:12:28Z","snapshot_observed_at":"2026-08-14T19:12:58.498616Z","submitted_at":"2018-05-21T14:14:14Z","title":"Faster Neural Network Training with Approximate Tensor Operations","version":3},"cited_work":{"arxiv_id":"1805.08079","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.08079","snapshot_observed_at":"2026-08-14T13:16:42.738710Z","title":"Faster Neural Network Training with Approximate Tensor Operations","venue":"cs.LG","work_id":"9fffb43d-b93b-4d6c-9716-c49506014cc4","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.106374Z"},"links":{"cited_paper":"/paper/1805.08079","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:b8f6adfe5b92eccc3ac9b0f39dae2138daf9ef34ef1b2bbb643e507506efc04b","observation_id":"31af04a7-cb31-496d-a8cd-ee3b94c15c51","resolution":{"observed_at":"2026-08-14T13:16:42.744748Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.04325","last_updated":"2017-11-12T17:36:46Z","snapshot_observed_at":"2026-08-14T20:14:31.158660Z","submitted_at":"2017-11-12T17:36:46Z","title":"Extremely Large Minibatch SGD: Training ResNet-50 on ImageNet in 15 Minutes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.04325","snapshot_observed_at":"2026-08-14T13:16:42.112438Z","title":"Ex- tremely large minibatch sgd: Training resnet-50 on imagenet in 15 minutes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.112438Z"},"links":{"cited_paper":"/paper/1711.04325","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:15c86ed9033fc7aad26322cde9679c3569f401e8a4ef5316f77d1c72291a9be1","observation_id":"0e85f209-f582-4381-8085-7ed962bb8db3","resolution":{"observed_at":"2026-08-14T13:16:42.112438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.953104Z","title":"Assessing the scalability of biologically-motivated deep learning algo- rithms and architectures","venue":null,"work_id":"b9b9ff05-1a42-4251-9cf6-5579d54c96d6","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.118045Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:526b75c6582d57a5268e43a16e9b3aef7597f89bc4ce2b2c16fccf13e78e1e2c","observation_id":"51723726-9f5c-4b01-9052-96c327c0b38e","resolution":{"observed_at":"2026-08-14T13:16:42.959217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.10280","last_updated":"2019-04-03T21:11:27Z","snapshot_observed_at":"2026-08-14T19:41:19.524730Z","submitted_at":"2018-02-28T06:31:45Z","title":"Escoin: Efficient Sparse Convolutional Neural Network Inference on GPUs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.10280","snapshot_observed_at":"2026-08-14T13:16:42.123375Z","title":"Escort: Efﬁcient sparse convolutional neural networks on gpus","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.123375Z"},"links":{"cited_paper":"/paper/1802.10280","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:9d68f1988939c4e5a52062e38e3a839b2e34cd2fd5643d3d2b357c532d7cea72","observation_id":"91e53907-8f7d-47e3-bbf9-5df0ef954482","resolution":{"observed_at":"2026-08-14T13:16:42.123375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1410.0759","last_updated":"2014-12-18T01:13:16Z","snapshot_observed_at":"2026-08-12T16:41:16.972891Z","submitted_at":"2014-10-03T06:16:43Z","title":"cuDNN: Efficient Primitives for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1410.0759","snapshot_observed_at":"2026-08-14T13:16:42.129369Z","title":"cudnn: Efﬁcient primitives for deep learning","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.129369Z"},"links":{"cited_paper":"/paper/1410.0759","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:f4985a78ef48fa24f9b6dc57935f9ce21d8c69987586b508dd54e18775ed6108","observation_id":"f2ae8905-b22e-44de-b3e8-eddb5ff4c89c","resolution":{"observed_at":"2026-08-14T13:16:42.129369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.06949","last_updated":"2019-11-23T05:51:53Z","snapshot_observed_at":"2026-08-14T19:05:04.444844Z","submitted_at":"2018-06-11T18:40:33Z","title":"Full deep neural network training on a pruned weight budget","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.06949","snapshot_observed_at":"2026-08-14T13:16:42.135559Z","title":"Drop- back: Continuous pruning during training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.135559Z"},"links":{"cited_paper":"/paper/1806.06949","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:d6e668b8d2628adce3c75cb73fcb450a6b8bb2f1396ab3755fca65571e5a33b4","observation_id":"f091178e-2f58-42ea-bcab-d9738141dc0e","resolution":{"observed_at":"2026-08-14T13:16:42.135559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.01307","last_updated":"2017-06-05T13:25:24Z","snapshot_observed_at":"2026-08-14T20:56:04.444944Z","submitted_at":"2017-06-05T13:25:24Z","title":"Submanifold Sparse Convolutional Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.01307","snapshot_observed_at":"2026-08-14T13:16:42.142188Z","title":"Sub- manifold sparse convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.142188Z"},"links":{"cited_paper":"/paper/1706.01307","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:33d2c12d330c42c84d2c656ea8407349a25a7612b6e48c13aa3491e35de025d5","observation_id":"a7cd2657-ae21-438b-9044-a5b75219df34","resolution":{"observed_at":"2026-08-14T13:16:42.142188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09224","last_updated":"2018-06-07T14:59:11Z","snapshot_observed_at":"2026-08-14T20:10:16.632375Z","submitted_at":"2017-11-25T09:34:12Z","title":"CondenseNet: An Efficient DenseNet using Learned Group Convolutions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09224","snapshot_observed_at":"2026-08-14T13:16:42.151217Z","title":"Gpu kernels for block-sparse weights","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.151217Z"},"links":{"cited_paper":"/paper/1711.09224","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:2d5f86ad3eae5627c1f07bc00fe34fab325169da92522d04caef54e422eedb26","observation_id":"0f0d28b1-b772-444c-a4ab-a5e4b562527f","resolution":{"observed_at":"2026-08-14T13:16:42.151217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.01986","last_updated":"2019-01-06T04:36:38Z","snapshot_observed_at":"2026-08-14T17:34:41.684746Z","submitted_at":"2019-01-06T04:36:38Z","title":"Efficient Convolutional Neural Network Training with Direct Feedback Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.01986","snapshot_observed_at":"2026-08-14T13:16:42.156740Z","title":"Efﬁcient convolutional neural network training with direct feedback alignment","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.156740Z"},"links":{"cited_paper":"/paper/1901.01986","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:5804f035a7268a0cafba20b36def078ed5e6ddcdc0c613ecef7706dd1464e78b","observation_id":"1f3ba43b-b01f-4f79-ae4a-712a5543bfc7","resolution":{"observed_at":"2026-08-14T13:16:42.156740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-14T13:16:42.162140Z","title":"Deep com- pression: Compressing deep neural networks with pruning, trained quantization and huffman coding","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.162140Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:e9cf80d4cbad9bf836762e5b4757392b3c81ca2b44da88321addfe2c18db0120","observation_id":"8d90145f-eef0-4d49-b8d7-a525451618fe","resolution":{"observed_at":"2026-08-14T13:16:42.162140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.167926Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.167926Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:32d34427dcb01ddf29d91b2223b0720b3055eb12df30732819c09205cbbec573","observation_id":"f14abb1f-c29f-43e6-906e-32acff717243","resolution":{"observed_at":"2026-08-14T13:16:42.167926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03167","last_updated":"2015-03-02T20:44:12Z","snapshot_observed_at":"2026-08-12T21:01:12.961874Z","submitted_at":"2015-02-11T01:44:18Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03167","snapshot_observed_at":"2026-08-14T13:16:42.173980Z","title":"Batch normalization: Accelerating deep network training by reducing internal co- variate shift","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.173980Z"},"links":{"cited_paper":"/paper/1502.03167","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:7eb329fbc1f033acca16b96e71dc67aa8b304a35280a097a6f988dbf9d0e38cd","observation_id":"d8e960d7-d28f-4df4-8983-d0b934e3da5f","resolution":{"observed_at":"2026-08-14T13:16:42.173980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.11205","last_updated":"2018-07-30T07:40:44Z","snapshot_observed_at":"2026-08-14T18:46:32.146288Z","submitted_at":"2018-07-30T07:40:44Z","title":"Highly Scalable Deep Learning Training System with Mixed-Precision: Training ImageNet in Four Minutes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.11205","snapshot_observed_at":"2026-08-14T13:16:42.179210Z","title":"Highly scalable deep learn- ing training system with mixed-precision: Training imagenet in four minutes","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.179210Z"},"links":{"cited_paper":"/paper/1807.11205","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:92f091e40e3bc283029130d5bb5297a1fd2403d0b735e35d0c595dfda20c4531","observation_id":"89362087-01b3-42d1-bae3-464b631693ea","resolution":{"observed_at":"2026-08-14T13:16:42.179210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.927305Z","title":"In-datacenter per- formance analysis of a tensor processing unit","venue":null,"work_id":"6720e3ac-13e2-4870-ae98-ff8ecedad3e7","year":2017},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.184395Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:b0c19042f89eae97c1e2c693eaad82c5e0376127c9e3506c1ea4fcc6496fa549","observation_id":"f01ee53d-90ef-4e0e-a8d0-76bc1b98fde5","resolution":{"observed_at":"2026-08-14T13:16:42.932388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.189783Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.189783Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:95b8f4aa7adf7569b4b7e8d1c685e118e9e7eb01803695f8ad926724ce342a36","observation_id":"591d4183-f787-4242-9beb-fef6d808d01c","resolution":{"observed_at":"2026-08-14T13:16:42.189783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.896892Z","title":"Random synaptic feedback weights support error backpropagation for deep learning","venue":null,"work_id":"db09bfe4-d7a5-4794-a0e5-654aa25a0a0c","year":2016},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.194884Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:eacbcf9ad47618b772f25a8a5b157ff79cc4fe5aee64eafee1944e48b8ebb365","observation_id":"575a2363-3490-48a7-8e61-45ea86cb9b54","resolution":{"observed_at":"2026-08-14T13:16:42.902270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06367","last_updated":"2018-02-18T12:29:05Z","snapshot_observed_at":"2026-08-14T19:44:50.280460Z","submitted_at":"2018-02-18T12:29:05Z","title":"Efficient Sparse-Winograd Convolutional Neural Networks","version":1},"cited_work":{"arxiv_id":"1802.06367","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.06367","snapshot_observed_at":"2026-08-14T13:16:42.503511Z","title":"Efficient Sparse-Winograd Convolutional Neural Networks","venue":"cs.CV","work_id":"4bff47ed-b46d-4f22-bddd-64f30f0e9531","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.199761Z"},"links":{"cited_paper":"/paper/1802.06367","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:5f670dbd40a7bbcca0813acd57604796bf03658375abd2daeb8937ee3e5e31f3","observation_id":"91be7638-96d5-4028-b44c-559d83b2cdb8","resolution":{"observed_at":"2026-08-14T13:16:42.510234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.09290","last_updated":"2019-12-09T06:06:16Z","snapshot_observed_at":"2026-08-14T17:25:28.129521Z","submitted_at":"2019-01-26T23:18:49Z","title":"PruneTrain: Fast Neural Network Training by Dynamic Sparse Model Reconfiguration","version":5},"cited_work":{"arxiv_id":"1901.09290","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.09290","snapshot_observed_at":"2026-08-14T13:16:42.468757Z","title":"PruneTrain: Fast Neural Network Training by Dynamic Sparse Model Reconfiguration","venue":"cs.LG","work_id":"b128e6a1-ff8b-4f36-8c03-17bb55525f60","year":2019},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.204886Z"},"links":{"cited_paper":"/paper/1901.09290","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:04256b9a8fcf824d8f2177d19b431d3835ebaf35df078e33975d0c4657576b39","observation_id":"f3a616b6-bc4a-4994-a190-80a78a97a071","resolution":{"observed_at":"2026-08-14T13:16:42.475638Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.878961Z","title":"Nvidia tensor core pro- grammability, performance & precision","venue":null,"work_id":"f49d5cd8-b493-4bcb-a1b4-f4148088c1f9","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.210406Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:c7c58b18b8d880943eaf5199bb9608a5564bb60529f5c7b98e8ff7ca4a12ff8e","observation_id":"7a1f96b1-5249-406a-9446-a614e1ed6d7a","resolution":{"observed_at":"2026-08-14T13:16:42.884296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-08-12T13:00:33.339808Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-14T13:16:42.215383Z","title":"Mixed precision training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.215383Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:7ad5bc7fabb133c517783fba7d66e5194dec6ba46ee2da4e4f30c5c8dcfae6c8","observation_id":"d2e23773-3dda-4671-8d47-181378aba173","resolution":{"observed_at":"2026-08-14T13:16:42.215383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.862338Z","title":"Direct feedback alignment provides learning in deep neural networks","venue":null,"work_id":"8f244554-3907-4651-89f2-c1f3e98feae9","year":2016},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.221200Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:bff8870ad9654e3b8653b7a3923aa8d8d1e5301a8f8f15ce54b9f2f7540ba4c9","observation_id":"8103b93a-4f6f-4aac-a32b-655a54f98442","resolution":{"observed_at":"2026-08-14T13:16:42.867883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.01409","last_updated":"2017-07-28T22:26:27Z","snapshot_observed_at":"2026-08-14T21:45:30.021228Z","submitted_at":"2016-08-04T01:16:39Z","title":"Faster CNNs with Direct Sparse Convolutions and Guided Pruning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.01409","snapshot_observed_at":"2026-08-14T13:16:42.226280Z","title":"Faster cnns with di- rect sparse convolutions and guided pruning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.226280Z"},"links":{"cited_paper":"/paper/1608.01409","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:c95c7e61abda9b97713ef9a5a56459b566e80fce9705cdcae52fb66bcfc3b467","observation_id":"b1c53001-d8c0-4f9c-afc9-b881a6cb1417","resolution":{"observed_at":"2026-08-14T13:16:42.226280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.844984Z","title":"Sbnet: Sparse blocks network for fast inference","venue":null,"work_id":"42eccec3-0d96-4c7f-90b5-04aeddc73b95","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.231479Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:68bc5e06f1ad51bc505d1c2b8106bbd7b5fc8cacdf1d0072d21b6a6f13999579","observation_id":"91242104-9158-4d41-bc59-5831165d8e54","resolution":{"observed_at":"2026-08-14T13:16:42.850406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-14T04:13:35.056640Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-14T13:16:42.236265Z","title":"Very deep convo- lutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.236265Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:119540cd6f50e3acb7be3ad09f9e2ed4ef5d92facafa553c87333ba4871e854b","observation_id":"1a545ae2-9a96-4ae5-b738-c389316f6481","resolution":{"observed_at":"2026-08-14T13:16:42.236265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.826168Z","title":"meprop: Sparsiﬁed back propagation for accelerated deep learning with reduced overﬁtting","venue":null,"work_id":"1f3274c1-3d1f-43d5-a453-4875d013c9bd","year":2017},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.241521Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:7beadd9994501a32dcdfb4c48fc991116de0b83c161f1a010d96a7cb96470d96","observation_id":"08af80e6-dcfe-4b67-8567-d858551a38b4","resolution":{"observed_at":"2026-08-14T13:16:42.831866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.809118Z","title":"Training simpliﬁcation and model simpliﬁcation for deep learning: A minimal effort back propagation method.IEEE Transactions on Knowledge and Data Engineering, 2018","venue":null,"work_id":"dff10bf5-3c5b-49a9-9ba5-25a7b29805b1","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.247702Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:aef0b34bd310a1d5935de6dd3c1ba4f384cebb537a69cd50cd0a575dac3e667d","observation_id":"6b8c0fac-8cda-4774-a70d-9374af2d9bc8","resolution":{"observed_at":"2026-08-14T13:16:42.814552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.792420Z","title":"Gra- dient sparsiﬁcation for communication-efﬁcient distributed optimization","venue":null,"work_id":"1b2616b8-e9df-4312-93a6-47bb5ce3bdab","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.252711Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:623b267641780189f0fd5988e468c50d8e49d7031327b18d9f09a08298630f28","observation_id":"d89334ce-7185-4ad0-9dbc-76a2cb57f197","resolution":{"observed_at":"2026-08-14T13:16:42.797835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.05804","last_updated":"2017-09-18T08:07:40Z","snapshot_observed_at":"2026-08-14T20:32:17.565915Z","submitted_at":"2017-09-18T08:07:40Z","title":"Minimal Effort Back Propagation for Convolutional Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.05804","snapshot_observed_at":"2026-08-14T13:16:42.258733Z","title":"Minimal effort back propagation for convolutional neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.258733Z"},"links":{"cited_paper":"/paper/1709.05804","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:74befabc9a6e0e85a4d0853b0a0f5af2f0bfb31f1be17bb2e2c57a8f1f436fdf","observation_id":"86399129-5caa-4169-aff1-c223faea57c5","resolution":{"observed_at":"2026-08-14T13:16:42.258733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.774399Z","title":"Terngrad: Ternary gradi- ents to reduce communication in distributed deep learning","venue":null,"work_id":"49de428f-d12e-4dc4-93dd-5c4644ce9b99","year":2017},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.264854Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:4866b57c5213849b324d514c7654b77629367f87d7035120737b3ae0efae21c5","observation_id":"d3612027-5bfd-46c5-8fe0-781580d70229","resolution":{"observed_at":"2026-08-14T13:16:42.780206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.03567","last_updated":"2018-12-21T02:03:52Z","snapshot_observed_at":"2026-08-14T18:02:03.964748Z","submitted_at":"2018-11-08T17:43:59Z","title":"Biologically-plausible learning algorithms can scale to large datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.03567","snapshot_observed_at":"2026-08-14T13:16:42.270519Z","title":"Biologically-plausible learning algorithms can scale to large datasets","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.270519Z"},"links":{"cited_paper":"/paper/1811.03567","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:908dd66e48d81c2b80206451024ef177055ef5cad890a4546c546cdaf1315414","observation_id":"e0c687f7-e52f-483e-ae86-2f82a2ed6b85","resolution":{"observed_at":"2026-08-14T13:16:42.270519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:16:42.756490Z","title":"Imagenet training in minutes","venue":null,"work_id":"1f5c502d-f7db-4608-8212-dbbde4139acb","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.276916Z"},"links":{"citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:fc2bd872836ccba8dc2466f5900b19918af8356b15ce5593ecb846ae0fe21587","observation_id":"911a5974-972a-4e8a-8187-b416a1ff5684","resolution":{"observed_at":"2026-08-14T13:16:42.761777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00512","last_updated":"2018-06-01T19:08:30Z","snapshot_observed_at":"2026-08-14T19:08:23.932671Z","submitted_at":"2018-06-01T19:08:30Z","title":"Structurally Sparsified Backward Propagation for Faster Long Short-Term Memory Training","version":1},"cited_work":{"arxiv_id":"1806.00512","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.00512","snapshot_observed_at":"2026-08-14T13:16:42.332085Z","title":"Structurally Sparsified Backward Propagation for Faster Long Short-Term Memory Training","venue":"cs.LG","work_id":"9f26c4c1-a67d-4bc6-9cbb-02cc024e370b","year":2018},"citing_paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T13:16:42.284264Z"},"links":{"cited_paper":"/paper/1806.00512","citing_paper":"/paper/1908.05460"},"observation_digest":"sha256:faea4d3894bf127af47dab5ab8f87a6eda79cbe42f09da1680cdedd574cb0fa0","observation_id":"e1c89aeb-b8db-488b-b27f-015afa22fb7c","resolution":{"observed_at":"2026-08-14T13:16:42.341246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.05460","last_updated":"2019-08-15T09:11:31Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T13:10:50.167375Z","submitted_at":"2019-08-15T09:11:31Z","title":"Accelerated CNN Training Through Gradient Approximation"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":4,"verified_fuzzy":11},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:1908.05460."}