{"as_of":"2026-08-17T21:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:045fae7254ca4111b8f072e1d30def10ec8f33d610df8e42d2621a5fbe561f38","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T05:23:19.751654Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T10:10:09.804381Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-14T10:10:10.035485Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"cited_work":{"arxiv_id":"1909.01440","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.01440","snapshot_observed_at":"2026-08-14T10:10:10.035485Z","title":"LCA: Loss Change Allocation for Neural Network Training","venue":"cs.LG","work_id":"fc93e3c0-9450-4e68-8212-6394ef6d2225","year":2019},"citing_paper":{"arxiv_id":"1908.11843","last_updated":"2020-01-05T21:15:43Z","snapshot_observed_at":"2026-08-16T03:15:04.621149Z","submitted_at":"2019-08-30T17:12:56Z","title":"Partitioned integrators for thermodynamic parameterization of neural networks","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T10:10:09.804381Z"},"links":{"cited_paper":"/paper/1909.01440","citing_paper":"/paper/1908.11843"},"observation_digest":"sha256:04427d4ddbfbd26f404ea87631d3312209a5521fb06112f52ce6a9d06b2971a8","observation_id":"a6f5d4d0-6046-4dd4-bf8f-ac58c800683c","resolution":{"observed_at":"2026-08-14T10:10:10.041065Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1909.01440/citation-record","integrity":"/paper/1909.01440/integrity","json":"/paper/1909.01440/citation-record.json","paper":"/paper/1909.01440"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1711.08856","last_updated":"2019-02-25T11:08:56Z","snapshot_observed_at":"2026-08-17T03:04:27.775014Z","submitted_at":"2017-11-24T01:58:54Z","title":"Critical Learning Periods in Deep Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.08856","snapshot_observed_at":"2026-08-14T05:23:19.575147Z","title":"Critical learning periods in deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.575147Z"},"links":{"cited_paper":"/paper/1711.08856","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:a9d983be2f8af770e9ccc957253a5b2b4f6bb22feaf1c268a94b3fb642602901","observation_id":"1278211e-ddab-4091-ae2c-3d7bf050033e","resolution":{"observed_at":"2026-08-14T05:23:19.575147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.365354Z","title":"Alain and Y","venue":null,"work_id":"81456ea1-965d-40bb-b94b-3790399a4271","year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.581413Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:8a8fd13ee2a5b4ccbc4e8f883a9fae2faf2a4d88d2c47cb141a8738cb119a52d","observation_id":"9eaeb2a4-4f61-47c8-b15b-3ea10fbbbc7e","resolution":{"observed_at":"2026-08-14T05:23:20.370337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.348799Z","title":"Optimization methods for large-scale machine learning","venue":null,"work_id":"75dc6dbd-ac5e-4bfb-a869-45179be90dbb","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.586545Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:937ebe374bb87cf3aa6062a3f3bed50d767e36d1ec78a2207e5a422e3e0ea4f6","observation_id":"3c24fb10-5a75-4d85-9a68-a5171f2ab56c","resolution":{"observed_at":"2026-08-14T05:23:20.353963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.331447Z","title":"The loss surfaces of multilayer networks","venue":null,"work_id":"247aabe0-12d9-4f16-b2c0-1558cbe39a73","year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.591951Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:a7bc76edfa35fc9cd57d52ffeb04af373f6e3ce4a7412ee29cd058bdb2070abf","observation_id":"9a02fdb2-dc21-4539-b3bf-72f5d1ba27ed","resolution":{"observed_at":"2026-08-14T05:23:20.336894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.314415Z","title":"Identifying and attacking the saddle point problem in high-dimensional non- convex optimization","venue":null,"work_id":"64f952ef-7666-4d59-bc75-bc10256fb214","year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.597175Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:c3d277c542e7611743d1ceb757be28633723b979ff0360d731a1a814e70ebfe0","observation_id":"f97b57b8-42f5-4f09-9416-2b7fe76e1a63","resolution":{"observed_at":"2026-08-14T05:23:20.319487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.03635","last_updated":"2019-03-04T15:51:11Z","snapshot_observed_at":"2026-08-14T19:37:43.556604Z","submitted_at":"2018-03-09T18:51:28Z","title":"The Lottery Ticket Hypothesis: Finding Sparse, Trainable Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.03635","snapshot_observed_at":"2026-08-14T05:23:19.602104Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.602104Z"},"links":{"cited_paper":"/paper/1803.03635","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:2065e8227f18fa6b44145170b42508af56ea27ce21456b6c09339c8c5b31d288","observation_id":"925baf4f-c62f-4823-9a93-f90910108b47","resolution":{"observed_at":"2026-08-14T05:23:19.602104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6544","last_updated":"2015-05-21T21:44:31Z","snapshot_observed_at":"2026-08-16T10:18:43.512175Z","submitted_at":"2014-12-19T21:55:01Z","title":"Qualitatively characterizing neural network optimization problems","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6544","snapshot_observed_at":"2026-08-14T05:23:19.607676Z","title":"Qualitatively characterizing neural network optimization problems","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.607676Z"},"links":{"cited_paper":"/paper/1412.6544","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:dff07c9e70114aa9446dfac4f5cb9ab3b0a75c510e72a317cb7457754838e162","observation_id":"b621a332-9368-4663-8228-9af28b056197","resolution":{"observed_at":"2026-08-14T05:23:19.607676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.296973Z","title":"A closer look at deep learning heuristics: Learning rate restarts, warmup and distillation","venue":null,"work_id":"01363e3c-c1f7-43db-940d-0ca28663e6d0","year":2019},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.612843Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:732a6890961030ceaf41099bc108dfd2969c492d87d4d3fb3b94b2d717875d7b","observation_id":"9ec53c71-e679-44ec-8e6e-6e9fb453721c","resolution":{"observed_at":"2026-08-14T05:23:20.303586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03385","last_updated":"2015-12-10T19:51:55Z","snapshot_observed_at":"2026-07-06T04:39:28.429064Z","submitted_at":"2015-12-10T19:51:55Z","title":"Deep Residual Learning for Image Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03385","snapshot_observed_at":"2026-08-14T05:23:19.617428Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.617428Z"},"links":{"cited_paper":"/paper/1512.03385","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:760973e830106a0d77b6b85526f2d9850b55c386d9650b0ceae251e6321274e8","observation_id":"9ae736c1-1d52-42be-9428-1a83acb4002f","resolution":{"observed_at":"2026-08-14T05:23:19.617428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:19.622568Z","title":"Delving deep into rectiﬁers: Surpassing human-level performance on imagenet classiﬁcation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.622568Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:b8c9233acc4dc9bccc58a3205568871944589e393ab307c809f3913f6ffe52d8","observation_id":"21390072-047f-4bfb-b15f-6b651367063d","resolution":{"observed_at":"2026-08-14T05:23:19.622568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1207.0580","last_updated":"2012-07-03T06:35:15Z","snapshot_observed_at":"2026-08-15T00:54:35.320150Z","submitted_at":"2012-07-03T06:35:15Z","title":"Improving neural networks by preventing co-adaptation of feature detectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.0580","snapshot_observed_at":"2026-08-14T05:23:19.627225Z","title":"Improving neural networks by preventing co-adaptation of feature detectors","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.627225Z"},"links":{"cited_paper":"/paper/1207.0580","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:6d136143429777b73c2dc2a1a01e151e365472f1fe9d685a25fabff97f0a60d9","observation_id":"9a40c5cd-1c44-4f4a-8ad0-a6382ad9ade9","resolution":{"observed_at":"2026-08-14T05:23:19.627225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.04540","last_updated":"2018-03-20T08:56:25Z","snapshot_observed_at":"2026-08-14T19:55:18.944592Z","submitted_at":"2018-01-14T12:00:43Z","title":"Fix your classifier: the marginal value of training the last weight layer","version":2},"cited_work":{"arxiv_id":"1801.04540","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.04540","snapshot_observed_at":"2026-08-14T05:23:19.975206Z","title":"Fix your classifier: the marginal value of training the last weight layer","venue":"cs.LG","work_id":"2652f78d-3692-49a8-b3c5-5b8e5c864466","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.633195Z"},"links":{"cited_paper":"/paper/1801.04540","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:a2120e554641da24d465d22a834f27a04dda96b7b6eca8e4538a88d3c750c5d9","observation_id":"26b1cae8-1a20-4998-b194-fbb3e140c4d5","resolution":{"observed_at":"2026-08-14T05:23:19.982832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03167","last_updated":"2015-03-02T20:44:12Z","snapshot_observed_at":"2026-08-12T21:01:12.961874Z","submitted_at":"2015-02-11T01:44:18Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03167","snapshot_observed_at":"2026-08-14T05:23:19.639254Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.639254Z"},"links":{"cited_paper":"/paper/1502.03167","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:2de25f3f3d6f2364e742fbe01981bc079cd6af296f541d8ecdb2963045964d81","observation_id":"fdf194b1-1b2b-4736-bd24-987f79de429a","resolution":{"observed_at":"2026-08-14T05:23:19.639254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.05031","last_updated":"2019-12-23T12:50:22Z","snapshot_observed_at":"2026-08-14T18:52:20.944777Z","submitted_at":"2018-07-13T12:17:41Z","title":"On the Relation Between the Sharpest Directions of DNN Loss and the SGD Step Length","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.05031","snapshot_observed_at":"2026-08-14T05:23:19.643754Z","title":"On the Relation Between the Sharpest Directions of DNN Loss and the SGD Step Length","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.643754Z"},"links":{"cited_paper":"/paper/1807.05031","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:dcb54869749beb5f2653379d8d46fe4fd5e4771565a50f69aecd9bc36380924e","observation_id":"36797494-6ff9-4d58-837a-c079faaa5f92","resolution":{"observed_at":"2026-08-14T05:23:19.643754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.04836","last_updated":"2017-02-09T20:38:16Z","snapshot_observed_at":"2026-08-15T20:45:29.277746Z","submitted_at":"2016-09-15T20:03:06Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.04836","snapshot_observed_at":"2026-08-14T05:23:19.648942Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.648942Z"},"links":{"cited_paper":"/paper/1609.04836","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:73da3924da68a8c3a1ee83d385ff50f02b60fdc91b3a6ca4510d14c61ac20b6a","observation_id":"9e4aa06e-134f-4bce-aaac-0851722461a8","resolution":{"observed_at":"2026-08-14T05:23:19.648942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:19.654169Z","title":"Rusu, Kieran Milan, John Quan, Tiago Ramalho, Agnieszka Grabska-Barwinska, Demis Hassabis, Claudia Clopath, Dharshan Kumaran, and Raia Hadsell","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.654169Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:1c778540775e7f8b2e01e789b47fe3380fbe626a89a85c57cfc41c627c681f92","observation_id":"fdad05f1-61f5-49f6-b02d-14877c8fc8f1","resolution":{"observed_at":"2026-08-14T05:23:19.654169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.269487Z","title":"Beitrag zur näherungweisen integration totaler differentialgleichungen","venue":null,"work_id":"7fad79c5-74fa-429a-a0ba-ba13d69408b7","year":1901},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.658983Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:0b4b5c72c3dbaad41286493994c2f35a3a5db8356ebe4e3b80d98d8f1906845c","observation_id":"cb2d9ab3-525e-49f9-8121-3311a0762785","resolution":{"observed_at":"2026-08-14T05:23:20.274993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:19.663521Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.663521Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:4363623dc7235715c1d49046a5660d574349673f7f1fec5667aefa25508d8b82","observation_id":"a5c367a6-9fd6-4568-a354-2660f5a0ff75","resolution":{"observed_at":"2026-08-14T05:23:19.663521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.242160Z","title":"Measuring the Intrinsic Dimension of Objective Landscapes","venue":null,"work_id":"2ec61ef6-be9d-4563-84c1-858d8b6ab55f","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.668158Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:9bd3cc4d3b88507f640dd8cda1e972e32506e64b1d1252f1ba672546bc2fb703","observation_id":"16221b14-f67b-41e7-b3b7-69e7022306a9","resolution":{"observed_at":"2026-08-14T05:23:20.246918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.225748Z","title":"Visualizing the loss landscape of neural nets","venue":null,"work_id":"7b06981e-9c26-448d-8908-8560219d374c","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.673437Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:00a21bb240b382a3101d6b461583a634aea8df5cef52f6a7b2e0a52231960332","observation_id":"98e3768b-3bc2-4956-9929-ffe98b8b6906","resolution":{"observed_at":"2026-08-14T05:23:20.230870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.207002Z","title":"The loss surface of deep and wide neural networks","venue":null,"work_id":"08d40465-47f8-4260-8c73-899a1e973c9c","year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.678145Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:eaada126223adbf990996d5ae2f9d3c8ae16cba9762b6b8352a7beae069babc1","observation_id":"561e7922-3bc0-49e3-b5e2-304c7827d9d6","resolution":{"observed_at":"2026-08-14T05:23:20.212767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.189579Z","title":"Raghu, J","venue":null,"work_id":"b1cc1011-f9ae-4741-a30a-5c1e93c6e17b","year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.683164Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:e9f9631b8b299b63b4b792bd0a133b0c9a8b63cbeb95194d2d735ea636119020","observation_id":"f0980e5d-f3ac-4391-9432-447a4b329d50","resolution":{"observed_at":"2026-08-14T05:23:20.195558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.172085Z","title":"Über die numerische auﬂösung von differentialgleichungen","venue":null,"work_id":"92317b89-1135-4a3a-8a16-01243b735fca","year":null},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.688003Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:141186618f7e679bcd77f342cf4dacb9d167922e6c3738b87ba663e74e3807f7","observation_id":"5b40fb9c-34f3-4fb8-853b-1e9d7349c366","resolution":{"observed_at":"2026-08-14T05:23:20.177571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.153562Z","title":"On the quality of the initial basin in overspeciﬁed neural networks","venue":null,"work_id":"8e0cbfea-d18f-4bf3-83b0-62d152dc2a9d","year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.692652Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:7c176d0d4d239c3304d88bea77826fe5e7d436585625fda3cc1a44e2000bfdd1","observation_id":"390fd79c-859f-4bee-a385-f1e3fcbfc383","resolution":{"observed_at":"2026-08-14T05:23:20.158951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.00810","last_updated":"2017-04-29T17:32:47Z","snapshot_observed_at":"2026-08-14T21:13:52.487817Z","submitted_at":"2017-03-02T14:53:14Z","title":"Opening the Black Box of Deep Neural Networks via Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.00810","snapshot_observed_at":"2026-08-14T05:23:19.697460Z","title":"Opening the black box of deep neural networks via information","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.697460Z"},"links":{"cited_paper":"/paper/1703.00810","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:90249cf104ac5ba98db335dc5eff2524895bba1e2d169748f65cb86be8142711","observation_id":"f1dcfb32-9651-49c3-9197-597e91c4d949","resolution":{"observed_at":"2026-08-14T05:23:19.697460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-17T19:17:06.411141Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-14T05:23:19.702628Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.702628Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:64b7b0eb0c8fab891fadcdbef534afb4ebcdea3ff2de40c3d86b6429232968f5","observation_id":"5a924dc4-7a14-4e20-8af9-fcc461144ea0","resolution":{"observed_at":"2026-08-14T05:23:19.702628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6034","last_updated":"2014-04-19T11:54:52Z","snapshot_observed_at":"2026-08-17T14:45:30.096775Z","submitted_at":"2013-12-20T16:45:54Z","title":"Deep Inside Convolutional Networks: Visualising Image Classification Models and Saliency Maps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6034","snapshot_observed_at":"2026-08-14T05:23:19.707362Z","title":"Deep inside convolutional networks: Visualising image classiﬁcation models and saliency maps","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.707362Z"},"links":{"cited_paper":"/paper/1312.6034","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:25641fcf0395a0b1dfc7190b83fb926c67543be6d0d94b3f94741437ca0d6d5d","observation_id":"18337fff-039f-4213-9008-e29644c9934e","resolution":{"observed_at":"2026-08-14T05:23:19.707362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1605.08361","last_updated":"2016-05-30T04:33:39Z","snapshot_observed_at":"2026-08-14T21:55:33.885071Z","submitted_at":"2016-05-26T16:51:05Z","title":"No bad local minima: Data independent training error guarantees for multilayer neural networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.08361","snapshot_observed_at":"2026-08-14T05:23:19.713359Z","title":"No bad local minima: Data independent training error guarantees for multilayer neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.713359Z"},"links":{"cited_paper":"/paper/1605.08361","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:449de7009ce31ea849c16ec73ddd72d250738ae00d9896bead05cf37d8330bac","observation_id":"6f9bf117-3aa3-4ede-82e0-a23455d66736","resolution":{"observed_at":"2026-08-14T05:23:19.713359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6806","last_updated":"2015-04-13T07:58:17Z","snapshot_observed_at":"2026-08-14T23:06:34.544371Z","submitted_at":"2014-12-21T16:16:37Z","title":"Striving for Simplicity: The All Convolutional Net","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6806","snapshot_observed_at":"2026-08-14T05:23:19.718425Z","title":"Riedmiller","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.718425Z"},"links":{"cited_paper":"/paper/1412.6806","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:718f85a6af80928c25b5c4ac9706a804b0d5629f7ffc8a00c5636818657b2eb8","observation_id":"ea030a86-f11e-4fcf-9898-eabe6d4c87ca","resolution":{"observed_at":"2026-08-14T05:23:19.718425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.136978Z","title":"On the importance of initialization and momentum in deep learning","venue":null,"work_id":"64f4e4f8-a31c-44a6-9ebe-e9fe480a28c8","year":2013},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.723260Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:6b3592cd7654ea2b890e8ea0af6e5d330dc1b0b318aa53a8175939fa5513b7fa","observation_id":"97b7e272-7b30-477d-a634-f02bec09fc38","resolution":{"observed_at":"2026-08-14T05:23:20.142295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.118653Z","title":"Simpson’s rule","venue":null,"work_id":"6c700398-2d38-4fdf-a6a9-ce23bc14c5d1","year":2003},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.727944Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:2d58d8cdb546f17eb70e8283b65d2e0a6bf3e8b987b734cf2e42457c76b425af","observation_id":"0cafcc36-e7c0-4a7f-aba1-01e0662fc196","resolution":{"observed_at":"2026-08-14T05:23:20.124207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.100739Z","title":"A walk with sgd","venue":null,"work_id":"be51dfc5-f27d-4966-9946-cec4e423c098","year":2018},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.732566Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:f5821f7c359517f0c9dce28e26aa947d8211987bedcead2ddb6bba9ef6bc4c97","observation_id":"79642e13-dda4-4558-8a77-355700df41aa","resolution":{"observed_at":"2026-08-14T05:23:20.106421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T05:23:20.084001Z","title":"Yosinski, J","venue":null,"work_id":"ec6c981b-12fa-421c-9093-f3e55a77bb8a","year":2015},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.737344Z"},"links":{"citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:77c7e06a2466c9df079c31a0f728f383a4f1ca264d7c7dbb5e31f10a815ec469","observation_id":"307786b3-8e0a-43a9-a579-6a58b20c30da","resolution":{"observed_at":"2026-08-14T05:23:20.089308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04200","last_updated":"2017-06-12T19:57:42Z","snapshot_observed_at":"2026-08-14T21:12:14.237470Z","submitted_at":"2017-03-13T00:02:48Z","title":"Continual Learning Through Synaptic Intelligence","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04200","snapshot_observed_at":"2026-08-14T05:23:19.741886Z","title":"Improved multitask learning through synaptic intelligence","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.741886Z"},"links":{"cited_paper":"/paper/1703.04200","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:4291c41cc7702434041ec44f24c13b9fbd75b975f506581e9f9389056d21170d","observation_id":"3c229f5e-fb3e-4449-a5f8-b4d74fed3e8d","resolution":{"observed_at":"2026-08-14T05:23:19.741886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.01996","last_updated":"2022-03-08T21:16:04Z","snapshot_observed_at":"2026-08-15T10:37:49.016375Z","submitted_at":"2019-02-06T01:29:01Z","title":"Are All Layers Created Equal?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.01996","snapshot_observed_at":"2026-08-14T05:23:19.746568Z","title":"Are all layers created equal? arXiv preprint arXiv:1902.01996, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.746568Z"},"links":{"cited_paper":"/paper/1902.01996","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:e90557df00ad33053b7c1395b83f39d8f4acefea3f582d87e67aa1a96bbbb81b","observation_id":"c0c89bd2-f78f-418a-9db1-9bac5f8939c4","resolution":{"observed_at":"2026-08-14T05:23:19.746568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.01067","last_updated":"2020-03-03T05:40:51Z","snapshot_observed_at":"2026-08-17T01:19:13.238797Z","submitted_at":"2019-05-03T08:21:07Z","title":"Deconstructing Lottery Tickets: Zeros, Signs, and the Supermask","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.01067","snapshot_observed_at":"2026-08-14T05:23:19.751654Z","title":"Total error","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T05:23:19.751654Z"},"links":{"cited_paper":"/paper/1905.01067","citing_paper":"/paper/1909.01440"},"observation_digest":"sha256:12e7562fa3ad199619b56e8a97970180d8f609bcddc51912c2c729a1ef05f43b","observation_id":"5c223eb3-c64b-4c70-94c8-86ab54a98166","resolution":{"observed_at":"2026-08-14T05:23:19.751654Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"1909.01440","last_updated":"2020-03-03T05:46:16Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T10:19:51.806855Z","submitted_at":"2019-09-03T20:34:05Z","title":"LCA: Loss Change Allocation for Neural Network Training"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:1909.01440."}