{"as_of":"2026-08-16T18:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:902d61158acf32acfcbaea89b642f061e459ee59efee8533e9c2a7243a81003b","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:13:02.118812Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.02419/citation-record","integrity":"/paper/1908.02419/integrity","json":"/paper/1908.02419/citation-record.json","paper":"/paper/1908.02419"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.006096Z","title":"On the capabilities of multilayer perceptro ns,","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.006096Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:61a1872aaed75ebfcca2d0c4879c10bf814d88e7480216fd22b1e5e1d81e910d","observation_id":"6e7acdae-8136-48ee-be41-b4abb108316c","resolution":{"observed_at":"2026-08-14T15:13:02.006096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/pgec.196","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.155960Z","title":"Geometrical and statistical properties of systems of linear inequalities with applications in pattern recognit ion,","venue":null,"work_id":"69c14a95-8506-4b17-bf1d-cc8a79703747","year":1965},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.012025Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:88781a9c2b9dd4dfe6d6c9dd21b11f3e66d5682901cdb8140c5aeefebb3a25b3","observation_id":"7a8fa5cb-bba6-4f4d-b0b6-bcc7bc81ea87","resolution":{"observed_at":"2026-08-14T15:13:02.164268Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.018617Z","title":"Learning capability and storage capacity of t wo- hidden-layer feedforward networks,","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.018617Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:d634f8b266ce1044040472a14ce4480147d386942b438da2e8d84a01bcd91ecd","observation_id":"60e96cc1-2e27-4f84-9188-cb8af3b544f3","resolution":{"observed_at":"2026-08-14T15:13:02.018617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.532754Z","title":"Bounds on the number of hidden neur ons in multilayer perceptrons,","venue":null,"work_id":"da579136-20d6-42cd-bffc-96bcbef52c01","year":1991},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.023492Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:16da02036217168a4c328a83dc053aedc4ab1c68df80e3d446bac2ff48b5aa55","observation_id":"ffece35b-ebf7-4dac-b1c0-19747dbfb751","resolution":{"observed_at":"2026-08-14T15:13:02.537769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.518350Z","title":"Upper bounds on the number of hid den neurons in feedforward networks with arbitrary bounded non linear activation functions,","venue":null,"work_id":"19faa23d-6a4b-485d-8589-2018c435071e","year":1998},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.028910Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:3f527ef0e549e6b9824a7c7be6d1fc014479c28c6a116bd239fe18e49454b0c7","observation_id":"54f169f9-db32-4e41-b2d9-b68399c6ee8b","resolution":{"observed_at":"2026-08-14T15:13:02.522975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.503692Z","title":"The lower bound of the capacity for a neural network with multiple hidden layers,","venue":null,"work_id":"17bc292a-9d9e-467b-b418-1b4e113ff2c8","year":1993},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.033395Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:fbba740f065b4139433341dcd100b9d89df9e97493282babef75173901fae8c8","observation_id":"c89272af-d367-434e-a1a4-8a0b2d30b1aa","resolution":{"observed_at":"2026-08-14T15:13:02.508836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.07770","last_updated":"2019-10-29T05:22:58Z","snapshot_observed_at":"2026-08-16T11:30:08.715130Z","submitted_at":"2018-10-17T20:21:43Z","title":"Small ReLU networks are powerful memorizers: a tight analysis of memorization capacity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.07770","snapshot_observed_at":"2026-08-14T15:13:02.038044Z","title":"Small relu networks are powerful memorizers: a tight analysis of memorization capacity,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.038044Z"},"links":{"cited_paper":"/paper/1810.07770","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:295e032cbc328067f04880d04a5f5c2d52340061a9bcdaa79d71185a4eb6885b","observation_id":"a6d3ebc9-4ddb-427e-83b2-c1f5c1c1ebe1","resolution":{"observed_at":"2026-08-14T15:13:02.038044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.489994Z","title":"Identity matters in deep learning,","venue":null,"work_id":"cadc8a44-069a-4f90-ba48-fb1d966486ca","year":2017},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.043052Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:d0a9c9cc60dcdd0acdf1de4bf3bed4a5a74e7ad4b1acf6bb43840b5031e4246c","observation_id":"fab85cc0-1dd1-43bc-bdc9-fbb86d2dabca","resolution":{"observed_at":"2026-08-14T15:13:02.494215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.476904Z","title":"Optimization landscape and expre ssivity of deep cnns,","venue":null,"work_id":"190fc081-370c-4eb1-a606-393084b9a7c9","year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.048207Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:b17668489b1840e451237be8d08cff24dacc58ffd3e0cefc60949fcb9de1f9c2","observation_id":"b8b6b97a-022d-4361-bc23-e3df696bdfe5","resolution":{"observed_at":"2026-08-14T15:13:02.481216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.461394Z","title":"Hardness results for neu ral network approximation problems,","venue":null,"work_id":"55ad37d0-93ff-4ed3-bbac-5518fc72392a","year":1999},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.052824Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:966c2af16db83195fcf42b907d7f80aa398bda72116e87f7ffa653590e3c3933","observation_id":"d9d0f5e9-4836-40af-9432-24efc8d1784e","resolution":{"observed_at":"2026-08-14T15:13:02.465949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.447266Z","title":"Training a 3-node neural netwo rk is np-complete,","venue":null,"work_id":"906625cb-171b-4838-a851-7352b71ba972","year":1989},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.057073Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:18804b82dc0d29ab0986f6fee0c084fa2527266a184122a7d29ed21a88925b0f","observation_id":"e5e950a6-84f3-46a1-afe6-79e20f099d70","resolution":{"observed_at":"2026-08-14T15:13:02.452598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.433801Z","title":"On the comp utational efﬁciency of training neural networks,","venue":null,"work_id":"a9b8ee09-2c2a-4a2b-a80b-f61a7eb95c1e","year":2014},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.063119Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:1fb852d149c6afc353f4bcee78734b0ab94acefe7af9a539028ec4232534509e","observation_id":"0b66dabb-91db-4937-9b22-cb34f739d3ea","resolution":{"observed_at":"2026-08-14T15:13:02.438195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.067007Z","title":"Learning overparameterized neural networks via stochastic gradient descent on structured data,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.067007Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:5fb49c6fac090997ec5bf317faefdd251e8a81e563af2087e4e262bd3f775ea0","observation_id":"95bb0f26-e34a-4e62-a4f9-c3fdf2e32521","resolution":{"observed_at":"2026-08-14T15:13:02.067007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02054","last_updated":"2019-02-05T01:59:59Z","snapshot_observed_at":"2026-08-14T18:19:41.565109Z","submitted_at":"2018-10-04T04:47:47Z","title":"Gradient Descent Provably Optimizes Over-parameterized Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02054","snapshot_observed_at":"2026-08-14T15:13:02.072458Z","title":"Gradient desc ent provably optimizes over-parameterized neural networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.072458Z"},"links":{"cited_paper":"/paper/1810.02054","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:65e3c9fa75ee4ba5969daa3cd97710e1f24af82ab9c2e6fc0f2c4acc6358a453","observation_id":"c71fdfb4-b2e5-49e9-92da-d910d6944777","resolution":{"observed_at":"2026-08-14T15:13:02.072458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.03593","last_updated":"2020-02-18T11:17:58Z","snapshot_observed_at":"2026-08-14T16:18:38.634759Z","submitted_at":"2019-06-09T08:36:35Z","title":"Quadratic Suffices for Over-parametrization via Matrix Chernoff Bound","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.03593","snapshot_observed_at":"2026-08-14T15:13:02.077002Z","title":"Quadratic sufﬁces for over-parame trization via matrix chernoff bound,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.077002Z"},"links":{"cited_paper":"/paper/1906.03593","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:80f13931422c9001c3ddecd42ec1822b5268b85ea3eaa218054029206cc67c74","observation_id":"befe36de-8c92-47f3-8e29-797b1f0a8743","resolution":{"observed_at":"2026-08-14T15:13:02.077002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.03962","last_updated":"2019-06-17T06:39:04Z","snapshot_observed_at":"2026-08-15T12:33:17.579745Z","submitted_at":"2018-11-09T15:16:13Z","title":"A Convergence Theory for Deep Learning via Over-Parameterization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.03962","snapshot_observed_at":"2026-08-14T15:13:02.081931Z","title":"A convergence theory f or deep learning via over-parameterization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.081931Z"},"links":{"cited_paper":"/paper/1811.03962","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:95c34a068898bc27af3131c7de0d72e49416fa46e30d24be759e91952c933ab0","observation_id":"3ecdd18b-cb6c-4cef-89aa-d5f93d52993b","resolution":{"observed_at":"2026-08-14T15:13:02.081931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.03804","last_updated":"2019-05-28T19:01:22Z","snapshot_observed_at":"2026-08-14T18:01:47.691002Z","submitted_at":"2018-11-09T07:39:59Z","title":"Gradient Descent Finds Global Minima of Deep Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.03804","snapshot_observed_at":"2026-08-14T15:13:02.086434Z","title":"Gradi- ent descent ﬁnds global minima of deep neural networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.086434Z"},"links":{"cited_paper":"/paper/1811.03804","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:5083e752d2746373aeda5c4e44f75f83b86533c8098dc22b38a535af4a974f4a","observation_id":"beb30428-637a-400a-b2d6-119d16b8b79b","resolution":{"observed_at":"2026-08-14T15:13:02.086434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.08888","last_updated":"2018-12-27T18:57:43Z","snapshot_observed_at":"2026-08-14T17:55:27.705967Z","submitted_at":"2018-11-21T18:58:46Z","title":"Stochastic Gradient Descent Optimizes Over-parameterized Deep ReLU Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.08888","snapshot_observed_at":"2026-08-14T15:13:02.090787Z","title":"Stochastic gradient d escent optimizes over-parameterized deep relu networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.090787Z"},"links":{"cited_paper":"/paper/1811.08888","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:41ac2ab7e11796a5d5f77bb32c8de72562b6d70568ddc8c31ae0b79faf1533a8","observation_id":"b7290fee-7f34-42a5-bd1d-c83a1f4073b6","resolution":{"observed_at":"2026-08-14T15:13:02.090787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.04688","last_updated":"2019-06-11T16:40:46Z","snapshot_observed_at":"2026-08-14T16:17:20.769057Z","submitted_at":"2019-06-11T16:40:46Z","title":"An Improved Analysis of Training Over-parameterized Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.04688","snapshot_observed_at":"2026-08-14T15:13:02.095110Z","title":"An improved analysis of training over-parameterized deep neural networks,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.095110Z"},"links":{"cited_paper":"/paper/1906.04688","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:2c58e0240e06d3b750a95c33e36b84ba0d66d20c6f233c1ade11445bd497bf9b","observation_id":"8913bb73-3894-4f11-a7cf-03c81627f2de","resolution":{"observed_at":"2026-08-14T15:13:02.095110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1512.07276","last_updated":"2015-12-22T22:01:22Z","snapshot_observed_at":"2026-08-14T22:17:19.284360Z","submitted_at":"2015-12-22T22:01:22Z","title":"The Zero Set of a Real Analytic Function","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.07276","snapshot_observed_at":"2026-08-14T15:13:02.100067Z","title":"The zero set of a real analytic function,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.100067Z"},"links":{"cited_paper":"/paper/1512.07276","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:193f73f6d9870e983daf1d322b8d4258d429e71278a584671c3fb5fa4b89cf6d","observation_id":"94233533-c566-4533-bf6f-ff1440613c23","resolution":{"observed_at":"2026-08-14T15:13:02.100067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.413598Z","title":"Gradien t-based learning applied to document recognition,","venue":null,"work_id":"c4ce3029-c827-4f46-be72-761029d06f99","year":1998},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.104766Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:335230d04c2efa2c683e60cf867d1f4a33c4cd13ca925091c039b83717cd3279","observation_id":"d949762c-1f3b-4ec1-bf96-e02f22f6de60","resolution":{"observed_at":"2026-08-14T15:13:02.418071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.09038","last_updated":"2019-07-09T14:59:54Z","snapshot_observed_at":"2026-08-14T18:11:30.633530Z","submitted_at":"2018-10-21T22:38:32Z","title":"Depth with Nonlinearity Creates No Bad Local Minima in ResNets","version":3},"cited_work":{"arxiv_id":"1810.09038","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.09038","snapshot_observed_at":"2026-08-14T15:13:02.214851Z","title":"Depth with Nonlinearity Creates No Bad Local Minima in ResNets","venue":"stat.ML","work_id":"e6dbaefa-b1e0-4b42-bbab-94913ee9e9a4","year":2018},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.108923Z"},"links":{"cited_paper":"/paper/1810.09038","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:ab8f57111cba40d8a64c48fbca131ba7ebe56735af8a2f503143e5dc74c123c5","observation_id":"392d1edb-14e8-435f-9372-d0a481192d15","resolution":{"observed_at":"2026-08-14T15:13:02.219877Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.03673","last_updated":"2019-11-15T23:04:15Z","snapshot_observed_at":"2026-08-14T16:50:26.857115Z","submitted_at":"2019-04-07T15:43:59Z","title":"Every Local Minimum Value is the Global Minimum Value of Induced Model in Non-convex Machine Learning","version":3},"cited_work":{"arxiv_id":"1904.03673","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.03673","snapshot_observed_at":"2026-08-14T15:13:02.191610Z","title":"Every Local Minimum Value is the Global Minimum Value of Induced Model in Non-convex Machine Learning","venue":"stat.ML","work_id":"71be5293-2f51-4f37-ab3b-b269fae52487","year":2019},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.114280Z"},"links":{"cited_paper":"/paper/1904.03673","citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:8d50e0c60671e75581bc9a5275cd33c01da5e86feff56f168f8a7fc26b801b6f","observation_id":"4b9c0bbf-0014-42f7-a525-d1aa559d14a0","resolution":{"observed_at":"2026-08-14T15:13:02.196780Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:13:02.399685Z","title":"Empirical margin di stributions and bounding the generalization error of combined classiﬁers,","venue":null,"work_id":"ba801cee-f897-4653-853b-666bc9eb53da","year":2002},"citing_paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T15:13:02.118812Z"},"links":{"citing_paper":"/paper/1908.02419"},"observation_digest":"sha256:5d4e8184b2072623b1074cfdcc56898cb438d5d8cab4c234a64a3f449905d024","observation_id":"2e4ec549-8830-42db-a09c-4a580a7c51e2","resolution":{"observed_at":"2026-08-14T15:13:02.404253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.02419","last_updated":"2020-06-16T19:40:44Z","latest_version":3,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-16T04:36:14.636887Z","submitted_at":"2019-08-05T20:19:39Z","title":"Gradient Descent Finds Global Minima for Generalizable Deep Neural Networks of Practical Sizes"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":3,"verified_fuzzy":10},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:1908.02419."}