{"as_of":"2026-08-06T04:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4250678874659a7468986c7754ab79214e9317ac764481a54f88715e5c338c56","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T11:12:34.202549Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":115,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"1609.04836","last_updated":"2017-02-09T20:38:16Z","snapshot_observed_at":"2026-07-06T05:10:58.923264Z","submitted_at":"2016-09-15T20:03:06Z","title":"On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T10:58:48.515002Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/1609.04836"},"observation_digest":"sha256:f8930e2079114f53a9157377b4e76714528f0692435bb9f7bba55d986e197d84","observation_id":"696ae77a-636b-4c35-b96e-d146e6b23050","resolution":{"observed_at":"2026-05-13T10:58:48.536037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"1906.09069","last_updated":"2019-06-21T11:14:59Z","snapshot_observed_at":"2026-08-02T16:53:30.966654Z","submitted_at":"2019-06-21T11:14:59Z","title":"First Exit Time Analysis of Stochastic Gradient Descent Under Heavy-Tailed Gradient Noise","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T18:55:33.003637Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/1906.09069"},"observation_digest":"sha256:b9b653af6c6246f122971bdbaa4dc300e63c9d9d4841e2006e85dd89bbef1c7e","observation_id":"4263f2cd-d578-43c0-9b34-4712a416ed17","resolution":{"observed_at":"2026-05-25T18:56:08.858446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"1906.10186","last_updated":"2019-06-24T19:21:29Z","snapshot_observed_at":"2026-08-02T11:11:25.599799Z","submitted_at":"2019-06-24T19:21:29Z","title":"A Stochastic Composite Gradient Method with Incremental Variance Reduction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-25T17:02:34.602404Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/1906.10186"},"observation_digest":"sha256:2b481e98b54701ac343267762b9cca522ff22aaa743bb165609a3a7ce7eb8c48","observation_id":"b4861c65-5ff2-4fab-824f-f8895f6bac89","resolution":{"observed_at":"2026-05-25T17:06:07.855790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"1906.10822","last_updated":"2019-06-26T02:54:26Z","snapshot_observed_at":"2026-07-06T08:02:51.583780Z","submitted_at":"2019-06-26T02:54:26Z","title":"Gradient Noise Convolution (GNC): Smoothing Loss Function for Distributed Large-Batch SGD","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-25T15:41:27.232807Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/1906.10822"},"observation_digest":"sha256:928cb371f5caa8fa512054e625bb5db942db13e37bb641f7816b74b533262953","observation_id":"8b8b53d5-dfc7-4d7f-ac91-da82991aff26","resolution":{"observed_at":"2026-05-25T15:45:59.706527Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"1906.11148","last_updated":"2019-06-26T15:05:24Z","snapshot_observed_at":"2026-07-06T08:03:00.197350Z","submitted_at":"2019-06-26T15:05:24Z","title":"Chaining Meets Chain Rule: Multilevel Entropic Regularization and Training of Neural Nets","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T15:45:38.743857Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/1906.11148"},"observation_digest":"sha256:a27d3230f5c6ff75105d2c49280752fa50d60e44e9e96314b8c5051439715eee","observation_id":"a396cc71-c528-4659-ae75-c781d35beeb7","resolution":{"observed_at":"2026-05-25T15:45:59.309563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"1907.09697","last_updated":"2019-07-23T05:15:55Z","snapshot_observed_at":"2026-07-06T08:09:31.884004Z","submitted_at":"2019-07-23T05:15:55Z","title":"Heavy-ball Algorithms Always Escape Saddle Points","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T17:59:27.851487Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/1907.09697"},"observation_digest":"sha256:cb973ebbaf5f49a742c217e3ad0788e95e326aaac66a9a693dc60300ba6f8fbe","observation_id":"5350fbc6-a279-4d89-8763-c266f739855b","resolution":{"observed_at":"2026-05-24T17:59:46.450026Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"1907.10732","last_updated":"2019-07-24T21:27:13Z","snapshot_observed_at":"2026-08-02T12:32:46.653350Z","submitted_at":"2019-07-24T21:27:13Z","title":"Hessian based analysis of SGD for Deep Nets: Dynamics and Generalization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T16:42:26.048100Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/1907.10732"},"observation_digest":"sha256:5cfa6418983fea23de7bc786e24b8d1758c3075763666af1f1e1242f7ddac762","observation_id":"fc57bbef-a897-4ccc-8d46-c5aabb156747","resolution":{"observed_at":"2026-05-24T16:44:41.707991Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"2010.01412","last_updated":"2021-04-29T16:44:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-03T19:02:10Z","title":"Sharpness-Aware Minimization for Efficiently Improving Generalization","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T20:13:53.366151Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2010.01412"},"observation_digest":"sha256:e086e02e01ef8cb131fac33941044a16f47f7520cdf35484e56a7e064b3853e1","observation_id":"64bf8a70-56d8-42ff-a46e-5be0c598ff66","resolution":{"observed_at":"2026-05-16T20:13:53.441561Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T11:12:34.202549Z","title":"Entropy- SGD : Biasing gradient descent into wide valleys","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.03110","last_updated":"2025-09-03T08:07:43Z","snapshot_observed_at":"2026-08-05T11:12:29.256884Z","submitted_at":"2025-09-03T08:07:43Z","title":"LSAM: Asynchronous Distributed Training with Landscape-Smoothed Sharpness-Aware Minimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T11:12:34.202549Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2509.03110"},"observation_digest":"sha256:2428fb2f5f9bdb03527443f39c4937bef330bae94786ebf15ab7659eb8c09b07","observation_id":"f7c5d364-69b5-4966-a16d-61c2f6e9cb2d","resolution":{"observed_at":"2026-08-05T11:12:34.202549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"2605.02105","last_updated":"2026-05-04T00:02:23Z","snapshot_observed_at":"2026-08-03T01:31:24.030995Z","submitted_at":"2026-05-04T00:02:23Z","title":"Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-08T18:33:26.638240Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2605.02105"},"observation_digest":"sha256:2128ae91f62ba9bdd133919c24e598d562118b6305325916fa3077e7c7ce56fd","observation_id":"0b3dbd2e-2c4a-401d-a603-d0b7ac4b63fe","resolution":{"observed_at":"2026-05-09T06:20:42.376885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"2605.05436","last_updated":"2026-05-06T20:52:42Z","snapshot_observed_at":"2026-08-02T06:37:23.588497Z","submitted_at":"2026-05-06T20:52:42Z","title":"Estimating Implicit Regularization in Deep Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T15:54:21.139902Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2605.05436"},"observation_digest":"sha256:df01e39a2760e7770ca927755e35372664801e441d0bed7962066f10e0498aba","observation_id":"c6e11566-7fed-497c-bb22-3889b5267912","resolution":{"observed_at":"2026-05-11T18:26:13.034669Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","version":5},"cited_work":{"arxiv_id":"1611.01838","doi":"10.48550/arxiv.1611.01838","metadata_source":"pith","pith_arxiv_id":"1611.01838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys","venue":"cs.LG","work_id":"bdc7ed98-348d-4ac0-acaa-b46ab29dcc3b","year":2016},"citing_paper":{"arxiv_id":"2605.16520","last_updated":"2026-05-15T18:14:38Z","snapshot_observed_at":"2026-08-02T14:37:22.154242Z","submitted_at":"2026-05-15T18:14:38Z","title":"Global Convergence of Sampling-Based Nonconvex Optimization through Diffusion-Style Smoothing","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-20T20:15:44.030714Z"},"links":{"cited_paper":"/paper/1611.01838","citing_paper":"/paper/2605.16520"},"observation_digest":"sha256:a356f388b54121f268efa311ce2918627e73ad34d4fe006a7334791936ff0384","observation_id":"bac4abc2-6be2-41ef-99a8-ab43288d6c9e","resolution":{"observed_at":"2026-05-20T20:18:59.541406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T01:23:27.426944+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1611.01838/citation-record","integrity":"/paper/1611.01838/integrity","json":"/paper/1611.01838/citation-record.json","paper":"/paper/1611.01838"},"outbound":[],"paper":{"arxiv_id":"1611.01838","last_updated":"2017-04-21T07:16:30Z","latest_version":5,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-04T10:51:35.375214Z","submitted_at":"2016-11-06T20:22:49Z","title":"Entropy-SGD: Biasing Gradient Descent Into Wide Valleys"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:1611.01838."}