{"as_of":"2026-08-23T19:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7078c2274505b69ec65ecf28580223bef57eaaa137d5529f7b582b8e5537d31c","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T12:19:08.358753Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.07607/citation-record","integrity":"/paper/1908.07607/integrity","json":"/paper/1908.07607/citation-record.json","paper":"/paper/1908.07607"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.221547Z","title":"Introduction to stochastic search and optimization: estimation, simulation, and control, volume 65","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.221547Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:b7b4feedf7d3f42e07a38fe05f27f07923ef2d46715e0f1cea7d83eeaaed2c0f","observation_id":"144de4d0-d9b2-4d50-bd0d-4f58a95477e4","resolution":{"observed_at":"2026-08-14T12:19:08.221547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.710658Z","title":"Variance reduction for stochastic gradient optimization","venue":null,"work_id":"42a82748-434d-46b1-a7b9-536e322238ae","year":2013},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.226900Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:5c7c827c3d559c7aa872c8949e29af996a726efe2309f660d6a1ac1f859434d7","observation_id":"7554454c-90c3-4e34-8d7a-2892801cc49e","resolution":{"observed_at":"2026-08-14T12:19:08.723323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.678886Z","title":"Accelerating stochastic gradient descent using predictive variance reduction","venue":null,"work_id":"ef42f851-f1bb-407c-a97d-d24e33a9d6f1","year":2013},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.231183Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:81c402ceb94897549e78099d48a4c0a9232114c48c2677c49d44ac496f5b657f","observation_id":"e634bcf1-eb65-49bb-8deb-6fb8724e46dc","resolution":{"observed_at":"2026-08-14T12:19:08.690665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.663070Z","title":"On variance reduction in stochastic gradient descent and its asynchronous variants","venue":null,"work_id":"eb5a3c97-649d-4444-9058-06a9aaa21b6b","year":2015},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.245189Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:2af2d1e2d77473847e3e06ba2ee3c55616cd72bb88f857f390e95f73093c8ba8","observation_id":"38220198-6b02-4e47-9a61-cc2c696a9f7a","resolution":{"observed_at":"2026-08-14T12:19:08.669462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.651328Z","title":"Stochastic variance reduced multiplicative update for nonnegative matrix fac- torization","venue":null,"work_id":"19786830-ae58-421b-ac92-8682c0287603","year":2018},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.253954Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:2be9171b7d0f074557772d7d77d13d42f4f8c79e269ea45f2e51b0cdc1b83d1b","observation_id":"e1630687-81a2-4815-90a3-4c67527791ad","resolution":{"observed_at":"2026-08-14T12:19:08.655624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.636880Z","title":"Convergence of variance-reduced learning under random reshufﬂing","venue":null,"work_id":"f3725f1c-0f79-46ad-92a2-d47176c8f1da","year":2018},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.259134Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:02e57dcf5ac8f689bcd228fd5d178dd0cb41d6ee0eeb9e9704d71b689f6de1c7","observation_id":"36272fc3-7fec-4f2c-afde-5daac777dc38","resolution":{"observed_at":"2026-08-14T12:19:08.641872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.264594Z","title":"On the importance of initialization and momentum in deep learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.264594Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:8e02e39dbf07216acf5d9ea2c89e5185797b1dc22ad63e9281a55814d1afb93d","observation_id":"f5918106-a515-46b1-b348-247940321259","resolution":{"observed_at":"2026-08-14T12:19:08.264594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.269715Z","title":"Reddi, Satyen Kale, and Sanjiv Kumar","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.269715Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:1c63338191b284e430422d46c2c68d3d2486fece533b934a1361726c6d9344cb","observation_id":"84554b1a-f869-4f8b-b819-2520b147eb69","resolution":{"observed_at":"2026-08-14T12:19:08.269715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.274290Z","title":"Adaptive subgradient methods for online learning and stochastic optimization","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.274290Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:f3f379d2648fda9c7bdac470fb5235e2ad9c863caece1e73b63a59f44aaff962","observation_id":"7f83dae5-0ebe-4ee9-b873-05aec368f7df","resolution":{"observed_at":"2026-08-14T12:19:08.274290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T12:19:08.279735Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.279735Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:7ffb23a8d340d15247dda097a9ba596ae1fa9c99f5f1867247f921ca387f811f","observation_id":"45af356d-0428-4ecd-91e6-7ff1bdd817cd","resolution":{"observed_at":"2026-08-14T12:19:08.279735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1212.5701","last_updated":"2012-12-22T15:46:49Z","snapshot_observed_at":"2026-08-19T05:19:50.480481Z","submitted_at":"2012-12-22T15:46:49Z","title":"ADADELTA: An Adaptive Learning Rate Method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.5701","snapshot_observed_at":"2026-08-14T12:19:08.284510Z","title":"Adadelta: an adaptive learning rate method","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.284510Z"},"links":{"cited_paper":"/paper/1212.5701","citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:cfe58ef73d6047e154a2aeba0abe6661bd62d917e288f9a7d42b16831ac08543","observation_id":"b36724a4-f1c7-4218-a20a-17cfefa95f66","resolution":{"observed_at":"2026-08-14T12:19:08.284510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.605186Z","title":"Incorporating nesterov momentum into adam","venue":null,"work_id":"c5b38a32-0d31-4666-aaf2-e6bb116f86c1","year":2016},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.289194Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:588d7f54bd2c603ac46a4a78a5a9f37688e8f910a3a60aa53cdd86e19cdd17db","observation_id":"af4bbc94-b56f-4310-9280-6be877d19ae6","resolution":{"observed_at":"2026-08-14T12:19:08.608600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.594788Z","title":"No more pesky learning rates","venue":null,"work_id":"c058ebba-bfb7-4088-a209-1c5fc3e3970e","year":2013},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.293177Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:f9b6dccc0f726aa1e82506c74ecb83482756c17dcdbb52ab645ad04fbcdb1b9b","observation_id":"897a7a78-d6a5-4e7c-8d34-f0f06e41afd6","resolution":{"observed_at":"2026-08-14T12:19:08.598290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.578264Z","title":"Barzilai-borwein step size for stochastic gradient descent","venue":null,"work_id":"92a0d941-21a1-4820-b3fc-66eb25fcb58e","year":2016},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.297298Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:8d5662e8f6de4767f5cce27f3d0b7ece6fc1c1ff620aa26c5aca3f0a5195ca21","observation_id":"7b3dc382-5c26-49f3-a75c-1f20c4eeac99","resolution":{"observed_at":"2026-08-14T12:19:08.584392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.301399Z","title":"Two-point step size gradient methods","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.301399Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:17506286698e7fb579dabcd3ace926db6e5ca8bf4f72a40f1c69bd470d5aaff4","observation_id":"a7262e0e-5d40-45f0-a229-f3d3813ee2ad","resolution":{"observed_at":"2026-08-14T12:19:08.301399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.551570Z","title":"Imagenet classiﬁcation with deep convolutional neural networks","venue":null,"work_id":"c509bbe3-080b-48e9-909f-5bbebe20d03a","year":2012},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.305466Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:dbd9207473c512e14d488d36233d17ebdd31ad81cb5efec8be75dcf8e77907db","observation_id":"55011ff5-fcdb-4a39-b57b-6913119dce17","resolution":{"observed_at":"2026-08-14T12:19:08.556943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.539256Z","title":null,"venue":null,"work_id":"1c63f0b8-b0e1-4848-a780-2fe944a07da4","year":2006},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.311487Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:bca04da8ff7500f8cea38d32a6a60676fdd052a0fccf7bd95575591b19628365","observation_id":"3a4d0bb1-8211-436c-8496-c9812d4c1e82","resolution":{"observed_at":"2026-08-14T12:19:08.543442Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.525685Z","title":"Sgd-qn: Careful quasi-newton stochastic gradient descent","venue":null,"work_id":"29704007-2609-4172-8821-eee1616cfc55","year":2009},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.315370Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:d16e5ee9cce4e79ef56acf55ecfb4b01ec4ddb32c13c1095274a0d272be45c72","observation_id":"1be727b6-ae0b-4afb-89bd-8c9864a46293","resolution":{"observed_at":"2026-08-14T12:19:08.530234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.514078Z","title":"Res: Regularized stochastic bfgs algorithm","venue":null,"work_id":"b4f2ef3f-8b1f-4bb3-9f70-93f9307120b6","year":2014},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.318854Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:04bbe9551c7768feb00da909b2d3308fab7716459383f8841c5fc6131b6b5c8e","observation_id":"33d6898a-c990-4fdf-8333-e02d10f407e9","resolution":{"observed_at":"2026-08-14T12:19:08.518053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.502055Z","title":"Limited-memory bfgs optimization of recurrent neural network language models for speech recognition","venue":null,"work_id":"88c83813-8295-41fe-80e5-8b3cc4f30b46","year":2018},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.323714Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:93e0301ac69ac4b57bbbe3a60bf506e23d5c14ba68a79cc8c7cdfa03f66d2c64","observation_id":"3debd217-0fb6-41d3-9f8d-119fb578467e","resolution":{"observed_at":"2026-08-14T12:19:08.505959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.490835Z","title":"Learning representations by back-propagating errors","venue":null,"work_id":"401e438e-c417-4914-939f-670502c46ade","year":1986},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.328839Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:ca9e75e72ebf6f0f80470b1555f09b90bdf4a778ef574326dca386c5fbaa40b3","observation_id":"4eecda32-6243-4c12-b571-5249e8d38a44","resolution":{"observed_at":"2026-08-14T12:19:08.495431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.476313Z","title":"The MNIST database of handwritten digits","venue":null,"work_id":"8a460677-861b-4a5a-b4b0-960dc97d62bb","year":2009},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.333489Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:7a6c3299b18df20ce178db6fe7d734f194c0c8be70465f04a6a98664e88f3522","observation_id":"8213387d-e14c-4a35-b5ef-2dbcce994967","resolution":{"observed_at":"2026-08-14T12:19:08.480801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.338254Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.338254Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:72448f0db589db91b8f2d649fca2da305dc1a8531742a22e5e2effbfed10a9dd","observation_id":"65328afa-17f0-430b-b2ca-26915a6c6d12","resolution":{"observed_at":"2026-08-14T12:19:08.338254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.344907Z","title":"MIT press Cambridge, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.344907Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:38c286693da7ea0951ce029cf947cc11b11db7e56472946de3e5b8bb234e5098","observation_id":"d75959c4-714f-4774-a17b-512c101782ef","resolution":{"observed_at":"2026-08-14T12:19:08.344907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.447465Z","title":"Rectiﬁed linear units improve restricted boltzmann machines","venue":null,"work_id":"268bfd02-7c94-47e9-919f-8b6ad083259c","year":2010},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.353188Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:6925df1cd02aa859a3f5d08b357d66386893c7ce4cff5521c5aa79f99686bedf","observation_id":"d7ab14a1-75c2-46d0-820d-4982e11b2a00","resolution":{"observed_at":"2026-08-14T12:19:08.452515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T12:19:08.432908Z","title":null,"venue":null,"work_id":"eb5a9962-b622-45b7-be32-86fd16030af7","year":null},"citing_paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T12:19:08.358753Z"},"links":{"citing_paper":"/paper/1908.07607"},"observation_digest":"sha256:7f81c41d3844ca0c7e366944f8bf0a4309b1ba8457cfcf74c2ff2b696d817ac3","observation_id":"c4fdd9bb-c46b-4a80-9185-76fbd8910caa","resolution":{"observed_at":"2026-08-14T12:19:08.438556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.07607","last_updated":"2019-08-20T20:56:41Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-18T13:32:21.680981Z","submitted_at":"2019-08-20T20:56:41Z","title":"Automatic and Simultaneous Adjustment of Learning Rate and Momentum for Stochastic Gradient Descent"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":15},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:1908.07607."}