{"as_of":"2026-08-16T08:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:58c1154f479629a44223970d4127885d2945aaf09654388526110620ed3867ad","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T15:43:22.439322Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.00700/citation-record","integrity":"/paper/1908.00700/integrity","json":"/paper/1908.00700/citation-record.json","paper":"/paper/1908.00700"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.243056Z","title":null,"venue":null,"work_id":"02e74647-3d59-4c94-8b61-0b06bb078979","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.167183Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:18f8a7242293566684b210bc426b9a6c591d92ed4d4613252f0dd4e70d6dfe63","observation_id":"5aaf2088-de28-4c79-9948-9c36f6e0f7bb","resolution":{"observed_at":"2026-08-14T15:43:23.274561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.090896Z","title":null,"venue":null,"work_id":"abec3d80-1b99-4263-9a3a-ece137c17c80","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.185759Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:b0fd3245b1afcc7213dd8c98f5312503c2e2e09b7ce722e860533188bc8f38db","observation_id":"0342eb9f-8516-4047-8736-bd022bd3aeb1","resolution":{"observed_at":"2026-08-14T15:43:23.096998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.139237Z","title":null,"venue":null,"work_id":"28917bd3-0d71-4020-b53b-924b1f7d4e1f","year":2013},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.174778Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:a25bea507bd30de2a4b40c7f49d4a952ddfe9b80ccb6a0c0d4af26ab20cf65ca","observation_id":"fbb9d947-bd00-4788-948e-692406ba250a","resolution":{"observed_at":"2026-08-14T15:43:23.175626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.356115Z","title":null,"venue":null,"work_id":"bbd97215-9ec1-4b1f-a9a6-57377f4493ba","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.138715Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:99631de69e71b73ca829142fc98d65186f7cb446b258a3b74ec0a60197dced6a","observation_id":"e51f7072-900a-4fdb-8d4c-fd152e6bbfb8","resolution":{"observed_at":"2026-08-14T15:43:23.362998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.336061Z","title":"small learning rate dilemma","venue":null,"work_id":"27649de6-7646-432c-afeb-e2bdaf9b7c90","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.146510Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:6ac37bf616ae580e890b15ebef84feef903a09447af292ca6750f66f9e94f6c5","observation_id":"963466fd-420e-47b8-b973-f3945f801973","resolution":{"observed_at":"2026-08-14T15:43:23.342676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.308281Z","title":"Besides the ﬁgures in main text, we have repeated experiments and show results as follows","venue":null,"work_id":"49b126d2-8117-4ae3-8acf-42ded70aaa0c","year":2014},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.152883Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:be0cf4ab2735e5b332b98509745042d86f9a638fd0ca2967685e9b440a0fe627","observation_id":"be65fb01-931d-40d5-b8d5-ddc2834953a3","resolution":{"observed_at":"2026-08-14T15:43:23.322470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.288749Z","title":null,"venue":null,"work_id":"1f1e4876-8a1e-412d-a767-0d78de3bf267","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.159166Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:5529f2710de39976f76260c6c142329200c7a4dc7444951554704fe3559aee82","observation_id":"3b5256ea-f896-4f98-812d-33218f1af16f","resolution":{"observed_at":"2026-08-14T15:43:23.294666Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.068647Z","title":null,"venue":null,"work_id":"bc2f3d39-d582-42b6-b6cd-eec86a295bb4","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.192714Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:78710f403b1327db9c4e70a8b895fa07a9d34ac88972ffcd15121cdb50a053ba","observation_id":"418484ea-8f8d-47f0-8fe3-8c66135330e2","resolution":{"observed_at":"2026-08-14T15:43:23.078499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.049379Z","title":"With ﬁxed L,σ,G,β 1, we have C1 =O(β2), C2 =O(dβ), C3 =O(dβ2)","venue":null,"work_id":"4119fe63-0493-455b-b8a6-9e86a2097b2c","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.203070Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:6e499481d1261edf9339f9cdbc730b2927291b07bed5c93b32368bb603c474fd","observation_id":"95b1d803-5af4-4a5c-bc71-3f68b94c1f48","resolution":{"observed_at":"2026-08-14T15:43:23.055754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.005517Z","title":"By Jensen’s inequality, 1 T T∑ t=1 (f(xt)−f∗)≥f(¯xt)−f∗, where ¯xt = 1 T ∑T t=1xt","venue":null,"work_id":"4bb18892-1e1e-4e7b-bb45-9f419854cfa4","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.223936Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:50ae4f4e03f4e4c1923ed33bd6833d13996d0b490b8a4e83f21c0e8ab597c09d","observation_id":"54de26b7-62cc-48f7-9b69-3af6a0b8e669","resolution":{"observed_at":"2026-08-14T15:43:23.012174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.982078Z","title":"f(¯xt)−f∗≤ D2 2µ1 √ T + β2 1d(σ2 +G2) (1−β1)2µ1T √ T (µ2 2−µ2","venue":null,"work_id":"687a1414-8aed-417b-bf63-73c5d39cba21","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.232345Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:34a59cbca76041e6eccfba719b31e14d153ae093c0c4b632852b2aaa01f02733","observation_id":"e944d485-d18f-4297-82e5-1248aa07e38a","resolution":{"observed_at":"2026-08-14T15:43:22.989752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.958889Z","title":"42 Remark 27 The leading item of convergence order of Adam should be O( ˜C√ T ), where ˜C = D2 2µ1 + µ2 2 µ1 (σ2 +G2) + β1d(σ2+G2) 2µ1(1−β1) (µ2 2−µ2","venue":null,"work_id":"9e5241a0-c836-4644-9a2f-1fa92465151f","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.241813Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:b978d82e0017b49b4ce5c0ec9e217527419fcf660b6236d3fb6cef73ca3470eb","observation_id":"8df3b6d7-c621-4655-b47c-c9e83e8b3689","resolution":{"observed_at":"2026-08-14T15:43:22.966435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.900896Z","title":null,"venue":null,"work_id":"0b2f41f5-e0e7-4b69-963a-659649513fe0","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.270233Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:7043cc2f0daf242a9e88b6e4f34ad2a4426a1c00a9a525a11f18c93d1b2644d4","observation_id":"608e165c-dacd-48cd-8630-623f0074dc8f","resolution":{"observed_at":"2026-08-14T15:43:22.928083Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.826208Z","title":"f(¯xt)−f∗≤ D2 2µ3 √ T + β2 1d(σ2 +G2) (1−β1)2µ3T √ T (µ2 4−µ2","venue":null,"work_id":"37981da7-2fa7-4c53-8f59-199c8bf748a4","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.314762Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:6294750b772eb59b256d32d45d2882388c716323d6c6fb15f473460076fc959c","observation_id":"8210dcf2-c3fc-41bd-93ff-44c07021f4f7","resolution":{"observed_at":"2026-08-14T15:43:22.868436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.697984Z","title":"For brevity, f(¯xt)−f∗ =O( 1√ T )","venue":null,"work_id":"05668a97-b8eb-4f64-9f4a-9b27e3b0e544","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.353595Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:a0d7c097c48b22327d74bcf425b3a12e7d422216ce522fc46481e4ce271bdf03","observation_id":"82fd7832-5332-4e68-b8fe-fcfcae8aaa1c","resolution":{"observed_at":"2026-08-14T15:43:22.735074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.666666Z","title":null,"venue":null,"work_id":"919107ec-ce66-4d71-9ac5-4ed9e714a25f","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.381079Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:1abec3619a7663075d4fef505ba18a5d7c643f23a7f3649d9bbda842f5b9f662","observation_id":"4fe05962-6b5d-45b7-9f3f-27ec2e0e46c6","resolution":{"observed_at":"2026-08-14T15:43:22.677674Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.609736Z","title":null,"venue":null,"work_id":"1e1f721f-f85f-435c-9a9b-c1e45987b508","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.406449Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:99b3d02b004a9c0e46d28c4bce2826b8e55b04b2eb793459c167b686e676be4a","observation_id":"6b654323-6b9b-4c27-b712-d50fc0d93ac3","resolution":{"observed_at":"2026-08-14T15:43:22.652059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:22.519570Z","title":"Set η =O( 1 T 2 ), E[f(xT +1)−f∗]≤ (1− 2λµ3 T 2 )TE[f(x1)−f∗] +O( 1 T )","venue":null,"work_id":"dcce047c-bd12-4fe6-837f-8871ec862332","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.439322Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:6b5316a2a5f35791af5ecbf82a44335c459aaa47e23253b2544e90b73b349bbc","observation_id":"9b0abe13-6aed-49ba-a102-9d02fd4992c7","resolution":{"observed_at":"2026-08-14T15:43:22.552564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T15:43:23.028454Z","title":"38 Remark 26 The leading item from the above convergence is C1/ √ T , β plays an essential role in the complexity, and a more accurate convergence should be O(βlog (1+eβ )√ T )","venue":null,"work_id":"b0cc68fa-1939-4040-8523-5d517d519f9d","year":null},"citing_paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM","version":2},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-14T15:43:22.214256Z"},"links":{"citing_paper":"/paper/1908.00700"},"observation_digest":"sha256:bb495bd57c5ad686260c35f37d614108a9f29977284768fc31f949fa99b8e6e0","observation_id":"61af7f28-a734-4c6f-ba88-84f5487363b8","resolution":{"observed_at":"2026-08-14T15:43:23.036490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.00700","last_updated":"2019-09-11T15:13:36Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T05:21:09.844665Z","submitted_at":"2019-08-02T04:20:34Z","title":"Calibrating the Adaptive Learning Rate to Improve Convergence of ADAM"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 0 inbound Pith citation observations for arXiv:1908.00700."}