{"as_of":"2026-08-11T04:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:561e746055d30b9418413658cbec4d4d7f6cbc6508441f35741ebf2c23ef56e5","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:46:12.809159Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:32:08.793867Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T12:32:09.949912Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"cited_work":{"arxiv_id":"2412.19444","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.19444","snapshot_observed_at":"2026-08-07T12:32:09.949912Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","venue":"cs.LG","work_id":"0c6cf786-562b-4dc9-9661-dd9398c3436c","year":2024},"citing_paper":{"arxiv_id":"2505.24399","last_updated":"2025-05-30T09:28:38Z","snapshot_observed_at":"2026-08-10T06:04:25.777105Z","submitted_at":"2025-05-30T09:28:38Z","title":"LightSAM: Parameter-Agnostic Sharpness-Aware Minimization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:08.793867Z"},"links":{"cited_paper":"/paper/2412.19444","citing_paper":"/paper/2505.24399"},"observation_digest":"sha256:6edd5b3511a8bb228bf03d89b03bd69266b26af79ed7452c3fbc7db41b17ac54","observation_id":"78bc8145-df67-48db-b8aa-820041ac313a","resolution":{"observed_at":"2026-08-07T12:32:10.057644Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.19444/citation-record","integrity":"/paper/2412.19444/integrity","json":"/paper/2412.19444/citation-record.json","paper":"/paper/2412.19444"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.190681Z","title":"and Cevher, V","venue":null,"work_id":"ecbb56f0-944f-46cf-8b0d-215da4b67f3b","year":2020},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.699684Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:fbc1423be1943151ca12ad38e452cd73d82df290323c75c4acf4c3344808e262","observation_id":"c45f2ce4-c3c3-45bf-bb4f-0d9a0a9cdcb2","resolution":{"observed_at":"2026-08-11T00:46:13.194961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.177186Z","title":"Each curve represents the mean of 8 random runs, with the shaded area indicating the standard error","venue":null,"work_id":"06850961-62e1-4795-8fd5-0919d5f51f3c","year":2020},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.707251Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:df06f6c4656d60f7688af3c4cd043ed8793aa9ec5934136977a1e9301dc2b37b","observation_id":"278785bd-5425-46eb-ab6d-3f5d84bc2c3a","resolution":{"observed_at":"2026-08-11T00:46:13.181756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.163850Z","title":"Each curve represents the mean of 8 random runs, with the shaded area indicating the standard error","venue":null,"work_id":"7a6603d7-71c7-41aa-baf3-0afb14a744c4","year":2015},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.712659Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:1c75fe639eb6614816f9ed0acc728f20c5e12dc45cabd65927a1bfd77d505b6c","observation_id":"a7bd8b8d-92d0-46b7-a34a-09a02de66a0e","resolution":{"observed_at":"2026-08-11T00:46:13.168412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.06763","last_updated":"2020-06-23T06:47:00Z","snapshot_observed_at":"2026-08-06T17:48:49.820786Z","submitted_at":"2018-06-18T15:17:01Z","title":"Closing the Generalization Gap of Adaptive Gradient Methods in Training Deep Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.06763","snapshot_observed_at":"2026-08-11T00:46:12.720055Z","title":"Chen, J., Zhou, D., Tang, Y., Yang, Z., Cao, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.720055Z"},"links":{"cited_paper":"/paper/1806.06763","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:5f45985fa859bac789ee33478d5f6bc7d8058261b675835f9e118a678ef8ebee","observation_id":"070ed9ff-f296-4116-9887-60f3de0940c2","resolution":{"observed_at":"2026-08-11T00:46:12.720055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.150596Z","title":"gap of adaptive gradient methods in training deep neural networks","venue":null,"work_id":"4bcbd8e3-9547-416e-a119-7cacd938a905","year":2022},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.726344Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:fff022207198be6b158ab633695e290706a2845030b824b3fd93be5e578f9a98","observation_id":"8c2d11e5-ed4c-4ac2-a999-3ce1e98b44a9","resolution":{"observed_at":"2026-08-11T00:46:13.154990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07146","last_updated":"2017-06-14T06:06:48Z","snapshot_observed_at":"2026-08-08T14:57:17.868613Z","submitted_at":"2016-05-23T19:27:13Z","title":"Wide Residual Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07146","snapshot_observed_at":"2026-08-11T00:46:12.804230Z","title":"Wide residual networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.804230Z"},"links":{"cited_paper":"/paper/1605.07146","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:443c1a8af3c1d711eb498c21f1e031a0061dd04acfa67bd6b7d388066ae29f47","observation_id":"ebb75d1f-9d1c-48b9-8eec-06f1f1d01b14","resolution":{"observed_at":"2026-08-11T00:46:12.804230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.115947Z","title":null,"venue":null,"work_id":"fdc82f8a-3e59-436a-a96f-7a66d84b0c67","year":2000},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.737685Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:7295b502bfccbeb59ae6d666f3a55138bbf11380c8c4c5e4b5842bfa951b6c02","observation_id":"1fc5a68e-961b-49c9-b5e6-a34a28be9e7f","resolution":{"observed_at":"2026-08-11T00:46:13.121956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.100648Z","title":null,"venue":null,"work_id":"1ffa993d-0cf9-48c0-9aca-b49df5e44454","year":2000},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.742848Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:6bf6ab4afc1d118f9fb4a3b2a19f2b88e5ae90e651a531e3838b6875234f01f7","observation_id":"98a583b5-3984-4c05-8aaf-ab7c112c2927","resolution":{"observed_at":"2026-08-11T00:46:13.104992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.084767Z","title":"conference on machine learning","venue":null,"work_id":"bfef448b-9733-4cc1-b3c5-8f8e9610fa13","year":2019},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.752048Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:f215dcbf603604dd8a6c25eedcd585410566e5e423a16b6ed8ac9bdef82e1b15","observation_id":"d9104c58-f93e-4607-845b-568c4f79db4b","resolution":{"observed_at":"2026-08-11T00:46:13.091232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11851","last_updated":"2021-09-23T19:39:54Z","snapshot_observed_at":"2026-07-06T11:21:48.104719Z","submitted_at":"2021-06-22T15:11:18Z","title":"Stochastic Polyak Stepsize with a Moving Target","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11851","snapshot_observed_at":"2026-08-11T00:46:12.761309Z","title":"Openwebtext corpus","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.761309Z"},"links":{"cited_paper":"/paper/2106.11851","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:c9ee4853831725055af1f4bd5d2e291c0939ba8265ebefa9e11711c11da1c748","observation_id":"ed06d3cc-6451-4aec-8b93-c0ed8c6d5554","resolution":{"observed_at":"2026-08-11T00:46:12.761309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.064544Z","title":"Each curve represents the mean of 8 random runs, with the shaded area indicating the standard error","venue":null,"work_id":"322f5454-22ec-426b-8fae-82237cb3de3c","year":2018},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.766197Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:a6623c81c1f07e412a2c10752fb75ae64323d2a7fd81edbc96eca8b8d7343294","observation_id":"f04be3e1-1d6a-4c23-b25b-8c6f364a30a3","resolution":{"observed_at":"2026-08-11T00:46:13.071445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T00:46:12.776291Z","title":"Each curve represents the mean of 8 random runs, with the shaded area indicating the standard error","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.776291Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:b07eb078c80c97c98afc5d8d7e6b5d306478132827ebfb5e53205c283663d3bd","observation_id":"758f17a2-29ae-4ddf-9ca1-55712a79097e","resolution":{"observed_at":"2026-08-11T00:46:12.776291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.14840","last_updated":"2025-04-04T20:13:36Z","snapshot_observed_at":"2026-08-09T23:11:19.514459Z","submitted_at":"2021-04-30T08:50:24Z","title":"Unified Convergence Analysis for Adaptive Optimization with Moving Average Estimator","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.14840","snapshot_observed_at":"2026-08-11T00:46:12.771288Z","title":"and Yang, T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.771288Z"},"links":{"cited_paper":"/paper/2104.14840","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:ea41a6e60f74f2bb883f5f5ae84bd9b3300302788639b2a9248356f5bb301650","observation_id":"7e205dc3-d351-4631-9e22-db78b72f9e64","resolution":{"observed_at":"2026-08-11T00:46:12.771288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.03888","last_updated":"2017-09-13T23:25:07Z","snapshot_observed_at":"2026-07-06T05:55:05.946111Z","submitted_at":"2017-08-13T11:01:57Z","title":"Large Batch Training of Convolutional Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.03888","snapshot_observed_at":"2026-08-11T00:46:12.799980Z","title":"Adagrad stepsizes: Sharp convergence over nonconvex landscapes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.799980Z"},"links":{"cited_paper":"/paper/1708.03888","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:d51e77377d902e04a67bab0e11b090750b32c00ffe35a98f496a2338b3f50e79","observation_id":"e70e1030-d237-454b-8cb7-08542b25a244","resolution":{"observed_at":"2026-08-11T00:46:12.799980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.05671","last_updated":"2024-06-20T16:13:13Z","snapshot_observed_at":"2026-08-10T02:19:11.168415Z","submitted_at":"2018-08-16T20:25:28Z","title":"On the Convergence of Adaptive Gradient Methods for Nonconvex Optimization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.05671","snapshot_observed_at":"2026-08-11T00:46:12.809159Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.809159Z"},"links":{"cited_paper":"/paper/1808.05671","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:441e15b4e477a3e01c474a3f619aab117c89992b3eab9da39b3902620b15740a","observation_id":"0623f153-eed2-4dce-8f30-f3a365d15da1","resolution":{"observed_at":"2026-08-11T00:46:12.809159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.026231Z","title":"and Tommasi, T","venue":null,"work_id":"42042ec7-2c28-4a6f-9dfc-62f2ae058174","year":2017},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.785431Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:5d884c739ade98e5e69b34d3b788a6be580d1ca32c282560a7cb8977430e08a1","observation_id":"c7a9b6de-3a54-479f-925b-93ec2bf95955","resolution":{"observed_at":"2026-08-11T00:46:13.034393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.07994","last_updated":"2018-07-20T18:33:52Z","snapshot_observed_at":"2026-07-06T06:51:27.956294Z","submitted_at":"2018-07-20T18:33:52Z","title":"A Stochastic Line Search Method with Convergence Rate Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.07994","snapshot_observed_at":"2026-08-11T00:46:12.790062Z","title":"and Loizou, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.790062Z"},"links":{"cited_paper":"/paper/1807.07994","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:6cf6d52b7fd1e8cad4f8f4099b7845e885bb7d42d136aa72901ee45a0191c97d","observation_id":"8abf8337-a83f-462e-946c-1bdc984d8e3e","resolution":{"observed_at":"2026-08-11T00:46:12.790062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-10T22:24:05.831832Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-11T00:46:12.795898Z","title":"Very deep convolutional networks for large-scale image recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.795898Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:2029aaa3a6c9a209fe7baa463e56df6a4dea5656e190a8149df62d4983cb5418","observation_id":"a444f1aa-1c71-4b22-9115-d3b67c3024dd","resolution":{"observed_at":"2026-08-11T00:46:12.795898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15682","last_updated":"2024-10-29T22:40:23Z","snapshot_observed_at":"2026-07-06T18:19:25.869339Z","submitted_at":"2024-05-24T16:20:46Z","title":"The Road Less Scheduled","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15682","snapshot_observed_at":"2026-08-11T00:46:12.756664Z","title":"et al.(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.756664Z"},"links":{"cited_paper":"/paper/2405.15682","citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:132ddae2db441eb2d1d5fea2d4d2f0a67e9d4cd7c936b8472933937b70dd8f54","observation_id":"6de7761c-9ff8-4e6e-8099-ae4ac6d6189e","resolution":{"observed_at":"2026-08-11T00:46:12.756664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.132883Z","title":"and Yang, T","venue":null,"work_id":"f2fe7771-9ef4-4dae-9ff9-ff6352044971","year":2018},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.732285Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:d2e250dcb9750e0008939a2411396284776a6dfcbf8c99629e91a3004a87d858","observation_id":"f1df9e0f-e611-4b67-a705-adec0c2495c9","resolution":{"observed_at":"2026-08-11T00:46:13.138063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:13.048198Z","title":"Orabona, F","venue":null,"work_id":"b87641c1-cb3a-44a4-a30e-8d9714bc26ca","year":2014},"citing_paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods","version":2},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-11T00:46:12.781351Z"},"links":{"citing_paper":"/paper/2412.19444"},"observation_digest":"sha256:8ca64562fa03dc123e333e02e73d7054372e7d6090939f498ee6f41d4fcbc60e","observation_id":"2b8987b1-9a4a-4dce-a53c-24fe2cb46f72","resolution":{"observed_at":"2026-08-11T00:46:13.053028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.19444","last_updated":"2026-05-31T16:34:26Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T00:33:16.420403Z","submitted_at":"2024-12-27T04:22:02Z","title":"Towards Simple and Provable Parameter-Free Adaptive Gradient Methods"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 1 inbound Pith citation observation for arXiv:2412.19444."}