{"as_of":"2026-08-08T15:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1823c8a8966d1633718ef00b44f39ff4298bf958410dd04b568ad615fa219ac","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:45:10.173055Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T14:04:45.249124Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":"2308.05621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-06-30T14:04:45.249124Z","title":"Nesterov","venue":null,"work_id":"ef0978f5-de28-4fbf-91bc-13ecf3e7acbb","year":2012},"citing_paper":{"arxiv_id":"2502.07529","last_updated":"2025-06-06T13:42:19Z","snapshot_observed_at":"2026-08-03T03:50:14.086851Z","submitted_at":"2025-02-11T13:10:34Z","title":"Training Deep Learning Models with Norm-Constrained LMOs","version":2},"reference_index":201,"source":"arxiv_source","source_observed_at":"2026-05-21T21:22:36.870292Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2502.07529"},"observation_digest":"sha256:1782e176a932cbe6f7b82bbff1f57f872e285db33645cb02e4092826afba6b2e","observation_id":"b86d2590-5808-45dc-b823-0f3bbfcefae2","resolution":{"observed_at":"2026-05-21T21:22:37.077202Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":"2308.05621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-06-30T14:04:45.249124Z","title":"Nesterov","venue":null,"work_id":"ef0978f5-de28-4fbf-91bc-13ecf3e7acbb","year":2012},"citing_paper":{"arxiv_id":"2506.12648","last_updated":"2026-05-15T19:09:03Z","snapshot_observed_at":"2026-08-06T01:54:06.797273Z","submitted_at":"2025-06-14T22:18:53Z","title":"Glocal Smoothness: Line search and adaptive step sizes can help in theory too!","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T00:57:03.982703Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2506.12648"},"observation_digest":"sha256:c415b047b2396907e487b77f4a5261231ee390f03e1505896c683ae7ef2b5dbc","observation_id":"9bb9c299-cac0-4b00-a284-ab1de3f4a0da","resolution":{"observed_at":"2026-05-22T01:00:52.243994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-08-06T21:45:10.173055Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.23803","last_updated":"2025-06-30T12:47:10Z","snapshot_observed_at":"2026-08-06T21:29:10.072225Z","submitted_at":"2025-06-30T12:47:10Z","title":"SGD with Adaptive Preconditioning: Unified Analysis and Momentum Acceleration","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:10.173055Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2506.23803"},"observation_digest":"sha256:302d87b2bbc802c9d6846da109840012d39af85195f2f5d54f2380d1a34040e4","observation_id":"697105f1-47ad-4c49-84b3-236b98b37cd2","resolution":{"observed_at":"2026-08-06T21:45:10.173055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-08-06T17:59:08.087181Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09823","last_updated":"2025-08-29T15:15:31Z","snapshot_observed_at":"2026-08-06T17:44:16.269487Z","submitted_at":"2025-07-13T23:07:45Z","title":"Nesterov Finds GRAAL: Optimal and Adaptive Gradient Method for Convex Optimization","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T17:59:08.087181Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2507.09823"},"observation_digest":"sha256:2069cfdefa28738bc82c187ed71083e0f5503568d792f4195b3c5ecd6535b98d","observation_id":"b294c62b-46ac-4af6-8ee9-5afcaa70cf19","resolution":{"observed_at":"2026-08-06T17:59:08.087181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-08-05T11:25:45.035920Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02981","last_updated":"2025-09-06T21:55:53Z","snapshot_observed_at":"2026-08-06T03:06:03.666431Z","submitted_at":"2025-09-03T03:42:22Z","title":"AdaGrad Meets Muon: Adaptive Stepsizes for Orthogonal Updates","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T11:25:45.035920Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2509.02981"},"observation_digest":"sha256:2a04dd51d35e427548902101e2f4f393ad94e943ae54898a1f33a7f1395ef386","observation_id":"11e49d20-8ae1-448d-863e-01dd7de3ab65","resolution":{"observed_at":"2026-08-05T11:25:45.035920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":"2308.05621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-06-30T14:04:45.249124Z","title":"Nesterov","venue":null,"work_id":"ef0978f5-de28-4fbf-91bc-13ecf3e7acbb","year":2012},"citing_paper":{"arxiv_id":"2604.02505","last_updated":"2026-04-02T21:02:10Z","snapshot_observed_at":"2026-07-06T22:51:53.458444Z","submitted_at":"2026-04-02T21:02:10Z","title":"Optimal Projection-Free Adaptive SGD for Matrix Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T20:56:41.466669Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2604.02505"},"observation_digest":"sha256:cba07b489429c511278cedab9c183c878165fdf6f60e44542de78a9393ead315","observation_id":"5938504b-6833-4ef0-89df-25d93ece93bc","resolution":{"observed_at":"2026-05-13T20:58:15.730379Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":"2308.05621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-06-30T14:04:45.249124Z","title":"Nesterov","venue":null,"work_id":"ef0978f5-de28-4fbf-91bc-13ecf3e7acbb","year":2012},"citing_paper":{"arxiv_id":"2604.06525","last_updated":"2026-04-14T04:56:12Z","snapshot_observed_at":"2026-08-02T21:35:49.903063Z","submitted_at":"2026-04-07T23:43:48Z","title":"Stochastic Auto-conditioned Fast Gradient Methods with Optimal Rates","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T18:23:59.771222Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2604.06525"},"observation_digest":"sha256:f7c0d85b59d4e91eaab8d533a4ce7572909ed2a4d33f1765e0ccb37d40482d45","observation_id":"262390be-1b2b-4bd2-bd3c-461b3dfb44b2","resolution":{"observed_at":"2026-05-11T00:41:05.436600Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":"2308.05621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-06-30T14:04:45.249124Z","title":"Nesterov","venue":null,"work_id":"ef0978f5-de28-4fbf-91bc-13ecf3e7acbb","year":2012},"citing_paper":{"arxiv_id":"2604.26867","last_updated":"2026-05-18T20:15:44Z","snapshot_observed_at":"2026-08-05T21:35:22.094908Z","submitted_at":"2026-04-29T16:34:11Z","title":"Function-free Optimization via Comparison Oracles","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T00:08:34.431809Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2604.26867"},"observation_digest":"sha256:88cc245c014c484dc1bef804c8fe471207b4e3d1b7d56c3aa8def2c44d9336b9","observation_id":"5e3d897c-ec10-4a8d-bafa-aa34785c4541","resolution":{"observed_at":"2026-05-21T00:09:16.827801Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All","version":1},"cited_work":{"arxiv_id":"2308.05621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.05621","snapshot_observed_at":"2026-06-30T14:04:45.249124Z","title":"Nesterov","venue":null,"work_id":"ef0978f5-de28-4fbf-91bc-13ecf3e7acbb","year":2012},"citing_paper":{"arxiv_id":"2606.29893","last_updated":"2026-06-29T07:31:55Z","snapshot_observed_at":"2026-08-07T16:39:06.909379Z","submitted_at":"2026-06-29T07:31:55Z","title":"AdaGrad does not adapt to H\\\"older-smoothness for composite objectives","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-30T05:37:19.393934Z"},"links":{"cited_paper":"/paper/2308.05621","citing_paper":"/paper/2606.29893"},"observation_digest":"sha256:bafdedaa47e9a8d22a5bd3cee0995d6822eb79b175354400fbb027b84c9df6d7","observation_id":"9b1d2338-fcbc-4e2b-98a2-94d06fb65a26","resolution":{"observed_at":"2026-06-30T14:04:45.251069Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2308.05621/citation-record","integrity":"/paper/2308.05621/integrity","json":"/paper/2308.05621/citation-record.json","paper":"/paper/2308.05621"},"outbound":[],"paper":{"arxiv_id":"2308.05621","last_updated":"2023-08-10T15:10:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:04:54.766026Z","submitted_at":"2023-08-10T15:10:08Z","title":"Normalized Gradients for All"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2308.05621."}