{"as_of":"2026-08-10T10:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:379e1e4c608f66f67e5115e5ee1986f62d4f34ea07b10ce9ff83631e4f5338a1","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:44:27.023924Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T19:51:04.968766Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.19454","last_updated":"2024-05-29T19:05:11Z","snapshot_observed_at":"2026-07-06T18:22:14.521977Z","submitted_at":"2024-05-29T19:05:11Z","title":"Deep Grokking: Would Deep Neural Networks Generalize Better?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19454","snapshot_observed_at":"2026-08-09T14:44:27.023924Z","title":"Deep grokking: Would deep neural networks generalize better?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01739","last_updated":"2025-02-03T19:00:02Z","snapshot_observed_at":"2026-08-09T23:01:29.939584Z","submitted_at":"2025-02-03T19:00:02Z","title":"Grokking vs. Learning: Same Features, Different Encodings","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T14:44:27.023924Z"},"links":{"cited_paper":"/paper/2405.19454","citing_paper":"/paper/2502.01739"},"observation_digest":"sha256:c0b1ce8ab806923e187507b0a7f4726ca58061f986fb870d6e7191cd1de36e17","observation_id":"3c8c77e5-fe0f-4266-8e02-25ba5d3f3d22","resolution":{"observed_at":"2026-08-09T14:44:27.023924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19454","last_updated":"2024-05-29T19:05:11Z","snapshot_observed_at":"2026-07-06T18:22:14.521977Z","submitted_at":"2024-05-29T19:05:11Z","title":"Deep Grokking: Would Deep Neural Networks Generalize Better?","version":1},"cited_work":{"arxiv_id":"2405.19454","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.19454","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep grokking: Would deep neural networks generalize better?","venue":null,"work_id":"2c41d455-7ee4-4397-a400-38c236c272b9","year":2024},"citing_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T19:51:04.779597Z"},"links":{"cited_paper":"/paper/2405.19454","citing_paper":"/paper/2504.20571"},"observation_digest":"sha256:c67188dfe6f1c25fb4e9aaee804935325a25b5797451f5e0070e408bf345e337","observation_id":"56670751-48f9-4bc0-90c8-2dd89773d875","resolution":{"observed_at":"2026-05-15T19:51:04.972881Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19454","last_updated":"2024-05-29T19:05:11Z","snapshot_observed_at":"2026-07-06T18:22:14.521977Z","submitted_at":"2024-05-29T19:05:11Z","title":"Deep Grokking: Would Deep Neural Networks Generalize Better?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19454","snapshot_observed_at":"2026-08-07T15:20:31.512408Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15624","last_updated":"2025-05-21T15:12:34Z","snapshot_observed_at":"2026-08-07T15:11:28.332416Z","submitted_at":"2025-05-21T15:12:34Z","title":"Mechanistic Insights into Grokking from the Embedding Layer","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:20:31.512408Z"},"links":{"cited_paper":"/paper/2405.19454","citing_paper":"/paper/2505.15624"},"observation_digest":"sha256:585b14263b6f7fe29f1777e760279afe55a3e01d8a12408cc68348ac527aef52","observation_id":"9945eda6-9954-4e43-90e3-a9ff8dec296c","resolution":{"observed_at":"2026-08-07T15:20:31.512408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19454","last_updated":"2024-05-29T19:05:11Z","snapshot_observed_at":"2026-07-06T18:22:14.521977Z","submitted_at":"2024-05-29T19:05:11Z","title":"Deep Grokking: Would Deep Neural Networks Generalize Better?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19454","snapshot_observed_at":"2026-08-06T17:10:12.014069Z","title":"Deep Grokking: Would Deep Neural Networks Generalize Better?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11645","last_updated":"2025-07-15T18:30:42Z","snapshot_observed_at":"2026-08-10T07:15:10.597968Z","submitted_at":"2025-07-15T18:30:42Z","title":"Tracing the Path to Grokking: Embeddings, Dropout, and Network Activation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:10:12.014069Z"},"links":{"cited_paper":"/paper/2405.19454","citing_paper":"/paper/2507.11645"},"observation_digest":"sha256:b9faa1ea1e4c85589edb4e912b4e282f5df574d5b039cfd61d398b04e1386cd8","observation_id":"f9faaf10-b663-4e5e-8343-e0cdadab1ac0","resolution":{"observed_at":"2026-08-06T17:10:12.014069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19454","last_updated":"2024-05-29T19:05:11Z","snapshot_observed_at":"2026-07-06T18:22:14.521977Z","submitted_at":"2024-05-29T19:05:11Z","title":"Deep Grokking: Would Deep Neural Networks Generalize Better?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19454","snapshot_observed_at":"2026-08-04T22:57:12.089881Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06931","last_updated":"2025-09-08T17:43:45Z","snapshot_observed_at":"2026-08-09T08:30:23.163548Z","submitted_at":"2025-09-08T17:43:45Z","title":"Learning words in groups: fusion algebras, tensor ranks and grokking","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T22:57:12.089881Z"},"links":{"cited_paper":"/paper/2405.19454","citing_paper":"/paper/2509.06931"},"observation_digest":"sha256:002be4cdd86bd4b245db22263b7e4f6fb268f6df6d0ab2345c1146205bfa5abb","observation_id":"8f98a357-1f12-4e32-9685-f53fee496fca","resolution":{"observed_at":"2026-08-04T22:57:12.089881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.19454/citation-record","integrity":"/paper/2405.19454/integrity","json":"/paper/2405.19454/citation-record.json","paper":"/paper/2405.19454"},"outbound":[],"paper":{"arxiv_id":"2405.19454","last_updated":"2024-05-29T19:05:11Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T18:22:14.521977Z","submitted_at":"2024-05-29T19:05:11Z","title":"Deep Grokking: Would Deep Neural Networks Generalize Better?"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2405.19454."}