{"as_of":"2026-08-19T13:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3052efd4b4fd51f3aae361e8e15df35262c530828a7817510b08d07bcc39a90e","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:25:02.913554Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T12:59:51.091008Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"cited_work":{"arxiv_id":"2504.20752","doi":"10.48550/arxiv.2504.20752","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.20752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","venue":"ArXiv.org","work_id":"2beb1017-e199-4b88-95b0-e4d1fb5b7575","year":2025},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-08-10T19:13:02Z","snapshot_observed_at":"2026-08-14T23:09:31.705348Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2504.20752","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:36a95845eafa316502dd146bbad69b58dfd75eb5286cd9bbb4a4378dc67beff7","observation_id":"3f85cbcb-95aa-456a-ac2f-9438fc6fb1ef","resolution":{"observed_at":"2026-06-27T13:00:56.103267Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.20752/citation-record","integrity":"/paper/2504.20752/integrity","json":"/paper/2504.20752/citation-record.json","paper":"/paper/2504.20752"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:02.729326Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.729326Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:379a01bb0370fe73a63e244c65833b6a74de5c82cc3a88af259cba1588ab4024","observation_id":"05274c05-fe2e-445f-b142-72ea33216038","resolution":{"observed_at":"2026-08-16T05:25:02.729326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:02.737130Z","title":"Reconciling modern machine-learning practice and the classical bias–variance trade-off","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.737130Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:905d0c2d54c0d0920335ecfb36ac029462a3a726704d38ff797464ebc5a88f13","observation_id":"63d2b90c-88b4-4dba-81af-0cabe2ef762f","resolution":{"observed_at":"2026-08-16T05:25:02.737130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.06173","last_updated":"2023-03-10T19:16:53Z","snapshot_observed_at":"2026-08-16T15:49:07.982971Z","submitted_at":"2023-03-10T19:16:53Z","title":"Unifying Grokking and Double Descent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.06173","snapshot_observed_at":"2026-08-16T05:25:02.745993Z","title":"Unifying grokking and double descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.745993Z"},"links":{"cited_paper":"/paper/2303.06173","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:620003daa842d6a4feac8df228e44e721c08e514c059b7708c86d5af5fc26080","observation_id":"f8e16b09-27d6-456b-82eb-643672f8cc94","resolution":{"observed_at":"2026-08-16T05:25:02.745993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:02.757444Z","title":"Constructing A Multi -hop QA Dataset for Comprehensive Evaluation of Reasoning Steps","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.757444Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:4ead1f62a683952f771759ca667771019d7c61d3c3fa9572f69937ee1cbaca4b","observation_id":"fd788774-905a-4713-9ea6-370b928fb831","resolution":{"observed_at":"2026-08-16T05:25:02.757444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12977","last_updated":"2023-10-19T17:59:44Z","snapshot_observed_at":"2026-08-19T11:35:38.953027Z","submitted_at":"2023-10-19T17:59:44Z","title":"Training Dynamics of Deep Network Linear Regions","version":1},"cited_work":{"arxiv_id":"2310.12977","doi":"10.48550/arxiv.2310.12977","metadata_source":"pith","pith_arxiv_id":"2310.12977","snapshot_observed_at":"2026-08-16T12:16:17.039197Z","title":"Training Dynamics of Deep Network Linear Regions","venue":"cs.LG","work_id":"f1b17c64-4a1e-4f26-bce4-4a0b9feb34ea","year":2023},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.770145Z"},"links":{"cited_paper":"/paper/2310.12977","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:796bc1959e9f6b5db6c542b470eddd09ee00760dee30308a68518ffd72c3e921","observation_id":"b605bb8b-9aa3-456b-a62f-b4d8ff35bf0e","resolution":{"observed_at":"2026-08-16T05:25:03.038616Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20233","last_updated":"2024-06-05T15:12:00Z","snapshot_observed_at":"2026-08-16T13:47:40.572603Z","submitted_at":"2024-05-30T16:35:30Z","title":"Grokfast: Accelerated Grokking by Amplifying Slow Gradients","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20233","snapshot_observed_at":"2026-08-16T05:25:02.785713Z","title":"G., Kim, K., and Lee, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.785713Z"},"links":{"cited_paper":"/paper/2405.20233","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:93ccf34a51e36fbeebcbdc5204f9e402d633140d39d1e0d7e9911673ea3a2a01","observation_id":"7abf4c34-4ffb-4c3c-8821-9f8cf949b2b9","resolution":{"observed_at":"2026-08-16T05:25:02.785713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:02.793400Z","title":"Joint Knowledge Graph Completion and Question Answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.793400Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:abb66223982373c6c1b75ef189eac1555688e0bd612954ff6dcacc2ee171e1ac","observation_id":"f2c8e9c0-a9f4-4c32-8a6d-3e6ae0f0675c","resolution":{"observed_at":"2026-08-16T05:25:02.793400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:03.627535Z","title":"J., and Tegmark, M","venue":null,"work_id":"7e0141e7-1525-4e9a-85ef-a06f5205b4b2","year":2023},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.799107Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:bb30e913a94289d0ad292d7ad1bc0a9f40f28814dca5b7c5536c6187a9fbed5c","observation_id":"97d676c7-eb44-4b66-9d7d-0a5a4f33235b","resolution":{"observed_at":"2026-08-16T05:25:03.634691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-16T05:25:02.810485Z","title":"Fixing weight decay regularization in adam","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.810485Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:bc55d4449ebb9288ee4d0db00620503f74ec82271a678934e484fe9ed203c540","observation_id":"a4d2c130-9e48-47d7-8644-1bbf57b20501","resolution":{"observed_at":"2026-08-16T05:25:02.810485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:03.577308Z","title":"Deep double descent: Where bigger models and more data hurt","venue":null,"work_id":"cd395483-4443-43a7-92e6-30b728590488","year":2020},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.818287Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:3f2e0c6d7d17b566f51f5d4305cbdae24f2498e5a06261e2cb64152edac2b413","observation_id":"2da2a0f3-260c-4e0c-a211-f7679d02e6b8","resolution":{"observed_at":"2026-08-16T05:25:03.589376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:02.826797Z","title":"Progress measures for grokking via mechanistic interpretability","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.826797Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:d232bb72dbcf89e397b2bca55cb1a0e4cc71ef69f269bcf1278a3330f22d0be2","observation_id":"5623f3ff-1655-449b-8933-74dd4c4e3665","resolution":{"observed_at":"2026-08-16T05:25:02.826797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:03.523564Z","title":"Multi-scale feature learning dynamics: Insights for double descent","venue":null,"work_id":"bc38a6df-62cb-4847-9e3e-efbaec1ecd0c","year":2022},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.849586Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:bbff652077451c85008c3f2bbc84666e48bd8559ffb8688d1c73816ce192e2cb","observation_id":"a8bdf8c8-daed-48da-96d0-783e2a8ce14a","resolution":{"observed_at":"2026-08-16T05:25:03.529935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:02.859424Z","title":"v., and Back, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.859424Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:21b239aa0a91c51ea5b14250dae61e6c0ebcff6de3b0ea01b7c48a5c3b12756e","observation_id":"71e19b3b-922a-4b13-b32b-4af451f98b88","resolution":{"observed_at":"2026-08-16T05:25:02.859424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02177","last_updated":"2022-01-06T18:43:37Z","snapshot_observed_at":"2026-08-18T12:23:06.967499Z","submitted_at":"2022-01-06T18:43:37Z","title":"Grokking: Generalization Beyond Overfitting on Small Algorithmic Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02177","snapshot_observed_at":"2026-08-16T05:25:02.876497Z","title":"Grokking: Generalization beyond overfitting on small algorithmic datasets","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.876497Z"},"links":{"cited_paper":"/paper/2201.02177","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:24f2db59abba3e0d14ce9abb3a135675874ceb69b42e472bd176710e709841a4","observation_id":"85469647-d46a-4c42-b3c8-2f1668a391d5","resolution":{"observed_at":"2026-08-16T05:25:02.876497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04817","last_updated":"2022-06-13T04:18:16Z","snapshot_observed_at":"2026-08-16T16:54:02.662840Z","submitted_at":"2022-06-10T00:04:21Z","title":"The Slingshot Mechanism: An Empirical Study of Adaptive Optimizers and the Grokking Phenomenon","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04817","snapshot_observed_at":"2026-08-16T05:25:02.883184Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.883184Z"},"links":{"cited_paper":"/paper/2206.04817","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:9ac8a984fca3c515488024fd53035d21af02ce07174f0b89386be79e37577def","observation_id":"630e4105-f7da-4a86-816d-567f0635ad58","resolution":{"observed_at":"2026-08-16T05:25:02.883184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:25:02.890115Z","title":"MuSiQue : Multihop Questions via Single -hop Question Composition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.890115Z"},"links":{"citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:d088edead5fd22c167b208115f829a95ac7e477288a572fcceb8f259181ec35b","observation_id":"0c6cfdfe-21e7-47fb-97ee-200cc50b4746","resolution":{"observed_at":"2026-08-16T05:25:02.890115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02390","last_updated":"2023-09-05T17:00:24Z","snapshot_observed_at":"2026-08-16T15:03:06.920972Z","submitted_at":"2023-09-05T17:00:24Z","title":"Explaining grokking through circuit efficiency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02390","snapshot_observed_at":"2026-08-16T05:25:02.896671Z","title":"Explaining grokking through circuit efficiency, September 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.896671Z"},"links":{"cited_paper":"/paper/2309.02390","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:2f92dc660cd4f64a9aa00676cf92f56397497ae1a2cba0904e3ca363b57e1146","observation_id":"d21e6a50-369f-43a3-9906-bbe587e242f9","resolution":{"observed_at":"2026-08-16T05:25:02.896671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15071","last_updated":"2024-10-30T18:47:53Z","snapshot_observed_at":"2026-08-18T08:22:27.203727Z","submitted_at":"2024-05-23T21:42:19Z","title":"Grokked Transformers are Implicit Reasoners: A Mechanistic Journey to the Edge of Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15071","snapshot_observed_at":"2026-08-16T05:25:02.907050Z","title":"Grokked Transformers are Implicit Reasoners : A Mechanistic Journey to the Edge of Generalization , May 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.907050Z"},"links":{"cited_paper":"/paper/2405.15071","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:dfd7d03e660d8a16d16f26cc37c53434eda6bafa141644a188a732218ba36596","observation_id":"056030f5-4be6-47f7-9caf-c65aef1c837c","resolution":{"observed_at":"2026-08-16T05:25:02.907050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-17T01:54:11.006899Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-16T05:25:02.913554Z","title":"W., Salakhutdinov, R., and Manning, C","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T05:25:02.913554Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2504.20752"},"observation_digest":"sha256:60f805bc47a39458d010b6be2370bb4797eb7624bb73c018c1c4e3ac01fc0bc9","observation_id":"14ca0e9b-67ca-4543-9a9c-7fbc8ddf21a4","resolution":{"observed_at":"2026-08-16T05:25:02.913554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.20752","last_updated":"2025-05-07T09:47:51Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T08:31:50.465000Z","submitted_at":"2025-04-29T13:33:29Z","title":"Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 1 inbound Pith citation observation for arXiv:2504.20752."}