{"as_of":"2026-08-24T00:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:108e5dc2a18cf8ea16f2c2b1ba485b6b5ae531bb4b2fd03e9a31cbe23f56a9d9","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:37:19.907107Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T21:03:04.021627Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T19:05:00.327994Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04318","snapshot_observed_at":"2026-08-09T21:03:04.021627Z","title":"The hyperfitting phenomenon: Sharpening and stabilizing llms for open-ended text generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19195","last_updated":"2025-06-25T16:24:12Z","snapshot_observed_at":"2026-08-19T20:26:09.492294Z","submitted_at":"2025-01-31T15:03:54Z","title":"Rethinking Early Stopping: Refine, Then Calibrate","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T21:03:04.021627Z"},"links":{"cited_paper":"/paper/2412.04318","citing_paper":"/paper/2501.19195"},"observation_digest":"sha256:90bc6726c715cbdb555149be6dbb48f6404a7ce2cbff31b2c1577262cae613ef","observation_id":"b3a9a617-327c-41fa-9f44-b0de61023470","resolution":{"observed_at":"2026-08-09T21:03:04.021627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04318","snapshot_observed_at":"2026-08-07T14:41:39.281110Z","title":"The Hyperfitting Phenomenon : Sharpening and Stabilizing LLMs for Open - Ended Text Generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17988","last_updated":"2025-08-05T11:46:13Z","snapshot_observed_at":"2026-08-09T20:50:22.177201Z","submitted_at":"2025-05-23T14:55:22Z","title":"Towards Revealing the Effectiveness of Small-Scale Fine-tuning in R1-style Reinforcement Learning","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:41:39.281110Z"},"links":{"cited_paper":"/paper/2412.04318","citing_paper":"/paper/2505.17988"},"observation_digest":"sha256:2b98eee7e11b49d0aefe3e082dbe3928efc305975c958387c6669f5316e41236","observation_id":"cf4a11ce-1b22-4ae5-9bd5-12572d62f4d8","resolution":{"observed_at":"2026-08-07T14:41:39.281110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04318","snapshot_observed_at":"2026-08-03T01:05:25.931091Z","title":"The hyperfitting phenomenon: Sharpening and stabilizing llms for open-ended text generation.arXiv preprint arXiv:2412.04318,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.15894","last_updated":"2026-05-27T12:13:06Z","snapshot_observed_at":"2026-08-15T18:55:19.443984Z","submitted_at":"2026-02-11T10:28:50Z","title":"Quality-constrained Entropy Maximization Policy Optimization for LLM Diversity","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T01:05:25.931091Z"},"links":{"cited_paper":"/paper/2412.04318","citing_paper":"/paper/2602.15894"},"observation_digest":"sha256:7e2d47af992a49f2106b05cfa988750b6ca973ca7426f0d25435b2bffcbbb732","observation_id":"14262ad3-f793-40f6-82a3-2fdc91bf01c6","resolution":{"observed_at":"2026-08-03T01:05:25.931091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"cited_work":{"arxiv_id":"2412.04318","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04318","snapshot_observed_at":"2026-06-30T19:05:00.327994Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","venue":null,"work_id":"288370d9-1b0a-477e-8c06-bf32fdf71d55","year":2024},"citing_paper":{"arxiv_id":"2605.17064","last_updated":"2026-06-28T13:06:30Z","snapshot_observed_at":"2026-08-15T21:20:36.023762Z","submitted_at":"2026-05-16T16:10:41Z","title":"Towards Human-Level Book-Writing Capability","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T15:40:53.245419Z"},"links":{"cited_paper":"/paper/2412.04318","citing_paper":"/paper/2605.17064"},"observation_digest":"sha256:647bcc0120bb482b51a03516145ade726165db0aa5afa15ca8cc5f757e92cd29","observation_id":"82bd4675-3582-4a2b-811f-94ea0201274d","resolution":{"observed_at":"2026-05-20T15:43:27.022818Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"cited_work":{"arxiv_id":"2412.04318","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.04318","snapshot_observed_at":"2026-06-30T19:05:00.327994Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","venue":null,"work_id":"288370d9-1b0a-477e-8c06-bf32fdf71d55","year":2024},"citing_paper":{"arxiv_id":"2605.17064","last_updated":"2026-06-28T13:06:30Z","snapshot_observed_at":"2026-08-15T21:20:36.023762Z","submitted_at":"2026-05-16T16:10:41Z","title":"Towards Human-Level Book-Writing Capability","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T19:03:27.257098Z"},"links":{"cited_paper":"/paper/2412.04318","citing_paper":"/paper/2605.17064"},"observation_digest":"sha256:011e236dd0dff7e4858816e40f6f11e2d246dc92cf30a92dbe29c3477602c059","observation_id":"7e68a4d7-7776-4d71-ae0c-4fcb0d80565a","resolution":{"observed_at":"2026-06-30T19:05:00.330321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.04318/citation-record","integrity":"/paper/2412.04318/integrity","json":"/paper/2412.04318/citation-record.json","paper":"/paper/2412.04318"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.06963","last_updated":"2025-07-29T03:57:01Z","snapshot_observed_at":"2026-08-16T14:10:51.973960Z","submitted_at":"2024-03-11T17:47:30Z","title":"The pitfalls of next-token prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06963","snapshot_observed_at":"2026-08-11T21:37:19.771484Z","title":"The pitfalls of next-token prediction, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.771484Z"},"links":{"cited_paper":"/paper/2403.06963","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:67df254a31f4227be79cf9bb88af3034defeb0284f54de5612d14ae2b752f262","observation_id":"7edaab7e-f345-40d9-b401-0fb1e5f3f1c7","resolution":{"observed_at":"2026-08-11T21:37:19.771484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.780875Z","title":"Reconciling modern machine-learning practice and the classical bias–variance trade-off","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.780875Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:0c06e91209f989b348504f38d8b589f12cfcfb5285a85528d02edb2a62eabc40","observation_id":"feb83713-020e-41cc-a4c4-6e01d94ed2a3","resolution":{"observed_at":"2026-08-11T21:37:19.780875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-14T19:47:04.330126Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-11T21:37:19.785090Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.785090Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:0cc1212929cfea5131c9d1208aa7ba7273cc8a2da14315df90dc1deee45661aa","observation_id":"c87fc84a-c4ec-4424-9137-3dd8f87f9107","resolution":{"observed_at":"2026-08-11T21:37:19.785090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T21:37:19.790929Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.790929Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:18c2e43597488af1dc231debdadc92aff32c0784b7ab08e5b417ce106a20b4ce","observation_id":"860e0920-f258-48a3-b74c-e237a8f9bb23","resolution":{"observed_at":"2026-08-11T21:37:19.790929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-18T22:17:47.865607Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-11T21:37:19.795377Z","title":"Lundberg, Harsha Nori, Hamid Palangi, Marco T \\' u lio Ribeiro, and Yi Zhang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.795377Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:362081dc43569baa7211690c8bf2cd9931eb86b485ddadb99ab89c793495ea79","observation_id":"6781914f-6edc-43c0-8aef-e382ecd9c6d1","resolution":{"observed_at":"2026-08-11T21:37:19.795377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.221968Z","title":"Branch- GAN : Improving text generation with (not so) large language models","venue":null,"work_id":"d03b102c-06e1-49e1-94f4-53646a475e55","year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.799578Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:29f628835b8517e3f630ed6532ebad768904a9409f03a2e82731e7ef6faebfaa","observation_id":"1aa015df-3b6c-40ab-84a0-863f22b61312","resolution":{"observed_at":"2026-08-11T21:37:20.225676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.211626Z","title":"Generative pretraining from pixels","venue":null,"work_id":"51ccea74-7d72-487e-858b-bf9fb52e29d7","year":2020},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.803376Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:76da9fc4036e7f8714cf6a0a03ba4fc06dddb5f3a0709ed6bd9837ec793bc6cd","observation_id":"0d97de0d-2c21-4d03-9e58-bc0912345134","resolution":{"observed_at":"2026-08-11T21:37:20.215681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-11T21:37:19.806778Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.806778Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:7714ce4909c5a5ac22c8bf0e329644eca1ff48935b3a056f02af8a349f00c762","observation_id":"caf1e9ad-415e-4084-85e4-5a9788962f03","resolution":{"observed_at":"2026-08-11T21:37:19.806778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.201400Z","title":"Text english code fiction nonfiction dataset, 2024","venue":null,"work_id":"95536e28-96bb-4b07-b4ad-41d97a1d8f22","year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.811091Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:d17452d8e6f7a2dc6e6335fe7057c8121b2add708f59a4f602c7f9cffe0514e1","observation_id":"1353a1e0-6733-4e60-871c-a911bbbbbbd0","resolution":{"observed_at":"2026-08-11T21:37:20.204929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.192013Z","title":"A theoretical analysis of the repetition problem in text generation","venue":null,"work_id":"a77843e2-5217-4699-a7e8-7ea92b69bae1","year":2020},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.814304Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:0c38b98e08e6862d15e465b4f93aeaaeb7f3f7437090682a17240db26e42f36a","observation_id":"18224769-5e18-4e41-847a-391c036047dc","resolution":{"observed_at":"2026-08-11T21:37:20.195452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-11T21:37:19.817583Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.817583Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:23f76b61f4ec39f2872fd781eb00e96bda62ae9512537ad6351efcbc420ef91e","observation_id":"b02208bb-a1a4-4a93-881c-5014f7bda999","resolution":{"observed_at":"2026-08-11T21:37:19.817583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.181672Z","title":"Identity mappings in deep residual networks","venue":null,"work_id":"3eb16812-1627-4410-8ea8-76e73c2efe25","year":2016},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.821483Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:f4d9c4af6575dcad342228c85f4b316af6fd65e63d92d368f98159ed46dcd85e","observation_id":"763c2465-9a78-4bd2-8277-e3d5082d71d5","resolution":{"observed_at":"2026-08-11T21:37:20.185573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.824936Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.824936Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:4ec23f99cc58c313d20577c0bac8e7b035cd7a983b0e72f17715586dc44e5c69","observation_id":"331e2470-14f8-4581-b207-c7a4c61cf81a","resolution":{"observed_at":"2026-08-11T21:37:19.824936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.828689Z","title":"The curious case of neural text degeneration","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.828689Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:64227d3ac45b901d7b28fab8c7220c237165a91c27257f09119948bc79e90c3a","observation_id":"1e12c8e2-0ac0-4369-a592-674bea271d6d","resolution":{"observed_at":"2026-08-11T21:37:19.828689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05858","last_updated":"2019-09-20T20:08:56Z","snapshot_observed_at":"2026-08-19T21:50:02.108697Z","submitted_at":"2019-09-11T17:57:18Z","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05858","snapshot_observed_at":"2026-08-11T21:37:19.831935Z","title":"Varshney, Caiming Xiong, and Richard Socher","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.831935Z"},"links":{"cited_paper":"/paper/1909.05858","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:7d939210c14c396f71d60970cc00418ef45efabb9f0bb10bc11136f44cf89314","observation_id":"c39d0dba-9300-4333-b5a1-1086d716b4cd","resolution":{"observed_at":"2026-08-11T21:37:19.831935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.159931Z","title":"Latesteval: Addressing data contamination in language model evaluation through dynamic and time-sensitive test construction","venue":null,"work_id":"6de7113d-ba81-471d-8dbf-49036d492f84","year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.836285Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:ba6ca68007a70a444053da368cbd314fd1cc71ac60245919579a5dc6a28205dd","observation_id":"3779295d-5e45-45ca-914b-b9572599ee1b","resolution":{"observed_at":"2026-08-11T21:37:20.163560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01117","last_updated":"2023-03-23T13:42:27Z","snapshot_observed_at":"2026-08-19T22:36:28.346094Z","submitted_at":"2022-10-03T17:58:04Z","title":"Omnigrok: Grokking Beyond Algorithmic Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01117","snapshot_observed_at":"2026-08-11T21:37:19.839769Z","title":"Michaud, and Max Tegmark","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.839769Z"},"links":{"cited_paper":"/paper/2210.01117","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:daadd90052d3651c8e73921dcadeb918b61660f3d66f53d41c7ea0f47b98cc27","observation_id":"13da8c61-1f2b-4ba5-afb2-41106915d9b6","resolution":{"observed_at":"2026-08-11T21:37:19.839769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-11T21:37:19.843483Z","title":"Starcoder 2 and the stack v2: The next generation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.843483Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:b5b502fbebd055efddff041af18d90c49c8db4589f6fefae13e8ec4e071f7500","observation_id":"165c6517-a448-46ce-a5c1-f93b929565d8","resolution":{"observed_at":"2026-08-11T21:37:19.843483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.847056Z","title":"Language model evaluation beyond perplexity","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.847056Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:fc7639fa679fbbed83675431eecfd46f2193bd8712f61e1465d627ef6a0b7556","observation_id":"e5f97074-d2d2-4afd-a8e8-589c23d002a7","resolution":{"observed_at":"2026-08-11T21:37:19.847056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.850933Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.850933Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:02e99e574ee731e779d38ffbbe1da14d13d68a1c074ff73b67815de0e76d9d9a","observation_id":"2a4f120f-ce2c-4a57-8c11-f1018483f16e","resolution":{"observed_at":"2026-08-11T21:37:19.850933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.144660Z","title":"Deep double descent: Where bigger models and more data hurt","venue":null,"work_id":"0758f6f5-755d-42ce-a2a0-22a661cbc263","year":2020},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.854321Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:35bfbcd1b78595d30dfa120139ee54277db70a44de93464b8ef1fbdb52013757","observation_id":"581ed746-e73f-4a17-a68d-ceb280e05281","resolution":{"observed_at":"2026-08-11T21:37:20.148108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-11T21:37:19.857704Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.857704Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:ed9e15bde37024440c3c618ed6afabb453a64ea37bd9d3d7fe6914cec051afee","observation_id":"b06f706f-3775-445a-9ec9-346889cd88cb","resolution":{"observed_at":"2026-08-11T21:37:19.857704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02177","last_updated":"2022-01-06T18:43:37Z","snapshot_observed_at":"2026-08-18T12:23:06.967499Z","submitted_at":"2022-01-06T18:43:37Z","title":"Grokking: Generalization Beyond Overfitting on Small Algorithmic Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02177","snapshot_observed_at":"2026-08-11T21:37:19.861469Z","title":"Grokking: Generalization beyond overfitting on small algorithmic datasets, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.861469Z"},"links":{"cited_paper":"/paper/2201.02177","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:daebb2e65fd863ba38375d9144e52f0223e529c75e62407db253cdba093b4177","observation_id":"159bdb1a-6223-4bdc-9ef9-88e985f7d85b","resolution":{"observed_at":"2026-08-11T21:37:19.861469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.134055Z","title":"Brown, Adam Santoro, Aditya Gupta, Adri \\`a Garriga-Alonso, Agnieszka Kluska, Aitor Lewkowycz, Akshat Agarwal, Alethea Power, Alex Ray, Alex Warstadt, Alexander W","venue":null,"work_id":"b676bec9-8ac6-46e4-9b8f-5a2e54b43a1e","year":2023},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.865147Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:097eca26a49cc3e96c1313f306b2dd80c3b56e15e842eb0269c302ed71efad60","observation_id":"52107a28-c223-40f7-947a-640d40419132","resolution":{"observed_at":"2026-08-11T21:37:20.137910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.123200Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":"8755a042-ec96-45bc-b0bc-5da0ab196cc7","year":2018},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.868796Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:b96d57c1ca2fa6cf2ba7b89edd505198dcb3cdeaf70cd1dd2a25356dd9420854","observation_id":"88bdb013-3c09-41b7-8963-71d4a1f885e6","resolution":{"observed_at":"2026-08-11T21:37:20.127269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:20.110287Z","title":"Chi, Tatsunori Hashimoto, Oriol Vinyals, Percy Liang, Jeff Dean, and William Fedus","venue":null,"work_id":"27afb488-a541-440e-b019-eb692a9fab2a","year":2022},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.872194Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:424762a644aab3083fb6d9c607350842ecc22172ea8949f4523da310cd54efdb","observation_id":"ea8d3438-0cad-470c-8064-5294dfd38bcf","resolution":{"observed_at":"2026-08-11T21:37:20.116077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.875573Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.875573Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:1ede6b26d3cc2195dae592151dbdc7a0efc7603c27f99a389b2b08d3f6d8eca2","observation_id":"b79f896f-137e-4942-9f1a-81cb85d21203","resolution":{"observed_at":"2026-08-11T21:37:19.875573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04319","last_updated":"2019-09-26T23:57:44Z","snapshot_observed_at":"2026-08-16T12:52:32.574265Z","submitted_at":"2019-08-12T18:09:04Z","title":"Neural Text Generation with Unlikelihood Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04319","snapshot_observed_at":"2026-08-11T21:37:19.879218Z","title":"Neural text generation with unlikelihood training","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.879218Z"},"links":{"cited_paper":"/paper/1908.04319","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:7bd09c429aa89fd4d1cfa26657173d383bfb2c2c30b1c09b74b499b69d31d4a5","observation_id":"8e7908ff-3a34-4f41-b1b7-9c24926ba89e","resolution":{"observed_at":"2026-08-11T21:37:19.879218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02369","last_updated":"2022-10-09T07:53:01Z","snapshot_observed_at":"2026-08-16T16:55:08.956754Z","submitted_at":"2022-06-06T05:51:12Z","title":"Learning to Break the Loop: Analyzing and Mitigating Repetitions for Neural Text Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02369","snapshot_observed_at":"2026-08-11T21:37:19.882686Z","title":"Learning to break the loop: Analyzing and mitigating repetitions for neural text generation, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.882686Z"},"links":{"cited_paper":"/paper/2206.02369","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:ebe7c9e2784575d368779ec0ab70976796823d6d3e914b006a49e22d9f982e6d","observation_id":"7e1136d3-d4a9-40e8-9119-a9264cafa1f9","resolution":{"observed_at":"2026-08-11T21:37:19.882686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.03530","last_updated":"2017-02-26T19:36:40Z","snapshot_observed_at":"2026-08-01T16:56:59.989486Z","submitted_at":"2016-11-10T22:02:36Z","title":"Understanding deep learning requires rethinking generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.03530","snapshot_observed_at":"2026-08-11T21:37:19.886146Z","title":"Understanding deep learning requires rethinking generalization, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.886146Z"},"links":{"cited_paper":"/paper/1611.03530","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:5c358582c924727a23c0f64c8c0cd7df59d04d49344ce3a8043357d01af3e416","observation_id":"5a61a7e4-d6c5-4bd9-8f4a-286a222033ee","resolution":{"observed_at":"2026-08-11T21:37:19.886146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.889695Z","title":"Understanding deep learning (still) requires rethinking generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.889695Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:1a2e59885ae31ea97473c5dee25d50898b5f8af143eea2a302babe06ed441e6d","observation_id":"20609bb7-dbda-4a19-87f4-a2919a37b6fd","resolution":{"observed_at":"2026-08-11T21:37:19.889695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-11T21:37:19.893000Z","title":"Tinyllama: An open-source small language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.893000Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:1058481996237843c7b01faaa35654f86ea6c249f5080702cd0b93c6d23fc483","observation_id":"32fa13d5-8cdb-49d3-ab4a-4e5fbe816170","resolution":{"observed_at":"2026-08-11T21:37:19.893000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.896223Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.896223Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:7339c44496d7ab1bd1e3dfbe0e6aebd105cdb9f7e36aeb906575e479d79db635","observation_id":"92c3787d-84e2-4c44-9039-1ea76ecccf1a","resolution":{"observed_at":"2026-08-11T21:37:19.896223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.899961Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.899961Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:42f8d07fdf0939621d98d120d772fce772799578376f7321989bce27a5b22894","observation_id":"a1fdeb43-a153-4de4-a652-d3d64838c04c","resolution":{"observed_at":"2026-08-11T21:37:19.899961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.903547Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.903547Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:3db87f661ad7e13ac151a1f7301407e8de76de16255a138bb8b82ae72e439ef9","observation_id":"815f22c9-5551-4d02-bcb3-103983864d8b","resolution":{"observed_at":"2026-08-11T21:37:19.903547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:37:19.907107Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T21:37:19.907107Z"},"links":{"citing_paper":"/paper/2412.04318"},"observation_digest":"sha256:7b6e63c5ea8ab6a177e8ed2572cd63356b4791754d954bb47de0d5ef30e166b8","observation_id":"9e638303-ae13-44d8-ab6f-04b253d1c008","resolution":{"observed_at":"2026-08-11T21:37:19.907107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.04318","last_updated":"2025-02-26T17:51:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T21:17:15.835976Z","submitted_at":"2024-12-05T16:34:20Z","title":"The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 5 inbound Pith citation observations for arXiv:2412.04318."}