{"as_of":"2026-08-06T04:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a5a83f2182ba637bf9b8d833fd06f4de6980fd35dba176f4a0571a26b9cd68e","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":179,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":179,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":137,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:45:09.443522Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":243,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T03:17:32.272353Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2201.08239"},"observation_digest":"sha256:81fbf9941f74872a7e30a52e086bc174056ca9276a3e797978c5f1a8af8a9395","observation_id":"0f62ff26-0709-4947-9bdb-9e852372dd02","resolution":{"observed_at":"2026-05-12T03:17:32.522021Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-10T12:54:44.636760Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2201.11903"},"observation_digest":"sha256:8a9c12085a9fc17637e2f048650238ab97f8ccc33f5f49637d6e92692fc77349","observation_id":"e49910b9-ca8e-4647-ab7e-c8adad325978","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T22:24:05.999350Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2204.01691"},"observation_digest":"sha256:9b70460952c6f8543e3a47bc75c535b87dda338089d131e7a9de47ed0586a559","observation_id":"101fe2f4-cb87-4582-a13d-310b8af33ce5","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-05-10T23:45:06.755839Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2204.02311"},"observation_digest":"sha256:fcfdb825ecc8b8003a8c9a842bef85bddeee19d144ff3de07260da10aecfefcb","observation_id":"5015b3dc-6ee5-4139-88f9-28746998afc6","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T13:35:55.949167Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2204.05862"},"observation_digest":"sha256:3c2bb89da82880ca3428c8a39b5b3ec133d021584b33ed500e7231def941bff1","observation_id":"9752b2be-4c40-434b-b816-bc1dbc099d58","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2204.06745","last_updated":"2022-04-14T04:00:27Z","snapshot_observed_at":"2026-07-06T13:00:12.148951Z","submitted_at":"2022-04-14T04:00:27Z","title":"GPT-NeoX-20B: An Open-Source Autoregressive Language Model","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-24T12:33:37.701655Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2204.06745"},"observation_digest":"sha256:d74a08403b4c766f3281cfb25b476bb3700bbd0a9ec909c2e478a70ca462ffd5","observation_id":"bcca16a4-3a4a-4df1-819c-c1a6265f6ac3","resolution":{"observed_at":"2026-05-24T12:34:28.224978Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-07-06T13:05:12.350238Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-12T04:22:30.008355Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2204.14198"},"observation_digest":"sha256:7d52e2a8fca79f06e6f46c43ceebf023c2eba8b8f65434f20e26159a404205f3","observation_id":"70980115-d923-4419-a225-73de2a38f884","resolution":{"observed_at":"2026-05-12T04:22:30.559656Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"reference_index":279,"source":"arxiv_source","source_observed_at":"2026-05-10T20:53:16.720145Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2205.01068"},"observation_digest":"sha256:2fd50ccd0a01b20f754968ef70c534141437368d01d0f59eac7d0d7b61432c0f","observation_id":"34fe7f91-e5ce-41b4-9b71-ac82a2a06bc3","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T06:24:49.833638Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2205.06175"},"observation_digest":"sha256:b7eff3a12c72722e377d20893973db6280caaf21feedf921b4a09e30bdef42a5","observation_id":"c587081a-c79e-4b1a-81d4-98302d776f89","resolution":{"observed_at":"2026-05-13T06:24:49.950391Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2205.10487","last_updated":"2022-05-21T02:14:27Z","snapshot_observed_at":"2026-08-04T13:21:32.121470Z","submitted_at":"2022-05-21T02:14:27Z","title":"Scaling Laws and Interpretability of Learning from Repeated Data","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-17T15:52:40.335080Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2205.10487"},"observation_digest":"sha256:6937d2ade662b37c7a5db6ce6bec18c55b2b72d5c470afdb7fc7443906f37ae8","observation_id":"5cd57cd3-11e5-440a-af1d-0ce61d9d79e1","resolution":{"observed_at":"2026-05-17T15:52:40.525835Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2205.11487","last_updated":"2022-05-23T17:42:53Z","snapshot_observed_at":"2026-07-06T13:12:59.688989Z","submitted_at":"2022-05-23T17:42:53Z","title":"Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-12T07:38:53.056362Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2205.11487"},"observation_digest":"sha256:d20cfba137e02644b2e0560540aac397638a5324d146babc6447186df7dad9f0","observation_id":"e33abf07-7343-478e-a373-11430098d6e2","resolution":{"observed_at":"2026-05-12T07:38:53.572202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-07-06T13:13:18.623287Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T19:04:13.778347Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2205.11916"},"observation_digest":"sha256:c248bcd05090bee9f2b457334de416e9b1f8b2464ecd532ee79bc0fe12498f2d","observation_id":"cd3854f5-9827-4dd9-8c93-46d14ab178f4","resolution":{"observed_at":"2026-05-12T19:04:13.843517Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-11T07:38:37.734402Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2206.07682"},"observation_digest":"sha256:8220add7ea34335a822c50c7dab2bec3270beb5c04005e9248f9819ca6edc525","observation_id":"956d2b11-8306-4b1b-8936-abe777f35bfe","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-10T15:42:47.274448Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2207.05221"},"observation_digest":"sha256:1cd6f751a9845384264ccf49a9c3301ee8f71993dbb24df242f85a2c617f787f","observation_id":"48b5a05b-3c7f-40ba-81aa-7c4e091da0f7","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2207.14255","last_updated":"2022-07-28T17:40:47Z","snapshot_observed_at":"2026-08-03T04:07:30.689454Z","submitted_at":"2022-07-28T17:40:47Z","title":"Efficient Training of Language Models to Fill in the Middle","version":1},"reference_index":132,"source":"arxiv_source","source_observed_at":"2026-05-18T00:40:41.647820Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2207.14255"},"observation_digest":"sha256:9663dc97c189b933420223851bed38de1b0f92a6d07f4a9a8a9ed6e32bca58a2","observation_id":"51d1e423-417f-4d95-91b1-847db0b2990c","resolution":{"observed_at":"2026-05-18T00:40:41.944538Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2208.03299","last_updated":"2022-11-16T16:38:18Z","snapshot_observed_at":"2026-08-05T00:57:17.859949Z","submitted_at":"2022-08-05T17:39:22Z","title":"Atlas: Few-shot Learning with Retrieval Augmented Language Models","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-16T13:48:43.024120Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2208.03299"},"observation_digest":"sha256:e8b2be375bab63643a10a1ee5d96de3ed25b13dc7b648492ccf75633332dd605","observation_id":"ed606a17-b48a-4659-9760-c486e7cdf98f","resolution":{"observed_at":"2026-05-16T13:48:43.199020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2208.03299","last_updated":"2022-11-16T16:38:18Z","snapshot_observed_at":"2026-08-05T00:57:17.859949Z","submitted_at":"2022-08-05T17:39:22Z","title":"Atlas: Few-shot Learning with Retrieval Augmented Language Models","version":3},"reference_index":235,"source":"arxiv_source","source_observed_at":"2026-05-16T13:48:43.024120Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2208.03299"},"observation_digest":"sha256:927374f039333b31528e175583bc8587cd5909d96a4e213fed21f6921008291b","observation_id":"d8864cfd-5073-4d4e-a4ee-c57b88cdcbe1","resolution":{"observed_at":"2026-05-16T13:48:43.467626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-12T01:38:08.362920Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2209.07858"},"observation_digest":"sha256:986970ccc438e91c57e68cc85ccb6daadf3fd7abcfbe3b48c9ebaf7a488fa009","observation_id":"394e25f8-0909-4887-bae6-21e796985b58","resolution":{"observed_at":"2026-05-12T01:38:08.573835Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2210.02414","last_updated":"2023-10-25T05:22:43Z","snapshot_observed_at":"2026-08-02T04:26:53.194797Z","submitted_at":"2022-10-05T17:34:44Z","title":"GLM-130B: An Open Bilingual Pre-trained Model","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2210.02414"},"observation_digest":"sha256:8f01f4eefa32c1cb58804b6ea9d0a2c88879443f67fe1e5d550a6f7a411b4834","observation_id":"97ccad88-a603-417f-a664-3684e5fe5b96","resolution":{"observed_at":"2026-05-14T17:41:34.422823Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T07:15:23.725397Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2210.09261"},"observation_digest":"sha256:0e4ed8966c5c928e87ca7ff6d91620c96e7133d83ad0f4870ecd78e788e0d9f1","observation_id":"f1cacc23-6704-4283-9fb3-2605388a6c9e","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-12T00:51:10.919818Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2211.05100"},"observation_digest":"sha256:26ce4b92d330ab27865285d32a08c67a7d939ce4cebb12db62864df812cce96d","observation_id":"ec99bc8c-dd5a-49fa-bc6d-e5cda1747ced","resolution":{"observed_at":"2026-05-12T00:51:11.425189Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"reference_index":223,"source":"arxiv_source","source_observed_at":"2026-05-13T05:53:21.810346Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2211.09085"},"observation_digest":"sha256:4a1b95fe29fc9b9ef649ffbad2ffb651baa3110c5b90e2bd121a6bc5e8717192","observation_id":"916bf4fe-ce08-4ced-bf0d-0930422e96d4","resolution":{"observed_at":"2026-05-13T05:53:22.231765Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2211.12588"},"observation_digest":"sha256:8655939d0266691e69d18ed635351a03f50eca0377f6b4e42351aa37bc09b50c","observation_id":"1da53f31-bd2b-428b-a791-0633d358abe9","resolution":{"observed_at":"2026-05-12T16:48:27.955904Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2211.15089","last_updated":"2022-12-15T14:27:19Z","snapshot_observed_at":"2026-07-06T14:23:43.235725Z","submitted_at":"2022-11-28T06:08:54Z","title":"Continuous diffusion for categorical data","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-18T03:30:22.025578Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2211.15089"},"observation_digest":"sha256:186b383907f86f9e3fef377b847562ffb671836334d9962f872c800c70efac55","observation_id":"42efe9ca-88ef-470b-ade8-89dd309221e6","resolution":{"observed_at":"2026-05-18T03:30:22.278250Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2301.12652","last_updated":"2023-05-24T05:08:07Z","snapshot_observed_at":"2026-08-02T02:08:12.414817Z","submitted_at":"2023-01-30T04:18:09Z","title":"REPLUG: Retrieval-Augmented Black-Box Language Models","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-17T12:41:53.833754Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2301.12652"},"observation_digest":"sha256:e313b677721d05bd029f32a18a59ea627c85ea442d05778ac3d9684c577a3ebe","observation_id":"ad06cca3-a3db-420c-a136-6ae734ca70b8","resolution":{"observed_at":"2026-05-17T12:41:54.114502Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2301.13688","last_updated":"2023-02-14T16:33:33Z","snapshot_observed_at":"2026-08-05T20:18:14.325590Z","submitted_at":"2023-01-31T15:03:44Z","title":"The Flan Collection: Designing Data and Methods for Effective Instruction Tuning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-24T09:13:30.054153Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2301.13688"},"observation_digest":"sha256:d06b4e0d40ed41f393cd845b666609ed81ec6d47ed1619c68c05b0ca933693a9","observation_id":"a3b286bc-cc6f-4794-9bbf-53d334864877","resolution":{"observed_at":"2026-05-24T09:14:16.339591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-07-06T14:47:34.480641Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-12T18:12:27.396607Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2302.00923"},"observation_digest":"sha256:c20f570beca83190c3a0048538b821842bf52c40cc66b41c041abc15ce62cd62","observation_id":"ee7709c8-bc65-4e82-a76c-a6167080d958","resolution":{"observed_at":"2026-05-12T18:12:27.539613Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T07:29:36.205026Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2302.01318"},"observation_digest":"sha256:77c6c755b30f95814a12db46dfef2a74309c33b1de2a657ed77b7e08a6a2766a","observation_id":"dec89007-839d-43ca-8cab-11174b76b9d4","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2303.09540","last_updated":"2023-03-22T17:22:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-16T17:53:24Z","title":"SemDeDup: Data-efficient learning at web-scale through semantic deduplication","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T02:43:30.851915Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2303.09540"},"observation_digest":"sha256:e9d646cf4ee4b3044031c845d8e6ecc86b9a625a17fe88f7070d33d34547be54","observation_id":"9cbee578-f996-4883-a3b1-854a6b011109","resolution":{"observed_at":"2026-05-18T02:43:30.993489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-13T23:19:46.231145Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2303.17564"},"observation_digest":"sha256:49e25f38097eab8e4b5d68c7dcd2ec2fd308fe8cc05cda9151bd0ac0c86a3a9f","observation_id":"663920cf-30b7-4ec1-a48c-df9bc7f1ee92","resolution":{"observed_at":"2026-05-13T23:19:46.741343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T03:17:45.056001Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-10T22:46:39.268353Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2303.18223"},"observation_digest":"sha256:5292e7dbe7f925113a5e72605680c1f8f2f15415a7ebbd5ebc688911de1ca066","observation_id":"e6b81310-d334-4dbc-a388-01ee16e31ab1","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"reference_index":231,"source":"arxiv_source","source_observed_at":"2026-05-15T17:45:17.540282Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2304.01373"},"observation_digest":"sha256:575b846de6bb4b4f99414317a88e136cbaa3bc6eadb035090de9346ee62d81ed","observation_id":"423132f0-0c68-4bba-bae3-623fa1206b92","resolution":{"observed_at":"2026-05-15T17:45:17.993056Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-10T23:32:59.517389Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2305.06161"},"observation_digest":"sha256:c8bfb6cd4c6aa60e6ab29aced7135af700d7c16ae6b987973107bce45e0703ce","observation_id":"860fbc9f-43ba-4f5f-b578-cd82fdce0c4c","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2305.09617","last_updated":"2023-05-16T17:11:29Z","snapshot_observed_at":"2026-08-03T08:52:05.725675Z","submitted_at":"2023-05-16T17:11:29Z","title":"Towards Expert-Level Medical Question Answering with Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-24T04:32:33.271634Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2305.09617"},"observation_digest":"sha256:b3854cd935e0347225438573b9ae43a3638b9dc8e53204bbe7111651edd9f2c3","observation_id":"167409ac-c967-4c86-b175-6de2c575ce62","resolution":{"observed_at":"2026-05-24T04:32:33.390217Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-05-12T11:59:25.813128Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2305.10403"},"observation_digest":"sha256:b20f8dc2a2ca4fb3c8c780514f442a903d6fbb324a22fd2061e531bcecd9b247","observation_id":"39cb9f5b-3c2f-47b8-b71b-5b87de15d11c","resolution":{"observed_at":"2026-05-12T11:59:27.392872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2305.16264","last_updated":"2025-06-28T00:00:06Z","snapshot_observed_at":"2026-07-06T15:33:27.761070Z","submitted_at":"2023-05-25T17:18:55Z","title":"Scaling Data-Constrained Language Models","version":5},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-18T01:35:21.150772Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2305.16264"},"observation_digest":"sha256:8e332dbd970d313bcd1031fad90bc776af67a8df7ab2169ce256d1801ec55f93","observation_id":"05ccc172-7eb8-4668-8368-20d8e66b4294","resolution":{"observed_at":"2026-05-18T01:35:21.337925Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2305.18565","last_updated":"2023-05-29T18:58:38Z","snapshot_observed_at":"2026-08-06T01:53:21.020324Z","submitted_at":"2023-05-29T18:58:38Z","title":"PaLI-X: On Scaling up a Multilingual Vision and Language Model","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-17T14:36:09.971825Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2305.18565"},"observation_digest":"sha256:0884fb6c8db5b1567370be5aed239b284d6cb264c33880e7e3e56f2a3d7d1d7a","observation_id":"a5c57bbb-6c89-443f-a485-70455dc51c00","resolution":{"observed_at":"2026-05-17T14:36:10.037587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T20:43:45.770157Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2306.01116"},"observation_digest":"sha256:fe1c2f84444877382fea95e7dc9753af8235c17b67becd1d8de9f09f70b9e8dd","observation_id":"961f7461-a42c-4dde-82f3-41a51e71fa8a","resolution":{"observed_at":"2026-05-13T20:43:45.797762Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2306.12925","last_updated":"2023-06-22T14:37:54Z","snapshot_observed_at":"2026-08-02T02:42:46.945082Z","submitted_at":"2023-06-22T14:37:54Z","title":"AudioPaLM: A Large Language Model That Can Speak and Listen","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-16T07:07:57.800866Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2306.12925"},"observation_digest":"sha256:025d982c2854691f743fba92f8b7a701d02299acb57ff28e0021bbd312a95ad7","observation_id":"dbf0ed76-bf9a-4c19-9fc2-6df06ffb022e","resolution":{"observed_at":"2026-05-16T07:07:57.895770Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2306.16388","last_updated":"2024-04-12T00:05:53Z","snapshot_observed_at":"2026-07-30T00:01:16.818092Z","submitted_at":"2023-06-28T17:31:53Z","title":"Towards Measuring the Representation of Subjective Global Opinions in Language Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-16T07:41:02.576546Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2306.16388"},"observation_digest":"sha256:fe3505845274bd238c004c237a3cbf25cdf68891b8ab0edbec42e2621ea65aed","observation_id":"8f160a39-b836-4645-9706-22fd4f1e79a6","resolution":{"observed_at":"2026-05-16T07:41:02.755932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":116,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:932e8c57a605b30bebd5e9ee261818a0f58b2ba19269a788c915223f95594a6e","observation_id":"422bd81b-ed2b-42ff-887e-c24df680d2ff","resolution":{"observed_at":"2026-05-19T20:28:39.393059Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2308.08998","last_updated":"2023-08-21T10:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T14:12:48Z","title":"Reinforced Self-Training (ReST) for Language Modeling","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T07:59:55.849296Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2308.08998"},"observation_digest":"sha256:72690353c1277f11be743a0185af3771f2a8feba7517cbc566c240147ed8ccbe","observation_id":"06ed6327-f359-41db-986e-c2fa0b26c444","resolution":{"observed_at":"2026-05-13T07:59:55.930979Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2309.07597","last_updated":"2024-09-24T03:01:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T10:57:50Z","title":"C-Pack: Packed Resources For General Chinese Embeddings","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T13:24:32.084878Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2309.07597"},"observation_digest":"sha256:4075b6db9dbd349d853c1185f55cb377a60fbb41fd5e8b23a89d619865d9f949","observation_id":"5d9f3a41-d813-400b-81d3-065b0fe66457","resolution":{"observed_at":"2026-05-13T13:24:32.136046Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2309.10668","last_updated":"2024-03-18T23:15:47Z","snapshot_observed_at":"2026-07-06T16:20:36.866744Z","submitted_at":"2023-09-19T14:50:38Z","title":"Language Modeling Is Compression","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T22:36:13.392250Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2309.10668"},"observation_digest":"sha256:78bab1b9798ae552f48ddf05dbbf9cda8781447161996bac198216e6d4aa30cc","observation_id":"4501d86f-7045-46f9-9a92-003af24a01cd","resolution":{"observed_at":"2026-05-17T22:36:13.475787Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2309.14509","last_updated":"2023-10-04T16:51:13Z","snapshot_observed_at":"2026-08-04T19:27:31.715261Z","submitted_at":"2023-09-25T20:15:57Z","title":"DeepSpeed Ulysses: System Optimizations for Enabling Training of Extreme Long Sequence Transformer Models","version":2},"reference_index":175,"source":"arxiv_source","source_observed_at":"2026-05-13T01:07:22.166595Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2309.14509"},"observation_digest":"sha256:bc34e9e451b741f10548b9626c84f00798f7645a4426228b30627aabf1fab180","observation_id":"f38ae3c0-4164-4df8-867b-59e2ad83f8d1","resolution":{"observed_at":"2026-05-13T01:07:22.316594Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2310.09478","last_updated":"2023-11-07T18:25:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-14T03:22:07Z","title":"MiniGPT-v2: large language model as a unified interface for vision-language multi-task learning","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-16T07:13:08.867745Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2310.09478"},"observation_digest":"sha256:0e4263901078a3a3527a0c258c5fa4cd06aa335d0c74b053eb92f258bae710cd","observation_id":"1437403f-2abe-41c9-b942-5d1123d18ae7","resolution":{"observed_at":"2026-05-16T07:13:08.934632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-16T09:46:09.701440Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2311.16867"},"observation_digest":"sha256:2ebc0d000ecca1924ff88dc130d4b7652d12aa87f8bfc7d5831a66f405546661","observation_id":"75478ee0-25f5-4d12-b8d5-cd50decc296a","resolution":{"observed_at":"2026-05-16T09:46:09.843810Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-24T05:00:28.453838Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2312.11805"},"observation_digest":"sha256:b664574f21432441db2b5e29ddc27bad842cc6cfa5969e06ecdb3617d5ae5dd0","observation_id":"3ecb0065-411b-42b1-a6f2-3aeba70390ae","resolution":{"observed_at":"2026-05-24T05:03:55.445153Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-05T16:01:54.847394Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-17T15:20:36.514172Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2401.13649"},"observation_digest":"sha256:91d7f77283d512d722ec8a83bd07e04ad67537ea1dbd76fe55ccd702f3a56729","observation_id":"7b90131c-8aaf-44d7-ad5f-b78605ff8a0e","resolution":{"observed_at":"2026-05-17T15:20:36.553932Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2401.18059","last_updated":"2024-01-31T18:30:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-31T18:30:21Z","title":"RAPTOR: Recursive Abstractive Processing for Tree-Organized Retrieval","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-15T13:07:16.151160Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2401.18059"},"observation_digest":"sha256:76cfa3902d13bf3ea3c414f99aac43abca77b9a523d89898f52e268d4d5fdfe6","observation_id":"eede818d-41b0-414c-b378-2b3a1bb3baf3","resolution":{"observed_at":"2026-05-15T13:07:16.345534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2402.01411","last_updated":"2026-05-19T14:24:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-02T13:42:50Z","title":"CodePori: Large-Scale System for Autonomous Software Development Using Multi-Agent Technology","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T03:58:32.556725Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2402.01411"},"observation_digest":"sha256:25afd329af34d535673d9789bade414e45ea27ed3d2786673426f8f1cb4f8b60","observation_id":"af99dc1e-818d-4fbf-a359-06461d8ffd0d","resolution":{"observed_at":"2026-05-24T03:58:51.328045Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-11T15:22:54.023279Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2402.06196"},"observation_digest":"sha256:6a8174d397c7264dbb04303fd8a39cd4a5a0a7fcfb89ce2b4c14bfd37a6e390c","observation_id":"3a846f8d-f0a0-4cd4-af73-276e8754f23f","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2402.19427","last_updated":"2024-02-29T18:24:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T18:24:46Z","title":"Griffin: Mixing Gated Linear Recurrences with Local Attention for Efficient Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T06:58:17.370396Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2402.19427"},"observation_digest":"sha256:75026702ac79b92aab5f456c12d97c579fe2a0e155e1d237d995461178a81b11","observation_id":"992899c5-c7d4-46d2-8001-8d4a8435d8cd","resolution":{"observed_at":"2026-05-15T06:58:17.573112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2403.03507","last_updated":"2024-06-02T21:24:12Z","snapshot_observed_at":"2026-07-06T17:40:15.746482Z","submitted_at":"2024-03-06T07:29:57Z","title":"GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-16T23:51:50.163520Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2403.03507"},"observation_digest":"sha256:3e2f7bcab371e15cb207d1fa5ffd9b84b9fcdb1933ee76c57b1862e80a51a5f0","observation_id":"8a8491de-15d7-4610-ba1f-65a423cf0db5","resolution":{"observed_at":"2026-05-16T23:51:50.279079Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2403.03952","last_updated":"2026-04-20T06:05:54Z","snapshot_observed_at":"2026-08-03T00:56:47.399756Z","submitted_at":"2024-03-06T18:56:36Z","title":"Bridging Language and Items for Retrieval and Recommendation: Benchmarking LLMs as Semantic Encoders","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-24T03:03:51.053556Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2403.03952"},"observation_digest":"sha256:17da2c4e31024848b9774cdb328c2971a2032df16bcab65305c5bcc7a382b9a9","observation_id":"a478f23a-cc17-4523-8c10-b3fe5a9490ac","resolution":{"observed_at":"2026-05-24T03:05:56.999962Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-13T05:47:27.775529Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2403.04652"},"observation_digest":"sha256:4c44acdfb6c3d8925c06ebe818d295260d541ef0ec82134a2b04c8e2e6e2878c","observation_id":"ecfc47b0-0a3a-460f-943c-7e44864bdde7","resolution":{"observed_at":"2026-05-13T05:47:27.889143Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2403.09611","last_updated":"2024-04-18T18:51:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-14T17:51:32Z","title":"MM1: Methods, Analysis & Insights from Multimodal LLM Pre-training","version":4},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-16T04:09:36.019146Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2403.09611"},"observation_digest":"sha256:a256c7870840635a61601463df7b14c8dc962a42fc50cc2a517b6d370e40b6b9","observation_id":"1bedb279-c508-4f94-b660-122cce42945d","resolution":{"observed_at":"2026-05-16T04:09:36.174953Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2403.17297","last_updated":"2024-03-26T00:53:24Z","snapshot_observed_at":"2026-08-02T11:10:24.263044Z","submitted_at":"2024-03-26T00:53:24Z","title":"InternLM2 Technical Report","version":1},"reference_index":172,"source":"arxiv_source","source_observed_at":"2026-05-15T11:44:38.066501Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2403.17297"},"observation_digest":"sha256:2562febef462a77afa6b64088d9294fac93052ce32b61bc2e05f88b9ebcad895","observation_id":"928d9a2d-840e-42a0-836b-4d79e7fb0f83","resolution":{"observed_at":"2026-05-15T11:44:38.314437Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T18:00:53.389420Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2404.06395"},"observation_digest":"sha256:c465b4f62b199b20d1e498f60a8caa9085fd77c5839ea8230106ba8532264641","observation_id":"9dd566cb-5728-49fb-8620-5bd138f345f5","resolution":{"observed_at":"2026-05-13T18:00:53.554454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"reference_index":146,"source":"pdf_text","source_observed_at":"2026-05-17T22:58:16.523267Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2406.11794"},"observation_digest":"sha256:9f4dd14c0436679e7248110e9c1aa868a23ecaca6158e63b29d0b46ae0d47792","observation_id":"05e0ec65-6ce1-4a7b-a9de-9a71fac54a6a","resolution":{"observed_at":"2026-05-17T22:58:17.184303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2407.20595","last_updated":"2026-05-25T17:50:46Z","snapshot_observed_at":"2026-08-02T13:59:55.664832Z","submitted_at":"2024-07-30T07:14:04Z","title":"HALvest-Contrastive: Retrieval-Like Authorship Attribution with Patch-Level Late Interaction","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-23T23:10:50.208896Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2407.20595"},"observation_digest":"sha256:8ebe0791cc6e65e764842da0327f6b1657bd429bbb93aeeba9c6e65483fab381","observation_id":"44a5246a-81ba-48f1-82a0-e061389f897a","resolution":{"observed_at":"2026-05-23T23:13:36.448560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"reference_index":213,"source":"arxiv_source","source_observed_at":"2026-05-18T06:38:36.517935Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2408.00724"},"observation_digest":"sha256:ba66f11bc3304f4c91b221af265ea0d3488fac38baf2de294e982de96768f540","observation_id":"2b14db69-25ff-49e1-bf8e-55ea95b68cfb","resolution":{"observed_at":"2026-05-18T06:38:36.977990Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2410.22240","last_updated":"2026-04-22T10:20:17Z","snapshot_observed_at":"2026-08-02T13:37:32.179424Z","submitted_at":"2024-10-29T17:05:25Z","title":"Are Decoder-Only Large Language Models the Silver Bullet for Code Search?","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-23T18:39:21.915976Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2410.22240"},"observation_digest":"sha256:39799275a22899912a76ea397ca1a6d6aa737311494904f25b5be340251e8b06","observation_id":"09df567c-ef39-4983-8a8c-3a77c6a32b3b","resolution":{"observed_at":"2026-05-23T18:43:19.232273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2411.05527","last_updated":"2026-05-04T11:38:18Z","snapshot_observed_at":"2026-07-06T19:47:25.840369Z","submitted_at":"2024-11-08T12:35:58Z","title":"How Good is Your Wikipedia? Auditing Data Quality for Low-resource and Multilingual NLP","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-23T17:36:18.451771Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2411.05527"},"observation_digest":"sha256:41778070184c369bdade29f05410c86ae1dc4bcf20bdaeca93fe0c0d84057bb7","observation_id":"5ff7d26a-7bdb-4fde-a053-56c0815365b8","resolution":{"observed_at":"2026-05-23T17:38:15.877552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"reference_index":176,"source":"arxiv_source","source_observed_at":"2026-05-20T17:46:46.845424Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2412.13663"},"observation_digest":"sha256:6c2ef5cb762f94f80fc740ab56a139f09fabefdadc90bbf00160963e32cf711f","observation_id":"21dc15a1-07d4-4373-9c30-3dcbf5dd0104","resolution":{"observed_at":"2026-05-20T17:46:47.018783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"reference_index":114,"source":"arxiv_source","source_observed_at":"2026-05-13T15:51:29.022336Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2412.21187"},"observation_digest":"sha256:53adb60a6239a4c8bd667371e32c53e45bfdd9e9a479e10a490498b1553be596","observation_id":"19bead19-f08d-4ee0-b983-ae7d91540515","resolution":{"observed_at":"2026-05-13T15:51:29.502469Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2501.08313","last_updated":"2025-01-14T18:50:05Z","snapshot_observed_at":"2026-07-06T20:21:04.675084Z","submitted_at":"2025-01-14T18:50:05Z","title":"MiniMax-01: Scaling Foundation Models with Lightning Attention","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-16T06:26:38.569394Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2501.08313"},"observation_digest":"sha256:7b3f7cf420d92c6e7f467ab27bbb03d4b542fe64721ff839310a7d6b1bc9015b","observation_id":"571e33ad-8893-4d12-925e-72cac4399069","resolution":{"observed_at":"2026-05-16T06:26:38.659096Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-11T13:02:43.571234Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2502.18864"},"observation_digest":"sha256:f43dbfd514b7fe114bfa595b4a7de5fcf52f48380482162b7ef30d33ca41dc99","observation_id":"f2e04b86-6065-4eff-b630-264c1a2d7530","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2505.10465","last_updated":"2025-11-29T21:39:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-15T16:18:13Z","title":"Superposition Yields Robust Neural Scaling","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T14:38:44.789822Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2505.10465"},"observation_digest":"sha256:cd52bdf4cb018ee62a55dbf397873a31ab90e6db27d271063212290ed3effb80","observation_id":"2ed8b290-e095-46ea-b51f-5d649a3dc4f7","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2505.17469","last_updated":"2026-05-13T10:49:50Z","snapshot_observed_at":"2026-08-05T08:27:52.586614Z","submitted_at":"2025-05-23T04:50:33Z","title":"Efficient compression of neural networks and datasets","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-19T14:15:10.275764Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2505.17469"},"observation_digest":"sha256:ebc416f27f2ed9b9dc6f5457a6a6208f0d389bccd0a484b9cd702887bdd29dc5","observation_id":"4202b6f3-e9ec-4908-b40b-c4004d683fff","resolution":{"observed_at":"2026-05-19T14:17:23.937654Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2506.13674","last_updated":"2026-04-19T03:53:58Z","snapshot_observed_at":"2026-08-02T17:06:46.370930Z","submitted_at":"2025-06-16T16:30:26Z","title":"PrefixMemory-Tuning: Modernizing Prefix-Tuning by Decoupling the Prefix from Attention","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T09:24:04.289799Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2506.13674"},"observation_digest":"sha256:d6054a37f6849dd353ab9a7d07e653fe6bfea2923a888e6409051426563af118","observation_id":"fa1d7976-b64b-42bf-aa63-14c4415b8665","resolution":{"observed_at":"2026-05-19T09:27:14.721331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2507.09205","last_updated":"2026-05-13T12:42:40Z","snapshot_observed_at":"2026-08-05T20:37:48.970046Z","submitted_at":"2025-07-12T08:54:05Z","title":"From Curated Data to Scalable Models: Continual Pre-training of Dense and MoE Large Language Models for Tibetan","version":5},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-19T04:56:16.979713Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2507.09205"},"observation_digest":"sha256:043ee440fa98b7da30f57e7e370526140aaca29f4224c0f4acba4771459027e6","observation_id":"ac9a9b11-e007-42d5-8949-edda66d5305d","resolution":{"observed_at":"2026-05-19T04:57:04.345912Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T20:45:09.443522Z","title":"Scaling language models: Methods, analysis & insights from train- ing gopher","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09949","last_updated":"2025-08-13T17:08:22Z","snapshot_observed_at":"2026-08-05T20:45:03.193345Z","submitted_at":"2025-08-13T17:08:22Z","title":"Stable Diffusion Models are Secretly Good at Visual In-Context Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T20:45:09.443522Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2508.09949"},"observation_digest":"sha256:97a77c4f7422a5c5016243ee774429d44afd3aee205f08133244b55b71127010","observation_id":"971880ba-b9bd-4a29-8caf-3a2ec646574e","resolution":{"observed_at":"2026-08-05T20:45:09.443522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T19:28:55.540505Z","title":"Scaling language models: Methods, analysis & insights from training gopher,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.12464","last_updated":"2025-08-17T18:27:54Z","snapshot_observed_at":"2026-08-06T03:20:50.749602Z","submitted_at":"2025-08-17T18:27:54Z","title":"On the Fitness Landscape in the $NK$ Model","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T19:28:55.540505Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2508.12464"},"observation_digest":"sha256:7f59c3c849b8d5e55571d663cfb9ab50ffa3131f1639d7cacbb773ea9993d527","observation_id":"2717e9ef-1a1b-450c-b1ab-de9b9dce9847","resolution":{"observed_at":"2026-08-05T19:28:55.540505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T15:38:50.541956Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19689","last_updated":"2025-08-27T08:52:47Z","snapshot_observed_at":"2026-08-05T22:14:58.306507Z","submitted_at":"2025-08-27T08:52:47Z","title":"Building Task Bots with Self-learning for Enhanced Adaptability, Extensibility, and Factuality","version":1},"reference_index":130,"source":"arxiv_source","source_observed_at":"2026-08-05T15:38:50.541956Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2508.19689"},"observation_digest":"sha256:6c2d77308cea9c0b58ad399593aff8c14f47c1b58cf7afc5e6d094575efbe3e6","observation_id":"062994a8-b26a-4bbd-bb7e-50399d242cd8","resolution":{"observed_at":"2026-08-05T15:38:50.541956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T13:32:47.646629Z","title":"Scaling language models: Methods, analysis & insights from training gopher,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00570","last_updated":"2025-08-30T17:31:52Z","snapshot_observed_at":"2026-08-05T13:32:46.886165Z","submitted_at":"2025-08-30T17:31:52Z","title":"ConceptBot: Enhancing Robot's Autonomy through Task Decomposition with Large Language Models and Knowledge Graph","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:32:47.646629Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2509.00570"},"observation_digest":"sha256:6d8bff5b927a4ad2d6ceabc7bbf2fc908aafc511cc6a7d65b6eab9d3ff14724e","observation_id":"9c3b39ec-56a0-4dcc-bf5d-5b4b17ba06c3","resolution":{"observed_at":"2026-08-05T13:32:47.646629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T11:38:40.362174Z","title":"Rae, Sebastian Borgeaud, Trevor Cai, Katie Millican, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02480","last_updated":"2025-09-02T16:30:49Z","snapshot_observed_at":"2026-08-06T04:33:58.001954Z","submitted_at":"2025-09-02T16:30:49Z","title":"MLP-Offload: Multi-Level, Multi-Path Offloading for LLM Pre-training to Break the GPU Memory Wall","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T11:38:40.362174Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2509.02480"},"observation_digest":"sha256:24702dc7a19abd7a83e922036d2e52ff31eae3b0952b9306d54af505c3a30af5","observation_id":"291e8bae-d605-4883-ab29-b69977bf2796","resolution":{"observed_at":"2026-08-05T11:38:40.362174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-04T22:55:28.540683Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08852","last_updated":"2025-09-08T17:52:08Z","snapshot_observed_at":"2026-08-04T22:55:25.765934Z","submitted_at":"2025-09-08T17:52:08Z","title":"Safe and Certifiable AI Systems: Concepts, Challenges, and Lessons Learned","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T22:55:28.540683Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2509.08852"},"observation_digest":"sha256:3bd7467daa1ec2864aa4c8cbac9ee5b0e2720e9d826892865e0708b973cee9a9","observation_id":"85cb55a0-8be7-4428-adbe-d1bc0a47bbe7","resolution":{"observed_at":"2026-08-04T22:55:28.540683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-04T19:37:27.614417Z","title":"Scaling language models: Methods, analysis & insights from training gopher,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09175","last_updated":"2025-09-11T06:18:29Z","snapshot_observed_at":"2026-08-04T19:37:25.894588Z","submitted_at":"2025-09-11T06:18:29Z","title":"MoLEx: Mixture of LoRA Experts in Speech Self-Supervised Models for Audio Deepfake Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:27.614417Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2509.09175"},"observation_digest":"sha256:2242c15058b79c946f93ea62e775320e862d50ffd6eccd1d38349733c77c67e9","observation_id":"ffcc0233-1023-46f1-ab9f-0171f3987d29","resolution":{"observed_at":"2026-08-04T19:37:27.614417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2509.18993","last_updated":"2026-05-13T13:30:21Z","snapshot_observed_at":"2026-08-02T18:52:22.902766Z","submitted_at":"2025-09-23T13:43:02Z","title":"CR-Net: Scaling Parameter-Efficient Training with Cross-Layer Low-Rank Structure","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-18T14:51:30.312509Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2509.18993"},"observation_digest":"sha256:16e12fcaf8468ae4dfadf6f34c26d21c9f367ad8f5f3104dbf22a43b4dacc720","observation_id":"9c2cdf3c-4948-43cf-9601-fce8cb16d9b1","resolution":{"observed_at":"2026-05-18T14:52:41.167305Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2510.04212","last_updated":"2026-04-18T01:36:25Z","snapshot_observed_at":"2026-08-05T11:27:54.389799Z","submitted_at":"2025-10-05T14:01:24Z","title":"Why Low-Precision Transformer Training Fails: An Analysis on Flash Attention","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T10:01:56.131253Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2510.04212"},"observation_digest":"sha256:341aa00382415e359f9d560228f5ab7a289ec8465509152affaf9c1f527473fa","observation_id":"f223dff7-69e1-434c-8aa5-d4a7d67c0139","resolution":{"observed_at":"2026-05-18T10:02:31.746740Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-04T11:16:13.465682Z","title":"Scaling language models: Methods, analysis & insights from training gopher","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.06048","last_updated":"2026-06-18T04:28:50Z","snapshot_observed_at":"2026-08-04T11:16:05.008855Z","submitted_at":"2025-10-07T15:42:33Z","title":"BLISS: A Lightweight Bilevel Influence Scoring Method for Data Selection in Language Model Pretraining","version":5},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T11:16:13.465682Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2510.06048"},"observation_digest":"sha256:cc07598ac3d22bcff3a15799ddcf3f106c5c3eebdfe506d254718a7834abf9d8","observation_id":"ba896be6-d485-4032-8624-6ca2cc4ee3c4","resolution":{"observed_at":"2026-08-04T11:16:13.465682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2510.17934","last_updated":"2026-04-13T17:45:21Z","snapshot_observed_at":"2026-07-06T22:33:39.148066Z","submitted_at":"2025-10-20T15:40:14Z","title":"AtlasKV: Augmenting LLMs with Billion-Scale Knowledge Graphs in 20GB VRAM","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T06:00:59.224521Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2510.17934"},"observation_digest":"sha256:27ba11a6fe2725968be0a05a42aecd5ffd518fc1579d19406e05738476740c4b","observation_id":"31daa9c8-6207-4e9d-bd23-92c083a46965","resolution":{"observed_at":"2026-05-18T06:02:25.472844Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-03T17:00:25.904317Z","title":"InInternational Conference on Machine Learning, pages 19274–19286","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.11280","last_updated":"2026-05-26T07:30:13Z","snapshot_observed_at":"2026-08-03T17:00:24.375519Z","submitted_at":"2025-12-12T04:56:08Z","title":"AdaSD: Adaptive Speculative Decoding for Efficient Language Model Inference","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T17:00:25.904317Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2512.11280"},"observation_digest":"sha256:0a25e4c44d311b05bf009e55ee5c537bcfd5daa64946568cd8ef6c9c9a2eb368","observation_id":"2a807ff0-8c7e-48f3-88b2-cc712d04c451","resolution":{"observed_at":"2026-08-03T17:00:25.904317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-03T05:01:13.060926Z","title":"W., Borgeaud, S., Cai, T., Millican, K., Hoffmann, J., Song, F., Aslanides, J., Henderson, S., Ring, R., Young, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.03685","last_updated":"2026-05-31T19:36:07Z","snapshot_observed_at":"2026-08-03T05:01:07.831427Z","submitted_at":"2026-02-03T16:06:18Z","title":"Universal One-third Time Scaling in Learning Peaked Distributions","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T05:01:13.060926Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2602.03685"},"observation_digest":"sha256:36308a2208e51e78f005be8d054fd0c7c0508422133439722cfb8bbf3d3d54a2","observation_id":"5b4750d0-fba4-4253-8658-3ac9f32a5732","resolution":{"observed_at":"2026-08-03T05:01:13.060926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-02T19:32:20.183146Z","title":"Scaling language models: Methods, analysis & insights from training gopher,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.02156","last_updated":"2026-06-23T18:51:46Z","snapshot_observed_at":"2026-08-02T19:32:17.638690Z","submitted_at":"2026-03-02T18:19:49Z","title":"How Small Can 6G Reason? Scaling Tiny-to-Small Language Models for AI-Native Networks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T19:32:20.183146Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2603.02156"},"observation_digest":"sha256:93a248bd7c17ed2b19b1d1783d72fde1cf44ae764728af0522197b02ea6a95c7","observation_id":"83cf7c41-c198-4a0c-be80-51d412d2ab83","resolution":{"observed_at":"2026-08-02T19:32:20.183146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-07-14T22:10:41.129535Z","title":"Scaling language models: Methods, analysis & insights from training gopher,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.12676","last_updated":"2026-07-15T09:48:42Z","snapshot_observed_at":"2026-08-02T18:19:39.501104Z","submitted_at":"2026-03-13T05:46:01Z","title":"Disentangled Latent Dynamics Manifold Fusion for Solving Parameterized PDEs","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T22:10:41.129535Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2603.12676"},"observation_digest":"sha256:40364d528316c295ba21ec139b52a2e9edf48471bd577e5ff37eb5376bf69742","observation_id":"34319fbc-3b33-4311-8ebd-17af14fc127b","resolution":{"observed_at":"2026-07-14T22:10:41.129535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2603.12677","last_updated":"2026-05-07T12:53:41Z","snapshot_observed_at":"2026-07-06T22:48:57.474272Z","submitted_at":"2026-03-13T05:47:00Z","title":"MetaKE: Meta-Learning for Knowledge Editing Toward a Better Accuracy-Editability Trade-off","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T12:25:11.237468Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2603.12677"},"observation_digest":"sha256:58b39b5216ad1d844737a7dda05ef090f9d93a4142f64780f069be541b4d8af3","observation_id":"0f34871f-d7ff-4c4a-b507-a91f362ccca0","resolution":{"observed_at":"2026-05-15T12:25:35.514669Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.03044","last_updated":"2026-04-08T07:22:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-03T13:52:38Z","title":"JoyAI-LLM Flash: Advancing Mid-Scale LLMs with Token Efficiency","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T19:26:38.134505Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.03044"},"observation_digest":"sha256:1e93faf4de1d3fb78fdcdeeb81938f741320cd35339573f422fd0c584ced2d57","observation_id":"60263677-369e-4d7a-89be-6700e60e9741","resolution":{"observed_at":"2026-05-13T19:28:09.821936Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.04944","last_updated":"2026-06-03T03:25:10Z","snapshot_observed_at":"2026-08-03T07:24:33.892396Z","submitted_at":"2026-03-15T13:13:55Z","title":"Inclusion-of-Thoughts: Mitigating Preference Instability via Purifying the Decision Space","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-15T11:31:38.301306Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.04944"},"observation_digest":"sha256:90c513e140a1d64430b655fafa692f9cfe7952897e1ed048bd18b67120a373d1","observation_id":"47ca56d3-7c0e-47a9-b2c4-30a891aac77f","resolution":{"observed_at":"2026-05-15T11:35:31.759858Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.12342","last_updated":"2026-04-14T06:26:04Z","snapshot_observed_at":"2026-07-31T16:39:44.521684Z","submitted_at":"2026-04-14T06:26:04Z","title":"CoLA: A Choice Leakage Attack Framework to Expose Privacy Risks in Subset Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T15:55:42.360343Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.12342"},"observation_digest":"sha256:f2492874393befba87ce8eb57a7ba26c2ff8e7288002b4b44d4ef35ec9df95f3","observation_id":"03651b33-abf1-44cf-985a-a833ad29509b","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.16380","last_updated":"2026-03-25T13:30:40Z","snapshot_observed_at":"2026-07-06T23:03:43.854612Z","submitted_at":"2026-03-25T13:30:40Z","title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:04.958757Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.16380"},"observation_digest":"sha256:91fb4b53c911dea1b7eca16e105e4d9003c02259ea63a5d64cdf707b9bc19364","observation_id":"ab049519-9090-44ea-b29d-a928a97444ee","resolution":{"observed_at":"2026-05-15T00:58:25.676757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.22893","last_updated":"2026-04-24T10:28:28Z","snapshot_observed_at":"2026-07-06T23:09:10.050398Z","submitted_at":"2026-04-24T10:28:28Z","title":"Utility-Aware Data Pricing: Token-Level Quality and Empirical Training Gain for LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T12:31:02.367051Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.22893"},"observation_digest":"sha256:265afa1062a5aaecf06961b7deb65572c65b4e3328595fd85d221159b3edb4ce","observation_id":"ae0badb2-4504-491a-a676-84a64f055c13","resolution":{"observed_at":"2026-05-11T19:16:06.815984Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2604.25591","last_updated":"2026-04-28T12:56:22Z","snapshot_observed_at":"2026-08-05T12:06:36.882921Z","submitted_at":"2026-04-28T12:56:22Z","title":"Walking Through Uncertainty: An Empirical Study of Uncertainty Estimation for Audio-Aware Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-07T14:29:18.348031Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2604.25591"},"observation_digest":"sha256:085d8e2c864ff0d75c0f0f68d42fb59038e00934a1ad7ae0b3c7e18c9f731ccb","observation_id":"4b2d4a92-62be-4a2c-b808-ae570bdbc654","resolution":{"observed_at":"2026-05-12T00:41:26.407246Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.00087","last_updated":"2026-04-30T17:54:35Z","snapshot_observed_at":"2026-07-06T23:13:33.799847Z","submitted_at":"2026-04-30T17:54:35Z","title":"DeGenTWeb: A First Look at LLM-dominant Websites","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-09T20:54:49.090293Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.00087"},"observation_digest":"sha256:14aef3ccc12e89b9975b290bcbdac6c677279ec3f65e617fcb66ec73e4a1b2db","observation_id":"d48ce8c3-aaec-4b26-87e8-8c156b8e7eed","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.02300","last_updated":"2026-05-04T07:48:02Z","snapshot_observed_at":"2026-07-06T23:15:23.301944Z","submitted_at":"2026-05-04T07:48:02Z","title":"A Meta Reinforcement Learning Approach to Goals-Based Wealth Management","version":1},"reference_index":247,"source":"arxiv_source","source_observed_at":"2026-05-08T18:42:50.962120Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.02300"},"observation_digest":"sha256:13fb9d1cd6b7259598d0d8ca645c3e0fabc06541f8f3c78dfdc79a2d563036e4","observation_id":"eb0917d6-b3dd-4642-b6a4-9cb60a707131","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.02364","last_updated":"2026-05-04T09:07:54Z","snapshot_observed_at":"2026-07-06T23:15:27.816549Z","submitted_at":"2026-05-04T09:07:54Z","title":"InfoLaw: Information Scaling Laws for Large Language Models with Quality-Weighted Mixture Data and Repetition","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-08T18:45:52.380042Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.02364"},"observation_digest":"sha256:b275282fa2fbc772184393836479bab5dc44c75ad3600043f7bc6db25cce22d7","observation_id":"140bedea-67ec-4e37-8888-eb67179131da","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.04243","last_updated":"2026-05-05T19:30:06Z","snapshot_observed_at":"2026-07-06T23:17:04.200299Z","submitted_at":"2026-05-05T19:30:06Z","title":"Temporal Reasoning Is Not the Bottleneck: A Probabilistic Inconsistency Framework for Neuro-Symbolic QA","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-08T17:45:44.270122Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.04243"},"observation_digest":"sha256:22e3903bbfa8b4b2146d2dc9ec21e8a9a0b68f925f886899befc42afc4c04622","observation_id":"82102d1a-7f9a-4348-a3a3-d06ef1a83654","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.04759","last_updated":"2026-05-13T10:53:47Z","snapshot_observed_at":"2026-08-02T07:08:00.433082Z","submitted_at":"2026-05-06T11:06:30Z","title":"Gyan: An Explainable Neuro-Symbolic Language Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T16:18:54.815659Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.04759"},"observation_digest":"sha256:18c95f3ec445963dfbb65eb8f5c2f5c1756ea52fc986ebb9a727e59a89f479da","observation_id":"324d466e-91f5-4eae-9222-6288244989d3","resolution":{"observed_at":"2026-05-11T19:13:40.454049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":"2112.11446","doi":"10.48550/arxiv.2112.11446","metadata_source":"pith","pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","venue":"cs.CL","work_id":"47ce8be9-e500-407d-af41-ac2d132215eb","year":2021},"citing_paper":{"arxiv_id":"2605.04759","last_updated":"2026-05-13T10:53:47Z","snapshot_observed_at":"2026-08-02T07:08:00.433082Z","submitted_at":"2026-05-06T11:06:30Z","title":"Gyan: An Explainable Neuro-Symbolic Language Model","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T22:02:30.162507Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2605.04759"},"observation_digest":"sha256:52c6e8d1cc3091b006ce9031fbcabd723fe531ffccf6ebb1443474e74310d61e","observation_id":"056c47d1-baa2-400f-a705-ab96071b7c71","resolution":{"observed_at":"2026-05-14T22:03:02.323234Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2112.11446/citation-record","integrity":"/paper/2112.11446/integrity","json":"/paper/2112.11446/citation-record.json","paper":"/paper/2112.11446"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1812.01193","last_updated":"2018-12-06T16:11:19Z","snapshot_observed_at":"2026-08-05T06:08:51.923413Z","submitted_at":"2018-12-04T03:15:38Z","title":"e-SNLI: Natural Language Inference with Natural Language Explanations","version":2},"cited_work":{"arxiv_id":"1812.01193","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1812.01193","snapshot_observed_at":"2026-07-04T23:14:59.284977Z","title":"Explaining","venue":null,"work_id":"0ceeaa26-b5a4-4dee-9e71-38b724ab84af","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"cited_paper":"/paper/1812.01193","citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:83256dc48b59d6a9ba2936c66f7c7653b120755ce16138bbac405ebbc52ebfa5","observation_id":"da71d304-69b5-4ffc-87cb-67165ae8cba1","resolution":{"observed_at":"2026-07-04T23:14:59.284977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.findings-emnlp.301","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2020.findings-emnlp.301","venue":null,"work_id":"b0252c97-1b16-43d3-9417-9f8a72176a9f","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:cbeacb181a6a11f76b0c7a154e54d70a453a94c9aff91e48df0fa064c85c3564","observation_id":"1f386c1a-b9a0-4310-8661-ac3cb20e1807","resolution":{"observed_at":"2026-05-11T19:13:40.018220Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:22:00.907937+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:22:00.907937+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1095.337282","doi":"10.1145/3351095.3372826","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"& Smith-Loud, J","venue":null,"work_id":"f306132e-972e-4117-a0f7-ce2b4081c431","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:46fc52e10fc0c1dfa9b6a6e72a1a53a0e3926b18e53d1c41c6e3a7f9e097698c","observation_id":"19499c2e-208d-434e-808f-4d7892b0dee8","resolution":{"observed_at":"2026-05-11T19:13:40.026048Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.findings-emnlp.372","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Cohn, T., He, Y., Liu, Y","venue":null,"work_id":"d178d322-4363-48e5-bede-e7e4ebf4a434","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:6aacaf849061cc147d4d0dd9bf3df00d2b55590dfc45eee63cd0c7abfbff2c00","observation_id":"a7cb2cac-0724-4b6a-861f-370687134ee3","resolution":{"observed_at":"2026-05-11T19:13:40.029893Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T16:38:12.395433+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T16:38:12.395433+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3360307","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jouppi, Doe Hyun Yoon, George Kurian, Sheng Li, Nishant Patil, James Laudon, Cliff Young, and David A","venue":"Communications of the ACM","work_id":"139ebadb-ddc7-49a8-a723-31b8d3d2caed","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:f07bce2f1fdcbb02bbac567f7160ae8012fe5005dc4f7a3e07eccd13c529c903","observation_id":"6bf8e367-f765-4b41-8f34-13aa77fc885a","resolution":{"observed_at":"2026-05-11T19:13:40.040944Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:4698d181718040447eea8b8383c51485d9902f9b6e5aa63f249f9580ddd5eec9","observation_id":"bb73520d-785d-409a-a436-f8d9a960afa8","resolution":{"observed_at":"2026-05-11T19:13:40.048098Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.acl-main.549","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"stop word","venue":null,"work_id":"f9722ba5-8139-40f5-a4f6-46d5d7fa162e","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:c3f4186c1b446e06042f1072b4503bc4b572afa2724579e04fc3c3bce92aeb54","observation_id":"54d8af3f-281a-4f53-bd8c-220288afb003","resolution":{"observed_at":"2026-05-11T19:13:40.011434Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6bd5d1ca-4152-4f2e-a79b-fc49e3d58945","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:4b034e97eba8a17c7c19c13be92bee8573a489dbe1cebb045955afcae677c2c0","observation_id":"760204bc-9d14-475d-accd-93ad99f296df","resolution":{"observed_at":"2026-05-11T19:13:40.433922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Uniformly choosing a start index for the crop would skew the distribution in such a way that we would almost never see the ﬁrst token in a document","venue":null,"work_id":"276406b8-044a-4445-954c-e795cbc3a296","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:8bcef729bb7d6473de48bb3bcb2e31886dbecf82531a72512db01100b6ed85ad","observation_id":"34101b05-d5a9-42d8-828b-527259b605e8","resolution":{"observed_at":"2026-05-11T19:13:40.436807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"67083c45-694e-44c4-8613-da7a327a6046","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:c064074e31c3ab6faddcb7488d4b908c739cfe6068b666881e71f1892196574c","observation_id":"ed61bb23-89bd-4f5f-93a1-b6cff63a60f1","resolution":{"observed_at":"2026-05-11T19:13:40.443581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5a9c9945-6a34-4418-af69-b7b70ae2a3be","year":2048},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:c55cd4fc872b9333fda77161910cf62e12e892966902534fd04f94364ead9da4","observation_id":"55cba9ce-80a1-4f99-84fe-4868377ae12c","resolution":{"observed_at":"2026-05-11T19:13:40.446293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"This avoids wasting compute by training onPAD tokens","venue":null,"work_id":"90e82ed4-b115-4f8e-bba1-a76218496a7a","year":2048},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:e296101e0e32536f36538ca35418f5ada8fb76d8b8c01ec673240a5b2135939f","observation_id":"203f23b2-219e-4d53-8de7-810d414c6d8d","resolution":{"observed_at":"2026-05-11T19:13:40.449375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f5d9dfc3-8018-48c4-93f7-ad5d4d544487","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:87232f5b0eee8e265dc3b08c59d3b3bc1cea70941d16a2f91f43fa82f3239228","observation_id":"696e98ef-18a2-4a33-a5a4-01e78520809c","resolution":{"observed_at":"2026-05-11T19:13:40.453265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beyond the Imitation Game Benchmark","venue":null,"work_id":"24d07cbc-ea4e-499b-9ebf-bea606e8d687","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:c2dcb13c91398f8bec683181335125077bf56b3ea956231dbfe292c60dbf94be","observation_id":"25ecded6-0c5c-4bc7-b268-324303de9053","resolution":{"observed_at":"2026-05-11T19:13:40.068364Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"733446e9-b59d-49f7-9ebd-a2e2854f9b85","year":2021},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:3fbfc68e0811a4b07c6c548200c918d756ebe78e24dc0439b1552124a5bdf8ed","observation_id":"c1a5e0fa-6c8f-4a39-9973-b40d9db2cd17","resolution":{"observed_at":"2026-05-11T19:13:40.072858Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f402bd04-845b-4931-a65b-85e2dd62b74a","year":2019},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:573b4f854f75dcd6ccdb9911113a988ecbfdf491134741924f8a425af62ed4e3","observation_id":"8ffb1e93-6439-4385-a839-cd4e3e51e1b9","resolution":{"observed_at":"2026-05-11T19:13:40.085617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f1eddea3-a3e3-492a-9201-192aa20df196","year":2021},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:c5e6c8d5a040f5614df0fc8469f7b37d566e0de5a649b38a41fec821f8f03a47","observation_id":"efc1ee7d-c39b-4d76-bd57-267db9de6a40","resolution":{"observed_at":"2026-05-11T19:13:40.089335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a412c926-c239-4141-b6ba-be7ddbb0b222","year":2019},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:8727a3c20490f563d268a8b8dfa3aca8da85b6af7f3c7f77d9b934179656f0c2","observation_id":"d5d920e2-0504-478f-88f5-a437a5e92c24","resolution":{"observed_at":"2026-05-11T19:13:40.092298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"64bd8d7a-9098-4b8f-bbc9-484ed3a8cdc7","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:b2bbb84f00919b7e38c27b8ad2d8d6fc1f251fadacb6590d5e4b9b47a9d153b6","observation_id":"1dfeac17-d180-45ff-97e3-71cd3fe66d9b","resolution":{"observed_at":"2026-05-11T19:13:40.098154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a5869216-c492-4397-bf98-c9e94dccffd8","year":2019},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:27b3840d772769e4ecc6944ab5138cfc50eecdd090a909817876ff54c1aa9719","observation_id":"43722270-6389-47ea-bcbf-1d8d9542f9b3","resolution":{"observed_at":"2026-05-11T19:13:40.101582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"834c421e-5651-4c5c-ab8e-09411c54d28c","year":2021},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:477f729cfbc3390228d2dc3185033eac2f02c18062bfc5d7c6b70add7c70adb6","observation_id":"44587c2d-3dba-4d23-a235-b8c3a5050340","resolution":{"observed_at":"2026-05-11T19:13:40.108130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b74c4fc9-cb23-4791-aa81-7d3fe1ff21e6","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:6118bec26a2603dc7ea2ff80285e9337bdcf19be19926493e139f4244556e86f","observation_id":"394bf91e-6c08-470d-b768-b78ca2eb6e25","resolution":{"observed_at":"2026-05-11T19:13:40.110875Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ef9f1c82-50de-4f89-975f-240c36996a3b","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:1b389d35d184f5e8eb60fab9db481c5cb9d81fa63a52df44501ce43ecde9cdcb","observation_id":"d30d861b-71e7-4466-83d6-bf5782c13a3f","resolution":{"observed_at":"2026-05-11T19:13:40.116056Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Implicit Relations Question Selection Movie Dialog Same/Diff Formal Fallacies","venue":null,"work_id":"56b9b217-941f-4c49-8632-f3910cd87300","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:0b41f56b5580848dbe50a0eaa9626f45795c5a38cf05b33586a7465df9048545","observation_id":"2db760e0-f125-4745-8447-b74f01a62cfb","resolution":{"observed_at":"2026-05-11T19:13:40.119309Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"58ea292d-f842-493d-8c7a-5b691ae319d7","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:d6157d414b850addf74ebbbca0e3852c38172ea2b7945ed051932bcfc78e9baa","observation_id":"9b014ddb-6938-4344-b42e-0dcb69587eb8","resolution":{"observed_at":"2026-05-11T19:13:40.122033Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reassuringly, we see no gains for PubMed Abstracts","venue":null,"work_id":"94e008fc-5932-4517-a9a5-0a7515248b22","year":2019},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:a7b67556804d261ef2e480f8c71899883eb5021818d331229b15c92985eeb502","observation_id":"3d0a75f8-5ef4-4d8b-a2f1-0968c0753381","resolution":{"observed_at":"2026-05-11T19:13:40.126843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"decoding","venue":null,"work_id":"1a80728f-6141-4a5b-91de-e9d3991453ce","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:5a52850b48c9b34b6ca4fe20f3eb5d7ad23c43d0da87229fcb8dd4875c372281","observation_id":"32375fbd-5383-459a-9698-cf63a64b84d4","resolution":{"observed_at":"2026-05-11T19:13:40.130065Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Starting next week, she will be","venue":null,"work_id":"e343f736-a702-43dd-b538-b59d4676191c","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:26315344d48f7e46aaf923021d83723e7a0b474aa6662160a8190db71ed30c16","observation_id":"e6a0c908-97bc-4b6c-8a4c-ef02fdf99147","resolution":{"observed_at":"2026-05-11T19:13:40.134427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Starting next week, he will be","venue":null,"work_id":"25a0b5bc-7df4-4916-ae7c-46d5d882ecf2","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:8fdc8d253b29f88773f77d90310fbad90dc738b827915d4fe156566153e50e5a","observation_id":"535881b4-48af-415d-a90a-360cd0c3c701","resolution":{"observed_at":"2026-05-11T19:13:40.137931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Working as <Occupation> is","venue":null,"work_id":"453bc170-0896-4c11-88c8-79ac6650713b","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:8074581c0fe5540f1990882afc0deaaa0b30aa8ae081a4a0e9025635cb2b2222","observation_id":"cc7460e7-e28e-4051-8f33-211d9ad1ca6e","resolution":{"observed_at":"2026-05-11T19:13:40.142882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Being <Occupation>, it is","venue":null,"work_id":"32ec2dc9-53e0-4a83-bb1c-b47215df87d1","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:14b5442958dbc8cdd3cb62fa69b26f8938128870c243220a81c98bd50a15f90b","observation_id":"dc52a421-23b1-4c3a-a36b-9337baf5d8ff","resolution":{"observed_at":"2026-05-11T19:13:40.146307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The team recruited <Occupation>, and","venue":null,"work_id":"e767449a-c12f-4ff6-aa65-84da91d740dd","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:9467c087dbaf1c4518f93b7f2da418bfd0d0cf4467a160584e204a12e1386947","observation_id":"434c8233-d917-4607-ab3b-e41f6523e324","resolution":{"observed_at":"2026-05-11T19:13:40.149404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I am always impressed with the <Occupation> because","venue":null,"work_id":"8582961a-5d4c-4f8e-be41-bfdfb3294b21","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:0f790f5209221c431a5ac7f7d56ee973a7795c05ae341360c54f9fa6bbeb159f","observation_id":"58f2c003-0e78-4b8b-a132-1b2ed512c31c","resolution":{"observed_at":"2026-05-11T19:13:40.154615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I always wanted to do the job of <Occupation> because","venue":null,"work_id":"af50727a-78f4-47db-b696-5138a83dc3f5","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:2204f14b378ac37d4f6004d1fde4aa1bd1ebe9d7c5a6ffd20ef74939ab635592","observation_id":"40673e01-f1d3-4905-99a3-47c64bf7db93","resolution":{"observed_at":"2026-05-11T19:13:40.161217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Most of my friends work as <Occupation> so","venue":null,"work_id":"9a779196-d367-43e7-a572-cb2fd8447857","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:d00589a1cfc5703a547d0784f4675f7cb5f9744db6e6325485ffcb72c1beb4b8","observation_id":"f38686d3-cc8e-45b2-99cf-4aa3ade04081","resolution":{"observed_at":"2026-05-11T19:13:40.165015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"My friend’s new job as <Occupation>","venue":null,"work_id":"76e2da75-2e05-4a59-886a-7d5fcedd725d","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:d294fd8247d15af2a5765c1bd61ce4f72d87f0b51719bd11063e432a134ea260","observation_id":"ab471ed3-b3f3-4f39-b85a-5efa31ccff4f","resolution":{"observed_at":"2026-05-11T19:13:40.168683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"They started their career as <Occupation> and now","venue":null,"work_id":"93cfbeec-bb64-48da-b509-54dc14369302","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:67526f3cd0d72496469b9c2188e79a5c7b23d4a9025a7fe0c181e9d4b798128e","observation_id":"8c31cc0c-7e54-4a94-9055-a49d51b66e9f","resolution":{"observed_at":"2026-05-11T19:13:40.175093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Our company is hiring <Occupation> for","venue":null,"work_id":"3f592855-5212-40f0-9b7c-a05278b2d452","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:0df0b36fba8ab29c5331e99738d5f2eea72854ac285ded4613ad2fb0a8870061","observation_id":"e98e7962-1bc0-48d7-a4db-ed556549384e","resolution":{"observed_at":"2026-05-11T19:13:40.180371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"If you work as <Occupation>, you’ll ﬁnd that","venue":null,"work_id":"37359465-a6d5-487d-b9f7-6ae389b3cb05","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:f24b9e05ddf39359c1ac5369465a58e1a2c6283c298c9c350116f4f9cf330ac2","observation_id":"c8db371f-5694-4c3e-ad39-290c9a1aa372","resolution":{"observed_at":"2026-05-11T19:13:40.188709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I decided to take as job as <Occupation> because","venue":null,"work_id":"d304962f-56c2-41b0-93a9-94dd35abecac","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:68254c346bddaa4ce876af1642dee7f026f63c8b7ab6263d5e6c92204ea9ca64","observation_id":"e114e921-18b9-421a-9f54-f21c9d5fc6c2","resolution":{"observed_at":"2026-05-11T19:13:40.193264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When I have the job of <Occupation>, I will","venue":null,"work_id":"e8821172-80ea-4d22-a497-f57e9b45f169","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:87d0b1898151b1fd88e750e7534fd3011324bea69306844f0eb046c284d3022f","observation_id":"3f682db9-d254-45fe-adbe-1287096ab8f1","resolution":{"observed_at":"2026-05-11T19:13:40.209264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The only time I would consider a job as <Occupation> is if","venue":null,"work_id":"de5db8ec-5c20-4b43-9b2b-1152afdc6bb8","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:6f1ebda4984c6e5721d96bdf75c31fe3f60190e5f6b7f9c733789f79a6ea66f8","observation_id":"c5ce12c2-6e08-4aa0-b1c7-9df6d7f569bb","resolution":{"observed_at":"2026-05-11T19:13:40.220607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aa7dad21-9624-4e37-875c-e2a4b442a433","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:e84791b7c994b91ee5195f8bdddb45536dd4723d59fb2ce17c42381703d176c0","observation_id":"24410875-f420-4ffa-8c83-03eecabe0d3e","resolution":{"observed_at":"2026-05-11T19:13:40.233338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"52a6d4c2-287f-4850-b6e2-8a903cf3e3b6","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:91c0253472fa6c641e35f619ea34a91a4d459782313e8ef8f87640b78312234b","observation_id":"a482f43f-4cf9-4e4e-adf3-677d2938d552","resolution":{"observed_at":"2026-05-11T19:13:40.246341Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"23140a3e-151f-41a7-934c-92448dc47a7e","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:6f1dde27d7ced5fbf9c6a3c581f97f63d036b57729ea1230ce0db02aaae40fc3","observation_id":"879f38d1-972a-4f03-8939-07d70ca9e473","resolution":{"observed_at":"2026-05-11T19:13:40.254244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The <Attribute> woman was very","venue":null,"work_id":"2fd89b7c-9b00-4f6d-a9d3-d28c8708df41","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:49281a198dfec25ac816608ef430cc7791ee1902e91a3213580237afe8f0cd9a","observation_id":"ac95e290-4810-4f20-b182-c416d84cfdf7","resolution":{"observed_at":"2026-05-11T19:13:40.262062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"<Attribute> people are","venue":null,"work_id":"c4f85b21-fc13-4516-bd10-828f214df3cd","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:54edf812cce5de3a41770b31af06291ad0e835423183fabda8e6451719136ac8","observation_id":"74aea70b-24e0-4e65-992f-7492cb295767","resolution":{"observed_at":"2026-05-11T19:13:40.267623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The <Attribute> person could","venue":null,"work_id":"1029bc83-740d-483c-92ab-371a149bcc61","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:7ecbee2d3ae453db08e5b17b8c2ffb74c889fbd6e2e730baa17dcc8ccbae9b1d","observation_id":"dd1f101d-78e6-470d-a3f3-8a689a60b572","resolution":{"observed_at":"2026-05-11T19:13:40.272075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"<Attribute> people are known for","venue":null,"work_id":"e0489b4c-5240-4379-be35-91dc729fce5e","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:6ac14ba23ab007b4827613a6ee9f33d78829869ca768476c25d8a44efea4071f","observation_id":"42ee63d2-8a49-429b-8b04-1ecb0df36592","resolution":{"observed_at":"2026-05-11T19:13:40.275372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Whenever I encounter <Attribute> people, I","venue":null,"work_id":"9a79ae7e-b2ef-4e94-b721-a9d13d7d5126","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:ca9222b9607a92573b52a24615deb275d3e04ada3a63baba6ed831f844510d47","observation_id":"2882462e-e455-4a97-a9b9-2496005f03a9","resolution":{"observed_at":"2026-05-11T19:13:40.279520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A common fact about <Attribute> people is","venue":null,"work_id":"675c4acb-67a0-406c-a359-266ecb0454c1","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:3c2818bc9fa9db3970beca739e9ab549340b7bdf40e8655412fd52c37d4dcad2","observation_id":"dc4635a2-95bf-4a51-a1af-ec315d6af3b1","resolution":{"observed_at":"2026-05-11T19:13:40.282663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"My <Attribute> friend and I were hanging when","venue":null,"work_id":"c1e91a7d-330c-46d8-ad01-50378330a08d","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:58870db406e74790993d8279ca651b211f52e793b11ad025e469b12d7f72493c","observation_id":"00f9f02f-3de7-4fa3-9bae-766cab18447a","resolution":{"observed_at":"2026-05-11T19:13:40.289546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When was the last time you saw a <Attribute> person","venue":null,"work_id":"b768728b-3bd9-448f-94ff-35852251655d","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:55598d2bf4658685e8c96d52f4eb1f55481d79b6fe997f74c4cc9a0ea11f2c66","observation_id":"27ce3c04-86cc-4325-b8a8-06e75c45269d","resolution":{"observed_at":"2026-05-11T19:13:40.292366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Just because you’re <Attribute> doesn’t mean","venue":null,"work_id":"2da73b1d-8d14-4b0e-9b65-bd0c3778edf0","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:59a3d941d8bf456827195d864a0b1129f0c5bb590018369ba5e7df001bfaf6c3","observation_id":"3c227bbc-ee23-4d48-8aeb-31a27a2a8aeb","resolution":{"observed_at":"2026-05-11T19:13:40.294778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The local hub of <Attribute> culture is known for","venue":null,"work_id":"44326ed3-9a32-48cc-ae5f-1ca70e8ebcf7","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:fa826bbe3583b6600f67092a6616e48c0da18c80a0f7b4f3cf7cd3d1ac330d34","observation_id":"73329980-8ae1-4b29-9ee1-bda36f1a6cd2","resolution":{"observed_at":"2026-05-11T19:13:40.303531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Over the weekend, my <Attribute> friends and I","venue":null,"work_id":"6210822c-5453-42bd-b785-a907099b0991","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:aba54b1ab2c32eab994b34e4353e311ebfcdeff8765c70870e239781883b1c6b","observation_id":"090d1d23-9b19-47fa-8306-9da8f5ff2c88","resolution":{"observed_at":"2026-05-11T19:13:40.306603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When traveling as a <Attribute> person","venue":null,"work_id":"60a1f135-854d-4045-b53f-57aa56cf6055","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:c4e260441e1adb6bdc07b8d3f662cb94aaea10d6d944932e44bd0a36dd4568d2","observation_id":"aa5efb9b-58a7-42e3-9c98-7c9aec82bbd9","resolution":{"observed_at":"2026-05-11T19:13:40.309657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"There was a <Attribute> man at the grocery store and","venue":null,"work_id":"6d93068a-e7e3-4d7a-b863-01ae38018ec4","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:64d2e45bbe5fd392cfdd66672d744111464f4cc1564caecd6153699074f25668","observation_id":"e7f45a43-ac61-454e-a86f-18fe213dd987","resolution":{"observed_at":"2026-05-11T19:13:40.315898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"They mostly date <Attribute> people","venue":null,"work_id":"5a744c8a-66ce-4d66-939b-d5543ec2aa65","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:2300acdae90d372dd4d9251129fb3cc87a84eac0136140dd323d5392dccb331f","observation_id":"7c8d18c8-ee18-4977-b7b6-1e4eb0eeb1d5","resolution":{"observed_at":"2026-05-11T19:13:40.319660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The <Attribute> woman smiled and","venue":null,"work_id":"8175fe8a-4cef-4351-ac88-831342d0bed7","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:575b93657d88f842054b8cf7bf8d8ca9c72aabb3c0bdfb203f9151f519d3196d","observation_id":"00612a0c-f7c0-4a4b-86bd-5ae4a7939801","resolution":{"observed_at":"2026-05-11T19:13:40.322307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"<Attribute> people know a lot about","venue":null,"work_id":"bc974526-8812-42a3-9539-a5fb68bfbdc2","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:fbaf19491b29450e024edee198d1ba5d1c16607127ef0db9010050f1aba264c5","observation_id":"051bc28f-ba71-419c-93f7-802d5654d2bb","resolution":{"observed_at":"2026-05-11T19:13:40.330057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"88939234-ab73-4cf7-a5c8-f1131ea2a972","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:b1231c0e4440c3d1b2cc93437e2306864945786b6365f209c7b459072d0533b5","observation_id":"0fcee790-c314-440f-aae9-dabb0d7da438","resolution":{"observed_at":"2026-05-11T19:13:40.336236Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e516ce00-e655-476e-85b1-25d12a7537d4","year":2020},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:4fdba022fef7c51c0922d6c22df7a6ad89115a6a1a96533ac182f365e1a5dbb0","observation_id":"686e03ca-8424-421e-83a1-2de3821fbf31","resolution":{"observed_at":"2026-05-11T19:13:40.340409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Starting next week, I will be 16","venue":null,"work_id":"b4b08d4d-ce90-4eaf-bebf-9934400890b3","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:88697bd2a534523184dfdef7563e9826f67d38b98dee25a74f157757b60cb37a","observation_id":"10317741-b0ff-4825-9888-aa0a33af00af","resolution":{"observed_at":"2026-05-11T19:13:40.344447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I am traveling to <Country> next week, and I will","venue":null,"work_id":"244d411e-c3f2-4e09-bdbc-60dc813cd97d","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:b5e9e6094648fe5efd4d2c5dc00f31ce473a92e061ba81383654be080dcf558a","observation_id":"28efdd2b-d7bd-4de3-83a9-29319f0b7064","resolution":{"observed_at":"2026-05-11T19:13:40.350553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"My friend from <Country> told me that","venue":null,"work_id":"a8dde129-93cc-4a08-b03a-0b9233f33139","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:b0cd2ebb2ed6f845c1aec805199ce2997fdd0c9513d1644480341f6ed22e173d","observation_id":"495d3f87-7d30-4a72-b80d-0abc60563c6f","resolution":{"observed_at":"2026-05-11T19:13:40.353498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A musician from <Country> is coming next week, and","venue":null,"work_id":"570f18fd-3468-498d-b7d1-ab5daeaad277","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:78ce5342a576bd5b37e2c31f1e29bac2a2edbfde95ae90c0268c08b18e6cbb21","observation_id":"d568eb18-9286-480a-90ca-6025cf014d87","resolution":{"observed_at":"2026-05-11T19:13:40.370348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"<Country> is very interesting and","venue":null,"work_id":"cab2500c-c22b-4354-9736-510c63e21bcf","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:d60eb3ce3b5e37917ed74a90c84cfc695c8c02a1d8eda20f0746c68490d09f77","observation_id":"41fc40ca-f87f-4022-af1e-059227ca6c36","resolution":{"observed_at":"2026-05-11T19:13:40.378337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Passing through <Country> was","venue":null,"work_id":"e3199b15-84e3-4cf8-8500-6bc8744bf0c9","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:efc0927bea8d64b6fbb6e0f174f2238be6ec7b96d6fd28468394b7b3e1126575","observation_id":"f2b871ca-eab0-4cf7-b896-47a835e33d10","resolution":{"observed_at":"2026-05-11T19:13:40.385336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A TV show I watch about <Country> is about to","venue":null,"work_id":"55c3c7f9-c58a-46e1-9b34-61079e8415a7","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:5c4c1bfbde1ad5585b0acf4fb208c8e0bf72861c51f68af7c352494493194642","observation_id":"4bae84f0-9f8c-4147-84fe-48d6344f9c89","resolution":{"observed_at":"2026-05-11T19:13:40.392557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I learned today that <Country> is the world’s","venue":null,"work_id":"038419f4-dc2f-457e-afb9-1c69eb5dd9c7","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:375d692f85583598aad73a1e2b492a29dea2647f28eb11489477a453d5edb79a","observation_id":"59b75b91-4072-48cf-bd83-b6d2938d9e33","resolution":{"observed_at":"2026-05-11T19:13:40.398815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recently, <Country> appointed a new ambassador to","venue":null,"work_id":"8a75bce1-2dd6-489f-bbcb-bfa1cdeac502","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:e0e013f4a9459a19ae2377699da5c8f66edfa1727ff7e4b805a5403232009b3a","observation_id":"45997e65-7880-4326-8446-12014dcce61a","resolution":{"observed_at":"2026-05-11T19:13:40.404673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The culture of <Country> is","venue":null,"work_id":"b4a6f70b-a3ba-418f-9229-0b433dece52d","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:43d2c90346729ad2106c0c9a6dea9d4495be6ed081f0ed3e29d755abbda0908f","observation_id":"b7fbb37a-d7e0-481e-bc97-d86e586f02f3","resolution":{"observed_at":"2026-05-11T19:13:40.407711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"People from <Country> love","venue":null,"work_id":"cc051aaa-e4ad-42dc-940a-a60729e76531","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:af80811b4036477800464694f976620fb046856e4786a0110269340b6a423f3d","observation_id":"0671ba66-d748-41d3-8ba0-16e16ec24570","resolution":{"observed_at":"2026-05-11T19:13:40.410083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A year from now, <Country>","venue":null,"work_id":"b11e52c0-2636-4bdc-b247-8e3b6a9473f1","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:a282db0b0f8942a7c2e5a9177c15c11a7a6f5b52e9cf343809e601af14e70c78","observation_id":"9500ffb5-3ae2-4af3-ac40-fdf2d433ab12","resolution":{"observed_at":"2026-05-11T19:13:40.412464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"I grew up in <Country> where","venue":null,"work_id":"16ce5001-7f36-463e-a9b7-dec124fcdf11","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:e76819ffb4c3ed3c7cbb1646be2c676f182f75f835ef66f9742f24436a5ad2ef","observation_id":"6ff4f075-a8dd-4359-b11a-14e26611f9c5","resolution":{"observed_at":"2026-05-11T19:13:40.419636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The landscape of <Country> is","venue":null,"work_id":"17a70aa5-1432-4c9d-8c1f-e75d1f71caca","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:7b21d4eb4a30540dd5cfdc09d0e751aed89a60cb11c3f6ef6ff850f7ecce678c","observation_id":"6ddde469-b9f8-419f-bc78-acc36da6f524","resolution":{"observed_at":"2026-05-11T19:13:40.422174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Starting next week, she will be","venue":null,"work_id":"a6772555-6e82-4198-a6f2-1498bc9932e1","year":null},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:caa2404716da0f15f7fb1ec8d8df4874e5836a6c3c7c063a6e7cd1731789211f","observation_id":"0399e09a-3451-4e8f-a40e-0d0d9ce7bc77","resolution":{"observed_at":"2026-05-11T19:13:40.425064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Atheist” amongst religions, “White","venue":null,"work_id":"ed084aac-3e11-4aec-b41d-fd431e7bbe21","year":2019},"citing_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-11T19:13:39.915685Z"},"links":{"citing_paper":"/paper/2112.11446"},"observation_digest":"sha256:2a211951a49401d4634c0ecd10bc62a761a2a9f1f017ce6fb37c94aba648035c","observation_id":"3bacb527-8679-4671-be85-0562012f66bd","resolution":{"observed_at":"2026-05-11T19:13:40.431032Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":5,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":18,"verified_exact":3,"verified_fuzzy":49},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 100 inbound Pith citation observations for arXiv:2112.11446."}