{"as_of":"2026-08-08T07:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3eb93cfaab57885b31f79cdca098d16eea71e49129a9106aa280de20ca071db3","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:55:02.868112Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:11:13.013810Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01172","snapshot_observed_at":"2026-08-01T07:11:13.013810Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21574","last_updated":"2026-07-23T17:54:37Z","snapshot_observed_at":"2026-08-04T08:40:37.828518Z","submitted_at":"2026-07-23T17:54:37Z","title":"Surprisal Theory is Tautological (without Rational Grounding)","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T07:11:13.013810Z"},"links":{"cited_paper":"/paper/2506.01172","citing_paper":"/paper/2607.21574"},"observation_digest":"sha256:fd1dc76d588602b8ee2150391887842dc63db6d1ef6ec23f8633594698d4bd39","observation_id":"ce8d93ba-0f2c-4015-aa42-8ba1f7ae2749","resolution":{"observed_at":"2026-08-01T07:11:13.013810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01172/citation-record","integrity":"/paper/2506.01172/integrity","json":"/paper/2506.01172/citation-record.json","paper":"/paper/2506.01172"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.274682Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.274682Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:a4c8e3f6306594520c3a7f4922bb61496c4a84f8c27f48e762445f4f24054a05","observation_id":"968836bf-c362-4e51-ab2f-54847270c8f7","resolution":{"observed_at":"2026-08-07T11:55:02.274682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.287670Z","title":"Barr, Roger Levy, Christoph Scheepers, and Harry J","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.287670Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:d84a6a0ca3b2e22594c860259b13291511fda02d987cd1f032a4e7f71e35ae3a","observation_id":"4a608228-279e-403c-85b4-e7735fca4c2b","resolution":{"observed_at":"2026-08-07T11:55:02.287670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.297374Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.297374Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c7a24dbbc8dff235fc6cf6103e5b43c03fc98fdbee574a93393143d3b9c4f798","observation_id":"322f75a1-db47-4d81-b126-d74558d161a1","resolution":{"observed_at":"2026-08-07T11:55:02.297374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.183986Z","title":null,"venue":null,"work_id":"77436eb8-33b0-4711-b760-f2c94e649076","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.305585Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:9a8d9362e8e7be36d79fdf6ab8d8e51d3b791f5f4dd386e575c66fc2fa93d4d6","observation_id":"8961308c-955d-4911-8450-1d0a878498c7","resolution":{"observed_at":"2026-08-07T11:55:04.197844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.133014Z","title":null,"venue":null,"work_id":"14c6f119-4121-4409-a5cf-7ab5b99fee32","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.315707Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:6c629ccba42821f0e00783b4db396a5fdd31f711616a5546390f6eac311fb7a3","observation_id":"ed0310fc-4810-4cbc-9ef8-dab004b19357","resolution":{"observed_at":"2026-08-07T11:55:04.160285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.073288Z","title":null,"venue":null,"work_id":"c9f82c07-5c84-4087-8583-f721b299e475","year":1920},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.326697Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:400f19fd8824ccbe2048949a073b8c6b673844d197953a8b50576941ae9a25cf","observation_id":"f9dacca9-13d9-4554-911d-5e99a634378d","resolution":{"observed_at":"2026-08-07T11:55:04.101736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.336053Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.336053Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:5545d4555ed350d4143bf860297e4960add18adb0e552f525de944d16e11eb97","observation_id":"6e6e8820-882b-41b5-b9e1-1fe151355ad7","resolution":{"observed_at":"2026-08-07T11:55:02.336053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/3-540-63246-8_12","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.130050Z","title":null,"venue":null,"work_id":"c5a2ce58-4e1f-4ba6-b9b9-5b1e5f63b115","year":1997},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.343867Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:297dba7f6e3822dda604adb8b97903d024e61922be8ed795f27e07d9ca0d4fa8","observation_id":"3227d12e-f00d-41ce-a229-2ffb194b7429","resolution":{"observed_at":"2026-08-07T11:55:03.147209Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s10579-020-09503-7","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.076498Z","title":"Tily, Idan Blank, Anastasia Vishnevetsky, Steven Piantadosi, and Evelina Fedorenko","venue":null,"work_id":"0867b020-4b81-4f04-ad70-5a0856c9a9a4","year":2021},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.356088Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:0de88382345b1a849ba78eacc4a3927b3c44241c46778752162d5f7c95b9831b","observation_id":"3505a9ac-42bd-44ba-8acd-b9ca2eeb84bc","resolution":{"observed_at":"2026-08-07T11:55:03.099726Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T11:55:02.367531Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.367531Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:3c2b78fb1dac8cb9bbafdb18a2e3ce356628c6625e25075313bd82159ee958ef","observation_id":"1e5e4d80-b5de-41f2-973d-d490289c8314","resolution":{"observed_at":"2026-08-07T11:55:02.367531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.377183Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.377183Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:6d37a954bd687ce346794791b0462c31e0a7aab1c70282c3794230d1920a1b83","observation_id":"c726c632-025e-414a-8cfe-fd0bb63733fa","resolution":{"observed_at":"2026-08-07T11:55:02.377183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:04.018567Z","title":null,"venue":null,"work_id":"aa94337c-875f-464c-9d6f-748103b84447","year":2001},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.383270Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:1ce3e4512e5ba284b7a5489eb452ec10ac4ab957701ce0f2be0372ff0fd6e189","observation_id":"1929da3b-b191-49fb-b060-d422f645e911","resolution":{"observed_at":"2026-08-07T11:55:04.032764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.393438Z","title":"Clark, and Philipp Koehn","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.393438Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:0e1f835c4c891b350747906fd936bb0f454b5385f4a5fe3336b95ef12b43d3de","observation_id":"8fdfd97f-bd09-47cd-a07a-90dfacb8ab09","resolution":{"observed_at":"2026-08-07T11:55:02.393438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.dam.2004.04.012","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.028700Z","title":null,"venue":null,"work_id":"69e7369a-e629-4708-8f28-9766778c4a01","year":2005},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.401218Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:d46aa7310b0c2a112ed20a1d702371a781d7a743b810474b6b05f2e2879361cd","observation_id":"76cca9b1-0b43-4f19-99a3-058f7cdc3503","resolution":{"observed_at":"2026-08-07T11:55:03.056423Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.969872Z","title":null,"venue":null,"work_id":"c3fa0e29-fe2f-4556-bade-7a9a41f9d80a","year":2003},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.410683Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:39b1e0b8915b45b662f3ebad06257c321f8a5f81a97d6cabdaf72e7bf45d2d3d","observation_id":"80a6ca9e-51ba-4879-9daa-09aa0d847516","resolution":{"observed_at":"2026-08-07T11:55:03.987777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T11:55:02.418060Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.418060Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:375de26b4ad9a73ee21c2447286239b4c7006e18bce7170c8f6f84b7154fba60","observation_id":"ce83a66d-0184-4b4a-88ff-9a9e9332a444","resolution":{"observed_at":"2026-08-07T11:55:02.418060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.935328Z","title":"Nelson Francis","venue":null,"work_id":"de9ce601-3bb1-474c-91cf-a3152b809015","year":1967},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.425842Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:2f95491cddee4537e5c5d6e342a0bcccedfebd99f2b268ba10622e8a9bcfe2ca","observation_id":"3a47aee8-bf28-4074-90bd-7cb42bd34dca","resolution":{"observed_at":"2026-08-07T11:55:03.946803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.437476Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.437476Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c79b919766e963ceb0acde52bc08f3256d8c059279979bc80841ea7aa6e306a9","observation_id":"94f026fb-1cb3-445c-9959-057d70a1fb5b","resolution":{"observed_at":"2026-08-07T11:55:02.437476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.447433Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.447433Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:eb75624d6d440477fee04d0cfaa070f6ef87312fc0594dfaf6bdd81a7d3a2bd4","observation_id":"af938671-5e66-4822-8891-d5690497b19f","resolution":{"observed_at":"2026-08-07T11:55:02.447433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.891616Z","title":null,"venue":null,"work_id":"a867d0ed-1b95-4f94-af37-a9d431fe32ee","year":2019},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.456187Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:bf8a925534b0e55a8c15b018ba907aed281d177f31c4982babc2d291f1f36495","observation_id":"4ae90f9f-ec8e-48e0-95c1-9846f207b7b3","resolution":{"observed_at":"2026-08-07T11:55:03.911311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.465284Z","title":"Luke and Kiel Christianson","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.465284Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:c15c04a4b780d2c72dbd3446b8b023efd71f94a87eea6f120e9c421569ee695e","observation_id":"af205181-e91d-4cf0-a51c-44a1f490afbd","resolution":{"observed_at":"2026-08-07T11:55:02.465284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.475089Z","title":"Ivanova, Idan A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.475089Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:4bb3b281188a758f04ad68817bb23e93e096f7349fa089f35839dfd7ac5bad09","observation_id":"6a1b9dce-8508-4a13-ab99-df90f855a1de","resolution":{"observed_at":"2026-08-07T11:55:02.475089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.838956Z","title":"Smith, and Yanai Elazar","venue":null,"work_id":"77adcede-46a8-40d2-ba56-1b06b0c31d3a","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.484089Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:575f29cb47c7d7b9da2cc389dc22c0221cd44d2047edbcdf6da71ed1766a2958","observation_id":"4435cce4-cb65-47af-827b-f080b6d4427e","resolution":{"observed_at":"2026-08-07T11:55:03.864254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.801467Z","title":null,"venue":null,"work_id":"2eda52e6-3f0d-4e43-8cd4-678a180ae4d5","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.492949Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:a9a641db5a34a1a40f0473503ee01e798eb3c9a905af5ed750ddb9cf95c70257","observation_id":"a36dfa31-d1b0-4b85-a226-beb8500f30d0","resolution":{"observed_at":"2026-08-07T11:55:03.817177Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.511467Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.511467Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:e9ff944fd4983ba8861f2e2763278507174d33498df2a38ea9a383cf7f7f1815","observation_id":"fa17703d-d16d-4db8-973f-6302d51836bb","resolution":{"observed_at":"2026-08-07T11:55:02.511467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.748562Z","title":null,"venue":null,"work_id":"bdfbfdab-907b-4eb0-87d9-3997c9207d36","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.535293Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:3e38a6bc8eab5ae1fcb830d51e2abead07d06e6ee4a15c97108df543fed9ec56","observation_id":"570dcbc7-8979-4ba7-9e22-50666a0aee2a","resolution":{"observed_at":"2026-08-07T11:55:03.769254Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.701948Z","title":null,"venue":null,"work_id":"f1763144-4c73-464b-bc8f-c2aa6f857886","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.562720Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:4cdd7a23b0e96d6f819b39b84c3cc8a5030d1ab51e7ac4364e0751a9f335b57f","observation_id":"4de5c190-9390-4c92-bfaa-425312e22038","resolution":{"observed_at":"2026-08-07T11:55:03.713943Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.664474Z","title":null,"venue":null,"work_id":"152e6c0a-96da-446a-ad76-a1f607b25d2e","year":2009},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.591765Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:fdfce289667db40e43ea2fc78a78c4d39be413b113d8124706f6caed1f018e8f","observation_id":"186435b9-7f44-42fc-88b0-73df377aeecd","resolution":{"observed_at":"2026-08-07T11:55:03.678360Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.617095Z","title":null,"venue":null,"work_id":"192883c9-eff5-47f7-aeae-e8b7e084c8cc","year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.616633Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:54541d8c3fca7523ffdf82adf8f9b0ae83c89f30c4a8229e5c0dfcd949200bd5","observation_id":"b5f5269a-4ab4-498e-8005-b4032b0c40e5","resolution":{"observed_at":"2026-08-07T11:55:03.638789Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.566754Z","title":null,"venue":null,"work_id":"5f445ed3-7939-4f8e-b5a1-d4caf0063141","year":2019},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.646682Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:7e8536e0318b84384268040ed373cf787667930f9bbe37426d9878f24a5d4125","observation_id":"465f72df-27ec-4896-9a3d-74951c6ca7e9","resolution":{"observed_at":"2026-08-07T11:55:03.597886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3701.34337","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.386783Z","title":null,"venue":null,"work_id":"dc581e5a-e8ed-45f5-98dd-5f2dc9119f7e","year":2020},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.676043Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:8c6176b2c8d6d5140ade20e93056d1571176233c124489f653e5d81d7329b165","observation_id":"061869f0-7229-4059-ac6b-538f58f0d7e9","resolution":{"observed_at":"2026-08-07T11:55:03.405889Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0022-5371(83)90236-0","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.943120Z","title":null,"venue":null,"work_id":"da615758-1992-4b93-96d2-af465f69a32a","year":1983},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.706877Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:9dc2bd820899baff2dc68aebe3883ff27d0f119be999969f7623ebeada48beca","observation_id":"c5a5dc01-43d8-4066-8a54-4f9ee4c6c6f4","resolution":{"observed_at":"2026-08-07T11:55:02.964269Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.724722Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.724722Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:37a0562561e90c31c78664f7551e59fae99e5f31b82fbefce1f1f48012e7a19d","observation_id":"e42ba496-38f7-485f-9cc8-a0fe870453b9","resolution":{"observed_at":"2026-08-07T11:55:02.724722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.750156Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.750156Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:f5af34df1bc56119bf608c50d57bd411be20f010cb96ed3defc5ab78846eb4bd","observation_id":"dceb68eb-b08e-4396-a63b-d8300eaea3b2","resolution":{"observed_at":"2026-08-07T11:55:02.750156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.773448Z","title":"Smith and Roger Levy","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.773448Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:7715396bdbbe2e565143952baad8ece052e8e4e24c80a6b588edbbf3d208d56c","observation_id":"ec6b1419-c981-4965-a73f-d1ace31849f8","resolution":{"observed_at":"2026-08-07T11:55:02.773448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.507752Z","title":null,"venue":null,"work_id":"06f2436b-d448-4491-8a7e-3a5e1839af2d","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.800446Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:bb17af0db949ede5cb62e74ecdba39b479898f58b84c3ada1756fc6324c78fe4","observation_id":"509b4c55-397e-416b-ab25-54bb28dcddf2","resolution":{"observed_at":"2026-08-07T11:55:03.536854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:02.836447Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.836447Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:00010f4df37453cce9fbef33cbf46a95b82d1a84ac5c618799a73f1ab6f0f7f0","observation_id":"4074eca7-f6a8-4e62-80f5-d74700ae1095","resolution":{"observed_at":"2026-08-07T11:55:02.836447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:03.458714Z","title":null,"venue":null,"work_id":"a97e6510-3733-47be-8ea0-d82d5d435203","year":2023},"citing_paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:55:02.868112Z"},"links":{"citing_paper":"/paper/2506.01172"},"observation_digest":"sha256:d859121e27f1ada7af8e1ee0d5b544ec28851cf6de178d25d3bcf6df07d52535","observation_id":"3d548478-e8ea-4f74-8f36-9b647b57f697","resolution":{"observed_at":"2026-08-07T11:55:03.478059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01172","last_updated":"2025-06-01T21:12:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:48:08.944946Z","submitted_at":"2025-06-01T21:12:36Z","title":"The Inverse Scaling Effect of Pre-Trained Language Model Surprisal Is Not Due to Data Leakage"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":31,"verified_exact":4,"verified_fuzzy":2},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2506.01172."}