{"as_of":"2026-08-08T07:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f97b28a65d5cf05f198db9cc207a380d2ebfb2c64031bad0f21022e64a494bf","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":34,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:12:12.952767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:20:00.933699Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2505.10465","last_updated":"2025-11-29T21:39:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-15T16:18:13Z","title":"Superposition Yields Robust Neural Scaling","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T14:38:44.789822Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2505.10465"},"observation_digest":"sha256:ea8622d703d9a4497d5aabb328b258e6a7a176a45b7fcf2102d0e0134e79dfcd","observation_id":"893a05cf-e463-4ab3-825d-0372c0b52dec","resolution":{"observed_at":"2026-05-09T06:36:25.504581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-07T15:12:12.952767Z","title":"Roberts, and James Sully","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16098","last_updated":"2025-05-22T00:58:50Z","snapshot_observed_at":"2026-08-08T05:52:06.882059Z","submitted_at":"2025-05-22T00:58:50Z","title":"Dimension-adapted Momentum Outscales SGD","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:12:12.952767Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2505.16098"},"observation_digest":"sha256:c6ca4e4b646393cc74ac92cd617a6faf96dda58bcf323f8e497a62774750ff43","observation_id":"f0eff303-0a79-4b5f-8810-45bc0ad8a5f2","resolution":{"observed_at":"2026-08-07T15:12:12.952767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-07T13:06:53.653585Z","title":"Maloney, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22813","last_updated":"2025-06-04T16:02:34Z","snapshot_observed_at":"2026-08-08T04:53:17.161864Z","submitted_at":"2025-05-28T19:41:37Z","title":"X-Factor: Quality Is a Dataset-Intrinsic Property","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:06:53.653585Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2505.22813"},"observation_digest":"sha256:2eeeac2738bd35c501bb9906ddb84f09931e379852f9d02f122964b0ee396b80","observation_id":"1cce0274-4132-4d29-be3c-11cb913f1980","resolution":{"observed_at":"2026-08-07T13:06:53.653585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-07T11:15:51.356068Z","title":"A., and Sully, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03470","last_updated":"2025-06-04T00:55:01Z","snapshot_observed_at":"2026-08-08T03:37:32.203029Z","submitted_at":"2025-06-04T00:55:01Z","title":"Models of Heavy-Tailed Mechanistic Universality","version":1},"reference_index":2011,"source":"pdf_text","source_observed_at":"2026-08-07T11:15:51.356068Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2506.03470"},"observation_digest":"sha256:1f85ffc84c06103183fb4ff26d71e03d7b7e04e01655ea5eb478728ea94f616e","observation_id":"f3770cae-fe95-4738-ab7f-9f70102b2849","resolution":{"observed_at":"2026-08-07T11:15:51.356068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-04T13:54:26.814732Z","title":"Maloney, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.24882","last_updated":"2026-08-06T09:40:55Z","snapshot_observed_at":"2026-08-08T07:13:57.128823Z","submitted_at":"2025-09-29T14:58:13Z","title":"Scaling Laws and Spectra of Shallow Neural Networks in the Feature Learning Regime","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T13:54:26.814732Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2509.24882"},"observation_digest":"sha256:49a7f12ad485e80593ce6a666b88b0118159ccd6ab8a8c8d0fe6f33a125ce732","observation_id":"46b99037-ca04-4263-8baf-ef25ccbe84e9","resolution":{"observed_at":"2026-08-04T13:54:26.814732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-03T16:34:37.711494Z","title":"Maloney, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2512.13491","last_updated":"2026-06-22T06:30:05Z","snapshot_observed_at":"2026-08-07T23:56:10.506186Z","submitted_at":"2025-12-15T16:25:06Z","title":"From Zipf's Law to Neural Scaling through Heaps' Law and Hilberg's Hypothesis","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T16:34:37.711494Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2512.13491"},"observation_digest":"sha256:c1c9932d9a62d4c2578c65dd90c70016ca9b005be7e1267a3ec6f85b3466634c","observation_id":"efedc4cb-28ea-41ec-9c0d-bce98d09b9f7","resolution":{"observed_at":"2026-08-03T16:34:37.711494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-03T11:25:09.558686Z","title":"A., & Sully, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.06649","last_updated":"2026-06-08T14:01:39Z","snapshot_observed_at":"2026-08-08T07:40:32.082499Z","submitted_at":"2026-01-10T18:24:40Z","title":"Revisiting Training Scale: An Empirical Study of Token Count, Power Consumption, and Parameter Efficiency","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T11:25:09.558686Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2601.06649"},"observation_digest":"sha256:8cd8a48a4568b03f8796f2fcfd1c807d44c0c15b779d0667d996e57adba13396","observation_id":"586d93f0-6620-4dd7-8d48-38a7159a6a97","resolution":{"observed_at":"2026-08-03T11:25:09.558686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-03T05:01:12.953666Z","title":"A., and Sully, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.03685","last_updated":"2026-05-31T19:36:07Z","snapshot_observed_at":"2026-08-03T05:01:07.831427Z","submitted_at":"2026-02-03T16:06:18Z","title":"Universal One-third Time Scaling in Learning Peaked Distributions","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T05:01:12.953666Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2602.03685"},"observation_digest":"sha256:ba101c9c82548866d2d48484444eb6702eaeec234fcd8aa5a67138d477c54c9e","observation_id":"706bb2b3-eea6-47fd-8fee-67402b30fe57","resolution":{"observed_at":"2026-08-03T05:01:12.953666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-03T04:07:46.211483Z","title":"A., and Sully, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05970","last_updated":"2026-05-31T19:48:07Z","snapshot_observed_at":"2026-08-07T15:15:21.459993Z","submitted_at":"2026-02-05T18:22:41Z","title":"Inverse Depth Scaling From Most Layers Being Similar","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T04:07:46.211483Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2602.05970"},"observation_digest":"sha256:a442c8ca56ae751f47c0895092560aabfd5dd1869c3838cd1c86eb57d696b86b","observation_id":"392ddaf4-955f-4e2e-99cb-68ce2c54c86b","resolution":{"observed_at":"2026-08-03T04:07:46.211483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-02T20:37:01.571822Z","title":"A., and Sully, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2602.23039","last_updated":"2026-06-01T09:29:09Z","snapshot_observed_at":"2026-08-04T13:27:32.737495Z","submitted_at":"2026-02-26T14:24:11Z","title":"Dynamics of neural scaling laws in random feature regression with powerlaw-distributed kernel eigenvalues","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T20:37:01.571822Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2602.23039"},"observation_digest":"sha256:3421ea916d390aabf267c5e6e3c7c800e45a0824619ed32d6fea2c3fe9319a3f","observation_id":"a5599f16-4da7-48d5-be98-7e5da2768231","resolution":{"observed_at":"2026-08-02T20:37:01.571822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2604.24037","last_updated":"2026-06-22T01:13:01Z","snapshot_observed_at":"2026-07-06T23:10:12.016186Z","submitted_at":"2026-04-27T04:43:42Z","title":"A Limit Theory of Foundation Models: A Mathematical Approach to Understanding Emergent Intelligence and Scaling Laws","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-13T07:27:21.118156Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2604.24037"},"observation_digest":"sha256:f76a1d2cf82de3faea4ccefc31cc500a771ce8c74426407e9ce275b1165a0e2a","observation_id":"ec6d1a16-ab5b-4e79-883d-4835848206c5","resolution":{"observed_at":"2026-05-13T07:27:28.948778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2604.24037","last_updated":"2026-06-22T01:13:01Z","snapshot_observed_at":"2026-07-06T23:10:12.016186Z","submitted_at":"2026-04-27T04:43:42Z","title":"A Limit Theory of Foundation Models: A Mathematical Approach to Understanding Emergent Intelligence and Scaling Laws","version":4},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-01T09:03:59.522516Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2604.24037"},"observation_digest":"sha256:272bacd65549a6da18af9adca6aaeb9e065593bb68621a65e985370bb55aea18","observation_id":"ddefce1b-ea3c-4e47-b034-664aa894c2cd","resolution":{"observed_at":"2026-07-01T09:05:36.341948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.05076","last_updated":"2026-05-24T22:21:17Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:11:09Z","title":"High-Dimensional Statistics: Reflections on Progress and Open Problems","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-08T15:35:08.202464Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.05076"},"observation_digest":"sha256:89713957030b14e80a9e83648bbdb82673732a801d8ed3206c0a96915ac31e20","observation_id":"34fa947e-f693-4fbb-8bf1-1ef2b54ea95f","resolution":{"observed_at":"2026-05-11T18:36:06.580939Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.05076","last_updated":"2026-05-24T22:21:17Z","snapshot_observed_at":"2026-07-06T23:17:43.402046Z","submitted_at":"2026-05-06T16:11:09Z","title":"High-Dimensional Statistics: Reflections on Progress and Open Problems","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-30T23:25:55.375541Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.05076"},"observation_digest":"sha256:c1e1901100989a5f2752fc8d5269e89ac79191dc43af1333f81e9efbc96b8a74","observation_id":"3c5b22b2-cd9d-46bc-aa1a-362c3bea1570","resolution":{"observed_at":"2026-06-30T23:35:08.037828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.05683","last_updated":"2026-05-07T05:19:56Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:19:56Z","title":"Spectral Lens: Activation and Gradient Spectra as Diagnostics of LLM Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T05:41:24.861876Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.05683"},"observation_digest":"sha256:b8f0c9e1fce682e02147e40b70b0bf0da0c872cb72d46a9a0c742fe864e269f9","observation_id":"455cdc7e-d189-4d5d-a330-2b1064372718","resolution":{"observed_at":"2026-05-11T21:26:13.379542Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.06563","last_updated":"2026-05-07T16:57:59Z","snapshot_observed_at":"2026-07-31T20:57:03.610204Z","submitted_at":"2026-05-07T16:57:59Z","title":"Criticality and Saturation in Orthogonal Neural Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T12:25:37.004451Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.06563"},"observation_digest":"sha256:099d2cbe308e6ad0c1626513a1d6b617159cf08eb1c761395b1a0f451dfe3186","observation_id":"74622cf9-2406-4f7f-b7db-f74cc4f1bbdd","resolution":{"observed_at":"2026-05-11T19:16:08.990799Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.09189","last_updated":"2026-05-09T22:07:01Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-09T22:07:01Z","title":"Practical Scaling Laws: Converting Compute into Performance in a Data-Constrained World","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T02:58:26.656927Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.09189"},"observation_digest":"sha256:d4092837106fb7fe38ddc9bb2f1787174c9ee485d43575a0fde5f22e70c936ff","observation_id":"e2e80ef0-64a6-429e-aa11-992b9c369aa2","resolution":{"observed_at":"2026-05-12T03:01:18.404478Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.14567","last_updated":"2026-05-14T08:37:28Z","snapshot_observed_at":"2026-08-03T00:46:36.800591Z","submitted_at":"2026-05-14T08:37:28Z","title":"Scaling Laws from Sequential Feature Recovery: A Solvable Hierarchical Model","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-15T01:39:21.733359Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.14567"},"observation_digest":"sha256:19aaa35b6e218f11cc762b1bad6dbd3be398b365c7a82dc91617d33dd156faca","observation_id":"f05e73b5-cd1c-4d70-ae65-4b8829b98afa","resolution":{"observed_at":"2026-05-15T01:39:38.388073Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.22341","last_updated":"2026-05-21T11:26:32Z","snapshot_observed_at":"2026-07-06T23:32:39.761431Z","submitted_at":"2026-05-21T11:26:32Z","title":"A Boundary-Layer Mechanism for One-Third Scaling in Online Softmax Classification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T07:07:01.822626Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.22341"},"observation_digest":"sha256:75f2c657a6986572ac922aeee928b009e8523c4b7403a804c328a27a133359fc","observation_id":"01751d39-b00b-4dbf-abc3-0407f78ed107","resolution":{"observed_at":"2026-05-22T07:11:13.111923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.23591","last_updated":"2026-05-22T13:00:52Z","snapshot_observed_at":"2026-08-02T07:23:00.263762Z","submitted_at":"2026-05-22T13:00:52Z","title":"Asymmetric Scaling Laws from Sparse Features","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-25T03:16:34.488732Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.23591"},"observation_digest":"sha256:a27ac2618b0501e4cda5287390bf14bf3d369288d01e872af2e57c30c2a78bd8","observation_id":"52b5c0d9-0e37-4125-aa5b-174c4f144906","resolution":{"observed_at":"2026-05-25T03:20:17.080193Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.24316","last_updated":"2026-06-25T06:26:55Z","snapshot_observed_at":"2026-08-01T14:56:15.713802Z","submitted_at":"2026-05-23T00:48:36Z","title":"From One-Pass SGD to Data Reuse: Mini-Batch Scaling Laws in Sketched Linear Regression","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T14:09:52.456340Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.24316"},"observation_digest":"sha256:d1ddcceaa192389ab63f517bf2314034059ad2dd3836b9c189d36566badc4b0d","observation_id":"52bbb7af-9e6a-4712-880f-d25a5410c7ef","resolution":{"observed_at":"2026-06-30T14:14:45.595089Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.29548","last_updated":"2026-06-01T17:29:35Z","snapshot_observed_at":"2026-08-02T17:41:19.598860Z","submitted_at":"2026-05-28T08:02:11Z","title":"Why Larger Models Learn More: Effects of Capacity, Interference, and Rare-Task Retention","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T08:39:14.327838Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.29548"},"observation_digest":"sha256:41f6a7186d146f5505763f542cd8f0a29fc9178e77dad936a7a2e638b77824ac","observation_id":"a7c9d649-fa35-42af-be95-3929dfd0b698","resolution":{"observed_at":"2026-06-29T08:43:15.227113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2605.31244","last_updated":"2026-08-03T07:52:55Z","snapshot_observed_at":"2026-08-07T15:13:56.799192Z","submitted_at":"2026-05-29T12:43:51Z","title":"Spectral Reach: Understanding Neural Scaling as Progress into the Spectral Tail","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T23:03:01.838682Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.31244"},"observation_digest":"sha256:10db94ec42a8bad75db25b1b31786be59409fff0e87e914f4358dc31bfd6043d","observation_id":"63f67eaa-c963-4c30-8734-04f8ed929025","resolution":{"observed_at":"2026-07-01T19:16:00.259743Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-04T04:58:48.522187Z","title":"Maloney, A., Roberts, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.31244","last_updated":"2026-08-03T07:52:55Z","snapshot_observed_at":"2026-08-07T15:13:56.799192Z","submitted_at":"2026-05-29T12:43:51Z","title":"Spectral Reach: Understanding Neural Scaling as Progress into the Spectral Tail","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T04:58:48.522187Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2605.31244"},"observation_digest":"sha256:e2b64dd682ec64a3c8f6ef69327a2dd1bda8170a0d7856efc74a853a56577d38","observation_id":"c21a7f9c-28dc-4b3f-a419-03510d521d4e","resolution":{"observed_at":"2026-08-04T04:58:48.522187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2606.08167","last_updated":"2026-07-30T10:53:08Z","snapshot_observed_at":"2026-08-02T23:58:03.710099Z","submitted_at":"2026-06-06T13:31:38Z","title":"Explaining Data Mixing Scaling Laws","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T20:20:53.599064Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.08167"},"observation_digest":"sha256:dae2d453856cc4bb6c15208ec203e0ec862a0b553aa9add822dec7e3c132c9be","observation_id":"5b61f59a-8012-40bc-a051-e7dc6210cee5","resolution":{"observed_at":"2026-07-02T20:37:22.531196Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-15T10:54:16.434702Z","title":"Maloney, A., Roberts, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08167","last_updated":"2026-07-30T10:53:08Z","snapshot_observed_at":"2026-08-02T23:58:03.710099Z","submitted_at":"2026-06-06T13:31:38Z","title":"Explaining Data Mixing Scaling Laws","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-15T10:54:16.434702Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.08167"},"observation_digest":"sha256:51c2a705f294f87f84c2567884285f54b93b45fdda5c9e7318175f496e96d1ea","observation_id":"ca8fb948-ab66-41a5-bc28-248b95aad65d","resolution":{"observed_at":"2026-07-15T10:54:16.434702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-08-02T12:13:46.679613Z","title":"Maloney, A., Roberts, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.08167","last_updated":"2026-07-30T10:53:08Z","snapshot_observed_at":"2026-08-02T23:58:03.710099Z","submitted_at":"2026-06-06T13:31:38Z","title":"Explaining Data Mixing Scaling Laws","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T12:13:46.679613Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.08167"},"observation_digest":"sha256:2445fc35ceb850ad716fda90add1d4845ff8fb56d4cdd4df004e8ada7d1650e4","observation_id":"ba1ae0eb-8755-4317-8800-e76e3826fd45","resolution":{"observed_at":"2026-08-02T12:13:46.679613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2606.18164","last_updated":"2026-06-16T17:01:57Z","snapshot_observed_at":"2026-07-30T03:30:31.097644Z","submitted_at":"2026-06-16T17:01:57Z","title":"Learning Dynamics of Chain-of-Thought State Tracking in a Solvable Transformer Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T21:49:03.896740Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.18164"},"observation_digest":"sha256:cc290fcd75b048963fabdbdb07db0c815282c4c38f52d052b36afda80ef5d2be","observation_id":"8f7991e6-4252-4f1a-af20-46b88b5b547c","resolution":{"observed_at":"2026-07-03T23:39:05.180523Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2606.20347","last_updated":"2026-06-18T15:15:57Z","snapshot_observed_at":"2026-08-03T19:01:38.303561Z","submitted_at":"2026-06-18T15:15:57Z","title":"Critical Percolation as a Synthetic Data Model for Interpretability","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-26T17:41:29.317167Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.20347"},"observation_digest":"sha256:a29764f0eb99945a29addbe98e0f1f6c2d4abba6141337b3ebfc58bd1e276606","observation_id":"0a001962-c6cb-4676-a358-1d41f1b3e69c","resolution":{"observed_at":"2026-07-04T03:49:29.695396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2606.25008","last_updated":"2026-06-23T17:46:30Z","snapshot_observed_at":"2026-07-31T03:01:22.674756Z","submitted_at":"2026-06-23T17:46:30Z","title":"Neural Scaling Universality: If Exponents Are Fixed, Time to Understand Coefficients","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-25T23:45:54.283436Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.25008"},"observation_digest":"sha256:b057bfcebca9f3cbf17421fd23e90c9b0bcad3cf6f448ac3f88006fdc858e58c","observation_id":"c8c4096d-4fe0-44eb-ae14-2a4c644aca69","resolution":{"observed_at":"2026-07-04T17:20:00.939107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2606.26617","last_updated":"2026-07-22T07:16:55Z","snapshot_observed_at":"2026-08-07T16:43:25.071694Z","submitted_at":"2026-06-25T05:20:21Z","title":"Sketched Linear Contrastive Learning: Approximation, Optimization, and Statistical Scaling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-26T05:36:30.686491Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.26617"},"observation_digest":"sha256:89f86125602e430ddcdf1726108ec67fcd3cadf86fca19b4d1119a1209f70ecb","observation_id":"74022b10-892a-4b42-be71-47966e8a1cbc","resolution":{"observed_at":"2026-07-04T12:59:52.807788Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2606.28242","last_updated":"2026-06-26T16:27:46Z","snapshot_observed_at":"2026-07-29T17:55:32.799595Z","submitted_at":"2026-06-26T16:27:46Z","title":"How Width and Data Shape Generalization Scaling Laws in Quadratic Neural Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T04:23:13.797023Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.28242"},"observation_digest":"sha256:c76e50f960ff5798b16410262c7e178a750b39b817f39a3ffdb4b9522d07c3e2","observation_id":"5f263e16-e6de-488a-a758-dbc2ea191c3a","resolution":{"observed_at":"2026-07-01T16:55:51.287189Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":"2210.16859","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-04T17:20:00.933699Z","title":"arXiv preprint arXiv:2210.16859 , year=","venue":null,"work_id":"2c562faf-6457-444e-9af0-8f248e7adef3","year":2022},"citing_paper":{"arxiv_id":"2606.29858","last_updated":"2026-07-10T15:59:05Z","snapshot_observed_at":"2026-07-15T23:18:26.051643Z","submitted_at":"2026-06-29T06:53:30Z","title":"Smooth Scaling Laws Hide Stepwise Token Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T06:08:22.652557Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.29858"},"observation_digest":"sha256:51452d80918c8f2aae1054032dc4c9d8179aed2087ea49d5074df9f4153bc2bf","observation_id":"d6b6d756-f7c7-4d20-959b-7c76bd133b01","resolution":{"observed_at":"2026-06-30T08:14:26.563121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.16859","snapshot_observed_at":"2026-07-13T07:15:03.029543Z","title":"Roberts, and James Sully","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.29858","last_updated":"2026-07-10T15:59:05Z","snapshot_observed_at":"2026-07-15T23:18:26.051643Z","submitted_at":"2026-06-29T06:53:30Z","title":"Smooth Scaling Laws Hide Stepwise Token Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T07:15:03.029543Z"},"links":{"cited_paper":"/paper/2210.16859","citing_paper":"/paper/2606.29858"},"observation_digest":"sha256:41054d03415652d33c69b1e28c847003096c357374d2b548ce5ea4ff60b6dabb","observation_id":"e9147c95-3363-4ae1-b99e-a08da0610c7e","resolution":{"observed_at":"2026-07-13T07:15:03.029543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2210.16859/citation-record","integrity":"/paper/2210.16859/integrity","json":"/paper/2210.16859/citation-record.json","paper":"/paper/2210.16859"},"outbound":[],"paper":{"arxiv_id":"2210.16859","last_updated":"2022-10-30T15:13:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T14:12:14.561840Z","submitted_at":"2022-10-30T15:13:18Z","title":"A Solvable Model of Neural Scaling Laws"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 34 inbound Pith citation observations for arXiv:2210.16859."}