{"as_of":"2026-08-08T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ea876ad46ea5f6a081291bb8206f58a8eeb5b859e44f65f5420822750a7852a","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:50:54.252154Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:12:02.029189Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T22:04:00.572602Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-08-06T14:12:02.029189Z","title":"A statistical physics of language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.19703","last_updated":"2025-07-30T07:58:56Z","snapshot_observed_at":"2026-08-06T14:12:01.325068Z","submitted_at":"2025-07-25T22:48:37Z","title":"The wall confronting large language models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:12:02.029189Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2507.19703"},"observation_digest":"sha256:259115f245a18c2a2456e87ffed14727f0da2e88df69b1ab63e33b56f28d2bba","observation_id":"cb34fdfe-81bf-4c22-bab9-05611277ea36","resolution":{"observed_at":"2026-08-06T14:12:02.029189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":"2506.04374","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-06-29T22:04:00.572602Z","title":"Carson and A","venue":null,"work_id":"bca7e922-849d-4061-8ce8-e5379f5b67da","year":2025},"citing_paper":{"arxiv_id":"2604.18464","last_updated":"2026-04-20T16:19:02Z","snapshot_observed_at":"2026-07-06T23:05:17.639285Z","submitted_at":"2026-04-20T16:19:02Z","title":"Semantic Step Prediction: Multi-Step Latent Forecasting in LLM Reasoning Trajectories via Step Sampling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T06:06:49.805066Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2604.18464"},"observation_digest":"sha256:7eb7c74b26d10ad2f7ef23d3c3a8f0329f93e3ca22f9ef7616d75c68805f56b8","observation_id":"7b4d4f39-60cd-4177-b72d-2d66b6201c3a","resolution":{"observed_at":"2026-05-10T06:11:20.492711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":"2506.04374","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-06-29T22:04:00.572602Z","title":"Carson and A","venue":null,"work_id":"bca7e922-849d-4061-8ce8-e5379f5b67da","year":2025},"citing_paper":{"arxiv_id":"2606.07559","last_updated":"2026-07-18T19:19:00Z","snapshot_observed_at":"2026-08-02T13:16:35.534776Z","submitted_at":"2026-05-25T10:44:42Z","title":"Phantom Transitions in Language Model Fine-Tuning: A Density-Matrix Analysis","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-29T21:54:30.991573Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2606.07559"},"observation_digest":"sha256:a4aa3414dc6ef098aba2e60f538a74bc23c2d1eed9c3725754c417925e83c641","observation_id":"b9161e76-0153-47dc-8365-de53eb1a9ec6","resolution":{"observed_at":"2026-06-29T22:04:00.574224Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04374","snapshot_observed_at":"2026-08-02T13:16:37.673532Z","title":"A statistical physics of language model reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07559","last_updated":"2026-07-18T19:19:00Z","snapshot_observed_at":"2026-08-02T13:16:35.534776Z","submitted_at":"2026-05-25T10:44:42Z","title":"Phantom Transitions in Language Model Fine-Tuning: A Density-Matrix Analysis","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T13:16:37.673532Z"},"links":{"cited_paper":"/paper/2506.04374","citing_paper":"/paper/2606.07559"},"observation_digest":"sha256:bc7ffd8e1e354db2092c269877283518f89341b10092116ef6410cb9f60c9f2a","observation_id":"ce70dd7e-be5a-44a5-bb67-2944beeb60da","resolution":{"observed_at":"2026-08-02T13:16:37.673532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04374/citation-record","integrity":"/paper/2506.04374/integrity","json":"/paper/2506.04374/citation-record.json","paper":"/paper/2506.04374"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.000524Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.000524Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:ec177517fb639b0ef2f2ed20f65541f7921e95753fe745800a8a595c0f74b6a7","observation_id":"41d2fb2e-a6e1-47c7-879a-27322d6ac4f7","resolution":{"observed_at":"2026-08-07T10:50:54.000524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T10:50:54.009552Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.009552Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:5dd6e7cbc3f17a1215e7e49635492a979ab440261dc464ddc38f41fa13ae9434","observation_id":"dbe64074-d129-4f06-8c87-3e923c209807","resolution":{"observed_at":"2026-08-07T10:50:54.009552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13673","last_updated":"2025-05-19T11:12:27Z","snapshot_observed_at":"2026-07-06T15:31:05.250637Z","submitted_at":"2023-05-23T04:28:16Z","title":"Physics of Language Models: Part 1, Learning Hierarchical Language Structures","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13673","snapshot_observed_at":"2026-08-07T10:50:54.016634Z","title":"Physics of language models: Part 1, learning hierarchical language structures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.016634Z"},"links":{"cited_paper":"/paper/2305.13673","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:c05b2aecb0a4936edeffed684ad6949644271d8e84af8ae45610e3aa40ed8087","observation_id":"3eee5651-e97b-4df9-9dc3-1e8d810da519","resolution":{"observed_at":"2026-08-07T10:50:54.016634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T10:50:54.023714Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.023714Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:8445cfba6b86542a578a9f1066098ef958feace66de72deece9b1e0806c64293","observation_id":"2ea8cd50-a7b1-4a74-9d8d-3e61e5850a18","resolution":{"observed_at":"2026-08-07T10:50:54.023714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11641","last_updated":"2019-11-26T15:31:46Z","snapshot_observed_at":"2026-08-08T00:48:01.603669Z","submitted_at":"2019-11-26T15:31:46Z","title":"PIQA: Reasoning about Physical Commonsense in Natural Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11641","snapshot_observed_at":"2026-08-07T10:50:54.031563Z","title":"PIQA : Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.031563Z"},"links":{"cited_paper":"/paper/1911.11641","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:144cbed9fe1aa4c58bc3409e7db4aa77937f27ae5b1a7e1b055837c97c5e27e6","observation_id":"b6756eb6-b362-4847-82ad-8f709e2c0e15","resolution":{"observed_at":"2026-08-07T10:50:54.031563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.977305Z","title":"Language models are few-shot learners","venue":null,"work_id":"e720fa51-d8ea-4b3b-a58c-9d1a8a06caa6","year":1901},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.038393Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:a6c1ff2a088e9e37a0a238adfaa429edf6740b1e1d31ed33fda548876fb1687c","observation_id":"ad646ed8-29dd-4694-bdc8-2b765aea35de","resolution":{"observed_at":"2026-08-07T10:50:54.984027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.044654Z","title":"Computational principles of memory","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.044654Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:6d4937485ab3629967ac7745af0987f3b999e7b3159bd2d15126557967fe2a6b","observation_id":"f4bf926a-8808-4193-8f73-7bbd6a6fc776","resolution":{"observed_at":"2026-08-07T10:50:54.044654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.051673Z","title":"B ool Q : Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.051673Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:200ee1cc9a1bd299b1efdacf2ae06a11708fe2e04581b627dac3bb236ff8e01a","observation_id":"1fc5574d-f462-473c-9935-eb88fdd96ec4","resolution":{"observed_at":"2026-08-07T10:50:54.051673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T10:50:54.057619Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.057619Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:059000f3475e97b1077c45aa040d37e5dbc9deec4e1d3c958764944aa3a029ad","observation_id":"ff18284e-300e-4ed2-b8da-ace4802c8d9d","resolution":{"observed_at":"2026-08-07T10:50:54.057619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.063449Z","title":"The rotation of eigenvectors by a perturbation","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.063449Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:9fe1d0a1698911252c78348f57ea573b6fb93bac86a30a3e4e4488d4a75be12b","observation_id":"96ac5b62-cdcd-4d0d-9dc7-5bd4b3805782","resolution":{"observed_at":"2026-08-07T10:50:54.063449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-07T10:50:54.069960Z","title":"DeepSeek LLM : Scaling open-source language models with longtermism","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.069960Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:6e572b64fc1839e26a1f7a137bab5da404af9e3d5fc3bf3f3bf3d5f04320ab74","observation_id":"99a03c65-33d5-40c6-b0a5-1b47a6b462a6","resolution":{"observed_at":"2026-08-07T10:50:54.069960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.077006Z","title":"Maximum likelihood from incomplete data via the EM algorithm","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.077006Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:b24ce79f29f292f48e09397d9663339198eefb4a53306278f2bc4b20f87add72","observation_id":"4614e809-2fc7-4f57-9929-ed222df58631","resolution":{"observed_at":"2026-08-07T10:50:54.077006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.959943Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":"77d16908-7bd2-42f1-a2c9-f3cebeec4bef","year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.083055Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:54cbd9f49cb14965ff76636ce7cb1355fd72f87ea302dabece36bc2ebdccc4a5","observation_id":"04b2d0e7-d5bf-41b6-b030-6cf49d4b4fb2","resolution":{"observed_at":"2026-08-07T10:50:54.965521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T10:50:54.088711Z","title":"Gemma: Open models based on gemini research and technology","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.088711Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:181b5b471f1bc8054512ea42ccefac4fbbdd758d25bc536509c9b080d3049298","observation_id":"f7fccd80-3790-4d98-a2e6-28f5475d3fbd","resolution":{"observed_at":"2026-08-07T10:50:54.088711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.094716Z","title":"Did A ristotle use a laptop? A question answering benchmark with implicit reasoning strategies","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.094716Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:30e9559ae3c9cec3137ee285b3800c03ebca5966785782abeaea5df26b4e4772","observation_id":"19544e3c-a527-442d-b994-300555438ce1","resolution":{"observed_at":"2026-08-07T10:50:54.094716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.101932Z","title":"Variational learning for switching state-space models","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.101932Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:05bf360b09b3efa254a3dce152dd2664798ffb7dbfa17ea7807415b29129998d","observation_id":"b22568c9-1c05-41ad-a723-c0ffe29a9410","resolution":{"observed_at":"2026-08-07T10:50:54.101932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.108154Z","title":"Note on the derivatives with respect to a parameter of the solutions of a system of differential equations","venue":null,"work_id":null,"year":1919},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.108154Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:cf4ddcc58d18501fa566f0442059691a4bd817c794637708c3f3be9c56e47b44","observation_id":"04fc1318-2b4e-4d18-8b0b-f20c5d3eae5f","resolution":{"observed_at":"2026-08-07T10:50:54.108154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.942295Z","title":"A new approach to the economic analysis of nonstationary time series and the business cycle","venue":null,"work_id":"ea39f761-172d-43fd-b842-7c86484774a3","year":1989},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.114907Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:66f56f4b3b5709c310ca5da94b4c5f51f011a6f6a9e766d125cee751aef8d71b","observation_id":"7212d7cc-02fd-4f8d-9d61-3872ea39d8ac","resolution":{"observed_at":"2026-08-07T10:50:54.948243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.121006Z","title":"Ridge regression: Biased estimation for nonorthogonal problems","venue":null,"work_id":null,"year":1970},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.121006Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:c62958acb4298e2d5d6eaf9295285289e71420d5d2701774b8549410c15da839","observation_id":"a7de34f1-32ec-4c75-9626-8efefaf3d0ad","resolution":{"observed_at":"2026-08-07T10:50:54.121006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T10:50:54.127341Z","title":"Mistral 7b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.127341Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:2a1b492496dd2616bfa0b3efee03fc1264f76a4757c2d48d13bc4dab7931966a","observation_id":"b338ff0e-75f0-4b85-9d1b-08fca85f5d44","resolution":{"observed_at":"2026-08-07T10:50:54.127341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.135171Z","title":"Principal Component Analysis","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.135171Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:9f891500cf5000a0877e05c48216080fb5cfdd526f7cc7e193c139cdfdabee06","observation_id":"14ac315b-453d-4a76-8b91-c4a84c4ee2e5","resolution":{"observed_at":"2026-08-07T10:50:54.135171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.920518Z","title":"Emergent world representations: Exploring a sequence model trained on a synthetic task","venue":null,"work_id":"8dba7fb6-4d04-4c8f-bc44-2c812cc943e1","year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.141571Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:2c9a9d60b60b061a3cf7bfecb846cab14f0805c87acbd2bd32ccd29155b3e5ec","observation_id":"fc54f6e5-1019-44ea-b2ea-9aa2c362cc3a","resolution":{"observed_at":"2026-08-07T10:50:54.927809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.149002Z","title":"T ruthful QA : Measuring how models mimic human falsehoods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.149002Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:54c4944f0b6feca8390c1808b9a13dab61160872028aa7531e939cc695c4e63b","observation_id":"3f659613-6d9f-4e04-9584-453567f223d9","resolution":{"observed_at":"2026-08-07T10:50:54.149002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08001","last_updated":"2024-04-08T07:37:31Z","snapshot_observed_at":"2026-07-06T17:59:00.124173Z","submitted_at":"2024-04-08T07:37:31Z","title":"Xiwu: A Basis Flexible and Learnable LLM for High Energy Physics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08001","snapshot_observed_at":"2026-08-07T10:50:54.156219Z","title":"Linguistic interpretability of transformer-based language models: A systematic review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.156219Z"},"links":{"cited_paper":"/paper/2404.08001","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:28b9e6400b933c87dc329f536209d1f2e54588feb7c90c984625df6dc101443e","observation_id":"1b578b2d-d39f-4fb5-ba82-190995151895","resolution":{"observed_at":"2026-08-07T10:50:54.156219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.162855Z","title":"Can a suit of armor conduct electricity? A new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.162855Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:6201f8901ea92eb915318983cc447a7161405068ece4e4ee17de1635c99ddf9a","observation_id":"abd62857-16bd-4bd2-911e-993031b6e5e2","resolution":{"observed_at":"2026-08-07T10:50:54.162855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00941","last_updated":"2023-09-07T20:36:48Z","snapshot_observed_at":"2026-07-06T16:13:34.788427Z","submitted_at":"2023-09-02T13:37:34Z","title":"Emergent Linear Representations in World Models of Self-Supervised Sequence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00941","snapshot_observed_at":"2026-08-07T10:50:54.169589Z","title":"Emergent linear representations in world models of self-supervised sequence models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.169589Z"},"links":{"cited_paper":"/paper/2309.00941","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:14c36f3ff23dc11a6e8c5d5ba116409b0023142dc998ca9475f90d871059fbad","observation_id":"740cb4f6-0837-459f-8fa0-a3c2cf3d6896","resolution":{"observed_at":"2026-08-07T10:50:54.169589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.901441Z","title":"Stochastic Differential Equations: An Introduction with Applications","venue":null,"work_id":"dc354c4e-2803-4fe1-b1cd-d882c01a824a","year":2003},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.176571Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:f8059d5efdbbcd2dab2aef5298eaed43865ea1effe03167dd368af4822b1e9c6","observation_id":"5b077623-4249-4d22-9fd8-f8387d348f3c","resolution":{"observed_at":"2026-08-07T10:50:54.908578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-07T10:50:54.183246Z","title":"In-context learning and induction heads","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.183246Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:984b7479dc66c1241ed568a7ff3e5f9862162405a3a4e64ba7757102211dc743","observation_id":"5cac4c0d-fe73-44bc-8099-7dd1b1c0f1b8","resolution":{"observed_at":"2026-08-07T10:50:54.183246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.883551Z","title":"A tutorial on hidden markov models and selected applications in speech recognition","venue":null,"work_id":"88cf6136-95a3-472c-a1df-77ba6b4392ce","year":1989},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.187908Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:33ebea7c3b972101a24e64eb13d73ec581e6efca11ed97ace85a96390e27b94f","observation_id":"3c35130a-41a2-4f2c-afb0-bad9a21ccc75","resolution":{"observed_at":"2026-08-07T10:50:54.889631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.865764Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"b7e05c2b-f56b-49f6-857b-775e8ed0773c","year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.193352Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:aaeb6c5f9c84cf81bd6bf3cfb8c746ab092e73826f4654b79c009b61aff4fe0a","observation_id":"1f9716f9-a6f7-4903-a6e3-b0e9d80c21c1","resolution":{"observed_at":"2026-08-07T10:50:54.870858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-61530-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.320707Z","title":"The Fokker-Planck Equation: Methods of Solution and Applications , volume 18 of Springer Series in Synergetics","venue":null,"work_id":"dd815be9-5d5b-4333-964a-8bae76cd60d6","year":1989},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.200463Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:18fdb2d79f0bbabe493e9bed87bb1c8f6e5223c3e91734635cfa634ff141b292","observation_id":"e37ca0ce-c5d3-49ae-ad1c-cbe891143ffe","resolution":{"observed_at":"2026-08-07T10:50:54.329744Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.205766Z","title":"Optimal sequence memory in driven random networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.205766Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:a498195e6fcf937446cc69628b7cc3805b69797c923dea2fd2e0b242f705f171","observation_id":"2ae1510a-b18e-40e3-9cf6-6c77df26fb9b","resolution":{"observed_at":"2026-08-07T10:50:54.205766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.211795Z","title":"C ommonsense QA : A question answering challenge targeting commonsense knowledge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.211795Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:44ab1d86a0007924d2bfba57255f4306ea770ea43019b25f45df506d3abbf890","observation_id":"4f59e42b-5357-403a-9a9e-04b38a02f705","resolution":{"observed_at":"2026-08-07T10:50:54.211795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05320","last_updated":"2022-01-14T06:49:15Z","snapshot_observed_at":"2026-07-06T12:27:19.431793Z","submitted_at":"2022-01-14T06:49:15Z","title":"CommonsenseQA 2.0: Exposing the Limits of AI through Gamification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.05320","snapshot_observed_at":"2026-08-07T10:50:54.218307Z","title":"C ommonsense QA 2.0: Exposing the limits of AI through gamification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.218307Z"},"links":{"cited_paper":"/paper/2201.05320","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:e5ca84f88060fd11ead0a2b807b17fbab487f9d5d04cda0a66fede7a504d741f","observation_id":"91ee295a-9d23-4090-bf35-bc0cc37b6b13","resolution":{"observed_at":"2026-08-07T10:50:54.218307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T10:50:54.224781Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.224781Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:1a42ea049f36f6b74ed2a71ccd358f82db90663290aa87def8852e8887631141","observation_id":"d3181f48-78d3-4fe9-8eb7-8f20c45eff53","resolution":{"observed_at":"2026-08-07T10:50:54.224781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.843899Z","title":"Attention is all you need","venue":null,"work_id":"7290c4a6-0359-4b2d-8bea-8730d7a8b69d","year":2017},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.233299Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:70d12d15973adda44c4eb4ec01ba1292830320dceeb586acb6aedd27d853d8b8","observation_id":"1988d3ee-b90c-4584-bb52-87a7f01ac4ce","resolution":{"observed_at":"2026-08-07T10:50:54.851812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10001","last_updated":"2023-06-01T05:38:00Z","snapshot_observed_at":"2026-08-07T18:44:16.941060Z","submitted_at":"2022-12-20T05:20:54Z","title":"Towards Understanding Chain-of-Thought Prompting: An Empirical Study of What Matters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10001","snapshot_observed_at":"2026-08-07T10:50:54.238608Z","title":"Towards understanding chain-of-thought prompting: An empirical study of what matters","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.238608Z"},"links":{"cited_paper":"/paper/2212.10001","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:e9322919f066448ff23743f202d670f9f773b242a19f0e892c816b40fb3cc99f","observation_id":"b820f736-39c1-48c9-8252-0031a060102b","resolution":{"observed_at":"2026-08-07T10:50:54.238608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T10:50:54.245026Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.245026Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:180c735805dea2fd023dd9ec72a01592624f18314defd169bb75f444412578c5","observation_id":"e5f1a811-8ce9-4c62-837a-99b20aba19c8","resolution":{"observed_at":"2026-08-07T10:50:54.245026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:50:54.252154Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:50:54.252154Z"},"links":{"citing_paper":"/paper/2506.04374"},"observation_digest":"sha256:8a2d562bf4965d58a068e72c3c1f6dbdb6a0a4fdb844578e35c93de84f7348ff","observation_id":"654f070f-9d6c-426c-a158-56f2cfc17430","resolution":{"observed_at":"2026-08-07T10:50:54.252154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04374","last_updated":"2025-06-04T18:43:23Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T10:40:57.687090Z","submitted_at":"2025-06-04T18:43:23Z","title":"A Statistical Physics of Language Model Reasoning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 4 inbound Pith citation observations for arXiv:2506.04374."}