{"as_of":"2026-08-18T14:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6d0a814f34dc013b7dcd0e1900fd1f5fb247e72d3ca528c3510e300289d6e255","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:32:36.905620Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T20:17:34.317147Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T20:37:22.852589Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"cited_work":{"arxiv_id":"2504.12585","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.12585","snapshot_observed_at":"2026-07-02T20:37:22.852589Z","title":"arXiv preprint arXiv:2504.12585 , year=","venue":null,"work_id":"271f0536-d79e-45e0-8a7f-6c3418c4a123","year":2025},"citing_paper":{"arxiv_id":"2605.12264","last_updated":"2026-05-12T15:29:33Z","snapshot_observed_at":"2026-08-12T12:37:52.421853Z","submitted_at":"2026-05-12T15:29:33Z","title":"Reconstruction of Personally Identifiable Information from Supervised Finetuned Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-13T04:15:22.283354Z"},"links":{"cited_paper":"/paper/2504.12585","citing_paper":"/paper/2605.12264"},"observation_digest":"sha256:be7c9bee383c7d5b1405457f76f70ca7963377960987709059e41d24b21584a9","observation_id":"8d1efa8e-dbb1-4243-a885-542f369aa2e6","resolution":{"observed_at":"2026-05-13T04:17:13.814261Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"cited_work":{"arxiv_id":"2504.12585","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.12585","snapshot_observed_at":"2026-07-02T20:37:22.852589Z","title":"arXiv preprint arXiv:2504.12585 , year=","venue":null,"work_id":"271f0536-d79e-45e0-8a7f-6c3418c4a123","year":2025},"citing_paper":{"arxiv_id":"2606.07951","last_updated":"2026-06-06T02:53:31Z","snapshot_observed_at":"2026-08-16T22:09:55.873292Z","submitted_at":"2026-06-06T02:53:31Z","title":"From `May' to `Is': Certainty Distortion in Language Model Rewriting","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T20:17:34.317147Z"},"links":{"cited_paper":"/paper/2504.12585","citing_paper":"/paper/2606.07951"},"observation_digest":"sha256:12d59714ebefc5db91333e359852fbaba1253075589d245dd65789d949b654d1","observation_id":"0c97e053-f821-4713-902d-b4ac4ea3fe8f","resolution":{"observed_at":"2026-07-02T20:37:22.854126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.12585/citation-record","integrity":"/paper/2504.12585/integrity","json":"/paper/2504.12585/citation-record.json","paper":"/paper/2504.12585"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-16T12:32:36.770107Z","title":"Sparks of artificial general intelligence: Early experiments with GPT-4","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.770107Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:91ec32df7e6f6ce9a6a0deb0f73233d23ecf73a28a8e12b5e1e98b6f33370468","observation_id":"92dcb18c-980d-4b19-87bf-a7cf3bb5bc8c","resolution":{"observed_at":"2026-08-16T12:32:36.770107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.249078Z","title":"All experiments are trained for 50 epochs, use learning-rate = 10−4, weight-decay = 0.01, 14 Preprint","venue":null,"work_id":"955e8b7c-86f7-425e-ad5e-c7746f3b7914","year":2024},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.905620Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:0f73661f7966d0df029327b92266b02b899b584c1691f872c07c31e909dbf96b","observation_id":"be39e095-8b47-41d4-8dd4-eb99bd389769","resolution":{"observed_at":"2026-08-16T12:32:37.256036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02536","last_updated":"2024-02-21T23:23:18Z","snapshot_observed_at":"2026-08-16T15:50:46.428395Z","submitted_at":"2023-03-05T00:57:49Z","title":"Finding Alignments Between Interpretable Causal Variables and Distributed Neural Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.02536","snapshot_observed_at":"2026-08-16T12:32:36.785476Z","title":"Icard, and Noah D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.785476Z"},"links":{"cited_paper":"/paper/2303.02536","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:b110f6395bee5e27dfa9ca5129fb647feb42553b358e1842e68762e1b42bf530","observation_id":"11ac7f8a-d936-4d62-9859-6d8e98dfdabb","resolution":{"observed_at":"2026-08-16T12:32:36.785476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.363138Z","title":"Under review","venue":null,"work_id":"237ae650-af2a-4317-951c-df0ce188c2ae","year":2018},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.790494Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:1e25b18692e2bd706bc50614825418430dbe14a1b32a97bc5e9d3f9047047648","observation_id":"e22fa075-9e2b-4d28-8cc0-de4dea2cc79e","resolution":{"observed_at":"2026-08-16T12:32:37.367844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12181","last_updated":"2024-01-22T18:11:01Z","snapshot_observed_at":"2026-08-17T00:42:01.760807Z","submitted_at":"2024-01-22T18:11:01Z","title":"Universal Neurons in GPT2 Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12181","snapshot_observed_at":"2026-08-16T12:32:36.800225Z","title":"Universal neurons in gpt2 language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.800225Z"},"links":{"cited_paper":"/paper/2401.12181","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:d99f28abe587c8504ed0bb00725d055ef04e2bbe208075e73112304cd43d7f90","observation_id":"29d081c7-3e59-4c9f-ab14-525ca45fc9bb","resolution":{"observed_at":"2026-08-16T12:32:36.800225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.346990Z","title":"Designing and interpreting probes with control tasks","venue":null,"work_id":"193fc455-6522-49ec-82d4-62b5587b6f36","year":2019},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.804946Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:4cce1be13acf87d323201e69358d965af124d03c82ae15d18aa4bcdde4fe6e57","observation_id":"0784b515-7eaa-4e75-ae59-1354972c0717","resolution":{"observed_at":"2026-08-16T12:32:37.352783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10811","last_updated":"2024-06-17T11:06:57Z","snapshot_observed_at":"2026-08-16T14:17:55.700999Z","submitted_at":"2024-02-16T16:35:35Z","title":"Quantifying the Persona Effect in LLM Simulations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10811","snapshot_observed_at":"2026-08-16T12:32:36.814843Z","title":"Quantifying the persona effect in llm simulations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.814843Z"},"links":{"cited_paper":"/paper/2402.10811","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:3f1a216d5dc27bd2ba54a3a3623da964ce903a0069e9a499d7d8d6703867914c","observation_id":"cfb7f09b-297e-4351-99ff-64f39b21df6a","resolution":{"observed_at":"2026-08-16T12:32:36.814843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-16T12:32:36.819707Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.819707Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:1baabea078637f76189c141b48ffba0e3dd55dab55b94f3251b6ac802699861d","observation_id":"cd4c451c-3769-4f7d-834d-50ba5cc381dc","resolution":{"observed_at":"2026-08-16T12:32:36.819707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.329340Z","title":"VISIT: Visualizing and interpreting the semantic information flow of transformers","venue":null,"work_id":"8a3b6f2f-aac8-4e37-a3c3-275eca61cc70","year":2023},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.824560Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:05fad764300dbcc62621fef4ddb9287bb7c02eaf8278832fbf9d340cf060adf6","observation_id":"a2ff0326-c10e-43be-b2f8-65bf70dde977","resolution":{"observed_at":"2026-08-16T12:32:37.335976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:36.829259Z","title":"doi: 10.18653/v1/2023.findings-emnlp.939","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.829259Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:8e773c8e6bf35904131d1b1e4a42c2ba701a91087ca764a0b4bfe17a32de04d8","observation_id":"c48ff341-7a4b-447d-98a5-0da77beb9bad","resolution":{"observed_at":"2026-08-16T12:32:36.829259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:36.834660Z","title":"doi: 10.18653/v1/2022.acl-long.229","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.834660Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:f89b6dc0530f9b9994a45f5ee85cb414c99b0c8f711af401caeb141b99a72233","observation_id":"e1ef8b32-0103-4a32-bb5a-3a003c7ad77b","resolution":{"observed_at":"2026-08-16T12:32:36.834660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:36.840300Z","title":"doi: 10.18653/v1/2022.acl-long.464","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.840300Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:722589c173621a13e5e813cc592f798be4c621e2c92015ddbd66c35cfe89e564","observation_id":"de3f9c77-703f-41cb-9519-1f6816f33f4f","resolution":{"observed_at":"2026-08-16T12:32:36.840300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01687","last_updated":"2024-10-04T01:01:39Z","snapshot_observed_at":"2026-08-16T13:38:00.506038Z","submitted_at":"2024-07-01T18:01:07Z","title":"Deciphering the Factors Influencing the Efficacy of Chain-of-Thought: Probability, Memorization, and Noisy Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01687","snapshot_observed_at":"2026-08-16T12:32:36.850130Z","title":"Griffiths, and R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.850130Z"},"links":{"cited_paper":"/paper/2407.01687","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:a5d0113b4c1315b0df7297923076e4e12883c39d4bfad06fb93cdadb436784ad","observation_id":"cb78573e-757c-421e-9012-f6ef4a68e1ae","resolution":{"observed_at":"2026-08-16T12:32:36.850130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.313330Z","title":"Impact of pre- training term frequencies on few-shot numerical reasoning","venue":null,"work_id":"fd1cb36f-884e-4bcb-859f-6c7086923cf5","year":2022},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.854466Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:9e0d28a980b535cdbdb761352ef351ad07fc4d140d2cfffc4b76257e819c6544","observation_id":"a0465803-56a3-4b9e-aff8-9e754a4cfba5","resolution":{"observed_at":"2026-08-16T12:32:37.318248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-15T08:04:06.283165Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-16T12:32:36.858792Z","title":"doi: 10.18653/v1/2022.findings-emnlp.59","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.858792Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:31c145fcfd2a3116fc9764e336baa1b19103855804085e88f44a7dd0a8bff76c","observation_id":"1f3eea69-ebaa-467f-a78f-e5e394726471","resolution":{"observed_at":"2026-08-16T12:32:36.858792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03729","last_updated":"2024-04-01T20:56:11Z","snapshot_observed_at":"2026-08-18T10:21:42.337304Z","submitted_at":"2024-01-08T08:28:08Z","title":"The Butterfly Effect of Altering Prompts: How Small Changes and Jailbreaks Affect Large Language Model Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03729","snapshot_observed_at":"2026-08-16T12:32:36.863642Z","title":"The butterfly effect of altering prompts: How small changes and jailbreaks affect large language model performance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.863642Z"},"links":{"cited_paper":"/paper/2401.03729","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:9c8cb0bf1b5b7556848bab9e51c962ca39408e7eedbad3e1f062a1a3d0d2ca91","observation_id":"03dbe367-2f0d-4faf-b97d-0be9f20dd802","resolution":{"observed_at":"2026-08-16T12:32:36.863642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.297777Z","title":"Just ask for calibration: Strategies for eliciting calibrated confidence scores from language models fine-tuned with human feedback","venue":null,"work_id":"12d49855-0c5f-454f-a1ac-dbeae585c4cb","year":2023},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.873398Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:b24ac9b67fac7ad2d1eea8174684eb6267dd5ac322ab121cd6fdd05c52a9cf4a","observation_id":"0641e8ff-dd4b-4954-8876-a035258a17d3","resolution":{"observed_at":"2026-08-16T12:32:37.303022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:36.877990Z","title":"doi: 10.18653/v1/2023.emnlp-main.330","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.877990Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:ad96a5152e41f3037f12a7edee351a428e1a506042f00c74b771e921c426d05d","observation_id":"92ca9151-8908-489e-acb1-53bfcc52e8b6","resolution":{"observed_at":"2026-08-16T12:32:36.877990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-08-13T07:04:41.220509Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-16T12:32:36.886776Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.886776Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:d9d9aaf06ebde18c606d259293731bff99587d28bbaf27816c80534443e6f8bc","observation_id":"f64cb460-b03d-4e31-bc85-9775b9fe09a2","resolution":{"observed_at":"2026-08-16T12:32:36.886776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03592","last_updated":"2024-05-22T17:52:31Z","snapshot_observed_at":"2026-08-16T14:03:33.898248Z","submitted_at":"2024-04-04T17:00:37Z","title":"ReFT: Representation Finetuning for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.03592","snapshot_observed_at":"2026-08-16T12:32:36.891309Z","title":"Reasoning or reciting? exploring the capabilities and limitations of language models through counterfactual tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.891309Z"},"links":{"cited_paper":"/paper/2404.03592","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:5aec7d2f71bd7d20117c327c342620bfc7ed0edd30251e44de08735839a5dc44","observation_id":"aecb7813-f8e1-4d43-b0ef-6b2164369a57","resolution":{"observed_at":"2026-08-16T12:32:36.891309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.282421Z","title":"Under review","venue":null,"work_id":"5befb201-66d2-442c-b1b0-8e3e29571519","year":2025},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.895916Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:ee699e2f7ad40cabe0410e5190549b976c341f8d879084a6b5924f38372a66cb","observation_id":"0353d7c9-4ae9-4d76-98cc-7dae54684689","resolution":{"observed_at":"2026-08-16T12:32:37.287179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:37.267127Z","title":"A.2 Ablating the unigram prior direction Past work has shown that LLMs have mechanisms for handling uncertainty (Stolfo et al., 2024)","venue":null,"work_id":"c6365a7f-1175-47d3-bcba-988dc62abf7e","year":2024},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.900832Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:41c291510e76358a6de45d767c42d46400473a7cb7f9ff2b98007e15ce850b64","observation_id":"2f986fc5-c07e-411b-a78b-7c436acf9cac","resolution":{"observed_at":"2026-08-16T12:32:37.272346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07461","last_updated":"2024-09-14T03:14:09Z","snapshot_observed_at":"2026-08-16T14:01:53.014267Z","submitted_at":"2024-04-11T03:51:29Z","title":"An Audit on the Perspectives and Challenges of Hallucinations in NLP","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07461","snapshot_observed_at":"2026-08-16T12:32:36.881998Z","title":"An audit on the perspectives and challenges of hallucinations in nlp","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.881998Z"},"links":{"cited_paper":"/paper/2404.07461","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:b12eddef5357940ca392a1e7e304c21587df4568dcd2c2e6ecd0df0016be16ba","observation_id":"274252e6-9541-4218-952c-25376becb9c6","resolution":{"observed_at":"2026-08-16T12:32:36.881998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:36.794978Z","title":"doi: 10.18653/v1/W18-5426","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.794978Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:2a3711c5e886aa43e1c4cc313d35d3c9e554c909f551336a15b54c57c5a09556","observation_id":"5e2a6393-960c-40d3-8787-8084092e3fee","resolution":{"observed_at":"2026-08-16T12:32:36.794978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-17T18:04:53.578114Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-16T12:32:36.809948Z","title":"doi: 10.18653/v1/ D19-1275","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.809948Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:6ecccab586e84e184204a7a1c3360db9ddffc7cf1c6e3d991e32daff2752cf32","observation_id":"cccc9871-bb1b-4a82-95ca-ca213e317ffb","resolution":{"observed_at":"2026-08-16T12:32:36.809948Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:36.868500Z","title":"doi: 10.18653/v1/2020.blackboxnlp-1.23","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.868500Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:671020f021d1edd3e5d1269f8f1f2bc939feda2bbe0ce36d34eafd8d9ef6eb36","observation_id":"9d227404-b267-4eb5-8484-a57e1070c07c","resolution":{"observed_at":"2026-08-16T12:32:36.868500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-08-14T11:50:41.917778Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-08-16T12:32:36.758505Z","title":"Ostrovsky, Lev McKinney, Stella Biderman, and Jacob Steinhardt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.758505Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:4848775cc4dfa4e0ae1151c02ec887a86c12f8215ae5482d69433ce9399211fc","observation_id":"c503d734-a8e5-410a-b51c-38dd2849625b","resolution":{"observed_at":"2026-08-16T12:32:36.758505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:32:36.780788Z","title":"doi: 10.18653/v1/2022.acl-long.501","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.780788Z"},"links":{"citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:f0cd0412b406885817d9633abc9547d2c0b36f5e819f0704e6ba0ca2b4c577cd","observation_id":"6ec29da4-6119-49c2-9ea6-1f2af6b560b5","resolution":{"observed_at":"2026-08-16T12:32:36.780788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-16T12:32:36.764760Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.764760Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:1d37fc92475b5bdc729191a37ecc5bf24c572fad9d1a35409edba81207a7e9b6","observation_id":"49498473-e6cf-4690-b1c8-7bc634815c44","resolution":{"observed_at":"2026-08-16T12:32:36.764760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-08-16T13:37:26.527260Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-16T12:32:36.775309Z","title":"Sparse au- toencoders find highly interpretable features in language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.775309Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:4c6b8ef4203fe3ec94ed99ef91596a4e6223b453f43d692be132d19a958d3cc4","observation_id":"c64caa1e-794c-4bf3-81f0-95f1f11e7910","resolution":{"observed_at":"2026-08-16T12:32:36.775309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-08-16T08:54:56.543625Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-16T12:32:36.844903Z","title":"GSM-Symbolic: Understanding the limitations of mathematical reasoning in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-16T12:32:36.844903Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2504.12585"},"observation_digest":"sha256:ac29a315b0a412284d2afb4e8fd1c06d919ca061b5428fb582e308c5205b4859","observation_id":"4884e36b-3bc3-43d1-8c18-5357705d9d1b","resolution":{"observed_at":"2026-08-16T12:32:36.844903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.12585","last_updated":"2025-04-17T02:00:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T10:31:42.044859Z","submitted_at":"2025-04-17T02:00:53Z","title":"Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 2 inbound Pith citation observations for arXiv:2504.12585."}