{"as_of":"2026-08-06T22:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39e1226a7efa31d3ff4afcf83d01a43ea5b4f1cb3032eb333b877608ba821765","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T20:34:08.207848Z","state":"measured"},{"denominator":140,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":140,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":96,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":96,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:31:08.741433Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":45,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2304.13734","last_updated":"2023-10-17T09:34:30Z","snapshot_observed_at":"2026-08-01T19:59:13.992395Z","submitted_at":"2023-04-26T02:49:38Z","title":"The Internal State of an LLM Knows When It's Lying","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-16T00:08:36.530560Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2304.13734"},"observation_digest":"sha256:c5de1bb1f0d9bca96b2737d0960f4170f6020704d9ced3c593e0ec70d0f352c3","observation_id":"972a7f42-7d52-416a-9f5e-4c1a96b903d4","resolution":{"observed_at":"2026-05-16T00:08:36.576016Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2311.05232","last_updated":"2024-11-19T12:42:45Z","snapshot_observed_at":"2026-07-06T16:45:07.733095Z","submitted_at":"2023-11-09T09:25:37Z","title":"A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T02:46:26.957539Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2311.05232"},"observation_digest":"sha256:af849afb411f4ec4eb9909e8dcf6fb3098cc9cfd83f47d3cc83419a699db6b46","observation_id":"a436c8ed-cd9c-44ce-ac8c-599dc9710c33","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2406.11717","last_updated":"2024-10-30T18:57:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T16:36:12Z","title":"Refusal in Language Models Is Mediated by a Single Direction","version":3},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-13T10:47:55.934081Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2406.11717"},"observation_digest":"sha256:05df6bd846058a9826ee80925962c314ab8f4a3658bfbeb7c8980184e55635b3","observation_id":"5a4a42f7-f3a3-4b76-a8e5-d13a63289cfc","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-05-17T12:04:10.210508Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2409.12917"},"observation_digest":"sha256:665225e78b2512354bfc328962d3789581388a3088b182e9a315fea09ac4cd2d","observation_id":"a856920c-44b4-4c1e-ac61-6f54e23e35f8","resolution":{"observed_at":"2026-05-17T12:04:10.676680Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2506.18852","last_updated":"2026-05-19T12:40:52Z","snapshot_observed_at":"2026-07-06T21:46:30.250293Z","submitted_at":"2025-06-23T17:13:30Z","title":"Mechanistic Interpretability Needs Philosophy","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T23:49:19.683025Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2506.18852"},"observation_digest":"sha256:8231a6d1457dfc0529e201c431545d4e7d1f42a6f075dcf8d90d7795ac0001f1","observation_id":"99afcef3-01b2-451f-82c4-4b463a8691ba","resolution":{"observed_at":"2026-05-21T23:50:47.353935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-06T19:31:08.741433Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05448","last_updated":"2025-07-07T20:02:57Z","snapshot_observed_at":"2026-08-06T19:23:48.255250Z","submitted_at":"2025-07-07T20:02:57Z","title":"On the Semantics of Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T19:31:08.741433Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2507.05448"},"observation_digest":"sha256:f7b4122a52c588bae24e89f74d35d39a73016bba57ce8ca838def61f9141d694","observation_id":"cc7703b0-aef2-4763-bd6a-6202f264716e","resolution":{"observed_at":"2026-08-06T19:31:08.741433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-06T16:39:34.368752Z","title":"arXiv:2212.03827","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-06T21:31:24.367640Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:34.368752Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:94c6252c712ce9c9c884a0557018efc8a681a2476b8d3c22ea37964b2dfc2210","observation_id":"4fd43903-ab84-4a90-8136-6b47cfd3699f","resolution":{"observed_at":"2026-08-06T16:39:34.368752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-06T15:14:16.689102Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21131","last_updated":"2025-07-22T11:23:18Z","snapshot_observed_at":"2026-08-06T15:06:26.666084Z","submitted_at":"2025-07-22T11:23:18Z","title":"NPO: Learning Alignment and Meta-Alignment through Structured Human Feedback","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:16.689102Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2507.21131"},"observation_digest":"sha256:270b9b01b091cb14049503c5deee50884caa93aca42f0ea1c8b999933a7f802b","observation_id":"8a1a899e-d56f-4157-9daa-0fef7608adf1","resolution":{"observed_at":"2026-08-06T15:14:16.689102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-06T11:03:16.510374Z","title":"Discovering latent knowledge in lan- guage models without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23167","last_updated":"2025-07-31T00:35:45Z","snapshot_observed_at":"2026-08-06T13:09:34.050342Z","submitted_at":"2025-07-31T00:35:45Z","title":"LENS: Learning Ensemble Confidence from Neural States for Multi-LLM Answer Integration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:03:16.510374Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2507.23167"},"observation_digest":"sha256:cdff4c6944c27362a10ed7f7e5d76d3a7e59dd42ac0ff995855f7685c15d4d5c","observation_id":"42cad935-733f-447c-b499-5832851180d8","resolution":{"observed_at":"2026-08-06T11:03:16.510374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-06T05:04:58.587323Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02312","last_updated":"2025-08-04T11:28:34Z","snapshot_observed_at":"2026-08-06T05:04:56.228391Z","submitted_at":"2025-08-04T11:28:34Z","title":"A Survey on Data Security in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:04:58.587323Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2508.02312"},"observation_digest":"sha256:2b68bd1aea085b3be806bc9bbd6ec11522e27ad275017313447ab214c6e51120","observation_id":"788a296d-7b76-4c98-8253-351e8993630b","resolution":{"observed_at":"2026-08-06T05:04:58.587323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T23:13:05.279845Z","title":"arXiv preprint arXiv:2212.03827 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05775","last_updated":"2026-07-27T20:50:40Z","snapshot_observed_at":"2026-08-05T23:12:57.691936Z","submitted_at":"2025-08-07T18:42:16Z","title":"Guardians and Offenders: A Survey on Harmful Content Generation and Safety Mitigation of LLM","version":3},"reference_index":224,"source":"arxiv_source","source_observed_at":"2026-08-05T23:13:05.279845Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2508.05775"},"observation_digest":"sha256:1d5a66d05f146d5488aa248ee300d537607b2571eccc47bda0bf33ceb8df1b46","observation_id":"208a2103-5324-43ae-af81-1de597b8beb4","resolution":{"observed_at":"2026-08-05T23:13:05.279845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T15:52:44.867137Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19432","last_updated":"2025-08-26T21:01:45Z","snapshot_observed_at":"2026-08-05T15:52:29.325697Z","submitted_at":"2025-08-26T21:01:45Z","title":"Quantized but Deceptive? A Multi-Dimensional Truthfulness Evaluation of Quantized LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:52:44.867137Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2508.19432"},"observation_digest":"sha256:7183b626f0db179d34e5997b06705d8b776199483d48bc68e188ae49803a6ece","observation_id":"34721bb2-9705-4205-8fb2-c98b1cc3fd4e","resolution":{"observed_at":"2026-08-05T15:52:44.867137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T14:47:11.367586Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20944","last_updated":"2025-08-28T16:04:39Z","snapshot_observed_at":"2026-08-05T14:46:56.612546Z","submitted_at":"2025-08-28T16:04:39Z","title":"STARE at the Structure: Steering ICL Exemplar Selection with Structural Alignment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T14:47:11.367586Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2508.20944"},"observation_digest":"sha256:7eb4a3b91ccb57f9e58e4c5d1b7b4a585a53bb5b03c3c29f5202b7a94ab14797","observation_id":"e0d35989-fd01-498f-bf30-5a86313d7fc2","resolution":{"observed_at":"2026-08-05T14:47:11.367586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T13:44:11.202844Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00371","last_updated":"2025-08-30T05:47:41Z","snapshot_observed_at":"2026-08-05T13:44:09.927751Z","submitted_at":"2025-08-30T05:47:41Z","title":"Two Causes, Not One: Rethinking Omission and Fabrication Hallucinations in MLLMs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T13:44:11.202844Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2509.00371"},"observation_digest":"sha256:9b345d86aa0f7554eca6501049476bd01c73a0e57c83f07eb1bd80e670af73da","observation_id":"d6239db5-d241-4e32-b4db-0f8ff4549ecf","resolution":{"observed_at":"2026-08-05T13:44:11.202844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T10:55:31.201012Z","title":"Burns, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03518","last_updated":"2025-09-03T17:59:45Z","snapshot_observed_at":"2026-08-05T10:55:25.765282Z","submitted_at":"2025-09-03T17:59:45Z","title":"Can LLMs Lie? Investigation beyond Hallucination","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:55:31.201012Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2509.03518"},"observation_digest":"sha256:32f49ddb0c85c95c677627fb15df4afe439a2fa47852ad2d30c9c57126b83785","observation_id":"db747075-a0cc-407d-971f-457774cc3c43","resolution":{"observed_at":"2026-08-05T10:55:31.201012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T10:18:02.808211Z","title":"Burns, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09700","last_updated":"2025-09-04T14:37:34Z","snapshot_observed_at":"2026-08-06T13:45:03.102383Z","submitted_at":"2025-09-04T14:37:34Z","title":"Cross-Layer Attention Probing for Fine-Grained Hallucination Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:18:02.808211Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2509.09700"},"observation_digest":"sha256:cae4994f23fa0f0e921d32a3c1b75b4420aaab302d82f083294aa812962a078e","observation_id":"0965d9b4-8212-4343-8f0a-c922e0bfc76c","resolution":{"observed_at":"2026-08-05T10:18:02.808211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-04T18:25:37.321564Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10004","last_updated":"2025-09-12T06:58:17Z","snapshot_observed_at":"2026-08-04T18:25:29.740099Z","submitted_at":"2025-09-12T06:58:17Z","title":"Unsupervised Hallucination Detection by Inspecting Reasoning Processes","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T18:25:37.321564Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2509.10004"},"observation_digest":"sha256:166f6009bbff1c4ce24b715d6d231cd786da9bc677de93356b1632bf00a2e426","observation_id":"737f2084-1b16-47e0-85e0-155f7b7506aa","resolution":{"observed_at":"2026-08-04T18:25:37.321564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-04T17:41:04.927879Z","title":"Colin Burns, Hattie Ye, Dan Klein, and Jacob Steinhardt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10753","last_updated":"2025-09-12T23:49:52Z","snapshot_observed_at":"2026-08-05T12:00:51.104778Z","submitted_at":"2025-09-12T23:49:52Z","title":"HalluField: Detecting LLM Hallucinations via Field-Theoretic Modeling","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-04T17:41:04.927879Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2509.10753"},"observation_digest":"sha256:dfcbfdb86c00b0f5a8102b06cf40c1c81849c50e6b79f066bc7cd2de6a8aeb4f","observation_id":"b92854d8-3d78-4b48-9f3d-f77b14696bae","resolution":{"observed_at":"2026-08-04T17:41:04.927879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-04T13:52:07.804961Z","title":"Discovering latent knowledge in language models without supervision.arXiv:2212.03827, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.24770","last_updated":"2026-07-27T11:18:04Z","snapshot_observed_at":"2026-08-04T21:27:21.169952Z","submitted_at":"2025-09-29T13:37:12Z","title":"Neural Message-Passing on Attention Graphs for Hallucination Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T13:52:07.804961Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2509.24770"},"observation_digest":"sha256:564c36ce5a6a16415a9e17824590d7c89c26a07d142665e1d221419031e781d9","observation_id":"b9f8d589-fb1d-421f-b447-01e879dbc9e5","resolution":{"observed_at":"2026-08-04T13:52:07.804961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-03T13:03:21.532835Z","title":"Discovering latent knowledge in language models without supervision.arXiv preprint arXiv:2212.03827,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.00791","last_updated":"2026-06-10T09:38:19Z","snapshot_observed_at":"2026-08-03T13:03:18.447936Z","submitted_at":"2026-01-02T18:49:37Z","title":"Geometry of Reason: Spectral Signatures of Valid Mathematical Reasoning","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-03T13:03:21.532835Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2601.00791"},"observation_digest":"sha256:71ad560f733927869dfc19964f9ddb406b3db899b099470408b1731ac678fc15","observation_id":"1d3ccaa2-bfbe-4d8b-b28e-3105ba86be42","resolution":{"observed_at":"2026-08-03T13:03:21.532835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-03T09:31:49.744774Z","title":"Samuel Marks and Max Tegmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.15334","last_updated":"2026-07-03T18:03:25Z","snapshot_observed_at":"2026-08-05T18:37:23.787188Z","submitted_at":"2026-01-20T08:28:02Z","title":"No Reliable Evidence of Self-Reported Sentience in Small Large Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T09:31:49.744774Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2601.15334"},"observation_digest":"sha256:b22a53a9201f289566371d0bcac885c2aa49c4d89c5d509e47570dce6f3bc27d","observation_id":"5b2de349-72c6-4f7b-ab80-61ce05f197a7","resolution":{"observed_at":"2026-08-03T09:31:49.744774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T21:43:07.066526Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.19313","last_updated":"2026-07-22T22:14:13Z","snapshot_observed_at":"2026-08-02T21:43:05.758047Z","submitted_at":"2026-02-22T19:25:48Z","title":"TOPReward: Token Probabilities as Hidden Zero-Shot Rewards for Robotics","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T21:43:07.066526Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2602.19313"},"observation_digest":"sha256:ccff1b62f8975b6987223ea4a20f924302065e25c0c84538e41b9c364f4bf387","observation_id":"fd69cf10-c629-4061-80ef-e2e15dd1ebc3","resolution":{"observed_at":"2026-08-02T21:43:07.066526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2602.20338","last_updated":"2026-05-08T02:14:05Z","snapshot_observed_at":"2026-07-06T22:46:49.536946Z","submitted_at":"2026-02-23T20:36:17Z","title":"Emergent Manifold Separability during Reasoning in Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T20:12:05.809065Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2602.20338"},"observation_digest":"sha256:a2e37ba89d029b05f03018401ae460be9ab598c5cef7deaaa2b8d52167e64949","observation_id":"bded4634-bc39-47e4-84ff-415f09055973","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T21:46:13.107901Z","title":"Harmony renderer library","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.12277","last_updated":"2026-06-27T01:09:30Z","snapshot_observed_at":"2026-08-02T21:46:08.650145Z","submitted_at":"2026-02-22T18:43:34Z","title":"Prompt Injection as Role Confusion","version":6},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T21:46:13.107901Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2603.12277"},"observation_digest":"sha256:d2b2e3e4993cc16b9abfde3a948017e4334c4ab661050f1e9964653c4a86f98c","observation_id":"4aace6aa-ea9d-41de-b8b7-1bdd9cb7ca87","resolution":{"observed_at":"2026-08-02T21:46:13.107901Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2603.17839","last_updated":"2026-05-19T10:45:47Z","snapshot_observed_at":"2026-07-06T22:49:33.482934Z","submitted_at":"2026-03-18T15:31:43Z","title":"How do LLMs Compute Verbal Confidence","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T10:38:28.533485Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2603.17839"},"observation_digest":"sha256:b4622406cab252966555b1df09e802f6b81e0b284f3c0030537373d4d5045856","observation_id":"d64fab97-26cc-4a83-84bc-4d05345c50ef","resolution":{"observed_at":"2026-05-21T10:40:00.611725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2603.18373","last_updated":"2026-06-01T01:48:27Z","snapshot_observed_at":"2026-07-13T22:42:12.670176Z","submitted_at":"2026-03-19T00:15:05Z","title":"To See or To Please: Uncovering Visual Sycophancy and Split Beliefs in VLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T09:18:34.853946Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2603.18373"},"observation_digest":"sha256:6f2c0ede85a12aa4e1cceb0f45db179d7f2362e2c2be58d4525764d9a1fd24ed","observation_id":"7be395c5-0fd1-4d93-a8ee-072d92950f40","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-07-13T14:23:49.346727Z","title":"Discovering latent knowledge in language models without supervision.arXiv preprint arXiv:2212.03827,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.01475","last_updated":"2026-06-08T13:23:37Z","snapshot_observed_at":"2026-07-13T14:23:49.176171Z","submitted_at":"2026-04-01T23:31:38Z","title":"Interpretable Electrophysiological Features of Resting-State EEG Capture Cortical Network Dynamics in Parkinsons Disease","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T14:23:49.346727Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.01475"},"observation_digest":"sha256:70f5a2b4755522e5b13750c18c4f36f0423007cbc047208486162ea9876b6759","observation_id":"8b14138c-2eaf-4c4d-8303-afbd55836c96","resolution":{"observed_at":"2026-07-13T14:23:49.346727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.06277","last_updated":"2026-04-07T08:14:48Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-07T08:14:48Z","title":"Weakly Supervised Distillation of Hallucination Signals into Transformer Representations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T19:49:35.865609Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.06277"},"observation_digest":"sha256:8967a5f63011c121169f5409a3c44d9efdc9fec4686820ddf9f796bf4fa6ebdd","observation_id":"b2834ec8-8899-4835-81b0-70fbcf06de46","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.13082","last_updated":"2026-06-17T04:09:14Z","snapshot_observed_at":"2026-07-13T15:57:54.517771Z","submitted_at":"2026-03-30T22:20:38Z","title":"The Long Delay to Arithmetic Generalization: When Learned Representations Outrun Behavior","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T21:16:40.430384Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.13082"},"observation_digest":"sha256:6087e162d7e8dfc0736775dad8b22086ca0734681b5bd06f254094eae7bad644","observation_id":"5494bc89-f8f3-40da-974c-95101eb4dedd","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.15741","last_updated":"2026-04-17T06:31:29Z","snapshot_observed_at":"2026-07-06T23:03:12.000381Z","submitted_at":"2026-04-17T06:31:29Z","title":"Learning Uncertainty from Sequential Internal Dispersion in Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-10T08:36:39.242766Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.15741"},"observation_digest":"sha256:204f03780f09485f4e1c02b1c8cd845054f4562351638a71ce5c2de298acb11c","observation_id":"13e3a36c-5c8b-49ba-9e03-63963fc621b9","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.17105","last_updated":"2026-04-18T18:40:56Z","snapshot_observed_at":"2026-07-06T23:04:19.063534Z","submitted_at":"2026-04-18T18:40:56Z","title":"How Tokenization Limits Phonological Knowledge Representation in Language Models and How to Improve Them","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-10T06:48:45.333416Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.17105"},"observation_digest":"sha256:beccf6e43a7219a0c2e69cfbb3d025751b67ffcfc77f60b48f6b32fbfef0c73e","observation_id":"81c5f600-eaa4-4f86-b2a1-6cd0cd3819ec","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.19974","last_updated":"2026-04-21T20:34:14Z","snapshot_observed_at":"2026-07-06T23:06:31.110859Z","submitted_at":"2026-04-21T20:34:14Z","title":"Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-10T02:51:12.492123Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.19974"},"observation_digest":"sha256:0cad18b912b62c9df0697967a8e3565d4258b710e63ea7e4c960012a1ae585ff","observation_id":"794bba6f-e38f-49ce-99b6-7b1ae2127bba","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.22271","last_updated":"2026-05-01T09:11:21Z","snapshot_observed_at":"2026-07-06T23:08:42.301487Z","submitted_at":"2026-04-24T06:33:32Z","title":"How LLMs Detect and Correct Their Own Errors: The Role of Internal Confidence Signals","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T12:30:51.094216Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.22271"},"observation_digest":"sha256:7b3295c78bea6b789ba83d770d34c266352aa57b642b0d4542466604e5d669a1","observation_id":"20783210-ed4f-436e-a807-f47148b73a8c","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2604.27401","last_updated":"2026-04-30T04:13:33Z","snapshot_observed_at":"2026-07-06T23:12:52.141592Z","submitted_at":"2026-04-30T04:13:33Z","title":"Perturbation Probing: A Two-Pass-per-Prompt Diagnostic for FFN Behavioral Circuits in Aligned LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T08:34:14.310656Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2604.27401"},"observation_digest":"sha256:6e1764ac2e9fbcb05336748fabad741915efc1bc39d40fbd95010783a3ef073b","observation_id":"51eddca8-d954-4d0a-92ae-a5689df686a0","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.03196","last_updated":"2026-05-04T22:24:34Z","snapshot_observed_at":"2026-08-02T11:55:00.034613Z","submitted_at":"2026-05-04T22:24:34Z","title":"Geometric Deviation as an Unsupervised Pre-Generation Reliability Signal: Probing LLM Representations for Answerability","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-08T17:56:27.360060Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.03196"},"observation_digest":"sha256:3fe61e040c68dd1b5ea73e343dbf98f669846e9a82a750de298855c2a09a2411","observation_id":"e77e8cdf-ab76-4031-8f23-5d13648ba686","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.05715","last_updated":"2026-05-07T05:58:38Z","snapshot_observed_at":"2026-07-06T23:18:17.333660Z","submitted_at":"2026-05-07T05:58:38Z","title":"Decodable but Not Corrected by Fixed Residual-Stream Linear Steering: Evidence from Medical LLM Failure Regimes","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-08T11:42:16.090162Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.05715"},"observation_digest":"sha256:d213de1ca765c399c1b2a702d297fcc7490370bbdde8b26d6e84989a0aa4cd5a","observation_id":"bf765001-42ef-4f78-92ff-c15d497f1ed4","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.09195","last_updated":"2026-05-09T22:27:31Z","snapshot_observed_at":"2026-07-29T22:50:26.989270Z","submitted_at":"2026-05-09T22:27:31Z","title":"The Geometry of Forgetting: Temporal Knowledge Drift as an Independent Axis in LLM Representations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-12T01:55:32.734498Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.09195"},"observation_digest":"sha256:107d684786d5bad51f4603105a1e397cf644d845e5ddc4ab280d84605b36aff2","observation_id":"240a3d52-49f6-40e1-87b3-66b0bce81b0c","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.09239","last_updated":"2026-07-26T23:41:07Z","snapshot_observed_at":"2026-08-03T03:53:21.271558Z","submitted_at":"2026-05-10T00:45:19Z","title":"Repeated-Token Counting Reveals a Dissociation Between Representations and Outputs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:28.650522Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.09239"},"observation_digest":"sha256:4755f0f0fac055ab61c9d0b6529ea77a018ebba5fe9ef98f73bdfbe33adf583b","observation_id":"0be2a14b-9cd2-4eef-9ae3-3db49ac3544f","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T14:31:12.034394Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.09239","last_updated":"2026-07-26T23:41:07Z","snapshot_observed_at":"2026-08-03T03:53:21.271558Z","submitted_at":"2026-05-10T00:45:19Z","title":"Repeated-Token Counting Reveals a Dissociation Between Representations and Outputs","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T14:31:12.034394Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.09239"},"observation_digest":"sha256:e63cc1ee1b293ec44ea52068c2ee7f994c02dff4f0800f4c08c30cfc41d8c836","observation_id":"148004bd-cf73-4510-ae50-056f92d70652","resolution":{"observed_at":"2026-08-02T14:31:12.034394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.09252","last_updated":"2026-05-20T19:57:19Z","snapshot_observed_at":"2026-08-02T16:03:49.427921Z","submitted_at":"2026-05-10T01:37:40Z","title":"LLM Agents Already Know When to Call Tools -- Even Without Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T02:44:00.329276Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.09252"},"observation_digest":"sha256:0b1463d6bac5ad2f69f27734e371442399c1fed5ae71b4c300dce5f1d9dcbd77","observation_id":"19837d01-1976-41dd-b6a2-05f2d0360a41","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.09252","last_updated":"2026-05-20T19:57:19Z","snapshot_observed_at":"2026-08-02T16:03:49.427921Z","submitted_at":"2026-05-10T01:37:40Z","title":"LLM Agents Already Know When to Call Tools -- Even Without Reasoning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-22T10:55:14.037226Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.09252"},"observation_digest":"sha256:477548164cca106926f3d1e9ad0beeb1ee6cc0f44035aa2445412f6279e8c991","observation_id":"b8e04aa4-4e78-48dc-ac11-00e62a8cd347","resolution":{"observed_at":"2026-05-22T10:56:25.877372Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.10310","last_updated":"2026-06-19T14:35:47Z","snapshot_observed_at":"2026-07-06T23:22:18.704329Z","submitted_at":"2026-05-11T10:11:08Z","title":"Positive Alignment: Artificial Intelligence for Human Flourishing","version":2},"reference_index":169,"source":"arxiv_source","source_observed_at":"2026-05-15T05:56:56.902705Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.10310"},"observation_digest":"sha256:dd34549586d9d7a6628ea3a48518c5922dd8169b9ad030ca85132b228d28d13a","observation_id":"0f003387-f22f-4da1-a30d-ae18832fadc6","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.12412","last_updated":"2026-05-12T17:09:41Z","snapshot_observed_at":"2026-07-06T23:24:08.763444Z","submitted_at":"2026-05-12T17:09:41Z","title":"Stories in Space: In-Context Learning Trajectories in Conceptual Belief Space","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-13T05:17:34.283917Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.12412"},"observation_digest":"sha256:90eff6b166a568a48514b742dfef59cbb71e60cd1bb358cce58806fefae8172f","observation_id":"68f47cbd-83af-403b-9446-21e8ef19ac46","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.12809","last_updated":"2026-05-12T23:01:29Z","snapshot_observed_at":"2026-07-06T23:24:27.821980Z","submitted_at":"2026-05-12T23:01:29Z","title":"Correcting Influence: Unboxing LLM Outputs with Orthogonal Latent Spaces","version":1},"reference_index":137,"source":"arxiv_source","source_observed_at":"2026-05-14T20:17:01.224864Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.12809"},"observation_digest":"sha256:33ae79ec8b8f9deee66c5de3353aa06388fbe839a821c441032d6b70cca4469e","observation_id":"d235f8c1-d6db-4105-b730-660c8b006b2c","resolution":{"observed_at":"2026-05-15T20:34:08.372263Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.17877","last_updated":"2026-07-31T02:25:17Z","snapshot_observed_at":"2026-08-05T23:10:42.483401Z","submitted_at":"2026-05-18T05:39:30Z","title":"PAIR: Prefix-Aware Internal Reward Model for Multi-Turn Agent Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T10:41:25.205368Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.17877"},"observation_digest":"sha256:c4e8727035bd2b7bf3b6858e814265bd7a72a265b1bff7cb43f5fb5655a19579","observation_id":"f7b26cd2-f8f1-443c-bc01-60f5f5733347","resolution":{"observed_at":"2026-05-20T10:43:12.459720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-03T02:23:29.475276Z","title":"Discovering latent knowledge in language models without supervision.arXiv preprint arXiv:2212.03827, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2605.17877","last_updated":"2026-07-31T02:25:17Z","snapshot_observed_at":"2026-08-05T23:10:42.483401Z","submitted_at":"2026-05-18T05:39:30Z","title":"PAIR: Prefix-Aware Internal Reward Model for Multi-Turn Agent Optimization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T02:23:29.475276Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.17877"},"observation_digest":"sha256:e46987b6bbcca47be51028301a3215feb3aca19c8e9f3085ec76f09d85b4e361","observation_id":"b12cf2a5-3e99-4956-ab39-40a3e91f015a","resolution":{"observed_at":"2026-08-03T02:23:29.475276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.18792","last_updated":"2026-05-11T05:44:27Z","snapshot_observed_at":"2026-08-01T20:16:08.484322Z","submitted_at":"2026-05-11T05:44:27Z","title":"Trust or Abstain? A Self-Aware RAG Approach","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T23:02:58.671115Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.18792"},"observation_digest":"sha256:e0dfa90a3aaef382e99a9fabb47f999f827ff58f2df17bbe82552614fbabbb59","observation_id":"8445a34d-820e-40ce-af87-ef1254df4472","resolution":{"observed_at":"2026-05-20T23:03:50.377331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.21770","last_updated":"2026-05-20T22:06:08Z","snapshot_observed_at":"2026-08-02T18:47:19.614133Z","submitted_at":"2026-05-20T22:06:08Z","title":"Manifold-Guided Attention Steering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T09:14:12.029680Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.21770"},"observation_digest":"sha256:fe8da3cf9f50c89072adc8b099df76cb0fcfc72da276112b15ae2fdfd4585bd5","observation_id":"abc1a637-f32f-4bf0-965d-eb101dd82cdd","resolution":{"observed_at":"2026-05-22T09:14:45.318091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.22864","last_updated":"2026-07-22T09:21:02Z","snapshot_observed_at":"2026-08-02T13:38:47.679784Z","submitted_at":"2026-05-19T19:24:29Z","title":"Reading Calibrated Uncertainty from Language Model Trajectories","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-25T05:44:23.197975Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.22864"},"observation_digest":"sha256:892889532996be7973c85688e8123f10a8981bf8bf2f701d58a8bf935fb2a130","observation_id":"9a0d9cb4-ca11-4c2e-8336-fb1ffae02cef","resolution":{"observed_at":"2026-05-25T05:45:23.945287Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.27157","last_updated":"2026-05-26T15:18:43Z","snapshot_observed_at":"2026-08-05T03:04:01.161346Z","submitted_at":"2026-05-26T15:18:43Z","title":"Detecting Is Not Resolving: The Monitoring Control Gap in Retrieval Augmented LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-29T17:06:46.379906Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.27157"},"observation_digest":"sha256:b222dfaffcb9d329e12dfcbf711e0d52bbb6dd25e02b936fb27f8affcbb3c7ec","observation_id":"ebe266b5-2bd6-4f20-bde9-98b6b079f2a8","resolution":{"observed_at":"2026-06-29T17:13:44.850347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.27712","last_updated":"2026-05-26T21:37:20Z","snapshot_observed_at":"2026-08-02T09:43:04.207109Z","submitted_at":"2026-05-26T21:37:20Z","title":"Prefix-Safe Bayesian Belief Tracking for LLM Reasoning Reliability:Separating Calibration from Ranking","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-29T16:59:25.127619Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.27712"},"observation_digest":"sha256:60d55c806efc8716ada12a4333b4d4e370ac7b01179ee2aa1ad0b96d2f881a00","observation_id":"a37d5119-93fe-4af7-b9a2-f7cd5203f68c","resolution":{"observed_at":"2026-06-29T17:03:40.977377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.28639","last_updated":"2026-05-27T15:45:27Z","snapshot_observed_at":"2026-07-06T23:38:14.056361Z","submitted_at":"2026-05-27T15:45:27Z","title":"The Attentional White Bear Effect in Transformer Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T12:43:43.792334Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.28639"},"observation_digest":"sha256:f82866f1ccb9d6bf8d1b2e22db77c02cf08bb60f5863552b048f4d42e4ef6d73","observation_id":"0d5845af-5a7e-4218-8c30-489698a744e1","resolution":{"observed_at":"2026-06-29T12:53:27.042291Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.28778","last_updated":"2026-05-27T17:38:00Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:38:00Z","title":"Can LLMs Use Linguistic Uncertainty Markers to Reliably Reflect Intrinsic Confidence?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T12:18:36.854164Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.28778"},"observation_digest":"sha256:26b8e5b6a2653d2f60ac53537e5103c635c9d7beb276f3d6b68acd5294e07cbe","observation_id":"425ad979-64c6-4b4e-bfec-1a9a76639028","resolution":{"observed_at":"2026-06-29T12:23:24.421371Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.29358","last_updated":"2026-05-28T04:57:47Z","snapshot_observed_at":"2026-07-06T23:38:46.361360Z","submitted_at":"2026-05-28T04:57:47Z","title":"Scaling Monosemanticity: Extracting Interpretable Features from Claude 3 Sonnet","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:04.813379Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.29358"},"observation_digest":"sha256:14d988dced20d5db256d9ad687f0bc134ea473e56c8386a6ce47626367a89552","observation_id":"ea620236-5c89-40f9-9a39-07223841e287","resolution":{"observed_at":"2026-06-29T07:53:13.424409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2605.30076","last_updated":"2026-05-28T15:23:29Z","snapshot_observed_at":"2026-08-04T20:44:11.155176Z","submitted_at":"2026-05-28T15:23:29Z","title":"UniSteer: Text-Guided Flow Matching in Activation Space for Versatile LLM Steering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T08:06:57.884950Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2605.30076"},"observation_digest":"sha256:04324addd2728025232a8f9e5f4dc1bdbdaa6dd0dd5ad3a32d4beb7f3e76ba91","observation_id":"032fde70-6b90-4177-963a-7df421816826","resolution":{"observed_at":"2026-06-29T08:13:15.611293Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.01695","last_updated":"2026-06-01T05:01:01Z","snapshot_observed_at":"2026-07-06T23:42:12.125247Z","submitted_at":"2026-06-01T05:01:01Z","title":"CANARY: Zero-Label Detection of Fine-Tuning Contamination in Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T15:22:01.257829Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.01695"},"observation_digest":"sha256:94be7d57f9b7a3f69df8f61ec6b5a3b3603da17c7fb019c947bd88c9064bb369","observation_id":"68d539dc-ec8c-445b-a156-a838d7880a14","resolution":{"observed_at":"2026-07-01T22:26:18.041801Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.02628","last_updated":"2026-05-30T02:04:30Z","snapshot_observed_at":"2026-08-03T23:54:10.883472Z","submitted_at":"2026-05-30T02:04:30Z","title":"Hallucination Is Linearly Decodable from Mid-Layer Hidden States in Quantized LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T19:13:23.794792Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.02628"},"observation_digest":"sha256:5d020672e36a9bf6b7edc114ff0fa4b7a27eb10a8d647d242bcac91d5e09b17a","observation_id":"edcd55e5-5802-4b5e-8faa-c1aea132a358","resolution":{"observed_at":"2026-06-28T19:22:34.868638Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.03810","last_updated":"2026-06-03T10:22:34Z","snapshot_observed_at":"2026-08-02T05:00:38.252385Z","submitted_at":"2026-06-02T15:54:24Z","title":"Consistency Training Can Entrench Misalignment","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T10:07:31.153337Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.03810"},"observation_digest":"sha256:adfe3a509c3738c1d5e2c6e1eb0888d50e70f388493581a6ffe34e313c2edcc4","observation_id":"8c7a4ce7-7193-4630-ab35-d123cb01ad32","resolution":{"observed_at":"2026-07-02T03:26:28.597517Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.05680","last_updated":"2026-06-04T04:02:51Z","snapshot_observed_at":"2026-08-02T16:31:21.190227Z","submitted_at":"2026-06-04T04:02:51Z","title":"CASS-RTL: Correctness-Aware Subspace Steering for RTL Generation with LLMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T23:06:44.339563Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.05680"},"observation_digest":"sha256:8b1d1059f6a3a00c159ee4f352051f0771b0f418e3362cf1628ee41cdce7dc20","observation_id":"b70fcb39-61c6-43c1-8e5a-8a6447d5c9fa","resolution":{"observed_at":"2026-07-02T15:57:07.351714Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.06315","last_updated":"2026-06-04T15:54:34Z","snapshot_observed_at":"2026-07-06T23:46:10.612537Z","submitted_at":"2026-06-04T15:54:34Z","title":"LLM Self-Recognition: Steering and Retrieving Activation Signatures","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-28T01:41:03.518190Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.06315"},"observation_digest":"sha256:e3ebcb3a004249c65b8ef1e0a1d690883c420fc57c26612d33d602c85a36429d","observation_id":"726e4a78-ae6f-4130-850d-d33cb3276854","resolution":{"observed_at":"2026-06-28T01:41:29.292254Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.07696","last_updated":"2026-06-05T07:40:34Z","snapshot_observed_at":"2026-07-06T23:47:19.773490Z","submitted_at":"2026-06-05T07:40:34Z","title":"Adversarial Robustness of Activation Steering in Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T22:30:36.839964Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.07696"},"observation_digest":"sha256:f5d4ce5e737146cc52861510145d1fb4fc7d0dde9319b0511c99f85fd57147f1","observation_id":"f1590fe2-9c58-4a74-80cb-8fb82e85583c","resolution":{"observed_at":"2026-07-02T16:37:09.415704Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.09411","last_updated":"2026-06-08T12:27:11Z","snapshot_observed_at":"2026-07-31T11:36:59.398934Z","submitted_at":"2026-06-08T12:27:11Z","title":"Now You (Still) See Me: Detecting Evasive Steganographic Payloads in LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T16:10:18.569412Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.09411"},"observation_digest":"sha256:2c590dbe6315a697cc0a3b0ee58ef4e04ef02b3fd56d788c651596ac46082704","observation_id":"d2c0df88-dd3e-4fd3-a531-d1574f04206c","resolution":{"observed_at":"2026-07-03T02:07:33.628376Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.09563","last_updated":"2026-06-08T14:37:46Z","snapshot_observed_at":"2026-08-01T00:37:11.487032Z","submitted_at":"2026-06-08T14:37:46Z","title":"PRISM: Recovering Instruction Sets from Language Model Activations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T16:52:02.948457Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.09563"},"observation_digest":"sha256:9efe4576958a380edcc237b2bf72cb858180ce2af34163966acbcf039745f5d0","observation_id":"3fe7d966-cb83-4746-a98c-f67677d0a77f","resolution":{"observed_at":"2026-06-27T17:01:08.112795Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.09881","last_updated":"2026-06-03T05:44:29Z","snapshot_observed_at":"2026-07-06T23:49:08.412079Z","submitted_at":"2026-06-03T05:44:29Z","title":"Toward Calibrated, Fair, and accurate Deepfake Detection","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-28T07:05:18.026601Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.09881"},"observation_digest":"sha256:9b27cedb0bee490eb65eddfd77a77893793b910f3b9285a1d8cd10f599d1305f","observation_id":"d2db5217-5ae7-4d8a-98da-78e0d5e50ee5","resolution":{"observed_at":"2026-06-28T07:11:45.306077Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.11445","last_updated":"2026-06-09T20:56:23Z","snapshot_observed_at":"2026-08-03T11:04:44.734596Z","submitted_at":"2026-06-09T20:56:23Z","title":"Forecasting Future Behavior as a Learning Task","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-27T12:55:39.494339Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.11445"},"observation_digest":"sha256:70a619ceb24e02ec20aae1a53031e734359c8781b52867949c4c64d765b6f1d0","observation_id":"29b05033-4b28-41f9-8174-14e58829eee9","resolution":{"observed_at":"2026-07-03T06:07:41.329043Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.21917","last_updated":"2026-06-20T07:31:41Z","snapshot_observed_at":"2026-07-31T17:52:32.183094Z","submitted_at":"2026-06-20T07:31:41Z","title":"Pre-Generation Hallucination Detection in Large Language Models via Soft-Target Attention Probing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T12:19:03.745305Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.21917"},"observation_digest":"sha256:253ea5bca5a007ee72d7852a8b483082bad03d0de552ee76bb2c6d4af4eeaa07","observation_id":"f33b6223-44aa-466e-92ca-5aa5c8c7b925","resolution":{"observed_at":"2026-07-04T07:59:40.433972Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.22936","last_updated":"2026-06-22T07:13:13Z","snapshot_observed_at":"2026-08-04T00:01:01.409909Z","submitted_at":"2026-06-22T07:13:13Z","title":"When Agents Commit Too Soon: Diagnosing Premature Commitment in LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T08:32:24.949332Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.22936"},"observation_digest":"sha256:a1c770294b0ae2344e9923e5cecd5ce2575c0ed2074a95953fe844515f06089d","observation_id":"7f67689c-c851-4bea-ab5b-dab52f299521","resolution":{"observed_at":"2026-07-04T10:49:45.709560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.22953","last_updated":"2026-06-22T07:30:47Z","snapshot_observed_at":"2026-07-31T01:34:28.285642Z","submitted_at":"2026-06-22T07:30:47Z","title":"Plans Don't Persist: Why Context Management Is Load Bearing for LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-26T08:27:28.236073Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.22953"},"observation_digest":"sha256:d6463589fadaf40b475d4ad2df4b0f9646fb5f967eeac875884a1980bfa8fb04","observation_id":"a6bb1225-a0a3-4c8e-a376-655bf79aa0e8","resolution":{"observed_at":"2026-07-04T10:49:46.382030Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.24952","last_updated":"2026-06-23T08:07:51Z","snapshot_observed_at":"2026-07-06T23:59:28.120338Z","submitted_at":"2026-06-23T08:07:51Z","title":"Perfect Detection, Failed Control: The Geometry of Knowing vs. Steering in Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T00:14:40.674306Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.24952"},"observation_digest":"sha256:282c4cc09849b386a5751980c52e31ee931947c45a8aae5fed5e4f7435a15502","observation_id":"1cdbb5a5-2feb-45cb-8bf8-99aafe702d90","resolution":{"observed_at":"2026-07-04T16:49:57.477292Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.26523","last_updated":"2026-06-25T01:58:38Z","snapshot_observed_at":"2026-08-06T19:44:14.778081Z","submitted_at":"2026-06-25T01:58:38Z","title":"Radical AI Interpretability","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-26T05:26:47.854890Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.26523"},"observation_digest":"sha256:28acf274d939407a0c74df520e209d3c23fb2f8b075ecf55d8fe904cd8e75ad5","observation_id":"0cfb732d-67cc-4985-a2fc-187b0d3880c8","resolution":{"observed_at":"2026-07-04T13:09:51.066147Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.26982","last_updated":"2026-06-25T12:53:33Z","snapshot_observed_at":"2026-08-03T13:22:49.813522Z","submitted_at":"2026-06-25T12:53:33Z","title":"Auditing Framing-Sensitive Behavioral Instability in Large Language Models for Mental Health Interactions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T04:33:07.815172Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.26982"},"observation_digest":"sha256:770a15f1936453aae3ece66b64b2efb042c6247daa69a0589dc51b0968923e70","observation_id":"815fb3b0-c0b6-4a99-afab-60022749c5a6","resolution":{"observed_at":"2026-07-04T14:09:52.856519Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.27679","last_updated":"2026-06-26T03:23:15Z","snapshot_observed_at":"2026-07-07T00:01:49.598947Z","submitted_at":"2026-06-26T03:23:15Z","title":"From Signals to Transfer: A Factorised Study of Probe-Based Uncertainty Estimation in Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-29T05:05:00.406145Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.27679"},"observation_digest":"sha256:9e67bc2fca1f40c344abd932d55e0a6bd0c9e6c4c92bb10767b9be6f70fb69d4","observation_id":"9c8c957e-203c-4a69-89b5-636ecf12beba","resolution":{"observed_at":"2026-06-29T18:23:51.030162Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.29034","last_updated":"2026-06-27T18:06:29Z","snapshot_observed_at":"2026-07-31T10:59:03.375998Z","submitted_at":"2026-06-27T18:06:29Z","title":"The strength of clinical evidence is recoverable from language model representations but not from their stated grades","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T09:30:55.171017Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.29034"},"observation_digest":"sha256:10622d130f2ab4dfdd86899326d83514c64a032cad29c5f1deb3a8bed2db068c","observation_id":"988d2075-4bd9-45aa-902e-1ed74210f20c","resolution":{"observed_at":"2026-06-30T09:34:34.612813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.30449","last_updated":"2026-06-29T15:18:36Z","snapshot_observed_at":"2026-08-06T13:55:03.865871Z","submitted_at":"2026-06-29T15:18:36Z","title":"Internal-State Probes Read the Situation, Not the Action: Three Negative Results for Pre-Action Misalignment Monitoring","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-30T07:37:47.420986Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.30449"},"observation_digest":"sha256:293ef7c5c3c561c0cc229b93b46f26ac1028777387addeec4fbf6c3a1b8184e3","observation_id":"b3528d69-d2c3-49fb-8a45-7bc3bad167a1","resolution":{"observed_at":"2026-06-30T07:44:22.026858Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2606.32032","last_updated":"2026-06-30T17:56:01Z","snapshot_observed_at":"2026-07-07T00:05:41.920778Z","submitted_at":"2026-06-30T17:56:01Z","title":"Reinforcement Learning with Metacognitive Feedback Elicits Faithful Uncertainty Expression in LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-01T05:22:38.232552Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2606.32032"},"observation_digest":"sha256:bff7c5e2b0b1cab26fe77f7cdfd27c293293a1f4409b30e9a0ec46c4b20c87a2","observation_id":"51c3f320-af26-410a-b377-1e688649833e","resolution":{"observed_at":"2026-07-01T10:35:42.045762Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2607.00012","last_updated":"2026-05-08T10:35:13Z","snapshot_observed_at":"2026-08-04T21:03:13.172809Z","submitted_at":"2026-05-08T10:35:13Z","title":"PRA-RAG: Provably Robust Aggregation in Retrieval-Augmented Generation against Retrieval Corruption","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-07-02T23:42:23.695930Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.00012"},"observation_digest":"sha256:1502a69c1058c4e80497b414e04db730677df61fd3350f72f61df7a5642d7d81","observation_id":"65575cb8-6020-4fc1-b1c3-ec9f82a82757","resolution":{"observed_at":"2026-07-02T23:47:27.197660Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2607.00158","last_updated":"2026-06-30T20:34:45Z","snapshot_observed_at":"2026-08-03T04:05:58.992502Z","submitted_at":"2026-06-30T20:34:45Z","title":"Readable but Not Controllable: Neuron-Level Evidence for Medical LLM Hallucination","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-02T19:16:31.055024Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.00158"},"observation_digest":"sha256:570cca4273b17392b87091a94bd3bae561831b106c00951b0c5d21dcce5f6b37","observation_id":"ac1e7194-fc01-4a14-bd82-fbc71b4e4c05","resolution":{"observed_at":"2026-07-02T19:17:17.626552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2607.01774","last_updated":"2026-07-20T22:29:25Z","snapshot_observed_at":"2026-08-02T09:06:56.021376Z","submitted_at":"2026-07-02T06:45:42Z","title":"Subliminal Clocks: Latent Time Modelling in Diffusion Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-03T13:48:58.653341Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.01774"},"observation_digest":"sha256:22ab57efbbd81e6c7a61786b0a8855ecd87d0b35b27293a5d5741bd72ed3c288","observation_id":"e99762da-d12e-4ea4-b327-88f774e91423","resolution":{"observed_at":"2026-07-03T13:58:21.254599Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T09:07:02.234749Z","title":"arXiv preprint arXiv:2212.03827 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.01774","last_updated":"2026-07-20T22:29:25Z","snapshot_observed_at":"2026-08-02T09:06:56.021376Z","submitted_at":"2026-07-02T06:45:42Z","title":"Subliminal Clocks: Latent Time Modelling in Diffusion Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T09:07:02.234749Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.01774"},"observation_digest":"sha256:0d62d68988910d56fc2ca38afa0dd21012a3e425639061990afb7df5a4072ec7","observation_id":"cc5b659a-cfca-421e-948d-a9b4b4bd793c","resolution":{"observed_at":"2026-08-02T09:07:02.234749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2607.05394","last_updated":"2026-07-08T17:57:18Z","snapshot_observed_at":"2026-08-02T11:12:50.300654Z","submitted_at":"2026-07-06T17:59:58Z","title":"Weak-to-Strong Generalization via Direct On-Policy Distillation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-07T12:31:42.224094Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.05394"},"observation_digest":"sha256:a2f1298c07079ed984e9609eac5dc85980e1a8e9361220f2e144978415bee6f5","observation_id":"fdb5c000-5b4c-40a3-b989-4f544d912bc1","resolution":{"observed_at":"2026-07-07T12:33:45.027092Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-07-11T07:01:56.628017Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.05394","last_updated":"2026-07-08T17:57:18Z","snapshot_observed_at":"2026-08-02T11:12:50.300654Z","submitted_at":"2026-07-06T17:59:58Z","title":"Weak-to-Strong Generalization via Direct On-Policy Distillation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-11T07:01:56.628017Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.05394"},"observation_digest":"sha256:2904913bf1a72513733cd570333a4100778d3086611e9996a67731ae90c845fd","observation_id":"5ddb4ac6-1bdc-4ba8-918d-16f06d406da1","resolution":{"observed_at":"2026-07-11T07:01:56.628017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2607.07003","last_updated":"2026-07-24T00:45:33Z","snapshot_observed_at":"2026-08-06T13:04:42.288645Z","submitted_at":"2026-07-08T04:54:54Z","title":"Dissociating the Internal Representations of Sycophancy in LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-09T21:56:32.778349Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.07003"},"observation_digest":"sha256:031d77238b3e0258b24bdb980283e126a4b9d0ec8134ccfd68b38d38c70aafa7","observation_id":"74b1ff89-6bd2-4fc3-9ea7-260b4678a84c","resolution":{"observed_at":"2026-07-09T22:06:35.316057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T08:11:39.080789Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.07003","last_updated":"2026-07-24T00:45:33Z","snapshot_observed_at":"2026-08-06T13:04:42.288645Z","submitted_at":"2026-07-08T04:54:54Z","title":"Dissociating the Internal Representations of Sycophancy in LLMs","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-02T08:11:39.080789Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.07003"},"observation_digest":"sha256:5206cb950c7d2a86cc325bf9faf8610b81bd9a180fdf962f41cae0e551f93e84","observation_id":"9bbff01e-d216-4a27-9234-b4bd2691c602","resolution":{"observed_at":"2026-08-02T08:11:39.080789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":"2212.03827","doi":"10.48550/arxiv.2212.03827","metadata_source":"pith","pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","venue":"cs.CL","work_id":"a12b68bd-76a4-4837-ac7c-3ed5a60010d3","year":2022},"citing_paper":{"arxiv_id":"2607.08399","last_updated":"2026-07-09T12:21:44Z","snapshot_observed_at":"2026-08-05T01:38:41.823519Z","submitted_at":"2026-07-09T12:21:44Z","title":"Prompt Compression via Activation Aggregation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-10T08:03:46.297577Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.08399"},"observation_digest":"sha256:83a61914bd56753c4c1983182ff489e70815babe11c2088c8f378a9f8a74b201","observation_id":"ef966a6b-d11d-4927-a5ff-07acb8c4ad06","resolution":{"observed_at":"2026-07-10T08:06:57.502233Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:03.323637+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T07:44:06.996445Z","title":"& Steinhardt, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09306","last_updated":"2026-07-30T11:40:45Z","snapshot_observed_at":"2026-08-02T23:59:13.473449Z","submitted_at":"2026-07-10T11:39:40Z","title":"Exposure is not manifestation: measurement target and output resolution jointly determine which behavioural-faithfulness evaluator wins","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T07:44:06.996445Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.09306"},"observation_digest":"sha256:eeeecf2d131b19c23edf4d55cc68397d3d6b5ba56346c82ddf039af98d321c9a","observation_id":"2d105eec-e4fb-4170-aeb5-ce3b335bcbf2","resolution":{"observed_at":"2026-08-02T07:44:06.996445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-07-13T02:15:42.731438Z","title":"arXiv preprint arXiv:2212.03827 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09544","last_updated":"2026-07-10T15:50:54Z","snapshot_observed_at":"2026-07-15T23:18:29.419733Z","submitted_at":"2026-07-10T15:50:54Z","title":"The Count Is There, but Misaligned: Understanding and Correcting Counting Failures in VLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-13T02:15:42.731438Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.09544"},"observation_digest":"sha256:5bdbb741fdebb56f7aa2027da0dae470d1c09b5b1aecd38cb6a84692e4c35f86","observation_id":"153b3803-5472-4faf-b276-4b1bb31ccf6d","resolution":{"observed_at":"2026-07-13T02:15:42.731438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-07-14T05:45:08.896651Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11414","last_updated":"2026-07-13T11:22:25Z","snapshot_observed_at":"2026-08-02T20:55:17.968894Z","submitted_at":"2026-07-13T11:22:25Z","title":"Confidently Wrong: Detecting Hallucinations in Financial Question Answering from LLM Internal States","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T05:45:08.896651Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.11414"},"observation_digest":"sha256:38d7e6cb7160173aec2287f8d0cff22a68867408d3026316c767fee45ed208d5","observation_id":"19d968ca-3e05-41c8-a177-2d7064d74d55","resolution":{"observed_at":"2026-07-14T05:45:08.896651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-07-14T02:33:34.084111Z","title":"International Conference on Learning Representations (ICLR) , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11871","last_updated":"2026-07-13T17:55:19Z","snapshot_observed_at":"2026-08-05T16:49:44.432361Z","submitted_at":"2026-07-13T17:55:19Z","title":"Inside the Unfair Judge: A Mechanistic Interpretability Account of LLM-as-Judge Bias","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-14T02:33:34.084111Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.11871"},"observation_digest":"sha256:8211e4a72f8cfb59a3af20a0f6f38505c1ade4bb359944bb0bf6c2400275b618","observation_id":"029b3bbe-157e-4230-9e2a-02fd015bb33e","resolution":{"observed_at":"2026-07-14T02:33:34.084111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T06:37:40.498943Z","title":"arXiv preprint arXiv:2212.03827 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12447","last_updated":"2026-07-24T07:10:23Z","snapshot_observed_at":"2026-08-04T12:28:32.750580Z","submitted_at":"2026-07-14T07:24:32Z","title":"The Computational Basis of Confidence in Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T06:37:40.498943Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.12447"},"observation_digest":"sha256:1aa8eb18f4176c7586501dca78f010f5af9b8d9f99190fcc9046da9443fcaf86","observation_id":"e0d54499-1682-4ac0-92b3-a092556fbc40","resolution":{"observed_at":"2026-08-02T06:37:40.498943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T05:33:17.045238Z","title":"arXiv preprint arXiv:2212.03827 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13346","last_updated":"2026-07-15T00:11:42Z","snapshot_observed_at":"2026-08-02T05:33:14.478878Z","submitted_at":"2026-07-15T00:11:42Z","title":"The Refusal Residue: When Probes Catch Alignment Faking and When They Don't","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T05:33:17.045238Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.13346"},"observation_digest":"sha256:f3536154d9d44504b04e1f9d9fa314d00c64677b081c96661d702e1ad30dff31","observation_id":"fc4cf203-9333-48e0-bd82-110f326d7d03","resolution":{"observed_at":"2026-08-02T05:33:17.045238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T04:52:45.338836Z","title":"The Eleventh International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13568","last_updated":"2026-07-15T08:06:59Z","snapshot_observed_at":"2026-08-04T16:52:43.026802Z","submitted_at":"2026-07-15T08:06:59Z","title":"Graded Entity-Familiarity Readouts in Language Models: Polish Adaptation, Cross-Language Robustness, and Refusal Steering","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-02T04:52:45.338836Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.13568"},"observation_digest":"sha256:6410e304c8fbff3523c97652db34888ed23a6669f826fbd29f8b23296e5f322d","observation_id":"d5d3e08a-91a9-4b84-a73b-1f135effb8c3","resolution":{"observed_at":"2026-08-02T04:52:45.338836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T02:42:01.203968Z","title":"Burns, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.14277","last_updated":"2026-07-15T18:36:54Z","snapshot_observed_at":"2026-08-02T02:42:00.070125Z","submitted_at":"2026-07-15T18:36:54Z","title":"Multi-Head Latent Control: A Unified Interface for LLM Agent Decision Making","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T02:42:01.203968Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.14277"},"observation_digest":"sha256:6be796f0f4924fee3f77b8167369b583139b8f54f9f9e8395b293d26a29736ec","observation_id":"6ddf48a2-c533-4b2d-accc-03a15f001caa","resolution":{"observed_at":"2026-08-02T02:42:01.203968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-01T20:09:48.551226Z","title":"Burns, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16741","last_updated":"2026-07-22T10:57:44Z","snapshot_observed_at":"2026-08-04T19:32:48.316280Z","submitted_at":"2026-07-18T10:03:21Z","title":"The Anatomy of a Truth Direction: Knowledge-Dependent Dimensionality, a Relational Law, and a Convergent Category Geometry in Small Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T20:09:48.551226Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.16741"},"observation_digest":"sha256:ed432a24aca2b5753f8fbab983e0128fdd9ff694c6e6cbc322ae9e6f0c4909b9","observation_id":"2bcafe71-c745-4368-8b24-f0556c70d460","resolution":{"observed_at":"2026-08-01T20:09:48.551226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-01T15:40:35.398243Z","title":"Discovering latent knowledge in language models without supervision.arXiv preprint arXiv:2212.03827, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.18228","last_updated":"2026-07-20T17:58:05Z","snapshot_observed_at":"2026-08-01T15:40:34.037153Z","submitted_at":"2026-07-20T17:58:05Z","title":"Logical Judgments Under Pressure: Diagnosing Syllogistic Stability with Learned Soft Prefixes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T15:40:35.398243Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.18228"},"observation_digest":"sha256:575c8876f4c9b5b1555240c5743cdc380727bd5b6285567f89b5dd6d450e2e78","observation_id":"fca63d1e-16b8-453c-8966-7f98fb4a1a71","resolution":{"observed_at":"2026-08-01T15:40:35.398243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-01T10:59:55.337046Z","title":"& Steinhardt, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20058","last_updated":"2026-07-22T12:02:49Z","snapshot_observed_at":"2026-08-04T12:08:06.054975Z","submitted_at":"2026-07-22T12:02:49Z","title":"Reading and Steering Representations of Materials-Science Mechanisms in an Open-Weight Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T10:59:55.337046Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.20058"},"observation_digest":"sha256:982f624e0bc5a356b552f0a264bb22011838521506b0fef2a0ebc36865975138","observation_id":"31fcd1be-d249-4209-9f92-08c7bd29507f","resolution":{"observed_at":"2026-08-01T10:59:55.337046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-02T15:02:58.141704Z","title":"Chao, P., Robey, A., Dobriban, E., Hassani, H., Pappas, G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21600","last_updated":"2026-05-03T19:21:06Z","snapshot_observed_at":"2026-08-06T09:31:16.482834Z","submitted_at":"2026-05-03T19:21:06Z","title":"Securing Multimodal AI through Internal Information Decomposition","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T15:02:58.141704Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2607.21600"},"observation_digest":"sha256:51367643a806ab67d45453514a5a412f9ee8f2b739e4e52649ec053459e26c62","observation_id":"bac76bc1-07cc-4137-a403-25d788855de2","resolution":{"observed_at":"2026-08-02T15:02:58.141704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2212.03827/citation-record","integrity":"/paper/2212.03827/integrity","json":"/paper/2212.03827/citation-record.json","paper":"/paper/2212.03827"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":"2112.00861","doi":"10.48550/arxiv.2112.00861","metadata_source":"pith","pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A General Language Assistant as a Laboratory for Alignment","venue":"cs.CL","work_id":"a43f9ea0-01be-47d5-b8ee-a1a9f73381c5","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:d792f5bf8e783a7ce2b26d33d1fe0f54579c18d6aa86b58d2f533f954bfca5ca","observation_id":"7054bd77-617c-4b80-8bfd-00518389ec30","resolution":{"observed_at":"2026-05-15T20:34:08.305675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:13.802987+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:e65e0688101d8ec15d27f1f07575ee4674282d9056e850cf4e0e17fb08b27f54","observation_id":"33d77505-15b6-4fe6-93ce-2a5dfb2592dd","resolution":{"observed_at":"2026-05-15T20:34:08.237537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell","venue":null,"work_id":"7a4bf523-8393-4178-954c-f3e957fdec18","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:0e6c27d92e0a8b7561b1b5aaafd14f9b888ec93902bb89c504b053298c8bd2e2","observation_id":"e7b72cc2-45c0-47b2-95a7-a421c5a34e29","resolution":{"observed_at":"2026-05-15T20:34:08.352984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":"2108.07258","doi":"10.1016/j.specom.2008.12.003","metadata_source":"pith","pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"On the Opportunities and Risks of Foundation Models","venue":"cs.LG","work_id":"a18039e9-928d-47c9-a836-32656a71bf71","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:dc0124f2beb7ca81dd7afaff1a7e29bac4cf18125573ae1e8ba17a5cd8597e54","observation_id":"41f2e11f-2b54-4efb-abe6-81569996d8c1","resolution":{"observed_at":"2026-05-15T20:34:08.278904Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:22:59.787075+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:22:59.787075+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":"2005.14165","doi":"10.1145/1926385.1926423","metadata_source":"pith","pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Models are Few-Shot Learners","venue":"cs.CL","work_id":"214732c0-2edd-44a0-af9e-28184a2b8279","year":2020},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:349d0c9e0361c4c822a1f6319237aed534c9ce96c38edc82cd6c160fb54115f4","observation_id":"c402b99c-6335-44fc-b359-d92a8708faba","resolution":{"observed_at":"2026-05-15T20:34:08.284137Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:33.42086+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03741","last_updated":"2023-02-17T17:00:34Z","snapshot_observed_at":"2026-08-03T14:31:51.401500Z","submitted_at":"2017-06-12T17:23:59Z","title":"Deep reinforcement learning from human preferences","version":4},"cited_work":{"arxiv_id":"1706.03741","doi":"10.48550/arxiv.1706.03741","metadata_source":"pith","pith_arxiv_id":"1706.03741","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deep reinforcement learning from human preferences","venue":"stat.ML","work_id":"95b596b9-4880-42ad-ac79-570a3a8a9dee","year":2017},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1706.03741","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:b76c84ff88603104c0f50a1cec9625871336e7ebf69602110f56d4816353e1d4","observation_id":"316431e8-35a7-4f2f-b5c6-35f228550c4d","resolution":{"observed_at":"2026-05-16T08:39:30.882444Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08575","last_updated":"2018-10-19T16:30:48Z","snapshot_observed_at":"2026-08-04T21:33:05.702276Z","submitted_at":"2018-10-19T16:30:48Z","title":"Supervising strong learners by amplifying weak experts","version":1},"cited_work":{"arxiv_id":"1810.08575","doi":"10.1177/0162243915579283","metadata_source":"pith","pith_arxiv_id":"1810.08575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Supervising strong learners by amplifying weak experts","venue":"cs.LG","work_id":"5d6c7456-8e86-44d2-b157-ac0daeb9587c","year":2018},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1810.08575","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:21624ae6388493de31481be9206174f02e23c279cef48e46b70e2917a8a9e5b8","observation_id":"bc95caa8-bb73-4a7e-b699-88e094c64a50","resolution":{"observed_at":"2026-05-15T20:34:08.291275Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-07-06T07:55:12.121264Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":"1905.10044","doi":"10.48550/arxiv.1905.10044","metadata_source":"pith","pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","venue":"cs.CL","work_id":"511eeb84-4b95-46d5-b14f-50da43f4f19f","year":2019},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:b02eb7783868a823235855360dcedf935bee3c7cdb1680a59f7e679f60222dda","observation_id":"5698c28a-791c-4963-9f57-c48273c6b764","resolution":{"observed_at":"2026-05-15T20:34:08.294891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06674","last_updated":"2021-10-13T12:18:09Z","snapshot_observed_at":"2026-07-06T11:57:24.991499Z","submitted_at":"2021-10-13T12:18:09Z","title":"Truthful AI: Developing and governing AI that does not lie","version":1},"cited_work":{"arxiv_id":"2110.06674","doi":"10.48550/arxiv.2110.06674","metadata_source":"arxiv_reference","pith_arxiv_id":"2110.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Truthful ai: Developing and governing ai that does not lie","venue":"arXiv (Cornell University)","work_id":"9c1629a9-e2e1-40ac-8a4a-8f46845fea79","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2110.06674","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:f27aba81b7c302cade9e81eaee1cd5c0fed15d0310e665ae3abbdd829b3b18d4","observation_id":"12269bc7-6dd8-4ba7-89e7-e45b05c82c0f","resolution":{"observed_at":"2026-05-15T20:34:08.298850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":"2006.03654","doi":"10.48550/arxiv.2006.03654","metadata_source":"pith","pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","venue":"cs.CL","work_id":"cb3211f6-363f-4355-bb84-2ecfd7e78875","year":2020},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:206a5781dd69b222671f9591fd62ff95341bc6bd2cd34d085fa676b570453473","observation_id":"560aaf69-397e-4a37-9c29-567103800a68","resolution":{"observed_at":"2026-05-15T20:34:08.302421Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13916","last_updated":"2022-06-16T21:12:42Z","snapshot_observed_at":"2026-07-06T11:52:19.105210Z","submitted_at":"2021-09-28T17:59:36Z","title":"Unsolved Problems in ML Safety","version":5},"cited_work":{"arxiv_id":"2109.13916","doi":"10.48550/arxiv.2109.13916","metadata_source":"pith","pith_arxiv_id":"2109.13916","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Unsolved Problems in ML Safety","venue":"cs.LG","work_id":"a4b59a6c-1b80-4562-afd6-0e6d0126d3bc","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2109.13916","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:91fe7f90f8136ec9a3688839006eec330dc450916fe495313907c01d5e226fa6","observation_id":"5e200fab-3720-44fa-80e5-b0ff20d7eda9","resolution":{"observed_at":"2026-05-16T20:45:28.030299Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00899","last_updated":"2018-10-22T17:36:07Z","snapshot_observed_at":"2026-08-02T15:33:17.783178Z","submitted_at":"2018-05-02T16:27:32Z","title":"AI safety via debate","version":2},"cited_work":{"arxiv_id":"1805.00899","doi":"10.48550/arxiv.1805.00899","metadata_source":"pith","pith_arxiv_id":"1805.00899","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI safety via debate","venue":"stat.ML","work_id":"13c1ec37-af93-438a-bdf0-f2eafaee5635","year":2018},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1805.00899","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:1a9d1594c3410e610631521b38782c9bfd6eee7ae4b9108ecb7c4152eea34a07","observation_id":"548d9f5b-f722-487f-8316-505edf7f8b12","resolution":{"observed_at":"2026-05-15T20:34:08.308667Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11822","last_updated":"2022-10-24T18:40:42Z","snapshot_observed_at":"2026-07-06T13:13:14.620980Z","submitted_at":"2022-05-24T06:36:42Z","title":"Maieutic Prompting: Logically Consistent Reasoning with Recursive Explanations","version":2},"cited_work":{"arxiv_id":"2205.11822","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.11822","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Takeshi Kojima, Shixiang Shane Gu, Machel Reid, Yutaka Matsuo, and Yusuke Iwasawa","venue":null,"work_id":"a818ea95-8d2f-4f30-8a66-9a06836e20cf","year":2022},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2205.11822","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:50147a9a69112ea48831a326fa0f71b9b36146f6346906de467417e6209cfed9","observation_id":"e76b8ba6-ed1d-4f2c-a0a5-65d7d0c74ac0","resolution":{"observed_at":"2026-05-15T20:34:08.311916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.14659","last_updated":"2021-03-26T18:01:48Z","snapshot_observed_at":"2026-07-06T10:53:51.296957Z","submitted_at":"2021-03-26T18:01:48Z","title":"Alignment of Language Agents","version":1},"cited_work":{"arxiv_id":"2103.14659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.14659","snapshot_observed_at":"2026-07-04T06:49:37.659279Z","title":"Kenton, T","venue":null,"work_id":"2dc6ed25-0b66-42f5-b67e-eb7e67977011","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2103.14659","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:4aa921c03d4d2238a7e4395af1e109826e368a9c70d9ca8135bac05f4d7443c4","observation_id":"5d0cd27f-e5b7-485f-ae64-cf47f5e8f508","resolution":{"observed_at":"2026-05-15T20:34:08.315226Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12685","last_updated":"2022-10-24T17:44:25Z","snapshot_observed_at":"2026-07-06T13:13:48.138379Z","submitted_at":"2022-05-25T11:45:14Z","title":"Ground-Truth Labels Matter: A Deeper Look into Input-Label Demonstrations","version":2},"cited_work":{"arxiv_id":"2205.12685","doi":"10.48550/arxiv.2205.12685","metadata_source":"arxiv_reference","pith_arxiv_id":"2205.12685","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv:2205.12685","venue":"arXiv (Cornell University)","work_id":"4e42e337-cba4-404c-9ffc-d85ef2b9d711","year":2022},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2205.12685","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:790ee846c33d56a03f3ebfa742e0085bfe79da4247cd48a36d58dc1c05c48514","observation_id":"c03ffb76-70c4-487c-8b84-28b58ab7dc65","resolution":{"observed_at":"2026-05-15T20:34:08.318512Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:31f7e91b4b373b0b5459c60e38cbb6462da50482d0ebb7fa1bcdc6c070be6ec0","observation_id":"f03c4e3a-47fe-4779-ad06-5deff716a1fa","resolution":{"observed_at":"2026-05-15T20:34:08.321324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-07-06T07:15:51.575438Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":"1811.07871","doi":"10.48550/arxiv.1811.07871","metadata_source":"pith","pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scalable agent alignment via reward modeling: a research direction","venue":"cs.LG","work_id":"1e9c4f6d-b369-4bd2-8e6e-1ec00318c924","year":2018},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:d31838046c4c2ba174faee458012d1e927a0a6c591e3de3b24e4698ec24e1369","observation_id":"838a7ba4-b93f-4f1f-9f8e-aa2f772f759b","resolution":{"observed_at":"2026-05-15T20:34:08.324344Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":"1907.11692","doi":"10.1007/s10489-02203627-9","metadata_source":"pith","pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","venue":"cs.CL","work_id":"41fe12c4-e538-4890-a244-480650ed3078","year":2019},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:5e0094df5d366362f685a362d649f5c0bd9f649d5538d9ea811769fb42e363f1","observation_id":"ac205680-71ff-44e0-804c-a37f7454ead5","resolution":{"observed_at":"2026-05-15T20:34:08.327577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:b6eaea8d19c7a03fe65199866d9e7502579a2f9231b11dd321937bcbd355db7b","observation_id":"475dc91b-c9e4-42ba-b257-490c63ef2b7c","resolution":{"observed_at":"2026-05-15T20:34:08.330770Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00661","last_updated":"2020-05-02T00:09:16Z","snapshot_observed_at":"2026-07-06T09:16:59.519524Z","submitted_at":"2020-05-02T00:09:16Z","title":"On Faithfulness and Factuality in Abstractive Summarization","version":1},"cited_work":{"arxiv_id":"2005.00661","doi":"10.48550/arxiv.2005.00661","metadata_source":"arxiv_reference","pith_arxiv_id":"2005.00661","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"On faithfulness and factuality in abstractive summarization","venue":null,"work_id":"15f147fc-11ab-469e-84a9-594dfedf756c","year":2005},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2005.00661","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:0050b993a3183570fdedf82165912f0f059740cb8617f7c8d73fae298cf49889","observation_id":"e7e7ce69-a935-47ec-8949-7b84c00a5a3a","resolution":{"observed_at":"2026-05-15T20:34:08.334377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11147","last_updated":"2022-03-21T17:26:29Z","snapshot_observed_at":"2026-08-01T19:23:25.711617Z","submitted_at":"2022-03-21T17:26:29Z","title":"Teaching language models to support answers with verified quotes","version":1},"cited_work":{"arxiv_id":"2203.11147","doi":"10.48550/arxiv.2203.11147","metadata_source":"pith","pith_arxiv_id":"2203.11147","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Teaching language models to support answers with verified quotes","venue":"cs.CL","work_id":"2950e664-d266-4db6-96e6-b81b3cf200ed","year":2022},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2203.11147","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:47fd34dcb809cde9dfdbd7a5ccd2bdf9cbe2328ea0e5b3f60d984db8b1305c0d","observation_id":"c3a61323-0f87-4ad2-881d-0289e4a60ec9","resolution":{"observed_at":"2026-05-17T11:45:48.341649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T14:49:49.659773+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T14:49:49.659773+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15943","last_updated":"2022-05-03T10:36:39Z","snapshot_observed_at":"2026-07-06T12:03:35.232581Z","submitted_at":"2021-10-29T17:42:08Z","title":"MetaICL: Learning to Learn In Context","version":2},"cited_work":{"arxiv_id":"2110.15943","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2110.15943","snapshot_observed_at":"2026-07-02T07:06:43.714296Z","title":"arXiv preprint arXiv:2110.15943 , year=","venue":null,"work_id":"6dcd9592-1325-455b-aba1-7e5c57127716","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2110.15943","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:d2ca700cafec9f1c5a1ce20617d2301cd8cff10d64c7d1f1fb07a30683d23699","observation_id":"2b18b2f4-47b0-4b94-b739-f752e4157c55","resolution":{"observed_at":"2026-05-15T20:34:08.341197Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":"2112.09332","doi":"10.48550/arxiv.2112.09332","metadata_source":"pith","pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebGPT: Browser-assisted question-answering with human feedback","venue":"cs.CL","work_id":"e25ef3e1-4848-4cb9-bf28-67a420591165","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:7b12cb18921f922aabce4bd8d821aea4a615c572aa25c7a9d0075ecc5c7b4338","observation_id":"1583a627-e650-41c0-b44b-1d0cf97e21a8","resolution":{"observed_at":"2026-05-15T20:34:08.344378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":"2203.02155","doi":"10.1007/s00354-022-00198-8","metadata_source":"pith","pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training language models to follow instructions with human feedback","venue":"cs.CL","work_id":"52aff42f-4fa9-4fcf-bdb3-1459b9bebf65","year":2022},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:4e94c3af93ab157c1ec928a7949f726b99593b96406f012b6f3e85098cf9f8ff","observation_id":"c95bebdc-9c95-457b-b97a-ebd6e96d1c0d","resolution":{"observed_at":"2026-05-15T20:34:08.347537Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":"2202.03286","doi":"10.48550/arxiv.2202.03286","metadata_source":"pith","pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models with Language Models","venue":"cs.CL","work_id":"d1274c54-508f-42f9-aeb3-91db13f3a622","year":2022},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:beeb4fd28aadd11f72d81e1aed1a0719368af5a4c85e209cc7437737c2cb7e1a","observation_id":"326f6614-903a-48fe-96a1-774af62f3fac","resolution":{"observed_at":"2026-05-15T20:34:08.350609Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"cited_work":{"arxiv_id":"1910.10683","doi":"10.18653/v1/2020.acl-main.259","metadata_source":"pith","pith_arxiv_id":"1910.10683","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","venue":"cs.LG","work_id":"50e3b368-0243-4726-8186-233869802ad1","year":2019},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1910.10683","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:75ddce3cd36a4b22916b8f9344e107633fe4d7cb9f1de9ee423323bd5113a505","observation_id":"96809c38-c7d3-495c-b8ae-2ee028c92ed7","resolution":{"observed_at":"2026-05-15T20:34:08.242501Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.05250","last_updated":"2016-10-11T02:42:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-16T16:36:00Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","version":3},"cited_work":{"arxiv_id":"1606.05250","doi":"10.48550/arxiv.1606.05250","metadata_source":"pith","pith_arxiv_id":"1606.05250","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SQuAD: 100,000+ Questions for Machine Comprehension of Text","venue":"cs.CL","work_id":"0492dd16-26e8-48d9-874c-3dd90cae7b85","year":2016},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1606.05250","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:7d7bae133c5805693d4aecd443fa724d31b7c8a8873cfd7e757a0e7dceffcb27","observation_id":"d69ab1c6-9bd7-46b7-9bea-97c93036c77b","resolution":{"observed_at":"2026-05-15T20:34:08.246766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Choice of plausible alternatives: An evaluation of commonsense causal reasoning","venue":null,"work_id":"4bb49cc8-48ae-41fd-ae87-94dede362f52","year":2011},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:2428560c207e158c728ed02d9ef809ecc3f6a8e274d6d0eb62035c5415834b44","observation_id":"e07a74a8-8a1d-4c2e-8c5d-5556d2523c75","resolution":{"observed_at":"2026-05-15T20:34:08.367484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08207","last_updated":"2022-03-17T17:53:01Z","snapshot_observed_at":"2026-07-06T11:58:21.596920Z","submitted_at":"2021-10-15T17:08:57Z","title":"Multitask Prompted Training Enables Zero-Shot Task Generalization","version":3},"cited_work":{"arxiv_id":"2110.08207","doi":"10.48550/arxiv.2110.08207","metadata_source":"pith","pith_arxiv_id":"2110.08207","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multitask Prompted Training Enables Zero-Shot Task Generalization","venue":"cs.LG","work_id":"1857c952-db2f-4810-9e3c-27a862c8d276","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2110.08207","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:7e11540dad2273f267d9dae135ab0b7c08a336989766bda785270eef76e81514","observation_id":"29f5c200-1097-4bf6-bd93-ed2299d2330e","resolution":{"observed_at":"2026-05-15T20:34:08.250101Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.01325","last_updated":"2022-02-15T19:09:36Z","snapshot_observed_at":"2026-08-06T19:18:51.065158Z","submitted_at":"2020-09-02T19:54:41Z","title":"Learning to summarize from human feedback","version":3},"cited_work":{"arxiv_id":"2009.01325","doi":"10.18653/v1/2022.naacl-main.6","metadata_source":"pith","pith_arxiv_id":"2009.01325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to summarize from human feedback","venue":"cs.CL","work_id":"1fae7759-93bb-4cba-a0d5-ebff515b9d39","year":2020},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2009.01325","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:0b70b3ad6309e18d6ca9a579fee142df3d7f99204c35e81547e59faef0ebb933","observation_id":"a21247f0-bcbd-4776-84ee-cd02e05a69b1","resolution":{"observed_at":"2026-05-18T01:46:18.838660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05355","last_updated":"2018-12-18T10:58:20Z","snapshot_observed_at":"2026-07-06T06:28:16.475418Z","submitted_at":"2018-03-14T15:30:37Z","title":"FEVER: a large-scale dataset for Fact Extraction and VERification","version":3},"cited_work":{"arxiv_id":"1803.05355","doi":"10.18653/v1/n18-1074","metadata_source":"pith","pith_arxiv_id":"1803.05355","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"FEVER: a large-scale dataset for Fact Extraction and VERification","venue":"cs.CL","work_id":"b696f75f-e5ad-4555-9c12-e292e77c388f","year":2018},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1803.05355","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:a5146a8bb16ab967e2acf975135eb3edf3b266339c9d2e39391dffb7ada98444","observation_id":"b05242b8-3f58-4cb6-b355-12ec5e3ff3aa","resolution":{"observed_at":"2026-05-15T20:34:08.258343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-12T15:19:19.296232+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T15:19:19.296232+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":"1804.07461","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-07-04T09:19:44.134394Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","venue":"cs.CL","work_id":"1bb6fb0c-482d-43cf-94a8-ed18f72a5563","year":2018},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:8b56f856c20049b4cc8b0561fb425b1cf769699314275e81354d29a60fe1d3f1","observation_id":"dac2e12b-a208-4dac-be6e-f423cf1e2fe6","resolution":{"observed_at":"2026-05-15T20:34:08.261955Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":"2109.01652","doi":"10.3030/823782","metadata_source":"pith","pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Finetuned Language Models Are Zero-Shot Learners","venue":"cs.CL","work_id":"7ed6cdaa-ed67-4db4-aceb-b7e1b0e6e7c4","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:933ec4e28ebe107129939d3077914567bd5260c52f64bb346f7f0a0ad9c63736","observation_id":"23635a30-246e-4ba9-b4e8-79ce61bc5709","resolution":{"observed_at":"2026-05-15T20:34:08.265277Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":"1910.03771","doi":"10.48550/arxiv.1910.03771","metadata_source":"pith","pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","venue":"cs.CL","work_id":"9d86da8d-01d3-41af-a0d2-ee14897927a9","year":2019},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:da50aad669d03d7302d0328269427ea62e89b35a2cca6ec5c9a009e28f2d9209","observation_id":"8b5fc1b9-5018-4f6b-9899-270224ad3412","resolution":{"observed_at":"2026-05-15T20:34:08.268533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09690","last_updated":"2021-06-10T18:20:59Z","snapshot_observed_at":"2026-08-04T17:24:45.675795Z","submitted_at":"2021-02-19T00:23:59Z","title":"Calibrate Before Use: Improving Few-Shot Performance of Language Models","version":2},"cited_work":{"arxiv_id":"2102.09690","doi":"10.48550/arxiv.2102.09690","metadata_source":"arxiv_reference","pith_arxiv_id":"2102.09690","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Calibrate before use: Improving few- shot performance of language models","venue":"arXiv (Cornell University)","work_id":"cd67a9c7-e56a-43c3-8688-0cfddf32f697","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2102.09690","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:e6480340852774dfa4100222a4c3c38c09cc53817bbb666aa121a90fdddcff80","observation_id":"44ec5d43-9a94-4655-9930-48e61a3a461d","resolution":{"observed_at":"2026-05-15T20:34:08.272099Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.00049","last_updated":"2022-12-27T03:59:51Z","snapshot_observed_at":"2026-07-06T13:05:16.090823Z","submitted_at":"2022-04-29T19:18:37Z","title":"Prompt Consistency for Zero-Shot Task Generalization","version":2},"cited_work":{"arxiv_id":"2205.00049","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2205.00049","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2205.00049 , year=","venue":null,"work_id":"b68ce713-929f-4118-a3f3-e24d50094747","year":null},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"cited_paper":"/paper/2205.00049","citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:7d985c9cb15455050a68387cded36a6a1480889b107246aa871790e3b0dab2e6","observation_id":"bab857f6-9b58-4109-b43c-69fa69990089","resolution":{"observed_at":"2026-05-15T20:34:08.275559Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Is 2+2=4? Yes","venue":null,"work_id":"45caefc6-f4d3-4c97-bcec-647bd79bee84","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:6c16b1f2f2795a856b77a9a1c8cd7e9d3607e213f08fb3290946689c9b2ca194","observation_id":"93f9bf49-bd74-4324-a474-56a74bb934ea","resolution":{"observed_at":"2026-05-15T20:34:08.369552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"hidden states","venue":null,"work_id":"a79c9cda-00e1-4a3d-9ab0-fa10074f6859","year":2016},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:096396692959943fb9422df2fdca9724484f73985f4236f5f2437255930604a2","observation_id":"44ae3498-4e2b-4f8d-b4be-4a3b20ebf014","resolution":{"observed_at":"2026-05-15T20:34:08.371651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[text] = I loved this movie","venue":null,"work_id":"1da7279e-6704-4008-a825-4ed894096128","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:16009ed72a6cba3364f7fac27d4b862ac9d5b7377e33309a94ee8bb8ef7f38b1","observation_id":"669c4cac-f670-41fb-99f1-d862ba1ceac1","resolution":{"observed_at":"2026-05-15T20:34:08.354996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"‘ [content]","venue":null,"work_id":"d109ff37-a704-4427-ba94-89eb11ab1a53","year":2019},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:1a4a48aff6025fa4810cf8a054eaf785b6982368e048251f92d4647e815bced8","observation_id":"7e8f239f-3405-4df5-898c-b2342791e464","resolution":{"observed_at":"2026-05-15T20:34:08.357051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Here the label is a short sentence","venue":null,"work_id":"23e4635f-e928-4b9a-881c-3e96ef596104","year":2011},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:928ddd80170f69de66e8c4a536daaa0dbdbf9ad2ac0dfa18a5dfa343b589b427","observation_id":"ee62ca3e-f61e-4b6d-a780-8e1243e6fc66","resolution":{"observed_at":"2026-05-15T20:34:08.359284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"‘ [premise]","venue":null,"work_id":"3d02fa5d-fa17-440b-9305-33dc7dc35d2e","year":2014},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:1071bca62b20987c59b808a7a32d54a9a14ed2f130711b0a4e90af668357b1bd","observation_id":"d7abd8d6-dcc9-42a3-b49b-3cc077d35637","resolution":{"observed_at":"2026-05-15T20:34:08.361276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"[label]” is “negative","venue":null,"work_id":"25d4f743-f607-48e5-b59e-4f5c705f7bea","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:ad89a22510ac4c31207d85fc0ea63df9c4f79908cbb980f9f08316bdf1787788","observation_id":"5b215f2e-1d43-44a0-bf79-6af2a0aa907d","resolution":{"observed_at":"2026-05-15T20:34:08.363341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"yes” or “no","venue":null,"work_id":"667638d9-d56f-4716-b3a9-d2d70ce71112","year":2021},"citing_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T20:34:08.207848Z"},"links":{"citing_paper":"/paper/2212.03827"},"observation_digest":"sha256:e8b4d9ea8b44062c7113bc8385bb32ec7995d3ff6ffad76b61c56f58f50527f3","observation_id":"4bf9e264-3cfc-4706-9089-47164b0a879e","resolution":{"observed_at":"2026-05-15T20:34:08.365373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":9,"parse_uncertain":0,"unresolved":0,"verified_exact":25,"verified_fuzzy":10},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 96 inbound Pith citation observations for arXiv:2212.03827."}