{"as_of":"2026-08-07T12:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0187d0f1af5cda1750636e2b7a1d40aa50b46d625d98c1b217ef3db82dbf286b","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:38:05.468538Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:00:51.707342Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-06T18:00:51.707342Z","title":"When thinking llms lie: Unveiling the strategic deception of large language models in reasoning tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09406","last_updated":"2025-07-12T21:29:49Z","snapshot_observed_at":"2026-08-07T06:25:20.948241Z","submitted_at":"2025-07-12T21:29:49Z","title":"Adversarial Activation Patching: A Framework for Detecting and Mitigating Emergent Deception in Safety-Aligned Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:00:51.707342Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2507.09406"},"observation_digest":"sha256:a64ac28344c92509d6648fcbe058e6f1479b4051f570895a0b3454f04a9d4a71","observation_id":"d94b862f-9d0a-46a8-8e48-25a4526a7381","resolution":{"observed_at":"2026-08-06T18:00:51.707342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T15:52:45.041136Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19432","last_updated":"2025-08-26T21:01:45Z","snapshot_observed_at":"2026-08-05T15:52:29.325697Z","submitted_at":"2025-08-26T21:01:45Z","title":"Quantized but Deceptive? A Multi-Dimensional Truthfulness Evaluation of Quantized LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T15:52:45.041136Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2508.19432"},"observation_digest":"sha256:06bf6babf15394d07044331aa32b99dbc30b8bfde0f2f120f38ba4c0c3d9e3f7","observation_id":"0c106958-39d9-4aca-85ba-031dcddc8406","resolution":{"observed_at":"2026-08-05T15:52:45.041136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.04909","doi":"10.48550/arxiv.2506.04909","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking llms lie: Unveiling the strategic deception in representations of reasoning models","venue":"ArXiv.org","work_id":"f0f2ab10-0554-4dc4-9fc9-b850243a8925","year":2025},"citing_paper":{"arxiv_id":"2605.19270","last_updated":"2026-05-19T02:33:21Z","snapshot_observed_at":"2026-07-06T23:30:02.207108Z","submitted_at":"2026-05-19T02:33:21Z","title":"DECOR: Auditing LLM Deception via Information Manipulation Theory","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T06:27:10.445757Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2605.19270"},"observation_digest":"sha256:9e81e61af4c0cd59f2ee8b27045153baed0e937a63f0838e99255d91de28dd85","observation_id":"5d7330bb-6195-47f7-9d55-0d3ac29e083c","resolution":{"observed_at":"2026-05-20T06:28:05.389621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.04909","doi":"10.48550/arxiv.2506.04909","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking llms lie: Unveiling the strategic deception in representations of reasoning models","venue":"ArXiv.org","work_id":"f0f2ab10-0554-4dc4-9fc9-b850243a8925","year":2025},"citing_paper":{"arxiv_id":"2606.13310","last_updated":"2026-06-11T13:07:02Z","snapshot_observed_at":"2026-08-05T04:26:49.130444Z","submitted_at":"2026-06-11T13:07:02Z","title":"RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T06:34:39.457798Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2606.13310"},"observation_digest":"sha256:cc00ce2143a557c52ed42b3a35be9bd879ebcc863d29e58ab2ad9c4e96a0ec69","observation_id":"e4811b80-86b1-48d7-beab-a368e862aeaa","resolution":{"observed_at":"2026-07-03T15:18:33.716480Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.04909","doi":"10.48550/arxiv.2506.04909","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking llms lie: Unveiling the strategic deception in representations of reasoning models","venue":"ArXiv.org","work_id":"f0f2ab10-0554-4dc4-9fc9-b850243a8925","year":2025},"citing_paper":{"arxiv_id":"2607.02507","last_updated":"2026-07-02T17:59:23Z","snapshot_observed_at":"2026-07-07T00:07:56.573640Z","submitted_at":"2026-07-02T17:59:23Z","title":"What LLM Agents Say When No One Is Watching: Social Structure and Latent Objective Emergence in Multi-Agent Debates","version":1},"reference_index":116,"source":"arxiv_source","source_observed_at":"2026-07-03T13:02:46.485260Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2607.02507"},"observation_digest":"sha256:c1236c7c3b5cd830349c1177d55146207bf24718814df001786225790430f228","observation_id":"88499384-a89c-4608-a2f1-9f5addf98a37","resolution":{"observed_at":"2026-07-03T13:08:07.647083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-02T01:06:13.525747Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14791","last_updated":"2026-07-16T10:10:10Z","snapshot_observed_at":"2026-08-05T16:07:00.714582Z","submitted_at":"2026-07-16T10:10:10Z","title":"Transcoders for Investigating Deception in Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T01:06:13.525747Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2607.14791"},"observation_digest":"sha256:da3e84162a67705dbfc1edfff451f62faa63c801e8ff313a5bedf896017b7385","observation_id":"54f538bb-6061-47d0-a0c1-f4f38945e484","resolution":{"observed_at":"2026-08-02T01:06:13.525747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04909","snapshot_observed_at":"2026-08-05T13:40:57.774902Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03745","last_updated":"2026-08-04T14:38:06Z","snapshot_observed_at":"2026-08-07T12:01:03.905832Z","submitted_at":"2026-08-04T14:38:06Z","title":"Risky Business: Measuring The Faithfulness-Safety Tension","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T13:40:57.774902Z"},"links":{"cited_paper":"/paper/2506.04909","citing_paper":"/paper/2608.03745"},"observation_digest":"sha256:5e7195108a3f54b3606a228fe93720189d3de265937ff092207ba6155212a7f6","observation_id":"a8ada123-d371-4e1c-99e8-b656e1ef1880","resolution":{"observed_at":"2026-08-05T13:40:57.774902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04909/citation-record","integrity":"/paper/2506.04909/integrity","json":"/paper/2506.04909/citation-record.json","paper":"/paper/2506.04909"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:02.027941Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.027941Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:f56844032fc42e1f1ef1869e948e5cd6952d5a1c1cdfe7a87dd99eda5fc5ded5","observation_id":"ea1967ed-7fb3-4bfb-a259-2ff5ac84da73","resolution":{"observed_at":"2026-08-07T10:38:02.027941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.714373Z","title":"and Mitchell, T","venue":null,"work_id":"a0288f73-d878-4945-b926-42f1a4c1825c","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.079573Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:ae4c9601edeae0d5a0f7681c74fef3a57e4df3ce6563835b5cce16cfc290755b","observation_id":"e7f2c0be-31e9-46d6-b0b0-ecc9b43caf03","resolution":{"observed_at":"2026-08-07T10:38:08.795250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.612428Z","title":"Discovering latent knowledge in language models without supervision, March 2024","venue":null,"work_id":"3a9dcc5d-925b-498a-8644-3507537fdf64","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.247102Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:33f3112439164ae976016d2ccc4ccfa1c0544c3ccedbc273ca62563aa663b067","observation_id":"bc0d4022-cb2d-464d-b884-7197d6d32dcc","resolution":{"observed_at":"2026-08-07T10:38:08.698680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.372679Z","title":"Localizing lying in llama: Understanding instructed dishonesty on true-false questions through prompting, probing, and patching, November 2023","venue":null,"work_id":"87f5da13-4d2f-48a6-b79d-867007612717","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.364755Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:071de80bcb37afe81aaa65c852a783d0aee6c5190cf836278a24fdab4a02ccd6","observation_id":"f8cea9d1-5ff4-40ad-ad5a-f045ea23bb2c","resolution":{"observed_at":"2026-08-07T10:38:08.506436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:02.444405Z","title":"A mathematical framework for transformer circuits","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.444405Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:d0b7b9ddaeb7a7d9a51dc38aa1217bd2601f52f450f6c35cb19ded22fea2b79f","observation_id":"9bd5f315-7111-4238-8abe-a69eb08545b4","resolution":{"observed_at":"2026-08-07T10:38:02.444405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:08.158374Z","title":"R., and Hubinger, E","venue":null,"work_id":"2ad0f992-6327-4764-9a2e-35600969089d","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.535294Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:9b0fdec32bb9295d3e522cc0a56e1b76a5f5aec780322bdbec5a962924630559","observation_id":"2276cea3-94aa-4d69-a342-392a370dd943","resolution":{"observed_at":"2026-08-07T10:38:08.264957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:02.688962Z","title":"Deception abilities emerged in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.688962Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:bb0ef5e244268ada03f01a9a368f8ca4c5166038d74d4a457edda8a764ca9685","observation_id":"7a6dbadb-b282-4992-87e3-ce9132f2a1b7","resolution":{"observed_at":"2026-08-07T10:38:02.688962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.961150Z","title":null,"venue":null,"work_id":"94508b43-9a42-4b31-8df5-ec8dad605301","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.814492Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:2d4c083d3dbd043b917cd1356c7b7a5edfae21cd85328923f3d12a95f76019dc","observation_id":"2ff6f362-bac0-4344-bdde-0a39ca7bbecf","resolution":{"observed_at":"2026-08-07T10:38:08.038259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.879156Z","title":"Y., Song, S., Hajishirzi, H., Kornblith, S., Farhadi, A., and Schmidt, L","venue":null,"work_id":"2ee038e9-f19c-4e91-9409-775d2bcc0f56","year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:02.936643Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:048f1ed9b7586b7fbceb3de1cc2135a618546e09e914db7dc2efa3ad5ef39521","observation_id":"e43df03a-f2fd-4914-b20e-501298c205bc","resolution":{"observed_at":"2026-08-07T10:38:07.930957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:03.057101Z","title":"Large language models ( LLMs ): Survey , technical frameworks, and future challenges","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.057101Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:f1e61f1ae78f24976a614f8eb364994033b76d27a39ed2191b02e9cc5c3d10da","observation_id":"eb049e20-912a-435a-9dc0-7d6644527c2b","resolution":{"observed_at":"2026-08-07T10:38:03.057101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-07T10:38:03.263205Z","title":"Truthfulqa: Measuring how models mimic human falsehoods, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.263205Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:82435e4c97fd170511480e8579825c8e5bbf4d859e995c137209240544ce9bd7","observation_id":"c7fae250-c8c1-4559-96df-6ab28f368dd5","resolution":{"observed_at":"2026-08-07T10:38:03.263205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:03.360826Z","title":"Cognitive dissonance: Why do language model outputs disagree with internal representations of truthfulness? In Bouamor, H., Pino, J., and Bali, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.360826Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:2e60915eb159bfa7e3de2c01e6643df7a5b83f4f99f419ab7406e822310fd85d","observation_id":"eaec6f86-1555-4ac8-9a0c-172a61f328ca","resolution":{"observed_at":"2026-08-07T10:38:03.360826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.726346Z","title":"Faithful chain-of-thought reasoning","venue":null,"work_id":"a194580f-dc26-4f75-b348-e475ff022e8a","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.478408Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:8e030e4efe5e665e42fdadd607853d1c4291dcfe84800fa0486fd5a8d0b4af6c","observation_id":"76fa1426-5849-493d-95a1-7de680df65f6","resolution":{"observed_at":"2026-08-07T10:38:07.798430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04984","last_updated":"2025-01-14T20:16:01Z","snapshot_observed_at":"2026-07-29T23:20:20.918596Z","submitted_at":"2024-12-06T12:09:50Z","title":"Frontier Models are Capable of In-context Scheming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04984","snapshot_observed_at":"2026-08-07T10:38:03.666723Z","title":"Frontier models are capable of in-context scheming, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.666723Z"},"links":{"cited_paper":"/paper/2412.04984","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:0867247c41f4239836b446b3fee982501d483fe82dfcabdc36a1601aeadf82b4","observation_id":"04ccd2a7-7794-45a0-8e7f-e4ce61697f42","resolution":{"observed_at":"2026-08-07T10:38:03.666723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.635819Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":"f6284096-d302-4c59-843a-c222b6e874b7","year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.799399Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:235051c64f275f238040549601eda60adac61f9453a9053bfc634c233a6515a5","observation_id":"e39c8e0a-756d-447f-9f73-173382954953","resolution":{"observed_at":"2026-08-07T10:38:07.670229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.502398Z","title":"Interpreting gpt: The logit lens","venue":null,"work_id":"26f82554-7b9f-4255-9409-469d7acd897b","year":2020},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:03.887928Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:36bf6d4a7811510e78d45f3c285b58e999f80b90779f81c27ee57abe6d3921ac","observation_id":"d1ed4703-bad2-484d-8e89-88bf35bfc607","resolution":{"observed_at":"2026-08-07T10:38:07.579925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.387484Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":null,"work_id":"9bb660f5-c84d-4658-ba0f-88dbd8f620ff","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.007213Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:1727ed20a0e29dfa8e23ace30936c48c484e2c0b08c194fb66eb87c1049c9ec9","observation_id":"31df4916-8878-494f-8a3b-af405b58173a","resolution":{"observed_at":"2026-08-07T10:38:07.443129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.241818Z","title":"Large language models can strategically deceive their users when put under pressure, July 2024","venue":null,"work_id":"b3f42f50-f124-406b-8c09-676f29df3a2f","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.146066Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:09cbf13f6da5fa63ae6634fe9f058eba5de8a266425e9bb708bb6be6199f8e34","observation_id":"b9f1ec61-4e4e-4481-ae94-4bd3ba97bcaa","resolution":{"observed_at":"2026-08-07T10:38:07.324772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.115459Z","title":null,"venue":null,"work_id":"fcd9c5b1-3513-48a2-bb74-b09b6331c5e6","year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.241493Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:5861bbcc76ab3166908990bf460c10442b0eb031feae8573f48f7bd61f5cfd69","observation_id":"218aef99-cf33-4e90-9326-c7eadb5a5ed0","resolution":{"observed_at":"2026-08-07T10:38:07.182106Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:07.015844Z","title":"Qwq-32b: Embracing the power of reinforcement learning, March 2025","venue":null,"work_id":"29cc75db-0e78-4e9f-b40c-00d9aa811f10","year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.365502Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:47c5b7d572ecd8b6164f17bbae7e86dfb74c567a3517b42ccd7058fb029d89eb","observation_id":"72b9e771-10e1-463a-913d-1715f16c41cb","resolution":{"observed_at":"2026-08-07T10:38:07.052683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:06.840220Z","title":"L., Sharma, A","venue":null,"work_id":"ba1fcf76-2b52-4e8c-ae9c-ef5509b02114","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.499667Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:5dca7569204e680d0924e1242215d439a2bf50158ab624c3d9ac62b981dfa6c6","observation_id":"45882e9b-bb11-42a8-8948-87676ff49ba7","resolution":{"observed_at":"2026-08-07T10:38:06.977885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:06.485557Z","title":"M., Thiergart, L., Leech, G., Udell, D., Vazquez, J","venue":null,"work_id":"25d2c09f-3b63-4398-af20-882abe61a772","year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.595514Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:58878cacf50ce889d4e2ed7d4e05456f5316854367ca5ab7c9b51a0d0c1986fc","observation_id":"16202906-50d5-480e-8771-259ecba3b2d7","resolution":{"observed_at":"2026-08-07T10:38:06.634111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:04.707675Z","title":"N., Kaiser, ., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.707675Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:2ef773f630eb70ce58a40d55cb3b0a1fbc51d21a6d7c05acb8539766fd84487a","observation_id":"5b7709c1-7bc1-44a4-a501-4270a70d1004","resolution":{"observed_at":"2026-08-07T10:38:04.707675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T10:38:04.803196Z","title":"H., Le, Q., and Zhou, D","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.803196Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:e088465f55bd297079cc772ed6863b02b28d1c9ac88fe62a849ff8516837abb2","observation_id":"a4a24f4c-66a9-4b16-83dc-98d75501138b","resolution":{"observed_at":"2026-08-07T10:38:04.803196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:04.941743Z","title":"V., Zhou, D., et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:04.941743Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:ba301e44c636108d780e2a2b477716f7f10c31fcbc48b808489f74205fd61dd3","observation_id":"c5497388-7067-482c-a3f7-2173f61acfe6","resolution":{"observed_at":"2026-08-07T10:38:04.941743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T10:38:05.057064Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.057064Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:d3cb5b05a32f03da32241c0b154d2e4266950018d5b8731ade75919a3a4069d6","observation_id":"0a8dbc01-e3a2-4e56-9687-20e072740ba3","resolution":{"observed_at":"2026-08-07T10:38:05.057064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:06.150916Z","title":"and Buzsaki, G","venue":null,"work_id":"6c75053b-d12c-47bc-8fb0-ac2f20952346","year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.173034Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:7fc7845e73b4eab68e4ad9d4b6bd58e2dc1de4846cb2a6fae0c9a3f16b6b6f3c","observation_id":"edeeb8da-e7d3-422c-b360-568a11f9766b","resolution":{"observed_at":"2026-08-07T10:38:06.305864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:05.292046Z","title":"Reasoning models better express their confidence, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.292046Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:8b283225cc84addae60618afc8e5e214b381b7acd4123e77bc235e7c5236cffb","observation_id":"9d6147ff-ac8b-4ef5-a946-2a7379e31e15","resolution":{"observed_at":"2026-08-07T10:38:05.292046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:05.934675Z","title":"J., Wang, Z., Mallen, A., Basart, S., Koyejo, S., Song, D., Fredrikson, M., Kolter, J","venue":null,"work_id":"a682df95-0e77-46c5-be30-988b5f2320a6","year":2023},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.352408Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:27bd18d4c17e15812571a2e11192f01122e017d90951774dbaf7679d0c001b8d","observation_id":"2acd94a5-b29b-4172-b401-4f472583fc24","resolution":{"observed_at":"2026-08-07T10:38:06.029672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:38:05.720429Z","title":"write newline","venue":null,"work_id":"6c933c9a-3761-4f55-bb76-796e629c493a","year":null},"citing_paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:38:05.468538Z"},"links":{"citing_paper":"/paper/2506.04909"},"observation_digest":"sha256:e303856fc8c724ee612cebe1137a748d49fdb94ced13cef6c5e85b786ce2082b","observation_id":"ce335cbb-4e4f-4164-ad63-f60edd888e08","resolution":{"observed_at":"2026-08-07T10:38:05.813873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04909","last_updated":"2025-06-05T11:44:19Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T10:28:37.330537Z","submitted_at":"2025-06-05T11:44:19Z","title":"When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 7 inbound Pith citation observations for arXiv:2506.04909."}