{"as_of":"2026-08-07T10:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:33c8152f61616c61e4ae30d300b15fe45119b98adf0bc54bc26e03fde67192b2","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:39:38.745141Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T05:40:54.002702Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T10:15:44.642321Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"cited_work":{"arxiv_id":"2507.12872","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.12872","snapshot_observed_at":"2026-07-01T10:15:44.642321Z","title":"arXiv preprint arXiv:2507.12872 , year=","venue":null,"work_id":"776d4b20-4762-436b-b86e-523ce82019f0","year":null},"citing_paper":{"arxiv_id":"2606.31916","last_updated":"2026-06-30T16:22:12Z","snapshot_observed_at":"2026-08-02T10:24:05.379334Z","submitted_at":"2026-06-30T16:22:12Z","title":"Theory of Mind and Persuasion Beyond Conversation: Assessing the Capacity of LLMs to Induce Belief States via Planning and Action","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-07-01T05:40:54.002702Z"},"links":{"cited_paper":"/paper/2507.12872","citing_paper":"/paper/2606.31916"},"observation_digest":"sha256:98f82b7c2fc80298614dfbba05b7ef6a2ddba0e119690ffdda3727dd9da8ce7b","observation_id":"5afbc83d-aa33-4eae-bf22-40991007b544","resolution":{"observed_at":"2026-07-01T10:15:44.643863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.12872/citation-record","integrity":"/paper/2507.12872/integrity","json":"/paper/2507.12872/citation-record.json","paper":"/paper/2507.12872"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.03336","last_updated":"2024-11-07T09:18:26Z","snapshot_observed_at":"2026-07-06T19:45:44.484683Z","submitted_at":"2024-10-29T17:55:29Z","title":"Towards evaluations-based safety cases for AI scheming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.03336","snapshot_observed_at":"2026-08-06T16:39:33.388263Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:33.388263Z"},"links":{"cited_paper":"/paper/2411.03336","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:94ef38ba17d400604380e23e4baadee158c176837de62e06e59fb48e9b3ce637","observation_id":"3c8a5245-5b7a-4bec-a5f1-ef815bdc27a2","resolution":{"observed_at":"2026-08-06T16:39:33.388263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21514","last_updated":"2024-10-28T20:34:51Z","snapshot_observed_at":"2026-07-06T19:41:10.332290Z","submitted_at":"2024-10-28T20:34:51Z","title":"Sabotage Evaluations for Frontier Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21514","snapshot_observed_at":"2026-08-06T16:39:33.510287Z","title":"arXiv:2410.21514","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:33.510287Z"},"links":{"cited_paper":"/paper/2410.21514","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:11973879c34de0e88432944129d7162264df2194ae21efa92a372e962d31ad41","observation_id":"3dd1535e-65ea-4ea5-b03b-12a6419c341d","resolution":{"observed_at":"2026-08-06T16:39:33.510287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18565","last_updated":"2025-05-05T20:52:36Z","snapshot_observed_at":"2026-08-06T04:13:55.623494Z","submitted_at":"2025-04-21T11:39:22Z","title":"RepliBench: Evaluating the Autonomous Replication Capabilities of Language Model Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18565","snapshot_observed_at":"2026-08-06T16:39:33.918076Z","title":"arXiv:2504.18565","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:33.918076Z"},"links":{"cited_paper":"/paper/2504.18565","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:9a2a4d8bfe2043489961769a7c416dead941b40ef3d571c07c1ddd439b89d345","observation_id":"5daba2b2-56c1-428a-9a14-c27588fa87d8","resolution":{"observed_at":"2026-08-06T16:39:33.918076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21572","last_updated":"2024-10-28T22:08:28Z","snapshot_observed_at":"2026-07-06T19:41:10.332290Z","submitted_at":"2024-10-28T22:08:28Z","title":"Safety cases for frontier AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21572","snapshot_observed_at":"2026-08-06T16:39:34.221645Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:34.221645Z"},"links":{"cited_paper":"/paper/2410.21572","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:261ca6aca4bc5417fb5faae0057b497f5f5a048e1501e10714108c1f22a59de5","observation_id":"a4c7f23e-f1b2-4122-a1ef-f42783b790ab","resolution":{"observed_at":"2026-08-06T16:39:34.221645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-06T16:39:34.368752Z","title":"arXiv:2212.03827","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:34.368752Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:c395e91e2a8f1d2701eadb5a8f77c62ba13927e7466b5ed3a6427499627f7261","observation_id":"4fd43903-ab84-4a90-8136-6b47cfd3699f","resolution":{"observed_at":"2026-08-06T16:39:34.368752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:34.536021Z","title":"doi: 10.1126/science","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:34.536021Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:0688846ac6e4d1e2da83da7cfd35a3a2f43b969b26a760031bf5bbacc24fc599","observation_id":"eb126926-4866-4039-ba8a-20e9b42e8c9c","resolution":{"observed_at":"2026-08-06T16:39:34.536021Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08088","last_updated":"2024-11-12T18:45:08Z","snapshot_observed_at":"2026-07-06T19:49:21.632336Z","submitted_at":"2024-11-12T18:45:08Z","title":"Safety case template for frontier AI: A cyber inability argument","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.08088","snapshot_observed_at":"2026-08-06T16:39:34.797703Z","title":"Google DeepMind","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:34.797703Z"},"links":{"cited_paper":"/paper/2411.08088","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:606e146e63150c227d02169e30d9ae633cfb5975d199994c80094e00c9cb69b3","observation_id":"2f5945e5-cfdb-47ac-96b1-87d871d8d1b3","resolution":{"observed_at":"2026-08-06T16:39:34.797703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-06T16:39:34.936205Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:34.936205Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:b2097d2e5ff0eca2fa08379efef64a488c3de0e8ecca124fc95fc3cb74119612","observation_id":"092ed59a-3920-4f54-a142-9417237a6709","resolution":{"observed_at":"2026-08-06T16:39:34.936205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00586","last_updated":"2024-11-30T21:02:06Z","snapshot_observed_at":"2026-07-06T19:59:33.383151Z","submitted_at":"2024-11-30T21:02:06Z","title":"Evaluating Large Language Models' Capability to Launch Fully Automated Spear Phishing Campaigns: Validated on Human Subjects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00586","snapshot_observed_at":"2026-08-06T16:39:35.146041Z","title":"Dan Hendrycks, Mantas Mazeika, and Thomas Woodside","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:35.146041Z"},"links":{"cited_paper":"/paper/2412.00586","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:09f04ed14d284aa1bd16ed7de49ceec210f4a951aab3c208c5d0788230d22674","observation_id":"d8251340-9940-4529-9b26-d5f2fa42defb","resolution":{"observed_at":"2026-08-06T16:39:35.146041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12001","last_updated":"2023-10-09T22:57:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-21T03:35:06Z","title":"An Overview of Catastrophic AI Risks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12001","snapshot_observed_at":"2026-08-06T16:39:35.301994Z","title":"Evan Hubinger, Chris van Merwijk, Vladimir Mikulik, Joar Skalse, and Scott Garrabrant","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:35.301994Z"},"links":{"cited_paper":"/paper/2306.12001","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:83b9a7ddb0aac3c45d2759dc8072afb660103d78fdb5e2d4084dc5fd04ed91fd","observation_id":"f4514e2c-d7c9-4557-878f-44d85e69c1a3","resolution":{"observed_at":"2026-08-06T16:39:35.301994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06700","last_updated":"2024-12-09T17:46:28Z","snapshot_observed_at":"2026-07-06T20:04:01.034597Z","submitted_at":"2024-12-09T17:46:28Z","title":"Facade: High-Precision Insider Threat Detection Using Deep Contextual Anomaly Detection","version":1},"cited_work":{"arxiv_id":"2412.06700","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06700","snapshot_observed_at":"2026-08-06T16:39:39.445873Z","title":"Facade: High-Precision Insider Threat Detection Using Deep Contextual Anomaly Detection","venue":"cs.CR","work_id":"ddb3c8db-92a2-4e43-b42c-e97ee4d170e0","year":2024},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:35.608070Z"},"links":{"cited_paper":"/paper/2412.06700","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:4e78d1db11abbdffbd78dfda9e0e57fc4e6f364ac2817ac2b5a7e5d1f46c4716","observation_id":"40ebb534-918c-4ad6-a927-557843c99c51","resolution":{"observed_at":"2026-08-06T16:39:39.585842Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17315","last_updated":"2025-01-28T21:52:15Z","snapshot_observed_at":"2026-07-06T20:27:37.265266Z","submitted_at":"2025-01-28T21:52:15Z","title":"A sketch of an AI control safety case","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17315","snapshot_observed_at":"2026-08-06T16:39:35.743325Z","title":"arXiv:2501.17315","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:35.743325Z"},"links":{"cited_paper":"/paper/2501.17315","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:6c04296dccea65ea8bac029a2a04893195f22da36fce057b7c1ab63bb6ecadd8","observation_id":"35a9ba68-1cf3-48a7-a135-5e6f71fe3865","resolution":{"observed_at":"2026-08-06T16:39:35.743325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14499","last_updated":"2026-07-10T21:48:09Z","snapshot_observed_at":"2026-08-01T19:38:55.929115Z","submitted_at":"2025-03-18T17:59:31Z","title":"Measuring AI Ability to Complete Long Software Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14499","snapshot_observed_at":"2026-08-06T16:39:35.884820Z","title":"Rudolf Laine, Bilal Chughtai, Jan Betley, Kaivalya Hariharan, Mikita Balesni, Jérémy Scheurer, Marius Hobbhahn, Alexander Meinke, and Owain Evans","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:35.884820Z"},"links":{"cited_paper":"/paper/2503.14499","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:6d7d4420904848d0a46f595ef8ce6627fac364f648e2b17b53fb24d4fe06863a","observation_id":"ca512bf0-6067-4e17-8342-e8b8d5e4dcdc","resolution":{"observed_at":"2026-08-06T16:39:35.884820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12480","last_updated":"2025-04-04T16:36:02Z","snapshot_observed_at":"2026-07-06T20:08:16.471575Z","submitted_at":"2024-12-17T02:33:45Z","title":"Subversion Strategy Eval: Can language models statelessly strategize to subvert control protocols?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12480","snapshot_observed_at":"2026-08-06T16:39:36.071018Z","title":"Yohan Mathew, Ollie Matthews, Robert McCarthy, Joan Velja, Christian Schroeder de Witt, Dylan Cope, and Nandi Schoots","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:36.071018Z"},"links":{"cited_paper":"/paper/2412.12480","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:7d6df66e53ab344abf2e55cca49bbb73f202ee2919e3dc0d6ce1d1a6eb951d9a","observation_id":"82d8d8d1-f84e-4a27-b3c1-ece7c72ba992","resolution":{"observed_at":"2026-08-06T16:39:36.071018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:36.234981Z","title":"arXiv:2410.03768","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:36.234981Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:67de3d519375323abe32e1507f2fd09d280d0e6cfbd005f12ed024116f9f8da3","observation_id":"f295ef85-315e-4427-ad9d-383551dc10ce","resolution":{"observed_at":"2026-08-06T16:39:36.234981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.01724","last_updated":"2017-03-03T21:17:05Z","snapshot_observed_at":"2026-07-06T05:25:21.010274Z","submitted_at":"2017-01-06T18:56:49Z","title":"DeepStack: Expert-Level Artificial Intelligence in No-Limit Poker","version":3},"cited_work":{"arxiv_id":"1701.01724","doi":null,"metadata_source":"pith","pith_arxiv_id":"1701.01724","snapshot_observed_at":"2026-08-06T16:39:39.203872Z","title":"DeepStack: Expert-Level Artificial Intelligence in No-Limit Poker","venue":"cs.AI","work_id":"73e489df-6346-4419-a557-21997cb935c3","year":2017},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:36.399493Z"},"links":{"cited_paper":"/paper/1701.01724","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:d48d511adfdc0df0065207f50e909e256c6ad3abcbaeead24cc77e68b8fdd38d","observation_id":"ab9e34a3-8724-443e-82f5-200cdb825ffd","resolution":{"observed_at":"2026-08-06T16:39:39.324600Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04018","last_updated":"2026-06-22T12:47:48Z","snapshot_observed_at":"2026-08-07T10:46:59.056034Z","submitted_at":"2025-06-04T14:46:47Z","title":"AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04018","snapshot_observed_at":"2026-08-06T16:39:36.526571Z","title":"Joe Needham, Giles Edkins, Govind Pimpale, Henning Bartsch, and Marius Hobbhahn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:36.526571Z"},"links":{"cited_paper":"/paper/2506.04018","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:767fe36540082d4b7eb38a9f5fe7b5b581fbd4810f9e3fb38d97442a6d29a099","observation_id":"4a7314a0-47fe-4c6f-85f8-3eaf24427fd8","resolution":{"observed_at":"2026-08-06T16:39:36.526571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23836","last_updated":"2025-07-16T11:25:40Z","snapshot_observed_at":"2026-07-06T21:33:12.217704Z","submitted_at":"2025-05-28T12:03:09Z","title":"Large Language Models Often Know When They Are Being Evaluated","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23836","snapshot_observed_at":"2026-08-06T16:39:36.667793Z","title":"Sella Nevo, Dan Lahav, Ajay Karpur, Yogev Bar-On, Henry Alexander Bradley, and Jeff Alstott","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:36.667793Z"},"links":{"cited_paper":"/paper/2505.23836","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:f4bf2d2d8808904135add5ba73b062381ef80c7b2445a195968d5549d9a0f7d1","observation_id":"d196b84c-0b27-4bf2-a575-2e893d947be3","resolution":{"observed_at":"2026-08-06T16:39:36.667793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.00626","last_updated":"2025-05-04T15:50:51Z","snapshot_observed_at":"2026-08-04T21:45:55.051017Z","submitted_at":"2022-08-30T02:12:47Z","title":"The Alignment Problem from a Deep Learning Perspective","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.00626","snapshot_observed_at":"2026-08-06T16:39:36.793291Z","title":"arXiv:2209.00626","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:36.793291Z"},"links":{"cited_paper":"/paper/2209.00626","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:891af8c1c84d6c869cdee6cfae5756b0ca2e18357a81b151f8521dc781327040","observation_id":"7579f224-aec7-4c7a-b527-bf7b68bc9725","resolution":{"observed_at":"2026-08-06T16:39:36.793291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00967","last_updated":"2024-12-01T21:11:28Z","snapshot_observed_at":"2026-07-06T19:59:47.022132Z","submitted_at":"2024-12-01T21:11:28Z","title":"Linear Probe Penalties Reduce LLM Sycophancy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00967","snapshot_observed_at":"2026-08-06T16:39:36.959394Z","title":"org/abs/2412.00967","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:36.959394Z"},"links":{"cited_paper":"/paper/2412.00967","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:0d2158d35fa07da116ccc4b3ab6ad89c774109d24c9fd63102766fff4cdfc2e8","observation_id":"4e3323b6-488b-486c-a837-1b926db7d428","resolution":{"observed_at":"2026-08-06T16:39:36.959394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13793","last_updated":"2024-04-05T12:26:11Z","snapshot_observed_at":"2026-08-03T18:07:25.978533Z","submitted_at":"2024-03-20T17:54:26Z","title":"Evaluating Frontier Models for Dangerous Capabilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13793","snapshot_observed_at":"2026-08-06T16:39:37.129859Z","title":"arXiv:2403.13793","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:37.129859Z"},"links":{"cited_paper":"/paper/2403.13793","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:19e6a9822b4d6b691cb5fa7fea56ab5232f79167215d930f969853aba5dbc6a0","observation_id":"e107757b-5e07-42fd-a604-df71d28c0cf0","resolution":{"observed_at":"2026-08-06T16:39:37.129859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14380","last_updated":"2024-03-21T13:14:40Z","snapshot_observed_at":"2026-07-06T17:48:19.344410Z","submitted_at":"2024-03-21T13:14:40Z","title":"On the Conversational Persuasiveness of Large Language Models: A Randomized Controlled Trial","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14380","snapshot_observed_at":"2026-08-06T16:39:37.344120Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:37.344120Z"},"links":{"cited_paper":"/paper/2403.14380","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:34011185ad963a86dc3fb0260e8c9cc66c56a88af9b71463f93e7da080029dcd","observation_id":"6f9fe1ac-4046-4eec-97e9-b50e3d3713ca","resolution":{"observed_at":"2026-08-06T16:39:37.344120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07590","last_updated":"2024-07-15T08:51:52Z","snapshot_observed_at":"2026-08-04T14:42:36.955119Z","submitted_at":"2023-11-09T17:12:44Z","title":"Large Language Models can Strategically Deceive their Users when Put Under Pressure","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07590","snapshot_observed_at":"2026-08-06T16:39:37.499516Z","title":"arXiv:2311.07590","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:37.499516Z"},"links":{"cited_paper":"/paper/2311.07590","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:d7d232fe37a6bbe1af5f1b21367df02eed211eca4540e3b62dc21910de75f37b","observation_id":"cbe3c3ce-fde7-47b6-9ef2-b51c5f46b7d1","resolution":{"observed_at":"2026-08-06T16:39:37.499516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:37.594525Z","title":"Melanie Sclar, Jane Yu, Maryam Fazel-Zarandi, Yulia Tsvetkov, Yonatan Bisk, Yejin Choi, and Asli Celikyilmaz","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:37.594525Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:263d8bd4444a3738e2fb594c12fe2d6ee1d888911e6e84b0636a60ae0eba8cc8","observation_id":"254ec2be-34e0-49e3-abd5-1b93ff8b788c","resolution":{"observed_at":"2026-08-06T16:39:37.594525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12175","last_updated":"2024-12-12T21:29:00Z","snapshot_observed_at":"2026-07-06T20:08:02.963967Z","submitted_at":"2024-12-12T21:29:00Z","title":"Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12175","snapshot_observed_at":"2026-08-06T16:39:37.772633Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:37.772633Z"},"links":{"cited_paper":"/paper/2412.12175","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:480e5296fa20e8dadfad1067c1f32f2a79eaba94c6bff0b3fe2632d61986a48d","observation_id":"8217a998-f671-41cf-85db-56b1dbc779ac","resolution":{"observed_at":"2026-08-06T16:39:37.772633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:37.919794Z","title":"Cameron Tice, Philipp Alexander Kreer, Nathan Helm-Burger, Prithviraj Singh Shahani, Fedor Ryzhenkov, Jacob Haimes, Felix Hofstätter, and Teun van der Weij","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:37.919794Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:7939b0d610ed7d87ac7f5ed82ed3b1f0484d21a1086fdf19a84e8f08045eadcc","observation_id":"06a423fb-b5be-4a4d-91f9-b1f054111d87","resolution":{"observed_at":"2026-08-06T16:39:37.919794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:38.000260Z","title":"Oriol Vinyals, Igor Babuschkin, Wojciech M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:38.000260Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:5ca63f04d612421286c0fd383545d898a4ace7bf45ffc089c75745d935aaecf0","observation_id":"f6142e7d-acb8-4907-bdbb-ae1fba6c8cdd","resolution":{"observed_at":"2026-08-06T16:39:38.000260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02306","last_updated":"2025-02-22T13:06:15Z","snapshot_observed_at":"2026-07-06T19:45:00.034364Z","submitted_at":"2024-11-04T17:31:02Z","title":"On Targeted Manipulation and Deception when Optimizing LLMs for User Feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02306","snapshot_observed_at":"2026-08-06T16:39:38.443628Z","title":"Shunyu Yao, Howard Chen, John Yang, and Karthik Narasimhan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:38.443628Z"},"links":{"cited_paper":"/paper/2411.02306","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:6a3c4a45ca03dcc216802a34525679dd1490a4e395b821dc50b653048eb72544","observation_id":"0c2aa3db-74cd-4152-8fa1-dfcef47d83d0","resolution":{"observed_at":"2026-08-06T16:39:38.443628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01206","last_updated":"2023-02-08T01:39:30Z","snapshot_observed_at":"2026-07-06T13:27:22.300465Z","submitted_at":"2022-07-04T05:30:22Z","title":"WebShop: Towards Scalable Real-World Web Interaction with Grounded Language Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.01206","snapshot_observed_at":"2026-08-06T16:39:38.613609Z","title":"arXiv:2207.01206","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:38.613609Z"},"links":{"cited_paper":"/paper/2207.01206","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:bb92a664e4c50b890c1e6da2da63833d28605b2ff8f8bfc39e73e5c5a63f89c0","observation_id":"88aa5c2d-366c-477e-8608-eb2a8a0693c1","resolution":{"observed_at":"2026-08-06T16:39:38.613609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:39.805421Z","title":"trusted inquiry","venue":null,"work_id":"fc6d9deb-9d01-4d49-953d-6d930ff7bbd8","year":2000},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:38.745141Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:5539d2f334142297f7d1b8e98d6e64a2a2c95e2780d4b0aabcfe623492c0a81f","observation_id":"d92ccab7-940a-463d-a334-18a3d93c4c69","resolution":{"observed_at":"2026-08-06T16:39:39.865103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:37.217624Z","title":"doi: 10.1017/S0140525X00076512","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":1978,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:37.217624Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:6f20e026d9e338dbbfec6c50b1cef17e9be73c6dc4cbac7482f986b293a2434e","observation_id":"a6467fe5-0cce-4521-b018-c2720d3a5487","resolution":{"observed_at":"2026-08-06T16:39:37.217624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:38.187897Z","title":"doi: 10.1038/s41586-019-1724-z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:38.187897Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:efd82a5096d679eac2576d9b1675360dfd9bc0a7458d1a024fa53295080810a8","observation_id":"54ff7abf-df0b-4ce8-84da-b5785de4165c","resolution":{"observed_at":"2026-08-06T16:39:38.187897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01820","last_updated":"2021-12-01T11:22:52Z","snapshot_observed_at":"2026-08-01T23:32:03.638122Z","submitted_at":"2019-06-05T04:43:25Z","title":"Risks from Learned Optimization in Advanced Machine Learning Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01820","snapshot_observed_at":"2026-08-06T16:39:35.476815Z","title":null,"venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:35.476815Z"},"links":{"cited_paper":"/paper/1906.01820","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:b19125e6d2041a4b2419eb75707c009fb789feb489cc67133df9d817ea7694a9","observation_id":"45ba4898-9e81-40d1-8001-4cef1191468b","resolution":{"observed_at":"2026-08-06T16:39:35.476815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-06T16:39:38.354084Z","title":"hawthorne effect","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:38.354084Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:005b7dfa9510c64795b91628c7644e91ab8b5252ab53d221f9848d7e4e477b04","observation_id":"9dbc06b4-a131-4486-9e6b-75de0ea0bbee","resolution":{"observed_at":"2026-08-06T16:39:38.354084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00667","last_updated":"2023-09-01T17:27:37Z","snapshot_observed_at":"2026-08-06T23:40:57.486399Z","submitted_at":"2023-09-01T17:27:37Z","title":"Taken out of context: On measuring situational awareness in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00667","snapshot_observed_at":"2026-08-06T16:39:33.641786Z","title":"arXiv:2309.00667","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:33.641786Z"},"links":{"cited_paper":"/paper/2309.00667","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:849b40cb67497f7b27d7a4b620aaef0ab875e6e6c37004df54850b395362a73e","observation_id":"f5b9cf08-8480-49e9-9190-96519907496a","resolution":{"observed_at":"2026-08-06T16:39:33.641786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:39:39.962667Z","title":"Anthropic","venue":null,"work_id":"29c080e3-73e6-4aae-b99d-d50cace8985f","year":2024},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:33.247242Z"},"links":{"citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:688ad45bbf547ada25a8539d91d43769eb266efc6df24cc5357e4143c8c1d4a6","observation_id":"ed0ebd9f-1d21-47c4-b787-933009b79d1d","resolution":{"observed_at":"2026-08-06T16:39:40.048618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10374","last_updated":"2025-04-14T16:22:11Z","snapshot_observed_at":"2026-07-06T21:09:11.849712Z","submitted_at":"2025-04-14T16:22:11Z","title":"Ctrl-Z: Controlling AI Agents via Resampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10374","snapshot_observed_at":"2026-08-06T16:39:33.772218Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T16:39:33.772218Z"},"links":{"cited_paper":"/paper/2504.10374","citing_paper":"/paper/2507.12872"},"observation_digest":"sha256:355844d7a3c15085baaf973d9a86ef01c3252fca564f246b78e314ac85fd6da6","observation_id":"86c9ba4b-f572-46cf-8cae-43602dff42c7","resolution":{"observed_at":"2026-08-06T16:39:33.772218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.12872","last_updated":"2025-07-17T07:45:53Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T04:50:21.603867Z","submitted_at":"2025-07-17T07:45:53Z","title":"Manipulation Attacks by Misaligned AI: Risk Analysis and Safety Case Framework"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2507.12872."}