{"as_of":"2026-08-20T00:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8ec55ee539262121e2b08a13a503560ad584ede5644e8aa6edf4d21af88b86f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T04:22:42.672539Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":22,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2404.11584","last_updated":"2024-04-17T17:32:41Z","snapshot_observed_at":"2026-08-04T23:37:27.678120Z","submitted_at":"2024-04-17T17:32:41Z","title":"The Landscape of Emerging AI Agent Architectures for Reasoning, Planning, and Tool Calling: A Survey","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T23:16:41.679855Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2404.11584"},"observation_digest":"sha256:f1bb65a26a041401f1963e9df0d0ba90b6795392a4a53ac8d3fd8d13f62b1d6f","observation_id":"8fdb77d7-d2dc-4ce1-8537-ae97433be3fa","resolution":{"observed_at":"2026-05-16T23:16:41.775976Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-12T22:01:11.497659Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.08088","last_updated":"2024-11-12T18:45:08Z","snapshot_observed_at":"2026-08-17T17:30:03.420101Z","submitted_at":"2024-11-12T18:45:08Z","title":"Safety case template for frontier AI: A cyber inability argument","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T22:01:11.497659Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2411.08088"},"observation_digest":"sha256:12c4dcc95c812aed316d62f56078c18cf146c5a645673cbefd121cf63e48e511","observation_id":"7d59b646-c460-4aa0-ab38-03d00e2d72a5","resolution":{"observed_at":"2026-08-12T22:01:11.497659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-10T20:33:38.451939Z","title":"single -minded loyalty","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07913","last_updated":"2025-02-11T14:30:44Z","snapshot_observed_at":"2026-08-16T21:12:20.846465Z","submitted_at":"2025-01-14T07:55:18Z","title":"Governing AI Agents","version":2},"reference_index":158,"source":"pdf_text","source_observed_at":"2026-08-10T20:33:38.451939Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2501.07913"},"observation_digest":"sha256:3cd60b59e11b6fa94cafe90e4c91f62a22bdd771ff99769f0dce21cc8109a119","observation_id":"3e154b21-d89c-41c5-86a8-6d1a2f369891","resolution":{"observed_at":"2026-08-10T20:33:38.451939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-10T14:43:14.797897Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15054","last_updated":"2025-06-08T18:34:17Z","snapshot_observed_at":"2026-08-15T01:34:40.694025Z","submitted_at":"2025-01-25T03:34:15Z","title":"Unraveling Token Prediction Refinement and Identifying Essential Layers in Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:14.797897Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2501.15054"},"observation_digest":"sha256:08d01a5c95ddcc434e0947aa3c95f9b929db648662d08f6dda6850e1ab2a5825","observation_id":"85c92d42-2d8c-43e8-9bf8-053b56e0a0dc","resolution":{"observed_at":"2026-08-10T14:43:14.797897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2502.04230","last_updated":"2026-05-22T02:22:15Z","snapshot_observed_at":"2026-08-19T02:55:15.314250Z","submitted_at":"2025-02-06T17:15:08Z","title":"XAttnMark: Learning Robust Audio Watermarking with Cross-Attention","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-25T08:30:15.011210Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2502.04230"},"observation_digest":"sha256:d2eb82eb8d8c6e5a00f4cd2b3e942dbb7403fc96b9241fa37e929650137ae77a","observation_id":"4a0bdd51-1176-47e1-9bf7-e0faea062590","resolution":{"observed_at":"2026-05-25T08:30:31.501832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-16T04:22:42.672539Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.01420","last_updated":"2025-07-03T17:52:47Z","snapshot_observed_at":"2026-08-20T00:14:58.043944Z","submitted_at":"2025-05-02T17:57:14Z","title":"Evaluating Frontier Models for Stealth and Situational Awareness","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T04:22:42.672539Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2505.01420"},"observation_digest":"sha256:72168baf710d933e42062a4a553de338c9195dacc434a7f7803a5eb3f0579c5e","observation_id":"d48a54de-5817-475b-84ab-1c65ceeba0f4","resolution":{"observed_at":"2026-08-16T04:22:42.672539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-07T00:23:51.822116Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21082","last_updated":"2025-06-17T07:13:35Z","snapshot_observed_at":"2026-08-14T07:06:27.623078Z","submitted_at":"2025-06-17T07:13:35Z","title":"Safety Features for a Centralised AGI Project","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:23:51.822116Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2507.21082"},"observation_digest":"sha256:cb7f6ae03ed11589325be6f1b1e303519098906229a18109817cb2aec5461ffa","observation_id":"70c9af57-e56a-4e6c-9703-e3cbd36e3cc6","resolution":{"observed_at":"2026-08-07T00:23:51.822116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-15T17:19:50.098601Z","title":"S.; Goldstein, S.; O'Gara, A.; Chen, M.; and Hendrycks, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.12920","last_updated":"2025-08-18T13:40:10Z","snapshot_observed_at":"2026-08-17T16:28:08.164676Z","submitted_at":"2025-08-18T13:40:10Z","title":"Do Large Language Model Agents Exhibit a Survival Instinct? An Empirical Study in a Sugarscape-Style Simulation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T17:19:50.098601Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2508.12920"},"observation_digest":"sha256:80e613929adf573b1cb8efeb4a661b50ed4926e2def61bb46b913054212cdfc8","observation_id":"55ceeacc-2e29-4b7d-b2c2-ca8e43c16364","resolution":{"observed_at":"2026-08-15T17:19:50.098601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T19:58:07.759972Z","title":"https://ar5iv.labs.arxiv.org/html/2308.14752","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.16628","last_updated":"2025-08-15T11:25:05Z","snapshot_observed_at":"2026-08-14T22:13:21.651415Z","submitted_at":"2025-08-15T11:25:05Z","title":"The Impact of Artificial Intelligence on Human Thought","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-05T19:58:07.759972Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2508.16628"},"observation_digest":"sha256:964b70c3bb4ae5a1c61bc046c60c8ecfb50081e8b184a352240a3cec831c47b4","observation_id":"ab6bd055-1c17-4c4c-87f2-16e6d0cd6ba7","resolution":{"observed_at":"2026-08-05T19:58:07.759972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2509.23023","last_updated":"2026-05-14T13:52:45Z","snapshot_observed_at":"2026-08-13T21:37:55.864755Z","submitted_at":"2025-09-27T00:40:19Z","title":"Deceive, Detect, and Disclose: Large Language Models Play Mini-Mafia","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-18T13:25:17.313704Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2509.23023"},"observation_digest":"sha256:e163b6bfc5885c419ccfa77b208105c6393a741a47744f064bdd03b166dfb5c3","observation_id":"e080a251-6d31-467f-bb62-3332da192d7a","resolution":{"observed_at":"2026-05-18T13:26:24.815133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2601.09600","last_updated":"2026-05-21T22:51:29Z","snapshot_observed_at":"2026-08-19T09:29:51.237822Z","submitted_at":"2026-01-14T16:15:26Z","title":"Information Access of the Oppressed: Freirean Design for Emancipatory Information Access","version":3},"reference_index":148,"source":"pdf_text","source_observed_at":"2026-05-25T07:27:39.494140Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2601.09600"},"observation_digest":"sha256:d7055547e8b018d00af6ef9005a6d46b750fab6541b0ccc023f55a6c59466785","observation_id":"00847b8c-d90d-42c6-bacf-ac21d8df4758","resolution":{"observed_at":"2026-05-25T07:30:27.948925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2604.01151","last_updated":"2026-05-09T19:42:28Z","snapshot_observed_at":"2026-08-17T16:14:05.459842Z","submitted_at":"2026-04-01T17:08:05Z","title":"Detecting Multi-Agent Collusion Through Multi-Agent Interpretability","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T22:46:39.337887Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2604.01151"},"observation_digest":"sha256:1bf9d3cce1f7d4c9cc83ddbee63fa7e3b700a759ae013d05b931e1e4013a1e09","observation_id":"d1618da5-8278-473f-beb6-08d88addf160","resolution":{"observed_at":"2026-05-13T22:48:22.964745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2604.05274","last_updated":"2026-04-07T00:18:28Z","snapshot_observed_at":"2026-07-06T22:54:04.491386Z","submitted_at":"2026-04-07T00:18:28Z","title":"Simulating the Evolution of Alignment and Values in Machine Intelligence","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-10T20:15:46.311347Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2604.05274"},"observation_digest":"sha256:109752244b26283858117d89d9ff6318a0f55ba80e1cd0043ecc6e8e7cf62fc4","observation_id":"3f59aa94-558a-43c4-87f6-163eadec8634","resolution":{"observed_at":"2026-05-10T22:05:48.449641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2604.13386","last_updated":"2026-04-15T01:21:52Z","snapshot_observed_at":"2026-08-13T20:41:45.606489Z","submitted_at":"2026-04-15T01:21:52Z","title":"Linear Probe Accuracy Scales with Model Size and Benefits from Multi-Layer Ensembling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T13:50:14.400797Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2604.13386"},"observation_digest":"sha256:88803cf89fc8b7b37414f7f238acde824e5f20b507a87ef827136464670b94c7","observation_id":"2441a7bf-ce08-4871-96fe-3b5481b42109","resolution":{"observed_at":"2026-05-10T14:10:29.191771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2604.21139","last_updated":"2026-04-22T23:00:49Z","snapshot_observed_at":"2026-07-06T23:07:47.244208Z","submitted_at":"2026-04-22T23:00:49Z","title":"Slot Machines: How LLMs Keep Track of Multiple Entities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T23:48:36.019590Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2604.21139"},"observation_digest":"sha256:9877f907d76d1e6f9d6a3b6dc57807e07ace4a1169287cdcd203526a3c6ec016","observation_id":"cdd2fa72-0248-4394-a7df-180d8b9c69ab","resolution":{"observed_at":"2026-05-11T14:01:04.046214Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2605.12809","last_updated":"2026-05-12T23:01:29Z","snapshot_observed_at":"2026-08-15T05:36:43.446023Z","submitted_at":"2026-05-12T23:01:29Z","title":"Correcting Influence: Unboxing LLM Outputs with Orthogonal Latent Spaces","version":1},"reference_index":239,"source":"arxiv_source","source_observed_at":"2026-05-14T20:17:01.224864Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2605.12809"},"observation_digest":"sha256:d3573de4d5b8d20e82b07a41f52cf219a0e4714350ff45077d64697f412f6dfd","observation_id":"2b008938-2cba-41d5-a14b-c9c0530aac54","resolution":{"observed_at":"2026-05-14T20:17:55.537487Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2605.15377","last_updated":"2026-05-18T07:58:13Z","snapshot_observed_at":"2026-08-15T23:22:36.347748Z","submitted_at":"2026-05-14T20:06:52Z","title":"Ensemble Monitoring for AI Control: Diverse Signals Outweigh More Compute","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-20T20:12:03.715605Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2605.15377"},"observation_digest":"sha256:756b2dafd4a5bcb80ee2b46dc06d38e0eb395f680c8da08fd860b4bb782c2cdd","observation_id":"55a8c0fa-0d46-4c56-b91a-e99cbb69e10b","resolution":{"observed_at":"2026-05-20T20:13:43.399083Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2606.05194","last_updated":"2026-07-08T19:54:16Z","snapshot_observed_at":"2026-08-06T06:51:53.907927Z","submitted_at":"2026-05-11T21:09:00Z","title":"Temporal Preference Concepts and their Functions in a Large Language Model","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-30T22:16:47.743387Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2606.05194"},"observation_digest":"sha256:3556ebad1a51334ac7714955d67700b177e8251decab464052d350c9a698bede","observation_id":"e0850522-cc4c-4a6d-b3a9-e4588c5ca04c","resolution":{"observed_at":"2026-07-01T14:05:47.186844Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-07-12T17:03:44.315006Z","title":"Park, Simon Goldstein, Aidan O’Gara, Michael Chen, and Dan Hendrycks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.05194","last_updated":"2026-07-08T19:54:16Z","snapshot_observed_at":"2026-08-06T06:51:53.907927Z","submitted_at":"2026-05-11T21:09:00Z","title":"Temporal Preference Concepts and their Functions in a Large Language Model","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-12T17:03:44.315006Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2606.05194"},"observation_digest":"sha256:fef07dced281a1734fc88e2a27bd52fa6cd02153e18006164d09c6dba8206042","observation_id":"c071e1c9-a7f0-4a95-bb91-8ad7a83c8038","resolution":{"observed_at":"2026-07-12T17:03:44.315006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2606.05330","last_updated":"2026-06-03T18:17:20Z","snapshot_observed_at":"2026-08-14T12:16:24.588905Z","submitted_at":"2026-06-03T18:17:20Z","title":"A Model of Multi-turn Human Persuadability Using Probabilistic Belief Tracing","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-28T06:17:01.173495Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2606.05330"},"observation_digest":"sha256:5894dd1ac0a9006002dac7af87a52042135f86101f613f63a1c46098021889bc","observation_id":"8a3f1075-186a-449b-b0a2-55435a3b799c","resolution":{"observed_at":"2026-07-02T08:16:47.557548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2606.13310","last_updated":"2026-06-11T13:07:02Z","snapshot_observed_at":"2026-08-15T02:53:25.014777Z","submitted_at":"2026-06-11T13:07:02Z","title":"RogueAI: A Reverse Turing Test for Detecting Licensed AI Deception in Dialogue","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T06:34:39.457798Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2606.13310"},"observation_digest":"sha256:2e50e5013c27787c5a4ba2b78ed6a964320f0559fa29a4fd998e72b766c045c4","observation_id":"2a312bf8-81cf-49b0-acbf-840faee45865","resolution":{"observed_at":"2026-07-03T15:18:33.739073Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2607.01033","last_updated":"2026-07-01T15:01:30Z","snapshot_observed_at":"2026-08-17T12:21:30.498323Z","submitted_at":"2026-07-01T15:01:30Z","title":"The Model Organism Lottery: Model Organism Interpretability Strongly Depends on Training Methodology","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-02T15:57:48.589980Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2607.01033"},"observation_digest":"sha256:fe77c85decb8fe3f33beeb06df8b259c18dda2f79265bbe0f33e6f408ac74a4f","observation_id":"f52ccfb1-c325-4ff3-a71f-49b148eab779","resolution":{"observed_at":"2026-07-02T16:07:08.176437Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions","version":1},"cited_work":{"arxiv_id":"2308.14752","doi":"10.48550/arxiv.2308.14752","metadata_source":"pith","pith_arxiv_id":"2308.14752","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S., Goldstein, S., O'Gara, A., Chen, M., and Hendrycks, D","venue":"cs.CY","work_id":"76d7059c-f36d-482c-bf84-2e38bde458b5","year":2023},"citing_paper":{"arxiv_id":"2607.08066","last_updated":"2026-07-09T02:48:36Z","snapshot_observed_at":"2026-08-18T08:26:26.366694Z","submitted_at":"2026-07-09T02:48:36Z","title":"Persuasion Attacks Can Decrease Effectiveness of CoT Monitoring","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-07-10T00:52:47.537142Z"},"links":{"cited_paper":"/paper/2308.14752","citing_paper":"/paper/2607.08066"},"observation_digest":"sha256:6cd450ca8de2f542d9c7683f11734a69b046a344d070679cfd5ca09969d5dfaf","observation_id":"fdaa1d02-3c7a-49f4-83b0-308edfcea7f0","resolution":{"observed_at":"2026-07-10T00:56:41.067496Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2308.14752/citation-record","integrity":"/paper/2308.14752/integrity","json":"/paper/2308.14752/citation-record.json","paper":"/paper/2308.14752"},"outbound":[],"paper":{"arxiv_id":"2308.14752","last_updated":"2023-08-28T17:59:35Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-18T21:40:19.754791Z","submitted_at":"2023-08-28T17:59:35Z","title":"AI Deception: A Survey of Examples, Risks, and Potential Solutions"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2308.14752."}