{"as_of":"2026-08-10T23:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa17442ad47fe1aeca673f352488a29d8c38a2957330c40c0b7cd9aa787bf766","coverage":[{"denominator":115,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:19:44.695462Z","state":"measured"},{"denominator":178,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":178,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":78,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:51:52.127591Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T15:53:51.319268Z","title":"Korbak, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.19461","last_updated":"2025-08-26T22:29:31Z","snapshot_observed_at":"2026-08-07T19:17:20.900756Z","submitted_at":"2025-08-26T22:29:31Z","title":"Reliable Weak-to-Strong Monitoring of LLM Agents","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T15:53:51.319268Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2508.19461"},"observation_digest":"sha256:2b1de7304316e1b3fccd2f43dd9735b6c4c5bac6a6acf2e4eb884c16574702e8","observation_id":"542fb94c-7c11-436d-acc8-29d26a4fea0b","resolution":{"observed_at":"2026-08-05T15:53:51.319268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T00:06:41.352727Z","title":"arXiv preprint arXiv:2507.11473 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06169","last_updated":"2025-09-07T18:38:39Z","snapshot_observed_at":"2026-08-05T00:06:40.787897Z","submitted_at":"2025-09-07T18:38:39Z","title":"Reasoning Language Model for Personalized Lung Cancer Screening","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T00:06:41.352727Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2509.06169"},"observation_digest":"sha256:fe0c74362c8f2dc633c6cef853cf590ff68aab210a2a7d55fe56b1c096034da8","observation_id":"7df2a5da-d825-428d-a547-9e820323b24d","resolution":{"observed_at":"2026-08-05T00:06:41.352727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-04T23:10:46.316066Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06786","last_updated":"2025-09-08T15:13:23Z","snapshot_observed_at":"2026-08-10T09:28:02.808191Z","submitted_at":"2025-09-08T15:13:23Z","title":"\\texttt{R$^\\textbf{2}$AI}: Towards Resistant and Resilient AI in an Evolving World","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T23:10:46.316066Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2509.06786"},"observation_digest":"sha256:516ab031d836a9b93eb9e5176a40445a4403b646f8e73d4441e905d2ce98bf27","observation_id":"26c31bba-7c20-4d2b-b948-809a6de4f633","resolution":{"observed_at":"2026-08-04T23:10:46.316066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2509.21465","last_updated":"2026-05-15T11:35:18Z","snapshot_observed_at":"2026-07-06T22:30:46.129271Z","submitted_at":"2025-09-25T19:30:39Z","title":"Talking Trees: Reasoning-Assisted Induction of Decision Trees for Tabular Data","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T22:05:11.146329Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2509.21465"},"observation_digest":"sha256:3aa493ef7ae86e03108f1c14c8eac5e037da44f36bdd307cb53572c1b575e159","observation_id":"6270b95f-84e8-4a4b-bf6d-e438de84b155","resolution":{"observed_at":"2026-05-21T22:05:41.485914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-04T14:43:50.532615Z","title":"Chain of thought monitorability: A new and fragile opportunity for ai safety","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23694","last_updated":"2026-06-03T04:13:57Z","snapshot_observed_at":"2026-08-04T14:43:33.365212Z","submitted_at":"2025-09-28T07:05:17Z","title":"SafeSearch: Automated Red-Teaming of LLM-Based Search Agents","version":6},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:50.532615Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2509.23694"},"observation_digest":"sha256:f12cb75218e67376de16b2b5822f550d10eb35a7606be3baee5564551cf45529","observation_id":"8345d0bc-ee95-4be4-ad50-38bd4b3d3d22","resolution":{"observed_at":"2026-08-04T14:43:50.532615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-04T10:20:20.487943Z","title":"Tom Kwiatkowski, Jennimaria Palomaki, Olivia Red- field, Michael Collins, Ankur Parikh, Chris Alberti, Danielle Epstein, Illia Polosukhin, Jacob Devlin, Ken- ton Lee, and 1 others","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.10448","last_updated":"2026-06-06T05:24:14Z","snapshot_observed_at":"2026-08-07T11:41:38.195425Z","submitted_at":"2025-10-12T05:00:05Z","title":"RECON: Reasoning with Condensation for Efficient Retrieval-Augmented Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T10:20:20.487943Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2510.10448"},"observation_digest":"sha256:b8553d7a41d929d845ab2a0ed0b22fe7abde9d087374d39e43bee6114b929d1a","observation_id":"f9fe0967-cfc4-4a39-805b-4b68c40615c7","resolution":{"observed_at":"2026-08-04T10:20:20.487943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2510.24941","last_updated":"2026-05-26T22:58:09Z","snapshot_observed_at":"2026-08-08T14:16:18.113872Z","submitted_at":"2025-10-28T20:14:02Z","title":"Can Aha Moments Be Fake? Towards Quantifying Decorative and True Thinking in Chain-of-Thought","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T02:44:48.729794Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2510.24941"},"observation_digest":"sha256:5f6418f1be9388c1b3467aa008ea9499bca844e0da104110acf68e7bbbe8ffe8","observation_id":"01c74dc6-7c76-4cf3-a8cd-350684d2cd0a","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-04T07:43:10.083400Z","title":"Chain of thought monitorability: A new and fragile opportunity for ai safety.arXiv preprint arXiv:2507.11473,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.24941","last_updated":"2026-05-26T22:58:09Z","snapshot_observed_at":"2026-08-08T14:16:18.113872Z","submitted_at":"2025-10-28T20:14:02Z","title":"Can Aha Moments Be Fake? Towards Quantifying Decorative and True Thinking in Chain-of-Thought","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T07:43:10.083400Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2510.24941"},"observation_digest":"sha256:486c368d7b35cec9406d763181baa159302a49312b7317f178b775e07a163f18","observation_id":"c5c07aa8-1ca4-470b-8bbd-dbedad43250f","resolution":{"observed_at":"2026-08-04T07:43:10.083400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":4},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-15T07:43:11.620446Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:4d0d49203bcd503e3dd4d6dbf21bfde28cfb6df9ba1f5cb0b97a6eac9efd96b4","observation_id":"9f32fefd-b237-4492-b6a0-3bed6e38926b","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-04T07:31:49.234854Z","title":"Chain of thought monitorability: A new and fragile opportunity for ai safety.arXiv preprint arXiv: 2507.11473, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":5},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-04T07:31:49.234854Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:4a765e6bc7c69868f20fad76f11b24615112b9aefabdcda1aa9ddf960b579be4","observation_id":"63be8710-ddea-48c0-bb7a-fcb08eb1ec48","resolution":{"observed_at":"2026-08-04T07:31:49.234854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T21:06:36.680344Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2601.03267"},"observation_digest":"sha256:bcad858284391882fb22c0ad526ed1b898d4572f809b82d1f9a022d746c22bee","observation_id":"25498b6d-158d-469e-9e1e-a938e42aead3","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-03T12:10:01.515778Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2601.04175","last_updated":"2026-06-01T17:58:15Z","snapshot_observed_at":"2026-08-03T12:09:59.518112Z","submitted_at":"2026-01-07T18:42:04Z","title":"Legal Alignment for Safe and Ethical AI","version":2},"reference_index":2027,"source":"pdf_text","source_observed_at":"2026-08-03T12:10:01.515778Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2601.04175"},"observation_digest":"sha256:092bd0028f9194e0169bcfcf727b89f2d8bb94f7f707024ac5285553fd129642","observation_id":"8e235981-f841-4242-9ad2-48d22f97dc1e","resolution":{"observed_at":"2026-08-03T12:10:01.515778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-02T23:26:30.279570Z","title":"Tamera Lanham, Anna Chen, Ansh Radhakrishnan, Benoit Steiner, Carson Denison, Danny Hernandez, Dustin Li, Esin Durmus, Evan Hubinger, Jackson Kernion, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.13904","last_updated":"2026-07-23T02:27:49Z","snapshot_observed_at":"2026-08-10T06:53:01.769687Z","submitted_at":"2026-02-14T21:53:47Z","title":"Diagnosing Pathological Chain-of-Thought in Reasoning Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T23:26:30.279570Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2602.13904"},"observation_digest":"sha256:1272aca63a72490e979ad8c2e9b52f53ba84ef82f4b8c055dd376a63309c435f","observation_id":"89d4ddf9-bc13-4cc1-a565-b1934746b98a","resolution":{"observed_at":"2026-08-02T23:26:30.279570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-02T23:21:33.388146Z","title":"Chain of Thought Monitorability : A New and Fragile Opportunity for AI Safety","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14095","last_updated":"2026-07-06T07:40:26Z","snapshot_observed_at":"2026-08-09T00:10:29.296236Z","submitted_at":"2026-02-15T11:05:18Z","title":"NEST: Nascent Encoded Steganographic Thoughts","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T23:21:33.388146Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2602.14095"},"observation_digest":"sha256:a02ad7f02a16d21df38b1d032182b89aad32de686b66567fe29bcc4b6b858df4","observation_id":"024bf749-cdf2-417c-b718-5b33e39aa676","resolution":{"observed_at":"2026-08-02T23:21:33.388146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2602.23163","last_updated":"2026-04-29T17:15:03Z","snapshot_observed_at":"2026-07-31T11:33:59.999447Z","submitted_at":"2026-02-26T16:27:24Z","title":"A Decision-Theoretic Formalisation of Steganography With Applications to LLM Monitoring","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T19:01:08.076475Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2602.23163"},"observation_digest":"sha256:5087189c4f86c61688823cde5fc787884070c4cc28e0aa2b68f1c7c35c8c0409","observation_id":"501d69b7-4613-4601-a539-90ba11857e13","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-07-13T14:03:01.974171Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.02029","last_updated":"2026-06-05T06:21:20Z","snapshot_observed_at":"2026-07-30T23:04:23.206455Z","submitted_at":"2026-04-02T13:36:37Z","title":"The Latent Space: Foundation, Evolution, Mechanism, Ability, and Outlook","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-07-13T14:03:01.974171Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2604.02029"},"observation_digest":"sha256:98f4d6ff9d23ad2c3ba1b64de535a44218a04543fa95223e38b3030ed64dd25d","observation_id":"be144ec8-1e94-4630-aed8-4f7b8f324801","resolution":{"observed_at":"2026-07-13T14:03:01.974171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2604.04902","last_updated":"2026-04-06T17:50:06Z","snapshot_observed_at":"2026-08-08T20:33:38.074527Z","submitted_at":"2026-04-06T17:50:06Z","title":"Are Latent Reasoning Models Easily Interpretable?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T19:45:06.229399Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2604.04902"},"observation_digest":"sha256:4b9e7d0ec4266a3a94771164b36dce6f0119b3f557f00ff5636ebcfd02e2c616","observation_id":"eed55445-795f-48ad-b3d8-581e86d0b76f","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2604.06427","last_updated":"2026-04-07T20:04:14Z","snapshot_observed_at":"2026-08-10T21:45:22.612984Z","submitted_at":"2026-04-07T20:04:14Z","title":"The Depth Ceiling: On the Limits of Large Language Models in Discovering Latent Planning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-10T19:55:50.232871Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2604.06427"},"observation_digest":"sha256:082b305ed71d7795a1d8eaa7d532209b1ad0e587be1a02fd21041ec5e4a757b6","observation_id":"c7263dc6-26d3-40dc-9e8d-ea22def1584d","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2604.19638","last_updated":"2026-04-21T16:27:20Z","snapshot_observed_at":"2026-07-06T23:06:16.972438Z","submitted_at":"2026-04-21T16:27:20Z","title":"SafetyALFRED: Evaluating Safety-Conscious Planning of Multimodal Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T02:21:29.463149Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2604.19638"},"observation_digest":"sha256:5aa6944be4c1730411925163632f435211583bdfc2dec02ffffba6b4379f7864","observation_id":"6a740188-0dcb-4af5-970b-47487c67f185","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2604.22709","last_updated":"2026-04-27T06:21:25Z","snapshot_observed_at":"2026-07-06T23:09:05.682387Z","submitted_at":"2026-04-24T16:45:51Z","title":"Thinking Without Words: Efficient Latent Reasoning with Abstract Chain-of-Thought","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-08T11:52:00.969949Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2604.22709"},"observation_digest":"sha256:1c56319084bbc1983b177554c7d728fe02dc51e3630ec4999d9cae2981006bbf","observation_id":"b8696292-6404-4fc7-afe1-1e8abb7361bd","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2604.24801","last_updated":"2026-05-12T04:14:03Z","snapshot_observed_at":"2026-07-06T23:10:47.277692Z","submitted_at":"2026-04-27T02:39:02Z","title":"Architecture Determines Observability of Transformers","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-08T04:42:16.480831Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2604.24801"},"observation_digest":"sha256:c25cdfd23665e536814dc252a506f2142e5262084a7524e59389b45dd95deeda","observation_id":"f95ebe2e-a79f-4368-ac1d-f5ae071ba116","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2604.24801","last_updated":"2026-05-12T04:14:03Z","snapshot_observed_at":"2026-07-06T23:10:47.277692Z","submitted_at":"2026-04-27T02:39:02Z","title":"Architecture Determines Observability of Transformers","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:09.488225Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2604.24801"},"observation_digest":"sha256:a1b753cbb265b1aec89c321a1dd795431edb67e22d59332a8ecdf9c7be5c279d","observation_id":"8cede5f7-b7d7-4710-87e2-d88626198d4a","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.01048","last_updated":"2026-05-01T19:23:33Z","snapshot_observed_at":"2026-07-06T23:14:20.123289Z","submitted_at":"2026-05-01T19:23:33Z","title":"Compared to What? Baselines and Metrics for Counterfactual Prompting","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-09T19:02:46.991897Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.01048"},"observation_digest":"sha256:a438dcd5ba8eec838cc503042b07a60d8815792b4640c54ff0bc5500cba9bb0b","observation_id":"63d30539-b1c1-402f-bfb6-29b542e6691c","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.02398","last_updated":"2026-05-14T14:48:51Z","snapshot_observed_at":"2026-08-10T21:53:08.413763Z","submitted_at":"2026-05-04T09:40:21Z","title":"The Compliance Trap: How Structural Constraints Degrade Frontier AI Metacognition Under Adversarial Pressure","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T19:09:30.284613Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.02398"},"observation_digest":"sha256:977a3f08cd45f07562b82b45b42edbc7d31bd648e4a93abce672ac6cc0c68ed6","observation_id":"d820622e-aa7b-4b3a-8e4f-9666deca004b","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.02398","last_updated":"2026-05-14T14:48:51Z","snapshot_observed_at":"2026-08-10T21:53:08.413763Z","submitted_at":"2026-05-04T09:40:21Z","title":"The Compliance Trap: How Structural Constraints Degrade Frontier AI Metacognition Under Adversarial Pressure","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T06:35:31.424885Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.02398"},"observation_digest":"sha256:c357ede4e8750ac315ea8968039acccf09b33e12a47ea8408489e902f6bedce5","observation_id":"2490a3cc-d123-489f-bec7-92cad2b0bfcf","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:d1d98d2f2e35761494b2d351713c87bd93d325dbd5d5cefcd74e37f445ad97e2","observation_id":"00545680-df47-4709-8e81-3799ff98586f","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.08321","last_updated":"2026-05-08T16:23:47Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T16:23:47Z","title":"LLM Wardens: Mitigating Adversarial Persuasion with Third-Party Conversational Oversight","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T00:51:17.434889Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.08321"},"observation_digest":"sha256:988664e7c9cf99d68e968b9c73427fa18f17d86d2e3df236010dd24a9b57231c","observation_id":"0134727d-24c8-424a-b670-97131fac9c86","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.11746","last_updated":"2026-05-12T08:24:47Z","snapshot_observed_at":"2026-08-03T19:32:09.592136Z","submitted_at":"2026-05-12T08:24:47Z","title":"When Reasoning Traces Become Performative: Step-Level Evidence that Chain-of-Thought Is an Imperfect Oversight Channel","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T06:30:12.558660Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.11746"},"observation_digest":"sha256:836373f91738fa66bea435ef40424bdb0ec9541c344e4e8fce0b3de012132b99","observation_id":"e1c5ed0f-2d8c-46c5-9d09-eea15040da4b","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.12673","last_updated":"2026-05-12T19:22:45Z","snapshot_observed_at":"2026-08-02T02:31:32.394072Z","submitted_at":"2026-05-12T19:22:45Z","title":"Do Androids Dream of Breaking the Game? Systematically Auditing AI Agent Benchmarks with BenchJack","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-14T20:31:50.043920Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.12673"},"observation_digest":"sha256:76b17256587dcdb7aedc215d34ce441521b7cff7322efdd6bd03560026d2dd5c","observation_id":"bc9f9a25-82dc-4095-b9c5-322d5d6ad964","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.14454","last_updated":"2026-05-14T06:47:35Z","snapshot_observed_at":"2026-07-06T23:25:54.070869Z","submitted_at":"2026-05-14T06:47:35Z","title":"LiSA: Lifelong Safety Adaptation via Conservative Policy Induction","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-15T01:53:46.630161Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.14454"},"observation_digest":"sha256:fb69ae2579e5251fd5c78a572523b69a2785e062cd086d3c2d9566fdc8cb6fe4","observation_id":"e13d0afc-8695-4b05-8cdf-d0fb47c0359b","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.14912","last_updated":"2026-05-14T14:47:06Z","snapshot_observed_at":"2026-08-07T15:03:55.917143Z","submitted_at":"2026-05-14T14:47:06Z","title":"From Sycophantic Consensus to Pluralistic Repair: Why AI Alignment Must Surface Disagreement","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T20:26:13.783556Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.14912"},"observation_digest":"sha256:953893c54bdba02dcad702dfbb99abea3f5dc5967e8927a0f612f787573294dd","observation_id":"272007fa-eb74-46fd-8cdd-a94a49ce4c62","resolution":{"observed_at":"2026-06-30T20:35:03.004285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.15377","last_updated":"2026-05-18T07:58:13Z","snapshot_observed_at":"2026-07-06T23:26:41.848219Z","submitted_at":"2026-05-14T20:06:52Z","title":"Ensemble Monitoring for AI Control: Diverse Signals Outweigh More Compute","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-20T20:12:03.715605Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.15377"},"observation_digest":"sha256:a29c45650a56af37662688ec249401e6d5f043462482b9218de8c06b3934bb9d","observation_id":"c24e72bb-0c14-4a8e-a3c0-b7411ae3e6ab","resolution":{"observed_at":"2026-05-20T20:13:43.316688Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.16198","last_updated":"2026-05-15T17:13:27Z","snapshot_observed_at":"2026-08-06T00:18:17.955385Z","submitted_at":"2026-05-15T17:13:27Z","title":"Formal Methods Meet LLMs: Auditing, Monitoring, and Intervention for Compliance of Advanced AI Systems","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T17:26:02.346222Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.16198"},"observation_digest":"sha256:579343c2081b16132c5ac530427882a7afa0252692b6851afd1d69c46c628110","observation_id":"7ad951b6-2b0b-4be3-b4c1-4fbc3a54de08","resolution":{"observed_at":"2026-05-20T17:28:47.996777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.17187","last_updated":"2026-05-16T22:52:11Z","snapshot_observed_at":"2026-07-06T23:28:12.114488Z","submitted_at":"2026-05-16T22:52:11Z","title":"PluRule: A Benchmark for Moderating Pluralistic Communities on Social Media","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-20T14:05:14.737146Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.17187"},"observation_digest":"sha256:5b0f9c86f965be0c2249020b3782d5e0f21261a93b340c23d9afb9dc9ec449a0","observation_id":"313333b7-bf8a-4a27-ae83-577dc5a48e56","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.17672","last_updated":"2026-05-17T22:04:11Z","snapshot_observed_at":"2026-07-06T23:28:41.111402Z","submitted_at":"2026-05-17T22:04:11Z","title":"Stop When Reasoning Converges: Semantic-Preserving Early Exit for Reasoning Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T12:29:30.505761Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.17672"},"observation_digest":"sha256:949da8c86901bbe7e91e0c7e882dec61233aaf63520a2607b0945546d08b627a","observation_id":"4541e96e-4c36-4095-a05e-9b7643342e95","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.18549","last_updated":"2026-05-18T15:29:04Z","snapshot_observed_at":"2026-08-03T06:08:37.339767Z","submitted_at":"2026-05-18T15:29:04Z","title":"Monitoring the Internal Monologue: Probe Trajectories Reveal Reasoning Dynamics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:20.285841Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.18549"},"observation_digest":"sha256:e1dc9c921522b14b9cc8d2d38293708a2b1a5e6e0aeb54060a9196ca0ea6365e","observation_id":"42343de3-3760-45aa-8e91-63138567d29e","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.19092","last_updated":"2026-05-18T20:27:43Z","snapshot_observed_at":"2026-08-01T08:55:54.081829Z","submitted_at":"2026-05-18T20:27:43Z","title":"Counterfactual Likelihood Tests for Indirect Influence in Private Reasoning Channels","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T13:05:41.969600Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.19092"},"observation_digest":"sha256:4a63b3986ee319d11099f8b487354c0f670a37eac50e374359042184404813da","observation_id":"56c523a7-1443-4857-9bf8-53c9e8d34f88","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.21260","last_updated":"2026-05-20T14:51:20Z","snapshot_observed_at":"2026-07-29T20:35:26.564819Z","submitted_at":"2026-05-20T14:51:20Z","title":"On the Cost and Benefit of Chain of Thought: A Learning-Theoretic Perspective","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-21T05:09:37.588841Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.21260"},"observation_digest":"sha256:143162bf9fc10141d53067a648ce4724d835a690c83852fe67106503ca9ca560","observation_id":"42a5fc82-e545-48fc-a3be-77c90db11f7b","resolution":{"observed_at":"2026-05-21T05:13:58.661889Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.22870","last_updated":"2026-05-20T00:32:41Z","snapshot_observed_at":"2026-08-02T01:45:01.340059Z","submitted_at":"2026-05-20T00:32:41Z","title":"The Readout Shortcut: Positional Number Copying Dominates Arithmetic CoT Readout in Small Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-25T06:27:42.024094Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.22870"},"observation_digest":"sha256:94eceda0f6f716d25489df1a3d02554332b6979789a2129b5e7f40f5130e231d","observation_id":"2fefb117-0c87-4a23-8681-b86e8b170323","resolution":{"observed_at":"2026-05-25T06:30:25.605167Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.24462","last_updated":"2026-05-23T08:24:42Z","snapshot_observed_at":"2026-08-07T09:27:01.117028Z","submitted_at":"2026-05-23T08:24:42Z","title":"No Certificate, No Execution: Certified Traces as a Foundation for Trustworthy AI Agents","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T12:27:09.893183Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.24462"},"observation_digest":"sha256:f59e877a7bd89fba17d9190bb025c2420794887c0cc73b97edfcaed11d700726","observation_id":"0c422f65-466f-4de3-ab00-a792993675ab","resolution":{"observed_at":"2026-06-30T12:34:38.971438Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.25052","last_updated":"2026-05-24T12:57:01Z","snapshot_observed_at":"2026-08-10T22:06:13.844554Z","submitted_at":"2026-05-24T12:57:01Z","title":"Faithfulness Metrics Don't Measure Faithfulness: A Meta-Evaluation with Ground Truth","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T11:56:53.355299Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.25052"},"observation_digest":"sha256:4ee401c36a53faf01104f1cbe30eba9d0833c10f8d3b2fded3e3e53b3aa277cd","observation_id":"0d47f1bb-2106-4b33-ba7f-b634204078eb","resolution":{"observed_at":"2026-06-30T12:04:39.017442Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.28742","last_updated":"2026-06-05T17:02:41Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:01:50Z","title":"CORE: Contrastive Reflection Enables Rapid Improvements in Reasoning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T11:48:18.855264Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.28742"},"observation_digest":"sha256:f4426a31b8b24c1ebe07f2e684cdee30c29f329266349960aa63f8098dae4c3a","observation_id":"5f3c2b89-1ea8-4631-b873-17443aa63a70","resolution":{"observed_at":"2026-06-29T11:53:23.838406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.29192","last_updated":"2026-05-28T00:08:35Z","snapshot_observed_at":"2026-07-06T23:38:37.178378Z","submitted_at":"2026-05-28T00:08:35Z","title":"ReasonOps: Operator Segmentation for LLM Reasoning Traces","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T08:04:44.270536Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.29192"},"observation_digest":"sha256:82189bd25fe0ed1d80aa2af2ad934ccf4c1aa1c9f2b0483cded81c704d14ad7f","observation_id":"9533fabc-59a2-494c-8636-d57885408967","resolution":{"observed_at":"2026-06-29T08:13:15.914008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.07157","last_updated":"2026-08-04T17:04:36Z","snapshot_observed_at":"2026-08-07T23:11:38.083619Z","submitted_at":"2026-06-05T11:17:08Z","title":"Think Fast: Estimating No-CoT Task-Completion Time Horizons of Frontier AI Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T22:10:01.701850Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.07157"},"observation_digest":"sha256:210ac7247b283c63d7553b4f553cfc6ddd57e0406eb6c073ab0ede2468e8eb8d","observation_id":"a8d0b19b-5204-441b-ba74-3a9b740f2dfb","resolution":{"observed_at":"2026-07-02T17:07:13.017238Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.07157","last_updated":"2026-08-04T17:04:36Z","snapshot_observed_at":"2026-08-07T23:11:38.083619Z","submitted_at":"2026-06-05T11:17:08Z","title":"Think Fast: Estimating No-CoT Task-Completion Time Horizons of Frontier AI Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T05:50:40.480874Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.07157"},"observation_digest":"sha256:f3af50bcc4e59d3c9711f5f75c7ad517ef5088773794066eb88d4d65fe5c2b7e","observation_id":"dc8a9399-7603-4b36-b853-7ac4a847fbcf","resolution":{"observed_at":"2026-06-29T05:53:08.786506Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.08629","last_updated":"2026-06-07T13:47:11Z","snapshot_observed_at":"2026-08-07T04:03:10.261869Z","submitted_at":"2026-06-07T13:47:11Z","title":"Sycophancy Towards Researchers Drives Performative Misalignment","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-27T18:52:29.375027Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.08629"},"observation_digest":"sha256:65eeaf4dc7abbb1ad466f9de3b4cc02e0a1d32bbfd6180678c21b3ed58acd7b6","observation_id":"d9b1ef5e-4f70-4b76-8495-a0d0b40be888","resolution":{"observed_at":"2026-07-02T22:27:26.211572Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.09931","last_updated":"2026-06-07T16:36:58Z","snapshot_observed_at":"2026-08-08T10:57:53.795341Z","submitted_at":"2026-06-07T16:36:58Z","title":"A Note on the Strategic Confinement Problem","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T17:30:12.165074Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.09931"},"observation_digest":"sha256:6833eed4a3ba647a6697238fcb3ae8c4b811f8815b70885fa0c58b7aef4f2483","observation_id":"48ec688a-a5cc-42f0-a504-05e311b68ee3","resolution":{"observed_at":"2026-06-27T17:31:06.808576Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.10456","last_updated":"2026-06-09T06:04:30Z","snapshot_observed_at":"2026-08-07T22:43:09.547652Z","submitted_at":"2026-06-09T06:04:30Z","title":"The Distributed Detectability Band Against Marginal-Preserving Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T12:58:22.056355Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.10456"},"observation_digest":"sha256:70d28bf7440a51ec443245bfa499b4073cf6d947c7f8ed80cb86a332ec5be1b6","observation_id":"1c22a08a-e98b-46fa-90c8-abb472bd2ad5","resolution":{"observed_at":"2026-07-03T05:57:41.866414Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.10747","last_updated":"2026-06-09T11:57:02Z","snapshot_observed_at":"2026-08-05T14:48:05.204090Z","submitted_at":"2026-06-09T11:57:02Z","title":"The Arbiter Agent: Continually Monitoring Multi-Agent Conversations to Detect Emergent Misalignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T13:26:14.457195Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.10747"},"observation_digest":"sha256:f082cb0355cff050d7510df22905439ad55eeef03f34387b2f6d3fea98f47be4","observation_id":"38c0b967-0b4c-4ea7-bdb0-ab921b64b788","resolution":{"observed_at":"2026-06-27T13:30:56.614999Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.12689","last_updated":"2026-06-10T21:23:22Z","snapshot_observed_at":"2026-07-06T23:51:35.904251Z","submitted_at":"2026-06-10T21:23:22Z","title":"Observable Patterns Are Not Explanations: A Causal-Geometric Analysis of Latent Reasoning Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-27T09:36:05.700067Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.12689"},"observation_digest":"sha256:8fe71e6253dda4450cad0c3cc41a3d614f25a0dd7ad7f27ad385604aecbedce7","observation_id":"3eecd365-6f83-4a9b-9d61-2854cab0eb6a","resolution":{"observed_at":"2026-07-03T11:18:03.821668Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.17478","last_updated":"2026-06-16T03:41:29Z","snapshot_observed_at":"2026-08-06T02:24:09.497908Z","submitted_at":"2026-06-16T03:41:29Z","title":"Decoding Hidden Deception in Reasoning LLMs: Activation Explainers for Deception Auditing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T01:28:38.810889Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.17478"},"observation_digest":"sha256:1bde5763d8b97c15eef0b4abf3d08e78aa415b68c049b1affb92425c7655c706","observation_id":"56f6f921-80cb-4205-9a06-c20b67647b62","resolution":{"observed_at":"2026-07-03T20:18:56.656841Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.20560","last_updated":"2026-06-18T17:59:46Z","snapshot_observed_at":"2026-07-06T23:55:43.830896Z","submitted_at":"2026-06-18T17:59:46Z","title":"How Transparent is DiffusionGemma?","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-26T18:23:41.734117Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.20560"},"observation_digest":"sha256:b9ad4a310fa204d5cd66858ba7726658413a76d6c0a3041f02f215e03aa55c37","observation_id":"c822910c-de5b-4e92-80a4-93e3150ad721","resolution":{"observed_at":"2026-07-04T03:09:29.706294Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.24014","last_updated":"2026-06-22T23:35:49Z","snapshot_observed_at":"2026-08-02T14:27:26.249523Z","submitted_at":"2026-06-22T23:35:49Z","title":"Reinforcement Learning Towards Broadly and Persistently Beneficial Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-26T07:51:13.283619Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.24014"},"observation_digest":"sha256:06af08406de92bf1867e386a22c7e13797aa0fccce9f6685ecd65b43a8086d2e","observation_id":"5bc94bd1-c13a-4a51-9dda-e6243a7d5e45","resolution":{"observed_at":"2026-07-04T11:39:46.771704Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.26523","last_updated":"2026-06-25T01:58:38Z","snapshot_observed_at":"2026-08-06T19:44:14.778081Z","submitted_at":"2026-06-25T01:58:38Z","title":"Radical AI Interpretability","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-26T05:26:47.854890Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.26523"},"observation_digest":"sha256:f0a30e4fa15ddb2d87c2b57c0f85242acd20cc28483a3fd6d0bbf94f4aadd2b3","observation_id":"419cd2fb-efd0-444c-8e98-3f32e0810863","resolution":{"observed_at":"2026-07-04T13:09:51.070994Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.28425","last_updated":"2026-06-25T19:42:39Z","snapshot_observed_at":"2026-08-02T13:33:32.015808Z","submitted_at":"2026-06-25T19:42:39Z","title":"Tool Use Enables Undetectable Steganography in Multi-Agent LLM Systems","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-30T00:42:20.220668Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.28425"},"observation_digest":"sha256:92dffae6a64fe3c8cb52d97d51e0b70f4e9d1c6a6db117b148da543f6758484b","observation_id":"2165b35c-e23b-4005-acf9-c3f861bbce40","resolution":{"observed_at":"2026-07-01T16:15:50.102892Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.29712","last_updated":"2026-06-29T02:34:52Z","snapshot_observed_at":"2026-07-07T00:03:41.292432Z","submitted_at":"2026-06-29T02:34:52Z","title":"Why Struggle with Continuous Latents? Interpretable Discrete Latent Reasoning via Rendered Compression","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T06:43:20.893142Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.29712"},"observation_digest":"sha256:cf96fc6dcbb180df31688345a94435320df8390e0645d8cc5428866095e33ea9","observation_id":"5027a41d-c9c5-4cd7-a106-81d19138bc75","resolution":{"observed_at":"2026-06-30T06:44:18.726440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2606.32038","last_updated":"2026-06-30T17:59:32Z","snapshot_observed_at":"2026-08-02T04:33:32.900362Z","submitted_at":"2026-06-30T17:59:32Z","title":"Introspective Coupling: Self-Explanation Training Tracks Behavioral Change Despite Fixed Supervision","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-01T05:18:30.190239Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2606.32038"},"observation_digest":"sha256:ed4dfdfb86605403ee986bf6ce25e79f3302606aacf7d8bb7dbb1f465fd8a038","observation_id":"58f7a6e6-5852-4328-9c08-2e6ea1b24c7d","resolution":{"observed_at":"2026-07-01T10:35:42.791677Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2607.01047","last_updated":"2026-07-01T15:08:02Z","snapshot_observed_at":"2026-08-07T14:53:02.059078Z","submitted_at":"2026-07-01T15:08:02Z","title":"Conversable Complexity: Agentic LLM Collectives as Interpretable Substrates","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-07-02T12:46:40.700728Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.01047"},"observation_digest":"sha256:b23782ba7275a162bbf06cdb04c21530331f2c6af029d785b198bb88a7c7607d","observation_id":"0b1f7055-17d5-4225-b04d-ed5ec15c0ebc","resolution":{"observed_at":"2026-07-02T12:46:56.198325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2607.01571","last_updated":"2026-07-02T01:03:49Z","snapshot_observed_at":"2026-08-09T18:08:38.112191Z","submitted_at":"2026-07-02T01:03:49Z","title":"Geometric Signatures of Reasoning: A Spectral Perspective on Task Hardness","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-03T17:36:09.322804Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.01571"},"observation_digest":"sha256:4befc6a4dfec307aff500ea206762c8f54490b9490f56eda9a68e69896c4da3c","observation_id":"e2e6535b-bda1-4760-91a8-2638e341c5b3","resolution":{"observed_at":"2026-07-03T17:38:43.202586Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2607.02510","last_updated":"2026-07-02T17:59:43Z","snapshot_observed_at":"2026-07-07T00:07:56.573640Z","submitted_at":"2026-07-02T17:59:43Z","title":"Online Safety Monitoring for LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T12:53:49.681641Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.02510"},"observation_digest":"sha256:bc6e105ffa81db939b1a03ae2624347a18dbc341820b1b5f1109b7484f131700","observation_id":"d86fa7b3-9659-458f-b319-16261d1d91b1","resolution":{"observed_at":"2026-07-03T12:58:07.490637Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2607.02514","last_updated":"2026-07-08T20:25:40Z","snapshot_observed_at":"2026-07-12T23:17:37.892425Z","submitted_at":"2026-07-02T17:59:56Z","title":"Distributed Attacks in Persistent-State AI Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-03T11:47:05.585463Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.02514"},"observation_digest":"sha256:7b9bc5f2b0e2b60f6fe59713f43a1410a9c5157aa04949db02ea54e6149ad511","observation_id":"a45c86ca-3278-4a1a-8fff-70ec459ee952","resolution":{"observed_at":"2026-07-03T11:48:04.376898Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-07-12T07:59:05.507834Z","title":"GitHub repository","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02514","last_updated":"2026-07-08T20:25:40Z","snapshot_observed_at":"2026-07-12T23:17:37.892425Z","submitted_at":"2026-07-02T17:59:56Z","title":"Distributed Attacks in Persistent-State AI Control","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-12T07:59:05.507834Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.02514"},"observation_digest":"sha256:6972debc06807b87a11fc314c0d45022bd021bfafbbd5109ff055e3ef174cf6b","observation_id":"0985f9cf-8ed0-4e46-9831-2174196571ee","resolution":{"observed_at":"2026-07-12T07:59:05.507834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-07-12T14:28:50.627444Z","title":"arXiv preprint arXiv:2507.11473 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05407","last_updated":"2026-06-09T03:22:53Z","snapshot_observed_at":"2026-08-07T08:54:21.406314Z","submitted_at":"2026-06-09T03:22:53Z","title":"Position: Preventing AI-Generated CSAM Necessitates New Approaches to AI Safety","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-07-12T14:28:50.627444Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.05407"},"observation_digest":"sha256:dc511e4c793cb14c225ada7598e2818ccaa74ab3717f9e79db602648c5402c68","observation_id":"07902bed-b5ca-49f9-96d4-8d36a6f4b10b","resolution":{"observed_at":"2026-07-12T14:28:50.627444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2607.07184","last_updated":"2026-07-08T09:17:47Z","snapshot_observed_at":"2026-08-07T19:35:24.965554Z","submitted_at":"2026-07-08T09:17:47Z","title":"Predicting LLM Safety Before Release by Simulating Deployment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-09T18:07:42.556329Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.07184"},"observation_digest":"sha256:faabd926a5e728cbb7fd499590e1851d2adc6dbed4866a84498814248ecca03b","observation_id":"3a8df77f-a393-4a11-a01a-5f512aa34551","resolution":{"observed_at":"2026-07-09T18:16:25.820530Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2607.08066","last_updated":"2026-07-09T02:48:36Z","snapshot_observed_at":"2026-08-06T18:29:44.776853Z","submitted_at":"2026-07-09T02:48:36Z","title":"Persuasion Attacks Can Decrease Effectiveness of CoT Monitoring","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-07-10T00:52:47.537142Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.08066"},"observation_digest":"sha256:8e1778df8ce87535b9c8bd4407882eb98a4ed12d0bb583bcc00a3a204f9d3ca9","observation_id":"454b0589-1219-414e-8397-1debf5570977","resolution":{"observed_at":"2026-07-10T00:56:40.987209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-07-14T15:45:54.532529Z","title":"Chain of thought monitorability: A new and fragile opportunity for AI safety","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09786","last_updated":"2026-08-02T18:21:10Z","snapshot_observed_at":"2026-08-07T05:12:04.880594Z","submitted_at":"2026-07-08T14:18:26Z","title":"Length Penalties Make Chain-of-Thought Less Monitorable","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-14T15:45:54.532529Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.09786"},"observation_digest":"sha256:de3f66300cb30cd144e571963ae6b2d9a66733eeff511d77fa81eaba57fffbdf","observation_id":"2ac22c00-237c-4925-a7b5-e6cf1fcbf8d5","resolution":{"observed_at":"2026-07-14T15:45:54.532529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-02T08:06:10.804751Z","title":"Chain of thought monitorability: A new and fragile opportunity for AI safety","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09786","last_updated":"2026-08-02T18:21:10Z","snapshot_observed_at":"2026-08-07T05:12:04.880594Z","submitted_at":"2026-07-08T14:18:26Z","title":"Length Penalties Make Chain-of-Thought Less Monitorable","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-02T08:06:10.804751Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.09786"},"observation_digest":"sha256:5b38c94619d6fa1e2a7cb311382c404452408c2e1635cb5ed965f470b5993b32","observation_id":"097f8438-1a9e-4ba5-8146-b1c1f020dd13","resolution":{"observed_at":"2026-08-02T08:06:10.804751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-04T04:30:28.364330Z","title":"Chain of thought monitorability: A new and fragile opportunity for AI safety","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09786","last_updated":"2026-08-02T18:21:10Z","snapshot_observed_at":"2026-08-07T05:12:04.880594Z","submitted_at":"2026-07-08T14:18:26Z","title":"Length Penalties Make Chain-of-Thought Less Monitorable","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T04:30:28.364330Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.09786"},"observation_digest":"sha256:5035a2df7f970a17e42442cd81306a22e7bdf9bb6b2abfdb15ccd4ca80158a8a","observation_id":"4cd93958-929e-4098-bddf-200e0f8b80c0","resolution":{"observed_at":"2026-08-04T04:30:28.364330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-02T06:53:52.430294Z","title":"Korbak, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13087","last_updated":"2026-07-13T14:20:06Z","snapshot_observed_at":"2026-08-07T20:29:34.196284Z","submitted_at":"2026-07-13T14:20:06Z","title":"GDM AI Control Roadmap","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T06:53:52.430294Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.13087"},"observation_digest":"sha256:dfa2a10e95f630f3db1c568b58e88af391db674bde9cd24d7b3b8fe2522aaa26","observation_id":"c956e04d-15f3-4430-b18a-18ab741f967f","resolution":{"observed_at":"2026-08-02T06:53:52.430294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-01T15:08:37.570947Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18553","last_updated":"2026-07-28T16:28:19Z","snapshot_observed_at":"2026-08-08T05:59:46.875794Z","submitted_at":"2026-07-20T22:40:36Z","title":"Operational Proto-Introspection in Looped Language Models: Process-Quality Taps, Executable Branching, and the Readout-Control Boundary","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T15:08:37.570947Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.18553"},"observation_digest":"sha256:86d2a1e76f643a4c36a38ade06284ce1e731a52241b6eb3ab3392ace62fa9d86","observation_id":"7f733765-f9be-43b0-bd9c-a2579c0b9889","resolution":{"observed_at":"2026-08-01T15:08:37.570947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-01T04:14:44.668324Z","title":"Chain of thought monitorability: A new and fragile opportunity for ai safety, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22925","last_updated":"2026-07-24T21:32:48Z","snapshot_observed_at":"2026-08-08T05:49:21.548828Z","submitted_at":"2026-07-24T21:32:48Z","title":"Not All LLM Reasoning is Visible in the Chain-of-Thought","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T04:14:44.668324Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.22925"},"observation_digest":"sha256:e7eb581e9c7d4e41caaa589c3a027f90f0da2140dd8d3ecf392edf1272703359","observation_id":"4dc50c46-c9be-4e21-bded-b442bc85ff3c","resolution":{"observed_at":"2026-08-01T04:14:44.668324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-03T14:26:28.259868Z","title":"Chain of Thought Monitorability : A New and Fragile Opportunity for AI Safety , July 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29062","last_updated":"2026-07-31T06:30:45Z","snapshot_observed_at":"2026-08-07T20:37:39.222608Z","submitted_at":"2026-07-31T06:30:45Z","title":"On the Generalization of Steering Vectors for Chain-of-Thought Faithfulness","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T14:26:28.259868Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2607.29062"},"observation_digest":"sha256:4a14bc5b4c63f51e7bdd969ab66b8279fd789ad655eaf171bdb59e0e86a21611","observation_id":"f5b88481-bcb1-49ac-956c-4e793b1c6f0b","resolution":{"observed_at":"2026-08-03T14:26:28.259868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T00:40:38.474169Z","title":"arXiv preprint arXiv:2507.11473 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00583","last_updated":"2026-08-01T10:42:41Z","snapshot_observed_at":"2026-08-07T18:20:36.503817Z","submitted_at":"2026-08-01T10:42:41Z","title":"A False Average: Chain-of-Thought Monitors Collapse Where They Are the Only Defense","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T00:40:38.474169Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.00583"},"observation_digest":"sha256:d32c9bd0315da9c6b863e3e8f6933eb062436cf4ebcf26b08617bb3042ea3608","observation_id":"4ee04524-1bec-470f-9a20-77c41943bf1c","resolution":{"observed_at":"2026-08-05T00:40:38.474169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-04T15:22:54.216027Z","title":"Chain of thought monitorability: A new and fragile opportunity for AI safety, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.02089","last_updated":"2026-08-03T11:48:39Z","snapshot_observed_at":"2026-08-08T01:52:41.954756Z","submitted_at":"2026-08-03T11:48:39Z","title":"How Much Does a Reasoning Summary Reveal? An Observability Ladder for Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T15:22:54.216027Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.02089"},"observation_digest":"sha256:019e97ff2e176b9ba1fc962f9ca5efc918ab714ca8f57782753852bcd2c7525b","observation_id":"a373dd73-b609-4f09-97fd-80d1fbab6cd3","resolution":{"observed_at":"2026-08-04T15:22:54.216027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T21:36:45.164802Z","title":"arXiv e-prints , keywords =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03291","last_updated":"2026-08-04T08:04:36Z","snapshot_observed_at":"2026-08-07T23:10:52.073975Z","submitted_at":"2026-08-04T08:04:36Z","title":"The Tell-Tale Trace: Detecting Reasoning Failures in LLMs Using Chain-of-Thought Dynamics","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T21:36:45.164802Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.03291"},"observation_digest":"sha256:e8f118c754bc155731cb58144049a10991525d50daaf5dca52da84a121b6f136","observation_id":"b6e315fa-63f3-40de-96aa-13372c40000b","resolution":{"observed_at":"2026-08-05T21:36:45.164802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T21:36:45.527818Z","title":"arXiv preprint arXiv:2507.11473 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03291","last_updated":"2026-08-04T08:04:36Z","snapshot_observed_at":"2026-08-07T23:10:52.073975Z","submitted_at":"2026-08-04T08:04:36Z","title":"The Tell-Tale Trace: Detecting Reasoning Failures in LLMs Using Chain-of-Thought Dynamics","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T21:36:45.527818Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.03291"},"observation_digest":"sha256:e405b557f87c226e93e490d80273117ed3d6058b1e9833d04d7a402636af830d","observation_id":"b7df419f-7609-427d-9ec9-fb2750533583","resolution":{"observed_at":"2026-08-05T21:36:45.527818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T13:40:55.680701Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03745","last_updated":"2026-08-04T14:38:06Z","snapshot_observed_at":"2026-08-08T09:35:52.621563Z","submitted_at":"2026-08-04T14:38:06Z","title":"Risky Business: Measuring The Faithfulness-Safety Tension","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T13:40:55.680701Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.03745"},"observation_digest":"sha256:ec66e2fd7befb4c47f51d416e29d68a8114a015d61198d828e47117ddbba3ec9","observation_id":"9eddd5c5-71cd-4642-8852-daecc35eba2f","resolution":{"observed_at":"2026-08-05T13:40:55.680701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-06T17:51:52.127591Z","title":"Chain of thought monitorability: A new and fragile opportunity for ai safety, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04735","last_updated":"2026-08-05T11:59:20Z","snapshot_observed_at":"2026-08-10T15:47:03.566452Z","submitted_at":"2026-08-05T11:59:20Z","title":"Chain-of-Thought Monitoring Can Be Unreliable in Implicit-Influence Settings","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:51:52.127591Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2608.04735"},"observation_digest":"sha256:f84b3c61af7d181f0b98721feae6550d714b341008fff548db2014b31390664d","observation_id":"3e760a5c-06ea-4874-9859-3c1560cfed5b","resolution":{"observed_at":"2026-08-06T17:51:52.127591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.11473/citation-record","integrity":"/paper/2507.11473/integrity","json":"/paper/2507.11473/citation-record.json","paper":"/paper/2507.11473"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1805.00899","last_updated":"2018-10-22T17:36:07Z","snapshot_observed_at":"2026-08-02T15:33:17.783178Z","submitted_at":"2018-05-02T16:27:32Z","title":"AI safety via debate","version":2},"cited_work":{"arxiv_id":"1805.00899","doi":"10.48550/arxiv.1805.00899","metadata_source":"pith","pith_arxiv_id":"1805.00899","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AI safety via debate","venue":"stat.ML","work_id":"13c1ec37-af93-438a-bdf0-f2eafaee5635","year":2018},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/1805.00899","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:05be777f1a47431a92c00a9b7d120eb1fee63125352f9e757cc2ebf59495664b","observation_id":"2aef35ed-b3ff-4c9d-b1be-a76fbcb70bc4","resolution":{"observed_at":"2026-05-20T14:19:44.804131Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":"1909.08593","doi":"10.48550/arxiv.1909.08593","metadata_source":"pith","pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Fine-Tuning Language Models from Human Preferences","venue":"cs.CL","work_id":"4f54aad1-f3b6-404f-b9c7-e21ba0a33b99","year":2019},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:7ed337e25efb953faae419555c9e274b1878d05f99d6bfa0cf77a370199f32a3","observation_id":"9b047c66-e8e2-47bc-b8b6-0be905068fce","resolution":{"observed_at":"2026-05-20T14:19:44.783757Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-08T21:08:07.78032+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T21:08:07.78032+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , howpublished=","venue":null,"work_id":"7b2b0e7e-57af-4409-bfc6-8da8dad23545","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:eefad0c261916b50d701913f7bf64e51de4840168320caa8672cb696b489c819","observation_id":"e6636576-0880-48bc-b5be-d61325ee222a","resolution":{"observed_at":"2026-05-20T14:19:44.988055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Checklist: What Succeeding at","venue":null,"work_id":"4beb31c9-8e7f-4d9f-b6e7-2ac376aeb123","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:aa69d1fc20e68ec274ea8f3d92355d80665005de8b4a87a26dad36f471e43e8e","observation_id":"3b158cbf-28f4-4ac2-bf11-16c27e367374","resolution":{"observed_at":"2026-05-20T14:19:44.989804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08379","last_updated":"2023-11-27T19:30:35Z","snapshot_observed_at":"2026-08-05T18:30:31.616984Z","submitted_at":"2023-11-14T18:42:40Z","title":"Scheming AIs: Will AIs fake alignment during training in order to get power?","version":3},"cited_work":{"arxiv_id":"2311.08379","doi":"10.48550/arxiv.2311.08379","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.08379","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scheming","venue":"arXiv (Cornell University)","work_id":"ddf793ee-1030-43e7-8317-c53cf34c2d1b","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2311.08379","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:a6ec01debc69c99e94868b94c8373101b811f3b5c49d9ab9889db8a5a176a3a6","observation_id":"4b9e95c8-ae1f-4e1e-94b4-af488562dd9c","resolution":{"observed_at":"2026-05-20T14:19:44.780078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Yang, John and Wettig, Alexander and Yao, Shunyu and Pei, Kexin and Press, Ofir and Narasimhan, Karthik , journal=","venue":null,"work_id":"3e14d133-4959-4980-87d8-60dc06567aac","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:5594e92dc6262ef6e6ccb2b9e1e0c3a4d6e53361d35650742d6d6213da7386d3","observation_id":"e0c65d65-7d6e-4db3-931d-12fa2e3007d9","resolution":{"observed_at":"2026-05-20T14:19:44.991922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e2b20c9d-0ca9-4aa8-b7a3-fbb120f114f3","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:ef2c2949721da9a009df07d96e7c526ae8b3d4e4dd40c2f2b618c02355d05e3c","observation_id":"f3743c47-da26-417b-b5d8-d29dd48572d7","resolution":{"observed_at":"2026-05-20T14:19:44.993921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"ff4c03ed-aa14-44a5-b226-9abdf549d69a","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:271e1e691a8eaab29ff8e35f78be47ba5b6653ef96a38b8bb05977fcffa231e6","observation_id":"9efc77cf-7478-4b84-810b-75157149f0e5","resolution":{"observed_at":"2026-05-20T14:19:44.995965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21572","last_updated":"2024-10-28T22:08:28Z","snapshot_observed_at":"2026-07-06T19:41:10.332290Z","submitted_at":"2024-10-28T22:08:28Z","title":"Safety cases for frontier AI","version":1},"cited_work":{"arxiv_id":"2410.21572","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.21572","snapshot_observed_at":"2026-07-03T10:48:02.306419Z","title":"Safety cases for frontier","venue":null,"work_id":"19cb1a79-b15d-4c9c-aff4-da575bbb3df6","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2410.21572","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:6f1553ba4ecaa9c2ed3363ccec703c7326e30d8abf0e0eb564e3437a7bd923fd","observation_id":"825d166f-3522-47b3-818c-c6ec0fc90406","resolution":{"observed_at":"2026-05-20T14:19:44.788052Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10462","last_updated":"2024-03-18T18:11:46Z","snapshot_observed_at":"2026-08-07T12:53:57.992660Z","submitted_at":"2024-03-15T16:53:13Z","title":"Safety Cases: How to Justify the Safety of Advanced AI Systems","version":2},"cited_work":{"arxiv_id":"2403.10462","doi":"10.48550/arxiv.2403.10462","metadata_source":"pith","pith_arxiv_id":"2403.10462","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safety Cases: How to Justify the Safety of Advanced","venue":"cs.CY","work_id":"ad3b5070-36ef-4ca6-8b9a-bfd981ea0c66","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2403.10462","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:1b80bdd8b0204788a863b3caade6b4f913c85ac4ff613fcfe54a89e3fa6afd15","observation_id":"568afe59-59a8-4d94-b118-19056f047797","resolution":{"observed_at":"2026-05-20T14:19:44.738859Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safety cases at","venue":null,"work_id":"a54270cf-9b03-4aa0-af18-d6673918f31e","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:d04e91e95a29e069dbca0fa863537eef13bf32b2c41753be4d0730ae14e0d3f3","observation_id":"50cb30c1-7088-4f5b-ace4-a84181c42154","resolution":{"observed_at":"2026-05-20T14:19:44.997695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"a6e09509-2aa8-4e45-9bdb-f9aed04d3ea9","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:ac295d9e62fc2a4c42cd32a66760379f93c2e4ea87fd540c354d2e2c7d8cada9","observation_id":"efff4b1f-3d17-4b9c-9bf1-457596ed7d9b","resolution":{"observed_at":"2026-05-20T14:19:44.999449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"7ac12fa2-39c2-4653-a021-db37a4ebc96d","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:313a83f328f408b1290191bee4c7d80de6ceb910062a810820f34ce7a69b2f9f","observation_id":"6268b255-31c4-458d-bb0a-a812173d80d6","resolution":{"observed_at":"2026-05-20T14:19:45.001359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Lucas, Caleb and Guest, Ella , year=","venue":null,"work_id":"46ec6e70-5db3-41e6-b096-cf2a9de44efd","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:18342c3e39b947451c9d59d8e9313fab4d51723e0c0f7a100e9d11b25898531d","observation_id":"ec62a315-c042-449e-9333-a533529262ee","resolution":{"observed_at":"2026-05-20T14:19:45.003856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , howpublished=","venue":null,"work_id":"4e3b99d1-20c1-49fc-9b3e-51239683ce51","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:0a5aa6a8f6d9eb86205cff71b0382e9f70dd482286686a3cd9f2e9ce08353550","observation_id":"3e975ea1-46f7-4dd6-b3cf-7ad09b292068","resolution":{"observed_at":"2026-05-20T14:19:45.006090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b7fcc8fa-021f-4622-96fc-3b6b62c72e4d","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:e448cd7afbed2e3f24d15a8be8c40530113eb0c8461e88c4554eb259a9bbdcd4","observation_id":"7c1b270f-5ff4-4c15-921c-5ec82e65f3ff","resolution":{"observed_at":"2026-05-20T14:19:45.007928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2007 , institution=","venue":null,"work_id":"108d3dc8-efd0-475e-b4e9-27b8f51398ee","year":2007},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:7b488f4309166cd4a3c192c54e02d902f8fe2b6530d7477d85ef49c3310c40d4","observation_id":"ee9fc45e-13c5-40df-9051-bd978a2f9fbd","resolution":{"observed_at":"2026-05-20T14:19:45.009660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Managing extreme","venue":null,"work_id":"23032b1b-c42d-4e0e-a7e8-1ec7c2f43d9a","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:9e85d1757583f1b609247aba2913ed8cb7a59a4cadd64a98aa11c45f4ea6511e","observation_id":"731272a7-e51c-4346-a0d6-9b9f4d872278","resolution":{"observed_at":"2026-05-20T14:19:45.011718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"3b01817c-a9a0-4a51-9520-9e94afe71f0b","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:83bed2665ac7f463f60f0d2e5efd3788b92e0c9fe908684552a4c1e2a084224b","observation_id":"37f5c1e9-5c7c-49e8-8fec-c1c26b191dad","resolution":{"observed_at":"2026-05-20T14:19:45.013409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safety and Reliability , volume=","venue":null,"work_id":"1a4121e3-2a1d-44ae-9770-292b1d120fff","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f8219f2ba8f3baf3ed826b2a3c6798fae039b3664cc340cda6bf802470def137","observation_id":"8f092750-c822-4864-b6c9-1925435fd126","resolution":{"observed_at":"2026-05-20T14:19:45.015153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SPE Asia Pacific Oil and Gas Conference and Exhibition , year=","venue":null,"work_id":"5be4e70b-3274-4955-89b0-b15be2e2fd4b","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:12bf6b2ecc0dffb4cf1a51796248f29867ff5d97700037d0ba85c84f3b9ad441","observation_id":"488b22dc-180f-4ad0-922c-132093072637","resolution":{"observed_at":"2026-05-20T14:19:45.017112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safety Science , volume=","venue":null,"work_id":"ea4bd55c-0a7f-44b1-a62e-39fd009ea006","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:427e6a76fc6d4e314b6145bb3fdfeaf20acb13b2460c8483b0d187a967fdfaa1","observation_id":"c5cc610a-52d3-43ab-b84a-76af7a08b6e6","resolution":{"observed_at":"2026-05-20T14:19:45.018894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safety Science , volume=","venue":null,"work_id":"3b71b778-50f6-4af3-9a0b-10a48abf1896","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:8a99ec515e6c2646044c4a6a69c14b1eb476ec539b2676fb60ff9d2e3ea380c3","observation_id":"6351afb8-c122-4ead-adc4-394d993631a1","resolution":{"observed_at":"2026-05-20T14:19:44.806657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Foundations of Computer Software , pages=","venue":null,"work_id":"9c86797e-9eb1-4066-abf0-4f6f5fafa701","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:8a393ad56b46cf5adee7c01faa4d2ec90190ff314037dbf68dae79b8f2babff8","observation_id":"f7aeffe1-2e71-4fac-8bae-a45f34e4f3a8","resolution":{"observed_at":"2026-05-20T14:19:44.809216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safety Science , volume=","venue":null,"work_id":"f8dcd49e-fe5c-4cfc-ade3-f8cdddc2d473","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:4f925af3c110300588ddaf9f94f7741b408f2e3cec9dd500e420ab2e0676edda","observation_id":"7d127e1d-0a79-4c4f-9c35-270233d74633","resolution":{"observed_at":"2026-05-20T14:19:44.811558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.08088","last_updated":"2024-11-12T18:45:08Z","snapshot_observed_at":"2026-08-10T04:37:54.272386Z","submitted_at":"2024-11-12T18:45:08Z","title":"Safety case template for frontier AI: A cyber inability argument","version":1},"cited_work":{"arxiv_id":"2411.08088","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.08088","snapshot_observed_at":"2026-07-01T08:15:31.703313Z","title":"Safety case template for frontier","venue":null,"work_id":"55ee6677-a7c7-4215-a014-5ed15b8b29af","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2411.08088","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:9899858a11c7cf628ce25751f866a7a35519d566d6278d2c24670f048458437a","observation_id":"34f5d9af-0338-403c-8696-fde5b488e3e6","resolution":{"observed_at":"2026-05-20T14:19:44.792729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.03336","last_updated":"2024-11-07T09:18:26Z","snapshot_observed_at":"2026-07-06T19:45:44.484683Z","submitted_at":"2024-10-29T17:55:29Z","title":"Towards evaluations-based safety cases for AI scheming","version":2},"cited_work":{"arxiv_id":"2411.03336","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.03336","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards evaluations-based safety cases for","venue":null,"work_id":"6e466b60-06c4-4684-8a4c-17b95fbc1131","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2411.03336","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:e85dee5cd55060a4e44330c1e8c172d87ac7421ec4ba56ed3bb947a961fa21e0","observation_id":"2196496e-8316-41b8-959c-d7264084d7d4","resolution":{"observed_at":"2026-05-20T14:19:44.800220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"booktitle=","venue":null,"work_id":"780f9b87-3795-4c33-9970-e83d08e20f02","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:965472c466831f69b7d20a89bbfbeb7ccf203663d27fa195b1c2f804778c409c","observation_id":"c02eb5d5-ec65-4923-8ca2-e87387523acb","resolution":{"observed_at":"2026-05-20T14:19:44.813756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15114","last_updated":"2025-05-27T03:32:23Z","snapshot_observed_at":"2026-08-01T07:23:06.300790Z","submitted_at":"2024-11-22T18:30:46Z","title":"RE-Bench: Evaluating frontier AI R&D capabilities of language model agents against human experts","version":2},"cited_work":{"arxiv_id":"2411.15114","doi":"10.48550/arxiv.2411.15114","metadata_source":"pith","pith_arxiv_id":"2411.15114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Re-bench: Evaluating frontier ai r&d capabilities of language model agents against human experts","venue":"cs.LG","work_id":"f6a7efa2-8f95-4bbf-9931-611f36393c20","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2411.15114","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:6641913e1e402f3869052968600f574ee27f72c2d3da13012d99218ccc06cbd1","observation_id":"7eca4a44-634e-4288-828e-ad2fcd68d077","resolution":{"observed_at":"2026-05-20T14:19:44.776446Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shell Games: Control Protocols for Adversarial","venue":null,"work_id":"917609e2-265c-4a5b-8dc0-ee653fafe0ee","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:6e7b2669a45cd79c235000bd1e56e4fcf2e92fc694d26524f20bc9abf7c75639","observation_id":"d9c04503-1bf6-4a8b-8ca8-efe930d06bd4","resolution":{"observed_at":"2026-05-20T14:19:44.816032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"4ffa8090-6241-4948-b458-f6d13bb4a268","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:df9fb93507cadada9702e06e37d153a99291fde37066a35425cafcd7a214d4d9","observation_id":"0e5567ae-1564-44ca-ab85-54cab6c5f213","resolution":{"observed_at":"2026-05-20T14:19:44.818066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:56:41.293428Z","title":"2023 , eprint=","venue":null,"work_id":"27fbc932-16e8-4a81-9c18-25a71f321895","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:a0bce064e0e15f71342a1d47527cad633f1b3f1f92c7f804b0f6909bea51fa6a","observation_id":"f97d2b4b-521b-43a4-b985-6cc7b72d6e90","resolution":{"observed_at":"2026-05-20T14:19:44.820445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T03:43:15.347347Z","title":"2023 , eprint=","venue":null,"work_id":"9e726140-07d9-49d4-b4fc-1ce0d03d41ee","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:4cd1ffd0c96383e7fedff754c30d928769c1c8cb67303dae3d0ca62c27c1280a","observation_id":"64a08022-20a5-4d68-9b28-4567c931f117","resolution":{"observed_at":"2026-05-20T14:19:44.822800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"a8d5e728-33e0-43cb-8acd-7e9011a3a927","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:098d3dc7607fbea5c4fba1251faeb383a2ebc50395985a711e39876156e045a9","observation_id":"a6f60f66-1770-4004-92d4-9139ea957be1","resolution":{"observed_at":"2026-05-20T14:19:44.825016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , eprint=","venue":null,"work_id":"b61587f2-36d7-4e53-9801-e4808399cc20","year":2018},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f563036622ddbbc95b960558f662bc819b2201435164b3ee3a28e2d4da0f2b60","observation_id":"1b60cc92-d048-47d8-a052-341217d6a80d","resolution":{"observed_at":"2026-05-20T14:19:44.827273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Phang, Jason and Bowman, Samuel R","venue":null,"work_id":"d6897a71-fcd8-4083-bfe4-ee9b48faf302","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:b964fce567eb2ba89ace1a714e4d26e5ec9377a8241e1f14e85878d957ed1790","observation_id":"6ff7940f-0a24-4028-99df-701ba6085d86","resolution":{"observed_at":"2026-05-20T14:19:44.829537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:22:42.106294Z","title":"2020 , eprint=","venue":null,"work_id":"a2c3ed4a-e3f5-4b3f-a871-514ef4ba4ba1","year":2020},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:94b8bc9c9cb68da0dc2c3df2a45b840037ab249b9ab9b3c49947d5878f220a00","observation_id":"88f66590-9c8d-4b7d-8c27-e0fa8229c420","resolution":{"observed_at":"2026-05-20T14:19:44.831791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:32:21.995696Z","title":"2022 , eprint=","venue":null,"work_id":"290b799d-7b6d-426f-b12b-1d750d415539","year":2022},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:da5fdf70ab97559a48985eceee96a97fec44674f2487c5b98470bdae5c9e5188","observation_id":"c042567e-c29b-4bc9-86be-498a8ac4b15b","resolution":{"observed_at":"2026-05-20T14:19:44.834280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:11:41.675591Z","title":null,"venue":null,"work_id":"d9d8cd14-b6da-4456-9ef3-d69eeb196b5d","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:bc614e2914d2c7a18d76426eb999ca80da98bea51058554003c3ad914b28884e","observation_id":"ff5ed61d-215a-4d42-aa28-6372369c8de6","resolution":{"observed_at":"2026-05-20T14:19:44.836641Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:56:41.314476Z","title":"2024 , eprint=","venue":null,"work_id":"62c91863-9e02-487f-80cb-ade392d03a59","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:6ae5acf7338b7fb2850772f227a0e7169d9f4086350470a42cbf0dfd85d477d5","observation_id":"c749b60a-efe5-402b-bf40-8ef3c84b06a2","resolution":{"observed_at":"2026-05-20T14:19:44.838685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"cd191f28-6b43-4bc1-b15b-44654f59cec2","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:4c3087982628d03ce221e6f992f66783e8567c513f1625da8ce6788f2a99e0e6","observation_id":"e5fdb9a6-96ee-4b6c-a491-f98581034778","resolution":{"observed_at":"2026-05-20T14:19:44.840703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , note=","venue":null,"work_id":"81af9c7b-933f-4ed7-97dd-77c1eff8d238","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:a6e76e7022a50646f6bc8ab5b07716f9bc1a7d8065b1167d6db4b6e4cc84c16c","observation_id":"16eb96b6-2ddd-4c88-9dc0-e88542b15e8c","resolution":{"observed_at":"2026-05-20T14:19:44.842808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00773","last_updated":"2024-02-01T17:02:20Z","snapshot_observed_at":"2026-08-04T05:12:44.452226Z","submitted_at":"2024-02-01T17:02:20Z","title":"On the Choice of Loss Function in Learning-based Optimal Power Flow","version":1},"cited_work":{"arxiv_id":"2402.00773","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.00773","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2402.00773 , year=","venue":null,"work_id":"dbaf2b02-6e14-463d-95ac-ad60ad741c8d","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2402.00773","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:2d106b1220536a923ab98e2eec86948570178489ac5436ad520943b83876083a","observation_id":"615e9e43-3fdf-447d-ae62-bbb75929e08a","resolution":{"observed_at":"2026-05-20T14:19:44.742672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00215","last_updated":"2024-06-28T19:53:17Z","snapshot_observed_at":"2026-08-10T12:31:19.058935Z","submitted_at":"2024-06-28T19:53:17Z","title":"LLM Critics Help Catch LLM Bugs","version":1},"cited_work":{"arxiv_id":"2407.00215","doi":"10.48550/arxiv.2407.00215","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.00215","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLM Critics Help Catch LLM Bugs","venue":"arXiv (Cornell University)","work_id":"e730c1aa-4c9b-48f3-923b-47ddc0a4e6d8","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2407.00215","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:01abf63ccffdc74d54fc689e9f70f2fd9c0f558aa0d516e6f6b578801ecea3b0","observation_id":"d82d28eb-19e1-4866-b18f-23d8360e1bd6","resolution":{"observed_at":"2026-05-20T14:19:44.746613Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.18512","last_updated":"2023-10-31T19:13:43Z","snapshot_observed_at":"2026-08-06T07:03:02.030103Z","submitted_at":"2023-10-27T22:02:29Z","title":"Preventing Language Models From Hiding Their Reasoning","version":2},"cited_work":{"arxiv_id":"2310.18512","doi":"10.48550/arxiv.2310.18512","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.18512","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.18512 , year=","venue":"arXiv (Cornell University)","work_id":"eb34c557-1225-4ed5-bdd4-0781473b6cf1","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2310.18512","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f453548b1d0f6edf0ca3581ef6fca93a8e856e2e49ac7a2b7f4ebfd1fd98be47","observation_id":"1bf448f2-6dcd-4830-905a-704b7d8ece0f","resolution":{"observed_at":"2026-05-20T14:19:44.761298Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07985","last_updated":"2026-05-07T14:31:00Z","snapshot_observed_at":"2026-07-06T19:14:16.762220Z","submitted_at":"2024-09-12T12:30:07Z","title":"Games for AI Control: Models of Safety Evaluations of AI Deployment Protocols","version":2},"cited_work":{"arxiv_id":"2409.07985","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.07985","snapshot_observed_at":"2026-07-03T10:17:57.619508Z","title":"Games for AI Control: Models of Safety Evaluations of AI Deployment Protocols","venue":"cs.AI","work_id":"29199782-3958-45b0-a87c-202e523c6042","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2409.07985","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:613c1d48aa78542ff3e784b79069cb3297c989e7b634760e7c9865049124b037","observation_id":"152d93e8-2efa-42b0-bd22-5bf803dc541f","resolution":{"observed_at":"2026-05-20T14:19:44.765406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14713","last_updated":"2024-06-20T20:16:29Z","snapshot_observed_at":"2026-08-09T20:12:53.938966Z","submitted_at":"2024-06-20T20:16:29Z","title":"Risk thresholds for frontier AI","version":1},"cited_work":{"arxiv_id":"2406.14713","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.14713","snapshot_observed_at":"2026-06-30T03:04:15.234514Z","title":"Risk thresholds for frontier","venue":null,"work_id":"d7669a35-ffab-4854-9b6f-548a349c3514","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2406.14713","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:6d98ed397e5cd93352835032edce9cac03d9ad7a1a48f78fc15697ec9877cda7","observation_id":"843fbaf1-6657-4a52-aa54-6c50da9bbb74","resolution":{"observed_at":"2026-05-20T14:19:44.772240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A basic systems architecture for","venue":null,"work_id":"3491cd7a-60e4-4b9c-ba9a-038115f2d20f","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:513c6c73bd3789f53d1e062962c7ea451d5ebc67d1c4f2df94f58f89d651020b","observation_id":"ee3c1419-8552-484a-889c-4175ae6720e2","resolution":{"observed_at":"2026-05-20T14:19:44.844717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Three Sketches of","venue":null,"work_id":"12ea68ba-90bc-42b9-a59c-3f9197ce47e0","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:4e655b76bed51f5d2de5accb7f41e1d9f935b69ac712e3bb68041683c0de79d3","observation_id":"32a09101-1490-40d9-a4e3-92bec89ca4f8","resolution":{"observed_at":"2026-05-20T14:19:44.846608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"6713b0be-58c2-4cfd-98b6-47b9f4b83883","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:178827d3e25b051f772e0f0f55f46370b9ee5d9e453323a44e6e26545bcb3b0a","observation_id":"9ccf0494-3037-42b2-b7c5-dc92560dfbc0","resolution":{"observed_at":"2026-05-20T14:19:44.848747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Thomas, John P","venue":null,"work_id":"b2a04d59-7bf5-4bcf-ace3-9c4342f69886","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:91aad6b59fb88fe85ee6c6fd209f7c5193c5aa82606bf0ee3f6ff0f973768e4e","observation_id":"2d69419d-2e8e-49e0-a240-240ca7e18664","resolution":{"observed_at":"2026-05-20T14:19:44.850556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Failure Mode and Effects Analysis (","venue":null,"work_id":"3ad264da-6901-4444-86d6-8e218d1d6d07","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:7bc5b6d56abf60484a1fd142e6423a0037b158db47bc520398ad2f5036471c7f","observation_id":"b224a236-2fca-498c-a067-20668f432e53","resolution":{"observed_at":"2026-05-20T14:19:44.853294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"66973a5e-ba01-4a5f-a23e-0e0659ccf8ad","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f265f46cf521da7eb1c0d005d15d0f91803a11b9b9616432f857345eca4630a7","observation_id":"b5ae26a7-c9db-42c2-ad9f-c81fbf261b9c","resolution":{"observed_at":"2026-05-20T14:19:44.855452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , month=","venue":null,"work_id":"ca09d877-af5c-4b64-b944-3de820ef9dc8","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:8871891e47f752e3e664841568e0f5db9bab0900a083741ea6367e2b36ca3e50","observation_id":"7f9f0fe9-2767-4f8e-a04b-f6c57b10193f","resolution":{"observed_at":"2026-05-20T14:19:44.857705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"255d4664-806c-43b5-8c14-affa78e207a9","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:c24515a2ee0c8918b8a8929d86f3566614d087b6444f92f2b680f31b804a14e4","observation_id":"ff161714-8109-488e-83ce-718457c7b30e","resolution":{"observed_at":"2026-05-20T14:19:44.859825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building Blocks for Assurance Cases , year=","venue":null,"work_id":"d7b7ef9b-09aa-46dc-96fd-3252eddce3f5","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:ae70e872adcea7910cdcfb0b1898d25b5ba71e8266297bb52fcc96839aae81c4","observation_id":"fe62e661-360b-4116-ab92-3a0208eba227","resolution":{"observed_at":"2026-05-20T14:19:44.862536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Thoughts on the conservative assumptions in","venue":null,"work_id":"843e0b21-f2ee-4bb7-937b-08c0fc76c345","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f67f600782ada4f0fce0a443144557cc5f81a64f52e8873bf950538c34c45e44","observation_id":"73b49422-0a3f-4e68-9ad6-84527748bd9b","resolution":{"observed_at":"2026-05-20T14:19:44.864684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"3ed63adb-bfe3-4d26-879e-fa0bf9c93280","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:2731d23e9494cd2a551d8ea404c516c72b0a424d58049c632c4520ffb69682d4","observation_id":"623c5053-6f99-45c4-89ed-81e743051059","resolution":{"observed_at":"2026-05-20T14:19:44.866896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"ad256d31-f255-4ad1-b333-e2c33cd8fbaa","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:cb24a0726fd39ed89e5553dd5ccd7ac71f020dd12784a8ee5e27505261d7abcc","observation_id":"f1aa6499-97b0-4b0a-af9b-ec8edbaff01e","resolution":{"observed_at":"2026-05-20T14:19:44.869029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , month=","venue":null,"work_id":"9c4d47ac-97ab-4cd8-9a84-205fec863d1c","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f7483f38fb5546f7a3e90cf45d264424e28df24f153906225880b6835c9042ca","observation_id":"b39906e4-ced2-4f77-bb60-2862e6b91dff","resolution":{"observed_at":"2026-05-20T14:19:44.872273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:06:16.662547Z","title":"Me, Myself, and","venue":null,"work_id":"0cc4b4e6-32e4-4b24-bafa-7052ad3d4764","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:46c17f600a755f8888a1e0cdf31236982be0c801ce828af848a338a4a6ae2121","observation_id":"6107eaf7-753d-4ff6-801b-e4dce07f1d84","resolution":{"observed_at":"2026-05-20T14:19:44.874443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"f9fef427-b7d3-4cfb-9c87-c25aa6f3d35d","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:8423e01b366ddb3382f11657c28016f003fe50624cc2d4fb0fce13779598574e","observation_id":"48285e7b-bd2b-4617-886f-846adcb68f20","resolution":{"observed_at":"2026-05-20T14:19:44.876786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"381029b4-0611-4994-84c7-8d4fb986d0a5","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:8ea21dfc274907c8d9b99621e0561c144d19694f0d76be0337c76249da29c561","observation_id":"3f829c75-f151-4d60-9cae-5fc3f29481a8","resolution":{"observed_at":"2026-05-20T14:19:44.878845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:24:42.892175Z","title":"2024 , eprint=","venue":null,"work_id":"10c6b2cf-b6b8-4485-85da-44523973474e","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:d4528202a3bfd45391bbb46dc94b005a5d4df517fa43a1acc207c823003f0c78","observation_id":"bdc9b807-0b7a-44d4-9c08-aae334363185","resolution":{"observed_at":"2026-05-20T14:19:44.881300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"bbdbfe22-6fd3-4633-8fa1-739859a9ae25","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:507a69adb7e2920b29376d084fc95bef34d14f6cd7382f50d38ff63ea98be2f3","observation_id":"4980c193-45f4-43f7-8e94-584de216fc53","resolution":{"observed_at":"2026-05-20T14:19:44.883579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01635","last_updated":"2025-02-03T18:59:13Z","snapshot_observed_at":"2026-08-10T10:52:49.507908Z","submitted_at":"2025-02-03T18:59:13Z","title":"The AI Agent Index","version":1},"cited_work":{"arxiv_id":"2502.01635","doi":"10.48550/arxiv.2502.01635","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.01635","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.01635 , year =","venue":"ArXiv.org","work_id":"bd75654b-4bd8-4784-b501-55eb08edf68b","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2502.01635","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:5f60bdaa8360c89f1b5525130cb6f4f64cf63ad42110cdb9b1630d3dddb8f5b0","observation_id":"86689f15-1f61-4b6b-b69c-1b81933b5801","resolution":{"observed_at":"2026-05-20T14:19:44.732817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint =","venue":null,"work_id":"4dddf647-7972-4307-8a99-c15fbcadd4d7","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:06cc92e196b1cd8018d61f051746dec6203c7da201e60653f5631312afe877c7","observation_id":"6756eed0-be02-4a1a-9159-f00ed8b3799f","resolution":{"observed_at":"2026-05-20T14:19:44.885465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"977402b6-7551-4a2a-bd16-ca84e7b08e17","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:3a2949ceaf15767955a9dedc7de03115336b50817214a746ac4241aab8fccaf3","observation_id":"df00cfca-3f4c-405b-a1c4-0ead86431c57","resolution":{"observed_at":"2026-05-20T14:19:44.887411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , month=","venue":null,"work_id":"97920acf-6383-4636-b93b-cf646b7b9e8f","year":2021},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:5593097ff6cb6489d59a3c9b3e85b6b00b008cd4cc7127111516edde63792f93","observation_id":"b895fe83-923b-4400-854c-079c47c17e40","resolution":{"observed_at":"2026-05-20T14:19:44.890070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.10862","last_updated":"2021-09-27T21:12:49Z","snapshot_observed_at":"2026-08-04T13:56:39.444746Z","submitted_at":"2021-09-22T17:34:18Z","title":"Recursively Summarizing Books with Human Feedback","version":2},"cited_work":{"arxiv_id":"2109.10862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.10862","snapshot_observed_at":"2026-07-03T09:07:47.851004Z","title":"Recursively Summarizing Books with Human Feedback","venue":"cs.CL","work_id":"aeb94d9f-1a59-4bbb-b591-0ccd732aa0f8","year":2021},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2109.10862","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f42c099647ce993f653f52fa297cab97bd95bfbec165504d9a9a5a2380b39d0a","observation_id":"487f6696-aff3-47ac-88c6-9d9503abc0a2","resolution":{"observed_at":"2026-05-20T14:19:44.750729Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05802","last_updated":"2022-06-14T01:16:24Z","snapshot_observed_at":"2026-07-06T13:19:58.934755Z","submitted_at":"2022-06-12T17:40:53Z","title":"Self-critiquing models for assisting human evaluators","version":2},"cited_work":{"arxiv_id":"2206.05802","doi":"10.48550/arxiv.2206.05802","metadata_source":"pith","pith_arxiv_id":"2206.05802","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-critiquing models for assisting human evaluators","venue":"cs.CL","work_id":"3fcefdd1-22ab-4648-a683-cb1555e7a50e","year":2022},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2206.05802","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:8a46ce1430c0cf7067795c6d320ad437ad59665d0917f1f5581f3297c0b9d4c5","observation_id":"61ba18f2-0447-455e-a6ff-50664e8f0a02","resolution":{"observed_at":"2026-05-20T14:19:44.756323Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"093a4391-9e48-4b3e-9208-2a09f990cd83","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f08d0e39ce697cdcbd7c868920671228cc42503c6ba191037b1534e77fc3e9d7","observation_id":"423fa106-fc10-4c3f-a54f-eebcdbf11d74","resolution":{"observed_at":"2026-05-20T14:19:44.891977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"7442b27d-d874-4792-84d3-aa236da2e82e","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:e3a82b7b51b3c4b3418597ddcbb5b31149ab163dc59aa8a206fce7d797858b78","observation_id":"1f4ed779-0a44-4586-9309-7d92fed9bb5f","resolution":{"observed_at":"2026-05-20T14:19:44.893792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08497","last_updated":"2025-01-15T00:00:01Z","snapshot_observed_at":"2026-08-10T20:22:52.268785Z","submitted_at":"2025-01-15T00:00:01Z","title":"Addressing Intersectionality, Explainability, and Ethics in AI-Driven Diagnostics: A Rebuttal and Call for Transdiciplinary Action","version":1},"cited_work":{"arxiv_id":"2501.08497","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08497","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DeepSeek-","venue":null,"work_id":"1b7e7dc9-2a15-4658-ae35-cfe790421e35","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"cited_paper":"/paper/2501.08497","citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:6c120ae61b1081c189ff38316b4454643046f8d1f695ff1ca933146646dbeae3","observation_id":"54f92d21-0e0e-4fa9-86dd-d37ccbf120c2","resolution":{"observed_at":"2026-05-20T14:19:44.769076Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:56:41.317568Z","title":"2025 , eprint=","venue":null,"work_id":"5e6d2e9a-bc8d-4420-ab79-7b9fbcdc3b90","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:d8c30f4ae7718c613f886c9ac73c306a0ed81939cc7250f9e3aaa749a4790234","observation_id":"023cb5db-ea80-4949-8960-5785c631f2de","resolution":{"observed_at":"2026-05-20T14:19:44.895600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c768f731-8670-4466-8552-2894a0f77993","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f324ef783d1bc43681fc188f603b3e7a1bae13c05a88b60914f56dfbce241333","observation_id":"e5687d1e-9838-461b-900b-557f6a2fec31","resolution":{"observed_at":"2026-05-20T14:19:44.897581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , url=","venue":null,"work_id":"f72cf04b-ff54-4b50-aee3-d5b89ca33d90","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:df8e7343e094e0fb7f45d9f897e7012284d62d2e05c341201e328592cf328198","observation_id":"b67597c1-38a9-4258-8a93-94026ae6741d","resolution":{"observed_at":"2026-05-20T14:19:44.899841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"be71fd52-06f9-46d3-bde0-34af72e2abf1","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:95f62978920fcff070dec0c4e741ca1d2b4aa3633e8a059693f14333da10b85f","observation_id":"6c4ae0ef-39a5-44d9-8d0a-f92ff6b43301","resolution":{"observed_at":"2026-05-20T14:19:44.901601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"290e8498-ed02-40c5-aef9-7eb98df25854","year":2022},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:2dfe79bf5962b7acaacdb9857c79061ef53527b3aee1588a7926c635702acb0c","observation_id":"a3fc8fe2-b381-435b-934f-c5e10389cfb7","resolution":{"observed_at":"2026-05-20T14:19:44.903852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"f142b969-bb25-4675-872c-d72b1e585128","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:93d8dcf7c241013b2156d509a7f4f146dfb0e2ca42258787108637793894fbe2","observation_id":"5ea2be2e-aa31-48dd-aadc-d09ee026e439","resolution":{"observed_at":"2026-05-20T14:19:44.905837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"92a2a109-bd38-4b64-bb99-e21eaf329fbc","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:be43d49bdb03d560543467133fee2d32634f8168f709e455700b7fee661cb307","observation_id":"58bd8690-7d8f-4611-a994-fa334720aa68","resolution":{"observed_at":"2026-05-20T14:19:44.916693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"403b0bd1-d456-431a-b260-f8eae95120f0","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:f922e5c02340d6d8eb723ffc0b8e0bb836f6a34166d93f57b85196e572e88199","observation_id":"3cf9ad6b-1eff-4357-87b6-3ee948a39a27","resolution":{"observed_at":"2026-05-20T14:19:44.920221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T22:54:10.676847Z","title":"2025 , eprint=","venue":null,"work_id":"28ed872d-a8e1-4761-9700-86222c25b5cb","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:4a18395b429610e9a6038eab6ccd9d009e1304d2bd42abaeeaf11d0ff5e228d6","observation_id":"8206dfdc-6dc5-4fbd-8801-6a61e59b0a14","resolution":{"observed_at":"2026-05-20T14:19:44.922089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , month=","venue":null,"work_id":"61fcb7da-1b81-4c18-b83a-6e2b851087b8","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:810afc5d8205401399428d943c8322ca90fa685c4c38ada017abb665df0c8525","observation_id":"b72d09b3-8246-4acf-a79e-ea6d3a9350af","resolution":{"observed_at":"2026-05-20T14:19:44.924069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2021 , eprint=","venue":null,"work_id":"a0597c68-21b2-4158-b746-484135203f2c","year":2021},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:28bc6ca6f77cd9d8ee6aeb8b09a5cc4c38f837f18aa6468b0f1bac3f62a82cdd","observation_id":"48188bf6-2ad8-4be5-b97e-e3653d1e8b95","resolution":{"observed_at":"2026-05-20T14:19:44.926105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T17:52:44.711607Z","title":"Proceedings of the 36th International Conference on Neural Information Processing Systems , articleno =","venue":null,"work_id":"51ad62d6-6e39-4c9a-9158-7a6a2e53a859","year":2022},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:729297759a1016744ea9da62b35549395000b5940f046a9f35e4194bd64cddac","observation_id":"fc300d9d-a94b-4e6f-ae8f-1dda55e9ef17","resolution":{"observed_at":"2026-05-20T14:19:44.928585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:47:55.076712Z","title":"and Le, Quoc V","venue":null,"work_id":"d9e56c99-6aae-4f4d-b3f1-84155f05cec7","year":2022},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:c0cfe9a548c30609b6dd1478188e61af80a9f8eb649f9373e3c2b08c9d389f3d","observation_id":"8134b1c4-b6a4-478d-9e30-ab8f2d27cc42","resolution":{"observed_at":"2026-05-20T14:19:44.930843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"d50a3969-a368-4fcc-badf-7108fe359916","year":2024},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:74a9413ff023bba116b40e8a1414a99f116b6ef658a62cfcca4f1e56190c4091","observation_id":"d0be5f31-bced-47d5-897e-3b11e907b8b5","resolution":{"observed_at":"2026-05-20T14:19:44.932612Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"014343da-fc00-4662-85ff-ed6fe4af298b","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:9256a776586edde92a076e3857758e8f27d8fea2fbb183951fb6f8ffdf47ad05","observation_id":"6f5df163-a52c-49fd-9a37-8523eef62f0b","resolution":{"observed_at":"2026-05-20T14:19:44.934415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:46.775981Z","title":"2025 , eprint=","venue":null,"work_id":"26c7b6ed-f86e-4ed8-b9ed-b1783d90255b","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:88d34d1e9116e74a49ccc1a0b4a2eaf89a73eff40be1623fd7f7497f7e7c87bd","observation_id":"2fd4b8c1-f163-4a44-a2a6-f8db66c4edf9","resolution":{"observed_at":"2026-05-20T14:19:44.936652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:56:41.306165Z","title":"2023 , eprint=","venue":null,"work_id":"ddc0b540-2ce3-4688-8a34-21658a41e700","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:d5e7806d50b2f7ed3ca913b21d20260a80b86b2e2b483de131ebfb39941e8d34","observation_id":"b351967e-fd15-438a-8b08-e513e244ef66","resolution":{"observed_at":"2026-05-20T14:19:44.939246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T00:56:41.327135Z","title":"2025 , eprint=","venue":null,"work_id":"5dd70822-959b-4818-a596-ca2ababa9e8f","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:300e9b5696cae4c1abef6c6f27121894ab284f018822a6674e84d0348bb0515a","observation_id":"30e1b8bc-505a-4061-944e-50b00b067e22","resolution":{"observed_at":"2026-05-20T14:19:44.941389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2020 , eprint=","venue":null,"work_id":"800ca18a-24ff-4763-9cf7-85efe7bb5edf","year":2020},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:b7b49fa6e905f6ed0860152997f667992559de6d989292e9e2c4232460262852","observation_id":"ba526406-09d2-42a3-b9b3-2e4737cf43dd","resolution":{"observed_at":"2026-05-20T14:19:44.943184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On reinforcement learning and distribution matching for fine-tuning language models with no catastrophic forgetting , year =","venue":null,"work_id":"bb341f07-d3ca-49e1-aff5-392ab29ed05b","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:3ebddeccf1b73600d9510f968d1b38d0461e96135b68b1f2958a87d2d238b7c6","observation_id":"7de6f035-0da8-46a8-ad46-8621a0989731","resolution":{"observed_at":"2026-05-20T14:19:44.945543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:31:44.599832Z","title":"and Kaiser","venue":null,"work_id":"b0b27036-ee6f-4f1e-82fe-65d1c911c737","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:05b5e22814e22cea680dbdc6ff2e3e4dd03865157f5b4e28aa6db592d315530b","observation_id":"b1921201-fc9f-463a-ae88-13e326e4900d","resolution":{"observed_at":"2026-05-20T14:19:44.947887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":"0715649f-498a-4d6a-ad72-2ad6a9aab80e","year":null},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:575af1a619c69b02b5eb3cb5feec6567930f986a8923de157d0ca556c628f120","observation_id":"f70f8a8c-74de-4f37-a9ee-4c0c7f4693c8","resolution":{"observed_at":"2026-05-20T14:19:44.950471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"0917ce03-a17a-42d0-bb21-945f4e179149","year":2025},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:1891a5382266552183e011174d449ea946fbfa782b75570a1cdb9cb5f9904967","observation_id":"9b1e8f52-0c73-4f13-a76a-665fe920ca87","resolution":{"observed_at":"2026-05-20T14:19:44.952251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions on Machine Learning Research , issn=","venue":null,"work_id":"cac75a86-9ad6-4d80-946c-184f6b50ebdf","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:d7b0b3325cdb6525ca0cf06a6e5c793662598cd5691b81f53d117e3da6a57fa2","observation_id":"8adbb5f1-9fd1-47e4-a853-b4040b903b28","resolution":{"observed_at":"2026-05-20T14:19:44.954585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"efd4a627-a9d5-4071-993c-6f0ca92e8701","year":2022},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:a7c93ad0f7c1d82f9acc98a9b51a1fd496b8096c878020a7ff5573442d9710d6","observation_id":"0a41f282-d53e-4a10-80d7-7e7cf3ec791b","resolution":{"observed_at":"2026-05-20T14:19:44.956959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"7c211df3-6a47-477a-97a3-e7111cf57a8d","year":2023},"citing_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-20T14:19:44.695462Z"},"links":{"citing_paper":"/paper/2507.11473"},"observation_digest":"sha256:7f9c021698b583a2f8db38e9fbf85c5a10324113e2f9df6b8fe709a6d1e936f2","observation_id":"700e32f5-8d98-4544-bc4e-18fd5bb49cf9","resolution":{"observed_at":"2026-05-20T14:19:44.959006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-10T09:38:50.886870Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":2,"unresolved":3,"verified_exact":11,"verified_fuzzy":78},"total_outbound_references":115},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 115 outbound references and 78 inbound Pith citation observations for arXiv:2507.11473."}