{"as_of":"2026-08-07T09:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:acc6aa3a3b226db2599a18a5dbaae7a6cc167e2950edb49ca280fe4e2c73f5cf","coverage":[{"denominator":97,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":97,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:26:57.754155Z","state":"measured"},{"denominator":98,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":98,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:27:34.770229Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:27:35.026558Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"cited_work":{"arxiv_id":"2506.17846","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.17846","snapshot_observed_at":"2026-08-06T19:27:35.026558Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","venue":"cs.AI","work_id":"0247c1b8-58f4-4999-9dfb-1b3119216d3d","year":2025},"citing_paper":{"arxiv_id":"2507.05587","last_updated":"2025-07-08T01:52:37Z","snapshot_observed_at":"2026-08-06T19:20:18.321551Z","submitted_at":"2025-07-08T01:52:37Z","title":"Towards Measurement Theory for Artificial Intelligence","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:27:34.770229Z"},"links":{"cited_paper":"/paper/2506.17846","citing_paper":"/paper/2507.05587"},"observation_digest":"sha256:63ac6142c096b7c0378ab4bdc94e61d5c525c022f55f4451eac64e7bda5d4e6c","observation_id":"ae3eb31d-6151-4fda-9b35-fb702528aa8a","resolution":{"observed_at":"2026-08-06T19:27:35.061123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17846/citation-record","integrity":"/paper/2506.17846/integrity","json":"/paper/2506.17846/citation-record.json","paper":"/paper/2506.17846"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.06942","last_updated":"2024-07-23T06:47:13Z","snapshot_observed_at":"2026-08-06T12:56:48.193649Z","submitted_at":"2023-12-12T02:34:06Z","title":"AI Control: Improving Safety Despite Intentional Subversion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06942","snapshot_observed_at":"2026-08-06T23:26:57.283865Z","title":"AI control: Improv- ing safety despite intentional subversion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.283865Z"},"links":{"cited_paper":"/paper/2312.06942","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e6523dd0659a7f2d467b3cdf2e1e4d8045e8af4963c943207c78ffae9aed417c","observation_id":"ab12fc43-486f-4daa-bac5-8049aee7dcf1","resolution":{"observed_at":"2026-08-06T23:26:57.283865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17315","last_updated":"2025-01-28T21:52:15Z","snapshot_observed_at":"2026-07-06T20:27:37.265266Z","submitted_at":"2025-01-28T21:52:15Z","title":"A sketch of an AI control safety case","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17315","snapshot_observed_at":"2026-08-06T23:26:57.289552Z","title":"A sketch of an AI control safety case","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.289552Z"},"links":{"cited_paper":"/paper/2501.17315","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:a11c99f8ad3f53c1a3a72ab92da427c7f7b43ec4e0d54db011844d45b21728cf","observation_id":"0075e0b6-928c-4ab7-81c9-2173cc5bde02","resolution":{"observed_at":"2026-08-06T23:26:57.289552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12480","last_updated":"2025-04-04T16:36:02Z","snapshot_observed_at":"2026-07-06T20:08:16.471575Z","submitted_at":"2024-12-17T02:33:45Z","title":"Subversion Strategy Eval: Can language models statelessly strategize to subvert control protocols?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12480","snapshot_observed_at":"2026-08-06T23:26:57.294628Z","title":"Subversion strategy eval: Can language models statelessly strategize to subvert control protocols? arXiv preprint arXiv:2412.12480, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.294628Z"},"links":{"cited_paper":"/paper/2412.12480","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:375281a09f83c6a3d62309c590c704c9c8c5d08fa1266525065ce29b9edaa387","observation_id":"3fdd020e-e755-40fa-90bc-d03e4a508367","resolution":{"observed_at":"2026-08-06T23:26:57.294628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17693","last_updated":"2024-11-26T18:58:20Z","snapshot_observed_at":"2026-08-04T20:54:02.244353Z","submitted_at":"2024-11-26T18:58:20Z","title":"Adaptive Deployment of Untrusted LLMs Reduces Distributed Threats","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17693","snapshot_observed_at":"2026-08-06T23:26:57.299859Z","title":"Adaptive deployment of untrusted LLMs reduces distributed threats","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.299859Z"},"links":{"cited_paper":"/paper/2411.17693","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:65cc008d503bb034d9b70bd8770fd1024415a59901893aef24c654ef1f7e8bee","observation_id":"7c3799c3-51b8-44de-a3a1-0bf9ccc84549","resolution":{"observed_at":"2026-08-06T23:26:57.299859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.305751Z","title":"Hidden in plain text: Emergence & mitigation of steganographic collusion in LLMs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.305751Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d1d1f79bc9d0f467737ab60bf4b3a06960dd98bffedc3903a0974a4f90ae471b","observation_id":"6bdb94a0-4680-491c-9e79-36571991cb74","resolution":{"observed_at":"2026-08-06T23:26:57.305751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.310460Z","title":"Mechanistic anomaly detection and elk","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.310460Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:47428a1184fac6edfa9ba800e404103aa768b7aa732696a6192e0cdd20c5b5a0","observation_id":"09f8f5fc-d200-4615-8aee-44edd28c4f68","resolution":{"observed_at":"2026-08-06T23:26:57.310460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-06T23:26:57.315490Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.315490Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:18116ee00265781de726223e0d5f0a1c8c2f27a71dfd5017f498c99b411a30fd","observation_id":"7a0f4489-f5b4-470c-9219-226c2b6fdc6f","resolution":{"observed_at":"2026-08-06T23:26:57.315490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-06T23:26:57.320407Z","title":"Michaud, Stephen Casper, Max Tegmark, William Saunders, David Bau, Eric Todd, Atticus Geiger, Mor Geva, Jesse Hoogland, Daniel Murfet, and Tom McGrath","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.320407Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:a2e2c1afed67815a5448dfbc91e6bb83ec3acbed65470fa19c366e0f838d2fbe","observation_id":"40e474c2-869f-4a60-8bac-dba478f0581b","resolution":{"observed_at":"2026-08-06T23:26:57.320407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.326661Z","title":"Berkovitz and Negash G","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.326661Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d61331c39cf349843286d6174b5712b922dd1ed5d57a0be20537732e4ddf1fbf","observation_id":"20397426-c115-47a5-a529-d2f1b29d540d","resolution":{"observed_at":"2026-08-06T23:26:57.326661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.06293","last_updated":"2019-03-14T23:07:48Z","snapshot_observed_at":"2026-07-06T07:39:24.062299Z","submitted_at":"2019-03-14T23:07:48Z","title":"A Research Agenda: Dynamic Models to Defend Against Correlated Attacks","version":1},"cited_work":{"arxiv_id":"1903.06293","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.06293","snapshot_observed_at":"2026-08-06T23:26:58.238089Z","title":"A Research Agenda: Dynamic Models to Defend Against Correlated Attacks","venue":"cs.LG","work_id":"1269241c-6c6f-4a37-94d7-8149001109d8","year":2019},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.330986Z"},"links":{"cited_paper":"/paper/1903.06293","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:41d44921edd95bea970e70129004fa39dde6fe38ab2d146d65040d416d2f7aec","observation_id":"30a29f39-a2b9-47a2-864d-13cd9eca1f87","resolution":{"observed_at":"2026-08-06T23:26:58.243301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.335594Z","title":"Learning to summarize from human feedback","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.335594Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:39059a4808ced458f5c35708f37e8b4935cbf0adb74faca1b46c340df05585dc","observation_id":"8f4e846f-ed77-416d-bbeb-9865ddf0fd5a","resolution":{"observed_at":"2026-08-06T23:26:57.335594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.340226Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.340226Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:99dfe9e24900e01821509d1527d67805ff824c96f9569cb2800633a929ecf512","observation_id":"b24e0c39-92c9-420b-9a4a-bd334de653e3","resolution":{"observed_at":"2026-08-06T23:26:57.340226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-06T23:26:57.344640Z","title":"Fine-tuning language models from human preferences","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.344640Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:28db40ff90671958ff48ddcb335ff044e0f5861ef30ed73ad1ce916240bd70f0","observation_id":"9dc2a1c7-2f43-4554-b9dd-3faf7f7c8e44","resolution":{"observed_at":"2026-08-06T23:26:57.344640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-06T23:26:57.349277Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.349277Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:bbb17630c4cd66f56a6d6d894a92138b454eca8533c1ede1298c433c3802eee3","observation_id":"28b69cd8-196e-450e-a172-3ea8edad8196","resolution":{"observed_at":"2026-08-06T23:26:57.349277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-06T23:26:57.353876Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.353876Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:4c923caf7d3846c53a86226be7483a1b37670fc771147a70e73f3f660cb2b955","observation_id":"6e751683-b89e-488a-80fe-3877b08c11a4","resolution":{"observed_at":"2026-08-06T23:26:57.353876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.358600Z","title":"Cooperative inverse reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.358600Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:639dc15ca59eb8f52977af40de3e797788b018d6e0e8f4db30c1250615f2f588","observation_id":"5e7e2798-2cdb-42ae-a2e2-748c3cded518","resolution":{"observed_at":"2026-08-06T23:26:57.358600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-07-06T07:15:51.575438Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-06T23:26:57.362934Z","title":"Scalable agent alignment via reward modeling: A research direction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.362934Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:35c71e8b669f03a41be88ade33f209b61d27f6b4c0aedc37000c4bb7be0d4a65","observation_id":"a75905cd-e4ab-40db-969b-80a1713f02c9","resolution":{"observed_at":"2026-08-06T23:26:57.362934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-06T23:26:57.367629Z","title":"Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.367629Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:dda458dbaa8695cf7b56b595a9a81cd709cc9c8c5495186fce203768bb061e27","observation_id":"10908b4d-a984-4b7c-980f-9e872c76bd49","resolution":{"observed_at":"2026-08-06T23:26:57.367629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07907","last_updated":"2023-10-27T06:59:24Z","snapshot_observed_at":"2026-07-06T16:31:33.607406Z","submitted_at":"2023-10-11T21:24:59Z","title":"The Pristine survey -- XXII. A serendipitous discovery of an extremely Li-rich very metal-poor giant and a new method of $^6$Li/$^7$Li isotope measurement","version":2},"cited_work":{"arxiv_id":"2310.07907","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.07907","snapshot_observed_at":"2026-08-06T23:26:58.140887Z","title":"The Pristine survey -- XXII. A serendipitous discovery of an extremely Li-rich very metal-poor giant and a new method of $^6$Li/$^7$Li isotope measurement","venue":"astro-ph.GA","work_id":"6fba65f2-1636-48ab-938b-af10507411f9","year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.372263Z"},"links":{"cited_paper":"/paper/2310.07907","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:1b8b279bc6242be8a06308acc4dc4c4dc24e520bc022dac09527115fd6ef0b28","observation_id":"c5dfe7dc-112a-468e-9f77-317055abfb9a","resolution":{"observed_at":"2026-08-06T23:26:58.146256Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.378196Z","title":"Consequences of misaligned AI","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.378196Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0d03a1ec792fe9aad90cd415249df7370f79f156e5d18b8a7525b62ecdedd6ff","observation_id":"6ec8cef2-c81f-4cae-87c5-0b2407571081","resolution":{"observed_at":"2026-08-06T23:26:57.378196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01820","last_updated":"2021-12-01T11:22:52Z","snapshot_observed_at":"2026-08-01T23:32:03.638122Z","submitted_at":"2019-06-05T04:43:25Z","title":"Risks from Learned Optimization in Advanced Machine Learning Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01820","snapshot_observed_at":"2026-08-06T23:26:57.382401Z","title":"Risks from learned optimization in advanced machine learning systems","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.382401Z"},"links":{"cited_paper":"/paper/1906.01820","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e358f554f2055825802336c2664fc43350e14db490639b7216f00abc2a0eca5d","observation_id":"5775113a-50f0-4329-8b43-f4bba1509c50","resolution":{"observed_at":"2026-08-06T23:26:57.382401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01909","last_updated":"2024-01-10T17:00:28Z","snapshot_observed_at":"2026-07-06T17:11:21.633421Z","submitted_at":"2023-12-27T12:14:21Z","title":"On the relevance of the Godot Engine in the indie game development industry","version":2},"cited_work":{"arxiv_id":"2401.01909","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.01909","snapshot_observed_at":"2026-08-06T23:26:58.102330Z","title":"On the relevance of the Godot Engine in the indie game development industry","venue":"cs.OH","work_id":"5e9e3382-8008-41ce-8b9d-1612dcdedb4a","year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.387612Z"},"links":{"cited_paper":"/paper/2401.01909","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:5424d9d3209acbc623a37c2ef5feda24d0b8579f9fa8a511aeee8c6b8211e986","observation_id":"b7279a7c-6550-4fcf-8609-dc0f7a0a6616","resolution":{"observed_at":"2026-08-06T23:26:58.107965Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.392376Z","title":"Steganography in chain of thought reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.392376Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:953d847ae883e6a79bba72bb9a3e1696b55830cf526b7f96a063726055299195","observation_id":"523ab9c4-8d1d-4b4b-b703-f3731febc4bf","resolution":{"observed_at":"2026-08-06T23:26:57.392376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.397660Z","title":"Neural linguistic steganography","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.397660Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:ebb9699a8249807c3bb42edf4de41f93dcef9bb457c1c6be263a6280c1b95e9f","observation_id":"ec1ebec8-65a9-4a13-bcb2-5a02e34890b0","resolution":{"observed_at":"2026-08-06T23:26:57.397660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.402416Z","title":"Information hiding-a survey","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.402416Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f7a9323d1fac3e6a50eec9d9e79f4a618cd2c8804f8511158e57c612223b9df2","observation_id":"f152e7d6-8fe4-401f-afad-b3018f80b3bb","resolution":{"observed_at":"2026-08-06T23:26:57.402416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.02950","last_updated":"2017-12-16T07:42:46Z","snapshot_observed_at":"2026-07-06T06:13:23.505399Z","submitted_at":"2017-12-08T06:07:52Z","title":"CycleGAN, a Master of Steganography","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.02950","snapshot_observed_at":"2026-08-06T23:26:57.407246Z","title":"Cyclegan, a master of steganography.ArXiv preprint, abs/1712.02950, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.407246Z"},"links":{"cited_paper":"/paper/1712.02950","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:83a80a6513b09978a370dc417178812be30bd916f98ba060d70a9e245202e99d","observation_id":"1afc3dff-0957-4efc-945d-c63465a950a6","resolution":{"observed_at":"2026-08-06T23:26:57.407246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.412853Z","title":"A review on text steganography techniques","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.412853Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e47f512513d805fd822f8aa618a2121e430bb6c011725d6b32f4204d8546a242","observation_id":"6937da5d-d4df-4bee-bbda-49f5a95c1e45","resolution":{"observed_at":"2026-08-06T23:26:57.412853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.417899Z","title":"Emergent misalignment: Narrow finetuning can produce broadly misaligned llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.417899Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b23267a59a9ffbde07aed2d6e39bafb947686a6b26ba6f165fcbccd4c9073240","observation_id":"d1391414-55f8-42d2-89f3-84236a15ee36","resolution":{"observed_at":"2026-08-06T23:26:57.417899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.422285Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.422285Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:a19cbd33cf99774158266d0194ccf997b2706d9ab70dca432b20803a5bba2ad2","observation_id":"be5e32ca-d5bb-40de-99c1-b3047f8595bc","resolution":{"observed_at":"2026-08-06T23:26:57.422285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.427086Z","title":"Arc’s first technical report: Eliciting latent knowledge","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.427086Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:01489f44934b5d7e15c3a89e32f6fd50bd7d87bd271128c964b50d592d94c632","observation_id":"339b3efe-c9c7-4a3c-9997-1077bf4cd380","resolution":{"observed_at":"2026-08-06T23:26:57.427086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13353","last_updated":"2024-08-13T07:19:59Z","snapshot_observed_at":"2026-08-07T07:48:13.488825Z","submitted_at":"2022-06-16T17:58:47Z","title":"Is Power-Seeking AI an Existential Risk?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13353","snapshot_observed_at":"2026-08-06T23:26:57.431297Z","title":"Is power-seeking ai an existential risk? arXiv preprint arXiv:2206.13353, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.431297Z"},"links":{"cited_paper":"/paper/2206.13353","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:1aa83cadab48771918b28e318c66a47779509e367503cc2ef6d8826d96c71888","observation_id":"fe61fc05-1d5e-429f-bd1e-50696299657a","resolution":{"observed_at":"2026-08-06T23:26:57.431297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.435862Z","title":"Optimal policies tend to seek power","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.435862Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:accc3605e054bcd33b695fe764fb2b5b15fa7ee55566dc3965c42c19442cd9b9","observation_id":"0c43d34d-c830-4c9c-95f8-cd70bdf42d44","resolution":{"observed_at":"2026-08-06T23:26:57.435862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.441272Z","title":"Corrigibility","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.441272Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0c4fca1a29e8e387de32a17914cf50a44989d00b3fbbaba36d1ec00b495b090b","observation_id":"91d1d0cd-e82a-455e-9c32-91d9b55043f2","resolution":{"observed_at":"2026-08-06T23:26:57.441272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.00899","last_updated":"2018-10-22T17:36:07Z","snapshot_observed_at":"2026-08-02T15:33:17.783178Z","submitted_at":"2018-05-02T16:27:32Z","title":"AI safety via debate","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.00899","snapshot_observed_at":"2026-08-06T23:26:57.451135Z","title":"Ai safety via debate","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.451135Z"},"links":{"cited_paper":"/paper/1805.00899","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f04efd67cedd286f038c690ebd7791f8580749c6824a6a1c1bcb991023395d70","observation_id":"c4d5ef54-f1ca-4500-93fa-7c05a3fce28c","resolution":{"observed_at":"2026-08-06T23:26:57.451135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08702","last_updated":"2023-11-15T05:05:40Z","snapshot_observed_at":"2026-07-06T16:47:45.504109Z","submitted_at":"2023-11-15T05:05:40Z","title":"Debate Helps Supervise Unreliable Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08702","snapshot_observed_at":"2026-08-06T23:26:57.455690Z","title":"Debate helps supervise unreliable experts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.455690Z"},"links":{"cited_paper":"/paper/2311.08702","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:c306754a0be3802ea867d3debdb9fb68d6e6436c12eec9829515b8574915f2f6","observation_id":"0e8cf767-1101-4c6e-92c4-bc2ccc28eeaf","resolution":{"observed_at":"2026-08-06T23:26:57.455690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06624","last_updated":"2024-07-08T13:35:00Z","snapshot_observed_at":"2026-07-06T18:12:43.301678Z","submitted_at":"2024-05-10T17:38:32Z","title":"Towards Guaranteed Safe AI: A Framework for Ensuring Robust and Reliable AI Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.06624","snapshot_observed_at":"2026-08-06T23:26:57.460137Z","title":"Towards guar- anteed safe ai: A framework for ensuring robust and reliable ai systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.460137Z"},"links":{"cited_paper":"/paper/2405.06624","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:0c4b10cfa0a713c68e12659cdd0161a87177cc6782daa126fc1704baee356324","observation_id":"4cb71390-ee26-42d7-b8bd-9ba263b7c9da","resolution":{"observed_at":"2026-08-06T23:26:57.460137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02867","last_updated":"2024-02-05T10:30:08Z","snapshot_observed_at":"2026-07-06T17:25:22.551344Z","submitted_at":"2024-02-05T10:30:08Z","title":"A new robust approach for the polytomous logistic regression model based on R\\'enyi's pseudodistances","version":1},"cited_work":{"arxiv_id":"2402.02867","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.02867","snapshot_observed_at":"2026-08-06T23:26:57.908429Z","title":"A new robust approach for the polytomous logistic regression model based on R\\'enyi's pseudodistances","venue":"stat.ME","work_id":"e57bc4af-5a70-4b81-8321-405644a5403e","year":2024},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.465214Z"},"links":{"cited_paper":"/paper/2402.02867","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:7b679cb38f1bac68d4a3aaf9039eca69f20be4fd883ee4347c56a5082f9b049d","observation_id":"6484fdc9-805a-4106-bfc3-6eced7d4b468","resolution":{"observed_at":"2026-08-06T23:26:57.913086Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03544","last_updated":"2022-02-14T09:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-10T18:58:52Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03544","snapshot_observed_at":"2026-08-06T23:26:57.469751Z","title":"The effects of reward misspecification: Mapping and mitigating misaligned models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.469751Z"},"links":{"cited_paper":"/paper/2201.03544","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:044262dd836e99a516d5582c8feb61d6fbac8992d93606f79e196b66bd62bb99","observation_id":"1de1f1e8-f83b-48e8-b322-b84b1cdf1473","resolution":{"observed_at":"2026-08-06T23:26:57.469751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.00626","last_updated":"2025-05-04T15:50:51Z","snapshot_observed_at":"2026-08-04T21:45:55.051017Z","submitted_at":"2022-08-30T02:12:47Z","title":"The Alignment Problem from a Deep Learning Perspective","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.00626","snapshot_observed_at":"2026-08-06T23:26:57.474356Z","title":"The alignment problem from a deep learning perspective","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.474356Z"},"links":{"cited_paper":"/paper/2209.00626","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:2e3c75cbe08707d30ff1fc7c03686e847fa22ad3a712ea6a71d695f1fbe3d608","observation_id":"972a95bd-1328-4030-a171-307a97df5f0c","resolution":{"observed_at":"2026-08-06T23:26:57.474356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.479472Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.479472Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b9cb2ed04fab3fb0d12c8bfc90f46735247723c3dc6056fa42049d9b9e3a303c","observation_id":"59348b0c-9cde-4e9e-9ea7-da61df4f85c2","resolution":{"observed_at":"2026-08-06T23:26:57.479472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03202","last_updated":"2022-02-01T21:13:34Z","snapshot_observed_at":"2026-07-06T12:35:13.377047Z","submitted_at":"2022-02-01T21:13:34Z","title":"One-Year In: COVID-19 Research at the International Level in CORD-19 Data","version":1},"cited_work":{"arxiv_id":"2202.03202","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.03202","snapshot_observed_at":"2026-08-06T23:26:57.854099Z","title":"One-Year In: COVID-19 Research at the International Level in CORD-19 Data","venue":"cs.DL","work_id":"f612716c-a332-4fd5-85c4-c72c003bbdc0","year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.487947Z"},"links":{"cited_paper":"/paper/2202.03202","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:1316952f1c4c96ef5a996f5f45cc6e487cc96792a6892bb778375278c65696dc","observation_id":"89095439-ec12-4800-a7a6-dca73a60ef5d","resolution":{"observed_at":"2026-08-06T23:26:57.861338Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.03540","last_updated":"2022-11-11T20:17:18Z","snapshot_observed_at":"2026-07-06T14:15:17.474527Z","submitted_at":"2022-11-04T17:03:49Z","title":"Measuring Progress on Scalable Oversight for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.03540","snapshot_observed_at":"2026-08-06T23:26:57.492998Z","title":"Measuring progress on scalable oversight for large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.492998Z"},"links":{"cited_paper":"/paper/2211.03540","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:3b9e088f4f4625c15f9051d5a9ba5195be1805ab307f2db3db3d755a5e758b9b","observation_id":"329a6965-01d5-4c3c-85e1-d48057160d83","resolution":{"observed_at":"2026-08-06T23:26:57.492998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-06T23:26:57.497730Z","title":"Discovering language model behaviors with model-written evaluations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.497730Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:392f112f953e0dfb96387535b1298c90422247db7fee1f54cefff8bf843401ce","observation_id":"07886c10-0fc8-4fbb-a355-0f241ea5eda3","resolution":{"observed_at":"2026-08-06T23:26:57.497730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-06T00:58:30.657180Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-06T23:26:57.502600Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.502600Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:ce0cede96f7c200491d1ae7b2554d0eb6a8fc724add909043ddbfb35872b378c","observation_id":"b4d26c89-ef97-4f54-a784-e949f76de09d","resolution":{"observed_at":"2026-08-06T23:26:57.502600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06674","last_updated":"2021-10-13T12:18:09Z","snapshot_observed_at":"2026-07-06T11:57:24.991499Z","submitted_at":"2021-10-13T12:18:09Z","title":"Truthful AI: Developing and governing AI that does not lie","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06674","snapshot_observed_at":"2026-08-06T23:26:57.507257Z","title":"Truthful ai: Developing and governing ai that does not lie","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.507257Z"},"links":{"cited_paper":"/paper/2110.06674","citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:3c983e3f43d1d91b85d5cc743d6b6784c30567372c8ec4d5830128fdaf8ab9f9","observation_id":"e963b313-e3ce-4a8f-a981-2ad6bf27bafc","resolution":{"observed_at":"2026-08-06T23:26:57.507257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.511663Z","title":"Safe reinforcement learning via shielding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.511663Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:bd29eb58fd0ab6f91ba34b7d5defc80d139f616c0ff9d064a64da019661b7951","observation_id":"75d5ecf9-2be6-49fc-90d7-fe55ee7d10b2","resolution":{"observed_at":"2026-08-06T23:26:57.511663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:57.516626Z","title":"Robust adversarial reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.516626Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:9ec6e50ba1bb511888ac02be2418fee0cf4733084c3b6c21d2b97d1e681862b4","observation_id":"118426b5-8c24-4398-b2a4-93a8eb3412ae","resolution":{"observed_at":"2026-08-06T23:26:57.516626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.263438Z","title":"Dynamic programming and optimal control, volume 1","venue":null,"work_id":"ecb8acf5-4434-4547-8a84-1e0e6be3fb57","year":2005},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.520713Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f66107fec28a7c9e88ed2107d1f45d32d170e302b34b16db769bfebec5763731","observation_id":"4f938f2e-83ea-4ff4-837f-3ea38260fa2d","resolution":{"observed_at":"2026-08-06T23:26:59.267980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.249038Z","title":"Robust and optimal control","venue":null,"work_id":"31d924c7-f5d8-47b6-b412-c40bae522067","year":1996},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.525183Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:814e24064acebc9f94984d64e7b262e8381f70eedb8c792f82e529f6dd80c7fc","observation_id":"0a2f84d3-4ddc-4f66-81e1-a5834221f5dd","resolution":{"observed_at":"2026-08-06T23:26:59.253765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.234911Z","title":"Optimal control theory: an introduction","venue":null,"work_id":"e8177254-537d-4944-9ba0-6859799ca280","year":1970},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.530225Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f172dc44bab84b4144f541c1f9adc6673e46eca82f4b0931a36e8350677aaef1","observation_id":"ede4711e-9d33-4c3e-bdd8-d0690d0accaf","resolution":{"observed_at":"2026-08-06T23:26:59.239370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.220579Z","title":"Optimal control","venue":null,"work_id":"5d208891-dc41-4fdb-9d87-e6a305930551","year":2012},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.535511Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:1425881529c67d74835b50d3ab0d7743c70d9d5d234ec8af48845be782cefe71","observation_id":"137e513d-2f59-42df-8ad6-7f2ee19dddd1","resolution":{"observed_at":"2026-08-06T23:26:59.225474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.206167Z","title":"Adaptive control","venue":null,"work_id":"89f357f2-4e96-4a47-b60d-c716ded1b1c3","year":2008},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.539962Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:7efbf7beade80cbcaca513da059c3b10c7b64bd49e16394adf5db7a240541ca6","observation_id":"b543f7f1-88cf-4637-9fff-b266e9ee4bdf","resolution":{"observed_at":"2026-08-06T23:26:59.210857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.190274Z","title":"Model predictive control","venue":null,"work_id":"85d880a7-5b04-42f7-b7f6-ba5888c56dbc","year":2013},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.545410Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:4ca34e42643a6645d772ce3d07f60cd9bb8671bc15b4b932a78f796c80052102","observation_id":"0c6359aa-fbd5-4a43-b3ae-6268e04a0564","resolution":{"observed_at":"2026-08-06T23:26:59.196061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.174546Z","title":"Stochastic optimal control: the discrete-time case , volume 5","venue":null,"work_id":"47009e14-2286-4c52-b4cb-32ee46ef527d","year":1996},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.549740Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:076c313466a523fdd6a56de26a1b063c5cf7516b1e4dc2168f7a4384469183cf","observation_id":"48cd507c-b336-4db8-be0b-8ff796034a38","resolution":{"observed_at":"2026-08-06T23:26:59.179346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.159896Z","title":"Nonlinear control systems","venue":null,"work_id":"4d63ce06-7ed2-4218-8423-d07709729387","year":1995},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.554104Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:68b82ff3a7f9d16731ede4a5ea376ecafb4fd43b4398b6f0a53fee4e6d0f4f17","observation_id":"d6702858-719b-42ad-8e71-e6cbd3901a41","resolution":{"observed_at":"2026-08-06T23:26:59.164569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.145046Z","title":"Geometric control of mechanical systems: modeling, analysis, and design for simple mechanical control systems","venue":null,"work_id":"7eccbdb2-403d-4617-a110-344197fd24e4","year":2004},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.558392Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:fb60d15aeaa640eb392fe042194d02a667f77cf512e680fb003b8d1f8ae5e5fd","observation_id":"d0662494-ffad-4fc4-824f-a158065e2adb","resolution":{"observed_at":"2026-08-06T23:26:59.150038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.130282Z","title":"Hybrid dynamical systems: modeling, stability, and robustness","venue":null,"work_id":"77b22dc1-2f9c-4ca1-af53-e7f57a67d776","year":2012},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.562822Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:a26878977248a31550bd102b7e33c3dfa101134b63c3e143db99118522e2abf3","observation_id":"eb062195-036f-4e8d-9510-bd13859555ac","resolution":{"observed_at":"2026-08-06T23:26:59.135036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.116518Z","title":"Reinforcement learning: An introduction","venue":null,"work_id":"42428170-2a47-4c5a-8afe-502987658a03","year":2018},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.567484Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:5b7e4ccf5fb045b91d9dcd606f536a8aae93e4977f66e3e2d85805be9b0bf076","observation_id":"1afd2908-f842-4578-8f7d-eae8cea6b095","resolution":{"observed_at":"2026-08-06T23:26:59.120979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.102651Z","title":"˙x∗(t) = ∂H ∂λ (t, x∗(t), u∗(t), λ(t)) (12) ˙λ(t) = − ∂H ∂x (t, x∗(t), u∗(t), λ(t)) (13) where the Hamiltonian H(t, x, u, λ) = λ0f 0(t, x, u) + Pn i=1 λi(t)f i(t, x, u)","venue":null,"work_id":"36cbb522-0ecb-4007-b1b3-0fb167fff8e0","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.571978Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:fad5b3458ce2e96f3cbb568e5cfc12a6321ae6921bd5486099b339ec528baf43","observation_id":"85910cfd-120d-43a4-bf1c-259ce9df6602","resolution":{"observed_at":"2026-08-06T23:26:59.107291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.088643Z","title":"For almost all t ∈ [t0, t1], H(t, x∗(t), u∗(t), λ(t)) = sup z∈Ω(t,x∗(t)) H(t, x∗(t), z, λ(t)) (14)","venue":null,"work_id":"1ddb5017-9a58-410f-ad99-263975de5dd6","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.577039Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:95498100978311bcbdb9ee9ebf2c3a3d882e7e886efdf1aa2d5b5b3799940271","observation_id":"6aec0a9b-d173-4222-8f53-86f322499486","resolution":{"observed_at":"2026-08-06T23:26:59.093151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.074306Z","title":"At the endpoints (t0, x∗(t0)) and (t1, x∗(t1)), the vector (−H(t0), λ(t0), H(t1), −λ(t1)) (where H(t) is H evaluated along the extremal) is orthog- onal to the end-manifold B","venue":null,"work_id":"0171ad3d-485e-4fda-aee2-542a5655c94f","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.581799Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:366af261b0b10554fdc9480cf1f6c59a9dedb9f17a6fde61fdc1bda33bd4c7ee","observation_id":"21d58aa7-2b20-42cd-9efd-47d8fd24fa3f","resolution":{"observed_at":"2026-08-06T23:26:59.079099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.059731Z","title":null,"venue":null,"work_id":"ae9663a5-ca29-411e-be28-a0c62291e0f2","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.586823Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:6b5d4d6be593d2e26df63c02a51e99f65e51cfdcc405bf192ef59564359d1bef","observation_id":"81438081-e24b-4463-9059-09359952aa4f","resolution":{"observed_at":"2026-08-06T23:26:59.064181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.044791Z","title":null,"venue":null,"work_id":"696931d6-6a99-4fb3-addc-6d903740b4bf","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.591884Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b88adf3da762e8152ad2786b660dd94672759545d4a8ca6ee78ca3a9988d01e6","observation_id":"795b0bda-e112-476c-bc4c-209e73382294","resolution":{"observed_at":"2026-08-06T23:26:59.049526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.030158Z","title":"This involves adjusting operational parameters of physical components","venue":null,"work_id":"90ebb0d8-859f-4dd2-88f6-a8860a3c7fcb","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.597023Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:afdaaa2b3c20489e68f148fe070933518d529631d71e6fad798211fdc63f47fa","observation_id":"01562de8-af0b-45bc-82d5-17daae9e2a60","resolution":{"observed_at":"2026-08-06T23:26:59.034924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:59.015100Z","title":"This concerns distributing computational tasks across available processing units (e.g., GPU kernels)","venue":null,"work_id":"e5b7e9fe-ae5a-4008-b68b-b0298302004c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.602475Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:75d9014decc60991b5d0bf2c0069a6777d51618aeb12be0a674df31939694561","observation_id":"b39cf135-32c6-441b-ab87-3afd32da7477","resolution":{"observed_at":"2026-08-06T23:26:59.020066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.998937Z","title":"This includes mechanisms like Error Correction Codes (ECC) in memory or redundant array of inexpensive disks (RAID) for storage","venue":null,"work_id":"6e82b706-d1c2-400a-af42-c47e81bd736f","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.607598Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:cd7b96784743006704cbbcfe1f0769ad6383cef1d9b67d238d9172d41c2d6bb4","observation_id":"b5ca32a1-ea19-4f32-99f2-8ff8c5a68446","resolution":{"observed_at":"2026-08-06T23:26:59.004976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.983561Z","title":"OS and containerization tools allow setting limits on resource consumption per process or container (e.g., Linux cgroups)","venue":null,"work_id":"0ba99ce6-feb4-4f71-a2ca-fbbcd10e5358","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.612961Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:59f74efb49424ba20e6de1b2e47366d49e245820a69819ffcbca6302617ff21d","observation_id":"5260a0b9-0003-4c11-8515-beabdeac6f29","resolution":{"observed_at":"2026-08-06T23:26:58.988645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.969471Z","title":"The OS scheduler manages the execution order of processes and threads","venue":null,"work_id":"b0f7ae57-42aa-469c-b662-e558de114cd6","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.618080Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:dafae32937b0553b24d0a90eb36705a0c5a81872c8b63e04ea999eb636e723d1","observation_id":"25bcc983-12b4-44ec-bbe9-e627e225b119","resolution":{"observed_at":"2026-08-06T23:26:58.973984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.954671Z","title":"Using containers, virtual machines, or specific OS mechanisms (e.g., seccomp, AppArmor) to restrict the privileges and visibility of AI processes","venue":null,"work_id":"ea625bce-35e2-4867-8531-b14402efc6a3","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.622787Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e95688ad75a2d5b12d6631ef8edabbba873e5127b6a21eaeda717657702fede0","observation_id":"568f8085-15ae-4e6b-bd49-e1d2c977be39","resolution":{"observed_at":"2026-08-06T23:26:58.959287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.939987Z","title":"Frameworks often perform optimisations like op- erator fusion, constant folding, and memory planning on the AI model’s computational graph","venue":null,"work_id":"d4b621f6-bd07-4019-8012-4c8a50c9478b","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.627271Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:aae79a0acc6f6295afd19b102a59dccc977117edeaa25aac70c0c1afa5958d35","observation_id":"c41fae4d-9ee8-4b4c-8e89-5958c1c27db3","resolution":{"observed_at":"2026-08-06T23:26:58.944616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.925663Z","title":"Techniques applied during computation to maintain numeri- cal precision and prevent issues like vanishing/exploding gradients","venue":null,"work_id":"d8100310-855b-466c-8e07-51247e6b8bf4","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.632324Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d4efaaf46671e3e39e92d1b821526483a56044aff2b6a95b19e3d010198ea3bc","observation_id":"79952eb8-3a97-4d05-8ba2-aed4f906db05","resolution":{"observed_at":"2026-08-06T23:26:58.930479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.911042Z","title":"Mechanisms for managing data and model parallelism, synchronizing gradients, and handling parameter updates across multiple devices or nodes","venue":null,"work_id":"4105d3fd-4ae2-4497-a8f7-a6a7564bca39","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.637503Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d7f09bc97d0a9b8b09d70549bda5a38b8a7ec110061966b3362aaac5192f08d8","observation_id":"03a971ba-78f7-47db-8445-760c7c2d4015","resolution":{"observed_at":"2026-08-06T23:26:58.915881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.896549Z","title":"Its efficiency and correctness are crucial for successful model development","venue":null,"work_id":"49bfabd9-180b-4532-bd46-8bb5e42cf8b4","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.641868Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:1102b2461cc70a8e467e3e88a873c431248c5001a5cb93ec6a28dfc33a348bc7","observation_id":"2a14673b-1ee7-446f-87da-5b782d41d6b8","resolution":{"observed_at":"2026-08-06T23:26:58.901153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.880782Z","title":"The deliberate selection of network structures, layer types, and connectivity","venue":null,"work_id":"cd3ec099-df2d-447d-9a0e-b947ba33305b","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.646312Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:dd8220090b5cfd89388c4f5f0739ac9968784f477018ab1a877d15b4f18ba41a","observation_id":"0207fbd2-b062-4de4-a1d9-ddc2c9a2b47f","resolution":{"observed_at":"2026-08-06T23:26:58.886207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.865425Z","title":"Incorporating architectural elements that intrinsi- cally promote better generalisation or robustness, such as dropout layers or batch normalisa- tion","venue":null,"work_id":"f073824c-dab0-40da-8e6d-ecb030d15469","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.651553Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:93fe3a9af0f5cf2f66a2efd5f963d94b168a4d9bcad472e5c5cd1fabf1507c5e","observation_id":"6f494e16-29ea-4065-a968-b5280365186d","resolution":{"observed_at":"2026-08-06T23:26:58.871166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.850382Z","title":"Methods like pruning (removing less important weights/neurons) and quantization (reducing the precision of weights and activations)","venue":null,"work_id":"c617146a-6447-4aeb-b171-13f7ef0ed226","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.655987Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:647b66c3d72de84f9ea01f6e08dc144bede9c910844b6edbd010064755c16114","observation_id":"bd8be8eb-0581-47a3-83f5-d6710a09d4d5","resolution":{"observed_at":"2026-08-06T23:26:58.855157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.835534Z","title":"Selecting, cleaning, and transforming the training data","venue":null,"work_id":"47b6e3d6-9e77-4fb2-9369-8263caa1ce97","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.660467Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:de5dd0ac1d1775e011495c862e023343fe19356c86d8c5b35f6d3ddf7879eb2e","observation_id":"71f2ee9b-fd11-49bb-a2c3-054be200ae91","resolution":{"observed_at":"2026-08-06T23:26:58.840902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.821624Z","title":"Defining the loss function Ltask that the model aims to minimise, and potentially adding regularization terms Lregi or constraints","venue":null,"work_id":"729bb320-12e7-4975-9283-73f4705e473c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.664742Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:b596fe1b8cd7cd0bd2bb12b84450f91403dd0301c784d8bdd980299753ac9847","observation_id":"24b7d4b6-37a5-481b-822e-533363ff6250","resolution":{"observed_at":"2026-08-06T23:26:58.826148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.807233Z","title":"Choosing the optimizer (e.g., SGD, Adam) and its parameters (e.g., learning rate ηt, batch size Bt, momentum βt)","venue":null,"work_id":"c70f1e05-3464-42ad-9654-e187bcb82cbf","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.669102Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:04a17947939a09307c8729133479b6cc392f9dce775acd6885142d424cd70b85","observation_id":"51470257-ea07-4e3a-9e00-eee556489701","resolution":{"observed_at":"2026-08-06T23:26:58.811945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.793225Z","title":"Monitoring performance on a validation set and stop- ping training when performance no longer improves, saving model checkpoints periodically","venue":null,"work_id":"facbd534-a8a7-4bfc-840d-0e6ca52aeb40","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.673973Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:5619edc4c8c6c1b18b91c8dc2959704ca9a157d530a8c62d091682f16ea90ff9","observation_id":"683017bc-a545-444d-9d06-72ce2f30305e","resolution":{"observed_at":"2026-08-06T23:26:58.797732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.778514Z","title":"Post-processing model outputs to detect and remove or modify undesirable content (e.g., harmful language, private information)","venue":null,"work_id":"afa90781-9957-4df3-8d83-867f4c60a697","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.678601Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:61a274f80ad40ccc5bd54b176f8b7f3f7e64b6745e77ee258ed66def6731acd7","observation_id":"de7b95c0-a8b2-4dd9-9fe6-a012e10dd32d","resolution":{"observed_at":"2026-08-06T23:26:58.782975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.764402Z","title":"Abstaining from providing an output or escalating to a human supervisor if the model’s confidence in its output is below a certain threshold","venue":null,"work_id":"0675db48-cdcd-4469-885c-de99dee9b3e8","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.682862Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:203506292bb60fd81da8b6b8126be5080be911bc768d505545b85eb8218414fe","observation_id":"61463965-6dd4-4ebf-a701-7cd32e43c7db","resolution":{"observed_at":"2026-08-06T23:26:58.769030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.749929Z","title":null,"venue":null,"work_id":"c7541cb0-e900-424e-b475-c8f5abb8c82c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.688090Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:00247356a59795a4f5f29e1b8def01c5e93e9134d4feca0dc363324ef2321bd9","observation_id":"d636dba1-dc82-4894-b1d9-e124cb2b2de6","resolution":{"observed_at":"2026-08-06T23:26:58.754604Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.735233Z","title":"Altering or ablating spe- cific internal parts of a model (e.g., neurons, attention heads, identified circuits) that are understood to contribute to certain behaviours","venue":null,"work_id":"5dfb4da4-1451-4142-a1b8-1d2ed9e8f993","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.692639Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:c4beefde946c0a8506f5fe96885fd01563a11e5ab1a039f139c5df0b60982fdc","observation_id":"e9b295af-af6a-4be9-9f08-84368c33ec4c","resolution":{"observed_at":"2026-08-06T23:26:58.740118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.721198Z","title":"Using explanations of model behaviour (e.g., why a particular output was generated) to identify and diagnose issues","venue":null,"work_id":"3e9f1606-be49-4a40-8621-1b30673c7d7d","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.697467Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e4c0aef8fd47d4144429014bc3df6942d636d8b576db13e157e536967dc10e7a","observation_id":"33e4d8b3-b717-4388-a6c0-b7e52fd0e5d1","resolution":{"observed_at":"2026-08-06T23:26:58.725762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.705459Z","title":"Directly modifying model weights or structure based on interpretability insights to correct specific knowledge or behaviours without full retraining","venue":null,"work_id":"d7d1f6db-7afa-48ed-8622-3b622fb8cf14","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.702606Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d604573f15e3736508e8159ba4422b06a92c77213312478c1a6fb4b2630c0121","observation_id":"be31639d-5d89-4ecb-abee-769f7f19d1b0","resolution":{"observed_at":"2026-08-06T23:26:58.711078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.690831Z","title":"Techniques for capturing human preferences and values to guide AI behaviour, often by training a reward model RM (y) based on human feedback","venue":null,"work_id":"636abe41-6cad-42da-8403-c964b5db675a","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.706937Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:075794e13058bb6f48f795b29facab2ef8f38a8c5c04a9ee133abcc454be2822","observation_id":"3771ab7b-4652-4736-85e8-0a32f8be8af0","resolution":{"observed_at":"2026-08-06T23:26:58.695414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.677212Z","title":"Using a learned reward model or direct human feedback to fine-tune a base AI model towards desired behaviours","venue":null,"work_id":"79b3d246-80ec-4dbc-8d0c-6f20ebd85249","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.711319Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e7d40a770a8ac33663db950de6aa5c64e30a419752aa05cdf3d55c4b5ce06796","observation_id":"5f6db323-c4bd-4170-bb47-0db365045fbd","resolution":{"observed_at":"2026-08-06T23:26:58.681521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.663096Z","title":"Systematically probing AI systems to discover vulnerabilities, failure modes, and misalignments before deployment","venue":null,"work_id":"17ba32d7-f5fd-40b8-85b7-50a1ea74c538","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.715979Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:bfc5b719814114ce3bd10bf3003a32c846758cd44d12e173c524077cf78daa94","observation_id":"0528181c-23ff-4844-8914-5c5de2637eb5","resolution":{"observed_at":"2026-08-06T23:26:58.667564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.646909Z","title":"Defining explicit principles, rules, or constitutions that the AI must adhere to, and using AI itself to critique and revise its outputs to comply with these rules","venue":null,"work_id":"8fe6dbac-1604-4337-8bfc-13fd86b00eb5","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.721090Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:d767ed3cb7d5cacb36016cf7480a9bc3ad55d0cbaaf3a61df3f98922ff4a9efd","observation_id":"be72f600-06fa-4be9-a576-4eee69244c81","resolution":{"observed_at":"2026-08-06T23:26:58.652156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.632247Z","title":"Designing the rules of interaction, com- munication protocols, and reward/utility functions for individual agents within a multi-agent system","venue":null,"work_id":"9fdc6a9f-7ccf-41c2-9cc0-7523fa226cb4","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.726466Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:291b8103340a9295fd572332ad915e88e37dcdd4296f7c4c1df6609383d409fe","observation_id":"f6f45057-65f6-4903-86da-4d7e61b71c53","resolution":{"observed_at":"2026-08-06T23:26:58.637303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.616873Z","title":"Implementing systems for establish- ing, communicating, monitoring, and enforcing social norms or rules within an AI agent population","venue":null,"work_id":"e2b9ac95-36e0-4863-9709-8ab8e3d3704b","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.730928Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:f86d025527a5a899bad28ef816dc847c2ebcded72a78af4671c102239d78badc","observation_id":"a21a1b03-6151-4c23-8997-e89952978811","resolution":{"observed_at":"2026-08-06T23:26:58.622214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.600133Z","title":"Establishing standardized ways for agents to exchange information, signal intent, and coordinate actions","venue":null,"work_id":"117afae1-3587-4b53-8238-8c797ee1647c","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.735359Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:c84316e451fd6a9f62c682a720079955ff23adb53b58720dba1bc91b6e546de7","observation_id":"c8a6f8aa-4642-4ae1-b1a5-83fbe2dacebf","resolution":{"observed_at":"2026-08-06T23:26:58.604718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.585164Z","title":"Governments and international bodies establishing laws, standards, and policies governing the development, deployment, and use of AI","venue":null,"work_id":"72b713c0-d27b-40e6-81bd-7f63929f2ef2","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.740359Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:dd869e5876f7165a281a2ff9f227c12427e24597bb170765055f287d4ad0a923","observation_id":"0f60556e-98cf-449a-ad22-b3078b03615a","resolution":{"observed_at":"2026-08-06T23:26:58.589930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.570706Z","title":"Professional organiza- tions, research institutions, and industry consortia developing and promoting principles for responsible AI","venue":null,"work_id":"c77178d9-bc9b-4a99-8f51-3aac0c940dec","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.744788Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:e315cb58d343ff35ed9a9acaaafdfed0f29825e9c223def8c9ad35659fd934e0","observation_id":"c3ed02ca-6c23-420c-ab9c-fb9993b972d3","resolution":{"observed_at":"2026-08-06T23:26:58.575331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.556030Z","title":"Efforts to inform the public about AI, foster critical discussion, and involve diverse stakeholders in shaping AI’s future","venue":null,"work_id":"88c30228-9d26-4a51-9a65-8342e2ffb705","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.749304Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:123ae6da5971ccb8df60492e0c60b349642bb0a2792aa07f71540961e46418c0","observation_id":"1f3a2255-c9e2-4c71-af75-151daf40becd","resolution":{"observed_at":"2026-08-06T23:26:58.560878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:26:58.539581Z","title":"Formal processes for evaluating the potential societal impacts of AI systems before and during deployment, and for independently verifying claims about their safety or fairness","venue":null,"work_id":"c4d42899-4126-44c9-945b-a66b2c8d7660","year":null},"citing_paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T23:26:57.754155Z"},"links":{"citing_paper":"/paper/2506.17846"},"observation_digest":"sha256:6525cd4329c57f59f43e33576a795cf016a0f2d1bd5fe6d07e4c8f86858a330a","observation_id":"6e1b6198-ad87-4f12-860d-c8be1e6c09ab","resolution":{"observed_at":"2026-08-06T23:26:58.544836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.17846","last_updated":"2025-06-21T22:45:19Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-06T23:21:24.487260Z","submitted_at":"2025-06-21T22:45:19Z","title":"Out of Control -- Why Alignment Needs Formal Control Theory (and an Alignment Control Stack)"},"reference_resolution":{"displayed":97,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":45,"verified_exact":1,"verified_fuzzy":47},"total_outbound_references":97},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 97 of 97 outbound references and 1 inbound Pith citation observation for arXiv:2506.17846."}