{"as_of":"2026-08-08T16:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d6f8209d86744ff0c84b133154d0101f0da807e41c00ba539a333ae339b985dc","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:06:17.543845Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13172/citation-record","integrity":"/paper/2607.13172/integrity","json":"/paper/2607.13172/citation-record.json","paper":"/paper/2607.13172"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:10.407075Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:10.407075Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:6c03f171622757aa0f671a91dcc71be48af16916f1b1558494af22d693b5b118","observation_id":"5872679e-69fb-4871-8442-faea6ecf55b5","resolution":{"observed_at":"2026-08-02T06:06:10.407075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:10.482844Z","title":"CRC Press (1999)","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:10.482844Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:69d445437dcefd6e49ae4eb2924f5909a3ed41d8262525cca858f09ba973a367","observation_id":"645e471f-4904-4ee9-99fb-f067f3f6c5c9","resolution":{"observed_at":"2026-08-02T06:06:10.482844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.09802","last_updated":"2022-02-06T08:59:29Z","snapshot_observed_at":"2026-08-08T02:55:25.377231Z","submitted_at":"2022-01-24T17:02:22Z","title":"Constrained Policy Optimization via Bayesian World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.09802","snapshot_observed_at":"2026-08-02T06:06:10.559482Z","title":"arXiv:2201.09802 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:10.559482Z"},"links":{"cited_paper":"/paper/2201.09802","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:31d02a0e1f89141d0d2bbcf9beaa71582181f5d7219e043f1085e33e4a346fef","observation_id":"635f6ba8-d718-4b37-944c-2bde0560d2d1","resolution":{"observed_at":"2026-08-02T06:06:10.559482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-08-02T06:06:10.637436Z","title":"arXiv:2506.09985 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:10.637436Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:7b83b50ef1284adef804d178f994134ad347f43da859cf52e2c37bf0f962d230","observation_id":"57b6cea2-4dba-4902-a553-fedd4f52f7b6","resolution":{"observed_at":"2026-08-02T06:06:10.637436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:10.779702Z","title":null,"venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:10.779702Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:318ac702badd270a36a8a06f355abcb371b859cf2e5b1fc1aa9eeaed03c5c1cc","observation_id":"358affb7-4d68-4030-ad32-1c145fad9b7a","resolution":{"observed_at":"2026-08-02T06:06:10.779702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:10.861850Z","title":"In: Conference on Robot Learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:10.861850Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:151daf1121a4b752f25445ad7417096cb4c6ac043719d751f7b2b72350612584","observation_id":"21ae2d28-a47f-4457-b042-6a54ef43b148","resolution":{"observed_at":"2026-08-02T06:06:10.861850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:10.943797Z","title":"In: Handbook of statistics, vol","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:10.943797Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:a75abf14acdd4ae96b8945b4b6a71a8d8fab6b669885c228e85c599d7e8c9824","observation_id":"3482d3ab-8f75-4c3b-8830-71a2cb140a5f","resolution":{"observed_at":"2026-08-02T06:06:10.943797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.032054Z","title":"The method of paired comparisons.Biometrika39(3/4), 324–345 (1952)","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.032054Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:311c2ed87bfec640930ce692293cbc6716f6b38c676dbbff787a3c7036dc91d8","observation_id":"aca5c713-9cad-4fe8-8fce-72390c668a99","resolution":{"observed_at":"2026-08-02T06:06:11.032054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-08-02T06:06:11.152578Z","title":"arXiv:1606.01540 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.152578Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:edb98ae8b0ffff59a1e6164bffaae071debb9b79dc3478c7735da35610cdb003","observation_id":"5016fb8d-b9da-4ee7-b6cd-c63212b73bc5","resolution":{"observed_at":"2026-08-02T06:06:11.152578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.262813Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.262813Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:f8c097c06dada168a07ff41a48bf65385150641a66a17b4033e0b7c4befd97dd","observation_id":"8f90a88f-d5d7-4b16-bcdf-454ff0b300cf","resolution":{"observed_at":"2026-08-02T06:06:11.262813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.371963Z","title":"In: Conference on Robot Learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.371963Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:eb5ed708e6c776f3e17b2d672228ce8f50e983d0f48079eb0de45cc713d2497b","observation_id":"02e51200-a361-4bce-bf94-993176c2b2c6","resolution":{"observed_at":"2026-08-02T06:06:11.371963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.572284Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.572284Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:7982b32ec247deaae19e78502bd26958c83381163f405c29c1350053305e575b","observation_id":"13e8c098-c7b3-4f83-a797-a91f43c26da0","resolution":{"observed_at":"2026-08-02T06:06:11.572284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.680141Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.680141Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:bdfef950d1ffe89ef34ea5d10c18a1d7408489cf4db35b9ee8c012d7eead899c","observation_id":"a4ad9ae3-6f99-4754-b6a8-deff92f61d24","resolution":{"observed_at":"2026-08-02T06:06:11.680141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.803531Z","title":"In: Advances in Neural Information Processing Systems","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.803531Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:f51a37136d382e703d37e892be89857571181daca3a2429837e3ed57a0fe3770","observation_id":"d7e97992-2418-4da3-b72c-fa52d17f9619","resolution":{"observed_at":"2026-08-02T06:06:11.803531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.914470Z","title":"In: The Twelfth International Conference on Learning Representations (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.914470Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:f0e5646054bba02e4012125cf0c3506f14eed5ef159a09b596dc2b52fd10d9bd","observation_id":"3e99214a-5d7b-4b27-9085-d06858a07401","resolution":{"observed_at":"2026-08-02T06:06:11.914470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:11.985701Z","title":"In: Pacific Rim Inter- national Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:11.985701Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:5e11b4947dae9446a8854435fdbb138ab3f4a145a1080ec7d7fa2993335f61e8","observation_id":"003ee4ba-50a2-4782-81a2-488d3e064660","resolution":{"observed_at":"2026-08-02T06:06:11.985701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.044195Z","title":null,"venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.044195Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:5ba58bed3559f757c603453bedcf2f8244e2cd6713d16f0b18097f2bc5918f50","observation_id":"a4c24d43-d88f-4a7c-9c83-2358e42272e6","resolution":{"observed_at":"2026-08-02T06:06:12.044195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06766","last_updated":"2019-02-18T19:10:18Z","snapshot_observed_at":"2026-07-31T21:25:58.208547Z","submitted_at":"2019-02-18T19:10:18Z","title":"Parenting: Safe Reinforcement Learning from Human Input","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06766","snapshot_observed_at":"2026-08-02T06:06:12.149527Z","title":"arXiv:1902.06766 (2019)","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.149527Z"},"links":{"cited_paper":"/paper/1902.06766","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:caa11d83205c5a60b5e33989fd6fcadc54b633825b9e9bc362d4b96f95e14092","observation_id":"d04bc555-6b81-4871-af4f-e414589ed257","resolution":{"observed_at":"2026-08-02T06:06:12.149527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.208187Z","title":"Automatica25(3), 335–348 (1989)","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.208187Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:30f99fe1bce460256e47aced2e0acbdfad813bd92c5980c5907e93b1a7df1dee","observation_id":"18b43076-150c-4c7d-b569-2580dd35b431","resolution":{"observed_at":"2026-08-02T06:06:12.208187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.261956Z","title":"Journal of Machine Learning Research16(1), 1437–1480 (2015)","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.261956Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:6dd0ee2a0c5a432bf001fb8b7fffcd83bbbf20d6046cc1b672dbcf16d6332235","observation_id":"7509fb55-fde4-4126-b2ea-a2f6b0179fa0","resolution":{"observed_at":"2026-08-02T06:06:12.261956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.301697Z","title":"IEEE Access7, 165007–165017 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.301697Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:d95b47c294ae7d3bc0d22249e115c68b66ee9d6506a02bca646c62ddd2a5953c","observation_id":"7fe89d64-3774-41e7-b02b-f175fe6d44c0","resolution":{"observed_at":"2026-08-02T06:06:12.301697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.410489Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.410489Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:430566f36f95ec39cb7872074a32aa9738f096bb11f1c75ec47d330ea678e884","observation_id":"bc6f1a8b-7806-4288-8df3-8424ba291284","resolution":{"observed_at":"2026-08-02T06:06:12.410489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.461979Z","title":"Frontiers in Neurorobotics17, 1280341 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.461979Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:8f30d0344812bbe77fb7960043fa20c931cde6a29abd5da62c7052e60bdb02e7","observation_id":"53896ce6-c72f-468f-a090-9c6c9ccbec8b","resolution":{"observed_at":"2026-08-02T06:06:12.461979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.513304Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.513304Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:882124d1aaced728d1c79f2797b6ba42f75c1379bd890610f30d166e13526197","observation_id":"4fda8422-b934-4416-b670-1ccb4585d4b8","resolution":{"observed_at":"2026-08-02T06:06:12.513304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.563032Z","title":"In: International Conference on Principles and Practice of Multi-Agent Systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.563032Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:8ff5d6a96dae7a3b0fd854d6ed0456f4e3d666804cb668470c440e731c55ded6","observation_id":"2d319fb4-ab68-45ab-bf88-a348bdfff61d","resolution":{"observed_at":"2026-08-02T06:06:12.563032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.615304Z","title":"In: Proceedings of the 32nd International Conference on Neural Information Process- ing Systems","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.615304Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:053a7c5ad39e2bf1ee891e1a0a73b09abbd3009f1f06c3976df1ae201f20561b","observation_id":"c6b6c9fc-913c-436f-b37e-247da2248c9e","resolution":{"observed_at":"2026-08-02T06:06:12.615304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-03T15:20:23.515607Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-02T06:06:12.660894Z","title":"arXiv:1912.01603 (2019)","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.660894Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:931bfe0ce4e740c826f9a942552e72315f14a71e795826f8a134632826bc9ab5","observation_id":"6e415062-a077-4100-88da-d721a118e24d","resolution":{"observed_at":"2026-08-02T06:06:12.660894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.724121Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.724121Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:184826ad75a16313236b4e10f8385a888cb9d7525e937050ff0c17ba071eed1b","observation_id":"56aad13e-629d-4680-994f-87849a73a0f7","resolution":{"observed_at":"2026-08-02T06:06:12.724121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-02T06:06:12.788064Z","title":"arXiv:2010.02193 (2020)","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.788064Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:b8ad109ee310e7e0210562cb6bb0ead3bf47fafdde69452f48d7ea6f3cd8628d","observation_id":"943c0f4b-72e2-4ba6-8660-fa074d8bb6d0","resolution":{"observed_at":"2026-08-02T06:06:12.788064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.900210Z","title":"Nature640(8059), 647–653 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.900210Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:a8953991940f419d8f87306892b7ca6c424271117cbc1d4f279d3d2e4334f3fd","observation_id":"0ca26ccb-06a1-42ec-a9ea-d7fafb19234a","resolution":{"observed_at":"2026-08-02T06:06:12.900210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:12.958241Z","title":"Evolutionary Computation9(2), 159–195 (2001)","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:12.958241Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:2bbdb750c5f92aad03691a5b40ff89227ab816dbea72cf1c6a8ef463a11b8999","observation_id":"fa3e44c1-3dd1-4b81-bb01-b02016f7f152","resolution":{"observed_at":"2026-08-02T06:06:12.958241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:13.048117Z","title":"Neural Computation 9(8), 1735–1780 (1997)","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.048117Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:8f8233f9147151c5ec4dcf7c960fd0a3279ae71757cdbb0670708492ca9d96fa","observation_id":"f757f143-a240-4854-bd5f-c0c208396c7e","resolution":{"observed_at":"2026-08-02T06:06:13.048117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:13.146254Z","title":"65–70 (1979)","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.146254Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:2a06c62180c83a8f226c5f4334e9f8935daf892178032f5a0ad0e88ca1c9f05c","observation_id":"950401ec-3c38-4b08-98ad-faaad4904bb9","resolution":{"observed_at":"2026-08-02T06:06:13.146254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:13.201380Z","title":"In: International Conference on Learning Represen- tations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.201380Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:de9f161d089fdc95634a8e90209b134e414f3fcdc23eaa51aa5b2700352fae8a","observation_id":"f56b354d-fb38-49c7-8a45-b4d22fd99058","resolution":{"observed_at":"2026-08-02T06:06:13.201380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:13.274243Z","title":"IEEE Access (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.274243Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:a4110ade91e3e36a67b8fa994f57a49e9e544017d23818e5b2c4a42f24a540f2","observation_id":"f2ea76fe-7146-47a8-80f5-a3c04e4d718c","resolution":{"observed_at":"2026-08-02T06:06:13.274243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:13.294083Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.294083Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:0719075690534937e1eb849097d0e52c42a2eec74ebd6da197b7aa839b34da9d","observation_id":"1a0bf936-427a-4af9-ae7a-9d934677ae93","resolution":{"observed_at":"2026-08-02T06:06:13.294083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:13.415296Z","title":"In: Proceedings of the 21st International Conference on Autonomous Agents and Multiagent Systems","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.415296Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:bfeedb0cd9e7242d0a58eb7abb677fdd6359ffacb2bdb5218ae928640c9e932c","observation_id":"cf643320-0fe1-44d1-ae41-7106519c751a","resolution":{"observed_at":"2026-08-02T06:06:13.415296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21203/rs.3.rs-2406802/v2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:09:24.412987Z","title":null,"venue":null,"work_id":"932f0128-0496-416c-a681-84cf3f291810","year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.517450Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:d633a657ce15e098375383670e14339ba0b879eeb48c118a14b26b171b0312f6","observation_id":"4c6c5dc8-7912-4fdc-98bb-884db763a9c0","resolution":{"observed_at":"2026-08-02T06:09:24.475711Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5220/0014408700004052","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: Proceedings of the 18th International Conference on Agents and Artificial Intelligence","venue":null,"work_id":"21a9e8e5-398f-40b4-9741-5e8813d944ff","year":2026},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.622953Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:25c4e1c54161b2e085badd3dce7997d72e0ffcfc3cb55290ca9f783263cf8723","observation_id":"7c188e54-b49a-433a-bdf0-6619003d1220","resolution":{"observed_at":"2026-08-02T06:09:24.301079Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:13.763095Z","title":"In: International Confer- ence on Learning Representations (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.763095Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:cbb504e0d8bf2bf07d1a4ad547255701311e0404706b1f75039e7bee0badb0a3","observation_id":"f49963fc-ef84-4b43-a42b-96086028000d","resolution":{"observed_at":"2026-08-02T06:06:13.763095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-02T06:06:13.913636Z","title":"arXiv:1312.6114 (2013)","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:13.913636Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:c0b428f5a94b78bdcc197de99f3f7674c5959920488d6132ce0e2b00422a6bff","observation_id":"d09fb77e-9940-4330-9a07-8ccdd633b873","resolution":{"observed_at":"2026-08-02T06:06:13.913636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.043032Z","title":"In: Proceedings of the fifth International Conference on Knowledge Capture","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.043032Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:749358334a7a06b7217aa545cff49b147f213f76625f5bfc6b4e1a5f94a482b7","observation_id":"f9441392-03eb-47ea-88a2-4281bd825553","resolution":{"observed_at":"2026-08-02T06:06:14.043032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.089341Z","title":"Jour- nal of the American statistical Association47(260), 583–621 (1952)","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.089341Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:d1c494a81a78979301d2d5fdd22c9d313737bdcebb69c123b4504aeaeaf83e1b","observation_id":"e1330e3f-97ac-4d75-97ab-7f057f5b8c36","resolution":{"observed_at":"2026-08-02T06:06:14.089341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.194382Z","title":"2, 2022-06-27","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.194382Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:d4ff9e0edfa69216a4eac40d2a62ba06782f978a29ae233ebafaf6f23d831ef8","observation_id":"8397e02c-a90f-4027-8cbd-54bbb6192d5c","resolution":{"observed_at":"2026-08-02T06:06:14.194382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.325447Z","title":"In: Inter- national Conference on Machine Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.325447Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:fe08d1c87eee367663fbd1502e6c3af37e9f9ad70983d4defbda47c1e3b7a2d5","observation_id":"e1848782-22fe-4e43-8502-a06ec1a2c853","resolution":{"observed_at":"2026-08-02T06:06:14.325447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.03026","last_updated":"2021-11-04T17:32:06Z","snapshot_observed_at":"2026-07-06T12:05:32.449744Z","submitted_at":"2021-11-04T17:32:06Z","title":"B-Pref: Benchmarking Preference-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.03026","snapshot_observed_at":"2026-08-02T06:06:14.354404Z","title":"arXiv:2111.03026 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.354404Z"},"links":{"cited_paper":"/paper/2111.03026","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:39fce74233ebed4e3e24788afd88b07f81b4f55a9dd08c1aba66695a27b41658","observation_id":"dcfcf58d-0322-4365-a1e0-dcd6d8635859","resolution":{"observed_at":"2026-08-02T06:06:14.354404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-07-06T07:15:51.575438Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-02T06:06:14.400874Z","title":"arXiv:1811.07871 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.400874Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:ff6c9aeed82aeb226344b94e44eacfef79d681b46ec9ad361962fa95f5b12660","observation_id":"ee0177bf-6ff1-4f8b-9caa-d4173551a443","resolution":{"observed_at":"2026-08-02T06:06:14.400874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.457876Z","title":"Cognitive Computation17(5), 1–16 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.457876Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:2acbb72092dc5f726e33070fc183782bf4af2b28cbe7735c05f2883817647226","observation_id":"24c366b6-3ec2-4869-ad26-a94856ca2f87","resolution":{"observed_at":"2026-08-02T06:06:14.457876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.505942Z","title":"IEEE Transactions on Vehicular Technology (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.505942Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:d6b57c0ac229c6239b5fa60354854301e0357c9dff6c088973d2d07d3deb7f8b","observation_id":"026496bb-fa81-43a1-9971-17339f61fec6","resolution":{"observed_at":"2026-08-02T06:06:14.505942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.562784Z","title":"In: 2023 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.562784Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:a7f12dcb9a0388f2db44c2a587cc7000543f29bb0802b97339cc1a46ad65686c","observation_id":"0d9527da-7e3d-4c08-8d4e-ff9b119897a6","resolution":{"observed_at":"2026-08-02T06:06:14.562784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.618551Z","title":"In: Proceedings of the 23rd International Conference on Autonomous Agents and Mul- tiagent Systems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.618551Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:9eb1f6df637c62358a36df4248ef2497ddde732e78e3032930dab1191c646b06","observation_id":"1160be37-5f4b-4398-84d8-04913db487b9","resolution":{"observed_at":"2026-08-02T06:06:14.618551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.667389Z","title":"Advances in Neural Information Processing Systems pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.667389Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:19769862bf1025690a32e7644ebd26b6911a7be25eed598939bf1160fce2826d","observation_id":"4c63f1e5-a823-43a7-bfe6-55c99a5222bb","resolution":{"observed_at":"2026-08-02T06:06:14.667389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.786967Z","title":"Journal of Machine Learning research9(Nov), 2579–2605 (2008)","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.786967Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:d387370b0c56f85d5be52489c452e39833d7d08397c649ac5bf75978c19bf6a7","observation_id":"776cf99f-9ddf-4ee4-8df3-3f8ee777ce29","resolution":{"observed_at":"2026-08-02T06:06:14.786967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.845611Z","title":"In: The Fourteenth International Conference on Learning Representations (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.845611Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:b611fa916774d0e37caa481064fcfa64fd8b3b2d5913e7393157f906adeafb25","observation_id":"957e170d-daf2-41a7-8f9a-86a380d4fbe1","resolution":{"observed_at":"2026-08-02T06:06:14.845611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:14.967182Z","title":"50–60 (1947)","venue":null,"work_id":null,"year":1947},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:14.967182Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:1f2f9bf3e3c97d21be2b455ff56009a46ef877d5b788a37b9f2195bbebfaba11","observation_id":"0fc26d47-98bb-47c6-b80c-6a3d8d2b6478","resolution":{"observed_at":"2026-08-02T06:06:14.967182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:15.086757Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.086757Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:c036ecac001d6d345192df0b134f536aaf079f5b2c693cf948b7c68030b79885","observation_id":"3442ae48-deb0-4e1e-bd19-aa877764b219","resolution":{"observed_at":"2026-08-02T06:06:15.086757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:15.267967Z","title":"In: Pro- ceedings of the Seventeenth International Conference on Machine Learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.267967Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:bad511a0224cfba52095577b51a8de0afc55110969874dcb083af2249de48d80","observation_id":"af83dc68-0a49-4aec-b7bf-e314cb8d7e4d","resolution":{"observed_at":"2026-08-02T06:06:15.267967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:15.330406Z","title":"Advances in Neural Information Processing Systems pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.330406Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:100c45459c3585d1e1dd68314ed2a14f2e06d230e9624b7cef50d4d4a4dce3b8","observation_id":"3885f59c-497c-4dc9-ad4c-283c9b24e31a","resolution":{"observed_at":"2026-08-02T06:06:15.330406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:15.433542Z","title":"In: 10th International Conference on Learning Representa- tions, ICLR 2022 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.433542Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:3e9a928ccc197216b33bafb434873192b09e052a8449c96fa6fb137161bf1626","observation_id":"0aaabe6b-ca77-476c-97bc-8734150627b3","resolution":{"observed_at":"2026-08-02T06:06:15.433542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:15.548909Z","title":"Advances in neural information processing systems36, 53728–53741 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.548909Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:49b6adf612026466a2c3a6ad56ca3d4c6a1c6ec6c720f2db4312b45e67a3ef49","observation_id":"074b221b-1036-4f30-aa36-8b18886db844","resolution":{"observed_at":"2026-08-02T06:06:15.548909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:15.674885Z","title":"In: Learning for Dynamics and Control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.674885Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:59850cd015fb5a6eef7de2f3196b8396843f0c05aa6f5b56bc95bb050c0ecfbe","observation_id":"90203423-ee24-41a8-b5a0-79d12db101fe","resolution":{"observed_at":"2026-08-02T06:06:15.674885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08102","last_updated":"2022-01-21T16:10:14Z","snapshot_observed_at":"2026-07-06T12:29:13.421747Z","submitted_at":"2022-01-20T10:26:34Z","title":"Safe Deep RL in 3D Environments using Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08102","snapshot_observed_at":"2026-08-02T06:06:15.779669Z","title":"arXiv:2201.08102 (2022) 42 I","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.779669Z"},"links":{"cited_paper":"/paper/2201.08102","citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:979835124f8fe9de82f93e665781893a670aa6297dda2076262a315f60efc873","observation_id":"b552c757-6c46-45d1-99d0-e6dd2803d23b","resolution":{"observed_at":"2026-08-02T06:06:15.779669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:15.872266Z","title":"In: International Conference on Machine Learn- ing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:15.872266Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:0a6093acc4b3cdfc9ccd79e648e5106c4b34f71972ee63ffaaf1f0b81d2eeb60","observation_id":"3250ad68-b736-426a-81d7-5b520946a97e","resolution":{"observed_at":"2026-08-02T06:06:15.872266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.034204Z","title":"In: Proceedings of the 17th Interna- tional Conference on Autonomous Agents and MultiAgent Systems","venue":null,"work_id":null,"year":2067},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.034204Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:6258f12f94cf20cfe55377e4937c8f3852c84b39e1afdcb6cc14b7fde284f2e8","observation_id":"c3a928fa-c4bb-47e8-a354-044fada585b5","resolution":{"observed_at":"2026-08-02T06:06:16.034204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.157222Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.157222Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:0b22dbc594cc135c38201d429d02ba56efcc0a5e66cfa49051a5a3238438495c","observation_id":"92f2741f-5159-475e-8371-d7a4aaa3fcfd","resolution":{"observed_at":"2026-08-02T06:06:16.157222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.287126Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.287126Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:cca8df0d7428915b285e7006e2b02a72b31ab0eb555afc7c37ee4dddba6bb755","observation_id":"d76b9425-38b3-4529-aeeb-cb462a2feff1","resolution":{"observed_at":"2026-08-02T06:06:16.287126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.398947Z","title":"12151–12162 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.398947Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:7d633d2127a1c448a0ab2148b5abafa797e938957c183bc005a71e7719861953","observation_id":"ff335f8f-a034-48d1-9cce-9f925edaf422","resolution":{"observed_at":"2026-08-02T06:06:16.398947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.496029Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.496029Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:9623cd1cb9b83795fa8b60616f2cfccd364d9f9f5a7899cf8145307ed40ea6c1","observation_id":"20b95e36-b785-4b08-ad8e-5b64e3732c0b","resolution":{"observed_at":"2026-08-02T06:06:16.496029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.638621Z","title":"Advances in Neural Information Processing Systems36, 29252–29272 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.638621Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:a9f2ceca2a86a71b1060271a65ac61609d37e47076935cadc0b4a79075bbbb96","observation_id":"e991026e-41f1-4826-b093-b6be673af8c7","resolution":{"observed_at":"2026-08-02T06:06:16.638621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.836785Z","title":"Advances in Neural Information Processing Systems34, 20759–20771 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.836785Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:41a1ca371c8b35d7b5fe54f93deb435659d2a775e26a73f247a06061926b2d59","observation_id":"08edd2ea-965a-4942-b0fb-1261872a5187","resolution":{"observed_at":"2026-08-02T06:06:16.836785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:16.994533Z","title":"In: Proceedings of the AAAI conference on artificial intelligence","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:16.994533Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:b1b8dcc69a531728bf31d5e9bda753e05b7320ea171671484ea5502da08b939c","observation_id":"f3072b85-af77-423a-892d-e7035bf9f231","resolution":{"observed_at":"2026-08-02T06:06:16.994533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:17.157234Z","title":"In: 9th International Conference on Learning Representations, ICLR 2021 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:17.157234Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:c0a3681178d2fd67fba0ca67521aadf0685f429c6cfd8bb653b75cfb6035a415","observation_id":"e7cbe25a-5236-4692-a1e6-7365ea47ed3f","resolution":{"observed_at":"2026-08-02T06:06:17.157234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:17.253761Z","title":"In: Deep RL Workshop NeurIPS 2021 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:17.253761Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:0d05a06903c629ac8d0199b5cb1a188aa4f021a085c913d1b10d261156b04bf0","observation_id":"693bc6dd-be15-4198-bb61-a348d4c92b05","resolution":{"observed_at":"2026-08-02T06:06:17.253761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:17.437226Z","title":"Advances in Neural Information Processing Systems35, 2608–2621 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:17.437226Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:f48a6081236f99f91c30c353c04de6ded52c72014263a9af298ccc45dfce96e2","observation_id":"173032a1-72fe-4220-aeee-4099c2a0edf1","resolution":{"observed_at":"2026-08-02T06:06:17.437226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:06:17.543845Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T06:06:17.543845Z"},"links":{"citing_paper":"/paper/2607.13172"},"observation_digest":"sha256:8b1d0afb7ac682bafae2226e77574300b2b38372f8b2ef0e56c38fb02389be9a","observation_id":"ff9edad7-bbf7-4f5f-bd6a-993e64a61a78","resolution":{"observed_at":"2026-08-02T06:06:17.543845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13172","last_updated":"2026-07-14T18:22:14Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-08T05:07:31.739333Z","submitted_at":"2026-07-14T18:22:14Z","title":"Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":73,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2607.13172."}