{"as_of":"2026-08-07T13:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b17f12d9e8586159c83e821886b09624c5ea3bafce4a71e1cf7e6ac8668cebd3","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:34:15.255851Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10995/citation-record","integrity":"/paper/2507.10995/integrity","json":"/paper/2507.10995/citation-record.json","paper":"/paper/2507.10995"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.640972Z","title":"Faulty reward functions in the wild","venue":null,"work_id":"da582f38-b1e2-4078-8637-9b240639c8f6","year":2016},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:13.445657Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:ff14c0643e17cd4a11fee507d308b2e03d24d7ab0a9b2a5e0810c39ed22ef32e","observation_id":"88265400-60cf-49f2-811c-ecbbfbd15654","resolution":{"observed_at":"2026-08-06T17:34:15.644297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.630669Z","title":"Potential-based shaping in model-based reinforcement learning","venue":null,"work_id":"9388731b-23ca-4213-b604-c494b4c964ff","year":2008},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:13.564815Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:2e89f0c757a3d84507617f53afc86b612c8956c2f82d13299fb60a7661aa895f","observation_id":"79375c00-6796-4b4a-af29-0df029ce93dc","resolution":{"observed_at":"2026-08-06T17:34:15.634052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.620947Z","title":"Discrete dynamic programming","venue":null,"work_id":"89e1ed4a-7148-4933-bb2e-60b4ca036b02","year":1962},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:13.683133Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:7ae31d1bc12bfb7061d07bc830519037483e81420f1ffa016fa125026abee0b1","observation_id":"9afe300b-8795-4d1f-a755-f6937a1eae89","resolution":{"observed_at":"2026-08-06T17:34:15.624257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.611227Z","title":"The superintelligent will: Motivation and instrumental rationality in advanced artificial agents","venue":null,"work_id":"dffadaa6-3c55-42ae-92cf-cd6e07fa91fb","year":2012},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:13.845517Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:bed97ebe6a269fb9a483153ac26d72d216a5615af2d9534144aef7437e9d33e2","observation_id":"7fb69216-d876-4780-a825-12f87281853f","resolution":{"observed_at":"2026-08-06T17:34:15.614442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:14.007127Z","title":"Deep reinforcement learning from human preferences","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:14.007127Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:d85c156eab7dcfe76cd1d74169f60ec758127b8649a28b294430ee8787dae64d","observation_id":"1dda2239-00c0-4048-afc8-c3eddabe3697","resolution":{"observed_at":"2026-08-06T17:34:14.007127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.594736Z","title":null,"venue":null,"work_id":"6848fdad-a996-42e9-be7f-dd817dc91109","year":2001},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:14.115875Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:9f442354f1faa331af0c14538886bd9ac924921c694d39354cfda059d54cf2b8","observation_id":"f4e68bce-d562-4453-8159-dfc05d25b0db","resolution":{"observed_at":"2026-08-06T17:34:15.597861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.584383Z","title":"Exploration-guided reward shaping for reinforcement learning under sparse rewards","venue":null,"work_id":"690d7f98-8746-486a-af28-71b54dfbc993","year":2022},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:14.267435Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:77e879e1ce28fe97c949398c3725be1a4b0073b113f77b91c7ae25181bd5623d","observation_id":"ee0d7ebe-8c38-4f58-8b6e-871135d1b94f","resolution":{"observed_at":"2026-08-06T17:34:15.588281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.574029Z","title":"Dynamic potential-based reward shaping","venue":null,"work_id":"3bc4bbd8-9ad5-45a7-b746-d37fc0b090bd","year":2012},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:14.381757Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:a817204704b2259812a92e840208a158117e89c6c36c40d60288d1e4d358f7e8","observation_id":"59a02da4-7372-4db5-be5e-a2cb6fa5455a","resolution":{"observed_at":"2026-08-06T17:34:15.577539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.564258Z","title":"What is it you really want of me? generalized reward learning with biased beliefs about domain dynamics","venue":null,"work_id":"1c82a6a5-a715-408b-981c-67f84757f1f5","year":2020},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:14.590020Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:2e47cae8186ffa0a1df8da47875cb8aea24716e27b7d7a91a0d87c49866ee9a2","observation_id":"b7db942a-cc12-495c-bbd7-0c354d537e01","resolution":{"observed_at":"2026-08-06T17:34:15.567489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.553787Z","title":"Reward shaping in episodic reinforcement learning","venue":null,"work_id":"4820a84b-3d43-4091-b518-ba1e59d327ba","year":2017},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:14.759732Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:eca94266ae8705e802a8d687c9a2a6ace6e1e5cc7630018c6f67622edf1e8d03","observation_id":"3acafe36-0836-4621-9bd8-5d3d59776dc1","resolution":{"observed_at":"2026-08-06T17:34:15.557064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:14.925169Z","title":"The off-switch game","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:14.925169Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:6732d0be6c309762f75941e803db5ca94a2d9f1c475afaee64e28ea79e4355c4","observation_id":"a4264b5e-a178-477f-8c19-fd9242abc934","resolution":{"observed_at":"2026-08-06T17:34:14.925169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.538083Z","title":"Exposure and response prevention for obsessive-compulsive disorder: A review and new directions","venue":null,"work_id":"0fb6afcd-c35f-4139-bd41-9b84deaaed30","year":2019},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.097323Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:9d3650f5d22d8d92ac067ba2bb318f9ecc5d2cfbe2a6875ddeeb316a80160082","observation_id":"13b04838-d379-48d7-a2a2-0906e7b465d3","resolution":{"observed_at":"2026-08-06T17:34:15.541323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.527974Z","title":"Teaching with rewards and punishments: Reinforcement or communication? In Proceedings of the Annual Meeting of the Cognitive Science Society, volume 37, 2015","venue":null,"work_id":"809c562a-4a7d-42e4-90e3-53f6f8b199cb","year":2015},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.181926Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:a8241255622f2a50ea9b54d322137a71e652430544053b7cf60d460a90279844","observation_id":"f96126d9-8445-4a64-b98d-6a9385688096","resolution":{"observed_at":"2026-08-06T17:34:15.531224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.518489Z","title":"People teach with rewards and punishments as communication, not reinforcements","venue":null,"work_id":"a90faff4-4a0f-4b37-b165-5c32931884e9","year":2019},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.185020Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:b6dacfb0626c27ddd639111ec445dbcc9567eab3478376288ba5a6d296d19b07","observation_id":"385de4a5-9185-4930-a313-3f4e81c05f78","resolution":{"observed_at":"2026-08-06T17:34:15.521675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.508578Z","title":"Horn and Charles R","venue":null,"work_id":"70fd684f-432e-4301-b9be-bf38918fb5de","year":2012},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.188111Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:02886953aeacf36bb5a6ffddb58355c40eb66b127712a3748d52636b67954e54","observation_id":"9385e40f-fbf7-4088-b447-795c1d6b83c6","resolution":{"observed_at":"2026-08-06T17:34:15.512021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.499102Z","title":"Reward learning from human preferences and demonstrations in Atari","venue":null,"work_id":"3456e9f9-ab1b-4552-ae9a-47351c57435d","year":2018},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.191190Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:b080ddfef1d16dfb74c7f0a9de5a4a02c0058504f8fe461a6b35b39fe4089352","observation_id":"09d72ca4-d9c5-4a43-8820-b8070f38aa5b","resolution":{"observed_at":"2026-08-06T17:34:15.502179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.489614Z","title":"Interactively shaping agents via human reinforcement: The tamer framework","venue":null,"work_id":"762210bc-d376-46fe-b648-fdd487414f49","year":2009},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.193878Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:a3245e05764e9fbf17f199a139332fc1e6be2d71971e50226bc7294d60b19acf","observation_id":"34e377bc-249d-4306-b0b4-3c007a454b7a","resolution":{"observed_at":"2026-08-06T17:34:15.492914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.480048Z","title":"How humans teach agents: A new experimental perspective","venue":null,"work_id":"2e1878bd-5393-4c84-a19f-3ebaadcee2dc","year":2012},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.196610Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:1a85061944a04f6397d0e77e0b411998c203564045821ccaf384f3c544652d55","observation_id":"3942d4f3-4cca-4c13-a3ca-f86360ca32ce","resolution":{"observed_at":"2026-08-06T17:34:15.483473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02231","last_updated":"2023-09-06T21:13:28Z","snapshot_observed_at":"2026-07-06T13:17:37.687023Z","submitted_at":"2022-06-05T17:58:02Z","title":"Models of human preference for learning reward functions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02231","snapshot_observed_at":"2026-08-06T17:34:15.199300Z","title":"Models of human preference for learning reward functions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.199300Z"},"links":{"cited_paper":"/paper/2206.02231","citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:42d1ed20b5f11046d82195f929024cbfaace06a9b243ec2c8998931a7623ae32","observation_id":"b05217fc-f97d-452d-9eea-6474cbc25f63","resolution":{"observed_at":"2026-08-06T17:34:15.199300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.470011Z","title":"Learning optimal advantage from preferences and mistaking it for reward","venue":null,"work_id":"b9b1fe6a-87c6-4c47-92ad-f7aa6c2bde63","year":2024},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.202726Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:5194d8f7518007619feadedb1273ba5e614a15e3046a2ad515c1d3df27d5928c","observation_id":"3db4851c-dadd-4dbc-b68b-79336cf351f3","resolution":{"observed_at":"2026-08-06T17:34:15.473562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05358","last_updated":"2025-03-22T02:05:56Z","snapshot_observed_at":"2026-07-06T19:12:19.677411Z","submitted_at":"2024-09-09T06:39:56Z","title":"BAMDP Shaping: a Unified Framework for Intrinsic Motivation and Reward Shaping","version":2},"cited_work":{"arxiv_id":"2409.05358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.05358","snapshot_observed_at":"2026-08-06T17:34:15.294368Z","title":"BAMDP Shaping: a Unified Framework for Intrinsic Motivation and Reward Shaping","venue":"cs.LG","work_id":"7b1d52a3-1bb5-42c3-9341-af130ee54268","year":2024},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.205426Z"},"links":{"cited_paper":"/paper/2409.05358","citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:06955add1abf5d3cb596073668e7e8b64643f72267afb5318b9587414529279a","observation_id":"cd331bdb-b089-4b25-9a86-9a209c9fd58f","resolution":{"observed_at":"2026-08-06T17:34:15.299575Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.460466Z","title":null,"venue":null,"work_id":"ce3425c6-74a3-4215-84b4-4eed4fbe2fd0","year":1960},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.208350Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:5c0d6a0cf97a82f9af9ecfdb9f1f768edbfa513e22adf62c8f28dfc5cc949620","observation_id":"2c0656be-52b7-4a18-9432-4a76b93da383","resolution":{"observed_at":"2026-08-06T17:34:15.463949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.450838Z","title":"Choice between partial trajectories: Disentangling goals from beliefs, 2024","venue":null,"work_id":"5b91fb10-6482-4cfe-a0ac-2f4c823b0f72","year":2024},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.211065Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:8d94ff68d702bca45ccd7a7af0a56eb3368562c4abed2b6a5b461bbf07f1bab5","observation_id":"6383da11-7435-4a03-bc2a-2451044abaae","resolution":{"observed_at":"2026-08-06T17:34:15.454002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.441605Z","title":"Policy invariance under reward transformations: Theory and application to reward shaping","venue":null,"work_id":"9a46688e-fc08-488d-8418-762db9574a08","year":1999},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.214008Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:7a4ede4fa1460296bd84446bf34288e8fd96bb95ab03a7b29b9c6fc51fa469e0","observation_id":"0400189d-aec9-4f9d-8d28-b305e0bf115d","resolution":{"observed_at":"2026-08-06T17:34:15.444941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.431582Z","title":"Anthropic’s new AI model threatened to reveal engineer’s affair to avoid being shut down","venue":null,"work_id":"94793637-aec2-4d28-bb19-54e70fbf939c","year":2025},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.217137Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:c586af6b7eaa6791068eeef1abbb0a9ab72f4b2c4e8a72e3cdfbe4ad51b2473d","observation_id":"457b866a-e7c5-48ae-bcb4-c4308c19a0ab","resolution":{"observed_at":"2026-08-06T17:34:15.435244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.421094Z","title":"The basic AI drives","venue":null,"work_id":"3b8e50ab-d25e-42ba-85e8-165d34088575","year":2018},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.219920Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:2d744e76311c2f310eeac56f9169a2fb17f4f9e989a6c3c72c784d0332ec67a9","observation_id":"2b3f10f5-6b0a-408d-84b1-8e72cf5ce63c","resolution":{"observed_at":"2026-08-06T17:34:15.424662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.410388Z","title":"Learning to drive a bicycle using reinforcement learning and shaping","venue":null,"work_id":"a980c38f-af32-44f4-8f32-7ce5cb6d8528","year":1998},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.222968Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:b0c4919019b66e4efe5fdefc8c7f224c072782959015fd4ff1284c42895e05cb","observation_id":"8d5bda20-19af-46a3-a813-f9933b54f384","resolution":{"observed_at":"2026-08-06T17:34:15.413722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.399791Z","title":"AI is learning to escape human control","venue":null,"work_id":"461dc5f1-32a8-4fb0-9c23-7c8914ebc609","year":2025},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.225939Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:e6924b6a2140a8de108a1d64a8158f986b9900c719b9309ee9727cdb39c33682","observation_id":"45e6ca2a-9107-4ec4-9254-7dea463fec9a","resolution":{"observed_at":"2026-08-06T17:34:15.402944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.390328Z","title":"Human-compatible artificial intelligence, 2022","venue":null,"work_id":"3e9b18fa-1f43-450d-bd8e-1a8588912d6a","year":2022},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.229124Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:a7088cd4d0de3dfe32b3f410d8fb77b543fe5f2216edb727743ce8f5de082478","observation_id":"4e66a997-67d8-41d3-be94-1999cabb3f9e","resolution":{"observed_at":"2026-08-06T17:34:15.393424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.379763Z","title":"Artificial intelligence: a modern approach","venue":null,"work_id":"cbece392-fcee-47a1-b07f-9e29791a995a","year":2016},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.232151Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:44df9e13481f8e7ae0663bffb32e58002b9a2170606d46ad8d5eec182b29c24e","observation_id":"ae0afa82-5d18-4aab-948f-d298f630f731","resolution":{"observed_at":"2026-08-06T17:34:15.383047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.369732Z","title":"Where do rewards come from","venue":null,"work_id":"01433bdc-b2a5-458b-9af1-dfac5e6f84f7","year":2009},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.235350Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:6529b6d183990bdce67477c24a4381ef8feaac4d533152debb78cee4fd5287a4","observation_id":"3c1f24bb-19f9-4cfa-ba51-389bb9f34d54","resolution":{"observed_at":"2026-08-06T17:34:15.372851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.238058Z","title":"Intrinsically motivated reinforcement learning: An evolutionary perspective","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.238058Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:cfdc890e7b132570c539a39525e613b83178bd2f04230074834129ede5b84517","observation_id":"87166d99-fb94-4a85-aa04-c247f9d643e1","resolution":{"observed_at":"2026-08-06T17:34:15.238058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.353462Z","title":"Corrigibility","venue":null,"work_id":"971503ad-8c50-42fe-b0ea-a080b471597e","year":2015},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.240721Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:0a03462df4e132e871d66599ee95d3cd0a7bdc82dcf27d32de1b45d5ff7b05de","observation_id":"9bff7598-8344-439e-b985-d32ea35a874f","resolution":{"observed_at":"2026-08-06T17:34:15.357143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.243611Z","title":"Reinforcement learning: An introduction, volume 1","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.243611Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:ca5db221de7644fa9e8d02280df9dda1f4f1ac42c04db4be4910f96be18ae513","observation_id":"028f26ba-7548-48ff-958d-1dcd59cf1be7","resolution":{"observed_at":"2026-08-06T17:34:15.243611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.337031Z","title":"Reinforcement learning with human teachers: Evidence of feedback and guidance with implications for learning performance","venue":null,"work_id":"573e0767-c15a-4789-8aca-cceca120540e","year":2006},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.246831Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:4582233fab0394aba3d8f200bc85cd734b5b70c5a6ec369e7016f1ac67fa4789","observation_id":"6f36d324-050b-43f8-8cc8-0a64e926a041","resolution":{"observed_at":"2026-08-06T17:34:15.340391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.326605Z","title":"a ngberg, Mikael B \\","venue":null,"work_id":"f2fc3992-2f24-4987-878e-0eda98953d80","year":2017},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.250509Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:2c36fd972dc29d43340265b84da2eb73b6f13251fa82f2541edcc123d99fc422","observation_id":"16481d20-58c4-41ae-a253-d4e787523bb0","resolution":{"observed_at":"2026-08-06T17:34:15.329928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:34:15.316475Z","title":"Principled methods for advising reinforcement learning agents","venue":null,"work_id":"5dd1b7cb-1d18-48c2-afc6-85d7eaf2d043","year":2003},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.253266Z"},"links":{"citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:7f82aa4aa2ee3a08ad26e042bc0360723e7305228c35ccb77d9cdb3e5ebf104a","observation_id":"63e2764a-c98a-46d2-a69c-2090a722c3fb","resolution":{"observed_at":"2026-08-06T17:34:15.319816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.09330","last_updated":"2019-01-27T06:38:24Z","snapshot_observed_at":"2026-07-06T07:29:14.938525Z","submitted_at":"2019-01-27T06:38:24Z","title":"Reward Shaping via Meta-Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.09330","snapshot_observed_at":"2026-08-06T17:34:15.255851Z","title":"Reward shaping via meta-learning","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:34:15.255851Z"},"links":{"cited_paper":"/paper/1901.09330","citing_paper":"/paper/2507.10995"},"observation_digest":"sha256:bddf984966a2d031dc1ce92076f4bbe385f76e354b04b658b05515b9e53ef938","observation_id":"f12742d6-154c-4225-adfa-8cd93a2728e0","resolution":{"observed_at":"2026-08-06T17:34:15.255851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.10995","last_updated":"2025-07-15T05:27:51Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T17:16:54.207556Z","submitted_at":"2025-07-15T05:27:51Z","title":"Misalignment from Treating Means as Ends"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":29},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2507.10995."}