{"as_of":"2026-08-07T07:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13506c634daac96cafcf93e23418530758c41ce48326aad10df010bac56b1dae","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T21:55:13.704957Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27968/citation-record","integrity":"/paper/2607.27968/integrity","json":"/paper/2607.27968/citation-record.json","paper":"/paper/2607.27968"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.533968Z","title":"In: 2021 IEEE symposium on security and privacy (SP)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.533968Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:c061e364e8d9dedbb8ddee7eca9ffe1e11734fa5bbb8f40b72dce2e10e254b15","observation_id":"a67c3f68-64f9-4c46-a139-0f9764d3da27","resolution":{"observed_at":"2026-07-31T21:55:10.533968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.640183Z","title":"In: 2015 IEEE symposium on security and privacy","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.640183Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:91ecdfa3886b71dff4fdd272badd9259332cf7af6eb0fedf61bf7295f8939241","observation_id":"cd1b2483-ce9c-401b-ac08-f6a204618672","resolution":{"observed_at":"2026-07-31T21:55:10.640183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.715745Z","title":"In: The Eleventh International Conference on Learning Representations (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.715745Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:9c9a9340ee5b98cdb4d3f2127c3248742752ed2b8e0b2dcdf6b0f1a8a0d909c3","observation_id":"997db017-ab7b-4a9f-b17b-97909c6de28f","resolution":{"observed_at":"2026-07-31T21:55:10.715745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.781911Z","title":"In: The Thirty-ninth Annual Conference on Neural Information Processing Systems Datasets and Benchmarks Track (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.781911Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:679edaf623cd68b890248bc0bc7352398e7f7072150e0b4871dcc23b362015e8","observation_id":"ae2896c2-c946-4011-a215-a1beaa5988e4","resolution":{"observed_at":"2026-07-31T21:55:10.781911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02238","last_updated":"2023-10-04T05:20:19Z","snapshot_observed_at":"2026-08-06T15:19:35.944642Z","submitted_at":"2023-10-03T17:48:14Z","title":"Who's Harry Potter? Approximate Unlearning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02238","snapshot_observed_at":"2026-07-31T21:55:10.827361Z","title":"arXiv preprint arXiv:2310.02238 (2023) Reward Design for Reinforcement Unlearning 13","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.827361Z"},"links":{"cited_paper":"/paper/2310.02238","citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:d96cf1aa4d9a8907726ea07ded9594aec9cc78ec144cb2f96b3d202d4a2ef6bf","observation_id":"402f4099-6f57-4e93-b08d-76d064c20f88","resolution":{"observed_at":"2026-07-31T21:55:10.827361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.885706Z","title":"Official Journal of the European Union (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.885706Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:4555e7997b3dfa91cff0ef3df131c3e5e7a0fd139fde8ef79559c4a049c7af31","observation_id":"62c624af-2ebd-4fa5-8cbf-51a4819a1bc3","resolution":{"observed_at":"2026-07-31T21:55:10.885706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:10.940732Z","title":"Official Journal of the European Union (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:10.940732Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:cd45edad6ff8686847c3244f226fd1d03d90605cbb809e7e26587d5eb9f7f551","observation_id":"f5129560-9279-4509-ae0d-455567d8306a","resolution":{"observed_at":"2026-07-31T21:55:10.940732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.123199Z","title":"CoRR (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.123199Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:06ced42f2deef182d5bef051335bb8df973a0481aadfe729ec95d897ad4bb6bb","observation_id":"3088ac90-d800-4425-b03e-150779755d76","resolution":{"observed_at":"2026-07-31T21:55:11.123199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.189416Z","title":"Advances in neural information processing systems32(2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.189416Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:f0c581bd30d39f7def33a97b1b49fa2af2c9d6f20b4fa94dcee64364319f89c2","observation_id":"81171f77-7d71-441e-9351-a9f41082a31c","resolution":{"observed_at":"2026-07-31T21:55:11.189416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.249325Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.249325Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:34fcf924f1a13d24e37e5dc7296434882d583e8fe4cc5bce4ce6d0f8814d2a5d","observation_id":"875a0c20-7022-4753-b0a2-0456061d935f","resolution":{"observed_at":"2026-07-31T21:55:11.249325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.317529Z","title":"Information & Commu- nications Technology Law28(1), 65–98 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.317529Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:ea5f2098d0809ca2b8fb948b44f9395e86274aa422289d2ed5f04cc15d926300","observation_id":"deed7fef-77b5-45be-9f5e-1945aeafe950","resolution":{"observed_at":"2026-07-31T21:55:11.317529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.406039Z","title":"In: The 61st Annual Meeting Of The Association For Computational Linguistics (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.406039Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:36707e70c20af2c649ff16dd5a7171098e5eaf084b4bffaca22e37b7bda206e9","observation_id":"3293c30e-1c61-4aba-a99c-0520e2c20fda","resolution":{"observed_at":"2026-07-31T21:55:11.406039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.504653Z","title":"In: The Thirty-eight Conference on Neural Information Processing Systems Datasets and Benchmarks Track (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.504653Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:b16323dda7c013894344c81652e16d393ecb49ed2f85e7d1d6ad61ee713b0cef","observation_id":"e1d516c7-7f14-476b-bd7f-1809cf471d77","resolution":{"observed_at":"2026-07-31T21:55:11.504653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.568648Z","title":"In: Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.568648Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:a851dd046dfed35744efdff58cbbf8e6447caba6c3d16f092b73894dbfea725a","observation_id":"95be9cd1-c3aa-4ce2-9041-2cacb89448ae","resolution":{"observed_at":"2026-07-31T21:55:11.568648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.629120Z","title":"Advances in Neural Information Processing Systems36, 20750–20762 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.629120Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:36412e0e1e150163780022fce277ea39855c88c4bb71c3d2e7f13b2a7e6c91ca","observation_id":"6e2f4b6f-d301-4ff1-98bf-844cd99de6cb","resolution":{"observed_at":"2026-07-31T21:55:11.629120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.688841Z","title":"In: Second Conference on Language Modeling (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.688841Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:0c1f672f3cf5d28254e8d99c39352094d4960c787d369deb85b61b8bf02b72e6","observation_id":"f616599b-b130-43b6-a17c-e5e39edbcb12","resolution":{"observed_at":"2026-07-31T21:55:11.688841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.759108Z","title":"In: Proceedings of the 41st International Conference on Machine Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.759108Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:2b9095aaf4105471e0595985a2d091380c6688b2a201acb05b7acaaeebe03c81","observation_id":"dc37383b-a264-4336-96f2-19a5afa24d3d","resolution":{"observed_at":"2026-07-31T21:55:11.759108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.875970Z","title":"Nature Machine Intelligence pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.875970Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:ac095b89eabac25949049f9aa024b1fc3cd2a107050a43d34c2c2f1ce37a9a64","observation_id":"a9cef38d-4e6b-4402-85e4-69feadde94b3","resolution":{"observed_at":"2026-07-31T21:55:11.875970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:11.967981Z","title":"CoRR (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:11.967981Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:cdf12fa14abb9ccb5780897edca410b484de766d70846a8b4c035494c00df5c4","observation_id":"dc9b98ed-8a08-4023-af0b-16eab27dd01a","resolution":{"observed_at":"2026-07-31T21:55:11.967981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.034510Z","title":"Advances in neural information processing systems35, 27591–27609 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.034510Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:45858416907416a282b7d6623da97e624aca15705024d682849047cf5e994b46","observation_id":"e2c5098f-6da3-4f42-8415-ef89b5d5361e","resolution":{"observed_at":"2026-07-31T21:55:12.034510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.132860Z","title":"In: First Conference on Language Modeling (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.132860Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:03af9296af1534180d0b104378e9e5642e48642fbf1a05d11ff1bf2a994dd3b7","observation_id":"61f8bb73-5c7b-437d-a18b-41f933149def","resolution":{"observed_at":"2026-07-31T21:55:12.132860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.261904Z","title":"In: Proceedings of the 31st International Conference on Computational Linguistics","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.261904Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:c909d556f2474c21a5e4097da96531c081a7dfd47a232d98ad69a68a9b4ce802","observation_id":"4726c605-703c-4289-bc11-a1597f0702c4","resolution":{"observed_at":"2026-07-31T21:55:12.261904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.371294Z","title":"In: Algorithmic Learning Theory","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.371294Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:d66702f0de2fdfa57b94af67cea2dce35f02ee327ab5b0cc5921dd6a60ecd345","observation_id":"59fffe0d-34a1-4fa3-8262-d133757d404a","resolution":{"observed_at":"2026-07-31T21:55:12.371294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.471787Z","title":"ACM Transactions on Intelligent Systems and Technology16(5), 1–46 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.471787Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:a005df201df55ff284537d14ad055dbaced483e4012fd6d87ce72e52b31d2896","observation_id":"727d2ac0-379f-4d42-b640-9b051ca25f2d","resolution":{"observed_at":"2026-07-31T21:55:12.471787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.535921Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.535921Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:f6d54697398fea6b6ab62185dae74456bae762287fc825f6e5c7aaa6cab0ef46","observation_id":"ce65cd6a-e6bf-411d-89bd-54704a29a03a","resolution":{"observed_at":"2026-07-31T21:55:12.535921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.630719Z","title":"Advances in Neural Information Processing Systems36, 53728–53741 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.630719Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:61998131ac24ddf0ee4c1d416b74db39c32f561983280906b840a386194a4d02","observation_id":"0e99e794-0199-47d5-8710-2b47136eedaa","resolution":{"observed_at":"2026-07-31T21:55:12.630719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.724577Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.724577Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:37b7ee156aee4281504677f26d48a70dce29bce32ef1c88a009f4301dbd49153","observation_id":"80d62ed6-1967-4eea-885f-3a9a5dc4b32a","resolution":{"observed_at":"2026-07-31T21:55:12.724577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.780508Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.780508Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:132601b1b29e5a3caf39745b86403368b1fd779d3b472c2f1661e07e852b48af","observation_id":"351e3d45-fedf-45ad-9721-cc1074ae742e","resolution":{"observed_at":"2026-07-31T21:55:12.780508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:12.870993Z","title":"Advances in Neural Information Processing Systems34, 18075–18086 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.870993Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:4b2b387c7e423742a5976edf363e261671562b81562bd37cc7472141bff6d7af","observation_id":"9b0c0066-19f5-4bb9-a20d-8a179ab37fde","resolution":{"observed_at":"2026-07-31T21:55:12.870993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-31T21:55:12.939314Z","title":"arXiv preprint arXiv:2402.03300 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:12.939314Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:1ecd4f47d0bc420c09fb23dc742ecf60ed933790cd12bbae42804208d7abc14e","observation_id":"752bbdb5-3f65-44f7-b404-929abf3774c3","resolution":{"observed_at":"2026-07-31T21:55:12.939314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.007776Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.007776Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:bc93ccc22c42733ab3344fd715f95de4427a333b5c8107f9715c22fe6b491cfe","observation_id":"32cc7f85-756e-4518-b208-019957c59423","resolution":{"observed_at":"2026-07-31T21:55:13.007776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.121127Z","title":"In: Conference on Learning Theory","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.121127Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:470947a2b1a4bdf9ee0a129bfc9056e9f37ccccad33e5588d4b91c2900267fd6","observation_id":"fce02641-6f6b-4d57-a62a-e74d36cab6c1","resolution":{"observed_at":"2026-07-31T21:55:13.121127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.209250Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.209250Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:89ad0b1f2f57ae547c4ff31937eb1b934d8eef63a3dc8e57dd842f152bede295","observation_id":"80b5ca3b-edc1-462e-860b-2f96c49ded4d","resolution":{"observed_at":"2026-07-31T21:55:13.209250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.273482Z","title":"In: The Thirty-First International Joint Conference on Artificial Intelligence (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.273482Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:66944ce592ae5ab285d88ad344dc24fe63ec6d96f72f93df0762d331ed886539","observation_id":"27041aa1-962e-455b-82dd-df22a1581321","resolution":{"observed_at":"2026-07-31T21:55:13.273482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.338035Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Pa- pers)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.338035Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:ec2691138c11ea222510d12d267c3468d24a77af23010a52da2768ec7a324626","observation_id":"96cd0941-6832-4506-a88d-4c940e9f849e","resolution":{"observed_at":"2026-07-31T21:55:13.338035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.404187Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.404187Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:fbf0e394e31866ae1f6797d5cbe70e3b049cf4ab5b562c6acba7eadf4bcae29d","observation_id":"7c85dd62-382b-415e-9511-401dad5177d2","resolution":{"observed_at":"2026-07-31T21:55:13.404187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.521475Z","title":"arXiv preprint arXiv:2601.20568 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.521475Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:13851e9679f1ca20ee6cd79b0d5f9873af03a9cc0dc005437e80094d81a21ac9","observation_id":"fa92a933-6086-4614-9b81-46774240372a","resolution":{"observed_at":"2026-07-31T21:55:13.521475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.642017Z","title":"In: The Thirty- ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.642017Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:aa8941da5cadd147cd126a7efa950b488600b7e2140ae4cd459086ae73bbec09","observation_id":"e8241d0f-0d8f-4211-a96b-e93bac6c8a90","resolution":{"observed_at":"2026-07-31T21:55:13.642017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T21:55:13.704957Z","title":"does the completion contain any forbidden item?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T21:55:13.704957Z"},"links":{"citing_paper":"/paper/2607.27968"},"observation_digest":"sha256:682b8725637c40bd5f9f8daa2ed4d697410d5211925107128f92da3200d9b514","observation_id":"286c5a3b-3f62-44e7-a06d-e1286eed1847","resolution":{"observed_at":"2026-07-31T21:55:13.704957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27968","last_updated":"2026-07-30T10:15:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T04:33:26.516139Z","submitted_at":"2026-07-30T10:15:59Z","title":"Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2607.27968."}