{"as_of":"2026-08-09T05:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e4effd20f81073c9f486fb345763f7ec67335ea936399c54d86cd85e4b4d409f","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:49:58.910725Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T12:22:06.635622Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T12:23:24.240761Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"cited_work":{"arxiv_id":"2508.04216","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04216","snapshot_observed_at":"2026-06-29T12:23:24.240761Z","title":"Causal re- ward adjustment: Mitigating reward hacking in exter- nal reasoning via backdoor correction.arXiv preprint arXiv:2508.04216, 2025a","venue":null,"work_id":"3f87b71a-25df-4b73-a0ca-53d553c3094b","year":2025},"citing_paper":{"arxiv_id":"2601.21350","last_updated":"2026-05-16T02:45:10Z","snapshot_observed_at":"2026-07-06T22:43:26.250071Z","submitted_at":"2026-01-29T07:18:45Z","title":"Factored Causal Representation Learning for Robust Reward Modeling in RLHF","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T14:18:33.768962Z"},"links":{"cited_paper":"/paper/2508.04216","citing_paper":"/paper/2601.21350"},"observation_digest":"sha256:49a15915a3fd28a791e7895bdf98d4a6db9e427a7e3ad67a1c77ff706374c554","observation_id":"74308e21-8960-496a-9d51-81d753f7543e","resolution":{"observed_at":"2026-05-21T14:20:13.564528Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"cited_work":{"arxiv_id":"2508.04216","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04216","snapshot_observed_at":"2026-06-29T12:23:24.240761Z","title":"Causal re- ward adjustment: Mitigating reward hacking in exter- nal reasoning via backdoor correction.arXiv preprint arXiv:2508.04216, 2025a","venue":null,"work_id":"3f87b71a-25df-4b73-a0ca-53d553c3094b","year":2025},"citing_paper":{"arxiv_id":"2605.27996","last_updated":"2026-05-29T02:24:56Z","snapshot_observed_at":"2026-07-06T23:37:36.244456Z","submitted_at":"2026-05-27T05:40:22Z","title":"Reward Bias Substitution: Single-Axis Bias Mitigations Redirect Optimization Pressure","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-29T12:22:06.635622Z"},"links":{"cited_paper":"/paper/2508.04216","citing_paper":"/paper/2605.27996"},"observation_digest":"sha256:1a1d03b98e0805b1516971c78a86a933e2da1a79cc2b158e74e96da1a562ed5f","observation_id":"90bf14c4-aaac-4d72-a5a3-94d7926aa0ef","resolution":{"observed_at":"2026-06-29T12:23:24.242250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.04216/citation-record","integrity":"/paper/2508.04216/integrity","json":"/paper/2508.04216/citation-record.json","paper":"/paper/2508.04216"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:55.195733Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.195733Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:2474db8911741bf8c677b5ffebcbca920f64d2680487f7456ad03f4ccfa5db2e","observation_id":"53475a56-da37-4582-bb18-dfc7b62a9ad8","resolution":{"observed_at":"2026-08-06T00:49:55.195733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:55.287688Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.287688Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:560eb9dd5b26e8d0e4f45ad011abb10da0e23d2455ce4b515a4a2d84d2ab91f2","observation_id":"a21285f0-4606-462a-8b62-e26e1c89cb44","resolution":{"observed_at":"2026-08-06T00:49:55.287688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-06T00:49:55.417778Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.417778Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:fdfbb7ddba0ddb2f4ecfaab67e788ea7f2ccde4752a82d39ed6346613c24d1d7","observation_id":"7953bb5a-bb0d-4a5f-bbc0-e78ea0e11043","resolution":{"observed_at":"2026-08-06T00:49:55.417778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:02.074880Z","title":null,"venue":null,"work_id":"eabbc369-6385-4558-9862-19eea0db1a40","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.552626Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:ccbe9a27afa9f80261449829ebcf4bbf878d8b57184ff170b28e28b1e3ed6f91","observation_id":"426f3b28-a921-476d-88da-4a3fe872c68c","resolution":{"observed_at":"2026-08-06T00:50:02.140984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:55.665028Z","title":"E.; Hume, T.; Carter, S.; Henighan, T.; and Olah, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.665028Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:2956a6cfe7daf681655541e4e174acb9c7c94ddb9fc2ffeead6feb8d6728092e","observation_id":"870055df-2744-4273-8716-6b2db294e08f","resolution":{"observed_at":"2026-08-06T00:49:55.665028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-06T00:49:55.743365Z","title":"V.; R \\'e , C.; and Mirhoseini, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.743365Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:a0b448edcb67e1f32270a084deb1c86da699fb8bf777b66448344b85b0d12905","observation_id":"d56d4c56-8dea-4b89-a9fe-5ff1ff83ac11","resolution":{"observed_at":"2026-08-06T00:49:55.743365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T00:49:55.811698Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.811698Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:f83b29b5e8ad5a1884e9e229bc817d677516c81a289c939641326716fb06c16f","observation_id":"7532f3ab-76f8-46a2-9748-bac3186db987","resolution":{"observed_at":"2026-08-06T00:49:55.811698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08600","last_updated":"2023-10-04T13:17:38Z","snapshot_observed_at":"2026-07-06T16:19:05.495349Z","submitted_at":"2023-09-15T17:56:55Z","title":"Sparse Autoencoders Find Highly Interpretable Features in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08600","snapshot_observed_at":"2026-08-06T00:49:55.891955Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.891955Z"},"links":{"cited_paper":"/paper/2309.08600","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:6cfcde4464221ffa8b83c3e7ccaa862d435d68b89b4e764dd50207b2cedbdbd4","observation_id":"f4fed5e4-9b22-432b-9197-85b9a818c276","resolution":{"observed_at":"2026-08-06T00:49:55.891955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T00:49:55.975299Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:55.975299Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:b679df770e8d0c6fe8d90a188c49adbbefb80ab9ea1914220184fd8de897f473","observation_id":"48843abe-3a9f-443d-aca0-0ce19980c0d0","resolution":{"observed_at":"2026-08-06T00:49:55.975299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.916729Z","title":null,"venue":null,"work_id":"ce522cd0-f5e7-4677-9864-b628b7a2e6d2","year":2015},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.047481Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:ae456ded0915096916fef96a27e0e4a5bf4d12f4221021e3c2b0413a8440402d","observation_id":"c175fe98-219e-43b5-be7c-dcaddc4ccf1d","resolution":{"observed_at":"2026-08-06T00:50:01.974682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T00:49:56.114202Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.114202Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:58d5a15518c7ccd404c0d4bc14b275409d67c2e2d41415166747ef49fc8e7e3b","observation_id":"6b720003-3c15-4315-87ef-c01af2f16297","resolution":{"observed_at":"2026-08-06T00:49:56.114202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02827","last_updated":"2020-10-07T15:41:58Z","snapshot_observed_at":"2026-07-06T06:08:19.420105Z","submitted_at":"2017-11-08T04:44:32Z","title":"Inverse Reward Design","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02827","snapshot_observed_at":"2026-08-06T00:49:56.182077Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.182077Z"},"links":{"cited_paper":"/paper/1711.02827","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:fa26b28a8dbfdc8e803b020800d89982cf646954d6f7df4d91b88246f5b3bd20","observation_id":"ff348be9-27de-427a-8ce6-a0f67c93a558","resolution":{"observed_at":"2026-08-06T00:49:56.182077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.729318Z","title":null,"venue":null,"work_id":"e91a85ae-cb9b-41d1-97bf-6278a3f162e4","year":2021},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.235762Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:7a4a672e1bfb25da4bd3545053fefc5fa649d6b5debc434ccac6e5e42c80e35e","observation_id":"993c3d33-30a8-4051-9fcd-da0bce7e8267","resolution":{"observed_at":"2026-08-06T00:50:01.825837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-05T13:11:04.104454Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-06T00:49:56.306521Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.306521Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:6c2d1cc351911df6abfc07150a6d3ead66641f2b3f34dce9e950af2029f78fbe","observation_id":"02c988b7-9dd4-47ae-bba3-607f415acebc","resolution":{"observed_at":"2026-08-06T00:49:56.306521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06703","last_updated":"2025-02-10T17:30:23Z","snapshot_observed_at":"2026-08-08T18:40:06.157350Z","submitted_at":"2025-02-10T17:30:23Z","title":"Can 1B LLM Surpass 405B LLM? Rethinking Compute-Optimal Test-Time Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06703","snapshot_observed_at":"2026-08-06T00:49:56.372971Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.372971Z"},"links":{"cited_paper":"/paper/2502.06703","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:0656ac117f78c0932a7254615519ffe8b840367162e0a1e5bfcc33b624e7d564","observation_id":"9c1a11d3-de30-4c11-9006-604f787b15e8","resolution":{"observed_at":"2026-08-06T00:49:56.372971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13156","last_updated":"2025-02-27T16:30:42Z","snapshot_observed_at":"2026-07-06T19:18:27.644746Z","submitted_at":"2024-09-20T01:46:07Z","title":"RRM: Robust Reward Model Training Mitigates Reward Hacking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13156","snapshot_observed_at":"2026-08-06T00:49:56.466791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.466791Z"},"links":{"cited_paper":"/paper/2409.13156","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:02d007f200b5744a1aeb3e153cbc0262bba1264987ebb2ad3641faa939121c93","observation_id":"151a3599-716c-4f98-ad09-f762cebc36b2","resolution":{"observed_at":"2026-08-06T00:49:56.466791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.537581Z","title":"P.; Hermann, K.; Welleck, S.; Yazdanbakhsh, A.; and Clark, P","venue":null,"work_id":"9b782865-d691-4c69-814e-ab3cd59defd1","year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.543973Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:063e698f607299ead7b28757d62d5f0e1b6829b25ef3c33aec7009467dc7fc0d","observation_id":"d2786640-1018-43ad-8f4e-99a900c9a45c","resolution":{"observed_at":"2026-08-06T00:50:01.604360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08366","last_updated":"2024-05-20T17:46:14Z","snapshot_observed_at":"2026-08-02T17:29:39.715223Z","submitted_at":"2024-05-14T07:07:13Z","title":"Towards Principled Evaluations of Sparse Autoencoders for Interpretability and Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08366","snapshot_observed_at":"2026-08-06T00:49:56.667273Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.667273Z"},"links":{"cited_paper":"/paper/2405.08366","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:7b70e5eb2154dfb514de88462a15613f6d9d262927cdf52b281c9808652a742e","observation_id":"41967675-9e22-4ff0-9d31-615883143be6","resolution":{"observed_at":"2026-08-06T00:49:56.667273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.365977Z","title":null,"venue":null,"work_id":"57856b14-5939-463f-984a-d51bf944d4c6","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.757497Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:409208cb11f3c1211ee4bec7e1702f2666012dab0fd36e7cd33d42d80bae891d","observation_id":"f01d6fc3-fd5d-46be-9266-4d1dc61a95e1","resolution":{"observed_at":"2026-08-06T00:50:01.465055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06627","last_updated":"2024-06-06T21:39:09Z","snapshot_observed_at":"2026-08-02T15:15:54.521833Z","submitted_at":"2024-02-09T18:59:29Z","title":"Feedback Loops With Language Models Drive In-Context Reward Hacking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06627","snapshot_observed_at":"2026-08-06T00:49:56.840261Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.840261Z"},"links":{"cited_paper":"/paper/2402.06627","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:1d7df21f0d1ec4379a46eab90c9998c2d09c0c152d8b34d09f14b778a0e3cadf","observation_id":"5fc8f8d2-3bc5-4065-acc1-1db253b092fd","resolution":{"observed_at":"2026-08-06T00:49:56.840261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:56.900164Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.900164Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:b7afcefda4c1bbac6103b4add2a1d1522c0af519be6441661b44f4e9d3876525","observation_id":"a8c35825-02bd-434b-9fd9-eacef2c06611","resolution":{"observed_at":"2026-08-06T00:49:56.900164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:01.166131Z","title":null,"venue":null,"work_id":"cb5b960c-264d-45b4-82bd-ae9ec93c8d54","year":2016},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:56.989041Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:ae2a74a4395a629eb89cbb9c49c5011f8a63c470f06ad8e19c5ac87d72567147","observation_id":"b599c292-0fe5-4857-8b69-41716d6dfa30","resolution":{"observed_at":"2026-08-06T00:50:01.243287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.968037Z","title":null,"venue":null,"work_id":"727f9a89-566a-45bc-ae1a-c962c4346070","year":2017},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.073629Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d9b8cf4ba1d1b3b8a9aed3aaa4859443e5885fcae096eda0c46bfcc48bab56c6","observation_id":"11feddce-4347-4d37-8522-ca4ea2a71324","resolution":{"observed_at":"2026-08-06T00:50:01.071894Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05802","last_updated":"2022-06-14T01:16:24Z","snapshot_observed_at":"2026-07-06T13:19:58.934755Z","submitted_at":"2022-06-12T17:40:53Z","title":"Self-critiquing models for assisting human evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.05802","snapshot_observed_at":"2026-08-06T00:49:57.156128Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.156128Z"},"links":{"cited_paper":"/paper/2206.05802","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:e9fb49bf868512e3d0662aabd86fcfa2feb039f9b03e9fa9ad601e295dc2eb2c","observation_id":"c81a857b-41ce-4035-aa10-4432d0b99b1f","resolution":{"observed_at":"2026-08-06T00:49:57.156128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.672558Z","title":null,"venue":null,"work_id":"c01a5069-4fb9-4e05-a9c6-83c525d69b16","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.244923Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:49d35d35ac713ab78fc19ca00cd84efd4d539a44d7ab7c14cb77c62343d566ba","observation_id":"1aef55fa-a437-473b-bcd4-c93e13044071","resolution":{"observed_at":"2026-08-06T00:50:00.812569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.491817Z","title":null,"venue":null,"work_id":"d9995263-0583-495a-998b-a4880236ecea","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.313769Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:cc106b4be9aad32545b690ad5d0e1bf3c2f24db3b4fdd8013b50b3a7c455fb46","observation_id":"3abde802-218f-44d7-ba48-e00c9527e919","resolution":{"observed_at":"2026-08-06T00:50:00.557972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T00:49:57.391495Z","title":"K.; Wu, Y.; and Guo, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.391495Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:fd0f700ab3b1ae564b03d516e43b154bede88325079f40c89bb02fe76ffd4f65","observation_id":"d45b03e4-3e88-475d-a03f-6465fd3d4c36","resolution":{"observed_at":"2026-08-06T00:49:57.391495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:57.500199Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.500199Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:4534375ec6f0aa8fdf6c254ad11fe2c92ebb00a942fc6287717f0dc7b87b49d1","observation_id":"8ca4aa02-c030-4f7d-9025-fd91360e5b06","resolution":{"observed_at":"2026-08-06T00:49:57.500199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-06T00:49:57.585878Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.585878Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:af93603b0f8a4c115cf7897c4eb58bc1e7bdd99771f2e8746a2c735615f0b916","observation_id":"c4bf3754-bb08-44c9-8096-667569423794","resolution":{"observed_at":"2026-08-06T00:49:57.585878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.226153Z","title":"V.; Lee, J.; Xu, K.; and Kumar, A","venue":null,"work_id":"f859fdf0-36a6-4553-8907-e32165dc9750","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.685133Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:8ef9827103b43e0a366d688fdb0c3ba2f4a0beecfa9dde73337d65e0837ec2e6","observation_id":"f8048e73-95ee-4f11-8082-d620ed4e4900","resolution":{"observed_at":"2026-08-06T00:50:00.332444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:50:00.037970Z","title":null,"venue":null,"work_id":"8419a55e-a0ef-4225-8c76-b154910cd6e1","year":2016},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.794179Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:f535dc1d2b330f882cefe3a12909d102cbb105235663e039105d34f4f4424ae8","observation_id":"94254e3b-f5aa-4a07-87f9-b90e7bc10d02","resolution":{"observed_at":"2026-08-06T00:50:00.119426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:57.868476Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.868476Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:1d5e957e2df284dc67f32ceea06617f0de7bd9db77611e2acc1a05fc95b2f190","observation_id":"06cff769-dda9-49ac-877f-d6f01645f5de","resolution":{"observed_at":"2026-08-06T00:49:57.868476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:57.951694Z","title":"L.; McDougall, C.; MacDiarmid, M.; Freeman, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:57.951694Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:59a6a57a0ffc7b0ddec2ac461831751c67c1487ec78a58985e4b96103eec143a","observation_id":"ea48494e-966a-4450-9252-0561cecf8267","resolution":{"observed_at":"2026-08-06T00:49:57.951694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-06T00:49:58.030203Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.030203Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:2916202df37b288a003c6f251a4dc7b455bba9334c0441432e3ebbd8bce86674","observation_id":"3fa39720-4336-4778-996c-69b162fd43dc","resolution":{"observed_at":"2026-08-06T00:49:58.030203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08935","last_updated":"2024-02-19T14:07:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-14T13:41:54Z","title":"Math-Shepherd: Verify and Reinforce LLMs Step-by-step without Human Annotations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08935","snapshot_observed_at":"2026-08-06T00:49:58.128960Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.128960Z"},"links":{"cited_paper":"/paper/2312.08935","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:3c67d360818e95a050c25a2e0456ef42fd983654fcc265f3889c20ac955693a7","observation_id":"20e4ba43-a24d-4141-b814-b64088f259ae","resolution":{"observed_at":"2026-08-06T00:49:58.128960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.829870Z","title":"V.; and Zhou, D","venue":null,"work_id":"de93bb86-1938-418e-9c52-7ba5850a37b9","year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.223409Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:d0fcec817f97ff676dfa8e48885b466452d74df2b4c3cf36b8a83f2680179119","observation_id":"5210ed7d-8a0c-4e7d-8e2e-8a4285517db3","resolution":{"observed_at":"2026-08-06T00:49:59.909412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.624983Z","title":null,"venue":null,"work_id":"3a590a82-30c4-4e53-9a5e-0e1a1681e536","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.324287Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:5fe9540ac977497de355b44cb1d37a4cead319cfedfb66be1ea4166e5275d67e","observation_id":"bac4398b-b0d7-4bdf-9178-1545702fd1ef","resolution":{"observed_at":"2026-08-06T00:49:59.733765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.418937Z","title":null,"venue":null,"work_id":"169acb0d-5413-400e-b692-664b7322e5a2","year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.417699Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:632c0c7dbc57925def202672f8163c5a14f940ea9deec95ab8f999bad3b1c0bc","observation_id":"a68159bb-9a83-431f-834f-94b0921806ab","resolution":{"observed_at":"2026-08-06T00:49:59.525941Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-06T00:49:58.564042Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.564042Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:59cf2fbe8afe02b8c9fbb11ab31e96632463c7b36b51dda2dd3f9c3d4bd17e2a","observation_id":"99f1c65a-14e5-4d15-8569-c13c054177e4","resolution":{"observed_at":"2026-08-06T00:49:58.564042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:49:59.230279Z","title":"L.; Cao, Y.; and Narasimhan, K","venue":null,"work_id":"6501c345-2726-4f55-9670-a0b98e3db331","year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.645366Z"},"links":{"citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:19ffbc099998cc25fd1e3d47e9b1311675cd918026deb0719907fa31704c0af5","observation_id":"941c3b9b-e322-4766-ac12-5d0c6c6af4b9","resolution":{"observed_at":"2026-08-06T00:49:59.304045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03493","last_updated":"2022-10-07T12:28:21Z","snapshot_observed_at":"2026-07-06T14:01:50.333970Z","submitted_at":"2022-10-07T12:28:21Z","title":"Automatic Chain of Thought Prompting in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03493","snapshot_observed_at":"2026-08-06T00:49:58.718193Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.718193Z"},"links":{"cited_paper":"/paper/2210.03493","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:1f85ef76fb5219943575c427c3f95fbf7aa91d82e9c39334ac5b519866a9809e","observation_id":"87d5d540-9d51-4cb6-85c3-5b5292754f9a","resolution":{"observed_at":"2026-08-06T00:49:58.718193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07301","last_updated":"2025-06-05T16:34:24Z","snapshot_observed_at":"2026-08-03T11:11:25.359494Z","submitted_at":"2025-01-13T13:10:16Z","title":"The Lessons of Developing Process Reward Models in Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07301","snapshot_observed_at":"2026-08-06T00:49:58.821187Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.821187Z"},"links":{"cited_paper":"/paper/2501.07301","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:b44ff7b11dcaa41c8c6be642ac327c70fedfaf786a701d86020c0d22b1c70d83","observation_id":"7bb593af-902e-48f0-b2d3-c34250c53f0b","resolution":{"observed_at":"2026-08-06T00:49:58.821187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-06T00:49:58.910725Z","title":"X.; Zhou, K.; Li, J.; Tang, T.; Wang, X.; Hou, Y.; Min, Y.; Zhang, B.; Zhang, J.; Dong, Z.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T00:49:58.910725Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2508.04216"},"observation_digest":"sha256:8fba2c9dc2ddb42cb10a3bda61443f2fa3cd620afc75c6e803556d2ddcf3bb8b","observation_id":"23122d00-eb26-4d5e-92d0-df77482177dd","resolution":{"observed_at":"2026-08-06T00:49:58.910725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.04216","last_updated":"2025-08-06T08:48:55Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T00:28:09.592738Z","submitted_at":"2025-08-06T08:48:55Z","title":"Causal Reward Adjustment: Mitigating Reward Hacking in External Reasoning via Backdoor Correction"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":4},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 2 inbound Pith citation observations for arXiv:2508.04216."}