{"as_of":"2026-08-04T10:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a48e4b818a0415d3f73b48b0241152cf456fb7277a2ddbd06847c5eb39bd92e2","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-14T20:27:26.552596Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.13537/citation-record","integrity":"/paper/2605.13537/integrity","json":"/paper/2605.13537/citation-record.json","paper":"/paper/2605.13537"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":"2404.14219","doi":"10.48550/arxiv.2404.14219","metadata_source":"pith","pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-07-10T13:57:06.708632Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":"cs.CL","work_id":"feef9556-a016-493c-abd2-0c97a23a7ebf","year":2024},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:92a23bf30441a971f8b344e9399828d3a7c3ce6ce9cfa50957ee95858793189e","observation_id":"38c7f9fa-91b3-4485-b188-07783ea51d97","resolution":{"observed_at":"2026-05-14T20:39:29.265050Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05913","last_updated":"2025-07-08T11:59:48Z","snapshot_observed_at":"2026-07-06T21:53:51.299826Z","submitted_at":"2025-07-08T11:59:48Z","title":"Best-of-N through the Smoothing Lens: KL Divergence and Regret Analysis","version":1},"cited_work":{"arxiv_id":"2507.05913","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.05913","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Best-of-n through the smoothing lens: KL divergence and regret analysis.arXiv preprint arXiv:2507.05913","venue":null,"work_id":"ccc8aa5e-ef73-48c7-b330-580a9f264058","year":null},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2507.05913","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:20f8c2aeaf44152caff441d1e1505c4b72dbc17000116560b16f86e0f85ce648","observation_id":"8584fc7a-97be-49fe-a67a-187801539ab3","resolution":{"observed_at":"2026-05-14T20:39:29.247752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:c5b35f795f76f7a7b6b6527267b8a054e06556ad49b81b5c82f1b380f5d28580","observation_id":"b485feae-cc7e-449b-8996-f25be0ac63d2","resolution":{"observed_at":"2026-05-14T20:39:29.235963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":"2204.05862","doi":"10.1016/j.respol.2005.01.014","metadata_source":"pith","pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","venue":"cs.CL","work_id":"a1f2574b-a899-4713-be60-c87ba332656c","year":2022},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:2ff93e83e463bcc6da68e036c0df9cfc41f4e48747f6febab87b2be5ce816d90","observation_id":"40f68bf7-bc59-4722-8ec2-116e64ff3637","resolution":{"observed_at":"2026-05-14T20:39:29.253089Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:22020a451d7d07bd3b1575177dd077d31a68201fc0f300e5d6650516f4850f5d","observation_id":"4e673fbb-612c-4c36-8366-790b2d7043fe","resolution":{"observed_at":"2026-05-14T20:39:29.240816Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reward-augmented decoding: Efficient controlled text generation with a unidirectional reward model","venue":null,"work_id":"b684d415-8d1f-4437-a489-e1d0d82a136b","year":2023},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:fd8f5b5ac6d53777b5ac23fa2f4867b9a4369a68e2ce2c913a23353d3898efdf","observation_id":"ddaab207-5768-41a3-a33a-2335c5c399d0","resolution":{"observed_at":"2026-05-15T15:21:11.804102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:8b18d40c17cea3ba2db37e8c2fb56a5433bbf7575adde562e0f49e4fd405dfc0","observation_id":"bcd1b07e-c8b5-4cb1-95f0-4b379e0754c0","resolution":{"observed_at":"2026-05-14T20:39:29.270766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Regularized best-of-n sampling with minimum bayes risk objective for language model alignment","venue":null,"work_id":"c8f6be3a-678b-4b04-a8df-e878e907cb7a","year":2025},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:dc439858236ebcc18a7531b13e1fa386e1693aa3eca2873d2735561fc685ae27","observation_id":"2f0faf65-83d7-4d47-9a1e-0d49c7716eab","resolution":{"observed_at":"2026-05-15T15:21:11.799864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:2552242a052aec9cf1b2e5125a2dc1a43c5ca50dc24755e637953796b3c289cc","observation_id":"d7bd3608-fc68-4a01-b1d8-a444a69a3c70","resolution":{"observed_at":"2026-05-14T20:39:29.258460Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On reinforcement learning and distribution matching for fine-tuning language models with no catastrophic forgetting","venue":null,"work_id":"4c85e61b-81a7-49f9-bb4b-7ea5484fd5df","year":2022},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:e88a2afaf71d6f2cbadc225ae016d94b0b8e863b6c487b2ec44c36977509b1ba","observation_id":"f21ccb7c-2cf7-4590-9315-40e9ce3e666a","resolution":{"observed_at":"2026-05-15T15:21:11.808393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":"2112.09332","doi":"10.48550/arxiv.2112.09332","metadata_source":"pith","pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-07-10T13:57:07.005292Z","title":"WebGPT: Browser-assisted question-answering with human feedback","venue":"cs.CL","work_id":"e25ef3e1-4848-4cb9-bf28-67a420591165","year":2021},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:f186fc6d118537a053752fff962a721430742e2967c9387c71b462b6d744a0de","observation_id":"aca132c2-62de-46a9-b25c-9b675de70f39","resolution":{"observed_at":"2026-05-14T20:39:29.225175Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:cff60a9f1c655473f401967ca403ecb9e7611a549db079f2cb8d9a49c012ba45","observation_id":"61a03144-eb7c-4d9f-904a-c758f6753342","resolution":{"observed_at":"2026-05-14T20:39:29.231231Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:eae7185977d1ce9accbe03b64724d7c72b2dd913601f740a093de372f0afd3ad","observation_id":"7ed7e962-1724-40b9-9122-22b5361ae2c3","resolution":{"observed_at":"2026-05-14T20:39:29.219280Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":"1909.08593","doi":"10.48550/arxiv.1909.08593","metadata_source":"pith","pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-07-10T19:37:34.037876Z","title":"Fine-Tuning Language Models from Human Preferences","venue":"cs.CL","work_id":"4f54aad1-f3b6-404f-b9c7-e21ba0a33b99","year":2019},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:43f95889df8686bb07c783a2d343148dab324dba264d6b17cfe1dfc2e211d5d6","observation_id":"a2fa2806-1291-4929-beb4-9026148a945e","resolution":{"observed_at":"2026-05-14T20:39:29.213700Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.631932+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.631932+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"For this example, the expected reward is given by Ex∼D,y∼π ∗ω(y|x)[g(x, y)] =ρ ω1 log p1(1|0) p1(0|0) +ρ ω1 log p1(0|1) p1(1|1) ,(22) as a function of two log-likelihood ratios","venue":null,"work_id":"0078ebf3-b7f4-4c2d-a508-a1523bcb56ed","year":2025},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:e33c1691550bdba901b33c16366112a43d39fe379be727b6667193a899a4a79d","observation_id":"82087f67-e075-469a-9176-62ae87afbc4f","resolution":{"observed_at":"2026-05-15T15:21:11.792023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Final answer","venue":null,"work_id":"5d0f8970-8197-462b-af6a-00e03e434d56","year":2014},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:26a4e06163c492aff1168d5ffa7c84f60edd63791d7db9eb0c791dd331f92ee1","observation_id":"28c1645e-3ffd-47a0-b347-52cdd45a4a5b","resolution":{"observed_at":"2026-05-15T15:21:11.795673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"71663396-a66e-4a19-9c45-8b71296bea48","year":2022},"citing_paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-14T20:27:26.552596Z"},"links":{"citing_paper":"/paper/2605.13537"},"observation_digest":"sha256:24afc670054cabe3943294853d083362851b76f9321bd347af53523157529544","observation_id":"60facd7e-a407-4129-aeaa-bf03cf493f98","resolution":{"observed_at":"2026-05-15T15:21:11.787163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.13537","last_updated":"2026-05-13T13:47:06Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:25:07.022065Z","submitted_at":"2026-05-13T13:47:06Z","title":"Temper and Tilt Lead to SLOP: Reward Hacking Mitigation with Inference-Time Alignment"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":11,"verified_fuzzy":5},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2605.13537."}