{"as_of":"2026-08-20T22:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:88b2d6ce56aa5378fdc00dbbec362d2ee8c7a72b7f9df03cf8f9c95b66dd3d2f","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T19:07:39.750969Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:24:57.402374Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07165","snapshot_observed_at":"2026-08-07T15:24:57.402374Z","title":"A method for evaluating hyperparameter sensitivity in reinforcement learning.arXiv preprint arXiv:2412.07165, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15306","last_updated":"2025-05-21T09:35:43Z","snapshot_observed_at":"2026-08-16T22:34:44.643578Z","submitted_at":"2025-05-21T09:35:43Z","title":"Multiple Weaks Win Single Strong: Large Language Models Ensemble Weak Reinforcement Learning Agents into a Supreme One","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:24:57.402374Z"},"links":{"cited_paper":"/paper/2412.07165","citing_paper":"/paper/2505.15306"},"observation_digest":"sha256:712d1b90e092478476320703635f52dc22fe165f46a5bae01c1bfe9fb64fc969","observation_id":"a86bb074-2a9b-47c2-90ba-95720d7c2bec","resolution":{"observed_at":"2026-08-07T15:24:57.402374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07165","snapshot_observed_at":"2026-08-06T14:48:44.755232Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning , February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17668","last_updated":"2025-09-10T12:25:27Z","snapshot_observed_at":"2026-08-13T09:20:50.731356Z","submitted_at":"2025-07-23T16:31:38Z","title":"How Should We Meta-Learn Reinforcement Learning Algorithms?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T14:48:44.755232Z"},"links":{"cited_paper":"/paper/2412.07165","citing_paper":"/paper/2507.17668"},"observation_digest":"sha256:a1a58ac511d4bead80d2ffba8104c8da8c2e436fc670f3d902b494ffc746f131","observation_id":"f48faf5f-8f10-4095-b923-e3fe5bf3f8f4","resolution":{"observed_at":"2026-08-06T14:48:44.755232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2412.07165","doi":"10.48550/arxiv.2412.07165","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.07165","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A method for evaluating hyperparameter sensitivity in reinforcement learning","venue":"arXiv (Cornell University)","work_id":"3a4cdd1b-d421-47bc-97cd-79fc435e1a17","year":2024},"citing_paper":{"arxiv_id":"2605.01567","last_updated":"2026-05-02T18:37:36Z","snapshot_observed_at":"2026-08-17T02:00:18.581256Z","submitted_at":"2026-05-02T18:37:36Z","title":"Feedback-Normalized Developer Memory for Reinforcement-Learning Coding Agents: A Safety-Gated MCP Architecture","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T13:59:40.638085Z"},"links":{"cited_paper":"/paper/2412.07165","citing_paper":"/paper/2605.01567"},"observation_digest":"sha256:4f1166ade9564888e02b78f15b810ec736e7d4424c41b8f576b5eefdfa69d105","observation_id":"ebba4398-d90e-42c5-9f66-de8e2bf794a0","resolution":{"observed_at":"2026-05-09T22:29:06.380913Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.07165/citation-record","integrity":"/paper/2412.07165/integrity","json":"/paper/2412.07165/citation-record.json","paper":"/paper/2412.07165"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.334468Z","title":"What Matters in On - Policy Reinforcement Learning ? A Large - Scale Empirical Study","venue":null,"work_id":"81d5ee81-7d02-4fb5-95b9-00e5a5965106","year":2021},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.613300Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:f05294f6d2dcf271148ace3e3b9966bd5b7c00df9f768ec1f18034603dab4022","observation_id":"5fe30a1c-3e83-42db-9d9d-5f334ddbb3b2","resolution":{"observed_at":"2026-08-11T19:07:40.340418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10876","last_updated":"2022-12-21T09:38:18Z","snapshot_observed_at":"2026-08-17T23:11:11.232813Z","submitted_at":"2022-12-21T09:38:18Z","title":"Hyperparameters in Contextual RL are Highly Situational","version":1},"cited_work":{"arxiv_id":"2212.10876","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.10876","snapshot_observed_at":"2026-08-11T19:07:39.883251Z","title":"Hyperparameters in Contextual RL are Highly Situational","venue":"cs.LG","work_id":"64be07e1-9275-46b3-87c8-8b74c3febbc8","year":2022},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.619016Z"},"links":{"cited_paper":"/paper/2212.10876","citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:cbbea08fa5c8172698b3dd8e9adf1e19ef8a05abe2dbe4ea3c06fd45adeb4b71","observation_id":"7eaf0051-ba98-4ef0-9559-9eddf46d8cfd","resolution":{"observed_at":"2026-08-11T19:07:39.909523Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.310816Z","title":"Hyperparameters in Reinforcement Learning and How To Tune Them","venue":null,"work_id":"913d524a-0e37-4259-bebb-b5c5c1c6970f","year":2023},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.624658Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:22306b796136f4b0ea6163e7c292d07fabfcabc18081138314e0ad3e6ad3824d","observation_id":"5e66c21d-4a0a-4e45-b3da-601ab2eedd79","resolution":{"observed_at":"2026-08-11T19:07:40.321521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.288404Z","title":"o rg KH Franke, Gregor K \\","venue":null,"work_id":"dac8c45e-2cea-468a-aa21-43ed29a55e41","year":2021},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.630778Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:b4e75e8fc1adc177657de1773bb4a34f43f4b290ded4f5f8272991223052a79e","observation_id":"93eacf2b-6b48-43ed-b064-78ce63a6ec3a","resolution":{"observed_at":"2026-08-11T19:07:40.295995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.255986Z","title":"Daniel Freeman, Erik Frey, Anton Raichuk, Sertan Girgin, Igor Mordatch, and Olivier Bachem","venue":null,"work_id":"458e901d-ffa1-4026-b7f3-1fd90147cf92","year":2021},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.640442Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:542e5376966f575a8021c37027ed7859e4a8d445efd4b193df6e1d8a1ce8cacc","observation_id":"cd48d35c-bf21-473e-aaf3-b009d8f9cc95","resolution":{"observed_at":"2026-08-11T19:07:40.273567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04104","last_updated":"2024-04-17T17:41:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-10T18:12:16Z","title":"Mastering Diverse Domains through World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04104","snapshot_observed_at":"2026-08-11T19:07:39.646721Z","title":"Lillicrap","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.646721Z"},"links":{"cited_paper":"/paper/2301.04104","citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:4aa28d67e11f298f679cbddc9e71979bb3749683d7e96f653d4b215fdf75f42f","observation_id":"045cc84f-7936-4f53-891c-eb8fa1b401d1","resolution":{"observed_at":"2026-08-11T19:07:39.646721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.226487Z","title":"Rainbow: Combining Improvements in Deep Reinforcement Learning","venue":null,"work_id":"1658f3f4-9e07-4e5a-8b78-542370494a80","year":2018},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.653259Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:3e7e01ff8d177bb5ba8cf31fb9741b79e79097f1e48534d67ca67d91f0c0b9fb","observation_id":"92c051d2-df4c-4061-acbc-1ab33e92625b","resolution":{"observed_at":"2026-08-11T19:07:40.232213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.202314Z","title":"The 37 Implementation Details of Proximal Policy Optimization","venue":null,"work_id":"1845cb2f-ffbe-4f28-9fbe-3809e66caf97","year":2022},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.659061Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:d2687778eaa348d9f09040aaa9c5ba1b370e1a7d149387f11c9e4f2267b9436a","observation_id":"93424955-b8ae-47e0-b65f-1b634411e059","resolution":{"observed_at":"2026-08-11T19:07:40.208497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.176212Z","title":"Jordan, Yash Chandak, Daniel Cohen, Mengxue Zhang, and Philip S","venue":null,"work_id":"bf3920aa-63f2-49d8-a8d2-7d97d3780040","year":2020},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.665748Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:2c2cb58a2a35d44fafa701824b8040887f7c1e17fc5a56ead69cbd0b45284210","observation_id":"5e81d34b-3333-489d-9e18-58d988198e09","resolution":{"observed_at":"2026-08-11T19:07:40.184249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.153361Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":"39b28877-cf68-4433-a103-82db2751f8d3","year":2015},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.671587Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:37c4c3481dd444346446c618b21a5f99bda2fbdb9c9b053a2a36258e9715cf1d","observation_id":"1ff7292e-6741-444a-a8a2-a8a7b866e0ab","resolution":{"observed_at":"2026-08-11T19:07:40.159913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.134236Z","title":"Lagoudakis and Ronald Parr","venue":null,"work_id":"36cf631f-082b-4388-98be-58359c0c0c59","year":2003},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.678055Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:97f9aeedef1076d88bc9741845e831765dba2dc279f793f14fa97bd4b66a6e7d","observation_id":"67e71ef6-5f64-4201-92a9-b400e97f5acc","resolution":{"observed_at":"2026-08-11T19:07:40.139322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.116408Z","title":"Discovered Policy Optimisation","venue":null,"work_id":"dcaca5ce-4cf8-426b-a0ec-712ed6296867","year":2022},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.684002Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:4aaac0ab381abfde430fe5192679d12b2aad442abbcf43aa4d3dc215cd7533f6","observation_id":"b630384c-4699-4e03-a77d-cd1d2543a8f0","resolution":{"observed_at":"2026-08-11T19:07:40.122246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.099785Z","title":"Rusu, Joel Veness, Marc G","venue":null,"work_id":"a377b8c3-9825-437c-954f-c3dc9b77cece","year":2015},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.691014Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:c75d1887e01ba8f340a6d9cbc14934ca6ae1202761872e2955bf04c714f8a803","observation_id":"de7177af-accf-433c-ba2c-f130844956bc","resolution":{"observed_at":"2026-08-11T19:07:40.105243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01315","last_updated":"2024-10-29T17:44:21Z","snapshot_observed_at":"2026-08-17T12:58:38.393092Z","submitted_at":"2023-04-03T19:32:24Z","title":"Empirical Design in Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01315","snapshot_observed_at":"2026-08-11T19:07:39.698889Z","title":"Empirical Design in Reinforcement Learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.698889Z"},"links":{"cited_paper":"/paper/2304.01315","citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:f44fb8dbd713bac620c14462a2c0b9fdffc713be7aaf0b5ebdf80acb7c21524e","observation_id":"e1851ac6-ef43-4eb4-9fec-131d91b15020","resolution":{"observed_at":"2026-08-11T19:07:39.698889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.079909Z","title":"The Cross - Environment Hyperparameter Setting Benchmark for Reinforcement Learning","venue":null,"work_id":"eac44a9a-a216-4e2d-9c36-836671feee0e","year":2024},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.705482Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:dbd986dfe9a9d2d9026fbb7ef36d5805989fa75053c000b53db7df6d5eb20b2d","observation_id":"80449247-d683-48e7-8d9b-a2bdda6df319","resolution":{"observed_at":"2026-08-11T19:07:40.086941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.056212Z","title":"Neural fitted q iteration - first experiences with a data efficient neural reinforcement learning method","venue":null,"work_id":"1b07b7e2-f906-40b5-9f47-b1518c9e821b","year":2005},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.710916Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:0da1ddcfdf59a2ec369017cb9f87200b7943fe768b8c3bb5b68ff58d04bc6138","observation_id":"25b6592a-5a47-44d7-ad64-afc19bcc79f9","resolution":{"observed_at":"2026-08-11T19:07:40.063461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-20T07:04:06.309989Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-11T19:07:39.716115Z","title":"Proximal Policy Optimization Algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.716115Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:c83ebea61f1f6d21d24ddc09bb0118e845557aa0f4959f8a503976c3c34892c8","observation_id":"b19e3072-29de-4c58-aec9-063952b2d161","resolution":{"observed_at":"2026-08-11T19:07:39.716115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.034852Z","title":"A reinforcement learning method for maximizing undiscounted rewards","venue":null,"work_id":"3af82284-b90a-4496-b1ec-bd18690c4e1f","year":1993},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.722669Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:57c8e143c2d09e468f3bb4e51a62b788c5da228e6ab46a979f023d7ad8920c17","observation_id":"cf16789d-9655-40e6-9b5a-e4b8169bce63","resolution":{"observed_at":"2026-08-11T19:07:40.040645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:40.016319Z","title":"Dickerson, and Joseph Suarez","venue":null,"work_id":"737f7ecd-83eb-4c80-a79d-2db92a5dbf24","year":2023},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.727969Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:bc67d2c44cd904639a4b923c5889f39f1ea4e6a945b4fef9cf15d0b96f497e15","observation_id":"695a8875-defd-46de-9593-b905024d9cca","resolution":{"observed_at":"2026-08-11T19:07:40.022256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:39.997062Z","title":"Reinforcement Learning : An Introduction","venue":null,"work_id":"5a1a2332-64ef-48e0-aecb-9965b89cd3ce","year":2018},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.733238Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:ddb73cd07f29c928668682a7201e5e5ea6a74045b705feebfb4e68cd18c39d5b","observation_id":"b7836f55-462b-4123-aa07-e744122403ae","resolution":{"observed_at":"2026-08-11T19:07:40.002884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:39.977542Z","title":"Learning Values Across Many Orders of Magnitude","venue":null,"work_id":"bcc66002-1035-4f0b-b55e-2f5aaf264068","year":2016},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.738929Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:efd60b7ebbb2ceb6f59fe8d1ed6eba09e6dfb52faf89681a7151b54ed5112079","observation_id":"30e5cbdd-c6ee-4b28-8726-5778092e61b1","resolution":{"observed_at":"2026-08-11T19:07:39.983700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:39.949560Z","title":"Learning from Delayed Rewards","venue":null,"work_id":"6be6beda-cae0-4a04-a12c-78bbb8f40835","year":1989},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.744232Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:5e27c91e3ba9f08b9ab01597422685f889bd7766518d28fc1ea08f28454e3041","observation_id":"71501654-42b8-408f-93d8-80ab33280237","resolution":{"observed_at":"2026-08-11T19:07:39.957633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:07:39.750969Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T19:07:39.750969Z"},"links":{"citing_paper":"/paper/2412.07165"},"observation_digest":"sha256:1e131386607c269f20949240168980136614bf3ca47b8175f952a99d50ece7a6","observation_id":"436d46a4-1008-4f7f-97b4-cdac143ab0f5","resolution":{"observed_at":"2026-08-11T19:07:39.750969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.07165","last_updated":"2025-02-04T05:17:26Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T17:21:13.114070Z","submitted_at":"2024-12-10T03:55:18Z","title":"A Method for Evaluating Hyperparameter Sensitivity in Reinforcement Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 3 inbound Pith citation observations for arXiv:2412.07165."}