{"as_of":"2026-08-04T12:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:27d87a94cdc3c094c8e54247a54730d398bf2094c640d1692bd222a17fc7d1fa","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T04:26:46.686445Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T21:36:34.225692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T17:29:49.186565Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2407.17032"},"observation_digest":"sha256:e55c2bef76f2eb6649e9454e9b1751620ee9ff0c6c4b74c00328a29a5344ad30","observation_id":"b918eef3-a7da-4d4f-b861-6ee4a0c7baba","resolution":{"observed_at":"2026-05-11T17:29:49.654592Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2509.22963","last_updated":"2026-05-19T22:38:20Z","snapshot_observed_at":"2026-08-02T17:56:37.590404Z","submitted_at":"2025-09-26T21:53:36Z","title":"Reinforcement Learning with Discrete Diffusion Policies for Combinatorial Action Spaces","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-05-21T21:14:54.053177Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2509.22963"},"observation_digest":"sha256:6bbae974de78cf3662ab085be371a2221c00b26b3308dca410639722ddbf2b30","observation_id":"ef038293-fdcc-45c4-82bc-f97c3cd34239","resolution":{"observed_at":"2026-05-21T21:15:38.644092Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2604.19033","last_updated":"2026-04-21T03:33:40Z","snapshot_observed_at":"2026-07-06T23:05:44.499005Z","submitted_at":"2026-04-21T03:33:40Z","title":"Intentional Updates for Streaming Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-10T03:45:22.886826Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2604.19033"},"observation_digest":"sha256:748fe6bd422117258955b0036d127f91e9a82359d88ae461c98730e8f929408a","observation_id":"0cf72884-7100-409c-863b-6d2a3d944c03","resolution":{"observed_at":"2026-05-11T12:21:06.679791Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2605.04368","last_updated":"2026-05-06T00:10:17Z","snapshot_observed_at":"2026-07-06T23:17:09.246351Z","submitted_at":"2026-05-06T00:10:17Z","title":"Extending Differential Temporal Difference Methods for Episodic Problems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T18:19:57.472765Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2605.04368"},"observation_digest":"sha256:cfd1c23967a2aff8176631ae69b093f4b7685162da4de022d56784f59af0b33c","observation_id":"c8fcc11d-03cd-48e7-9a9a-65a8931db6ed","resolution":{"observed_at":"2026-05-09T06:35:38.858398Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2605.06764","last_updated":"2026-05-07T17:54:31Z","snapshot_observed_at":"2026-08-03T14:14:53.438531Z","submitted_at":"2026-05-07T17:54:31Z","title":"Revisiting Adam for Streaming Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-11T01:10:49.483014Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2605.06764"},"observation_digest":"sha256:e5857357353e68e85ac3acec352abdab2d3dd5b4a7d7be96c1a1299f4b7fd6f1","observation_id":"40f185c2-cde6-4f7c-b6f5-009fe319950c","resolution":{"observed_at":"2026-05-11T04:40:58.208525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2605.12379","last_updated":"2026-05-12T16:44:02Z","snapshot_observed_at":"2026-07-06T23:24:03.984179Z","submitted_at":"2026-05-12T16:44:02Z","title":"Discrete Flow Matching for Offline-to-Online Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-13T05:48:40.468890Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2605.12379"},"observation_digest":"sha256:5baf01969f0fa7da138fd56255eb386329b50b1740b62fc952ec56cbab1534b3","observation_id":"b5405a6d-775e-45da-8970-2d2897b6e8da","resolution":{"observed_at":"2026-05-13T05:52:22.624571Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2606.06096","last_updated":"2026-06-04T12:34:15Z","snapshot_observed_at":"2026-07-06T23:46:01.165261Z","submitted_at":"2026-06-04T12:34:15Z","title":"OrderGrad: Optimizing Beyond the Mean with Order-Statistic Policy Gradient Estimation","version":1},"reference_index":107,"source":"pdf_text","source_observed_at":"2026-06-28T02:17:30.974692Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2606.06096"},"observation_digest":"sha256:2d38abd652332a9552197832d07818e9c7a84b24e138f163423302b8963daaa9","observation_id":"fb053806-a33c-47bb-beab-c950073b87cb","resolution":{"observed_at":"2026-07-02T12:16:57.040883Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2606.09762","last_updated":"2026-06-08T17:24:15Z","snapshot_observed_at":"2026-08-03T05:45:12.614998Z","submitted_at":"2026-06-08T17:24:15Z","title":"Preserving Plasticity in Continual Learning via Dynamical Isometry","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T17:26:20.769515Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2606.09762"},"observation_digest":"sha256:e5a6cbff27add057637b4019af85a394fb2bcd3c6dbc54fffff21e705cc36b84","observation_id":"5e616642-1be8-46f7-ac8a-6a398df0787d","resolution":{"observed_at":"2026-07-03T00:07:28.501091Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2606.21891","last_updated":"2026-06-20T05:47:37Z","snapshot_observed_at":"2026-08-02T17:30:04.265015Z","submitted_at":"2026-06-20T05:47:37Z","title":"Learning the ARTS of Search for Automated Discovery","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-26T12:04:13.117307Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2606.21891"},"observation_digest":"sha256:1c28f852c407a6a8eaa16b05c0576e807fb6a4c681c4e9ce8481c32ff872a93c","observation_id":"83a77ba6-2bd8-42d8-9f44-3f48855ce044","resolution":{"observed_at":"2026-07-04T08:09:41.769209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2606.25198","last_updated":"2026-07-01T17:23:10Z","snapshot_observed_at":"2026-08-02T21:34:55.759064Z","submitted_at":"2026-06-23T21:44:08Z","title":"Heuresis: Search Strategies for Autonomous AI Research Agents Across Quality, Diversity and Novelty","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-25T22:42:05.112858Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2606.25198"},"observation_digest":"sha256:340fdde2205d25dbb60bde630beaca694efc9dea4506b17320754e0f0e162ccb","observation_id":"00e35e0e-3e44-48d6-8502-86f8459397d7","resolution":{"observed_at":"2026-07-04T18:40:02.664185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2606.25198","last_updated":"2026-07-01T17:23:10Z","snapshot_observed_at":"2026-08-02T21:34:55.759064Z","submitted_at":"2026-06-23T21:44:08Z","title":"Heuresis: Search Strategies for Autonomous AI Research Agents Across Quality, Diversity and Novelty","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:35.240433Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2606.25198"},"observation_digest":"sha256:0a7c8bc340372bc79221b0b0d7e8566273fa7ba9abeeac26f3a08338ee18cb77","observation_id":"916e2a4b-4c82-4d38-9077-0452b1bf43de","resolution":{"observed_at":"2026-07-02T21:17:23.792386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2606.28433","last_updated":"2026-06-26T03:19:27Z","snapshot_observed_at":"2026-08-02T05:01:56.168457Z","submitted_at":"2026-06-26T03:19:27Z","title":"Position: RL Researchers Need to Distinguish Between Solving Simulators and Using Simulators as a Proxy","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T01:28:44.074862Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2606.28433"},"observation_digest":"sha256:45497deb5000fc4ea553699e719c323c35e18e33672cec182904e2ac4cbb0f78","observation_id":"c81a9206-8b9f-4fdd-b341-ba47ea3ea026","resolution":{"observed_at":"2026-07-01T15:25:48.462270Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":"1903.03176","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-09T21:36:34.225692Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","venue":"cs.LG","work_id":"b0356c0a-a542-4219-8643-47b4320a50ff","year":2019},"citing_paper":{"arxiv_id":"2607.07029","last_updated":"2026-07-08T06:00:40Z","snapshot_observed_at":"2026-08-02T06:00:55.810587Z","submitted_at":"2026-07-08T06:00:40Z","title":"Gimitest: A Comprehensive Tool for Testing Reinforcement Learning Policies","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2607.07029"},"observation_digest":"sha256:a3282a254ac5deabc425730d9a4a8cc06b442f4ebcbd2d0c8eacc8a7a3dd4cea","observation_id":"8bf67191-4491-4e86-bf54-e32852da6ae5","resolution":{"observed_at":"2026-07-09T21:36:34.228213Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.03176","snapshot_observed_at":"2026-07-14T04:26:46.686445Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.11607","last_updated":"2026-07-13T14:30:01Z","snapshot_observed_at":"2026-07-31T21:58:55.462761Z","submitted_at":"2026-07-13T14:30:01Z","title":"Auditing the Risk Claims of Distributional Reinforcement Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-07-14T04:26:46.686445Z"},"links":{"cited_paper":"/paper/1903.03176","citing_paper":"/paper/2607.11607"},"observation_digest":"sha256:851af73c3e01190c8f164badc69f3a52e429b3e7ac52f8de28c19f756d2e54f9","observation_id":"f4c43d8d-61d7-4da8-acf0-13d5560d9f91","resolution":{"observed_at":"2026-07-14T04:26:46.686445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1903.03176/citation-record","integrity":"/paper/1903.03176/integrity","json":"/paper/1903.03176/citation-record.json","paper":"/paper/1903.03176"},"outbound":[],"paper":{"arxiv_id":"1903.03176","last_updated":"2019-06-07T00:36:50Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T07:37:51.655095Z","submitted_at":"2019-03-07T20:34:36Z","title":"MinAtar: An Atari-Inspired Testbed for Thorough and Reproducible Reinforcement Learning Experiments"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:1903.03176."}