{"as_of":"2026-08-07T04:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f8066fcddc0e041cabaca0b89f21eeb07ea46939dbdf5c9b24b934d207fc9f2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:39:02.562616Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T00:07:28.185044Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T07:44:14.707183Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/1801.00690"},"observation_digest":"sha256:a413e501c0e052a3dd480218b94dda16f42fedf13a0e8a378b3b6262156ecbf5","observation_id":"b009f6a1-d086-47c7-9cb7-80f05702153e","resolution":{"observed_at":"2026-05-13T07:44:14.763418Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"1907.02057","last_updated":"2019-07-03T17:53:02Z","snapshot_observed_at":"2026-07-06T08:04:56.737336Z","submitted_at":"2019-07-03T17:53:02Z","title":"Benchmarking Model-Based Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-25T10:12:49.348162Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/1907.02057"},"observation_digest":"sha256:22591770f99a3935c58aa8c0b846c27e021f5fee597ee574c0783931c20570a8","observation_id":"eaff66d4-1eeb-4170-9459-d4939a30ef50","resolution":{"observed_at":"2026-05-25T10:15:37.036256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-08-04T15:07:29.209129Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-05-17T01:59:51.326493Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2310.11324"},"observation_digest":"sha256:4061fa381126f291572f299f8fedf6482c6e59c112ed4e15c54280a5911dce37","observation_id":"62ee2e47-b803-4397-ae12-dfa2aa8d5498","resolution":{"observed_at":"2026-05-17T01:59:51.418148Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-08-06T04:39:02.562616Z","title":"Reproducibility of benchmarked deep reinforcement learning tasks for continuous control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03194","last_updated":"2025-08-05T08:03:12Z","snapshot_observed_at":"2026-08-06T11:32:36.516059Z","submitted_at":"2025-08-05T08:03:12Z","title":"Scaling DRL for Decision Making: A Survey on Data, Network, and Training Budget Strategies","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T04:39:02.562616Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2508.03194"},"observation_digest":"sha256:f2f487874f19ef722771968eaa66e15c858cca6e2398cd94cd2136858df27174","observation_id":"decb3e77-a2a3-4f19-9afd-b62762b65cb1","resolution":{"observed_at":"2026-08-06T04:39:02.562616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-08-05T19:31:39.916570Z","title":"Islam, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.14105","last_updated":"2025-08-17T16:18:07Z","snapshot_observed_at":"2026-08-06T11:32:23.866566Z","submitted_at":"2025-08-17T16:18:07Z","title":"Efficient Environment Design for Multi-Robot Navigation via Continuous Control","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T19:31:39.916570Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2508.14105"},"observation_digest":"sha256:3ff7b1b2ff0d45121c4918d9645c6e32399636b99cba42b5c91b0bddd964723c","observation_id":"93cd6373-7558-49e5-94a6-3954fae50f5f","resolution":{"observed_at":"2026-08-05T19:31:39.916570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"2605.21800","last_updated":"2026-05-20T22:58:15Z","snapshot_observed_at":"2026-07-06T23:32:10.472558Z","submitted_at":"2026-05-20T22:58:15Z","title":"stable-worldmodel: A Platform for Reproducible World Modeling Research and Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T08:57:19.834179Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2605.21800"},"observation_digest":"sha256:b32058110b56a7747a25f30ae68ddbc68a5fc6a200137de498b01dc6b9e3c491","observation_id":"733260a8-cbdf-487b-b972-06a6fb780a87","resolution":{"observed_at":"2026-05-22T09:01:20.374479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"2605.26418","last_updated":"2026-06-10T16:29:02Z","snapshot_observed_at":"2026-07-06T23:36:15.452866Z","submitted_at":"2026-05-26T01:07:42Z","title":"When Does Deep RL Beat Calibrated Baselines? A Benchmark Study on Adaptive Resource Control","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T19:09:13.403710Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2605.26418"},"observation_digest":"sha256:f5e0d7cad08295bcdbb7069c9fff519376d0406ba00d26b8598e584183602638","observation_id":"1a042838-9f5b-4d63-8937-51154da289a4","resolution":{"observed_at":"2026-06-29T19:13:52.615078Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"2605.28287","last_updated":"2026-05-27T10:35:28Z","snapshot_observed_at":"2026-07-06T23:37:54.660355Z","submitted_at":"2026-05-27T10:35:28Z","title":"AtomComposer: Discovering Chemical Space from First Principles with Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T14:32:02.974833Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2605.28287"},"observation_digest":"sha256:dfbc87d5e277d14d12af79f3f3b4363fb88e6fd8a34f64bb55de9cd66dbe1217","observation_id":"5d37cf92-4ae1-4d0d-9a97-ecef564493a1","resolution":{"observed_at":"2026-06-29T14:33:30.431054Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"2606.00135","last_updated":"2026-05-28T22:21:47Z","snapshot_observed_at":"2026-07-06T23:40:51.363776Z","submitted_at":"2026-05-28T22:21:47Z","title":"On Effectiveness and Efficiency of Agentic Tool-calling and RL Training","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-29T08:38:52.411671Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2606.00135"},"observation_digest":"sha256:1c41ff36827967cd4e0576f9e8fbf1419f30d7feb745df7f2774cce1dd2aed82","observation_id":"23b79dbb-17ba-4cc3-a50d-944d9465a31f","resolution":{"observed_at":"2026-06-29T08:43:15.355895Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":"1708.04133","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-03T00:07:28.185044Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","venue":"cs.LG","work_id":"79bc5b68-7f90-4779-aa0d-5e000bdf6421","year":2017},"citing_paper":{"arxiv_id":"2606.10129","last_updated":"2026-06-08T20:06:25Z","snapshot_observed_at":"2026-08-06T23:03:17.916457Z","submitted_at":"2026-06-08T20:06:25Z","title":"Discovering Interpretable Multi-Parameter Control Policies for Evolutionary Algorithms Using Deep Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T17:29:31.604234Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2606.10129"},"observation_digest":"sha256:16d5a42bee03ead4fd09e20357b4fb6e660f735a991c93217b32801c1e03cad4","observation_id":"8dc3032d-8c6e-4b4d-81bc-197d248b4e4c","resolution":{"observed_at":"2026-07-03T00:07:28.186262Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-07-31T00:13:47.126677Z","title":"arXiv:1708.04133 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26680","last_updated":"2026-07-29T09:31:28Z","snapshot_observed_at":"2026-08-06T14:35:51.039552Z","submitted_at":"2026-07-29T09:31:28Z","title":"Efficient Heteroscedastic Bayesian Optimization for Risk-Aware AutoRL","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T00:13:47.126677Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2607.26680"},"observation_digest":"sha256:d826b35dceda2e5b58f7907e6a30d8380b111b8fc867b6e82711a08e50c82f98","observation_id":"956976c8-679c-40ec-99d3-8f12c652ad6c","resolution":{"observed_at":"2026-07-31T00:13:47.126677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1708.04133/citation-record","integrity":"/paper/1708.04133/integrity","json":"/paper/1708.04133/citation-record.json","paper":"/paper/1708.04133"},"outbound":[],"paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-05T17:11:34.773264Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:1708.04133."}