{"as_of":"2026-08-06T03:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2a7fc32c6088240df2ba8f9840da2754341958d2a7beebd68cdd9e74c992021","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T12:54:39.273506Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":"2306.09884","doi":"10.48550/arxiv.2306.09884","metadata_source":"pith","pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jumanji: A","venue":"cs.LG","work_id":"64834bf5-ebb6-4b6f-9300-49f2ada83fbf","year":2023},"citing_paper":{"arxiv_id":"2309.16797","last_updated":"2023-09-28T19:01:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T19:01:07Z","title":"Promptbreeder: Self-Referential Self-Improvement Via Prompt Evolution","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-16T08:12:30.984870Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2309.16797"},"observation_digest":"sha256:e3bfa2730e79c8b45704a09fca6622f6da6fd39a5da5b7e1ece2ccb9b0c8f009","observation_id":"9099ace3-0b92-4b5a-88e7-8cdc8116c452","resolution":{"observed_at":"2026-05-16T08:12:31.315387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":"2306.09884","doi":"10.48550/arxiv.2306.09884","metadata_source":"pith","pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jumanji: A","venue":"cs.LG","work_id":"64834bf5-ebb6-4b6f-9300-49f2ada83fbf","year":2023},"citing_paper":{"arxiv_id":"2407.17032","last_updated":"2025-11-02T13:42:19Z","snapshot_observed_at":"2026-07-06T18:51:06.750136Z","submitted_at":"2024-07-24T06:35:05Z","title":"Gymnasium: A Standard Interface for Reinforcement Learning Environments","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T17:29:49.186565Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2407.17032"},"observation_digest":"sha256:5ad08dce93600b2890138da87a41586fadc60f9b3a8765f37a44132f10ff795d","observation_id":"c2b8b9d1-3d81-43d4-8c9f-0bc4ced60bf3","resolution":{"observed_at":"2026-05-11T17:29:49.581158Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-04T12:54:39.273506Z","title":"Jumanji: a diverse suite of scalable reinforcement learning environments in jax.arXiv preprint arXiv:2306.09884,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.01764","last_updated":"2026-07-06T14:44:27Z","snapshot_observed_at":"2026-08-04T12:54:37.929563Z","submitted_at":"2025-10-02T07:56:47Z","title":"Octax: Accelerated CHIP-8 Arcade Environments for Reinforcement Learning in JAX","version":3},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-04T12:54:39.273506Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2510.01764"},"observation_digest":"sha256:1b5224904a6ae239360089e1cf237a83cf0c39aae7da0b2e5162ce9c712403c5","observation_id":"4f501582-ae8c-409c-abc9-2efc2ca501d9","resolution":{"observed_at":"2026-08-04T12:54:39.273506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-02T18:45:20.286849Z","title":"Midgley, Elshadai Tegegn, Tristan Kalloniatis, Omayma Mahjoub, Matthew Macfarlane, Andries P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.06009","last_updated":"2026-07-18T00:55:49Z","snapshot_observed_at":"2026-08-03T15:50:59.564009Z","submitted_at":"2026-03-06T08:07:08Z","title":"Preventing Learning Stagnation in PPO by Scaling to 1 Million Parallel Environments","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T18:45:20.286849Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2603.06009"},"observation_digest":"sha256:34e8f68b1c904708e3769ab6a7cfe03eb71bf3b74b0af7b4f4a452d7a4fe92fe","observation_id":"5888563a-2747-4fc3-b190-2c4515fb867d","resolution":{"observed_at":"2026-08-02T18:45:20.286849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":"2306.09884","doi":"10.48550/arxiv.2306.09884","metadata_source":"pith","pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jumanji: A","venue":"cs.LG","work_id":"64834bf5-ebb6-4b6f-9300-49f2ada83fbf","year":2023},"citing_paper":{"arxiv_id":"2605.13554","last_updated":"2026-05-13T13:58:49Z","snapshot_observed_at":"2026-08-01T19:52:28.213526Z","submitted_at":"2026-05-13T13:58:49Z","title":"Self-Supervised On-Policy Reinforcement Learning via Contrastive Proximal Policy Optimisation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-14T20:12:07.920183Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2605.13554"},"observation_digest":"sha256:0e7eb564b4f1980d103e34605c407f8891133078b844346345803eccc7817135","observation_id":"5055a177-3d43-467d-a838-dad7540087ec","resolution":{"observed_at":"2026-05-14T20:12:55.256675Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":"2306.09884","doi":"10.48550/arxiv.2306.09884","metadata_source":"pith","pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jumanji: A","venue":"cs.LG","work_id":"64834bf5-ebb6-4b6f-9300-49f2ada83fbf","year":2023},"citing_paper":{"arxiv_id":"2606.26463","last_updated":"2026-06-27T05:05:34Z","snapshot_observed_at":"2026-08-03T01:41:10.487866Z","submitted_at":"2026-06-24T23:55:15Z","title":"Finding the Time to Think: Learning Planning Budgets in Real-Time RL","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T05:08:19.504454Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2606.26463"},"observation_digest":"sha256:fe541f5ef20f019802c4432bd9d9828428db7ab9c0ec834104da765380878ab4","observation_id":"f54aa429-faff-4f7e-8b84-7923555950ee","resolution":{"observed_at":"2026-07-04T13:29:51.943255Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":"2306.09884","doi":"10.48550/arxiv.2306.09884","metadata_source":"pith","pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jumanji: A","venue":"cs.LG","work_id":"64834bf5-ebb6-4b6f-9300-49f2ada83fbf","year":2023},"citing_paper":{"arxiv_id":"2606.26463","last_updated":"2026-06-27T05:05:34Z","snapshot_observed_at":"2026-08-03T01:41:10.487866Z","submitted_at":"2026-06-24T23:55:15Z","title":"Finding the Time to Think: Learning Planning Budgets in Real-Time RL","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T09:26:31.944405Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2606.26463"},"observation_digest":"sha256:09f2dc42eddf3c0b97c907a9e0acaf78445aef2a7ab2ba93d9217d6014620598","observation_id":"c26d9e7c-5aa4-4022-b140-395749ef39fb","resolution":{"observed_at":"2026-06-30T09:34:34.919692Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":"2306.09884","doi":"10.48550/arxiv.2306.09884","metadata_source":"pith","pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jumanji: A","venue":"cs.LG","work_id":"64834bf5-ebb6-4b6f-9300-49f2ada83fbf","year":2023},"citing_paper":{"arxiv_id":"2606.28433","last_updated":"2026-06-26T03:19:27Z","snapshot_observed_at":"2026-08-02T05:01:56.168457Z","submitted_at":"2026-06-26T03:19:27Z","title":"Position: RL Researchers Need to Distinguish Between Solving Simulators and Using Simulators as a Proxy","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T01:28:44.074862Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2606.28433"},"observation_digest":"sha256:b9f133f508df6db18cb9e1f6541e3f9418921a6659a692a839f7fa3e09349155","observation_id":"7c1fb0cb-613b-40d1-9b18-05945d554523","resolution":{"observed_at":"2026-07-01T15:25:48.447624Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX","version":2},"cited_work":{"arxiv_id":"2306.09884","doi":"10.48550/arxiv.2306.09884","metadata_source":"pith","pith_arxiv_id":"2306.09884","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jumanji: A","venue":"cs.LG","work_id":"64834bf5-ebb6-4b6f-9300-49f2ada83fbf","year":2023},"citing_paper":{"arxiv_id":"2607.05915","last_updated":"2026-08-03T09:30:57Z","snapshot_observed_at":"2026-08-06T03:19:48.386362Z","submitted_at":"2026-07-07T07:09:46Z","title":"PCBWorld: A Benchmark Environment for Engine-Grounded PCB Design Automation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-08T21:09:25.719945Z"},"links":{"cited_paper":"/paper/2306.09884","citing_paper":"/paper/2607.05915"},"observation_digest":"sha256:c76828ff9373556daf221839c1512e93c0bf8acd5e9dbedc1336937cf8d4efde","observation_id":"9de7e73d-3082-4698-90f8-6dd10cb56ec4","resolution":{"observed_at":"2026-07-08T21:15:39.082889Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2306.09884/citation-record","integrity":"/paper/2306.09884/integrity","json":"/paper/2306.09884/citation-record.json","paper":"/paper/2306.09884"},"outbound":[],"paper":{"arxiv_id":"2306.09884","last_updated":"2024-03-16T00:02:49Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T14:52:24Z","title":"Jumanji: a Diverse Suite of Scalable Reinforcement Learning Environments in JAX"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2306.09884."}