{"as_of":"2026-08-09T18:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07f96d45a617df2995426c5f89979b417cca7c8f8b73726a15741eb4895f028f","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:59:14.592755Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-09T14:21:34.002785Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T17:01:05.767124Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"cited_work":{"arxiv_id":"2505.20659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20659","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"T., Rutherford, A., Goldie, A","venue":null,"work_id":"78235faa-cc10-4053-864b-f06815481c97","year":null},"citing_paper":{"arxiv_id":"2605.01358","last_updated":"2026-05-02T10:07:59Z","snapshot_observed_at":"2026-07-06T23:14:38.379875Z","submitted_at":"2026-05-02T10:07:59Z","title":"PACE: Parameter Change for Unsupervised Environment Design","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-09T14:21:34.002785Z"},"links":{"cited_paper":"/paper/2505.20659","citing_paper":"/paper/2605.01358"},"observation_digest":"sha256:e1e4475ec9f6081664a32e13c5c401b242bc43913631cef0ab48bdc7a7d70c3f","observation_id":"403859c4-df78-4cf1-80df-81596663fb5e","resolution":{"observed_at":"2026-05-11T17:01:05.778697Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20659/citation-record","integrity":"/paper/2505.20659/integrity","json":"/paper/2505.20659/citation-record.json","paper":"/paper/2505.20659"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.600777Z","title":"Deep reinforcement learning at the edge of the statistical precipice","venue":null,"work_id":"4af50c9f-3931-41d5-bf05-19be92c64b73","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.413701Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:ff11ea79c677f108fee4ae4939f5ccd272a690bf76bd20dc69070f24bc007419","observation_id":"45ca37ad-4d64-478d-b350-43edcb5d8613","resolution":{"observed_at":"2026-08-07T13:59:19.705091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.462204Z","title":"Clutr: curriculum learning via unsupervised task representation learning","venue":null,"work_id":"441a881b-c917-46bc-90b9-40ba6f1b56ce","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.491830Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:5ad8537441bbb70452bc8b2547259cd9d7c045d693a3ed5ff6806a69cf7e1fcf","observation_id":"ada294b3-89b2-47d5-9b4f-070da3fe9c1a","resolution":{"observed_at":"2026-08-07T13:59:19.546959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.299881Z","title":"Refining minimax regret for unsupervised environment design","venue":null,"work_id":"680686b6-761a-4cc2-866f-5404780b9a1a","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.573843Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:edb29d29ff5b7e7a2629574ae4ae48f831c3375d3c8c3a1c2438318e0540192a","observation_id":"0cd35d5d-94f9-4ca2-b00e-5b4f1bbc28d6","resolution":{"observed_at":"2026-08-07T13:59:19.421742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:10.649739Z","title":"JAX : composable transformations of P ython+ N um P y programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.649739Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:3f7e923e19a5aea234380e0a1840410dd11730c4eea6f82d8af43cedc771909a","observation_id":"f8cf8398-e8db-4a6a-a36a-1f2068138495","resolution":{"observed_at":"2026-08-07T13:59:10.649739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:19.146701Z","title":"Accelerated algorithms for constrained nonconvex-nonconcave min-max optimization and comonotone inclusion","venue":null,"work_id":"be68286b-ea8c-4b49-883f-7994d6ad67cf","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.751724Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:40e56b5b0d400a27fd7b638b7ef1c08215c6ef746c650be89759dfb5c8b62960","observation_id":"986bd1ea-e823-4651-938b-31815d897e4d","resolution":{"observed_at":"2026-08-07T13:59:19.215057Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.962935Z","title":"Minigrid &amp; miniworld: Modular &amp; customizable reinforcement learning environments for goal-oriented tasks","venue":null,"work_id":"71ae6f5a-af90-4ea2-ad2e-58d161cf672d","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.814763Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:02384a7919e2c75f90acec35b0cb76df3563904e591e38d93b1896b43bc841f0","observation_id":"7734ced4-d71b-46e5-8d30-12d7179bbbb6","resolution":{"observed_at":"2026-08-07T13:59:19.001873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.816474Z","title":"Adversarial environment design via regret-guided diffusion models","venue":null,"work_id":"0c405506-7d6e-489a-9d4f-03fd038475dc","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:10.899420Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:daa6fc42f056d5996b688ac6e35d1d5baffd431d3ebd6bf1117c6c9752c2d8fb","observation_id":"69b594fd-67e8-4c20-9c97-21e320e62cb7","resolution":{"observed_at":"2026-08-07T13:59:18.870568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13091","last_updated":"2024-03-19T18:40:50Z","snapshot_observed_at":"2026-07-06T17:47:18.214963Z","submitted_at":"2024-03-19T18:40:50Z","title":"JaxUED: A simple and useable UED library in Jax","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13091","snapshot_observed_at":"2026-08-07T13:59:11.000212Z","title":"Jaxued: A simple and useable ued library in jax, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.000212Z"},"links":{"cited_paper":"/paper/2403.13091","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:93cdb9151c9d76c5031d0f1f1eb4ba8562187eb6d2e90f4951fa8d7be84a1505","observation_id":"c29b49b6-08d9-4c8c-b2ec-db2998b0e4f5","resolution":{"observed_at":"2026-08-07T13:59:11.000212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:11.128688Z","title":"Last-iterate convergence: Zero-sum games and constrained min-max optimization, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.128688Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:20e5fddee250b221a21edb6704aa96a101b0b1e328273a8f6ccbb70d675a418a","observation_id":"944f8ce6-0429-4135-98dd-126f720c94a2","resolution":{"observed_at":"2026-08-07T13:59:11.128688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.706540Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design","venue":null,"work_id":"dc4cd217-de41-42d0-9111-3e70193937c9","year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.214362Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:a02e3258387643960358fbc821d81058003516ac2106f82b1d1d328ff50cef99","observation_id":"9fda1768-f0a8-43b4-8653-e35690083741","resolution":{"observed_at":"2026-08-07T13:59:18.752437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.555565Z","title":"Lucas, and Stefano V","venue":null,"work_id":"795b05b2-fafb-4ae2-b437-bce2fbf974b7","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.324172Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:28f6bcffca80666b3fc79cf2492db38138f2d5dae39d5c8e573cc2653f405572","observation_id":"5c41e082-7c63-4c14-b160-ebe0f672ed9c","resolution":{"observed_at":"2026-08-07T13:59:18.623243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.407995Z","title":"Mirror learning: A unifying framework of policy optimisation","venue":null,"work_id":"573d4ff9-c877-4254-babd-a779d541a493","year":2022},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.429144Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:dad453d5fccae80821a70475b611c643c8d8833d735aabdc9fb28d998232a249","observation_id":"c6b2672d-dce6-4994-9582-096f264228e0","resolution":{"observed_at":"2026-08-07T13:59:18.506970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:11.517105Z","title":"A two-timescale stochastic algorithm framework for bilevel optimization: Complexity analysis and application to actor-critic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.517105Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:7b89f628cdfa540e5a65a69f39c0e13f713284449b5b2a901de40248b1cb605b","observation_id":"51a42f59-85a3-4c36-97e9-7cd76d272abc","resolution":{"observed_at":"2026-08-07T13:59:11.517105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.261954Z","title":"Replay-guided adversarial environment design","venue":null,"work_id":"58ee943a-d994-404b-96d9-244e278fedc0","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.622907Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:ff5c86f9d12ddee4405d24dd178aa8cbb68108d188c00396e303b83cf16491f7","observation_id":"d948ca9a-e2ed-421d-abbf-ce71266722d3","resolution":{"observed_at":"2026-08-07T13:59:18.336846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:18.035952Z","title":"Prioritized level replay","venue":null,"work_id":"041eee7b-de71-4a4f-a6e0-992c09869dcf","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.724621Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:ddbbb37daa6cea7bb7a6e2206a9c79c26938ea594b6465464fff0c6470474484","observation_id":"2e041ef6-932d-4fb3-aba4-2147f2babde1","resolution":{"observed_at":"2026-08-07T13:59:18.130563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.823611Z","title":"u ttler, Edward Grefenstette, Tim Rockt\\","venue":null,"work_id":"f17ebe67-dcfc-4265-ba8c-f6cda6ae64fb","year":2022},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.831003Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:b347c9c73894e615ed36593db006466e5b112a16bb9d4e523339598acf08e7f4","observation_id":"d15ce4fa-db3d-49a0-a718-834ea5440add","resolution":{"observed_at":"2026-08-07T13:59:17.925056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.603225Z","title":null,"venue":null,"work_id":"8c0f6690-c83e-4cfe-8f23-e8894a639249","year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:11.922187Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:69fe5f15ae0b9ed26e0b1692e9379ae53fcbfdb373315fbbc696cd0d85fa0ba5","observation_id":"92c27f9c-b253-4fd8-8571-b5e342984f7c","resolution":{"observed_at":"2026-08-07T13:59:17.718011Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.364196Z","title":"Learning equilibria in adversarial team markov games: A nonconvex-hidden-concave min-max optimization problem","venue":null,"work_id":"7488af14-d4e5-40c5-bffb-1029a02c7b09","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.010761Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:f94cba74011e9a04e5b9fb50e279b3d4267f81f44e104d6702fe699ad7151d26","observation_id":"d27827ae-fc16-486a-a107-775f5a4c34ca","resolution":{"observed_at":"2026-08-07T13:59:17.478131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T13:59:12.133909Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.133909Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:d4e29821cdab7eb597289a34d2a9ab76ac9938628a1fb2f146c8301852461b48","observation_id":"f16aeca1-a981-4b65-b472-4dcc732060dc","resolution":{"observed_at":"2026-08-07T13:59:12.133909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:17.180392Z","title":"Last iterate convergence in no-regret learning: constrained min-max optimization for convex-concave landscapes","venue":null,"work_id":"8860e495-a27c-4af5-a844-68f7d5aa490c","year":2021},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.233330Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:250806e303887f285784b960322bf8e34bfd412cec55e33ca77282332004f24e","observation_id":"9a288aa5-d2e6-4cad-9d1d-6aba6953f1e1","resolution":{"observed_at":"2026-08-07T13:59:17.259025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00301","last_updated":"2024-02-15T07:12:14Z","snapshot_observed_at":"2026-07-06T16:25:54.621792Z","submitted_at":"2023-09-30T08:21:32Z","title":"Enhancing the Hierarchical Environment Design via Generative Trajectory Modeling","version":2},"cited_work":{"arxiv_id":"2310.00301","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.00301","snapshot_observed_at":"2026-08-07T13:59:15.071520Z","title":"Enhancing the Hierarchical Environment Design via Generative Trajectory Modeling","venue":"cs.LG","work_id":"af55dba8-df36-48bd-8077-74fd6e801a32","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.378628Z"},"links":{"cited_paper":"/paper/2310.00301","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:a4a6aac2eb04256b798c88ad5733e98193ab79ddb8565cbd082acb84021368c4","observation_id":"ae1812bc-2a81-46ee-878a-c0d69fca5952","resolution":{"observed_at":"2026-08-07T13:59:15.104332Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.983012Z","title":"Tiada: A time-scale adaptive algorithm for nonconvex minimax optimization","venue":null,"work_id":"1d2a10be-ffd7-4f4c-ac5e-9e254ea7e3df","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.463315Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:2fad470d1a77d4b9aaed5c2ec35baa41073199254822c9b1fc4e83821bd16b25","observation_id":"129197d0-3282-4dce-a945-3e419beb864b","resolution":{"observed_at":"2026-08-07T13:59:17.070894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.837203Z","title":"On gradient descent ascent for nonconvex-concave minimax problems","venue":null,"work_id":"6706cde5-02e5-4f18-851d-0da319dcafc7","year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.572294Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:a9a07bdf800f6824d421a9e413ba1c7015c671e7694d7d33f2d4c121e171132a","observation_id":"f0b11906-d612-46ff-960d-ce38d447c9d0","resolution":{"observed_at":"2026-08-07T13:59:16.918490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.685566Z","title":"Craftax: A lightning-fast benchmark for open-ended reinforcement learning","venue":null,"work_id":"eba91d50-fe14-4836-9d20-aabe966a84c7","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.644949Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:c3619d58428094d64983c2f5eebc20d90ed5d41ab95afd6b70a021238a1070aa","observation_id":"cc0f33ef-84da-45c4-9a50-d6f8762473bc","resolution":{"observed_at":"2026-08-07T13:59:16.732021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.581879Z","title":"Kinetix: Investigating the training of general agents through open-ended physics-based control tasks","venue":null,"work_id":"381c9fae-0815-47a1-b98c-127117923f90","year":2025},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.752204Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:d0d16f91df63e17125fa8aeeef61e1ff9dd7777dd7ac2da6de6f82629469376e","observation_id":"70cb860c-feca-41ff-820f-a284257be5b9","resolution":{"observed_at":"2026-08-07T13:59:16.626931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.438711Z","title":"Optimistic mirror descent in saddle-point problems: Going the extra(-gradient) mile","venue":null,"work_id":"9e9e20ae-c032-42cc-a446-b245f8fa1336","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.854877Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:8042e9db2b66459ffbfb9f37420267b5b5c6edf18ee36b92001f5eea839d6e91","observation_id":"66de8767-e7ae-4c2d-8a51-5e66d11f0a1a","resolution":{"observed_at":"2026-08-07T13:59:16.494263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.311306Z","title":"Stable recurrent models","venue":null,"work_id":"eaf966ec-85b6-42a6-8020-d068fcaaa341","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:12.990050Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:7f2e853b731367d9bb84ea4f618db171893b42d6d8259fee54d510c07ed5764a","observation_id":"5e02fc73-c8e4-49e1-9a07-b54e5a9f27c9","resolution":{"observed_at":"2026-08-07T13:59:16.372486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.164362Z","title":"Robust reinforcement learning","venue":null,"work_id":"592a29b7-00eb-4f0d-9ae1-12fdb58235f6","year":2000},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.093375Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:a4ef2593bed28276477b2a94392a5aee342f3cebc5c219fea968f33e2ea681d5","observation_id":"ed87f572-e213-491f-8bed-5f4f9e76b884","resolution":{"observed_at":"2026-08-07T13:59:16.237568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:16.049686Z","title":null,"venue":null,"work_id":"1f67c8b3-3007-4c2b-adf3-0376ae922340","year":1951},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.224898Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:d058c9a1cd88ce6604a8b61254d3a73c6dc4bce888b83060a2330660d0a05d73","observation_id":"f2683a6a-ecf0-4633-972b-a007f7d9e3f7","resolution":{"observed_at":"2026-08-07T13:59:16.114373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:13.352186Z","title":"XL and-minigrid: Scalable meta-reinforcement learning environments in JAX","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.352186Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:f26fb0b436bf28b82be979f5c9a4f112d442a69286161338ea74a94263e2f45b","observation_id":"0695a52a-79a8-4f20-855b-4449848915e1","resolution":{"observed_at":"2026-08-07T13:59:13.352186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.906756Z","title":"Solving a class of non-convex min-max games using iterative first order methods","venue":null,"work_id":"52c73026-6144-4907-9d1e-b2ea0482153f","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.450648Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:321ec793f2e5458778605c956a3d3ee41d8dab042cde5563b1ef2e35d44e3a66","observation_id":"6a374c7d-daa1-4782-b1ec-6927331f77f5","resolution":{"observed_at":"2026-08-07T13:59:15.957737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01302","last_updated":"2023-09-30T18:36:42Z","snapshot_observed_at":"2026-07-06T12:43:24.521815Z","submitted_at":"2022-03-02T18:40:00Z","title":"Evolving Curricula with Regret-Based Environment Design","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.01302","snapshot_observed_at":"2026-08-07T13:59:13.547382Z","title":"Evolving curricula with regret-based environment design, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.547382Z"},"links":{"cited_paper":"/paper/2203.01302","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:aa9eb467a1b97b9009623117711343d64787bd2b3087c59b4e7a6e0488a4a561","observation_id":"0aaa8f87-43d4-449f-96c1-75f18f280b62","resolution":{"observed_at":"2026-08-07T13:59:13.547382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v33i01.33014739","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:14.706062Z","title":"Robust optimization over multiple domains","venue":null,"work_id":"d1ed99cd-5a4e-4f8c-93f5-97ea918f4df8","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.643777Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:7d5980d1209584aec5b7c6bfea1b4ffb1e7855f2f8d81af65d7b789e9aa48581","observation_id":"8167e1a4-a411-4579-8cd3-2046172a8ce5","resolution":{"observed_at":"2026-08-07T13:59:14.766577Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.784775Z","title":"No regrets: Investigating and improving regret approximations for curriculum discovery","venue":null,"work_id":"71fd9066-9e79-4966-8ee9-a87fe5727612","year":2024},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.739015Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:0b264e21b9944c818c8e0a43a37c34e2cb514178d74d038f7254f7619a4efcb2","observation_id":"d5a5d92c-dfd3-4037-a06c-ddcb3e253e99","resolution":{"observed_at":"2026-08-07T13:59:15.839939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:59:13.887358Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.887358Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:d056d055744b6c756f1c95b2beb3ccf34067c60b4e5259a0c1317060fc12cbbb","observation_id":"63983b9c-3285-4557-869d-4ade299788cf","resolution":{"observed_at":"2026-08-07T13:59:13.887358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.678251Z","title":"Hessian aided policy gradient","venue":null,"work_id":"7e05fd9e-71e5-49ae-962e-50245bb49db2","year":2019},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:13.973152Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:635cbe27dd5b618793e422a170d1ee22c97979ebcb8f2c4da4b1994047c27f2f","observation_id":"d39efadf-3ba4-4e3b-b733-65fad7461315","resolution":{"observed_at":"2026-08-07T13:59:15.717329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:14.059351Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.059351Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:3948aa8e4f2208760c6f2e5c805656861af43dc39c2d56e9ba0a389a0b28ae34","observation_id":"3075b3c5-cab8-480a-8875-0fc3b7e313cb","resolution":{"observed_at":"2026-08-07T13:59:14.059351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.522625Z","title":"P roximal C urriculum for R einforcement L earning A gents","venue":null,"work_id":"889ad8e6-64d7-4dc6-b711-af1af713f952","year":2023},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.155579Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:b90174260b0120e940c6e33e953b4db52df695be27be67932ade654fddce26a1","observation_id":"581c788d-a6a1-4de2-8341-95af4d932f51","resolution":{"observed_at":"2026-08-07T13:59:15.595700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:15.419361Z","title":"Lipschitz regularity of deep neural networks: analysis and efficient estimation","venue":null,"work_id":"a77db14c-4b32-4cea-8c1f-2dd338009197","year":2018},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.299763Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:fc18c3f347b3a0b71c87076150a22714e51dc6942b96ce2cbc528aa78ff4bb7d","observation_id":"85d3e82b-1fa0-4282-a736-f1286aceaa78","resolution":{"observed_at":"2026-08-07T13:59:15.458707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.00927","last_updated":"2020-03-24T20:16:02Z","snapshot_observed_at":"2026-08-04T18:37:52.241290Z","submitted_at":"2019-09-30T00:27:08Z","title":"Stabilizing Generative Adversarial Networks: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.00927","snapshot_observed_at":"2026-08-07T13:59:14.404004Z","title":"Albrecht, and Andrew Nystrom","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.404004Z"},"links":{"cited_paper":"/paper/1910.00927","citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:d9e8187e9f454e1886439a77829916ab5609cd13306b248ab8f8ec5f682e258b","observation_id":"7bf159ea-5053-4b73-86c9-d215858e5636","resolution":{"observed_at":"2026-08-07T13:59:14.404004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:14.514957Z","title":"Williams","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.514957Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:a0f9f2b186c9f3c58b6d2067a85b1b8534a737c765065a21d6ac99e0ec5b1688","observation_id":"c8e08809-0025-43f7-90cb-dab3fb946529","resolution":{"observed_at":"2026-08-07T13:59:14.514957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:59:14.592755Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:59:14.592755Z"},"links":{"citing_paper":"/paper/2505.20659"},"observation_digest":"sha256:238722d0edddce2fdc523aec91ccd35f023fe97405c646b298c9eacc66e0b84c","observation_id":"55eebba2-f222-4ffd-a331-6b6d473f3c27","resolution":{"observed_at":"2026-08-07T13:59:14.592755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20659","last_updated":"2025-07-09T09:50:34Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T08:08:08.099151Z","submitted_at":"2025-05-27T03:07:26Z","title":"An Optimisation Framework for Unsupervised Environment Design"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":26},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2505.20659."}