{"as_of":"2026-08-17T08:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2dbd30facf6822dbd3db55aca2b7c58e1d664b9677af23bbc8e1a9c7550a908d","coverage":[{"denominator":100,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T06:07:19.785138Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.19139/citation-record","integrity":"/paper/2504.19139/integrity","json":"/paper/2504.19139/citation-record.json","paper":"/paper/2504.19139"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.454225Z","title":"Sharp-maml: Sharpness-aware model-agnostic meta learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.454225Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:68a38d2f094c4de49ccb6f16fd585c579be35afa24981030ab52cb9ae35f8b90","observation_id":"09e1139d-b60f-407b-8b04-691ecdb6c77c","resolution":{"observed_at":"2026-08-16T06:07:19.454225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1205.2664","last_updated":"2012-05-09T14:42:20Z","snapshot_observed_at":"2026-08-15T04:10:23.408004Z","submitted_at":"2012-05-09T14:42:20Z","title":"A Bayesian Sampling Approach to Exploration in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1205.2664","snapshot_observed_at":"2026-08-16T06:07:19.458774Z","title":"L., Nouri, A., and Wingate, D","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.458774Z"},"links":{"cited_paper":"/paper/1205.2664","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3cbbd92b7389606e40507134858b2433ba1aae437a75cc50865ad2a55cdba412","observation_id":"a7338292-d05e-4a24-9bbc-194edf99542e","resolution":{"observed_at":"2026-08-16T06:07:19.458774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.462707Z","title":"Finite-time analysis of the multiarmed bandit problem, 2002 a","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.462707Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:959bf645b8932a8930a9cf92040ad0424336e80fc2214b6525e63fe3d523fa06","observation_id":"f3958e16-e579-48bd-a001-efba37863483","resolution":{"observed_at":"2026-08-16T06:07:19.462707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.466308Z","title":"Using confidence bounds for exploitation-exploration trade-offs","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.466308Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:04d599a495a27202c8456ea0c9cccbbf4f2ca7eeea1ec41ce4afd876636d8d3f","observation_id":"a9393637-ad10-475d-b595-a2952282abb0","resolution":{"observed_at":"2026-08-16T06:07:19.466308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.08028","last_updated":"2025-05-29T14:17:01Z","snapshot_observed_at":"2026-08-16T16:01:25.565982Z","submitted_at":"2023-01-19T12:01:41Z","title":"A Tutorial on Meta-Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.08028","snapshot_observed_at":"2026-08-16T06:07:19.469725Z","title":"Z., Xiong, Z., Zintgraf, L., Finn, C., and Whiteson, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.469725Z"},"links":{"cited_paper":"/paper/2301.08028","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:d2b4cea8ca9fa9599a53dfe96a940230bb49167dfda69e3b744dee9e3d47fd51","observation_id":"88de1a95-ef77-40c5-a89c-ebfc37edfea0","resolution":{"observed_at":"2026-08-16T06:07:19.469725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.473581Z","title":"C., and Ye, Y","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.473581Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:971546aba1e4e2a21ae765a999f57543577ea5649142cd830348f4e53ec2a391","observation_id":"1b58aae1-a71b-435b-941b-1b2545c4c55f","resolution":{"observed_at":"2026-08-16T06:07:19.473581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.477281Z","title":"C., and Jordan, M","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.477281Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:5691200b9ab4efff015c2f0c4bbaf05fdea8e2258bff9b8d741c12981025362b","observation_id":"db0e3d95-27dc-4f8f-9028-b0b522d7e5ba","resolution":{"observed_at":"2026-08-16T06:07:19.477281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06705","last_updated":"2019-02-20T17:38:32Z","snapshot_observed_at":"2026-08-14T17:14:47.799958Z","submitted_at":"2019-02-18T18:18:27Z","title":"On Evaluating Adversarial Robustness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06705","snapshot_observed_at":"2026-08-16T06:07:19.480792Z","title":"On evaluating adversarial robustness","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.480792Z"},"links":{"cited_paper":"/paper/1902.06705","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:8f9d23855acfea34f40e71f416a029f5f402a0ee372d131d47b3775345265973","observation_id":"09bf18a0-b6c5-4008-b68c-004d67679998","resolution":{"observed_at":"2026-08-16T06:07:19.480792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.484656Z","title":"and Valko, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.484656Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:43a813701da680485ec76d298125dcbdb8178e7f773ccf48e7f411a2d1121de4","observation_id":"e9d098ea-8a69-4c04-959b-5272c941ddc2","resolution":{"observed_at":"2026-08-16T06:07:19.484656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.487852Z","title":"Risk aversion in finite markov decision processes using total cost criteria and average value at risk","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.487852Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:c59ae5403d37188b598c112da2b093c7f194b3a0c8c283300f118aaa0a0d51d1","observation_id":"084e88be-a8f7-4f9b-84ec-5a9d8acf0de6","resolution":{"observed_at":"2026-08-16T06:07:19.487852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.490989Z","title":"Box2d: A 2d physics engine for games, 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.490989Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:18a95e41cfda1244ef1b51390bc9055212f61ed3f87d8b5594a9929dabfad483","observation_id":"ee3a6edc-370d-40bb-91bf-9252012b9bba","resolution":{"observed_at":"2026-08-16T06:07:19.490989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.493963Z","title":"Tohan: A one-step approach towards few-shot hypothesis adaptation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.493963Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:862fa1ba7992bc8b36dd58ce5f0b923e2a375e2bf55dda16e0c4b2121d32d2e0","observation_id":"5aa9a946-f255-45e9-9c9d-39b50762b71c","resolution":{"observed_at":"2026-08-16T06:07:19.493963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.497136Z","title":"Unveiling causal reasoning in large language models: Reality or mirage? Advances in Neural Information Processing Systems, 37: 0 96640--96670, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.497136Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6d957a4e9b146057257899aa684253fb1a11780742f92af2ea6b052714cd5372","observation_id":"10390f7b-7b0d-4a0a-82da-9448cc321188","resolution":{"observed_at":"2026-08-16T06:07:19.497136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.500290Z","title":"Does confusion really hurt novel class discovery? International Journal of Computer Vision, 132 0 (8): 0 3191--3207, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.500290Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:40251669ef254fc7d85b0f8f9e8ceb2a849c63b4aacc9ddb977be977b9bb2017","observation_id":"5ae36d18-d5c2-4ac7-a337-b1d2f9fa7f17","resolution":{"observed_at":"2026-08-16T06:07:19.500290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.503511Z","title":"Risk-sensitive and data-driven sequential decision making","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.503511Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:1bbb983894587410a9f00b8f281ba044c3730109eebe5a474e4e743c2b0584a2","observation_id":"5a52b742-1efd-446d-9d0c-e764011016c3","resolution":{"observed_at":"2026-08-16T06:07:19.503511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.506792Z","title":"Risk-sensitive and robust decision-making: a cvar optimization approach","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.506792Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:42a460b1a9919204c0546fe40a96b641ac1ee2c37773e86f64244425edacd36d","observation_id":"d48cba5d-a026-457d-bfcf-fbdb0540a6a3","resolution":{"observed_at":"2026-08-16T06:07:19.506792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.510159Z","title":"Risk-constrained reinforcement learning with percentile risk criteria","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.510159Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:9b0fcfc79e6f6a86dbea863d12a81e8e5f9dc07f464dd0a42365f4445997915b","observation_id":"3d165292-de38-4999-ac7a-796108c24444","resolution":{"observed_at":"2026-08-16T06:07:19.510159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.513287Z","title":"Safe policy learning for continuous control","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.513287Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:bc18238a1f65e59811c287d618b27c92922a46dc5bd885495fd2bc3fd6c17e1a","observation_id":"08b77fd6-6cf0-4907-8477-1097cdfaff34","resolution":{"observed_at":"2026-08-16T06:07:19.513287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.516464Z","title":"A., Ghahramani, Z., and Jordan, M","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.516464Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:69c67b521421aa5285c8c37e51d10103261c6893d6bb8b1b36bfc79e1b5a8217","observation_id":"ad555537-0d1a-4d8e-85dd-5c9e0045ab09","resolution":{"observed_at":"2026-08-16T06:07:19.516464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.519552Z","title":"Task-robust model-agnostic meta-learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.519552Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3661431b98ecdf4c1f19a8fae4228e5f8f5483c8f933cc1157f27d50353c0348","observation_id":"520db437-9c7b-45ba-a628-5fb89d6311fd","resolution":{"observed_at":"2026-08-16T06:07:19.519552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.522707Z","title":"Bullet physics simulation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.522707Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:f8a55c09b98de7f17ddf02b84d0c4471e8b48a47e5464171b50b0ad2204c6ca4","observation_id":"2f599618-15bf-4f0a-b9e9-82c98d327771","resolution":{"observed_at":"2026-08-16T06:07:19.522707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.525933Z","title":"Emergent complexity and zero-shot transfer via unsupervised environment design","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.525933Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6b2c00787aad4060d829d855fea58a0f9c90b6fa219d579827532764b815f979","observation_id":"cfb1dac3-b75c-4f21-841a-4174aca1c1e3","resolution":{"observed_at":"2026-08-16T06:07:19.525933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.02779","last_updated":"2016-11-10T01:17:36Z","snapshot_observed_at":"2026-08-14T21:31:19.001119Z","submitted_at":"2016-11-09T00:13:29Z","title":"RL$^2$: Fast Reinforcement Learning via Slow Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.02779","snapshot_observed_at":"2026-08-16T06:07:19.529048Z","title":"L., Sutskever, I., and Abbeel, P","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.529048Z"},"links":{"cited_paper":"/paper/1611.02779","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:7d0b33784942898b425791aa2cdb4e4a56f0b1aa519d5e05a9e700f5ec386d4e","observation_id":"c7dbbb5e-b488-41c1-91c5-920cb78e1cc4","resolution":{"observed_at":"2026-08-16T06:07:19.529048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.532581Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.532581Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:5cedec3e05fc36186b628ef449e5bad2560148e4a97cc8f968d9008d0c338590","observation_id":"0bf6c1c1-77c8-416d-8117-80618e674125","resolution":{"observed_at":"2026-08-16T06:07:19.532581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.583887Z","title":"Probabilistic model-agnostic meta-learning","venue":null,"work_id":"926c61a3-2805-4d30-b45c-d47ce4d7fd2f","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.535863Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:0b60f8c18d538ae33e326b260c11f6cd80d88fb178760cd2ae129502f0df1202","observation_id":"4ba7b02f-826c-411a-a9fd-26ad116d33db","resolution":{"observed_at":"2026-08-16T06:07:20.587274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.539079Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.539079Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:e94e1d4f29e4d210c7aacb28f07056839d53d4f9f5c1edb85abf791485b2b0e1","observation_id":"3e10efdc-50e3-4987-acf9-069324e04e40","resolution":{"observed_at":"2026-08-16T06:07:19.539079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.542165Z","title":"Deep bayesian active learning with image data","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.542165Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:ca02ee2acc65410a443b7fd78de0fb1ad722a575b83ee5a3d028a99ae35d992f","observation_id":"73b4ff04-48e1-4b27-bccc-7b3ad2b1462c","resolution":{"observed_at":"2026-08-16T06:07:19.542165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"0805.3415","last_updated":"2008-05-22T09:18:44Z","snapshot_observed_at":"2026-08-16T18:59:25.396218Z","submitted_at":"2008-05-22T09:18:44Z","title":"On Upper-Confidence Bound Policies for Non-Stationary Bandit Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0805.3415","snapshot_observed_at":"2026-08-16T06:07:19.545422Z","title":"and Moulines, E","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.545422Z"},"links":{"cited_paper":"/paper/0805.3415","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3f9597e6c6f5066a946d7e6aa56fd7fe6bda5634f9c6bcfde1ec19756aedc7fd","observation_id":"c013a9d6-e318-4622-9214-ca36fda4c9c0","resolution":{"observed_at":"2026-08-16T06:07:19.545422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01622","last_updated":"2018-07-04T14:49:46Z","snapshot_observed_at":"2026-08-14T18:55:44.864275Z","submitted_at":"2018-07-04T14:49:46Z","title":"Neural Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01622","snapshot_observed_at":"2026-08-16T06:07:19.549045Z","title":"J., Eslami, S., and Teh, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.549045Z"},"links":{"cited_paper":"/paper/1807.01622","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:4145210b0e36a84f0ce0a52e9f524b8661a0917bd39c7cb56364b10bef3059a9","observation_id":"39d67b2e-5b1a-4a58-8bd8-dbf2cecdf521","resolution":{"observed_at":"2026-08-16T06:07:19.549045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.552344Z","title":"W., Gast, J., Ruiz, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.552344Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:fb6cd61b5241c36e8c11b45e5d9e8908760cbb6e614a6319381d642dad470897","observation_id":"db9426d3-cb51-49c4-bda5-bc3087bb20c4","resolution":{"observed_at":"2026-08-16T06:07:19.552344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.555550Z","title":"Efficient risk-averse reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.555550Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:053ea8de1c4cc0e02bc75fd1eb890abe1c31cd0e45347d256078d249e23bd869","observation_id":"ecc75b9d-4c65-4272-868a-e61485fe8737","resolution":{"observed_at":"2026-08-16T06:07:19.555550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.550675Z","title":"Train hard, fight easy: Robust meta reinforcement learning","venue":null,"work_id":"2565dcc4-65e9-4c04-a8d4-60b34d54f25c","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.558873Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b65e1bdf70c6a7013368d34f39f358b646d26b9269d91d68b522a673c5607b9b","observation_id":"e8b401d3-9702-4d82-bef4-917a36cf50af","resolution":{"observed_at":"2026-08-16T06:07:20.553993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.540543Z","title":"Meta-reinforcement learning of structured exploration strategies","venue":null,"work_id":"4776a4d5-504b-4eef-a749-d370d69eb232","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.562580Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:ed66a56ebf4948b5286726d95566805e955bb1bdecee76b0a247c4668fda601f","observation_id":"72f301d9-fb70-4907-b8f6-859b32073cea","resolution":{"observed_at":"2026-08-16T06:07:20.544201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.529936Z","title":"Beyond uniform sampling: Offline reinforcement learning with imbalanced datasets","venue":null,"work_id":"6d13ecf1-06df-4519-b440-79c0df09011c","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.565645Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:adbbd660e518ce64de229120fc97d9f404cb9f9e81c7a8ed1f46040a1744b690","observation_id":"8809c028-b3aa-4805-b1b9-8c5a26198c5d","resolution":{"observed_at":"2026-08-16T06:07:20.533631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.568751Z","title":"Meta-learning in neural networks: A survey","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.568751Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:bada790f5cceaa12e8a851505722ed072726a8fdb57a64a1f347b82a67f7d05b","observation_id":"a6e17ffc-edd1-4c2a-8251-2376183c8832","resolution":{"observed_at":"2026-08-16T06:07:19.568751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.514368Z","title":"Replay-guided adversarial environment design","venue":null,"work_id":"fd28fdfd-4f1b-440f-8f39-ab08a791eb10","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.571839Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:0dffadf093f3286b17504ad3f062881050ae8a18ca4c22e5b0fe3ddf0cec56f5","observation_id":"f92a9204-8118-4b48-8ea2-1ee27e65fead","resolution":{"observed_at":"2026-08-16T06:07:20.517773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-16T06:07:19.575103Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.575103Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:1a4fc4480349af8c98143b77bd04f4445a89272391c7706d1e16914426caecd2","observation_id":"848061a3-a3bb-463d-ba5f-2ee24d7fc1a3","resolution":{"observed_at":"2026-08-16T06:07:19.575103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.503833Z","title":"Batchbald: Efficient and diverse batch acquisition for deep bayesian active learning","venue":null,"work_id":"725d01e2-e9e7-423b-9a6b-329ae9a89498","year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.578658Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:015319e8e2acdd3f26aba6182c32a25baef466a56b46d5559bcfd46aca4087f5","observation_id":"8b2b7e8e-e1f6-42e9-bbe1-db88d8b52e17","resolution":{"observed_at":"2026-08-16T06:07:20.507713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.581994Z","title":"W., Sagawa, S., Marklund, H., Xie, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.581994Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:006fc0120de761b0037631dc1df2d7edcd899252f74c008eee924fc10405ab39","observation_id":"40efd838-94f0-4597-b41c-b036314ff133","resolution":{"observed_at":"2026-08-16T06:07:19.581994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.487483Z","title":"D., Jansen, N., and Topcu, U","venue":null,"work_id":"4e80ea81-3e44-400d-afee-9f2d786060ae","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.585184Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:a66747115cbaa3c923007e52813ad084d8bb18f796bd98703032acc3e49c8e43","observation_id":"628fe51d-540b-4f10-82bd-dba56e076eb1","resolution":{"observed_at":"2026-08-16T06:07:20.491172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-16T06:07:19.588739Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.588739Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:0c94eb9b603fdfc43846413770fa4dedbe633eb569d8c94d90e01edac5c1bdd2","observation_id":"36d99476-cedd-4c8e-be10-4f532acf5e6f","resolution":{"observed_at":"2026-08-16T06:07:19.588739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.01112","last_updated":"2021-05-06T09:06:50Z","snapshot_observed_at":"2026-08-16T19:16:15.851626Z","submitted_at":"2020-10-02T17:13:39Z","title":"FOCAL: Efficient Fully-Offline Meta-Reinforcement Learning via Distance Metric Learning and Behavior Regularization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.01112","snapshot_observed_at":"2026-08-16T06:07:19.592312Z","title":"Focal: Efficient fully-offline meta-reinforcement learning via distance metric learning and behavior regularization","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.592312Z"},"links":{"cited_paper":"/paper/2010.01112","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:d3bb0c969a9f406e76ac7435a756c0c1df46c83236dada22ce7ea358c5421ddc","observation_id":"181ab4fc-e272-40ef-9092-d7ec4a0f3549","resolution":{"observed_at":"2026-08-16T06:07:19.592312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.477056Z","title":null,"venue":null,"work_id":"0ed76706-b730-48ec-a928-61448f4d284c","year":2000},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.595751Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b79f5f856e818d8dc10d757ca40df4f675aa30d74143e404d2c7d3720f798461","observation_id":"211c40b9-32db-49a9-b287-3d629f91d480","resolution":{"observed_at":"2026-08-16T06:07:20.480834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.466329Z","title":"Theoretical investigations and practical enhancements on tail task risk minimization in meta learning","venue":null,"work_id":"fe11c6ac-82f0-45e4-9a93-8eb8c72be5fa","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.598914Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:97626b9f33e0e9cf5e509f4b2452bd3da82129677c655053b6a2cb91d37ca4c0","observation_id":"59bbb7de-cfa1-4f46-b92c-7bfc49fc81bb","resolution":{"observed_at":"2026-08-16T06:07:20.469952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01967","last_updated":"2024-06-04T04:53:05Z","snapshot_observed_at":"2026-08-16T13:46:27.470681Z","submitted_at":"2024-06-04T04:53:05Z","title":"DrEureka: Language Model Guided Sim-To-Real Transfer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01967","snapshot_observed_at":"2026-08-16T06:07:19.602087Z","title":"J., Liang, W., Wang, H.-J., Wang, S., Zhu, Y., Fan, L., Bastani, O., and Jayaraman, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.602087Z"},"links":{"cited_paper":"/paper/2406.01967","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:1e4c4cbb2f12e16a010ea1714645dbb9e4041cf07d3daa2f2a16f14bdc9c118e","observation_id":"37f86d4f-c7ec-4872-b1b3-e52a5dfa7ce8","resolution":{"observed_at":"2026-08-16T06:07:19.602087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.605532Z","title":"and Teneketzis, D","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.605532Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:c8049c3d7e07dee4b671e80a6fb67833023225a7c0b36cf9416c74a48c5a8c1f","observation_id":"932ccd72-ef9f-4421-85aa-dc657993df71","resolution":{"observed_at":"2026-08-16T06:07:19.605532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.450529Z","title":"Supported value regularization for offline reinforcement learning","venue":null,"work_id":"5e33dd12-4a11-41b0-a6c6-73749253ddf6","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.609039Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:9d892fe306f51f77f0249409a03d3d05d0f04e57d6ced26b5cb5075d31055325","observation_id":"5bd5de1a-bfa4-409b-8ba8-171371fcb1a5","resolution":{"observed_at":"2026-08-16T06:07:20.453803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.440332Z","title":"Supported trust region optimization for offline reinforcement learning","venue":null,"work_id":"2dff6464-2205-45c3-830b-74d02f78f13a","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.612323Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b172cf33bbf4f46ef0cf9ea71df2a87848de82b8128d2ed3e257b639f9dc40f2","observation_id":"08e8b828-7914-4b44-9625-d7ed06d336af","resolution":{"observed_at":"2026-08-16T06:07:20.443745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19400","last_updated":"2024-11-01T07:20:10Z","snapshot_observed_at":"2026-08-16T13:06:00.956064Z","submitted_at":"2024-10-25T09:01:37Z","title":"Offline Reinforcement Learning with OOD State Correction and OOD Action Suppression","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19400","snapshot_observed_at":"2026-08-16T06:07:19.615567Z","title":"Offline reinforcement learning with ood state correction and ood action suppression","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.615567Z"},"links":{"cited_paper":"/paper/2410.19400","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:116cd5abcd5b11a702d2a8e30dd1d0afdc7ee9fe4b9f81fb016417ed03129bbb","observation_id":"8d134177-3bb4-4deb-9dae-a8b253696e41","resolution":{"observed_at":"2026-08-16T06:07:19.615567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07934","last_updated":"2024-11-13T06:34:07Z","snapshot_observed_at":"2026-08-16T13:00:45.785904Z","submitted_at":"2024-11-12T17:04:56Z","title":"Doubly Mild Generalization for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2411.07934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.07934","snapshot_observed_at":"2026-08-16T06:07:19.964570Z","title":"Doubly Mild Generalization for Offline Reinforcement Learning","venue":"cs.LG","work_id":"aac73140-34b2-4879-a2a1-471cfb65ebfb","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.619155Z"},"links":{"cited_paper":"/paper/2411.07934","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:b67ba3e924d1a499a764da89ac40b66a4cbad7b92a228ebb19f756a90b5bd975","observation_id":"a3552b7b-4a38-43e3-a0c6-812e1ea38396","resolution":{"observed_at":"2026-08-16T06:07:19.968776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.622708Z","title":"J., and Paull, L","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.622708Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:44b313759d6ba70b95da78530f39a0311a313c67516dfa6ef8e0affda68b3167","observation_id":"6315d687-cfaa-4d1e-bf3b-f147cf91b0ee","resolution":{"observed_at":"2026-08-16T06:07:19.622708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.424376Z","title":"H., and Gal, Y","venue":null,"work_id":"af4e1325-2b3b-47ee-a852-cba69fd0a907","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.625944Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3c0a5ea1a36ea5ac100b0f74e45745b40545819cdbac0afcdb1ba0d4d1c2eb6f","observation_id":"7ae5c00f-4e86-45e3-ba3f-be12b02d81ce","resolution":{"observed_at":"2026-08-16T06:07:20.427747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.414278Z","title":"Domain randomization for simulation-based policy optimization with transferability assessment","venue":null,"work_id":"10a9fde1-d6e9-4479-9011-49e96bd38ee0","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.629250Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:4a24dee1cc1ba65cc741e265c877792cee80f84af8477fd466175ee3ad1138cd","observation_id":"8cbba36c-a336-4627-a8be-834454a72db0","resolution":{"observed_at":"2026-08-16T06:07:20.417889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.404266Z","title":"Data-efficient domain randomization with bayesian optimization","venue":null,"work_id":"e950b0b8-ef34-422c-9c23-d87ecab13e74","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.632665Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:8743ff5a6f69e0a35785a3c01d145a0d71370a827754d5011e15c8b3cac25e7d","observation_id":"01d74f5d-c795-4de4-968e-58930b2a59b2","resolution":{"observed_at":"2026-08-16T06:07:20.407725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10628","last_updated":"2018-05-20T14:51:43Z","snapshot_observed_at":"2026-08-14T20:19:14.327014Z","submitted_at":"2017-10-29T15:30:58Z","title":"Variational Continual Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10628","snapshot_observed_at":"2026-08-16T06:07:19.635795Z","title":"V., Li, Y., Bui, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.635795Z"},"links":{"cited_paper":"/paper/1710.10628","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:ea7b5893956ba1fca3e4aeaf99f065f3995304c6b84dc93849b3cd672e378fad","observation_id":"3b839439-50fd-4352-86f7-964aca3c4c97","resolution":{"observed_at":"2026-08-16T06:07:19.635795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.394316Z","title":"(more) efficient reinforcement learning via posterior sampling","venue":null,"work_id":"a7bcc979-f06e-48d7-922e-81e109183cbb","year":2013},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.639417Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:9c584958164784361271c9ab6f9c9aeb54a8a68147eb6faca9ced348b6b9a2cc","observation_id":"551dc370-d83b-4015-ae6d-200c68d636d4","resolution":{"observed_at":"2026-08-16T06:07:20.397796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.642846Z","title":"Risk averse robust adversarial reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.642846Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:830ea0c279886620c6f22cf2badce159b4e80b8625b49a9411060bb45406e0a7","observation_id":"bc30fc04-e964-43ee-b0dd-38a1710cb077","resolution":{"observed_at":"2026-08-16T06:07:19.642846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.646330Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.646330Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:28595a0e3c145184d5027c3bab91a7bbddc5b3f975a06424d093617aca036bfe","observation_id":"81ba255b-0a9b-4753-b37e-5efd2a4783a0","resolution":{"observed_at":"2026-08-16T06:07:19.646330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.649421Z","title":"Meta-learning with neural bandit scheduler","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.649421Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:952635b4acd97fef78071d0724127bad79dd0060a2192b4fc0ad736c6530c437","observation_id":"c2de9c67-7809-45f9-b0d2-514e663ce01c","resolution":{"observed_at":"2026-08-16T06:07:19.649421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.364744Z","title":"Hokoff: Real game dataset from honor of kings and its offline reinforcement learning benchmarks","venue":null,"work_id":"ad78d692-41d5-4d42-863e-d6c3da4f39b8","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.652730Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2847feeba909c65cea5d2c990cdead54f91ad26feee335ce5fc34fa41b394f17","observation_id":"d5bd3537-2d1a-44f4-92cd-f9bb40e89e8f","resolution":{"observed_at":"2026-08-16T06:07:20.368888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02511","last_updated":"2026-05-30T09:14:19Z","snapshot_observed_at":"2026-08-16T13:12:57.564591Z","submitted_at":"2024-10-03T14:21:23Z","title":"Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration","version":2},"cited_work":{"arxiv_id":"2410.02511","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02511","snapshot_observed_at":"2026-08-16T06:07:19.936728Z","title":"Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration","venue":"cs.AI","work_id":"e17efc75-08f6-495c-b375-64729718a838","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.656167Z"},"links":{"cited_paper":"/paper/2410.02511","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:c511b9d77445b838f7c3b823ec68550fd125f7e85be7dbafd1a41d94fdc8f9d4","observation_id":"c99a8ad3-082b-4c41-9227-809318140e1d","resolution":{"observed_at":"2026-08-16T06:07:19.942774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.354333Z","title":"Latent reward: Llm-empowered credit assignment in episodic reinforcement learning","venue":null,"work_id":"bd3842da-a856-4b0d-8fec-60a61f2766cf","year":2025},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.659467Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:cf5a0ff396bbfb1019fc0fd16523f48c73295f340ab3be22c15fdfc5bd347715","observation_id":"b25e7614-0244-45db-86b5-a40bb327682d","resolution":{"observed_at":"2026-08-16T06:07:20.357963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.662642Z","title":"M., and Levine, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.662642Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:a17dac31b5945d47c3a94b778807a09e86829e9ad7f8084979bc6cb4afe3ec3b","observation_id":"3d905242-76d5-4c81-ac73-0180c35e1eb2","resolution":{"observed_at":"2026-08-16T06:07:19.662642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.665736Z","title":"Efficient off-policy meta-reinforcement learning via probabilistic context variables","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.665736Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:c2ccee9d4a9d8055c701e9c06337481d0bcdde717fe0bc8861353ebabe411814","observation_id":"60d5ae6c-a7a6-4dca-beee-76d1eccebf43","resolution":{"observed_at":"2026-08-16T06:07:19.665736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.332422Z","title":"J., Fidler, S., and Litany, O","venue":null,"work_id":"ad693f6b-386a-4bca-a549-ce95127a5849","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.669179Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2c0006bbb148b2b3b9722e5f2ee1bb71c4c990ae17da151f9a92e8262dda02da","observation_id":"87b89c97-cf3f-487a-994d-a873bf6c236a","resolution":{"observed_at":"2026-08-16T06:07:20.335668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.672267Z","title":"B., Chen, X., and Wang, X","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.672267Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2e05f7916f085f91625660f543ede179e045a4fa589f099846c21801e08f7e2b","observation_id":"3b880b53-a8d7-4ca5-a884-3b728f473cec","resolution":{"observed_at":"2026-08-16T06:07:19.672267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.315569Z","title":"Risk-averse bayes-adaptive reinforcement learning","venue":null,"work_id":"125a9a3e-9418-49bc-9e67-b225bc28efc6","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.675393Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2d2ab8bee8c3faec4ac7a6991b0160c74368b3d8a52024d9e39b650eaea9bb6e","observation_id":"f7823eb2-0ff8-439a-aa19-6b91830928f8","resolution":{"observed_at":"2026-08-16T06:07:20.319048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.305226Z","title":"Been there, done that: Meta-learning with episodic recall","venue":null,"work_id":"d4b6534c-e154-4023-961c-ed4adb68320f","year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.678600Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:48e24fbade1452e2e51600e00c0e2c03979449327d94fb5e3980c85e8a81bf7f","observation_id":"5543703a-f2c1-4506-8bbd-850b2cf96ee3","resolution":{"observed_at":"2026-08-16T06:07:20.308943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.681694Z","title":"T., Uryasev, S., et al","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.681694Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:94d8a2c2d14fca91cf0c32aa315456b555575375faf410ee7ade2efc1ef73206","observation_id":"1eb0376d-39d5-47a8-b7d3-e9702776e451","resolution":{"observed_at":"2026-08-16T06:07:19.681694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.684809Z","title":"and Van Roy, B","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.684809Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:896ed56f507cb2469e766afb415ebb9c037362891ecac22c2468f6a4b0954cf8","observation_id":"92992d40-807e-4363-8f8d-82445fdaa4f8","resolution":{"observed_at":"2026-08-16T06:07:19.684809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.688100Z","title":"W., Hashimoto, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.688100Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:394c7b73ef2589554d345a13f255fff125fd15e8bb05cd399a88dbf243cd6293","observation_id":"9ab5554e-712c-4b3a-917b-27ab353a1863","resolution":{"observed_at":"2026-08-16T06:07:19.688100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T06:07:19.691253Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.691253Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:48b931bcd474b513ec961c4fbbc186dde014b1380a6c1b175c437d965e8e110d","observation_id":"c24aa8df-f8a0-4d30-83b2-fe21871d7f89","resolution":{"observed_at":"2026-08-16T06:07:19.691253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.276254Z","title":"Prompting is a double-edged sword: Improving worst-group robustness of foundation models","venue":null,"work_id":"87fd949b-8e3e-4e4b-9454-a1c5f0891e1c","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.694623Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:0719579dcc67e29718ebf11969e034094a6ae46c585529090107e64ed7927f9e","observation_id":"b0e4148b-a0f4-43d9-9e54-251830dc707e","resolution":{"observed_at":"2026-08-16T06:07:20.280010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.265544Z","title":"Counterfactual conservative q learning for offline multi-agent reinforcement learning","venue":null,"work_id":"2801395f-7dd8-4a88-9f95-4a726dd7bcff","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.697683Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:a271f9aae8349f23f78fcb77c0f1434678a56e33bb7962176c1a6b176331990a","observation_id":"c1138d65-1084-4484-8d0d-3887b3c25aed","resolution":{"observed_at":"2026-08-16T06:07:20.269237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.254725Z","title":"Complementary attention for multi-agent reinforcement learning","venue":null,"work_id":"226df3f0-f9e8-4782-b869-0a3aebda66ef","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.700660Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:7c5d2d919c76aa52da50d1f9084fd26d8b2411cc04c9bb88809714da5b461e75","observation_id":"dca42403-e6b6-408d-9b0f-51f93d2c270a","resolution":{"observed_at":"2026-08-16T06:07:20.258683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.703760Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.703760Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:55293993f5156e10d83b7324c619410f408d2590aaa35b27ccb6ea26f10563d0","observation_id":"454e847c-0d68-4e41-8062-4a923f958261","resolution":{"observed_at":"2026-08-16T06:07:19.703760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.238447Z","title":"Policy gradient for coherent risk measures","venue":null,"work_id":"d820938b-8ed8-4850-95c6-ab0c6cb54f78","year":2015},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.706802Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3a2b2810ea7692032fadf8f059638b4a7b3ccd62d9e2e14b803b60b0bd4e0f8f","observation_id":"e135e20a-24fe-43e4-ad74-5fe1fe8e0566","resolution":{"observed_at":"2026-08-16T06:07:20.241938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00425","last_updated":"2025-05-30T05:49:14Z","snapshot_observed_at":"2026-08-16T13:13:51.765058Z","submitted_at":"2024-10-01T06:10:39Z","title":"ManiSkill3: GPU Parallelized Robotics Simulation and Rendering for Generalizable Embodied AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00425","snapshot_observed_at":"2026-08-16T06:07:19.710213Z","title":"Maniskill3: Gpu parallelized robotics simulation and rendering for generalizable embodied ai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.710213Z"},"links":{"cited_paper":"/paper/2410.00425","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:0f436a11491f200879aa35d09bca5d0e3ce2fba572597e778fac8b09df1169b5","observation_id":"f346bfa0-9a39-4f98-b3e4-e66d4a83688d","resolution":{"observed_at":"2026-08-16T06:07:19.710213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.713847Z","title":null,"venue":null,"work_id":null,"year":1933},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.713847Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2ee5be834d4c015960e093fbefa27b7c09888482542d9d6be3b1b304e52ac0af","observation_id":"7c8b863b-f3d3-47f5-97ba-99f315cfc6cf","resolution":{"observed_at":"2026-08-16T06:07:19.713847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01885","last_updated":"2024-03-26T12:59:44Z","snapshot_observed_at":"2026-08-16T14:46:14.049126Z","submitted_at":"2023-11-03T12:54:05Z","title":"Domain Randomization via Entropy Maximization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01885","snapshot_observed_at":"2026-08-16T06:07:19.717212Z","title":"Domain randomization via entropy maximization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.717212Z"},"links":{"cited_paper":"/paper/2311.01885","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:5fb374b53ee21f122d382040b9eb8cd286090ab2a91aff42afa77481d6a79f88","observation_id":"9b8e0d7a-63b7-4354-a78a-379b9e52ae3e","resolution":{"observed_at":"2026-08-16T06:07:19.717212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.720919Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.720919Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2f27ac920141a6f596f269b48046f2d473e59971c0ece9ed830fc7c17fe504a9","observation_id":"f05afa65-1ef3-4159-9de9-1b58e8cd730c","resolution":{"observed_at":"2026-08-16T06:07:19.720919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.724132Z","title":"Mujoco: A physics engine for model-based control","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.724132Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:6cdbcf7adbb1d32943df0631b21d317aa99bfc7bc8a9b54e0f35097164f1c73a","observation_id":"911e0356-f945-4776-a7d5-931688ce6c72","resolution":{"observed_at":"2026-08-16T06:07:19.724132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.727152Z","title":"N., Vapnik, V., et al","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.727152Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2825207c4c81f124add4e9a6b30dec0a886bec76a289c0b119dfc58232fe3c0c","observation_id":"4bbdb804-6c21-48aa-a9ab-60fa43844b8a","resolution":{"observed_at":"2026-08-16T06:07:19.727152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13237","last_updated":"2024-07-18T07:47:51Z","snapshot_observed_at":"2026-08-16T13:33:10.969401Z","submitted_at":"2024-07-18T07:47:51Z","title":"LLM-Empowered State Representation for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13237","snapshot_observed_at":"2026-08-16T06:07:19.730282Z","title":"Llm-empowered state representation for reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.730282Z"},"links":{"cited_paper":"/paper/2407.13237","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:058fe55c5464a71c25e773a9caddfc65a70f15f10c1a4aea84c7dca01f7eddc8","observation_id":"450bf3bf-cd93-4342-baff-0af5473f97e5","resolution":{"observed_at":"2026-08-16T06:07:19.730282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19523","last_updated":"2025-01-06T14:02:17Z","snapshot_observed_at":"2026-08-16T13:30:27.018560Z","submitted_at":"2024-07-28T16:23:55Z","title":"Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19523","snapshot_observed_at":"2026-08-16T06:07:19.733479Z","title":"Robust fast adaptation from adversarially explicit task distribution generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.733479Z"},"links":{"cited_paper":"/paper/2407.19523","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:db4abfef655c2d5b73b5ce4d10dd7e45d6f5ac10e405b3cb5f724446a5ec2e6c","observation_id":"932eb590-c4d9-47e8-a013-3a3f5c2caed3","resolution":{"observed_at":"2026-08-16T06:07:19.733479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.203587Z","title":"and Van Hoof, H","venue":null,"work_id":"97d2c374-5930-401d-a000-1a16c85a33fa","year":2020},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.736690Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:979e95f403bdb8309d1762a385c87fea1de0b5fa91e1732d1ea75de1a8c3b210","observation_id":"de78651d-fc48-4d6f-a572-d227deb1ec3c","resolution":{"observed_at":"2026-08-16T06:07:20.207349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.193171Z","title":"and Van Hoof, H","venue":null,"work_id":"6e63383a-01e3-474d-8aea-5815a7f474d9","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.739818Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:77cc1e3a8f96eb0e73b9179a09d8efe4e87bc8b47af93b8f134817d65482de2a","observation_id":"332c131a-42bd-4c21-800c-77e06e2532a3","resolution":{"observed_at":"2026-08-16T06:07:20.196751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.182884Z","title":"and Van Hoof, H","venue":null,"work_id":"94d807a8-2fc2-482a-bb29-f332a4dd45bd","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.742889Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:102e4e14cb42a728bff96c28c3e8122a0d4b9d2f0b1dbe51333836d5d5ddacd2","observation_id":"e5755f72-9968-40e7-8150-c53782f0a346","resolution":{"observed_at":"2026-08-16T06:07:20.186407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.171000Z","title":"Bridge the inference gaps of neural processes via expectation maximization","venue":null,"work_id":"a2768ee2-ec47-46b0-a6a2-cc4b4b3e1b1a","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.746258Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:26e6e51061da1b037a3d648427cfb7913eaf33c095277fd06be96c8ea5f30d28","observation_id":"3e54db66-d416-48ce-b0a7-f000105f813a","resolution":{"observed_at":"2026-08-16T06:07:20.175111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.160139Z","title":"Bridge the inference gaps of neural processes via expectation maximization","venue":null,"work_id":"124068a9-cd1b-419f-b51d-6c3a335342e7","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.749224Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:f033e5d4a5d7d511060b48555b5cea19bb5a64fe52a7c337c42565b38581feae","observation_id":"1819eff5-2710-4920-8ae0-32c5a4631aa6","resolution":{"observed_at":"2026-08-16T06:07:20.163804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.149317Z","title":"A simple yet effective strategy to robustify the meta learning paradigm","venue":null,"work_id":"d1cdc3de-c314-4d93-b27b-e771462c2e0b","year":2024},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.752321Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:29ed3340874ae87aa5c3f2c3681c67a92911a87e89d6273dba059ad25de96485","observation_id":"785659ff-e84c-45ef-a2a6-f488a576919b","resolution":{"observed_at":"2026-08-16T06:07:20.153016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.758674Z","title":"C., Xiao, Z., Mao, Y., Qu, Y., Shen, J., Lv, Y., and Ji, X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.758674Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:02081a064929d3cf84115991dfa0beabf6074f4d39f606ee869e91f8c781d54d","observation_id":"b922284c-bd28-4f68-84e1-7b097446435b","resolution":{"observed_at":"2026-08-16T06:07:19.758674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.139189Z","title":"Max-min diversification with fairness constraints: Exact and approximation algorithms","venue":null,"work_id":"f8d4a950-0990-42f7-a82d-b33ebc4be086","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.762013Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:bc0bf3fff2603acaea71442f5a2bfeeee98165cde7e5035c31689e840838ee70","observation_id":"9e805beb-f4c3-45a6-b04f-0c97540e7fb1","resolution":{"observed_at":"2026-08-16T06:07:20.142842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.128554Z","title":"Entropy-based active learning for object detection with progressive diversity constraint","venue":null,"work_id":"d23c7fbf-f89f-4f1f-ae68-b14a911c6078","year":2022},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.765397Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:28d507e1edc966c99768c31ca6224c46e0aa48f53d0eaf38ef849497fb7cb09f","observation_id":"50d7c5f2-06e2-4879-ba82-e4f9643a5733","resolution":{"observed_at":"2026-08-16T06:07:20.132062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.118291Z","title":"Enhancing context-based meta-reinforcement learning algorithms via an efficient task encoder (student abstract)","venue":null,"work_id":"77f866c3-5363-4826-bddb-90f24e036790","year":2021},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.768519Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:8d9039ba3f7a34cd0c40bdfa294b32f04033bd586fea611d2e596e19c3245e9f","observation_id":"173e4ce0-585b-4a84-ac1c-48d876fc04cd","resolution":{"observed_at":"2026-08-16T06:07:20.121864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.772193Z","title":"Bayesian model-agnostic meta-learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.772193Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:3ca4884efd497e67f2c1cfc53c8cd6b4857743fe20fbe0e4dc02c787f94ebf12","observation_id":"5ade9aee-9d27-4eb9-abbb-5de699f1a2ad","resolution":{"observed_at":"2026-08-16T06:07:19.772193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.101532Z","title":"In-sample actor critic for offline reinforcement learning","venue":null,"work_id":"e2c3623f-839e-4140-8200-c257c5591ec7","year":2023},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.775352Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:7503a934923287e9b20e28c49c3a0a08ec62c9c9aa0b1b9cf14dc48066cc39eb","observation_id":"c8f669a2-91a3-409f-93e8-6bcc611ac78f","resolution":{"observed_at":"2026-08-16T06:07:20.105029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:20.091263Z","title":"Combining active learning and semi-supervised learning using gaussian fields and harmonic functions","venue":null,"work_id":"71f93e95-24df-44d5-9101-a375ebb9a73c","year":2003},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.778563Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:f22725b1cf00aac0a25c556aaf3506615c5f5fe09c09aa35cb59b7acfa7f63ec","observation_id":"79df17aa-53a6-4126-bccd-7de4dd4c6752","resolution":{"observed_at":"2026-08-16T06:07:20.094970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08348","last_updated":"2020-02-27T19:40:21Z","snapshot_observed_at":"2026-08-11T22:18:09.221124Z","submitted_at":"2019-10-18T11:44:59Z","title":"VariBAD: A Very Good Method for Bayes-Adaptive Deep RL via Meta-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08348","snapshot_observed_at":"2026-08-16T06:07:19.781695Z","title":"Varibad: A very good method for bayes-adaptive deep rl via meta-learning","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.781695Z"},"links":{"cited_paper":"/paper/1910.08348","citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:04eece031f60ced6ebdfb20ef4ac04d9f79161551b551e20c218a5f6b4032394","observation_id":"0a639983-ad2c-4d88-b0bd-d292922863b0","resolution":{"observed_at":"2026-08-16T06:07:19.781695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T06:07:19.785138Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments","version":3},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-16T06:07:19.785138Z"},"links":{"citing_paper":"/paper/2504.19139"},"observation_digest":"sha256:2bc05a2d9123ad7f4c4d3ec7fd2dac46e188ee91fb8573783ad39eca6d33d12b","observation_id":"d7272cf5-1381-4047-a0c9-7ee5a53ea186","resolution":{"observed_at":"2026-08-16T06:07:19.785138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.19139","last_updated":"2025-05-15T01:51:26Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T05:58:20.560888Z","submitted_at":"2025-04-27T07:27:17Z","title":"Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":2,"verified_fuzzy":34},"total_outbound_references":100},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 100 of 100 outbound references and 0 inbound Pith citation observations for arXiv:2504.19139."}