{"as_of":"2026-08-09T09:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:036448a836dbf62372c53391c12c19dc2bcfd691fd1635be36a72ae575c5c3fc","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:16:15.283328Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19628/citation-record","integrity":"/paper/2607.19628/integrity","json":"/paper/2607.19628/citation-record.json","paper":"/paper/2607.19628"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:06.785025Z","title":"Optimal Control of Partial Differential Equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:06.785025Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:bb42ce90b4bf6482ed34513bdee007e91e1966996d0e5e975ca0f3a83763f791","observation_id":"0686d5cb-7e55-4eff-bdfa-2b095f07c0d3","resolution":{"observed_at":"2026-08-01T12:16:06.785025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:06.893154Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:06.893154Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:bd6fb7c61afc97b680cc68b6a6c4769631f16e0ab7105dac68e83f2818c1d4c3","observation_id":"7c260ed2-a519-411f-be2b-3852a105470d","resolution":{"observed_at":"2026-08-01T12:16:06.893154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:06.998257Z","title":"Fleming and H","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:06.998257Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:7ca0020d33a5ea1949278814a0d7cbf93f0eb9279f64bebf7e24b6118e9df350","observation_id":"42ad2392-90b0-4448-aa8d-976d160d9914","resolution":{"observed_at":"2026-08-01T12:16:06.998257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:07.134193Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:07.134193Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:afc63927b8354dc87d07552f6296ca806af0c38af004d43b3e1c1eeac5dbdf60","observation_id":"06e3e0fe-ef36-4f83-963d-d3531b623c4a","resolution":{"observed_at":"2026-08-01T12:16:07.134193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:07.259748Z","title":"Bertsekas and John N","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:07.259748Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:a9efe89915b9b8d999805276672552c1fe8a84169ef6fed73e8d0aaad4dcf0a0","observation_id":"5a671d0d-f7bc-44e7-8ea4-9f2860aaff52","resolution":{"observed_at":"2026-08-01T12:16:07.259748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:07.448135Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:07.448135Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:48c551c577bf7412c2686cda2af181633f529957457cc455a8e68d4b098ecd41","observation_id":"b1451670-53fd-4382-a74e-d29d1f81ff0f","resolution":{"observed_at":"2026-08-01T12:16:07.448135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:07.582405Z","title":"Deep reinforcement learning: A brief survey","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:07.582405Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c57b8a022b7a58aa76de481a5a66826bd2f9f24abb254bbe2979aaa1a577189a","observation_id":"6f6b4afc-340f-45a2-924a-20894c53f44e","resolution":{"observed_at":"2026-08-01T12:16:07.582405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:07.718837Z","title":"Bellemare, and Joelle Pineau","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:07.718837Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c26a445ba29b51bfbe06dbfb635897a93b0496cb8eac77c39d5d2a61aff0c880","observation_id":"feeb43c0-c89c-4dd0-8d11-d1bfdd8d588c","resolution":{"observed_at":"2026-08-01T12:16:07.718837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:07.899923Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:07.899923Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:7f7e8fafa346f4fdb4d6aac0005a50f0d9f32aa79c3458de9b0f0c34c3f7338b","observation_id":"92c3a7f5-83e2-421d-9c7a-10c7dfdf8c6a","resolution":{"observed_at":"2026-08-01T12:16:07.899923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:08.041634Z","title":"Mastering complex control in moba games with deep reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.041634Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c9841074211447ba1386531eea6801abc07c8f622584275fb3b86de244978f07","observation_id":"6af5490a-ec3f-4d8b-89ba-31b9aa11f4c7","resolution":{"observed_at":"2026-08-01T12:16:08.041634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-01T12:16:08.195533Z","title":"Playing atari with deep reinforcement learning","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.195533Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:50b90bf19da550b922a287b314c558fdf7860bf4d81ca240aff8633fed742f92","observation_id":"4ad93362-8e30-49ee-9ce5-326630161dac","resolution":{"observed_at":"2026-08-01T12:16:08.195533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:08.322640Z","title":"Deep reinforcement learning with double q-learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.322640Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:af81885f190ecf4ee3f3487e161cf9abb358223976c9d8f11ad28f7076dd5078","observation_id":"e4eb16a3-69c0-417d-8fcb-6143e39dc037","resolution":{"observed_at":"2026-08-01T12:16:08.322640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:08.455917Z","title":"Reinforcement learning for robots using neural networks","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.455917Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c7d2729077e5d646f64218901b30b0ee9fd1e2d43836bfe8544476e2ac491eb8","observation_id":"bb652059-cde2-4aa5-ab8f-9a59aa60f370","resolution":{"observed_at":"2026-08-01T12:16:08.455917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:08.611466Z","title":"Andrew Bagnell, and Jan Peters","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.611466Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:451ca4ec8e318fd5c4aacd7853c0ec409c19762a84e89bee33628137a57337b3","observation_id":"7ce96309-f9ca-4d14-a39a-eb24f466ea41","resolution":{"observed_at":"2026-08-01T12:16:08.611466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:08.754069Z","title":"Towards vision-based deep reinforcement learning for robotic motion control","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.754069Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c738013e814747d9824f611536f8fd40c375c554231e237a8e8695b9b5f3f38c","observation_id":"21a829e5-c87a-44c7-aae5-45c18664088d","resolution":{"observed_at":"2026-08-01T12:16:08.754069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:08.891545Z","title":"Deep reinforcement learning for robotic manipulation with asynchronous off-policy updates","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.891545Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:6e0ea714981de8f04b3fec3b81555f62b70fe83541b7eea14f50f270383bed01","observation_id":"f1c97c2d-a894-42c4-8479-fd4e40ef0b6f","resolution":{"observed_at":"2026-08-01T12:16:08.891545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:08.975267Z","title":"Sim-to-real transfer in deep reinforcement learning for robotics: a survey","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:08.975267Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:479e77f6752ad36b5bf1cb68be5208a2be491aefe1fba2c7534a771334d90000","observation_id":"064ff056-cea0-4d04-a801-b629d07f61f5","resolution":{"observed_at":"2026-08-01T12:16:08.975267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:09.054613Z","title":"Low dimensional state representation learning with robotics priors in continuous action spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.054613Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:69127049b343599f1953c8aa667eb491f4f4c2070836e36726627026407daaf2","observation_id":"20f95b64-7545-4122-a1a1-0650b41fa5ab","resolution":{"observed_at":"2026-08-01T12:16:09.054613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:09.128491Z","title":"Control of chaotic systems by deep reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.128491Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:74c1417e4543952f7ffdf984cf7333565f1cae319fdae733fb3ae2a4c297a668","observation_id":"1b4cad3a-969c-4d0a-b7d7-8bc731c7d458","resolution":{"observed_at":"2026-08-01T12:16:09.128491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:09.218887Z","title":"Reinforcement learning for bluff body active flow control in experiments and simulations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.218887Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:5f0ad99472be1baf2b7e92ad35ee34229584f6d9d1ac1f0ac4e9902a5d172144","observation_id":"5b8fd41c-3ee5-45c2-aa67-d34e2a9b1b9f","resolution":{"observed_at":"2026-08-01T12:16:09.218887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:09.367062Z","title":"Accelerating deep reinforcement learning strategies of flow control through a multi-environment approach","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.367062Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:09ac2015539c121532297e086ff4ecb54e5cf86fc688e46037ef14b84ce498d4","observation_id":"26f94feb-60dd-41bb-aa15-a22116ab9d21","resolution":{"observed_at":"2026-08-01T12:16:09.367062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:09.526451Z","title":"Active flow control for bluff body drag reduction using reinforcement learning with partial measurements","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.526451Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:13e338e8231bca0869c5ee81c2a1fce5aa475b3dc74001c4c745a30b0f854c91","observation_id":"93b83026-4ac7-4ffe-850e-a70b04f2a8b3","resolution":{"observed_at":"2026-08-01T12:16:09.526451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10737","last_updated":"2023-12-23T17:41:08Z","snapshot_observed_at":"2026-07-06T14:44:38.168186Z","submitted_at":"2023-01-25T17:55:30Z","title":"Distributed Control of Partial Differential Equations Using Convolutional Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10737","snapshot_observed_at":"2026-08-01T12:16:09.690774Z","title":"Brunton, and Kunihiko Taira","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.690774Z"},"links":{"cited_paper":"/paper/2301.10737","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:39f35873b2fd67db8814950d82caf1c377fff4406dccbf76048da8f08b214d5f","observation_id":"91f66401-f20f-491f-a4c0-fff9518df2ef","resolution":{"observed_at":"2026-08-01T12:16:09.690774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09110","last_updated":"2025-08-22T20:31:51Z","snapshot_observed_at":"2026-07-06T17:44:21.659847Z","submitted_at":"2024-03-14T05:17:39Z","title":"SINDy-RL: Interpretable and Efficient Model-Based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09110","snapshot_observed_at":"2026-08-01T12:16:09.830353Z","title":"Sindy-rl: Interpretable and efficient model-based reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.830353Z"},"links":{"cited_paper":"/paper/2403.09110","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:d69f9265bf3a5e09e531f4d39e44e82611a186b2f0d661bce3fc3199374f00c6","observation_id":"416652ab-5202-4acf-a08f-980f95b10cc1","resolution":{"observed_at":"2026-08-01T12:16:09.830353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:09.945394Z","title":"Parametric PDE Control with Deep Reinforcement Learning and L <sub>0</sub> Sparse Polynomial Policies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:09.945394Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c4e9bf8d229f2e1dc4dbdb3d1cf973905b9299b76275b417869abe5063e6f330","observation_id":"195bbfa7-bbf4-45bc-9b3f-bbbce9f612f1","resolution":{"observed_at":"2026-08-01T12:16:09.945394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:10.042217Z","title":"HypeMARL: Multi- Agent Reinforcement Learning For High-Dimensional, Parametric, and Distributed Systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.042217Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:0f08dd0c2d80e1ec5800cae8ccecc4799e409d54dee85b493f2b395d83719789","observation_id":"571d1375-ba70-4570-acc2-fd4e9656545e","resolution":{"observed_at":"2026-08-01T12:16:10.042217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:10.146357Z","title":"Implementation matters in deep rl","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.146357Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:ea96b9db129ffa5627b3e7a81b2e53880731850e6d87f26f9efce1fb17560ec2","observation_id":"b9220098-34de-43bb-b2de-4b17052ebb1e","resolution":{"observed_at":"2026-08-01T12:16:10.146357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01283","last_updated":"2017-03-03T19:58:56Z","snapshot_observed_at":"2026-07-06T05:13:22.674148Z","submitted_at":"2016-10-05T06:51:58Z","title":"EPOpt: Learning Robust Neural Network Policies Using Model Ensembles","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01283","snapshot_observed_at":"2026-08-01T12:16:10.261275Z","title":"Epopt: Learning robust neural network policies using model ensembles","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.261275Z"},"links":{"cited_paper":"/paper/1610.01283","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:02eea33de3f7662a3b1ebcd194998aa1e60f518c4e943159f5dd6d09cb82e3c7","observation_id":"cf74b94c-5bc6-415f-98bd-b4cda89a357e","resolution":{"observed_at":"2026-08-01T12:16:10.261275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-07-06T07:49:17.886466Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-08-01T12:16:10.311939Z","title":"Challenges of real-world reinforcement learning","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.311939Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:838ff49c7ce199f5b546dcdb0538396298fd3a2261e7d91abb1e064ff85cd154","observation_id":"c69926f4-b6a4-48a9-9b22-a4677fb03b65","resolution":{"observed_at":"2026-08-01T12:16:10.311939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:10.396960Z","title":"Deep reinforcement learning at the edge of the statistical precipice","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.396960Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:ed01e690f9cd28004dd5f134cc225ef8820b39905e7aeb07fb805008bf9e7561","observation_id":"f9976255-2990-4984-8b49-a0f0c397a2da","resolution":{"observed_at":"2026-08-01T12:16:10.396960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12282","last_updated":"2019-03-15T17:58:23Z","snapshot_observed_at":"2026-08-04T12:14:43.752072Z","submitted_at":"2018-10-29T17:51:46Z","title":"Assessing Generalization in Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12282","snapshot_observed_at":"2026-08-01T12:16:10.549227Z","title":"Assessing generaliza- tion in deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.549227Z"},"links":{"cited_paper":"/paper/1810.12282","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:20e713f6c10005aaa7e3bbf97ad413ebc07df9c6442875946c28c3cf6f380d55","observation_id":"02e8dae2-8c12-4006-b456-62cba3ef9de7","resolution":{"observed_at":"2026-08-01T12:16:10.549227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:10.685453Z","title":"Crossing the reality gap: A survey on sim-to-real transferability of robot controllers in reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.685453Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:d9c06dee227c37477a7c7bd6d7f809fca174284e8df9f84ee48e561bf4e08911","observation_id":"ef17d0c1-1ed7-4fd3-922f-19bbf0618342","resolution":{"observed_at":"2026-08-01T12:16:10.685453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.11881","last_updated":"2021-03-04T13:02:59Z","snapshot_observed_at":"2026-07-06T09:07:31.294850Z","submitted_at":"2020-03-24T11:05:41Z","title":"An empirical investigation of the challenges of real-world reinforcement learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.11881","snapshot_observed_at":"2026-08-01T12:16:10.849144Z","title":"Mankowitz, and Todd Hester","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.849144Z"},"links":{"cited_paper":"/paper/2003.11881","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:ec5b33ba2d4ca37ac0534fb1caebeb13e3cf6b9efb5b343f5a561669ff9d526b","observation_id":"fbcc7291-354b-44f8-b954-992f5b24ea76","resolution":{"observed_at":"2026-08-01T12:16:10.849144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:10.984484Z","title":"Aleatoric and epistemic uncertainty in machine learning: An introduc- tion to concepts and methods","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:10.984484Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:4c0127f9c2c0ef1e1d2771070663c5174de03e5c4e43135a6cf1c3ec823ee768","observation_id":"f217aba7-8acf-4dd6-9edf-c5f75d82e390","resolution":{"observed_at":"2026-08-01T12:16:10.984484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:11.135310Z","title":"Uncertainty-aware reinforcement learning agents for noisy environments","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:11.135310Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c3233eab05fbebb2e9927c63811590bae41836b18fa019ff775794617811047b","observation_id":"b70add5b-851a-4fe6-9b92-60e89302eeb4","resolution":{"observed_at":"2026-08-01T12:16:11.135310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.08334","last_updated":"2021-06-25T17:45:05Z","snapshot_observed_at":"2026-08-02T22:09:20.359294Z","submitted_at":"2020-12-15T14:39:57Z","title":"Masksembles for Uncertainty Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.08334","snapshot_observed_at":"2026-08-01T12:16:11.303004Z","title":"Masksembles for uncertainty estimation.arXiv preprint arXiv:2012.08334, 2020","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:11.303004Z"},"links":{"cited_paper":"/paper/2012.08334","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:34b257dd312ba1c4c6b1f7c95d034d3c2412e5c12b5d258882754d6b956afb1f","observation_id":"bc38f21a-bb63-4be8-899e-c4fc375be9b1","resolution":{"observed_at":"2026-08-01T12:16:11.303004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:11.494958Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:11.494958Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:30d48d2c624b20608339f816265e3cdbe04949825f188a39ebdf222c0c125a24","observation_id":"36fa8fef-e768-49ee-95f7-285652da9b03","resolution":{"observed_at":"2026-08-01T12:16:11.494958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:11.615345Z","title":"Sunrise: A simple unified framework for ensemble learning in deep reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:11.615345Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:248af90150a2beb3b06c16a69b77a099850e62017c922501422f6b56f863950d","observation_id":"ac9454bb-456b-47ff-8a55-7a896739ffcf","resolution":{"observed_at":"2026-08-01T12:16:11.615345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:11.762473Z","title":"Hyperl: Hypernetwork-based reinforcement learning for control of parametrized dynamical systems","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:11.762473Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:2a307796dd36802f567482dc7b3d069b1a4e037e7e0b0a67caa11c0b84c1b7ad","observation_id":"c01fe666-3a2f-429c-8ccd-9862ec3e5a90","resolution":{"observed_at":"2026-08-01T12:16:11.762473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.09106","last_updated":"2016-12-01T10:08:15Z","snapshot_observed_at":"2026-08-08T11:39:44.107967Z","submitted_at":"2016-09-27T05:57:00Z","title":"HyperNetworks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.09106","snapshot_observed_at":"2026-08-01T12:16:11.931428Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:11.931428Z"},"links":{"cited_paper":"/paper/1609.09106","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:ecd4c3844843ed33345cd2fa29e39efff89cafbf5637605bebb904d22453f6c9","observation_id":"bfcc7993-2d7a-41cc-b863-d09a2e59d271","resolution":{"observed_at":"2026-08-01T12:16:11.931428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06955","last_updated":"2024-07-13T16:54:28Z","snapshot_observed_at":"2026-07-06T15:41:28.693657Z","submitted_at":"2023-06-12T08:37:38Z","title":"A Brief Review of Hypernetworks in Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06955","snapshot_observed_at":"2026-08-01T12:16:12.062437Z","title":"A brief review of hypernetworks in deep learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.062437Z"},"links":{"cited_paper":"/paper/2306.06955","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:ea81a6def29a0d69c66dc4f5d8189fc8f54ba91a79184017ba069c6650d7f130","observation_id":"9b55948d-b140-4d70-8d14-4f4907a70f0b","resolution":{"observed_at":"2026-08-01T12:16:12.062437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:12.192121Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.192121Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:2eaa658b3f1403745f58811f1e8fc6a0e6c3397f66f9443b6848b35172bdf9c9","observation_id":"2a1ccffb-e9d4-452f-93bc-9e6f0cda9e1b","resolution":{"observed_at":"2026-08-01T12:16:12.192121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:12.389929Z","title":"Hypernetworks in meta- reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.389929Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:92eb9c919349ba7d40c3eb1cafae46aebc288d02560a75a3d0063acb519b6c5e","observation_id":"1994bad7-a6ff-4677-a87a-8a8e9117c67a","resolution":{"observed_at":"2026-08-01T12:16:12.389929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.04759","last_updated":"2018-04-24T20:36:16Z","snapshot_observed_at":"2026-07-06T06:04:02.924963Z","submitted_at":"2017-10-13T00:27:57Z","title":"Bayesian Hypernetworks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.04759","snapshot_observed_at":"2026-08-01T12:16:12.556846Z","title":"Bayesian hypernetworks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.556846Z"},"links":{"cited_paper":"/paper/1710.04759","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:7776434a4468b05458badec898b73db343e8aadb06cfe216e54bcd2143d5de8d","observation_id":"34aa6c25-0bb6-464f-8c33-0bce3fe1cea0","resolution":{"observed_at":"2026-08-01T12:16:12.556846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:12.625144Z","title":"Puterman","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.625144Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:55fe12a1a78fdd565c0f3ef30d441fdb97def3f8c5ca219f72c8730da9f728ef","observation_id":"be0b92a7-bf83-48f2-84b7-47b70a65890d","resolution":{"observed_at":"2026-08-01T12:16:12.625144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:12.719370Z","title":"Bertsekas","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.719370Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:9967a6544e14ce7ef59eb97ed569a952b2059fb944824b563f59f753bc8a24db","observation_id":"6b5ef0c3-f265-44dd-9087-55d72692bfec","resolution":{"observed_at":"2026-08-01T12:16:12.719370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:12.835506Z","title":"Mastering atari, go, chess and shogi by planning with a learned model","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.835506Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:51b487cc6ded1fa584e2408a80e65c6b9130d8b833223d50863c24e91a7ac7a8","observation_id":"d71fd274-099e-4b06-a9fd-bf6fee69953a","resolution":{"observed_at":"2026-08-01T12:16:12.835506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00374","last_updated":"2024-04-03T14:26:32Z","snapshot_observed_at":"2026-08-07T15:39:37.899352Z","submitted_at":"2019-03-01T15:40:19Z","title":"Model-Based Reinforcement Learning for Atari","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.00374","snapshot_observed_at":"2026-08-01T12:16:12.956077Z","title":"Model-based reinforcement learning for atari","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:12.956077Z"},"links":{"cited_paper":"/paper/1903.00374","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:62324216cabc5457e883b8cd0d9c557721b08f70220a7f6b60325fb023acd102","observation_id":"fe921aa0-fafa-459b-b0e1-c55a855ee45e","resolution":{"observed_at":"2026-08-01T12:16:12.956077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:13.099992Z","title":"Moerland, Joost Broekens, Aske Plaat, and Catholijn M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:13.099992Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:869568d8a7bc87b518371dcd00adfab7ae76f9389cba87ed0bdc1712bb5fc9af","observation_id":"c93b2799-061f-49fd-915a-b7ebdba9f95f","resolution":{"observed_at":"2026-08-01T12:16:13.099992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:13.230108Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:13.230108Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:f63f0999256ff51c0d83a244f1383777dce7f2173833ae66d5e1c1ed6750add0","observation_id":"04296ae2-45ed-448b-9c1b-2e00de0501fb","resolution":{"observed_at":"2026-08-01T12:16:13.230108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:13.352295Z","title":"Konda and John N","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:13.352295Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:ccfb84200e3703c9483341c466def1bcdd7f68077fb86ff81cc8048d37161652","observation_id":"a772ee5d-c539-4d5d-a8ee-ca40148d0fef","resolution":{"observed_at":"2026-08-01T12:16:13.352295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:13.517884Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:13.517884Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c5bbb095e80dfc964164fc33a8484dc1f43e25b106c6bdf9f33417d001dd9be0","observation_id":"a71d499e-36a7-4f3b-8b20-993aaa0057a7","resolution":{"observed_at":"2026-08-01T12:16:13.517884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-01T12:16:13.673716Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:13.673716Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:1d204d87da70e5e40392e109e5417bcba7e7a2157913a8ad83048396e13e86d8","observation_id":"7795942c-bb59-4e4b-8df6-6e07df0343d9","resolution":{"observed_at":"2026-08-01T12:16:13.673716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01290","last_updated":"2018-08-08T21:27:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T09:50:50Z","title":"Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01290","snapshot_observed_at":"2026-08-01T12:16:13.809650Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:13.809650Z"},"links":{"cited_paper":"/paper/1801.01290","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:d71caacec5a5bec031565d10a37e9f52ac6d925bde453c5951e9e1d4aaa282a5","observation_id":"09c4a2ea-ca0d-42d4-b385-d5d1ae55e4d6","resolution":{"observed_at":"2026-08-01T12:16:13.809650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:13.951750Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:13.951750Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:a552bcac492d7e451e7c4381be344e6e8e448a06bcb005dfe551212997669e08","observation_id":"d63c0197-3436-46b2-821d-c1fb36fd4af3","resolution":{"observed_at":"2026-08-01T12:16:13.951750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:14.103073Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.103073Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:d6aea0d6ee69f7f4ce1ab6d4c8cffc48781f74fa9cdcd12ca337ad9a93e6f277","observation_id":"c16fac71-c7f6-43f4-83c4-2b030d553668","resolution":{"observed_at":"2026-08-01T12:16:14.103073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-01T12:16:14.177610Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.177610Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c8503a0cc06411554b05b2c08683f2b6368ea580c7e96632b3b881c4ea13fd7d","observation_id":"9425f308-bae0-4e3a-82df-d9a314aa5e93","resolution":{"observed_at":"2026-08-01T12:16:14.177610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:14.252404Z","title":"Deterministic policy gradient algorithms","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.252404Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:9e84554f94b4532790b8a297685305ad08bce1334c77c7dee5352c5a7415d091","observation_id":"6ae09b76-d0da-49d8-9031-369edb5ce2b2","resolution":{"observed_at":"2026-08-01T12:16:14.252404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13307","last_updated":"2020-05-19T07:07:51Z","snapshot_observed_at":"2026-08-05T03:20:48.865842Z","submitted_at":"2020-05-19T07:07:51Z","title":"LALR: Theoretical and Experimental validation of Lipschitz Adaptive Learning Rate in Regression and Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13307","snapshot_observed_at":"2026-08-01T12:16:14.414177Z","title":"Generalization in reinforcement learning with hypernetworks","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.414177Z"},"links":{"cited_paper":"/paper/2006.13307","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:cfd85e060fc8b1a1cb675a381a6d5e23e8c522a30a87de34ea9abb5fd79df03f","observation_id":"7579585c-eead-4743-be02-c5c92cf78efe","resolution":{"observed_at":"2026-08-01T12:16:14.414177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03335","last_updated":"2018-11-15T17:53:47Z","snapshot_observed_at":"2026-07-06T06:43:49.475434Z","submitted_at":"2018-06-08T19:47:54Z","title":"Randomized Prior Functions for Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.03335","snapshot_observed_at":"2026-08-01T12:16:14.531038Z","title":"Randomized prior functions for deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.531038Z"},"links":{"cited_paper":"/paper/1806.03335","citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:b078953aa07f0ae500b8e78444851e50d90623681157ab7cf34ed94f3f1e0300","observation_id":"f933a9ae-08fe-4c8b-ad90-49bfc1efee7d","resolution":{"observed_at":"2026-08-01T12:16:14.531038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:14.670240Z","title":"For sale: State-action representation learning for deep reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.670240Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:14804fcf148d9c2427cf7d6d2705dc8207c6e903e16f62d6ed59646b36382494","observation_id":"9ddb9b44-1d4c-420d-9d02-61bfa0e51f4c","resolution":{"observed_at":"2026-08-01T12:16:14.670240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:14.808900Z","title":"Kudryashov","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.808900Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:ee8ca14b51354b44c191a5d80a0b78d447040b1af6b8450d9babaea9e604b10a","observation_id":"a50334ca-f917-441f-92cd-d91444149501","resolution":{"observed_at":"2026-08-01T12:16:14.808900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:14.966360Z","title":"Evidence on the Regularisation Properties of Maximum-Entropy Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:14.966360Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:8041fdf7d3eb60a81eb841e805d2fa08c61170a8ac02314e42742b06ddecd873","observation_id":"f61980ca-3257-4c3b-8038-5c185ffc9d68","resolution":{"observed_at":"2026-08-01T12:16:14.966360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:15.060826Z","title":"Learning efficient navigation in vortical flow fields","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:15.060826Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:1cec3fb4a1d5dbd1cbf3d8390b713d613982006571d7a59a170de8e26ac4c9b0","observation_id":"5b2304bf-9d38-47aa-92a2-86401b4ed93c","resolution":{"observed_at":"2026-08-01T12:16:15.060826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:15.186862Z","title":"Finite time lyapunov exponent analysis of model predictive control and reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:15.186862Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:c222ec092985e613bcddd5a3b2924251e2a3fbc3f89d9f94a9582782ce09d36f","observation_id":"4478aa8e-5e07-46c3-b098-8be43c1d33e2","resolution":{"observed_at":"2026-08-01T12:16:15.186862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T12:16:15.283328Z","title":"A novel mechanism for mechanosensory-based rheotaxis in larval zebrafish","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T12:16:15.283328Z"},"links":{"citing_paper":"/paper/2607.19628"},"observation_digest":"sha256:22e1aab77eb86f0bd14fc7a9cdd71aa01dcd46a8142511f5364edce3c9b0c7ff","observation_id":"34891815-80e2-401a-a95f-b30f329d92dd","resolution":{"observed_at":"2026-08-01T12:16:15.283328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19628","last_updated":"2026-07-21T23:37:34Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T00:28:58.091967Z","submitted_at":"2026-07-21T23:37:34Z","title":"HypEMBER: Hypernetwork-based Ensemble for Robust Policy Learning of Parametrized Dynamical Systems"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":66,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2607.19628."}