{"as_of":"2026-08-13T10:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bec4be461fd9bdf3362cfccade2fe01e57185de2d793101faec2971d49429535","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:29:40.825180Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14246/citation-record","integrity":"/paper/2411.14246/integrity","json":"/paper/2411.14246/citation-record.json","paper":"/paper/2411.14246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:42.046132Z","title":"Learning hand-eye coordination for robotic grasping with deep learning and large-scale data collec- tion,","venue":null,"work_id":"d821e666-c5f2-468c-aed1-6b7b7d306ff9","year":2018},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.610292Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:8206e23d7e1d75edef264f91327f8376a72b8f1fb415ca02c8e433c95c1d53aa","observation_id":"f6328274-15c1-43e4-bba6-36c94f402154","resolution":{"observed_at":"2026-08-12T15:29:42.051539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:42.032467Z","title":null,"venue":null,"work_id":"c64671ac-1d52-42a9-a428-eb460388c607","year":null},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.614971Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:180c2dd764d8f62750c69e40d31a72b45f00a9c122cbf8f6dd9513e3f95547da","observation_id":"bb48e362-466c-4041-8f93-9115b2e6fe86","resolution":{"observed_at":"2026-08-12T15:29:42.036805Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.619002Z","title":"Learning quadrupedal locomotion over challenging terrain,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.619002Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:48f7e75edf97d5730e723f01b234fb71061421b0e1ebd289fcdf411dd991030f","observation_id":"4310e71e-9923-4246-a17b-cb7854a79051","resolution":{"observed_at":"2026-08-12T15:29:40.619002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.623358Z","title":"How to train your robot with deep reinforce- ment learning: Lessons we have learned,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.623358Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:c308d1b5d6c9ff849bb7cc565c489515310129a0fb50c9bec5f536073f050cba","observation_id":"e4ae5f8b-4c70-4a53-8349-b08706086e6b","resolution":{"observed_at":"2026-08-12T15:29:40.623358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.627533Z","title":"A survey on policy search algorithms for learning robot controllers in a handful of trials,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.627533Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:c78dfdac19bc91e800588fbceafcf7a3c5e0113b0b7175195fe260d2b0375db5","observation_id":"07f58f11-0d88-49a6-a08e-e53d9509372d","resolution":{"observed_at":"2026-08-12T15:29:40.627533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.10147","last_updated":"2020-02-24T10:27:40Z","snapshot_observed_at":"2026-08-12T18:38:29.960786Z","submitted_at":"2020-02-24T10:27:40Z","title":"Constraining Conformal Theories in Large Dimensions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.10147","snapshot_observed_at":"2026-08-12T15:29:40.631909Z","title":"Move- ment imitation with nonlinear dynamical systems in humanoid robots,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.631909Z"},"links":{"cited_paper":"/paper/2002.10147","citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:84ca8f1ccc46d7680de1b4d12b27980ee82a2fb938a7cdc86e965419f6465b16","observation_id":"38b2caa6-900e-4261-a4bb-10aa87ade617","resolution":{"observed_at":"2026-08-12T15:29:40.631909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:42.019518Z","title":"Probabilistic movement primitives,","venue":null,"work_id":"0e5265d4-0f8b-43df-b3a8-efb9fd34ee57","year":2013},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.637024Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:c50ae13bfeb07fff724d79e13086b93087ca78e686df47082368ab45509e873a","observation_id":"5f0346d3-725f-4bd1-bb1f-c6babca95626","resolution":{"observed_at":"2026-08-12T15:29:42.024325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16013","last_updated":"2025-03-20T09:13:10Z","snapshot_observed_at":"2026-08-13T05:34:17.034409Z","submitted_at":"2024-01-29T10:01:10Z","title":"SERL: A Software Suite for Sample-Efficient Robotic Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16013","snapshot_observed_at":"2026-08-12T15:29:40.641563Z","title":"Luo et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.641563Z"},"links":{"cited_paper":"/paper/2401.16013","citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:023196e261593b42a50a43a66a0a841340ee9982f3ad3c2f202a348d40b9be5e","observation_id":"3ce9ed82-34a4-4b1d-b830-3d437840dd07","resolution":{"observed_at":"2026-08-12T15:29:40.641563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:42.004670Z","title":"Scalable global optimization via local Bayesian optimization,","venue":null,"work_id":"48135ef5-ab88-4395-a892-24bb85be2cbd","year":2019},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.649875Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:dc66a215bba6f88cef9e09dd2787fdda8981403aafa100a195fc4452cbf08196","observation_id":"17fa55f0-31e4-4441-8fbe-b53745e91731","resolution":{"observed_at":"2026-08-12T15:29:42.010187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.991167Z","title":"Local policy search with Bayesian optimization,","venue":null,"work_id":"be7dc497-eb37-4827-b659-3e3978a1fa21","year":2021},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.653728Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:f3c7ebbe5d08acf804540eae94536d4b9e92981e46485f92780852f5b174c634","observation_id":"f0444ab0-ba5f-488c-8972-278767aeefde","resolution":{"observed_at":"2026-08-12T15:29:41.995285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.977962Z","title":"Cautious Bayesian optimization for efficient and scal- able policy search,","venue":null,"work_id":"3cfc61f7-6375-47f6-beb2-89800b65d892","year":2021},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.657429Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:63c2196b8a3b07e9b6e1cd726aae02195906b7409703fa7cb4672a44065289b9","observation_id":"baceda17-3a97-468c-b910-bbd812f9cb58","resolution":{"observed_at":"2026-08-12T15:29:41.983228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.964987Z","title":"High-dimensional Bayesian optimization with sparse axis-aligned sub- spaces,","venue":null,"work_id":"29ba8066-8eae-452d-b8bc-8e059d0cd4b1","year":2021},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.660985Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:cd6669954a1abadde48c9eddf93d62306a8e692cbdc0590ba811c6c4e058eb11","observation_id":"da560310-667d-4fd6-b912-f7e368ea64e0","resolution":{"observed_at":"2026-08-12T15:29:41.969936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.952371Z","title":"Lo- cal Bayesian optimization via maximizing probability of 15 descent,","venue":null,"work_id":"70f03d6f-bef6-46fe-9acc-98c82ba1ff24","year":2022},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.664074Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:0a94799a5b881b2ff726b225d1aafc37d2727d5d8293dc64d51c14763b213a36","observation_id":"edd77fc8-3414-4e0d-b40b-fc11b0899725","resolution":{"observed_at":"2026-08-12T15:29:41.957393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.939305Z","title":"Are random decom- positions all we need in high dimensional Bayesian optimisation?","venue":null,"work_id":"874a9171-f056-4912-8cf8-1ff75569cf0d","year":2023},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.667350Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:41b5943222c55610f2588d29f5d92146fee46faa89b9217166deb55e47936de6","observation_id":"63e7f3c1-b57c-4295-8232-fb4ee2bf7973","resolution":{"observed_at":"2026-08-12T15:29:41.943814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.924874Z","title":"Transferring end-to-end visuomotor control from simulation to real world for a multi-stage task,","venue":null,"work_id":"adc5c606-ea7a-4c6c-af5d-496a95765f6e","year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.670486Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:148a99cf81aaa81e4db9f9fb78dcbc1d6b3ff9d293bdfeabd06000170bd09178","observation_id":"37884e94-1764-4b8b-bbff-a55ffe89b2f4","resolution":{"observed_at":"2026-08-12T15:29:41.930045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.912066Z","title":"Sim-to-real transfer of robotic control with dynamics randomization,","venue":null,"work_id":"1d2236a6-4f33-4070-bdf7-2a88b9f937a5","year":2018},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.674407Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:217c7d331cb185fecbe4f1e9dc13e02435906ec7698a3dcef85b5613d5748b00","observation_id":"31f0400c-b403-4040-8820-528a480b79f7","resolution":{"observed_at":"2026-08-12T15:29:41.916049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.898267Z","title":"Learning dexterous in-hand manipulation,","venue":null,"work_id":"2194fc43-0507-4434-a20d-7548e41217e7","year":2020},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.681323Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:186fe6a386849bf0eac1dd0b046624b6c09549290e77d3556966ecf829d42772","observation_id":"0b19b8ab-02f8-4ab0-8164-a3fd79f4ce8a","resolution":{"observed_at":"2026-08-12T15:29:41.903757Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.886435Z","title":"Learning invariant feature spaces to transfer skills with reinforcement learning,","venue":null,"work_id":"032699dc-02e6-4580-84e6-7a26830fd6a7","year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.684913Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:41bc4c269e2e61667a34fa35473c5f858a173da0c499d862ce429555e2d441bd","observation_id":"c1cfe1cb-762c-4c9f-87df-872619c6ef34","resolution":{"observed_at":"2026-08-12T15:29:41.890502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.873220Z","title":"Sim-to-real robot learning from pixels with progressive nets,","venue":null,"work_id":"a463db14-7c63-45ac-a818-8826606ac12f","year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.688583Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:3dbdbdc4bee291760c9cc62bcbc7351b7422c68d03f8ace191825602a0a165d9","observation_id":"cd5dd830-71f8-40e4-8a62-b332a1f8d484","resolution":{"observed_at":"2026-08-12T15:29:41.877701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.862231Z","title":"DIRL: Domain-invariant representation learning for sim-to-real transfer,","venue":null,"work_id":"1601e4f9-6f91-490d-b098-b091ff5c83d7","year":2021},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.692377Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:ef5e5427845654950db6b8937a27ba17fab8e93a965fdb663a8c9894385411dd","observation_id":"12e66ebb-b236-4925-b9b1-7aa6b270000e","resolution":{"observed_at":"2026-08-12T15:29:41.866030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.849844Z","title":"Gaussian process optimization in the bandit setting: No regret and experimental design,","venue":null,"work_id":"92027099-fbf3-4d0e-9eb1-e51a3df01652","year":2010},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.696075Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:3041417ed3f503a0b78eedbee97829f50fc648d2d086077f02de3be25807ca87","observation_id":"8592cd30-0b97-4cee-a85c-f56639c8d248","resolution":{"observed_at":"2026-08-12T15:29:41.854864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.703386Z","title":"Automatic LQR tuning based on Gaussian process global optimization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.703386Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:e1d9ef00884a99a05583e0080a38b0728afd61b234c017c6e7da6e2b829578bf","observation_id":"0d3f4eeb-1e8d-4a64-933d-bf57b9c4d6ef","resolution":{"observed_at":"2026-08-12T15:29:40.703386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.707069Z","title":"Automatic tuning for data-driven model predictive control,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.707069Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:0361a0dd83081957c177327849f823843f37822154551480c8c78b5102513723","observation_id":"591c9f47-06f2-49d1-b6fc-4c28521f9c71","resolution":{"observed_at":"2026-08-12T15:29:40.707069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.836943Z","title":"Bayesian optimisation for robust model predictive control un- der model parameter uncertainty,","venue":null,"work_id":"dc4985f3-f9a4-425f-b423-29999656bf1d","year":2022},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.711061Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:bc83031c78baa242b7ed8673ca22713ccd9c0c6ce73facddae259548c263c26d","observation_id":"96a651ea-63d4-40fe-8587-132c5ebe03fa","resolution":{"observed_at":"2026-08-12T15:29:41.841914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.716039Z","title":"Computing the racing line using Bayesian optimization,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.716039Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:9bc7f4c5abe34324739fc6865c90df5662a24ad5f75b41cf81817d5294b22407","observation_id":"d26358e4-58a4-48b5-bffe-ed94894eb9c0","resolution":{"observed_at":"2026-08-12T15:29:40.716039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.719630Z","title":"Learning by demonstration and robust control of dexterous in-hand robotic manipu- lation skills,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.719630Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:4e1d708eca8eaa0c1c8fca0e41b7bc7ce8164cd22eccba305391b2f0fe3d6f2a","observation_id":"1b021aac-5c6f-40e0-917e-7e9380ae1791","resolution":{"observed_at":"2026-08-12T15:29:40.719630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.823820Z","title":"Deep black-box reinforcement learning with movement primitives,","venue":null,"work_id":"6d92b711-b4c1-4f7b-a641-83e938a057c1","year":2023},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.723411Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:585f9a8aca71ce18622221e4d30bd56959a2089fb025b52aa3a40f3081958bbd","observation_id":"0dd6725d-2b85-40b6-853f-51d057ef70ce","resolution":{"observed_at":"2026-08-12T15:29:41.829043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.811393Z","title":"PILCO: A model- based and data-efficient approach to policy search,","venue":null,"work_id":"4792e919-9bf6-4688-b245-5b9b5db50a33","year":2011},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.728258Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:2d5d3501e6e181b6f3128e738dd00130d9cd36354acda5e7f532206963148e12","observation_id":"0fe9d78f-c443-4a07-9629-4357db549b68","resolution":{"observed_at":"2026-08-12T15:29:41.815430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.799273Z","title":"Deep reinforcement learning in a handful of trials using probabilistic dynamics models,","venue":null,"work_id":"6dde94db-aee0-4661-ab71-a951ed38a717","year":2018},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.731964Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:d244091bd187f0c2dcb953be006ce7df5e6a39ea9d12ab68b82904ade247bb7b","observation_id":"b621ba10-93eb-4912-b091-471cd2704b38","resolution":{"observed_at":"2026-08-12T15:29:41.803562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.786997Z","title":"Sample-efficient reinforcement learning with stochastic ensemble value expansion,","venue":null,"work_id":"0f202ee7-d704-4b14-8445-86d054efc5bb","year":2018},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.736080Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:36f03c6724beec061b82512bbece7d0f7970b0ccab25916b2b0a252e8bd5fa82","observation_id":"6bdb17c9-04c4-4af2-9757-257712103322","resolution":{"observed_at":"2026-08-12T15:29:41.791964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.775570Z","title":"When to trust your model: Model-based policy optimization,","venue":null,"work_id":"606c3d45-13e3-4f1f-a500-e18685c2d9bc","year":2019},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.739603Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:e2956f2cf3c77f598510365721af28055eb311b38ab27e39d834622c4a75d4cb","observation_id":"763ed34d-3a26-4aae-8544-631775c5d5be","resolution":{"observed_at":"2026-08-12T15:29:41.779465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.763080Z","title":"Data efficient reinforcement learning for legged robots,","venue":null,"work_id":"047968da-d129-4ad8-84a0-a46a3f1dcaf4","year":2020},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.743059Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:39a977f84b85e251eeefd56c14d489f5f4b9fa97d65d5e93dfbe75f7bf2bd897","observation_id":"6011d745-857c-45cd-9f8c-6fe9aad6f2f5","resolution":{"observed_at":"2026-08-12T15:29:41.767304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.747307Z","title":"Learning modular robot control policies,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.747307Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:2787ad9a602d4a58b63938124c458601a76010ed892a2bbbbf54b1807dcf6897","observation_id":"adfcefb4-0dc1-4201-8392-c35638763791","resolution":{"observed_at":"2026-08-12T15:29:40.747307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.751287Z","title":"Garnett, Bayesian Optimization","venue":null,"work_id":"b36a5ac1-9235-48d2-a1a2-73f7576c7916","year":2023},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.751378Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:2b36d56a53338221f6f36dd1f23b6b7c214ea6eadaea7352a9ea7a7da2df0744","observation_id":"a092624f-6504-4cd6-b82a-428036adbdb0","resolution":{"observed_at":"2026-08-12T15:29:41.755352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.738363Z","title":"Automatic gait optimization with Gaussian process regression,","venue":null,"work_id":"850d76c0-ef8f-4ee6-92a2-c22b80545a22","year":2007},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.755460Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:15efc14e965df09e3504e8b1d22f23e7f9370d609aa5b99da304839c20804c35","observation_id":"42e6cd61-6347-4e4e-af46-6d68a17529ad","resolution":{"observed_at":"2026-08-12T15:29:41.742719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.763956Z","title":"Virtual vs. real: Trading off sim- ulations and physical experiments in reinforcement learning with Bayesian optimization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.763956Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:d4bdd773e62c68a012325ed25a605ce1dcf54eb82eafd02c779e64eba09ca443","observation_id":"9fdd8248-87d3-47e5-8339-37a16d800655","resolution":{"observed_at":"2026-08-12T15:29:40.763956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.726675Z","title":"Local Bayesian optimization of motor skills,","venue":null,"work_id":"9c7c140b-fdf6-4e42-8981-3717e47c16b8","year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.768446Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:6781e0278240192a22d5174537a6e69229a10595356e9090792fc407ecdd21ff","observation_id":"41584dd8-e665-40ae-b92a-d9e5d1813540","resolution":{"observed_at":"2026-08-12T15:29:41.730439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.772121Z","title":"Domain randomization for transferring deep neural networks from simulation to the real world,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.772121Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:30462a6923ef75c997095ff7d618346c0f4a06ff05204ff1e4b803a4beda7a8c","observation_id":"a95212dd-daaf-4e8e-af70-8530ae1d9491","resolution":{"observed_at":"2026-08-12T15:29:40.772121Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.713385Z","title":"Robot learning from randomized simulations: A review,","venue":null,"work_id":"22cb518d-b91b-4ca2-95cc-5d3ff667dd25","year":null},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.775777Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:7db4ddecbf7306e0bab23580c7fd4270870c3ecb82491f0939f3241bcc24b767","observation_id":"3dce94f0-4523-480f-a72d-6d05b6f220c7","resolution":{"observed_at":"2026-08-12T15:29:41.717670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.700564Z","title":"Rasmussen and C","venue":null,"work_id":"f0548fb5-9f33-4882-b4d1-6663f8d0044a","year":2006},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.784949Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:e6e980a3899f7b43bf301f51ab4e6a45127981cec94b30a702e286ad75538275","observation_id":"473f6e8b-ca05-4228-a6d4-ca3fef2eb017","resolution":{"observed_at":"2026-08-12T15:29:41.704902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.686793Z","title":null,"venue":null,"work_id":"21aca844-af09-4397-bff3-71cec1709e86","year":1987},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.788328Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:8145cee5c57c85c3b0a93724baad71de5d22e6150a39d2f0e95fe4783315ea06","observation_id":"320994a6-2c3b-4fb6-914c-831c44e63f68","resolution":{"observed_at":"2026-08-12T15:29:41.691349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.674571Z","title":null,"venue":null,"work_id":"5ae41490-624d-412c-89a1-e785e3f507e4","year":2020},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.792200Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:3cfac751e3db0d0cf3987b1a74d5a9500b18ed78002174aab580bfed07278e90","observation_id":"03719e0b-9138-4896-bd79-3ca2dfd10a72","resolution":{"observed_at":"2026-08-12T15:29:41.678825Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.661053Z","title":"Multi- information source optimization,","venue":null,"work_id":"583b7bc2-6345-4c05-b628-3543e4f4d8f3","year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.795656Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:bbaec3104b1f6d140c1f79650ddadbcb6cde44c8349821ae7f41c53c25202cfc","observation_id":"6182c494-b2e6-4da2-81d1-47abfbfdee82","resolution":{"observed_at":"2026-08-12T15:29:41.665546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.644940Z","title":"Efficient global optimization of expensive black-box functions,","venue":null,"work_id":"0661dfac-f841-4374-9818-4846120f9c55","year":1998},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.799099Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:42f1d47374c6e5fca2131447e1c60943cb30c93cfdbaea8b81bf45ec7f04f34f","observation_id":"6e107953-93c5-4375-a156-d1247eff033c","resolution":{"observed_at":"2026-08-12T15:29:41.650146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.632526Z","title":"Simple random search of static linear policies is competitive for rein- forcement learning,","venue":null,"work_id":"06a1680f-dd2d-4923-b746-7abd23ec4940","year":2018},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.802351Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:91059e1e62bf23121f0e9aa9630c9dff073b53e3bd3e66ac1738815248cb545d","observation_id":"bc1a5150-8a52-4ac7-936a-b0a68f60e95e","resolution":{"observed_at":"2026-08-12T15:29:41.637024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.619182Z","title":"Entropy search for information-efficient global optimization,","venue":null,"work_id":"bfa72052-627e-4aed-a03c-2aeec361a4b4","year":2012},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.805473Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:6a309e02625e5fd73283668e4f88bc16b4dc3b782f275b0df0adaff4056516fd","observation_id":"9a1831f7-4f87-47a3-8ee4-f833a2f2a377","resolution":{"observed_at":"2026-08-12T15:29:41.622908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.604846Z","title":null,"venue":null,"work_id":"6ad5b8be-a35f-4dd5-aefe-a5aeb925917c","year":null},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.809077Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:ccaedbc31066c36b685dcf98bc2e7fc61c0b4653989709f9f1d165c39eaa648c","observation_id":"5f9b1e75-6f4f-4776-9545-6134375a6b4c","resolution":{"observed_at":"2026-08-12T15:29:41.609298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.590062Z","title":"Deep neural networks for improved, impromptu trajectory tracking of quadrotors,","venue":null,"work_id":"c6a1061d-c6a3-42e0-8359-f4fb5c7a8ee3","year":2017},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.813068Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:2e0b4bbb2f5dfff17dd89f8c77354eab92a7c898c82403c15aa84c7c157c12a4","observation_id":"dad6e46d-1403-4615-81b2-7aa06d67b846","resolution":{"observed_at":"2026-08-12T15:29:41.595331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.575727Z","title":"Learning from demonstration,","venue":null,"work_id":"59d60d8f-5071-430a-bd7d-5429685fdedd","year":1996},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.816966Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:1b69b26dad71178a43392e78e66676c5ebdf777f45f03c42b9b8a6df88212a0e","observation_id":"8f602c73-7ee4-4ca4-8339-a90fd2946b29","resolution":{"observed_at":"2026-08-12T15:29:41.580927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.560875Z","title":"Dynamical movement primitives: Learning attractor models for motor behaviors,","venue":null,"work_id":"11075f88-5817-41e4-80c6-3ec8ff0a82e7","year":2013},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.820994Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:c067cd5b34b0cca84f6c876c14d792c32e1536c842e1820e53c49e49a23b1a82","observation_id":"d1608eec-9159-45c5-8b12-d274a61baa87","resolution":{"observed_at":"2026-08-12T15:29:41.565313Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:41.544313Z","title":"The be- havior and convergence of local Bayesian optimization,","venue":null,"work_id":"02e3e091-195a-4064-bf52-f3ae8c443ed5","year":2023},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.825180Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:321a3d31642252b4c6206e6f2a46905991a164989dac111044da11d2c7953084","observation_id":"6c98789d-d8ef-407c-9e79-15256541fe2e","resolution":{"observed_at":"2026-08-12T15:29:41.550213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.781179Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.781179Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:69f6d39f4fbf1a32fc8d92fdab0f9dbe050df0e1c28a5df50ec257a1a28d16bc","observation_id":"d145925e-1e84-4770-a68e-d20d5ebdb204","resolution":{"observed_at":"2026-08-12T15:29:40.781179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:29:40.677742Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning","version":1},"reference_index":3810,"source":"pdf_text","source_observed_at":"2026-08-12T15:29:40.677742Z"},"links":{"citing_paper":"/paper/2411.14246"},"observation_digest":"sha256:610dc0fa656eb3f40eed765782d7da49a3c477f965c521cfb716cb86ebceda0c","observation_id":"88972a25-d739-41de-9e62-6ba972aab61d","resolution":{"observed_at":"2026-08-12T15:29:40.677742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.14246","last_updated":"2024-11-21T15:52:23Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-12T18:38:28.725077Z","submitted_at":"2024-11-21T15:52:23Z","title":"Simulation-Aided Policy Tuning for Black-Box Robot Learning"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2411.14246."}