{"as_of":"2026-08-17T19:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:31bdc545bd3be8bb6f42162ab6ff71bc0619b08de64f313b11b6a68e2cde7227","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:34:47.753469Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:24:01.004152Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T20:52:37.979699Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17857","snapshot_observed_at":"2026-08-15T16:24:01.004152Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.06342","last_updated":"2026-07-31T11:13:35Z","snapshot_observed_at":"2026-08-17T13:43:07.835064Z","submitted_at":"2025-09-08T05:32:28Z","title":"Towards bridging the gap: Systematic sim-to-real transfer for diverse legged robots","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:24:01.004152Z"},"links":{"cited_paper":"/paper/2504.17857","citing_paper":"/paper/2509.06342"},"observation_digest":"sha256:399ed86d0209e785710fc906af33bcdd83cab06a9d6f32daaea9a0e084e2feea","observation_id":"e639ffae-9b1f-45cd-9c1f-a2c2a1045d61","resolution":{"observed_at":"2026-08-15T16:24:01.004152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"cited_work":{"arxiv_id":"2504.17857","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.17857","snapshot_observed_at":"2026-06-28T20:52:37.979699Z","title":"High-performance reinforcement learning on spot: Optimizing simulation parameters with distributional measures","venue":null,"work_id":"0057d9a2-d91d-41f5-8ff5-3ed97831d82f","year":2025},"citing_paper":{"arxiv_id":"2511.04831","last_updated":"2025-11-06T21:43:02Z","snapshot_observed_at":"2026-08-16T09:41:41.700782Z","submitted_at":"2025-11-06T21:43:02Z","title":"Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-11T10:22:52.472354Z"},"links":{"cited_paper":"/paper/2504.17857","citing_paper":"/paper/2511.04831"},"observation_digest":"sha256:8dc9ad2ba898dd835784eac7324e09c3a2743005493b13c9d65ffeb82bd3a966","observation_id":"6063e40d-8e20-4b72-ae92-a7416c55c41e","resolution":{"observed_at":"2026-05-11T10:22:52.729902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17857","snapshot_observed_at":"2026-08-03T19:16:27.534748Z","title":"High- performance reinforcement learning on spot: Optimizing simulation parameters with distributional masures.arXiv preprint arXiv:2504.17857,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.01467","last_updated":"2026-06-08T10:55:45Z","snapshot_observed_at":"2026-08-13T23:10:54.185288Z","submitted_at":"2025-12-01T09:50:04Z","title":"Differentiable Weightless Controllers: Learning Logic Circuits for Continuous Control","version":2},"reference_index":1994,"source":"pdf_text","source_observed_at":"2026-08-03T19:16:27.534748Z"},"links":{"cited_paper":"/paper/2504.17857","citing_paper":"/paper/2512.01467"},"observation_digest":"sha256:6bf5bed2fc5eb3510387b1defe5fb9bdb0d8fa1b3b3ef72ae3e0d896448d403e","observation_id":"838aa872-209c-4534-93c4-d353e38d1a9b","resolution":{"observed_at":"2026-08-03T19:16:27.534748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"cited_work":{"arxiv_id":"2504.17857","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.17857","snapshot_observed_at":"2026-06-28T20:52:37.979699Z","title":"High-performance reinforcement learning on spot: Optimizing simulation parameters with distributional measures","venue":null,"work_id":"0057d9a2-d91d-41f5-8ff5-3ed97831d82f","year":2025},"citing_paper":{"arxiv_id":"2606.02636","last_updated":"2026-06-03T16:09:02Z","snapshot_observed_at":"2026-08-16T23:39:20.965188Z","submitted_at":"2026-05-30T22:17:04Z","title":"Too Much of a Good Thing: When sim2real Efforts Impede Policy Learning (And What to Do About It)","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T18:19:58.499360Z"},"links":{"cited_paper":"/paper/2504.17857","citing_paper":"/paper/2606.02636"},"observation_digest":"sha256:b42112c0151650e57262ce8f12d540ee4f68b31c9164148d4cf6ec543a1fcbec","observation_id":"b5ae5f6f-f69c-4512-a5bb-dc682dbf926c","resolution":{"observed_at":"2026-06-28T20:52:37.981273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.17857/citation-record","integrity":"/paper/2504.17857/integrity","json":"/paper/2504.17857/citation-record.json","paper":"/paper/2504.17857"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.406575Z","title":"Boston Dynamics","venue":null,"work_id":"f7c7e517-677b-4b28-9f0a-c2da0f185fe4","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.538221Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:9607a0f6e0537ab52476274fb830f6be9f08d03307f3db37a9d5f5110ae312d9","observation_id":"e61ff5ab-66e9-4618-8597-bf3017b09f78","resolution":{"observed_at":"2026-08-16T10:34:48.411403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.392457Z","title":"[Online]","venue":null,"work_id":"8e54cc6a-98b7-4a35-a099-bf36136e718e","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.543045Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:96ca1ed8f36f68b1b24406d379d3f9e601b90fc89804a9eace33d1dc2f7649a7","observation_id":"7774cf65-9bda-43bf-b3b2-c004f6d83d8c","resolution":{"observed_at":"2026-08-16T10:34:48.396805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.379134Z","title":"[Online]","venue":null,"work_id":"11f1c42b-3d1e-46ad-90d6-94b92c64fc64","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.547576Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:4db39cc40616cb3f6358eed330b9df1c218c8d17248b1c8e734459826699c5bd","observation_id":"ed60f90b-b5c2-4084-838e-0bc9aa3480b3","resolution":{"observed_at":"2026-08-16T10:34:48.383449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.366247Z","title":"Boston Dynamics","venue":null,"work_id":"4139b688-9cab-444e-a068-fa2236a98f6e","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.552155Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:18aa6a54e93c058407fdcb85b7dddc1a5e73f0b55f0bcec3b563315097e05413","observation_id":"1c883275-e383-4160-b831-64994ac3c5b4","resolution":{"observed_at":"2026-08-16T10:34:48.370259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.352828Z","title":"Boston Dynamics","venue":null,"work_id":"06c90f01-ed82-40a6-9a87-8b08bca89132","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.556512Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:784593bb94558227e08dcc5eb847d82907aa7b238f7c50460ce6cd97bca430cb","observation_id":"5d3dc23e-8b22-4b2f-aa6a-040e26202fd7","resolution":{"observed_at":"2026-08-16T10:34:48.356804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.339379Z","title":"Domanico","venue":null,"work_id":"735dd830-7049-4fb6-8287-0ca44a1c504b","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.560845Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:d7093d7147c54f39e9997daa9d6d0bec951dd168916b981c6372a5d628eee72c","observation_id":"4f047921-8809-4a90-adbe-1e7ff639c2b0","resolution":{"observed_at":"2026-08-16T10:34:48.343828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.565641Z","title":"Mit cheetah 3: Design and control of a robust, dynamic quadruped robot,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.565641Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:aaa6e5fe47e36986ef949b25786d994ec8071a454c88090949e047450d0e5706","observation_id":"73935ede-48d0-4ed3-9b23-039366f5e8e3","resolution":{"observed_at":"2026-08-16T10:34:47.565641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.315346Z","title":"Design of hyq–a hydraulically and electrically actuated quadruped robot,","venue":null,"work_id":"5c60b52e-222e-4981-bcce-ef5b5a092db4","year":2011},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.569930Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:06bb1a72a14cc7452b4cdb95ed442d691c9576b7701c05d146cc5e6b5326a8f3","observation_id":"1b6819f2-77d3-4612-91ec-bffebaf95991","resolution":{"observed_at":"2026-08-16T10:34:48.319891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.574149Z","title":"Anymal-a highly mobile and dynamic quadrupedal robot,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.574149Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:b5a06dbf78b96b8fa0aeb50b8a7601eccc1eabf461768da564d28743ed914ad6","observation_id":"2b648160-cc1b-41ae-a9c6-847b72d5b67e","resolution":{"observed_at":"2026-08-16T10:34:47.574149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.578428Z","title":"Dynamic locomotion in the mit cheetah 3 through convex model-predictive control,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.578428Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:8dc2bee49b604a20eb26c221e554671ae39879c0290f63678b2ce66b119d6c8f","observation_id":"dc16cc9b-ca55-48c5-a45f-6bb86780305b","resolution":{"observed_at":"2026-08-16T10:34:47.578428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.582616Z","title":"Real-time motion planning of legged robots: A model predictive control approach,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.582616Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:7b71a866f8637c2c495788965de96d5ed821368961358748c60b042097d378e8","observation_id":"46a0d6ca-f1ef-424f-b4c2-ab0797450502","resolution":{"observed_at":"2026-08-16T10:34:47.582616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.587107Z","title":"Dynamic locomotion and whole-body control for quadrupedal robots,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.587107Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:48bdd0865056ef6efd7b26d5c38fbaf70b4bafdb008ffffd009f05ebb14d26c0","observation_id":"b58594b9-4b87-4611-a85a-8d68afc8b126","resolution":{"observed_at":"2026-08-16T10:34:47.587107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.591881Z","title":"Learning agile and dynamic motor skills for legged robots,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.591881Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:614afdfeef52840d3fcd025b92355e2f8fbee77db36e01c95059e8094b6390a5","observation_id":"5b5cc935-673c-427b-88c1-6649c7f2e872","resolution":{"observed_at":"2026-08-16T10:34:47.591881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.596150Z","title":"Rapid locomotion via reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.596150Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:fa9cb465ea0a6e181a467abc67884c51436117b80da58923fa57f54e33c37953","observation_id":"d20d3d53-af5c-4156-b085-43a4a629459c","resolution":{"observed_at":"2026-08-16T10:34:47.596150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.600414Z","title":"Anymal parkour: Learning agile navigation for quadrupedal robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.600414Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:f7c32f1d0ba38f66bb74de9106a610b0766cf278e8eb06aa264967b6a7c4d8cf","observation_id":"deff04f7-7ad5-44d7-b42c-ba39b2088ed7","resolution":{"observed_at":"2026-08-16T10:34:47.600414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.604641Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.604641Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:dec464077eba6f7e9f26f703356cf7ce6c33c966cc38abc5d646b330759de0c0","observation_id":"417664b8-92aa-4cbe-8dde-29c3f73ca7a1","resolution":{"observed_at":"2026-08-16T10:34:47.604641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.608817Z","title":"Concurrent training of a control policy and a state estimator for dynamic and robust legged locomotion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.608817Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:b7e12429b002f75a001c1e91fe51c96c67d78e341a6fa403147216fa61407b7d","observation_id":"5033f84a-1c45-410b-a37c-54d7e69efbef","resolution":{"observed_at":"2026-08-16T10:34:47.608817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04034","last_updated":"2021-07-08T17:59:59Z","snapshot_observed_at":"2026-08-15T19:30:43.427473Z","submitted_at":"2021-07-08T17:59:59Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04034","snapshot_observed_at":"2026-08-16T10:34:47.612791Z","title":"Rma: Rapid motor adaptation for legged robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.612791Z"},"links":{"cited_paper":"/paper/2107.04034","citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:adcf41f1e7bc2fc7dea90b06abf6bfc2fcc9f814ccec8faa7f54d1a34b9aee31","observation_id":"48f4a069-af48-44b5-9cb2-9e58d9caf3db","resolution":{"observed_at":"2026-08-16T10:34:47.612791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17507","last_updated":"2023-12-29T08:03:27Z","snapshot_observed_at":"2026-08-16T14:30:58.645790Z","submitted_at":"2023-12-29T08:03:27Z","title":"Actuator-Constrained Reinforcement Learning for High-Speed Quadrupedal Locomotion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17507","snapshot_observed_at":"2026-08-16T10:34:47.617273Z","title":"Actuator-constrained reinforcement learning for high-speed quadrupedal locomotion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.617273Z"},"links":{"cited_paper":"/paper/2312.17507","citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:fc900bb63ef2509d66d925527b0693450fa4fe39bad6968720730e1fc4a4f461","observation_id":"906b9c94-ca0f-4fde-bedb-4ccdfef34546","resolution":{"observed_at":"2026-08-16T10:34:47.617273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.222497Z","title":"Robot learning from randomized simulations: A review,","venue":null,"work_id":"1d11b14d-236b-4859-8feb-cc029f262610","year":2022},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.622197Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:3fe4f9837f1436f7b0c52eeb12e8bbdffc9735d2e908ac0c3a95c7b6edf9fa51","observation_id":"39260b76-9595-4cac-b214-f5fdeba013b8","resolution":{"observed_at":"2026-08-16T10:34:48.226924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.209389Z","title":"Feedback control for cassie with deep reinforcement learning,","venue":null,"work_id":"f37f1d2c-0355-4265-a497-e10ef4b8315a","year":2018},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.626732Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:4fa30c0c0bbaa41986269cfa0540f3f2ba0dad119dbf83397df80bf9da73e8da","observation_id":"b2f1eeca-cc06-409a-9e90-d8f9432ae4ed","resolution":{"observed_at":"2026-08-16T10:34:48.213573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.194838Z","title":"Policy transfer via kinematic domain randomization and adaptation,","venue":null,"work_id":"cbad2a48-1e10-452c-8c99-c5cff956c4b4","year":2021},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.631040Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:d00d3ba2bbe0d7815540161ac343c15439264f9298d7b3f36267bca0c0c6d48c","observation_id":"946f0d13-1d8b-4e6c-8e7c-04d7f0aa05a7","resolution":{"observed_at":"2026-08-16T10:34:48.199252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.635069Z","title":"Reinforcement learning for robust parameterized locomotion control of bipedal robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.635069Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:27d7a07c1b03a96a2d8c09dae10fa15c086652e27951b5810711ab05170b7003","observation_id":"9de06589-a0b0-4f0d-aa98-e66b38f52adb","resolution":{"observed_at":"2026-08-16T10:34:47.635069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.172456Z","title":"Sim2real transfer for reinforcement learning without dynamics randomization,","venue":null,"work_id":"be9e3857-a33d-4b36-b226-5e84f7bb650f","year":2020},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.639416Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:19e0b1308bf3d100ecee0e752c032f9264f4c1a48b3f6a0d1caae868fc6c3c9a","observation_id":"e417f7e4-5d7a-4a35-95b8-9331420e26f5","resolution":{"observed_at":"2026-08-16T10:34:48.176952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.158421Z","title":"Estimation of inertial parameters of rigid body links of manipulators,","venue":null,"work_id":"8c2fe6ba-7043-428c-83e5-f10db710723b","year":1985},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.644491Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:0cb1075147fcf7cb1c3440a52be69bcc719df023bdd4a16438b98485170d5d15","observation_id":"7536fa8d-0eff-4434-b1ce-27d3f1bfb68a","resolution":{"observed_at":"2026-08-16T10:34:48.162613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.144462Z","title":"Geometric robot dynamic identification: A convex programming approach,","venue":null,"work_id":"5d0dd744-b4bf-4a48-a91f-f63b4d75fb8f","year":2019},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.649434Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:40e025e43604d0754849e86ba50dc00e03fe6abd611e5178ed1cd2e74a0e9596","observation_id":"74afa7bc-cb13-43c1-a9ab-46699c4ad9ed","resolution":{"observed_at":"2026-08-16T10:34:48.148935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.653314Z","title":"Pros and cons of gan evaluation measures,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.653314Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:952a0c61b5a15f85a9dd0f960cef02fde8c5593b8beb359a24676229f1b559e6","observation_id":"e986502e-b79d-4e7a-8b63-75c0cc8433e3","resolution":{"observed_at":"2026-08-16T10:34:47.653314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.122154Z","title":"The wasserstein distance and approximation the- orems,","venue":null,"work_id":"abf8d600-8fa6-4d59-aa1f-bf8bf5d3c09d","year":1985},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.657562Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:8259202b2103768b35b11adc2bbd1fa0918a0d479cd3322759f526b818413292","observation_id":"81ced21a-467d-4979-acd4-3326aed28374","resolution":{"observed_at":"2026-08-16T10:34:48.126874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.03906","last_updated":"2015-05-14T22:18:42Z","snapshot_observed_at":"2026-08-15T17:58:23.647881Z","submitted_at":"2015-05-14T22:18:42Z","title":"Training generative neural networks via Maximum Mean Discrepancy optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.03906","snapshot_observed_at":"2026-08-16T10:34:47.661621Z","title":"Training generative neural networks via maximum mean discrepancy optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.661621Z"},"links":{"cited_paper":"/paper/1505.03906","citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:6edef980949604b24d604095bc2751c49b23123d1ea78e4bf6c04a0e9de02589","observation_id":"6d0b83f9-3719-4d27-9414-8866faa2c88b","resolution":{"observed_at":"2026-08-16T10:34:47.661621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.665981Z","title":"Amp: Adversarial motion priors for stylized physics-based character con- trol,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.665981Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:f49902bbf4b6ea0a05e4dc806b515761a209e8f4d40144837ae9335bdcb041f3","observation_id":"6d31e23f-2c8c-4f11-837d-296c72fa2e93","resolution":{"observed_at":"2026-08-16T10:34:47.665981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.099450Z","title":"Learning agile skills via adversarial imitation of rough partial demonstrations,","venue":null,"work_id":"518ef4f8-0a17-4752-a0ef-0048ceec6047","year":2023},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.669939Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:d2d3a590327a406fb55c78cc40a202a67e08ce29f85277283083f598613ad320","observation_id":"7de43baa-1f93-4ac1-b8aa-971bd91a5440","resolution":{"observed_at":"2026-08-16T10:34:48.103810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.085735Z","title":"Knowl- edge transfer across imaging modalities via simultaneous learning of adaptive autoencoders for high-fidelity mobile robot vision,","venue":null,"work_id":"937b1bff-1b30-401c-8e8f-b301d3a72c53","year":2021},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.673984Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:8059e9044cfec021c61a18b99b38bc69e2716cf7f9281494625fb0882486cd10","observation_id":"9c1c3968-96e1-49ee-b1de-a143b6686173","resolution":{"observed_at":"2026-08-16T10:34:48.090179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.072464Z","title":null,"venue":null,"work_id":"8fd9b421-6d90-4d63-80e9-9eab6f265a12","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.677924Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:f9f1df5fca80504e1f94b4ec245db33c1195a2f8ef5727bf089e6365d3ea7790","observation_id":"2273d16f-747e-4771-94a7-a9911bdf7c8e","resolution":{"observed_at":"2026-08-16T10:34:48.076505Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.058748Z","title":"About the nyquist frequency,","venue":null,"work_id":"6af17587-1281-4b73-b6e3-80512bb90d83","year":2005},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.682130Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:8ff8875e755c3d6e59721749e3aec7e12560d1a626387ef920d080542b0f7e60","observation_id":"7b4ecbfe-a42b-410b-9fd9-cde075b119d1","resolution":{"observed_at":"2026-08-16T10:34:48.062953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.045242Z","title":"Simulation-based design of dynamic controllers for humanoid balancing,","venue":null,"work_id":"60d800f6-04a9-424a-b8ad-f861ef68ba33","year":2016},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.686263Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:6a79f2572ea16381a54c3a93e75d574aa3a12a093671006dcf01e21b56a540a8","observation_id":"429ececc-51bf-41b6-a2ce-6624231d878f","resolution":{"observed_at":"2026-08-16T10:34:48.049548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10332","last_updated":"2018-05-16T20:35:34Z","snapshot_observed_at":"2026-08-14T19:21:23.179705Z","submitted_at":"2018-04-27T03:42:55Z","title":"Sim-to-Real: Learning Agile Locomotion For Quadruped Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.10332","snapshot_observed_at":"2026-08-16T10:34:47.691450Z","title":"Sim-to-real: Learning agile locomotion for quadruped robots,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.691450Z"},"links":{"cited_paper":"/paper/1804.10332","citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:17b1b4a98c01c19b2f919bd218011a2436dfaae3d032fe97e73e4a8cdac97c80","observation_id":"10abcb00-3956-4279-8f7e-f767af486008","resolution":{"observed_at":"2026-08-16T10:34:47.691450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.031004Z","title":"Sim-to-real via sim- to-sim: Data-efficient robotic grasping via randomized-to-canonical adaptation networks,","venue":null,"work_id":"ddde2586-8856-482f-b3f3-b8c070598c10","year":2019},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.695910Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:4bb91489509b9195313f636372c65a19dfc7a7981450107537cde597b61de63f","observation_id":"4509a04b-f695-4743-acba-78c3c3bcf1c4","resolution":{"observed_at":"2026-08-16T10:34:48.035832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.017409Z","title":"Learning inertial odometry for dynamic legged robot state estimation,","venue":null,"work_id":"4625a661-5cf3-4cfd-9955-61c263a929e6","year":2022},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.699791Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:f812416bd42bc0676e28e9af9e0bd737f0fa4580f2ce3c4401073512894bad48","observation_id":"bfb76f5e-d700-4dc6-a6ff-29b7ac6cc24d","resolution":{"observed_at":"2026-08-16T10:34:48.022122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:48.004074Z","title":"Starleth & co.: Design and control of legged robots with compliant actuation,","venue":null,"work_id":"2ce01856-a8d1-4a5b-b93b-b4b9e7889a78","year":2013},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.703807Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:67ca8e700ec9254c1beaad5af211a7d92777383d94656118f700d2781b38a859","observation_id":"3961aa89-e1a9-4086-a0bf-379f9e5c9795","resolution":{"observed_at":"2026-08-16T10:34:48.008451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.990528Z","title":"Mini cheetah: A platform for push- ing the limits of dynamic quadruped control,","venue":null,"work_id":"25e9742e-9d35-4aae-bc30-8e53c7d65016","year":2019},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.708190Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:4e77ec0327d961e917d0ada6d6f8476c04b231d615c67c128940c7d4ae929e47","observation_id":"4497228d-2a20-4b47-9ed8-f3660a537a1a","resolution":{"observed_at":"2026-08-16T10:34:47.994744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.976148Z","title":"Tutorial cma-es: evolution strategies and covariance matrix adaptation,","venue":null,"work_id":"5312d9e9-6b46-4baa-b403-57746ccaae2b","year":2012},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.712382Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:52d344125c314440194944851f2b623cdb172025d714b84decd0a68d792d4ef5","observation_id":"8e6a2a03-3b43-4c1b-ac64-a90bc8b10896","resolution":{"observed_at":"2026-08-16T10:34:47.981037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.04460","last_updated":"2020-11-09T16:45:32Z","snapshot_observed_at":"2026-08-09T09:32:19.536383Z","submitted_at":"2020-08-11T00:10:44Z","title":"Hardware as Policy: Mechanical and Computational Co-Optimization using Deep Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.04460","snapshot_observed_at":"2026-08-16T10:34:47.716277Z","title":"Hardware as policy: Mechanical and computational co-optimization using deep reinforcement learn- ing,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.716277Z"},"links":{"cited_paper":"/paper/2008.04460","citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:f863620465ab27abcf828c80a4a73c32a0365b858d3949eabe5faf01252c59db","observation_id":"76afa3df-c89e-4642-a686-86da959f8d09","resolution":{"observed_at":"2026-08-16T10:34:47.716277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.962663Z","title":"Simulation aided co-design for robust robot optimization,","venue":null,"work_id":"1a70f327-de82-4984-bd16-f6c6ccc25ff6","year":2022},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.720532Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:edd614a48cb4a65fc448274d0af80328d71c228176dcebc314b95a217f27a8c1","observation_id":"e607d970-232d-41ff-9a15-2775bd4149d5","resolution":{"observed_at":"2026-08-16T10:34:47.967050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.949645Z","title":"Multiple task optimization with a mixture of controllers for motion generation,","venue":null,"work_id":"2671cadb-1bb0-4864-a0ab-60743703bb28","year":2015},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.724837Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:89ba45d8078080dda6be2719aa9f5a69db419e3c79c7029cae45c7937944fef4","observation_id":"6279070a-1439-48a6-8091-fb8832c85d54","resolution":{"observed_at":"2026-08-16T10:34:47.953762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.935485Z","title":"Kicking motion planning of nao robots based on cma-es,","venue":null,"work_id":"9ba3b7c7-fbe0-4474-8621-4c927019983b","year":2015},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.728992Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:755cd4e77cf56292afebe6ff0353d34cfab8b646b6b0b095d38b412130d3482f","observation_id":"6e58ba1b-feab-4aec-860c-e158e77d7edf","resolution":{"observed_at":"2026-08-16T10:34:47.939834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.921308Z","title":"Orbit: A unified simulation framework for interactive robot learning environments,","venue":null,"work_id":"6a5d8819-6cfd-4a8c-b167-1880aa4cfc71","year":2023},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.732837Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:9d298b20efef214e603c3bf4e26c665e90c8455c966f9cad6a42774f01d08ec6","observation_id":"c56abdfb-0489-4bd7-9572-4f3ed61b6120","resolution":{"observed_at":"2026-08-16T10:34:47.925595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.907852Z","title":null,"venue":null,"work_id":"aa5207df-6914-4f6b-99de-ba97242616e4","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.736865Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:944ef2772fc79efb02be68a084ae7a30d574824e2575e549044e28ec9d62ba57","observation_id":"baa34c9d-8544-4d04-9c62-667c1b05e36f","resolution":{"observed_at":"2026-08-16T10:34:47.912271Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.894416Z","title":"Robotic Systems Lab","venue":null,"work_id":"653f2e4b-63d2-4815-8e61-e2968c554b86","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.740872Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:595f8b3179d371911ce8ee4c3e199afa5ef8c8617052289d64000606c8d9050d","observation_id":"6981ee42-a225-40d3-8c70-094b3dae6763","resolution":{"observed_at":"2026-08-16T10:34:47.898554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.880086Z","title":"A survey of actor-critic reinforcement learning: Standard and natural policy gradients,","venue":null,"work_id":"ea53736c-3432-4466-903f-23f2a0f3f849","year":2012},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.744956Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:2cd4d3b26792442f407511554d46a68f9ff8c74ff01c7290cc8d3c00d0ab56bb","observation_id":"3dd07f4a-83f6-403f-8402-b50dcc8481eb","resolution":{"observed_at":"2026-08-16T10:34:47.885185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-16T10:34:47.749086Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.749086Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:569008973e450a2a81aeee7a239499d26cf3af0354a26bdec4e8cc49dcb0cd88","observation_id":"b2ba19a0-92fa-4c33-8bf2-01320d3adc1f","resolution":{"observed_at":"2026-08-16T10:34:47.749086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:34:47.864963Z","title":"Boston Dynamics","venue":null,"work_id":"635d403b-c418-4352-95bb-2330d1826d99","year":null},"citing_paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T10:34:47.753469Z"},"links":{"citing_paper":"/paper/2504.17857"},"observation_digest":"sha256:9b2286993f52e99c5c261ac5c7e50cc668031fffb5c61205555d2f28eef25fcb","observation_id":"46ff918a-8c34-4863-bdd5-5b1a7408d52f","resolution":{"observed_at":"2026-08-16T10:34:47.870034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.17857","last_updated":"2025-07-03T05:14:46Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T10:28:33.389869Z","submitted_at":"2025-04-24T18:01:36Z","title":"High-Performance Reinforcement Learning on Spot: Optimizing Simulation Parameters with Distributional Measures"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":30},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 4 inbound Pith citation observations for arXiv:2504.17857."}