{"as_of":"2026-08-18T19:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d20c5a7ccee2ab1ebcf69258c27abe98a4d883133bd4b8c4d992ddf7022c602e","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:20:31.071434Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.00880/citation-record","integrity":"/paper/2608.00880/integrity","json":"/paper/2608.00880/citation-record.json","paper":"/paper/2608.00880"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.679857Z","title":"Bokser,et al., System Design of the Ultra Mobility Vehicle: A Driving, Balancing, and Jumping Bicycle Robot.arXiv preprint arXiv:2602.22118(2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.679857Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:10c693e65ac7e0232c4833e28b43b703fd44b42c156713df92f5350138c5b901","observation_id":"70b2668b-4eb0-41d0-b60e-b9399d260cb2","resolution":{"observed_at":"2026-08-15T15:20:30.679857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.684762Z","title":"Dynamics, Introducing Handle, Y outube video, https://www.youtube","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.684762Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:1e09b0b0b94f46c2d824084885bd4cb1ab688b3c34211556e1ad9842bcf96f12","observation_id":"3b509cd4-2b80-43ab-92b4-35d13831f685","resolution":{"observed_at":"2026-08-15T15:20:30.684762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.689325Z","title":"Kashiri,et al., Centauro: A hybrid locomotion and high power resilient manipulation platform.IEEE Robotics and Automation Letters 4(2), 1595–1602 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.689325Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c47d4c88d1601b7e111625ed5ed52cea58818367a9b0c20ac2a05e7adb0f94de","observation_id":"d38a7698-d32c-4a72-b409-3a3da3821ca8","resolution":{"observed_at":"2026-08-15T15:20:30.689325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.693438Z","title":"Klemm,et al., Ascento: A two-wheeled jumping robot, in2019 International conference on robotics and automation (ICRA)(IEEE) (2019), pp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.693438Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:686d8d4b4833fb3cd1ecbe6a1aadfee851588f3a67cc6ec8dc6aaf7b2f67d57b","observation_id":"1b5ccf1e-a306-4be1-ad88-954e62480803","resolution":{"observed_at":"2026-08-15T15:20:30.693438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.697418Z","title":"Bjelonic, P","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.697418Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:4c1662b575a2bb2ffc6361dc96bab456234fb2992266f16f518c7427347cfe95","observation_id":"84dff52e-09a0-4e61-8a52-4bb595f72e4d","resolution":{"observed_at":"2026-08-15T15:20:30.697418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.701278Z","title":"Bjelonic, V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.701278Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2e278f24fa4d7a4b3e07d06b91726ab5aba174b2fb95a79adac4d6836bcda439","observation_id":"c5d5da6b-33c6-4134-8b98-659e56ce5075","resolution":{"observed_at":"2026-08-15T15:20:30.701278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.705518Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.705518Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:d916967b2b3e2d3bd2919944346e7fb2cf736dc01f0ba8e8345e319817c9bde0","observation_id":"fd36f65b-8c0d-4843-a67b-9fc48cea6d28","resolution":{"observed_at":"2026-08-15T15:20:30.705518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.709458Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.709458Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:9ff5a0c81c0e11e813aaac41279172a2c61785a7755ba8f1ad1d9ddb9d9ab46f","observation_id":"fea9a12f-68fa-4ea4-9c6e-170035c44668","resolution":{"observed_at":"2026-08-15T15:20:30.709458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.713418Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.713418Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:73af64cfae6a59d67ac785f73f1b05c6c30250457aa4dfcabaca8b60586b715f","observation_id":"b2106733-1e37-4629-8ce2-7ee1b36efc12","resolution":{"observed_at":"2026-08-15T15:20:30.713418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.717404Z","title":"Astrom, R","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.717404Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3b3f92b9a2542d7dced167e02bf6ded76b69e1934b39dc571023f2a2b45ad899","observation_id":"d4c73f48-4023-40e8-bfb0-dd9c8cf4fd8c","resolution":{"observed_at":"2026-08-15T15:20:30.717404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.721505Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.721505Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:f19c0a3fb7f66e827c61db8138afa7eee24d1f698eff3e67c946dd0f30181f9e","observation_id":"1cec8c81-68e3-4cdb-9f9b-bdd261f28a4b","resolution":{"observed_at":"2026-08-15T15:20:30.721505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.725427Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.725427Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:701c71cbdc59279cd653ceb144f3def869f4837dbd9ae36a1d9151745dbaff64","observation_id":"335d983f-9da6-4814-8657-472244f71b31","resolution":{"observed_at":"2026-08-15T15:20:30.725427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.729299Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.729299Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2641aefece36e80d61ea8f313cbde70ea64997105a877edbc6a2a5a2f7a02002","observation_id":"372974be-9b9c-483c-8697-a5f9b8c44a90","resolution":{"observed_at":"2026-08-15T15:20:30.729299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.737279Z","title":"Xiong, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.737279Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:6e3de1bde2bb43c9198800062ab108488193ff6ca4608130182af484f2a55381","observation_id":"463e6cf4-e373-4b66-8390-046c4d1339eb","resolution":{"observed_at":"2026-08-15T15:20:30.737279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.741311Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.741311Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:4c7d7c107f676b645ffca39e06529980ec0bc11581dd3d6e81a6b2f672908fae","observation_id":"c244d780-bb11-4a8d-8947-d27748bc2a78","resolution":{"observed_at":"2026-08-15T15:20:30.741311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.515116Z","title":null,"venue":null,"work_id":"b39a050b-4fd1-47c3-bb85-7b41bad4b060","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.745519Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:51a02a5a14e6243746ba9c285b244318509f3aaee61fcd7565bd459cc716abcc","observation_id":"a9031de8-321a-4b37-8699-cf5e0c4e4871","resolution":{"observed_at":"2026-08-15T15:20:32.519096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.502806Z","title":"Randløv, P","venue":null,"work_id":"f5ced35c-91d3-4cd0-af71-e0b51664e3ee","year":1998},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.750231Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8a4659ab367987bb65e1426eaa3449efcb73949e6e5e5b6d54c580adf3e198e9","observation_id":"1bda3074-1f84-4232-9864-fbd9b0548316","resolution":{"observed_at":"2026-08-15T15:20:32.507243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.490284Z","title":null,"venue":null,"work_id":"463c93d8-61be-4cb2-8000-3908200cdcd8","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.755896Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:803d47821f1ef343199d7ebc426269bdfafcff3fd1c4abe5c3fb44815557f434","observation_id":"376245e4-e372-415d-972b-c94562aaed0f","resolution":{"observed_at":"2026-08-15T15:20:32.494178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.478679Z","title":"Zheng,et al., Reinforcement learning-based control of single-track two-wheeled robots in narrow terrain.Actuators12(3), 109 (2023)","venue":null,"work_id":"06d6ab7b-03c8-4a1c-a3ce-213e9de06f5f","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.759881Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2571caf0837bb8ac1fe09c6884341064b59e6709922880d881845c2f6cc2287b","observation_id":"b6c54ef7-1a69-42ec-8165-22655658be5e","resolution":{"observed_at":"2026-08-15T15:20:32.482545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.467889Z","title":"Baltes, G","venue":null,"work_id":"5384f578-d340-4be6-a654-5219f510478e","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.763822Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:e693a5a2a23de8afffe0cf475ba53ddafea83b2649a59e10aa0084d8617f1050","observation_id":"948b6118-a193-462b-ba74-ec19e5c1b47f","resolution":{"observed_at":"2026-08-15T15:20:32.471862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.456036Z","title":"Zheng, D","venue":null,"work_id":"8c9798bb-e082-4987-b062-c3af68acc984","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.767922Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:d327133aaac713083adec83d2f000bcf9190c193f1f4c98868c40bca4c0e8606","observation_id":"990176fe-4387-45b5-b4f0-31e64c55a7c4","resolution":{"observed_at":"2026-08-15T15:20:32.459974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.444573Z","title":null,"venue":null,"work_id":"ef4d6812-7a86-4dbc-a21c-e0e386c67ae0","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.771806Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:e7df53f8d61cb6f5032a8e2a9a92eb92dc473809415e2604cd681ed6c58281e5","observation_id":"e815078e-98d7-4dab-901a-075f2a06f694","resolution":{"observed_at":"2026-08-15T15:20:32.448166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.434259Z","title":null,"venue":null,"work_id":"beb93c8e-eac9-4cff-bfa9-25dd2aac6ef3","year":2014},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.775689Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:4a39196cccc68f78fea75851b189f210bc21918bcc9b2218e8677fa2d72aa2c9","observation_id":"123e173e-0aa0-4be3-aa50-2b16d1a00463","resolution":{"observed_at":"2026-08-15T15:20:32.437816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.422048Z","title":null,"venue":null,"work_id":"1dcbcbae-3f52-4bf8-924d-9dc83e7a4985","year":1986},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.779676Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:50885401a47ec329232eb353dc01070dd2ff4eba7395ddb744cd45066219af87","observation_id":"ac1dff7c-be1a-43bb-8969-dce463d655c0","resolution":{"observed_at":"2026-08-15T15:20:32.426448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.408705Z","title":"Kuindersma,et al., Optimization-based locomotion planning, esti- mation, and control design for the atlas humanoid robot.Autonomous Robots40(3), 429–455 (2016),","venue":null,"work_id":"5ff76ab1-3894-476c-ae65-fe4d3b051406","year":2016},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.783677Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:0c665c96aabbe601c14e919fae0778c3e293a45e55cc4d689987c414afaa3540","observation_id":"c5a5028a-439c-41cf-9ee1-6346454771b8","resolution":{"observed_at":"2026-08-15T15:20:32.413834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.393319Z","title":"Di Carlo, P","venue":null,"work_id":"f51e972f-e7c4-442a-9828-a8d9f79ae8d0","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.787652Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:27b61d2856fd194474d7ffe42d699977eb6cfd573141bae9def36d3adb0bab5d","observation_id":"284f7c33-c429-4179-a331-de37abdc7aa2","resolution":{"observed_at":"2026-08-15T15:20:32.397291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.381749Z","title":null,"venue":null,"work_id":"bbed99d9-12bc-4bdc-8a6a-e3a8c94ffea6","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.791421Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3d5797dd108b251f704b3e02d32e655966861fd73b08fe1b9d8947faf98b0fe8","observation_id":"7e513410-0b09-49d3-84ee-c2a3acd23176","resolution":{"observed_at":"2026-08-15T15:20:32.385736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.370542Z","title":"Fahmi, C","venue":null,"work_id":"f49b0af8-0ae3-455a-a2b6-9b0af58eb4e9","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.795942Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:f2a5490ece8969ff2872c19bcdc617d0ddf6f3a32cb1dde0263385c04d4badc7","observation_id":"3d63ce7c-808f-43e2-8d46-f1fe23f3f4a6","resolution":{"observed_at":"2026-08-15T15:20:32.374169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.359022Z","title":"Rudin, D","venue":null,"work_id":"6ea41e02-940b-4978-a60f-08f4a222b2c1","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.799652Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:74363c7f9f090810072848e1984f7689f9ca5a099e89c9767158b87380019bd9","observation_id":"a1b1ca8f-4124-4ad1-88ce-224e6f56f02c","resolution":{"observed_at":"2026-08-15T15:20:32.362999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.346189Z","title":"Ha,et al., Learning-based legged locomotion: State of the art and future perspectives.Int","venue":null,"work_id":"61b9e0a0-a349-456a-9954-4187b0a183d8","year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.803509Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:bba9ae10da964b5b69dd972ca810ee703b308e727078628e280213c62069bbfa","observation_id":"3225f8f1-6b7a-45f1-b855-f41f5922ee7f","resolution":{"observed_at":"2026-08-15T15:20:32.350284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.334196Z","title":null,"venue":null,"work_id":"eea62c3e-f4ec-4b9d-b3b5-de43947ceeea","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.807383Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:802908175e1df7c4ebaae541aeb487e1d5b132f24e25d8f7bbc3091b14ecfaed","observation_id":"ccc3704e-344a-4257-9538-8934b30cdf6c","resolution":{"observed_at":"2026-08-15T15:20:32.337937Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.811235Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.811235Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:03cfca5848101f1a5500ad464c96ca7bf4671ca2a215fbabdb1079658c08f33e","observation_id":"ccad76a2-eb1e-4250-8db6-39962bca0064","resolution":{"observed_at":"2026-08-15T15:20:30.811235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.319775Z","title":"Hoeller, N","venue":null,"work_id":"ea782816-23d5-4da6-bd22-c9dd846af089","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.815349Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5fab99c6d113d721ceeb42d12790a52892341271f3b8f5fc37437b60004c1c5c","observation_id":"58018126-b8f8-4fb6-9f5e-633bcb1b6cc7","resolution":{"observed_at":"2026-08-15T15:20:32.325157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.303956Z","title":"Cheng, K","venue":null,"work_id":"f1cde581-e4f2-42e4-b0df-ab6cf28bbcea","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.819497Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:13c2bb836a6d5605927e72aa2df3911ca7ccc4a2c15933c49205d8998097ccdd","observation_id":"3f430b46-e207-49ca-b74c-c3abefcf209e","resolution":{"observed_at":"2026-08-15T15:20:32.308219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.290151Z","title":"Zhuang,et al., Robot Parkour Learning, inConference on Robot Learning(PMLR) (2023), pp","venue":null,"work_id":"f56b4eb3-e9b1-4e35-b4d1-a62a67194e6d","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.823248Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:99d5bde5cc185a1280f771dac3f05726a5b00ac0fa389e8652562059ad55213a","observation_id":"d964b997-a84e-42ac-b0c1-f6f030c22490","resolution":{"observed_at":"2026-08-15T15:20:32.294177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.275995Z","title":"Li,et al., Robust and Versatile Bipedal Jumping Control through Re- inforcement Learning, inRobotics science and systems(RSS) (2023)","venue":null,"work_id":"88b95590-77c4-42f1-b412-897e21984a14","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.827043Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5f8cc583bb75d93ad8bffb07c37d828e3bb61f6c6944f54a42afc96364a6cdb4","observation_id":"abf073d7-07bb-466a-868b-4250d58cd034","resolution":{"observed_at":"2026-08-15T15:20:32.280208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.263737Z","title":"Lee,et al., Learning robust autonomous navigation and locomotion for wheeled-legged robots.Science Robotics9(89), eadi9641 (2024)","venue":null,"work_id":"a2bf3c1e-ee3e-4016-af10-3063659ff318","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.830825Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:a351a75586e11857d5629f7837ac96b9610ccf0190096d304b76841744bb74a0","observation_id":"b72746cc-2d9f-4fd8-bb90-c4180c5487b3","resolution":{"observed_at":"2026-08-15T15:20:32.268081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.249600Z","title":"Kim,et al., High-speed control and navigation for quadrupedal robots on complex and discrete terrain.Science Robotics10(102), eads6192 (2025)","venue":null,"work_id":"a95b00f0-8799-490e-a8b1-e120e403aa05","year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.835269Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:ac8701689609c23afb2c4d98e9938daccdb2e4605ef1855a6fb41743592cd544","observation_id":"7fb7b8d2-6ecc-4c7b-a986-16fb29ea166e","resolution":{"observed_at":"2026-08-15T15:20:32.255109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.839034Z","title":"He,et al., Attention-based map encoding for learning generalized legged locomotion.Science Robotics10(105), eadv3604 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.839034Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:cb247842cc1399171de1179acfd0b8e49dc51a845ce5eea222b5ee37f3ecdf0f","observation_id":"2503c6ad-fc8d-43c9-87da-404cfdc2b933","resolution":{"observed_at":"2026-08-15T15:20:30.839034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16481","last_updated":"2026-05-18T07:58:00Z","snapshot_observed_at":"2026-07-06T22:00:57.880339Z","submitted_at":"2025-07-22T11:36:45Z","title":"Guided Reinforcement Learning for Omnidirectional 3D Jumping in Quadruped Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16481","snapshot_observed_at":"2026-08-15T15:20:30.842877Z","title":"Bussola, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.842877Z"},"links":{"cited_paper":"/paper/2507.16481","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c56b69e7e73e4f50b08eca6770a80e923e0f478986ab26e30410a1095f5dd946","observation_id":"b0e3e562-ceaf-4086-8ce9-9ae31212a4c3","resolution":{"observed_at":"2026-08-15T15:20:30.842877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.223292Z","title":null,"venue":null,"work_id":"9830eb94-d453-4b9f-9603-e75a8baf63fe","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.846724Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3f8e0ce7f06169b7e9c1a024b05b3d956c0c663a5cee29c25f8e8b232bad43de","observation_id":"a2508b65-5b43-42ce-9e57-29e158fdb790","resolution":{"observed_at":"2026-08-15T15:20:32.227901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.206763Z","title":null,"venue":null,"work_id":"a38a943c-20ea-4585-8e2c-e7966acdcc4d","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.851125Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:0e0ad520479012b664f0c50d227328bf2afdfc7c7bd7ed2affbd0abad4d992be","observation_id":"627d7db9-ac7a-4523-8e6b-3811d72e800f","resolution":{"observed_at":"2026-08-15T15:20:32.211795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.193462Z","title":null,"venue":null,"work_id":"a2c6e446-5754-49fd-a02a-3775e91acc1e","year":2021},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.855132Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:eb32ca9d7dece27ec78ccca3ec17037e4262ff759743290ac0e90284209c3084","observation_id":"7ab20264-5a0d-4aca-a27a-57c2983bebb2","resolution":{"observed_at":"2026-08-15T15:20:32.197430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.180364Z","title":null,"venue":null,"work_id":"baedb04d-af39-4bc8-8418-f4f4da1ca749","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.859040Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:6170df1b63e0cef8110f99ed2b23930921c3f906f7f00f3fc842563b38a41982","observation_id":"8dadc89b-ce5c-467f-ba0c-d188fb64442d","resolution":{"observed_at":"2026-08-15T15:20:32.184405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.168804Z","title":"Tessler, Y","venue":null,"work_id":"06b55b3b-fa3f-484e-96d1-89ca17eef950","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.863108Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2cff098468e879a4dc9886d757689026723948dbca4321cf09fe8ee89a4ee0de","observation_id":"c36a769b-959d-41d5-a419-d2c2adf8f61f","resolution":{"observed_at":"2026-08-15T15:20:32.172896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.866617Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.866617Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:793c907a7725221dce36f2024de9e4c90372c46b507f7fbe2b34209d8f55f0c7","observation_id":"e72ccc95-1255-4a94-8dd9-58087f169b3a","resolution":{"observed_at":"2026-08-15T15:20:30.866617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.870466Z","title":"Kang,et al., Learning Steerable Imitation Controllers from Unstruc- tured Animal Motions.arXiv preprint arXiv:2507.00677(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.870466Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:1098fffbf0bfc81c444f5269c3f1286143d55c50d367197a008e04eefcfaaf97","observation_id":"10a009a3-0d01-4df8-842d-1c39e173b8c7","resolution":{"observed_at":"2026-08-15T15:20:30.870466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.155154Z","title":null,"venue":null,"work_id":"2efacf12-545d-4f1c-bd12-b95c4fb2d361","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.873975Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b765c923d5510ce33ecc65cbed2b830c80691118fb0de8ad0a757b7d8aec1b4f","observation_id":"bd484a3a-e56a-4d66-83d1-6edb08974e68","resolution":{"observed_at":"2026-08-15T15:20:32.158910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10989","last_updated":"2023-05-18T14:09:04Z","snapshot_observed_at":"2026-08-18T00:39:58.443526Z","submitted_at":"2023-05-18T14:09:04Z","title":"Reinforcement Learning for Legged Robots: Motion Imitation from Model-Based Optimal Control","version":1},"cited_work":{"arxiv_id":"2305.10989","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10989","snapshot_observed_at":"2026-08-15T15:20:31.474500Z","title":"Reinforcement Learning for Legged Robots: Motion Imitation from Model-Based Optimal Control","venue":"cs.RO","work_id":"b45c9bd3-e0b8-4f5a-b6a6-b169255cca90","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.877693Z"},"links":{"cited_paper":"/paper/2305.10989","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:25cbc00a071ef3e458474d256e7bc33f1d928a9d88596f0c7285a018a78ae2e2","observation_id":"1fc000c0-7f1d-4018-820b-09830a322986","resolution":{"observed_at":"2026-08-15T15:20:31.479707Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.140805Z","title":null,"venue":null,"work_id":"1e1f4291-325a-43b2-a27a-ec22f03f6fc1","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.881747Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b619832b7c8f369f18e7f551a0bd10547c38c8f8b739d2fc51516274746b1917","observation_id":"70377422-dd93-4ca6-8063-8f7f71ed5b79","resolution":{"observed_at":"2026-08-15T15:20:32.146130Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.124241Z","title":"Y oum,et al., Imitating and finetuning model predictive control for robust and symmetric quadrupedal locomotion.IEEE Robotics and Automation Letters8(11), 7799–7806 (2023)","venue":null,"work_id":"ac206350-cab7-440a-8fbf-72f948e6585c","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.885374Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:9eaa25a8274d31a913c26d98a3442a94ae872a8920f73f376d0fb0dee0f13975","observation_id":"dea73991-cb1d-405d-866f-1f144f70e2a3","resolution":{"observed_at":"2026-08-15T15:20:32.129304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01247","last_updated":"2023-03-23T21:50:08Z","snapshot_observed_at":"2026-08-16T16:27:11.781955Z","submitted_at":"2022-10-03T21:58:25Z","title":"OPT-Mimic: Imitation of Optimized Trajectories for Dynamic Quadruped Behaviors","version":3},"cited_work":{"arxiv_id":"2210.01247","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.01247","snapshot_observed_at":"2026-08-15T15:20:31.452346Z","title":"OPT-Mimic: Imitation of Optimized Trajectories for Dynamic Quadruped Behaviors","venue":"cs.RO","work_id":"3d1a4e70-abc9-41c3-b801-554a89796282","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.889172Z"},"links":{"cited_paper":"/paper/2210.01247","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:87914d94af5508430bd16f27abc5066e6ad74ebe93b4b1936923c2f0a968657b","observation_id":"a6e37e3e-3d26-4d2a-8157-03e90a9b8506","resolution":{"observed_at":"2026-08-15T15:20:31.459258Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.893520Z","title":"Liu,et al., Opt2skill: Imitating dynamically-feasible whole-body trajectories for versatile humanoid loco-manipulation.arXiv preprint arXiv:2409.20514(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.893520Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c7dc20e6b7fd2f2a79fdfab21c267c1e8be99c1fcf7e861366c2b50b2d2fc847","observation_id":"6eb73797-b78e-405b-bea5-3bd9e95d9e36","resolution":{"observed_at":"2026-08-15T15:20:30.893520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.26633","last_updated":"2026-06-15T23:36:36Z","snapshot_observed_at":"2026-08-17T19:51:07.076391Z","submitted_at":"2025-09-30T17:59:02Z","title":"OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.26633","snapshot_observed_at":"2026-08-15T15:20:30.897390Z","title":"Y ang,et al., OmniRetarget: Interaction-Preserving Data Generation for Humanoid Whole-Body Loco-Manipulation and Scene Interaction, inarxiv preprint arXiv:2509.26633(2026), pp","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.897390Z"},"links":{"cited_paper":"/paper/2509.26633","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:6915c4b8499cafa4c0f7c8f121ca483485d88004fbe99a30076106c752a6ad3e","observation_id":"baa6edf4-d022-4820-865f-27df86d45d2b","resolution":{"observed_at":"2026-08-15T15:20:30.897390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.110849Z","title":"Mahmood, N","venue":null,"work_id":"0c684d4e-96e6-4dbd-a0d5-db4d06afb0e7","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.901704Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:364a2f1200e4ba1132f73809534ff4182aeb310a1b8e0d66bc911b29b6bd5d8e","observation_id":"c35dcc02-4c47-4f6d-b3e0-f691e31c176b","resolution":{"observed_at":"2026-08-15T15:20:32.114692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.097920Z","title":null,"venue":null,"work_id":"5e4e470e-2c51-4508-be15-a1a7f0a830ef","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.905662Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:16e2253415254705b932c867427c473e26726d0adde1aaba9a0fcbdccf71397e","observation_id":"f68e09aa-70b9-40c9-8f6a-b208f5350179","resolution":{"observed_at":"2026-08-15T15:20:32.102419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08858","last_updated":"2024-06-13T06:44:46Z","snapshot_observed_at":"2026-08-17T03:24:39.882015Z","submitted_at":"2024-06-13T06:44:46Z","title":"OmniH2O: Universal and Dexterous Human-to-Humanoid Whole-Body Teleoperation and Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08858","snapshot_observed_at":"2026-08-15T15:20:30.909504Z","title":"He,et al., OmniH2O: Universal and Dexterous Human-to- Humanoid Whole-Body Teleoperation and Learning.arXiv preprint arXiv:2406.08858(2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.909504Z"},"links":{"cited_paper":"/paper/2406.08858","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:0bf4e2efd2f7212bc1c8a1d39e85d660454417f010cc07c70d44c18243c03c71","observation_id":"4f921d9b-933a-470f-b0db-24392e83cd10","resolution":{"observed_at":"2026-08-15T15:20:30.909504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01143","last_updated":"2025-04-26T03:22:14Z","snapshot_observed_at":"2026-08-17T19:56:09.038444Z","submitted_at":"2025-02-03T08:22:46Z","title":"ASAP: Aligning Simulation and Real-World Physics for Learning Agile Humanoid Whole-Body Skills","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01143","snapshot_observed_at":"2026-08-15T15:20:30.914367Z","title":"He,et al., Asap: Aligning simulation and real-world physics for learn- ing agile humanoid whole-body skills.arXiv preprint arXiv:2502.01143 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.914367Z"},"links":{"cited_paper":"/paper/2502.01143","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:9d49371456d652424520c338a64e5383603b38996538fb52a575d2a932ddc011","observation_id":"d06e224d-c0b4-4cf8-a5f7-e5690717ff29","resolution":{"observed_at":"2026-08-15T15:20:30.914367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14770","last_updated":"2025-09-04T02:48:07Z","snapshot_observed_at":"2026-08-14T19:22:40.392293Z","submitted_at":"2025-06-17T17:59:33Z","title":"GMT: General Motion Tracking for Humanoid Whole-Body Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14770","snapshot_observed_at":"2026-08-15T15:20:30.918642Z","title":"Chen,et al., GMT: General Motion Tracking for Humanoid Whole- Body Control.arXiv preprint arXiv:2506.14770(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.918642Z"},"links":{"cited_paper":"/paper/2506.14770","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:7b57f80345c9db461a6bbbaff93609a22bcb74e59f277213fb974c40dc28c940","observation_id":"13541ca3-778f-46df-99e9-74037e5e0fe8","resolution":{"observed_at":"2026-08-15T15:20:30.918642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15827","last_updated":"2026-05-06T20:45:29Z","snapshot_observed_at":"2026-07-06T22:46:12.384926Z","submitted_at":"2026-02-17T18:59:11Z","title":"Perceptive Humanoid Parkour: Chaining Dynamic Human Skills via Motion Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15827","snapshot_observed_at":"2026-08-15T15:20:30.923069Z","title":"Wu,et al., Perceptive humanoid parkour: Chaining dynamic human skills via motion matching.arXiv preprint arXiv:2602.15827(2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.923069Z"},"links":{"cited_paper":"/paper/2602.15827","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:5b6e66d2622f6a2427efa6c5e236df28debfafa43f5a78717c86663dbc403014","observation_id":"54e00089-315a-4d7c-b050-ac5791c8013d","resolution":{"observed_at":"2026-08-15T15:20:30.923069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.927624Z","title":"Sleiman, ZEST: Zero-shot Embodied Skill Transfer for Athletic Robot Control.arXiv preprint arXiv:2602.00401(2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.927624Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:bc5e4e3fd176d503f55b7e94ce5fe51d1c5aca0757cf3999caff7ac0584b7408","observation_id":"0682d286-642c-484e-a998-7d3b22ea41d3","resolution":{"observed_at":"2026-08-15T15:20:30.927624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.085104Z","title":null,"venue":null,"work_id":"0e1ea02d-325c-480c-92c2-65b7131ffedc","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.932024Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:e45da2e2218c1ce2ebf823f6b1d9725883c7277aa43ac2fa4b45a7591b399aba","observation_id":"c369d56a-569c-4011-832e-23a7954d4069","resolution":{"observed_at":"2026-08-15T15:20:32.089379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.071986Z","title":null,"venue":null,"work_id":"d83197c0-986b-4ff8-bb9c-553fa92e9bb7","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.935861Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:fc1cab1300c27fc0e3275dac3139cefd1250a6b03c15ad98b74e31f4a2ca7bbf","observation_id":"3d20cbd2-863b-4a53-bbdf-3fd5ab91c824","resolution":{"observed_at":"2026-08-15T15:20:32.076545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.044162Z","title":null,"venue":null,"work_id":"cfb9215a-b55c-4b09-924f-57c3037a75a0","year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.939713Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:93bfac283ff7cd68824f2d9beaddd462907253a9b11b998bb335cfe0f3ca844b","observation_id":"55935f32-87c8-4d21-a5f0-6c4121eb1694","resolution":{"observed_at":"2026-08-15T15:20:32.048390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.031999Z","title":"Li,et al., Learning agile skills via adversarial imitation of rough partial demonstrations, inConference on Robot Learning(PMLR) (2023), pp","venue":null,"work_id":"bbdbd105-057e-4c1e-a1b3-5fd95d1c2eb2","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.943034Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b1a9f6505d373b23358edb0fc953779853894944930893f84d877b116f9073ca","observation_id":"d82ace34-d19f-4915-abf4-631d4eb11ed1","resolution":{"observed_at":"2026-08-15T15:20:32.036914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.020023Z","title":"Zargarbashi, J","venue":null,"work_id":"047c11e8-421e-4a21-a8f9-3af558539f91","year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.947641Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:018b4d48d24b7265b3b73d539e6bf7e161a44dcd2293bc335f370ad3e9cc3595","observation_id":"69ad7e7c-08d2-4ff2-b380-fced12bb450b","resolution":{"observed_at":"2026-08-15T15:20:32.024171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:32.006627Z","title":"Rho,et al., LineRides: Line-Guided Reinforcement Learning for Bicycle Robot Stunts.IEEE Robotics and Automation Letters(2026),","venue":null,"work_id":"e2f1c11f-8c6c-4c25-8406-ba1cc6b47ffd","year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.951593Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:1b27a461a49f974892ec967adbf34688a4c163de30406fe9ce061e5ef3209572","observation_id":"0da85ed4-38b2-434e-aa46-da89b0109250","resolution":{"observed_at":"2026-08-15T15:20:32.011080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.994296Z","title":null,"venue":null,"work_id":"785b92cc-613d-48ca-ba4c-9b0d1bc05141","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.955417Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:64d02d00d8c5880c999cc3823585f4811f3f129ac7e5a50f9d8c524622d297cb","observation_id":"611a2d88-86b2-4560-b9e3-faf22584deb5","resolution":{"observed_at":"2026-08-15T15:20:31.998779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08378","last_updated":"2025-04-19T20:24:29Z","snapshot_observed_at":"2026-08-14T07:06:18.521079Z","submitted_at":"2025-02-12T13:10:09Z","title":"Learning Humanoid Standing-up Control across Diverse Postures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08378","snapshot_observed_at":"2026-08-15T15:20:30.960092Z","title":"Huang,et al., Learning Humanoid Standing-up Control across Di- verse Postures.arXiv preprint arXiv:2502.08378(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.960092Z"},"links":{"cited_paper":"/paper/2502.08378","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:9da73aab6c0afae3dee4f4c1b193bf55df66badb355cfa04934e05ab70145b33","observation_id":"c95c2c09-2d5b-46e4-a482-325f675f001c","resolution":{"observed_at":"2026-08-15T15:20:30.960092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:30.964285Z","title":"Strauch,et al., Robot Crash Course: Learning Soft and Stylized Falling.arXiv preprint arXiv:2511.10635(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.964285Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3a52b4ea24d4ebeb1d21987fe37159e8bd767afeb0a4a0275db7e09ee5ddd4af","observation_id":"a17b5db7-db0d-46f5-876e-677f89c7e346","resolution":{"observed_at":"2026-08-15T15:20:30.964285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.979511Z","title":"MacAskill, Red Bull, Danny MacAskill’s Imaginate (2013), https: //www.youtube.com/watch?v=Sv3xVOs7_No, accessed: 2026-05-18","venue":null,"work_id":"efc32779-ee41-4099-b0d0-7704ab6c74bd","year":2013},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.968708Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2791ada440bdbca3d791c5cae935e212d3e71ab4640640289c2b3e05f398d539","observation_id":"9524057f-1322-45f0-9a3c-f8dfcc9d6ba8","resolution":{"observed_at":"2026-08-15T15:20:31.984465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.967883Z","title":"MacAskill, Redd Bull Bike, Danny MacAskill’s Gymnasium (2020), https://www.youtube.com/watch?v=fAEBNEscL0c, accessed: 2026-05- 18","venue":null,"work_id":"dd3a13cd-aa8c-4e48-9b9b-e87bf5c35505","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.972531Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:20297d92a427ec557a887e82d31e2d123d64f8e0358a8069dcaf81cfae60cde4","observation_id":"c9264d1c-fc09-46eb-b1f3-96117778f14e","resolution":{"observed_at":"2026-08-15T15:20:31.972078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.956594Z","title":null,"venue":null,"work_id":"45ae1c02-30e3-4be3-b914-806f9393514e","year":1999},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.976719Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3bfedb26d0d8e6f49ae9caa205e90c28e4c9e515c2f3f9dac3102ff04a532db2","observation_id":"40b936d4-6112-422c-9975-7575913c0856","resolution":{"observed_at":"2026-08-15T15:20:31.960198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.943614Z","title":"Rudin, D","venue":null,"work_id":"0407f18f-d2ce-4759-b121-d98bed713501","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.980805Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:bc5257a85023d4185e1d47fbace419e157cf4c34b57afc8978ccc7aee173aa60","observation_id":"d3768a7e-e90e-4aa3-ae85-b6bf87c2891c","resolution":{"observed_at":"2026-08-15T15:20:31.948014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.924773Z","title":null,"venue":null,"work_id":"24124dfe-ac8a-44b0-b1a1-a78505b47ac8","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.985113Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:be4bd57f27b6ec041c8d617df7a8bde126cfce2c1f8bb27a795f195d4e2f90f3","observation_id":"d493ba73-173b-4109-b568-3b7ee089ca88","resolution":{"observed_at":"2026-08-15T15:20:31.930844Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.904168Z","title":"Portelas, C","venue":null,"work_id":"48811092-38b3-4d43-8cdf-5ffb896ca281","year":2020},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.989750Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:51a02b8f12db0469b0bb53ee11c169c133ca2615db4be41d3ef31b18fa27883e","observation_id":"063cfea2-04e8-4c0b-8b86-60c71a892e9a","resolution":{"observed_at":"2026-08-15T15:20:31.909102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.888515Z","title":"Hwangbo,et al., Learning agile and dynamic motor skills for legged robots.Science Robotics4(26), eaau5872 (2019)","venue":null,"work_id":"8ad163ff-11f5-4937-a616-005f5dfe4805","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.993972Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:bead19ae35b1bafd805ee1ec4fab80633a73c9c5358eee6862ee308b6e649a8d","observation_id":"aeccaf49-db11-4984-a2c8-9704a483ba74","resolution":{"observed_at":"2026-08-15T15:20:31.892915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.876159Z","title":null,"venue":null,"work_id":"776193bc-cc6c-4094-986c-bc64f7764db2","year":2024},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:30.999077Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:80fd0fc3efc40dffb7c6a4d947eb2b51a32407da29db53d1457ce64f81c7038a","observation_id":"59c1c74d-324f-4da6-8fff-0baa6d75cc8f","resolution":{"observed_at":"2026-08-15T15:20:31.880194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T15:20:31.004000Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.004000Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:844920ecb2ee31c21c927f7e561262a49a6815903676460f6fc871ee2b988f07","observation_id":"f264c837-9830-4810-9e5c-3bfac113ab43","resolution":{"observed_at":"2026-08-15T15:20:31.004000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.04831","last_updated":"2025-11-06T21:43:02Z","snapshot_observed_at":"2026-08-16T09:41:41.700782Z","submitted_at":"2025-11-06T21:43:02Z","title":"Isaac Lab: A GPU-Accelerated Simulation Framework for Multi-Modal Robot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.04831","snapshot_observed_at":"2026-08-15T15:20:31.008582Z","title":"Mittal,et al., Isaac Lab: A GPU-Accelerated Simulation Frame- work for Multi-Modal Robot Learning.arXiv preprint arXiv:2511.04831 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.008582Z"},"links":{"cited_paper":"/paper/2511.04831","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:6cdc7d6c61d6a9a57f2d7745f35b7973184b9ba5176276db3fafb34f95b5eb13","observation_id":"df2e71ea-671a-46ed-9f18-e6bf67e58719","resolution":{"observed_at":"2026-08-15T15:20:31.008582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.06542","last_updated":"2017-10-18T01:10:37Z","snapshot_observed_at":"2026-08-14T20:22:42.955584Z","submitted_at":"2017-10-18T01:10:37Z","title":"Asymmetric Actor Critic for Image-Based Robot Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.06542","snapshot_observed_at":"2026-08-15T15:20:31.012846Z","title":"Pinto, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.012846Z"},"links":{"cited_paper":"/paper/1710.06542","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8f463009385926ba01b267118e82fba77649a5d7ee680d75b8185bbaa1b7d175","observation_id":"2a347df2-0ab7-476b-91ca-bcc9cb2bcc6d","resolution":{"observed_at":"2026-08-15T15:20:31.012846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.858105Z","title":"Abdolhosseini, H","venue":null,"work_id":"e4b9f020-f8d8-4126-8c0c-833792572d20","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.017710Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:f0237e6f62aa16b0aab7e06ce251e78d2ffd8de8977850d928b9f0b4f7616fe9","observation_id":"57543452-8b01-4c4b-8eb2-bfe19d70a9eb","resolution":{"observed_at":"2026-08-15T15:20:31.865207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.842663Z","title":null,"venue":null,"work_id":"f8d3d555-f96c-4a9f-9f80-e2107a4ea673","year":2017},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.022440Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:b923d17d3e4a84695754f580967fd09cb47c0cdf67e45817f6135ca44137a03d","observation_id":"a30d98d3-01cc-4fb5-b08d-08ae94a6e8c7","resolution":{"observed_at":"2026-08-15T15:20:31.846705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.829709Z","title":null,"venue":null,"work_id":"35e6777c-a544-40c8-885b-f12d0548dd04","year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.026204Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:2ffc4c7bd4d3c8ee26a2e50f182ecc714f325ac859f838801377c2d68af7b6a9","observation_id":"e40a63ba-bfec-47d4-9966-2d4bb67a26e8","resolution":{"observed_at":"2026-08-15T15:20:31.833583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10332","last_updated":"2018-05-16T20:35:34Z","snapshot_observed_at":"2026-08-14T19:21:23.179705Z","submitted_at":"2018-04-27T03:42:55Z","title":"Sim-to-Real: Learning Agile Locomotion For Quadruped Robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.10332","snapshot_observed_at":"2026-08-15T15:20:31.030954Z","title":"Tan,et al., Sim-to-real: Learning agile locomotion for quadruped robots.arXiv preprint arXiv:1804.10332(2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.030954Z"},"links":{"cited_paper":"/paper/1804.10332","citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:c9004f29dcaa80b5896bb28b1bdce0b3b0c72f5fd0c3b002d6ace8484c069eee","observation_id":"b1c11b73-d267-46d2-84da-7f545c857794","resolution":{"observed_at":"2026-08-15T15:20:31.030954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.814736Z","title":"Choi,et al., Learning quadrupedal locomotion on deformable terrain","venue":null,"work_id":"9734ffe6-d51e-4446-bffc-d46621ece7e9","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.035163Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:08ace63c6a1f753089e6c1ec8cac95390b43d29ba59d9434abb64ef09a97e380","observation_id":"3153df8e-fba7-4209-828b-a2563a2fe8a0","resolution":{"observed_at":"2026-08-15T15:20:31.819010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.801619Z","title":"Todorov, T","venue":null,"work_id":"d37249e5-ae4a-479e-a771-a08e21c0a4db","year":2012},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.039698Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:8f59b4e079c60ec622eef4913bd5b8b432967ac79fae06bdb458023d426cf103","observation_id":"6156e641-a08c-4390-a9d5-67bbe964b67c","resolution":{"observed_at":"2026-08-15T15:20:31.806387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.786923Z","title":null,"venue":null,"work_id":"f2a249dd-a849-4479-9c02-bc57a5a4b9f3","year":null},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.044802Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:3644879141a7c0d99808fb8fd66c8af303b5ad08c579f1c1bd57b54a68fd16c1","observation_id":"05e9884e-f2cb-4a20-84a1-41922d090a3d","resolution":{"observed_at":"2026-08-15T15:20:31.790976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.772873Z","title":"Bellicoso, A","venue":null,"work_id":"c4dfe01a-ffdb-4b86-bc03-d06acbf9d111","year":2026},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.048863Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:6b53c877a9c6916862e98f8b103f296a7c8d1525d649839cfcf2bb9554e1c07a","observation_id":"6119261c-39e3-426e-b1cd-0efa9733589b","resolution":{"observed_at":"2026-08-15T15:20:31.777932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.758525Z","title":null,"venue":null,"work_id":"c0149b27-0b7a-4705-8807-a4344bfeaa9b","year":null},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.054630Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:9d5abeaddf21303063d53989e2bf96a5b563d0c10d6d68789af05e41806c6aa7","observation_id":"48e22604-9c55-4db4-a66c-9a1ed66a896b","resolution":{"observed_at":"2026-08-15T15:20:31.762856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.743731Z","title":null,"venue":null,"work_id":"bc51a612-8084-4739-a6d0-1678e3245753","year":2022},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.058964Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:29b0e82d1c2196d40f04b18638c525e3673177fcab73cfe8ef05589b16651976","observation_id":"db0d5f7a-0b8c-4825-9dde-cd6b3b3f1797","resolution":{"observed_at":"2026-08-15T15:20:31.747803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.730271Z","title":"Dellaert,et al., borglab/gtsam: Release 4.2.Zenodo(2023)","venue":null,"work_id":"23d69846-debf-42bd-8a8d-ebcb8acc1310","year":2023},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.063027Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:835dbcbdc9531b8465934b9d4bf594bb01670ed94b0acb423b31823a269e1b08","observation_id":"c9064be9-e991-49e0-a26a-e9027672823b","resolution":{"observed_at":"2026-08-15T15:20:31.734735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.717356Z","title":"Goldfain,et al., Autorally: An Open Platform for Aggressive Au- tonomous Driving.IEEE Control Systems Magazine39(1), 26–55 (2019)","venue":null,"work_id":"7401164c-25b0-471f-b6b8-e95df06cc36e","year":2019},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.066762Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:94d7492b4d9bb392f46dd4f1ea513feb25f7c833f711997655996cd505972de9","observation_id":"f9ca2262-3509-4c34-859c-d70e35971599","resolution":{"observed_at":"2026-08-15T15:20:31.721607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:20:31.702988Z","title":"bail out","venue":null,"work_id":"e603fcee-6afb-46bb-bca0-d14081a27489","year":2015},"citing_paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T15:20:31.071434Z"},"links":{"citing_paper":"/paper/2608.00880"},"observation_digest":"sha256:40a37cd3d74a4966777656b2d02bc79d98d8c2ba2955b4c39204636b63d19c48","observation_id":"99b32d12-a94a-40c1-95b9-4fceb243d2ac","resolution":{"observed_at":"2026-08-15T15:20:31.707153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00880","last_updated":"2026-08-01T21:54:40Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-18T16:12:06.191307Z","submitted_at":"2026-08-01T21:54:40Z","title":"Bicycle Acrobatics with Reinforcement Learning"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":2,"verified_fuzzy":33},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 0 inbound Pith citation observations for arXiv:2608.00880."}