{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:WMFCXZMILFRGGVOYHVFE5ZSQ7E","short_pith_number":"pith:WMFCXZMI","schema_version":"1.0","canonical_sha256":"b30a2be58859626355d83d4a4ee650f9009c0a8b13de70c092e6618c80fbabbb","source":{"kind":"arxiv","id":"2403.01928","version":1},"attestation_state":"computed","paper":{"title":"ZSL-RPPO: Zero-Shot Learning for Quadrupedal Locomotion in Challenging Terrains using Recurrent Proximal Policy Optimization","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.RO","authors_text":"Haitham Bou-Ammar, Jun Wang, Peng Du, Tao Wu, Xiang Lu, Xinyu Zhang, Yao Zhao, Yijie Zhu","submitted_at":"2024-03-04T10:44:59Z","abstract_excerpt":"We present ZSL-RPPO, an improved zero-shot learning architecture that overcomes the limitations of teacher-student neural networks and enables generating robust, reliable, and versatile locomotion for quadrupedal robots in challenging terrains. We propose a new algorithm RPPO (Recurrent Proximal Policy Optimization) that directly trains recurrent neural network in partially observable environments and results in more robust training using domain randomization. Our locomotion controller supports extensive perturbation across simulation-to-reality transfer for both intrinsic and extrinsic physic"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2403.01928","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.RO","submitted_at":"2024-03-04T10:44:59Z","cross_cats_sorted":[],"title_canon_sha256":"bd68c7c91c45737437c0a10808e92cd7cd243ff48ef86f4c338838a5535aa0f1","abstract_canon_sha256":"4bc3b93bed7f0098e84a11b4931ad327d5a54ae820c62a715ee38233b3feaa49"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T07:51:54.260731Z","signature_b64":"mtWMsgL4wSvqurivJYjS+xTz8VMJ4sxXsLTqIqGD1x2j6ggbvIWPr1y0JsLvCw5Ax7bPbFwPMZL7/T4L68pkBA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"b30a2be58859626355d83d4a4ee650f9009c0a8b13de70c092e6618c80fbabbb","last_reissued_at":"2026-07-05T07:51:54.260204Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T07:51:54.260204Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"ZSL-RPPO: Zero-Shot Learning for Quadrupedal Locomotion in Challenging Terrains using Recurrent Proximal Policy Optimization","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.RO","authors_text":"Haitham Bou-Ammar, Jun Wang, Peng Du, Tao Wu, Xiang Lu, Xinyu Zhang, Yao Zhao, Yijie Zhu","submitted_at":"2024-03-04T10:44:59Z","abstract_excerpt":"We present ZSL-RPPO, an improved zero-shot learning architecture that overcomes the limitations of teacher-student neural networks and enables generating robust, reliable, and versatile locomotion for quadrupedal robots in challenging terrains. We propose a new algorithm RPPO (Recurrent Proximal Policy Optimization) that directly trains recurrent neural network in partially observable environments and results in more robust training using domain randomization. Our locomotion controller supports extensive perturbation across simulation-to-reality transfer for both intrinsic and extrinsic physic"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2403.01928","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2403.01928/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2403.01928","created_at":"2026-07-05T07:51:54.260272+00:00"},{"alias_kind":"arxiv_version","alias_value":"2403.01928v1","created_at":"2026-07-05T07:51:54.260272+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2403.01928","created_at":"2026-07-05T07:51:54.260272+00:00"},{"alias_kind":"pith_short_12","alias_value":"WMFCXZMILFRG","created_at":"2026-07-05T07:51:54.260272+00:00"},{"alias_kind":"pith_short_16","alias_value":"WMFCXZMILFRGGVOY","created_at":"2026-07-05T07:51:54.260272+00:00"},{"alias_kind":"pith_short_8","alias_value":"WMFCXZMI","created_at":"2026-07-05T07:51:54.260272+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E","json":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E.json","graph_json":"https://pith.science/api/pith-number/WMFCXZMILFRGGVOYHVFE5ZSQ7E/graph.json","events_json":"https://pith.science/api/pith-number/WMFCXZMILFRGGVOYHVFE5ZSQ7E/events.json","paper":"https://pith.science/paper/WMFCXZMI"},"agent_actions":{"view_html":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E","download_json":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E.json","view_paper":"https://pith.science/paper/WMFCXZMI","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2403.01928&json=true","fetch_graph":"https://pith.science/api/pith-number/WMFCXZMILFRGGVOYHVFE5ZSQ7E/graph.json","fetch_events":"https://pith.science/api/pith-number/WMFCXZMILFRGGVOYHVFE5ZSQ7E/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E/action/timestamp_anchor","attest_storage":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E/action/storage_attestation","attest_author":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E/action/author_attestation","sign_citation":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E/action/citation_signature","submit_replication":"https://pith.science/pith/WMFCXZMILFRGGVOYHVFE5ZSQ7E/action/replication_record"}},"created_at":"2026-07-05T07:51:54.260272+00:00","updated_at":"2026-07-05T07:51:54.260272+00:00"}