{"as_of":"2026-08-09T14:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:58ed06ee0a3dce0a4f5e6edcee427284c49f9fce5880a6354b1125762010fd37","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:51:50.755943Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.18046/citation-record","integrity":"/paper/2509.18046/integrity","json":"/paper/2509.18046/citation-record.json","paper":"/paper/2509.18046"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.621121Z","title":"Advancements in humanoid robots: A comprehensive review and future prospects,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.621121Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:b41ffa1a47a3dee2423a21b306641258e0c0805676c67cfed1b30675cb26ac62","observation_id":"5614fd3e-7f35-44a4-a129-7bb0d13cebde","resolution":{"observed_at":"2026-08-04T15:51:50.621121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.628977Z","title":"Reinforcement learning in robotic applications: a comprehensive survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.628977Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:52dba75d9467d256e6eb8b87ed84252d69b79ba4d5830d9a5b02bc7deaa9113f","observation_id":"1fab63ac-c489-4936-b7a0-b1e6ed191f63","resolution":{"observed_at":"2026-08-04T15:51:50.628977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.634466Z","title":"A comprehensive survey on humanoid robot development,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.634466Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:9e0df12616a5fb844d2559ef4fbe6233626fb50025dc402acbf016bba741646b","observation_id":"888ec996-93d1-46c2-9556-09a6a01935db","resolution":{"observed_at":"2026-08-04T15:51:50.634466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.641308Z","title":"Teleoperation of humanoid robots: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.641308Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:707fb1808b8b1c5461634f163b924f43d57b96b462232f3c838ad9f35d685a4f","observation_id":"bc339678-607c-4c30-a359-ced574570e83","resolution":{"observed_at":"2026-08-04T15:51:50.641308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.647887Z","title":"Learning agile and dynamic motor skills for legged robots,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.647887Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:22f6c91704d9585ad8f0504dcdb9d79d964bed3deec78c1bd2db67b2a47a29ae","observation_id":"445469d6-58d4-4151-8a97-1fddef0d5cfc","resolution":{"observed_at":"2026-08-04T15:51:50.647887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.663390Z","title":"Learning quadrupedal locomotion over challenging terrain,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.663390Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:175087b1e7e280265c07a51334e90b670e57f24463f77513ed2002e171281bbe","observation_id":"93a96076-dc11-449b-98ab-64055af883ff","resolution":{"observed_at":"2026-08-04T15:51:50.663390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11978","last_updated":"2022-08-19T07:52:32Z","snapshot_observed_at":"2026-07-06T11:51:01.269374Z","submitted_at":"2021-09-24T14:04:19Z","title":"Learning to Walk in Minutes Using Massively Parallel Deep Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11978","snapshot_observed_at":"2026-08-04T15:51:50.669910Z","title":"Learning to walk in minutes using massively parallel deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.669910Z"},"links":{"cited_paper":"/paper/2109.11978","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:7470cfaa1338434f49ac0668c62199e6aad4ada0523a15202e13f4ddc35cdc1c","observation_id":"6696e8fd-b032-4923-af16-a615fe5efbc7","resolution":{"observed_at":"2026-08-04T15:51:50.669910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04034","last_updated":"2021-07-08T17:59:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-08T17:59:59Z","title":"RMA: Rapid Motor Adaptation for Legged Robots","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04034","snapshot_observed_at":"2026-08-04T15:51:50.677905Z","title":"Rma: Rapid motor adaptation for legged robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.677905Z"},"links":{"cited_paper":"/paper/2107.04034","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:e848a4a7dc7895435c6c03eec2f39fe23019252049058f24c978d27f81d77d40","observation_id":"afbdb6b5-2968-412f-a626-b63b4f44a9ae","resolution":{"observed_at":"2026-08-04T15:51:50.677905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.686949Z","title":"Sim-to- real learning of all common bipedal gaits via periodic reward composition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.686949Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:7cf7e9e497b96b5e120e820f7e1578fcb97a77ff7eac9a93e34c35bad0c3cca4","observation_id":"7c70bd06-36e5-405c-9820-03799fbc1f63","resolution":{"observed_at":"2026-08-04T15:51:50.686949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.695300Z","title":"Reinforcement learning for robust parameterized locomotion control of bipedal robots,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.695300Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:e9bb7854c8c2a5760df47d73432a5a999fb1759b876a294ded642e85f8359dee","observation_id":"83283a16-58f7-4486-8a5d-30677e8de08a","resolution":{"observed_at":"2026-08-04T15:51:50.695300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08328","last_updated":"2021-05-18T07:49:15Z","snapshot_observed_at":"2026-08-08T07:19:42.138821Z","submitted_at":"2021-05-18T07:49:15Z","title":"Blind Bipedal Stair Traversal via Sim-to-Real Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08328","snapshot_observed_at":"2026-08-04T15:51:50.702075Z","title":"Blind bipedal stair traversal via sim-to-real reinforce- ment learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.702075Z"},"links":{"cited_paper":"/paper/2105.08328","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:c0d7fda7c4f2b9694b5b4c8305bf905a6c92770f11846c36ebe220e73b79ab98","observation_id":"d148a5eb-44ab-43be-81d9-2c8b62d6e559","resolution":{"observed_at":"2026-08-04T15:51:50.702075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.02991","last_updated":"2020-02-07T19:40:59Z","snapshot_observed_at":"2026-08-06T15:54:26.956804Z","submitted_at":"2020-02-07T19:40:59Z","title":"Learning Whole-body Motor Skills for Humanoids","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.02991","snapshot_observed_at":"2026-08-04T15:51:50.707129Z","title":"Learning whole-body motor skills for humanoids,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.707129Z"},"links":{"cited_paper":"/paper/2002.02991","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:11ff0f6a65e810b2c16bc5da4f64be571e905be863695aee7038ac1039c0b089","observation_id":"054be262-3706-4214-ad2b-c434c2078cae","resolution":{"observed_at":"2026-08-04T15:51:50.707129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.00534","last_updated":"2021-06-01T14:51:12Z","snapshot_observed_at":"2026-08-06T17:11:16.558627Z","submitted_at":"2021-06-01T14:51:12Z","title":"DeepWalk: Omnidirectional Bipedal Gait by Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.00534","snapshot_observed_at":"2026-08-04T15:51:50.712600Z","title":"Deepwalk: Omnidirectional bipedal gait by deep reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.712600Z"},"links":{"cited_paper":"/paper/2106.00534","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:9557c61d1087a067ea33a37b59d95926c729f97f2fd025652ebec0174b3f93b8","observation_id":"6daf4b9a-fbee-4a06-bd3d-a5c2d82e369e","resolution":{"observed_at":"2026-08-04T15:51:50.712600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.15309","last_updated":"2021-03-29T03:33:52Z","snapshot_observed_at":"2026-07-06T10:54:14.838348Z","submitted_at":"2021-03-29T03:33:52Z","title":"Robust Feedback Motion Policy Design Using Reinforcement Learning on a 3D Digit Bipedal Robot","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.15309","snapshot_observed_at":"2026-08-04T15:51:50.718680Z","title":"Robust feedback motion policy design using reinforcement learning on a 3d digit bipedal robot,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.718680Z"},"links":{"cited_paper":"/paper/2103.15309","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:290f48cb701580a5d8216ff1807aca16d6014b28c1f9d1f61c239f12cbbab5d6","observation_id":"7063757d-ab51-48ad-a26a-7879e874448c","resolution":{"observed_at":"2026-08-04T15:51:50.718680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.04323","last_updated":"2020-08-30T00:45:00Z","snapshot_observed_at":"2026-08-06T17:12:05.471140Z","submitted_at":"2020-05-09T00:16:38Z","title":"ALLSTEPS: Curriculum-driven Learning of Stepping Stone Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.04323","snapshot_observed_at":"2026-08-04T15:51:50.724880Z","title":"Allsteps: Curriculum-driven learning of stepping stone skills,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.724880Z"},"links":{"cited_paper":"/paper/2005.04323","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:a3a8a4cca62a5f83efb29b5095524fc9680f489bd304177cb7cf29be12b90685","observation_id":"5aabc96b-c7ab-45f4-ac27-011e6ca243fb","resolution":{"observed_at":"2026-08-04T15:51:50.724880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01807","last_updated":"2022-05-03T22:29:33Z","snapshot_observed_at":"2026-08-03T12:37:07.704265Z","submitted_at":"2022-05-03T22:29:33Z","title":"Learning Dynamic Bipedal Walking Across Stepping Stones","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01807","snapshot_observed_at":"2026-08-04T15:51:50.729742Z","title":"Learning dynamic bipedal walking across stepping stones,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.729742Z"},"links":{"cited_paper":"/paper/2205.01807","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:b8a5bb0a6b3468cbcaa09dbcc375b099f20605ec2945a446fe2f39aae1ccd318","observation_id":"bb0fba7e-4829-493b-a06f-af9dd85bf626","resolution":{"observed_at":"2026-08-04T15:51:50.729742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-04T15:51:50.735924Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.735924Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:6e4dfdaba14c132867395705a96a37a74c0c1e495414927e4beaa92d73a105a2","observation_id":"4ecfbcb7-a13b-4d21-bbac-d4d676e4964b","resolution":{"observed_at":"2026-08-04T15:51:50.735924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.740784Z","title":"mc-mujoco: Simulating articulated robots with fsm controllers in mujoco,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.740784Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:f0f838832dddc4b9e5af6a0dd9fadc2d797e3723556c557202785c1369931375","observation_id":"abc0fe63-f1cf-4004-af73-0cb21c07bfa5","resolution":{"observed_at":"2026-08-04T15:51:50.740784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.745743Z","title":"Proposal of inspection and rescue tasks for tunnel disasters—task development of japan virtual robotics challenge,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.745743Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:4d511bb19693e572fcecc1109ef5c59f23a2e2be52b173adf36d4460b0425626","observation_id":"8706442c-7780-4927-9711-c6667e8c16ab","resolution":{"observed_at":"2026-08-04T15:51:50.745743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.750687Z","title":"Learning bipedal walking on planned footsteps for humanoid robots,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.750687Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:e0178407fbc3905f2baaa935af92ef53272d7d2251c249ebe0f28bfb58fb1351","observation_id":"77263eb5-5a78-4fbe-b4c1-fda63dd38cc5","resolution":{"observed_at":"2026-08-04T15:51:50.750687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.755943Z","title":"Anytime search-based footstep planning with suboptimality bounds,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.755943Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:058132a9e99c8e91043147c2f09457067562ac3a254678640cbfe809bcbbe9c4","observation_id":"89db7155-f7cd-4582-864c-06c0974b7b4e","resolution":{"observed_at":"2026-08-04T15:51:50.755943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:51:50.655273Z","title":"Available: https://www.science.org/doi/ 10.1126/scirobotics.aau5872","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-04T15:51:50.655273Z"},"links":{"citing_paper":"/paper/2509.18046"},"observation_digest":"sha256:c5cd3751347fa74cc1cd71a9c7d618ec9d5507e16d696aff96662f47857c4518","observation_id":"95317a5b-85ae-4903-b7e1-bec7e17835ce","resolution":{"observed_at":"2026-08-04T15:51:50.655273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.18046","last_updated":"2026-02-11T16:00:35Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T11:14:23.982337Z","submitted_at":"2025-09-22T17:19:55Z","title":"HuMam: Humanoid Motion Control via End-to-End Deep Reinforcement Learning with Mamba"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:2509.18046."}