{"as_of":"2026-08-20T10:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:11bc679b6c1ee8231c48ffc17b9c6d7936cea5eceb28eaa56f5b1295b39bb8dc","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:37:57.981796Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T01:28:16.666961Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T20:18:56.712377Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"cited_work":{"arxiv_id":"2509.19525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.19525","snapshot_observed_at":"2026-07-03T20:18:56.712377Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","venue":"cs.RO","work_id":"fe02d7a4-9f34-474e-9b0c-ea897e0b7563","year":2025},"citing_paper":{"arxiv_id":"2606.17394","last_updated":"2026-06-16T01:11:34Z","snapshot_observed_at":"2026-08-12T13:57:33.143897Z","submitted_at":"2026-06-16T01:11:34Z","title":"Damage Adaptation in Seconds for Architected Materials","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T01:28:16.666961Z"},"links":{"cited_paper":"/paper/2509.19525","citing_paper":"/paper/2606.17394"},"observation_digest":"sha256:ae06200eac2387ceed66875502698c12eb42097d7500d229683c4a3102e17805","observation_id":"dbee581d-e107-49ed-968b-cfe271c76c69","resolution":{"observed_at":"2026-07-03T20:18:56.714417Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.19525/citation-record","integrity":"/paper/2509.19525/integrity","json":"/paper/2509.19525/citation-record.json","paper":"/paper/2509.19525"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:51.572053Z","title":"Design, fabrication and control of soft robots,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:51.572053Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:ae817fdd34f6252b44187ac2499c6d338b32e6d83a0bf48b7d4be73e03ba657b","observation_id":"4248aea4-1d59-4e8f-9184-93d97cb4ae8d","resolution":{"observed_at":"2026-08-04T15:37:51.572053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:51.606416Z","title":"Soft robotics: Review of fluid-driven intrinsically soft devices; manufacturing, sensing, control, and appli- cations in human-robot interaction,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:51.606416Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:8cab351e881e3069371533b85bc81cd043b6cd4bd50b2cee3618f5a5261de96e","observation_id":"7cb33178-1f65-4e8d-b9e8-0c69a560275f","resolution":{"observed_at":"2026-08-04T15:37:51.606416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:51.667234Z","title":"Modeling and control of soft robots using the koopman operator and model predictive control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:51.667234Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:d88291a93b4768e1c1e5b317fd1ffb5207885b5f79ad20ef7a17194901085495","observation_id":"ff6ef948-d557-4d2b-be42-0bab0c890b28","resolution":{"observed_at":"2026-08-04T15:37:51.667234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:51.707252Z","title":"Model-based control of soft robots: A survey of the state of the art and open challenges,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:51.707252Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:ffbc3257d49a0b538e57a6de3cdd74904e8c4752f10e2c2834b5354c63f5ef55","observation_id":"9fae19ee-26c2-481b-aa8f-fbce71930d02","resolution":{"observed_at":"2026-08-04T15:37:51.707252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:51.799952Z","title":"Model-based reinforcement learning for closed-loop dynamic control of soft robotic manipulators,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:51.799952Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:0449f20dff633e394df5b6c69efc7faaa08fc710d6230534fb4979d87f307ff3","observation_id":"e58e2f7a-0e73-411a-b98a-989d7851b3c3","resolution":{"observed_at":"2026-08-04T15:37:51.799952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:51.870270Z","title":"Review of machine learning methods in soft robotics,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:51.870270Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:bf56faed0cc729231d122f46079afb06f951725a8833873a25ae3f62ef862ebb","observation_id":"a8eb3233-92a4-43bb-b3cd-604af812131b","resolution":{"observed_at":"2026-08-04T15:37:51.870270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:51.959107Z","title":"Reinforcement learning enables real- time planning and control of agile maneuvers for soft robot arms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:51.959107Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:0378546106d27c8142c73a02e17f4b9b576d505d95d05bde00757b0a9b810bc1","observation_id":"9b416703-d1ac-42aa-bb43-32e00e8c347c","resolution":{"observed_at":"2026-08-04T15:37:51.959107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:52.090562Z","title":"Closed-loop dynamic control of a soft manipulator using deep reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:52.090562Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:908226e8c98b737009b9a83925665d2874dc812b9a82443c5e056d4813ae9c40","observation_id":"8621b2eb-2c8b-4af4-abcf-7f9cb4ce24ee","resolution":{"observed_at":"2026-08-04T15:37:52.090562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:52.185651Z","title":"Model-free reinforcement learning with ensemble for a soft continuum robot arm,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:52.185651Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:631e93af6ab7c201e768cb7714f3f53ef45bda00395bb2134914b263d1738d79","observation_id":"3c66f321-f578-4e45-9d13-2aebc913cfad","resolution":{"observed_at":"2026-08-04T15:37:52.185651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:52.362899Z","title":"Pushing with soft robotic arms via deep reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:52.362899Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:3492ac27a0ef786e3928b9637be13904116b07a296ef2272e8147ecb8a829735","observation_id":"32c80fe8-307f-45d5-b82d-9f65e580ff5c","resolution":{"observed_at":"2026-08-04T15:37:52.362899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:52.540171Z","title":"Automated gait generation for walking, soft robotic quadrupeds,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:52.540171Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:5605a596adc43c6ad67638f7ead92c4f897e42e823ff224047e0acd40730fad0","observation_id":"a543d547-43c9-4c38-a257-e8f91cf4b243","resolution":{"observed_at":"2026-08-04T15:37:52.540171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:52.722862Z","title":"A platform with six degrees of freedom,","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:52.722862Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:a920d4627fc29f374d2af5e33333300d19d9d14b59b75ba98ac004ec00c22873","observation_id":"f600c745-6d8d-4cf8-97ee-490de5318efb","resolution":{"observed_at":"2026-08-04T15:37:52.722862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:52.833750Z","title":"Handedness in shearing auxetics creates rigid and compliant structures,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:52.833750Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:a853a2d63536877a9a6a0a1a9483ec7752ac2a842d3ea89b41bffa5e7650f214","observation_id":"b4300a37-343b-4545-9c91-8af14ff1c762","resolution":{"observed_at":"2026-08-04T15:37:52.833750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:52.947361Z","title":"A flexible, architected soft robotic actuator for motorized extensional motion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:52.947361Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:8bb16b19a95a9eea526b5e5a2af1ec4e4ee193339f436bae820d39f61e525210","observation_id":"b3a78656-316d-4e8d-8fb5-d68f53976789","resolution":{"observed_at":"2026-08-04T15:37:52.947361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.077630Z","title":"Challenges of real-world reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.077630Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:40f7abb55c33fb9e8c4b7b4f1782e66e5b249ebb3f738b916be09d3870c4f656","observation_id":"5359e697-4fb3-4d78-9be9-5fa0d2fbd2ee","resolution":{"observed_at":"2026-08-04T15:37:53.077630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.180415Z","title":"How to train your robot with deep reinforce- ment learning: lessons we have learned,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.180415Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:74684c9734fcc0f69c0dae8517db95761e1609539db2feac97b4dad3043ace34","observation_id":"41b56e40-30f0-4aba-bf62-c56cdf15a27b","resolution":{"observed_at":"2026-08-04T15:37:53.180415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.253938Z","title":"Hardware-in-the-loop soft robotic testing framework using an actor-critic deep reinforcement learning algorithm,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.253938Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:4c00cb335cdc15aa9bd6ba4041f85dc01d0394ae69f81594af0c787faa522f13","observation_id":"e1e5d8dd-d9f4-4c96-b4c4-0003b140d4a1","resolution":{"observed_at":"2026-08-04T15:37:53.253938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.323799Z","title":"Smooth exploration for robotic reinforce- ment learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.323799Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:d732c4b6382784c0d8395a124c1fe511433c4ba0cc9a4c164fdddcea1b8f1629","observation_id":"bb861ea1-8861-4e9d-9d73-3d6e9c6393bb","resolution":{"observed_at":"2026-08-04T15:37:53.323799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.383513Z","title":"Daydreamer: World models for physical robot learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.383513Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:c8a1d28f8c5460a6ef16acc12729ec053baed4097526faadbfccfca7b82339a7","observation_id":"2bc0ccdc-0d71-4aae-b8cb-4a842bc64be9","resolution":{"observed_at":"2026-08-04T15:37:53.383513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.565477Z","title":"Physical state exploration for reinforcement learning from scratch,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.565477Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:9f70c1bb1db6b78018179fad1ac36887e452d95369c75098eda7020ccdfda092","observation_id":"d0f227b7-5ba7-47f8-918d-093cfe7b361c","resolution":{"observed_at":"2026-08-04T15:37:53.565477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.734616Z","title":"Comparison of modern control methods for soft robots,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.734616Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:1661cbbde9a3f099cce097f69dc50aecb0ce756530d38879fc38d0ed4cd99b45","observation_id":"0b260e1a-ad62-445c-9c2e-ee03e394efe1","resolution":{"observed_at":"2026-08-04T15:37:53.734616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:53.882847Z","title":"Simple, low-hysteresis, foldable, fabric pneumatic artificial muscle,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:53.882847Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:5afc0b8482f1af6f2c9bb455c7fbb1366c4ee358e3e712392a4ead08ccd20e2d","observation_id":"1c574319-6a65-4a42-9824-efc97273099f","resolution":{"observed_at":"2026-08-04T15:37:53.882847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:54.029788Z","title":"Dynamic task space control enables soft manipulators to perform real-world tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.029788Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:67c1d777b45c194d7ffd3e3a1b9afa9d2c9feeaca8fc6a1704c2e22b6cfd7694","observation_id":"cebbe845-6431-4d03-81d4-9895e5578701","resolution":{"observed_at":"2026-08-04T15:37:54.029788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:54.167107Z","title":"Motorized, untethered soft robots via 3d printed auxetics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.167107Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:08cb0fe20791e492b2425959ffff29bf1193c9d56f8c7597c10599de84d3c43d","observation_id":"46e42502-2f86-402e-8c2a-1f9e5119d890","resolution":{"observed_at":"2026-08-04T15:37:54.167107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:54.312727Z","title":"A recipe for electrically-driven soft robots via 3d printed handed shearing auxetics,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.312727Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:ca96f355bed5cf4e0784f65afb7421a4076a34606816dfb7da396b248266eb52","observation_id":"b342668b-5679-465a-a121-a920d3a32fb7","resolution":{"observed_at":"2026-08-04T15:37:54.312727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:54.457234Z","title":"Electrically controllable materials for soft, bioinspired machines,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.457234Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:aa5e5b418fc5a6244b36beb9ce9c4802c46d463fb7059af5bec60328b0829233","observation_id":"ffa09f42-2233-45f3-92e4-37a6ce71c200","resolution":{"observed_at":"2026-08-04T15:37:54.457234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:54.583973Z","title":"Vision-based sensing for electrically- driven soft actuators,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.583973Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:27cf88dc8e2ce9068ca1920c6ed58e3d1704245e0dbfab2fe04c5772b5e0162c","observation_id":"f093d8ad-d358-4b6b-a3b8-11cc0bf35d55","resolution":{"observed_at":"2026-08-04T15:37:54.583973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:54.707697Z","title":"Fluidic innervation sensorizes structures from a single build material,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.707697Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:f3d0c6cade95b1f97c26e22b2784a6b3d68c65e867703bbc5f85f0ab0d4faa2b","observation_id":"ef4f8441-a9d4-4001-ad97-c30893436062","resolution":{"observed_at":"2026-08-04T15:37:54.707697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.10137","last_updated":"2017-11-29T02:56:39Z","snapshot_observed_at":"2026-08-14T20:09:30.589967Z","submitted_at":"2017-11-28T06:03:14Z","title":"One-Shot Reinforcement Learning for Robot Navigation with Interactive Replay","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.10137","snapshot_observed_at":"2026-08-04T15:37:54.853476Z","title":"One-shot reinforcement learning for robot navigation with interactive replay,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.853476Z"},"links":{"cited_paper":"/paper/1711.10137","citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:4f86cb263e8851d4e6be1da7f3719b74affefd6710b6b2d16e909c76f76808fe","observation_id":"85c6e961-9b7b-4153-a905-5096b4eea667","resolution":{"observed_at":"2026-08-04T15:37:54.853476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:54.975009Z","title":"Maximum diffusion reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:54.975009Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:03ec6541e8ba47fd4799a7f3e43de413f75b7593c43802669d11a213aba84f92","observation_id":"9da73e7e-a8a3-4928-a396-ef8b34216b13","resolution":{"observed_at":"2026-08-04T15:37:54.975009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:55.092285Z","title":"Reset-free guided policy search: Efficient deep reinforcement learning with stochastic initial states,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:55.092285Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:0c3c0394360d365d1eba39f161f6da8abca826359754b5c0e666823c08ced675","observation_id":"6b83fd82-ef4b-4d29-819d-e5c8b17204c6","resolution":{"observed_at":"2026-08-04T15:37:55.092285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07719","last_updated":"2020-02-12T19:54:41Z","snapshot_observed_at":"2026-07-06T08:30:10.653347Z","submitted_at":"2019-10-17T05:37:50Z","title":"Single Episode Policy Transfer in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07719","snapshot_observed_at":"2026-08-04T15:37:55.210056Z","title":"Single episode policy transfer in rein- forcement learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:55.210056Z"},"links":{"cited_paper":"/paper/1910.07719","citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:07d3e88bf8575299793957e61382d069834258fee39c17703deb0fa2c8be2530","observation_id":"c1a5abc7-51df-4898-8158-671818b57a0e","resolution":{"observed_at":"2026-08-04T15:37:55.210056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:55.337319Z","title":"Grow your limits: Continuous improvement with real-world rl for robotic locomotion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:55.337319Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:9aafe3cacbe3f30e0cd86117bc8dc558d9887004b9f880e7afb08e1e138bb096","observation_id":"20d89bd1-7e98-4f79-aaa5-d951324ab1e9","resolution":{"observed_at":"2026-08-04T15:37:55.337319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:55.480551Z","title":"You only live once: Single-life reinforce- ment learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:55.480551Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:caf870b7dfef28d4f15380d79f958e8bccb6b2909390ea8f12ab645dd7ac28b2","observation_id":"53bc0b99-b292-44eb-84d7-e18515a4700a","resolution":{"observed_at":"2026-08-04T15:37:55.480551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:55.604343Z","title":"Leave no trace: Learning to reset for safe and autonomous reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:55.604343Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:28427b40fcc697f3c823ca320f7903f6617808ce7be9ba0892dd935380efa4f5","observation_id":"c6c1baec-2dd8-407d-84cb-5295b0eb88f8","resolution":{"observed_at":"2026-08-04T15:37:55.604343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:55.774215Z","title":"Continual reinforcement learning in 3d non-stationary environments,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:55.774215Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:007aac0b95a420f80ed4c5ba91aaae1a914c7973120a1bf2da83c58a4748fc71","observation_id":"8ac6d6f4-7b63-467a-9122-5f2c6048f2c0","resolution":{"observed_at":"2026-08-04T15:37:55.774215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:55.904057Z","title":"Automating reinforcement learning with example-based resets,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:55.904057Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:bcf9c347847e4b6e86f6bef71e5666d606c9b45d98f4e79e44437bd00a11fef5","observation_id":"075cb962-af60-4e88-b4cb-c25e20ddb863","resolution":{"observed_at":"2026-08-04T15:37:55.904057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.054995Z","title":"Don’t start from scratch: Leveraging prior data to automate robotic reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.054995Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:23ae54ee3bf8d7363ca4dbc0c2c4f8c819ee756b2cbfa523a43b9deb38c5be10","observation_id":"c3a6e64a-ef4e-4dda-b71b-35bcfea595d9","resolution":{"observed_at":"2026-08-04T15:37:56.054995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.175874Z","title":"Reset-free reinforcement learning via multi- task learning: Learning dexterous manipulation behaviors without human intervention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.175874Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:a8e9f47504c9fb744f0a605b3aa0ce5fdde14cba680e6b53b615c29921d0e746","observation_id":"6147b90e-152d-4006-92f5-86b6767710ac","resolution":{"observed_at":"2026-08-04T15:37:56.175874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.311261Z","title":"Self-improving robots: End-to-end autonomous visuomotor reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.311261Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:df114bb3df0239e87df4a285d791ba1eeb1402c161c6d3985b030e71596d3b9a","observation_id":"2294289b-af76-47a3-aa45-70e0debd7ca7","resolution":{"observed_at":"2026-08-04T15:37:56.311261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.463211Z","title":"Rtmba: A real-time model-based rein- forcement learning architecture for robot control,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.463211Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:4670f8fc2f2ffd9d9ae192dedaa0d29898699cf03b6f6152b2118b10985e5519","observation_id":"a7f7f3f7-d3c0-4a90-8bd1-6b1b9fbf5aa3","resolution":{"observed_at":"2026-08-04T15:37:56.463211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.581469Z","title":"Curriculum learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.581469Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:4a45e1e1a1abfb18737f965720c4e232db536eab68bbca168c17e29d300c607b","observation_id":"fd5f2976-998e-48f9-b0d9-1627877bd533","resolution":{"observed_at":"2026-08-04T15:37:56.581469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.739032Z","title":"Curriculum learning for reinforcement learning domains: A framework and survey,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.739032Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:96c4cc6087a56f5b672d44da3c826e43d900f9c0aa757c7fd502ae4022cd2800","observation_id":"3e884152-24c5-421c-97f3-d061f0346db1","resolution":{"observed_at":"2026-08-04T15:37:56.739032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.860177Z","title":"A survey on curriculum learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.860177Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:fa9005d61adb0b48dd8551e633d8e26f758e125556909b0c7a743014bfe1b9c3","observation_id":"da293502-2e8d-44e7-9d1f-c47bdfc5fbbd","resolution":{"observed_at":"2026-08-04T15:37:56.860177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:56.975735Z","title":"Training and tracking in robotics.,","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:56.975735Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:5f97d4a89042d3955fa66647b45fe7d58e8e9eb953050f2097696031d1bf53e2","observation_id":"b3ec2291-c223-4d20-95c9-ba341513bb76","resolution":{"observed_at":"2026-08-04T15:37:56.975735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:57.070457Z","title":"Neural network learning control of robot manipulators using gradually increasing task difficulty,","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:57.070457Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:21e16f06a8d082a933bd7f3f8c73cafdc9227006bce678e5aed8f92e297767bb","observation_id":"8f1f780e-a3af-4c89-9d15-9146ba6796c3","resolution":{"observed_at":"2026-08-04T15:37:57.070457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:57.226356Z","title":"Stewart py,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:57.226356Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:d47050634440d93f126902027cecd243e03d2fcd245ccb6e4a226cf4114ad113","observation_id":"3b2d72da-8fc8-4598-a492-6873a6a4f130","resolution":{"observed_at":"2026-08-04T15:37:57.226356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:57.388713Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:57.388713Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:dd336ab8fde8c452fdec6f716b83b0c11b0e5a32be22dd12c59f7715b81b0322","observation_id":"400159d3-0e95-492b-b670-4b47ab1078d5","resolution":{"observed_at":"2026-08-04T15:37:57.388713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:57.548928Z","title":"Information theoretic mpc for model-based reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:57.548928Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:4d5b7fae1437ed724a6362e3aa26d315cd994e2591c722a45aa6242a76ac3946","observation_id":"0c361f60-cf7b-42ea-96c9-6ff1383bee22","resolution":{"observed_at":"2026-08-04T15:37:57.548928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:57.804000Z","title":"Aggressive driving with model predic- tive path integral control,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:57.804000Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:8f7f018c80aac48d0aad2d5d02571ef430db80a868edc8cd5e09b5908508586b","observation_id":"7c690f93-d974-4921-8102-1311f04244d8","resolution":{"observed_at":"2026-08-04T15:37:57.804000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T15:37:57.981796Z","title":"Model-based reinforcement learning: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T15:37:57.981796Z"},"links":{"citing_paper":"/paper/2509.19525"},"observation_digest":"sha256:c6ecc64724766d1a365c5e59ac7a39da34d4a9831750100029a5105878238b01","observation_id":"76d71152-c799-47bc-bff9-75c5d2e9820b","resolution":{"observed_at":"2026-08-04T15:37:57.981796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.19525","last_updated":"2025-09-23T19:45:21Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-17T21:33:40.273334Z","submitted_at":"2025-09-23T19:45:21Z","title":"Real-Time Reinforcement Learning for Dynamic Tasks with a Parallel Soft Robot"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2509.19525."}