{"as_of":"2026-08-08T06:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e5e42c3adbb5fb07c0ac97b46baf8d4fb0ccd09e2ece70416328d46a561d75e","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:26:30.721159Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.21916/citation-record","integrity":"/paper/2505.21916/integrity","json":"/paper/2505.21916/citation-record.json","paper":"/paper/2505.21916"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-07T13:26:26.933507Z","title":"π 0: A vision-language-action flow model for general robot control,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:26.933507Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:42b1849328969c1a314f4da1b1b4712342e8457f2b97bacfb35e84c9fcd1530b","observation_id":"dde0c067-a19c-4bb4-a90a-fc4a2df9b1dc","resolution":{"observed_at":"2026-08-07T13:26:26.933507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:36.511600Z","title":"Catch it! learning to catch in flight with mobile dexterous hands,","venue":null,"work_id":"8bf834a3-1fe5-46db-8c8d-0b9ff01f2063","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.044744Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:513f651f2072849416063c8a83b0ea18901a69783bd6c17c02a0ea20b384830d","observation_id":"9f6e0cc4-f8e1-4751-be15-928630f409cb","resolution":{"observed_at":"2026-08-07T13:26:36.571364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02635","last_updated":"2026-04-23T15:06:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-04T07:56:42Z","title":"Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02635","snapshot_observed_at":"2026-08-07T13:26:27.138792Z","title":"Reinforcement learning with foundation priors: Let the embodied agent efficiently learn on its own,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.138792Z"},"links":{"cited_paper":"/paper/2310.02635","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:f5d8c2d886a5336336209154821156f0d2c329127baa1519d52036629a133c7b","observation_id":"1841f679-70c0-43e7-bdd4-f68484d81443","resolution":{"observed_at":"2026-08-07T13:26:27.138792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:36.322574Z","title":"Roboagent: Generalization and efficiency in robot manipulation via semantic augmentations and action chunking,","venue":null,"work_id":"1d744b6a-32e1-467a-82c3-bcc12706ecd5","year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.219525Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:f655cdfc5f5ccba7caba3939b2f22ee684640ecf3c22be71c9b578479a688f8f","observation_id":"1abd5754-45bb-45f9-8ccb-57100baebb7b","resolution":{"observed_at":"2026-08-07T13:26:36.410113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:27.288599Z","title":"Diffusion policy: Visuomotor policy learning via ac- tion diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.288599Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:8a51758668a23e3258ebb639d6362080fc3cade650c6a05858c7574c60e0875c","observation_id":"d2e3e260-18f9-4865-bca9-c236acf5b96f","resolution":{"observed_at":"2026-08-07T13:26:27.288599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10329","last_updated":"2024-03-06T00:11:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-15T21:11:50Z","title":"Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10329","snapshot_observed_at":"2026-08-07T13:26:27.372085Z","title":"Universal manipulation interface: In-the-wild robot teaching without in-the-wild robots,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.372085Z"},"links":{"cited_paper":"/paper/2402.10329","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:308f99ea84d60845c83fab9579d3217020e6c73e832ee081fd77623a69c1e498","observation_id":"1a818a0e-9eb9-4d24-bcb1-cc8277653bf5","resolution":{"observed_at":"2026-08-07T13:26:27.372085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:36.055304Z","title":"UMI on legs: Making manipulation policies mobile with manipulation-centric whole-body controllers,","venue":null,"work_id":"f9a75d9d-711f-4cd1-833f-b2dd7183598b","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.448258Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:22b8d03f2e4a3a40a9f16f10eb30c649c5dd107a57070749324c888f59d75949","observation_id":"3d9c947f-18ab-4d0e-8904-b337e9c1468b","resolution":{"observed_at":"2026-08-07T13:26:36.146040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14400","last_updated":"2025-07-02T08:26:20Z","snapshot_observed_at":"2026-07-06T20:25:31.304367Z","submitted_at":"2025-01-24T11:11:53Z","title":"SKIL: Semantic Keypoint Imitation Learning for Generalizable Data-efficient Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14400","snapshot_observed_at":"2026-08-07T13:26:27.535567Z","title":"Skil: Semantic keypoint imitation learning for generalizable data-efficient manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.535567Z"},"links":{"cited_paper":"/paper/2501.14400","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:66a7593afda15bfae2830436ef3e4544051148920d917a87782e14f623f0a385","observation_id":"9b125b66-afd3-4529-b500-dbfee911de7b","resolution":{"observed_at":"2026-08-07T13:26:27.535567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.831701Z","title":"Rt-1: Robotics transformer for real-world control at scale,","venue":null,"work_id":"b136dfc0-8b78-4eef-84e9-90d2fb8f8750","year":2022},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.626948Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:ac38c156e526bdce348c2bc942549953e3e7ed43d277bcc9bd97cc2b8f85948f","observation_id":"93f944c3-9a32-465c-8dd2-7b02c676f962","resolution":{"observed_at":"2026-08-07T13:26:35.947994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.643509Z","title":"Openvla: An open-source vision-language-action model,","venue":null,"work_id":"08cf28b4-582f-4b60-8037-00c0a90676b4","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.705369Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:91d9a705ac8f6afecc1b7eb779bb6a2c68cb0ea326cd63d645c7e59143b9fcfa","observation_id":"566b6b29-ce8c-4803-8fd9-43d9c06e3977","resolution":{"observed_at":"2026-08-07T13:26:35.717526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-07T13:26:27.782344Z","title":"Rdt-1b: a diffusion foundation model for bimanual manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.782344Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:32c05af450bd98703478a64dae592f6d4f0cc90230071da035717c26e4cf5191","observation_id":"9c99f3bd-bee6-41bf-8229-358bde098955","resolution":{"observed_at":"2026-08-07T13:26:27.782344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.444665Z","title":"Copa: General robotic manipulation through spatial constraints of parts with foundation models,","venue":null,"work_id":"b795992a-7825-4446-bc94-37684fc56c35","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.870762Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:d09801556884bf67c5426eb959d41ace09ea10d18f9d156a2edc9a8bc439bef4","observation_id":"3d051b29-32ce-4515-b48c-61b8d6100d8d","resolution":{"observed_at":"2026-08-07T13:26:35.542360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:27.988402Z","title":"Onetwovla: A unified vision-language-action model with adaptive reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:27.988402Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:eeda2984bd87d27605a93e98e099111c2ea3034113e777c31c8c890c50878bfe","observation_id":"1c315c49-60a8-468f-861c-1766ead52a0b","resolution":{"observed_at":"2026-08-07T13:26:27.988402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09160","last_updated":"2025-07-12T06:44:37Z","snapshot_observed_at":"2026-08-07T10:59:00.776993Z","submitted_at":"2025-07-12T06:44:37Z","title":"Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.09160","snapshot_observed_at":"2026-08-07T13:26:28.067832Z","title":"Tactile- vla: Unlocking vision-language-action model’s physical knowledge for tactile generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.067832Z"},"links":{"cited_paper":"/paper/2507.09160","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:475a009bbdf0f1d673d271e2beb3a515554e713263c797fad15572236796ee7a","observation_id":"3b0f671b-579c-4dbe-a7d7-2a76569d55c1","resolution":{"observed_at":"2026-08-07T13:26:28.067832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:35.199520Z","title":"Itera- tive residual policy: for goal-conditioned dynamic manipulation of deformable objects,","venue":null,"work_id":"2477de84-2dfe-4052-9954-5d2a33086fdd","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.167940Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:df99fa40e576a4d16316f9b2b6c123cf1ce444b9526c9676954ae369b88afb03","observation_id":"54865958-4082-4bd8-b9fe-de647e0e243e","resolution":{"observed_at":"2026-08-07T13:26:35.319684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.888062Z","title":"Dynamic handover: Throw and catch with bimanual hands,","venue":null,"work_id":"fd8280f5-997d-4f78-abc9-0f2c84ec4a49","year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.264807Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:307870052125a55f5ec52b05895f4a7f12552d6f50f687f0d0b54ee48756a6f1","observation_id":"409f3c03-2e24-4a06-b4bb-276049887685","resolution":{"observed_at":"2026-08-07T13:26:35.049367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:28.365732Z","title":"Tossing- bot: Learning to throw arbitrary objects with residual physics,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.365732Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:2d29a8271edf36deb6a86b8588d61853aa7c3bb91471f45b127c260a97627425","observation_id":"0940180c-58d3-43f0-977a-7290a7d4d1ff","resolution":{"observed_at":"2026-08-07T13:26:28.365732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.640282Z","title":"A stochastic dynamic motion planning al- gorithm for object-throwing,","venue":null,"work_id":"2bf1fcc4-d442-4b52-a5e3-92f9d63be8d0","year":2015},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.466750Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:718301251fc6bf0ee731acd7c233051dbfdbe6269957ee847b8d47f47dd981c1","observation_id":"ed05babb-c3e0-49b7-a7b3-7bd603461c4a","resolution":{"observed_at":"2026-08-07T13:26:34.753541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.334876Z","title":"Optimal shape and motion planning for dynamic planar manipulation,","venue":null,"work_id":"ecc8138d-c69c-469f-87d8-2ec74e2b6878","year":2019},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.614868Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:838182283060ee6be724756873bb58d846eaae373652c839fe4c63517dbef84d","observation_id":"41f110a7-93d0-4e8e-9ed7-82de4746097a","resolution":{"observed_at":"2026-08-07T13:26:34.496952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:34.058794Z","title":"Learning agile robotic locomotion skills by imitating animals,","venue":null,"work_id":"2c0d97cd-898c-4f65-98a0-c118be17ab94","year":2020},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.756928Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:46eee2d464b508189b3535e1a18ff419ef2a600d3b21a2be92853d5595c6ff66","observation_id":"e30fe29a-1bf1-4fcf-9ecd-486fb5b5cd6e","resolution":{"observed_at":"2026-08-07T13:26:34.159475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:28.851555Z","title":"Tool-as-interface: Learning robot policies from human tool usage through imitation learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.851555Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:55a1c7b41d6ce1ec8c6341f4c3a43cdbb1e44e54e28116ccf4bb24005511bf7a","observation_id":"ab0143bf-26f3-4fc1-83fa-bcf95e4a42c8","resolution":{"observed_at":"2026-08-07T13:26:28.851555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15266","last_updated":"2024-05-24T06:50:14Z","snapshot_observed_at":"2026-07-06T18:19:08.871953Z","submitted_at":"2024-05-24T06:50:14Z","title":"Conditional Variational Auto Encoder Based Dynamic Motion for Multi-task Imitation Learning","version":1},"cited_work":{"arxiv_id":"2405.15266","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.15266","snapshot_observed_at":"2026-08-07T13:26:31.235498Z","title":"Conditional Variational Auto Encoder Based Dynamic Motion for Multi-task Imitation Learning","venue":"cs.RO","work_id":"ea2b7f00-c961-41d1-b06e-94747a469f5c","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:28.970885Z"},"links":{"cited_paper":"/paper/2405.15266","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:3bb732cf217dbb4ae056b629d22ddcd5b4cb76418ccf5e9be8c0d09f080e2044","observation_id":"2c6da33a-1826-4123-8f81-98d0b68c35a3","resolution":{"observed_at":"2026-08-07T13:26:31.316019Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05681","last_updated":"2025-04-01T02:01:17Z","snapshot_observed_at":"2026-08-08T02:27:25.068559Z","submitted_at":"2024-10-08T04:40:54Z","title":"Whole-Body Dynamic Throwing with Legged Manipulators","version":2},"cited_work":{"arxiv_id":"2410.05681","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05681","snapshot_observed_at":"2026-08-07T13:26:30.990595Z","title":"Whole-Body Dynamic Throwing with Legged Manipulators","venue":"cs.RO","work_id":"04939c4a-422f-40db-8563-3582c5293ea9","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.051887Z"},"links":{"cited_paper":"/paper/2410.05681","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:b0970ec504c7fadb10809cc355c02080c2ee5a1c54c81e4cb70cc3259cb588c7","observation_id":"654d17d7-a9b9-44b9-9e33-e6b0efd39dbd","resolution":{"observed_at":"2026-08-07T13:26:31.122942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.836398Z","title":"Mockus, V","venue":null,"work_id":"400d67da-52ad-413a-a4d4-a825d190f996","year":2014},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.136403Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:a4fc686748cd7c44d44df255a0503097412cd9a2635f1a6ae34ccf36b0527e70","observation_id":"cc0130f0-e586-4643-85ed-78d7cda9fac6","resolution":{"observed_at":"2026-08-07T13:26:33.939466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.525930Z","title":"Gaussian processes in machine learning,","venue":null,"work_id":"e9ed98a3-3882-48bd-8d34-f6231a83443f","year":2004},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.223928Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:a497bd3cd137ba63070626fdeab687e50bec75a0d95599e26069255d7b7e92fd","observation_id":"1159557e-02ba-4e8c-9fb3-29f6535b7d1e","resolution":{"observed_at":"2026-08-07T13:26:33.653150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.311744Z","title":"A ball-throwing robot with visual feedback,","venue":null,"work_id":"0b00da8c-2a71-406d-a72f-09025a9a2554","year":2010},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.308002Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:41b6b238809f73d51e9ea78156d945e911517144797d51891b723a12e2a1cf40","observation_id":"fe1c5f1b-6392-4471-87cd-2ab77dfa0faa","resolution":{"observed_at":"2026-08-07T13:26:33.421876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:33.116041Z","title":"Dynamic task execution using active parameter identification with the baxter research robot,","venue":null,"work_id":"f0a03adf-c336-45fd-b37b-68ba218d97ab","year":2017},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.455825Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:5545f723b5e344e28ed6a5d9bf8f66432e6649a41a9c25b1ebae874268252def","observation_id":"c272b6ad-0489-4fa3-be30-1fb439c7e960","resolution":{"observed_at":"2026-08-07T13:26:33.195062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:29.571907Z","title":"Dynamic movement primitives in robotics: A tutorial survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.571907Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:b62f791446210d255ffa601a17704fb1431bcc7d3a6765a2c8c0d4aef616ae4d","observation_id":"e46e3e95-2ae3-419d-ab66-f82cc7c1f180","resolution":{"observed_at":"2026-08-07T13:26:29.571907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.846051Z","title":"Probabilistic movement primitives,","venue":null,"work_id":"741a1ed6-87f1-43cd-91b7-ca36825d0191","year":2013},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.656775Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:f6f896e254ff0661c68917c041f8b190cea91ed8cc7e7af4ca0c223f51411daf","observation_id":"ee8585f3-7a79-47e3-997e-c45826390cd3","resolution":{"observed_at":"2026-08-07T13:26:32.985900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:29.794186Z","title":"Prodmp: A unified perspective on dynamic and probabilistic move- ment primitives,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.794186Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:ef0f4b6cc89e4ef526a6d6621a5da21984df53725ef2b73d448d07e9d5aec3a9","observation_id":"828c0b84-50c8-4611-b4e0-f7cdfde5a8bf","resolution":{"observed_at":"2026-08-07T13:26:29.794186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.645969Z","title":"Learning table tennis with a mixture of motor primitives,","venue":null,"work_id":"a245c51b-250f-42b8-8847-d6f0ac5ab36b","year":2010},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:29.941186Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:d7d40ca4b183c4f36bb93034721466cd9fe503b47a78e03ab85d50c21e530fae","observation_id":"ca74b015-19e8-4212-848f-115f4d5c7298","resolution":{"observed_at":"2026-08-07T13:26:32.727050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.424526Z","title":"Residual learning from demonstration: Adapting dmps for contact-rich manipulation,","venue":null,"work_id":"a2e25d91-f3be-4744-9380-12ab13e9b04a","year":2022},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.058492Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:a3f7bab00bcef5972e0ea1acfb399da7146f1d374bc84419415cb5051b7a4afe","observation_id":"f84174ff-b5d3-4a09-98f8-cf654d3b4dfa","resolution":{"observed_at":"2026-08-07T13:26:32.532660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.03918","last_updated":"2022-03-08T08:27:10Z","snapshot_observed_at":"2026-08-07T22:31:10.252959Z","submitted_at":"2022-03-08T08:27:10Z","title":"Residual Robot Learning for Object-Centric Probabilistic Movement Primitives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.03918","snapshot_observed_at":"2026-08-07T13:26:30.165854Z","title":"Residual robot learning for object-centric probabilistic movement primitives,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.165854Z"},"links":{"cited_paper":"/paper/2203.03918","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:56b32685ad1579c2a2bf9dfec613871e577e24da4696ee9fc0d0e7a43cec696b","observation_id":"7bd44fb3-2d90-4ab9-b78a-53a7556d8720","resolution":{"observed_at":"2026-08-07T13:26:30.165854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:32.152123Z","title":"Optimizing robot striking movement primitives with iterative learning control,","venue":null,"work_id":"fb8df849-73db-40c5-82ee-e881fb510621","year":2015},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.241146Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:e700c9f1a692ea45d9045c58f16ec9a30c7d9fc970e3daad2d9a6f777fb8c2b3","observation_id":"a33ad91e-5220-4e9c-acb6-1e5527efa933","resolution":{"observed_at":"2026-08-07T13:26:32.249735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07294","last_updated":"2025-08-17T08:03:16Z","snapshot_observed_at":"2026-08-07T15:47:59.123181Z","submitted_at":"2025-05-12T07:31:42Z","title":"HuB: Learning Extreme Humanoid Balance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07294","snapshot_observed_at":"2026-08-07T13:26:30.356430Z","title":"Hub: Learning extreme humanoid balance,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.356430Z"},"links":{"cited_paper":"/paper/2505.07294","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:b03727b17c801f57cf79f79ea23f7af6f0c25ab4a26e8254dee6cbf888181c92","observation_id":"c58ef950-819b-49cc-8cb6-ace9411fdcde","resolution":{"observed_at":"2026-08-07T13:26:30.356430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:31.959282Z","title":"Serl: A software suite for sample- efficient robotic reinforcement learning,","venue":null,"work_id":"2bee49cd-1016-4df7-9396-359fc3618bde","year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.444239Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:c24f6e54c18630bd160720deef3f43cb8a2f41235997a6ea3cef55c86f414726","observation_id":"bb115905-d894-472a-80c0-0855f0f53da1","resolution":{"observed_at":"2026-08-07T13:26:32.053382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21845","last_updated":"2025-03-20T09:16:05Z","snapshot_observed_at":"2026-07-06T19:41:24.411424Z","submitted_at":"2024-10-29T08:12:20Z","title":"Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21845","snapshot_observed_at":"2026-08-07T13:26:30.534038Z","title":"Precise and dexterous robotic manipulation via human-in-the-loop reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.534038Z"},"links":{"cited_paper":"/paper/2410.21845","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:ca1b2cc61c25a2725949410a452a63d225a52f4890a694db02d212db48fd9532","observation_id":"216a3b5f-2cca-4dda-a44d-aae64872c4a7","resolution":{"observed_at":"2026-08-07T13:26:30.534038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:26:31.755260Z","title":"Asap: Aligning simulation and real-world physics for learning agile humanoid whole-body skills,","venue":null,"work_id":"b543c018-fbb2-4b5a-b7b8-1728f242a10c","year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.680147Z"},"links":{"citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:1741abdda74c8b35eafa962dbc5c511ab15973d78473f91ccbb8e23fce64b646","observation_id":"6deab804-ea55-4a5f-b512-96f082ec0cb2","resolution":{"observed_at":"2026-08-07T13:26:31.847434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-07T13:26:30.721159Z","title":"Glm-4.5v and glm-4.1v-thinking: Towards versatile multimodal reasoning with scalable reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:26:30.721159Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2505.21916"},"observation_digest":"sha256:d9fbd721aa37689f2d646cb279dcf76989a9bd06fad8f34355fc7536cdcc7d80","observation_id":"6f8bc91c-4f66-4844-b669-7a3a93dcb7f4","resolution":{"observed_at":"2026-08-07T13:26:30.721159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.21916","last_updated":"2026-06-23T04:20:51Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-07T13:17:10.164373Z","submitted_at":"2025-05-28T03:03:38Z","title":"Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":2,"verified_fuzzy":21},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2505.21916."}