{"as_of":"2026-08-07T10:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7679ffdd4544d5b33096b2ca145192b47518764ac7084a4d478b99d9170030dd","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T12:40:11.283716Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.01651/citation-record","integrity":"/paper/2607.01651/integrity","json":"/paper/2607.01651/citation-record.json","paper":"/paper/2607.01651"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1708.08611","last_updated":"2017-09-03T20:35:33Z","snapshot_observed_at":"2026-07-06T05:57:03.852252Z","submitted_at":"2017-08-29T07:16:54Z","title":"Safe Reinforcement Learning via Shielding","version":2},"cited_work":{"arxiv_id":"1708.08611","doi":null,"metadata_source":"pith","pith_arxiv_id":"1708.08611","snapshot_observed_at":"2026-07-03T12:48:11.098500Z","title":"Safe Reinforcement Learning via Shielding","venue":"cs.LO","work_id":"f8d9458b-2559-478a-b180-3f0daea682ae","year":2017},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1708.08611","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:c52a2abecbfe891bf8e8fd5c19d8026fa5b4cd3ae0cc6a571f41d490bd97be03","observation_id":"c5dba6b1-5136-41bb-bf5a-955fe37370f3","resolution":{"observed_at":"2026-07-03T12:48:11.099901Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05450","last_updated":"2025-04-14T04:53:32Z","snapshot_observed_at":"2026-08-01T15:07:04.704348Z","submitted_at":"2025-02-08T05:01:17Z","title":"ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy","version":2},"cited_work":{"arxiv_id":"2502.05450","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.05450","snapshot_observed_at":"2026-07-10T23:07:47.914406Z","title":"Conrft: A reinforced fine-tuning method for vla models via con- sistency policy.arXiv preprint arXiv:2502.05450","venue":"cs.RO","work_id":"12e4ef8e-5311-42c5-86de-e8a0c0a4c1c1","year":2025},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2502.05450","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:e11af3ba6b87dcfec416d328e5c4aae399d7638bf21d15eaf547328aa235a54b","observation_id":"ae239259-5324-4226-b3eb-ab2aeac532bb","resolution":{"observed_at":"2026-07-03T12:48:11.139831Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.12372","last_updated":"2026-06-10T17:38:24Z","snapshot_observed_at":"2026-08-06T11:07:11.202179Z","submitted_at":"2026-06-10T17:38:24Z","title":"UniIntervene: Agentic Intervention for Efficient Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2606.12372","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.12372","snapshot_observed_at":"2026-07-03T12:48:11.119197Z","title":"UniIntervene: Agentic Intervention for Efficient Real-World Reinforcement Learning","venue":"cs.RO","work_id":"6c6c17e4-4ff7-489a-a048-7967208251f2","year":2026},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2606.12372","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:0b594751a5367602dbf9cb39aad4cf256721042e05ffc4cb134fd81756f5d911","observation_id":"3e54b218-d694-4087-8280-87588666b55e","resolution":{"observed_at":"2026-07-03T12:48:11.120391Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.12901","last_updated":"2019-04-29T18:40:15Z","snapshot_observed_at":"2026-07-06T07:49:17.886466Z","submitted_at":"2019-04-29T18:40:15Z","title":"Challenges of Real-World Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1904.12901","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.12901","snapshot_observed_at":"2026-07-03T12:48:11.128704Z","title":"Challenges of Real-World Reinforcement Learning","venue":"cs.LG","work_id":"fc99449a-80f4-4f37-a028-7b3774c78bf6","year":2019},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1904.12901","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:f5c741ea327dccc2ab144713634c893ed88a50bbc9a9ae56ea65d787a23f94e9","observation_id":"096060d8-e486-466b-985f-203fec17463b","resolution":{"observed_at":"2026-07-03T12:48:11.129886Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.01292","last_updated":"2018-02-14T18:14:34Z","snapshot_observed_at":"2026-07-06T05:40:38.039175Z","submitted_at":"2017-05-03T08:18:51Z","title":"A General Safety Framework for Learning-Based Control in Uncertain Robotic Systems","version":3},"cited_work":{"arxiv_id":"1705.01292","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.01292","snapshot_observed_at":"2026-07-03T12:48:11.133816Z","title":"A General Safety Framework for Learning-Based Control in Uncertain Robotic Systems","venue":"cs.RO","work_id":"15c9ad8a-9291-4e6a-90bd-dec35a1dcc36","year":2017},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1705.01292","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:201b1ac777355e52e15791b8e28ecc1045baa3f327aa930eb4eb61a9319ebce8","observation_id":"85de99bf-ef5d-47f1-944c-3151127b0eb0","resolution":{"observed_at":"2026-07-03T12:48:11.134980Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2012.62251","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T12:48:11.131152Z","title":"In: 2012 IEEE International Conference on Robotics and Automation","venue":null,"work_id":"28bbae4d-41af-404e-a926-3b41e38afd7f","year":2012},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:3f84821bef0a9299f69b2e38da9e593b8e59e6f26be48df4fb32f0cf88113b4f","observation_id":"c7df5e04-4c97-4e3e-8c7b-a5e95421d956","resolution":{"observed_at":"2026-07-03T12:48:11.132576Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08273","last_updated":"2021-09-17T01:21:16Z","snapshot_observed_at":"2026-08-05T03:04:46.264171Z","submitted_at":"2021-09-17T01:21:16Z","title":"ThriftyDAgger: Budget-Aware Novelty and Risk Gating for Interactive Imitation Learning","version":1},"cited_work":{"arxiv_id":"2109.08273","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.08273","snapshot_observed_at":"2026-07-03T12:48:11.111034Z","title":"Thriftydagger: Budget-aware novelty and risk gating for interactive imitation learning","venue":null,"work_id":"f1678abd-ca2e-4c2f-a858-081c1f0fbc23","year":2021},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2109.08273","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:81c35123cc371d563006b9eb89ac0596b4fa4e444fc5d3a56f164b8a8c18800c","observation_id":"2fc3bb0c-3a6a-4c76-a83c-dba5050bb49e","resolution":{"observed_at":"2026-07-03T12:48:11.112599Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12252","last_updated":"2025-08-26T03:21:20Z","snapshot_observed_at":"2026-08-06T17:36:38.597196Z","submitted_at":"2025-08-17T06:17:06Z","title":"Robot Trains Robot: Automatic Real-World Policy Adaptation and Learning for Humanoids","version":2},"cited_work":{"arxiv_id":"2508.12252","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.12252","snapshot_observed_at":"2026-07-03T12:48:11.092966Z","title":"arXiv preprint arXiv:2508.12252 , year=","venue":null,"work_id":"5c2bd5a9-0382-4951-9444-3639efa57cc3","year":2025},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2508.12252","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:e62e9f490ade975cc2ff8bd91118de81a4e78cf7a23ee89b23f061db1fb1ceef","observation_id":"d5dff37c-69d6-4fb0-bded-f9c65388aa07","resolution":{"observed_at":"2026-07-03T12:48:11.094715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.06411","last_updated":"2021-06-10T17:58:27Z","snapshot_observed_at":"2026-07-06T11:09:15.957979Z","submitted_at":"2021-05-13T16:36:55Z","title":"Coarse-to-Fine Imitation Learning: Robot Manipulation from a Single Demonstration","version":2},"cited_work":{"arxiv_id":"2105.06411","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2105.06411","snapshot_observed_at":"2026-07-03T12:48:11.087509Z","title":null,"venue":null,"work_id":"97cda4d1-d778-4640-ab93-888911991ff1","year":2021},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2105.06411","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:6115606c538dea9a49d892335aeaee91dc28e524f20ab4baeab9db7c612b02a7","observation_id":"db0c5ccd-8033-450b-9350-057f1ecfb93c","resolution":{"observed_at":"2026-07-03T12:48:11.088930Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02890","last_updated":"2019-03-11T06:46:08Z","snapshot_observed_at":"2026-07-06T07:06:25.320715Z","submitted_at":"2018-10-05T21:18:40Z","title":"HG-DAgger: Interactive Imitation Learning with Human Experts","version":2},"cited_work":{"arxiv_id":"1810.02890","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02890","snapshot_observed_at":"2026-07-03T12:48:11.116933Z","title":"HG-DAgger: Interactive Imitation Learning with Human Experts","venue":"cs.RO","work_id":"3cc4bc5d-bf6e-47e3-b418-991ad78e71de","year":2018},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1810.02890","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:54cbcfee9ce189a8d8b7e64945f80a8018d307a792e93e5b25ec02bf843caf21","observation_id":"a1302369-e653-4647-8e51-5c4441b1d9ea","resolution":{"observed_at":"2026-07-03T12:48:11.118041Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.07821","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:39:37.233863Z","title":"Failure-Aware RL: Reliable Offline- to-Online Reinforcement Learning with Self-Recovery for Real-World Manipulation","venue":null,"work_id":"b14fdb96-19ec-4e4e-b453-e80e55f5e609","year":2026},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:ffcaf1f96898a12cf6b7be536a7d81481a7e5c9a5a1ac296b7c1aa46ee3bee6b","observation_id":"6b1b0889-0d09-4e2d-9f6d-0851eb82d7bd","resolution":{"observed_at":"2026-07-03T12:48:11.086430Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10885","last_updated":"2020-01-24T03:12:03Z","snapshot_observed_at":"2026-07-06T08:31:48.262897Z","submitted_at":"2019-10-24T02:22:42Z","title":"Robust Model Predictive Shielding for Safe Reinforcement Learning with Stochastic Dynamics","version":2},"cited_work":{"arxiv_id":"1910.10885","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.10885","snapshot_observed_at":"2026-07-03T12:48:11.123755Z","title":"Liu et al","venue":null,"work_id":"5907e728-d313-4e4d-b37c-b574954b7c91","year":2020},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1910.10885","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:130149916f4e86c425777e8c28fc6ef8b2897402f085edbf91a56d633e6c26fe","observation_id":"9530e7d5-4547-4625-9f36-119200c0fba9","resolution":{"observed_at":"2026-07-03T12:48:11.125043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.08416","last_updated":"2023-07-04T00:03:55Z","snapshot_observed_at":"2026-07-06T14:18:45.878111Z","submitted_at":"2022-11-15T18:53:39Z","title":"Robot Learning on the Job: Human-in-the-Loop Autonomy and Learning During Deployment","version":3},"cited_work":{"arxiv_id":"2211.08416","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.08416","snapshot_observed_at":"2026-07-03T12:48:11.101049Z","title":null,"venue":null,"work_id":"e1e00eaf-4e6b-4785-b35c-e038ef91f4dd","year":2023},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2211.08416","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:4578f1484c5859b6b41e6152094ae278863dd99259fc7028d395dc727bac0bc5","observation_id":"dac69b05-f6ac-4ef5-8ee6-28e583e21304","resolution":{"observed_at":"2026-07-03T12:48:11.102416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:10:48.216454Z","title":"In: 2024 IEEE International Conference on Robotics and Automation (ICRA)","venue":null,"work_id":"688a800b-28e1-41af-ba2f-98eca0d2002d","year":2024},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:966de050029be10f42bd8d16a384f982b26d106cb3ac230d8aa7662bd6fae3b8","observation_id":"f1702531-5658-4dec-965f-96ae4d77bfb8","resolution":{"observed_at":"2026-07-05T08:10:48.217576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:10:48.218146Z","title":"Science Robotics10(105), eads5033 (2025)","venue":null,"work_id":"bd4356f0-a013-474b-b7ba-4f2a8ac580ce","year":2025},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:1b48cc18a3c21ec2880e22ea9ea988d829acd09cfc5de45ec82efac86eddb7d2","observation_id":"1fe52abe-072e-402f-82e1-73fbb11a7d71","resolution":{"observed_at":"2026-07-05T08:10:48.219700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.06733","last_updated":"2020-12-12T05:30:35Z","snapshot_observed_at":"2026-07-06T10:23:43.246202Z","submitted_at":"2020-12-12T05:30:35Z","title":"Human-in-the-Loop Imitation Learning using Remote Teleoperation","version":1},"cited_work":{"arxiv_id":"2012.06733","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.06733","snapshot_observed_at":"2026-07-04T13:09:50.357171Z","title":"Human-in-the-loop imitation learning using remote tele- operation","venue":null,"work_id":"d26db493-4fc8-4cd0-833f-2934093e0b1b","year":2012},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2012.06733","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:59a7a20f3362a795f5f80c9bc9343c71a944d0b2b3d4ebf9b9144468c8bad0ca","observation_id":"5ab7515f-1351-4d40-96fd-6ec3b15cd3ca","resolution":{"observed_at":"2026-07-03T12:48:11.083696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1312.5602","doi":"10.48550/arxiv.1312.5602","metadata_source":"pith","pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Playing Atari with Deep Reinforcement Learning","venue":"cs.LG","work_id":"736a8ddf-e365-4940-ad58-4699fddedb86","year":2013},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:cd2acf48f3d7d0c169676b70c98bb368419988873062ea44bb84d9667ce39df4","observation_id":"b19b1f52-e108-4769-9bf9-1e6415382d28","resolution":{"observed_at":"2026-07-03T12:48:11.122714Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:10:48.214520Z","title":"In: 2018 IEEE inter- national conference on robotics and automation (ICRA)","venue":null,"work_id":"43cd4198-c76d-44eb-afd8-ae85ce9d5d93","year":2018},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:9f39b3d14e58cfe18c6dd446ce296097fda8982c64d72b8ee54b16dbf1336a49","observation_id":"8166d853-2ce5-45c9-abe7-97bd198254a8","resolution":{"observed_at":"2026-07-05T08:10:48.215720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12345","last_updated":"2023-12-19T17:17:52Z","snapshot_observed_at":"2026-07-06T17:05:27.005904Z","submitted_at":"2023-12-19T17:17:52Z","title":"On the Effectiveness of Retrieval, Alignment, and Replay in Manipulation","version":1},"cited_work":{"arxiv_id":"2312.12345","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.12345","snapshot_observed_at":"2026-07-03T12:48:11.136039Z","title":null,"venue":null,"work_id":"57c45967-132b-489b-88cc-a219a6fcb7d2","year":2023},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2312.12345","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:f0392a612c5b461ad787457d8c85f2d9290c92756c65edaea1d43b1f0ebaaadd","observation_id":"2e50b993-2f39-42ec-a407-77de45d7801f","resolution":{"observed_at":"2026-07-03T12:48:11.137310Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19693","last_updated":"2024-10-25T17:06:50Z","snapshot_observed_at":"2026-07-06T19:39:47.007952Z","submitted_at":"2024-10-25T17:06:50Z","title":"MILES: Making Imitation Learning Easy with Self-Supervision","version":1},"cited_work":{"arxiv_id":"2410.19693","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.19693","snapshot_observed_at":"2026-07-03T12:48:11.113681Z","title":"arXiv preprint arXiv:2410.19693 (2024)","venue":null,"work_id":"ca8a1ef0-df0c-4f1c-bfdc-54db76c59984","year":2024},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2410.19693","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:469a96598e54c61251b210b8d1561452521c567dd64f8ffc76a9e53209b71d3b","observation_id":"7c9c7f79-8910-4b27-ad04-9e2a2a16c1d4","resolution":{"observed_at":"2026-07-03T12:48:11.115768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.10087","last_updated":"2018-06-26T13:31:37Z","snapshot_observed_at":"2026-07-06T06:01:51.192687Z","submitted_at":"2017-09-28T17:51:13Z","title":"Learning Complex Dexterous Manipulation with Deep Reinforcement Learning and Demonstrations","version":2},"cited_work":{"arxiv_id":"1709.10087","doi":"10.48550/arxiv.1709.10087","metadata_source":"pith","pith_arxiv_id":"1709.10087","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning Complex Dexterous Manipulation with Deep Reinforcement Learning and Demonstrations","venue":"cs.LG","work_id":"e0799bae-989e-4c06-891d-c93b0b32024d","year":2017},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1709.10087","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:89f079f1e55361cf626bc172f9097b890dbe97d20a6d434d765a4f086455b76f","observation_id":"c5d82b4a-5915-4ad5-8bcc-9c6bd17d6642","resolution":{"observed_at":"2026-07-03T12:48:11.080750Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1011.0686","last_updated":"2011-03-16T18:51:21Z","snapshot_observed_at":"2026-08-03T22:17:51.826967Z","submitted_at":"2010-11-02T17:55:55Z","title":"A Reduction of Imitation Learning and Structured Prediction to No-Regret Online Learning","version":3},"cited_work":{"arxiv_id":"1011.0686","doi":"10.48550/arxiv.1011.0686","metadata_source":"pith","pith_arxiv_id":"1011.0686","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Reduction of Imitation Learning and Structured Prediction to No-Regret Online Learning","venue":"cs.LG","work_id":"73c02b0d-67bb-4f1e-900f-0241ff680534","year":2010},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1011.0686","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:2ad97244f39c2572b6c31b73e6ee665a09ae77c9d05d026e84b61a6479b70578","observation_id":"ede12d47-9489-456d-ba66-b585af81b2bc","resolution":{"observed_at":"2026-07-03T12:48:11.091632Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:10:48.212662Z","title":"nature529(7587), 484–489 (2016)","venue":null,"work_id":"8ee42daf-9fc1-40f0-b79c-503c56a7ca44","year":2016},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:fcb2641b10ee14c01e19ca8c1a8512ccf864d36b09817c0dd72865037baf0628","observation_id":"ea370fb2-420d-4372-8612-6dd5c68aa293","resolution":{"observed_at":"2026-07-05T08:10:48.213979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15920","last_updated":"2021-05-17T21:20:48Z","snapshot_observed_at":"2026-07-06T10:09:59.903425Z","submitted_at":"2020-10-29T20:10:02Z","title":"Recovery RL: Safe Reinforcement Learning with Learned Recovery Zones","version":2},"cited_work":{"arxiv_id":"2010.15920","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.15920","snapshot_observed_at":"2026-07-03T12:48:11.126151Z","title":null,"venue":null,"work_id":"9660329a-fea5-4731-87e7-ce23b285a1b3","year":2021},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2010.15920","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:a82f9e3239eb917b4719bae796612ee3f15bbbfaab6f54384efd80103919715a","observation_id":"8aa6e697-ad99-41f7-8fc0-beb82cfccea2","resolution":{"observed_at":"2026-07-03T12:48:11.127477Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02863","last_updated":"2022-07-27T19:24:54Z","snapshot_observed_at":"2026-07-06T12:57:27.948438Z","submitted_at":"2022-04-06T14:32:51Z","title":"Demonstrate Once, Imitate Immediately (DOME): Learning Visual Servoing for One-Shot Imitation Learning","version":2},"cited_work":{"arxiv_id":"2204.02863","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2204.02863","snapshot_observed_at":"2026-07-03T12:48:11.095812Z","title":null,"venue":null,"work_id":"6e1f5dfb-37e2-4bad-86fa-1ee429051d4a","year":2022},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2204.02863","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:0e7039205db5bd197a556a5551a9449efe4d4c75ce5d33d5219fa2f51f2986f4","observation_id":"ba4021e6-6b4c-4841-8475-7954fdbd1f6d","resolution":{"observed_at":"2026-07-03T12:48:11.097265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.08817","last_updated":"2018-10-08T13:38:52Z","snapshot_observed_at":"2026-08-02T04:07:03.272158Z","submitted_at":"2017-07-27T11:16:53Z","title":"Leveraging Demonstrations for Deep Reinforcement Learning on Robotics Problems with Sparse Rewards","version":2},"cited_work":{"arxiv_id":"1707.08817","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.08817","snapshot_observed_at":"2026-07-10T21:47:36.312721Z","title":"Leveraging Demonstrations for Deep Reinforcement Learning on Robotics Problems with Sparse Rewards","venue":"cs.AI","work_id":"a4478529-fa6c-4c19-98bd-743c55919fd6","year":2017},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/1707.08817","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:dc1ce57e77bbab688d2fd1e58aad3c5e4b9d0712e7535e9ee8ba963b9532545e","observation_id":"6f13c6ce-3a31-480f-a6a0-41eece112469","resolution":{"observed_at":"2026-07-03T12:48:11.109912Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12716","last_updated":"2022-05-06T14:46:46Z","snapshot_observed_at":"2026-07-06T12:32:37.254956Z","submitted_at":"2022-01-30T03:59:14Z","title":"You Only Demonstrate Once: Category-Level Manipulation from Single Visual Demonstration","version":2},"cited_work":{"arxiv_id":"2201.12716","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2201.12716","snapshot_observed_at":"2026-07-03T12:48:11.076099Z","title":"You only demonstrate once: Category-level manipulation from single visual demonstration","venue":null,"work_id":"5e30c60f-29e6-4b46-941b-a266b1ddc17b","year":2022},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2201.12716","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:6b8bb46fbb3f1be453fe37f2e3774e1472fd6243afcf4309ea06237696b0d647","observation_id":"fb5ba526-330f-46a7-84ea-3b71532a2a24","resolution":{"observed_at":"2026-07-03T12:48:11.077820Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07771","last_updated":"2025-03-10T18:52:54Z","snapshot_observed_at":"2026-07-06T20:50:14.273421Z","submitted_at":"2025-03-10T18:52:54Z","title":"RoboCopilot: Human-in-the-loop Interactive Imitation Learning for Robot Manipulation","version":1},"cited_work":{"arxiv_id":"2503.07771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.07771","snapshot_observed_at":"2026-07-04T06:19:37.569345Z","title":"Robocopilot: Human-in-the-loop interactive imitation learning for robot manipulation","venue":null,"work_id":"704de9db-444f-4a85-9a6e-a8e9edc935e6","year":2025},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"cited_paper":"/paper/2503.07771","citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:b1949f104cd6c5c69f70386cb386297a640f10d311db428fb500eb8dd3cafab9","observation_id":"893ca77d-8416-498a-91c5-1be6cbe975ae","resolution":{"observed_at":"2026-07-03T12:48:11.107581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.16685","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:09:50.350993Z","title":"Compliant residual dagger: Improving real-world contact-rich manipulation with human corrections","venue":null,"work_id":"6ea99c4a-3e43-4673-ad3e-ca6983735db0","year":2025},"citing_paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-03T12:40:11.283716Z"},"links":{"citing_paper":"/paper/2607.01651"},"observation_digest":"sha256:b212556086a56fff96b5a5d5e8a30e1d110d4b4e72564732d7ba830b3dd0f9ec","observation_id":"99555941-8933-4777-b467-1fce8618fd4a","resolution":{"observed_at":"2026-07-03T12:48:11.104951Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.01651","last_updated":"2026-07-02T03:23:40Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-07T00:07:13.555571Z","submitted_at":"2026-07-02T03:23:40Z","title":"One Demonstration Is Enough for Real-World Robotic Reinforcement Learning"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":0,"verified_exact":18,"verified_fuzzy":4},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2607.01651."}