{"as_of":"2026-08-04T16:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:16e1ebd67bec7e220de648967936cc57f97eb8127fecd1583d0d7235961c5552","coverage":[{"denominator":125,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T19:02:19.756092Z","state":"measured"},{"denominator":114,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":114,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:56:56.473768Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T07:26:54.401445Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2606.00773","last_updated":"2026-05-30T15:31:57Z","snapshot_observed_at":"2026-08-03T08:47:01.769122Z","submitted_at":"2026-05-30T15:31:57Z","title":"SafeVLA-Bench: A Benchmark for the Success-Safety Gap in Vision-Language-Action Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T18:26:45.016723Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2606.00773"},"observation_digest":"sha256:2c24a84c7872f32bd5b01cc4b976950fa9f041618269279025b6dda4aeb6b128","observation_id":"38e2641f-ec34-471b-9f78-d8369930444f","resolution":{"observed_at":"2026-06-28T20:42:37.637411Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2606.03312","last_updated":"2026-06-02T08:25:01Z","snapshot_observed_at":"2026-08-02T05:40:29.017278Z","submitted_at":"2026-06-02T08:25:01Z","title":"RobotValues: Evaluating Household Robots When Human Values Conflict","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T09:48:49.076365Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2606.03312"},"observation_digest":"sha256:f0550d6886b0af81b48de371e6466206ffa3e18ebda95904b91933c777b1cad8","observation_id":"0ff56ba6-2a30-485d-ad64-e545536cf6d7","resolution":{"observed_at":"2026-07-02T03:36:30.222944Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2606.17846","last_updated":"2026-06-17T17:06:39Z","snapshot_observed_at":"2026-08-01T08:00:11.218777Z","submitted_at":"2026-06-16T12:14:39Z","title":"Qwen-RobotManip Technical Report: Alignment Unlocks Scale for Robotic Manipulation Foundation Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T01:08:59.969040Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2606.17846"},"observation_digest":"sha256:390529dacb4d9c50d4457613cf06ff7807fdbc8d331e3a6507ad5f61e0ab53bd","observation_id":"c8e98220-7d5b-4d7b-b6cd-78a3caba9bc7","resolution":{"observed_at":"2026-07-03T20:48:55.837778Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2606.19340","last_updated":"2026-06-19T13:42:23Z","snapshot_observed_at":"2026-08-02T05:06:10.398443Z","submitted_at":"2026-06-17T17:59:56Z","title":"ZeroDex: Zero-Shot Long-Horizon Dexterous Manipulation via Multi-View 3D-Grounded VLM Reasoning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-26T20:49:01.269513Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2606.19340"},"observation_digest":"sha256:fb42f266e33ccc49ba2a28f350fe2307766c92be8868951ad76f46d9a58af8d0","observation_id":"c2873035-f494-449b-a39e-b8c69cf889f2","resolution":{"observed_at":"2026-07-04T00:59:20.368399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2606.20118","last_updated":"2026-06-19T06:39:01Z","snapshot_observed_at":"2026-07-06T23:55:20.134506Z","submitted_at":"2026-06-18T11:41:25Z","title":"Pose6DAug: Physically Plausible Multi-view Object Swapping for Robot Data Augmentation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T17:23:49.431731Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2606.20118"},"observation_digest":"sha256:a86cfb95245b2d2e6648d33ad91101375dcb1665931927eb66faf14a83aeb00d","observation_id":"d19b860f-b140-4fdc-a548-e6cd0382116f","resolution":{"observed_at":"2026-07-04T03:59:33.615781Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-07-12T09:22:06.947773Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T14:24:23.187164Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.00678"},"observation_digest":"sha256:3ea68d5c8980292afdd4beac21b3551dd427e55fa9fae7086897b76590ade205","observation_id":"9e1cbec8-c8d2-4bcf-829a-03b1afc1baa3","resolution":{"observed_at":"2026-07-02T14:27:03.073446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-12T09:22:08.000379Z","title":"Rldx-1 technical report.arXiv preprint arXiv:2605.03269, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.00678","last_updated":"2026-07-06T08:13:44Z","snapshot_observed_at":"2026-07-12T09:22:06.947773Z","submitted_at":"2026-07-01T09:21:20Z","title":"ABot-M0.5: Unified Mobility-and-Manipulation World Action Model","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T09:22:08.000379Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.00678"},"observation_digest":"sha256:f8c1b7139954efeaec605d0b9150933d7d03319f85f66961effa25551aa82857","observation_id":"0f2e6dd8-ab67-428e-b01e-53c544557679","resolution":{"observed_at":"2026-07-12T09:22:08.000379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2607.06403","last_updated":"2026-07-07T15:33:12Z","snapshot_observed_at":"2026-08-03T19:29:48.813900Z","submitted_at":"2026-07-07T15:33:12Z","title":"From Foundation to Application: Improving VLA Models in Practice","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-08T07:06:13.473493Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.06403"},"observation_digest":"sha256:0f459d786725cceb8d47bbf04511a4956955a8b63a9982f797da3bada735bc69","observation_id":"b0d968cf-f23c-4deb-b81d-c421f2bd1c1c","resolution":{"observed_at":"2026-07-08T07:14:45.478990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":"2605.03269","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-10T07:26:54.401445Z","title":"RLDX-1 Technical Report","venue":"cs.RO","work_id":"c9a872cd-f003-489b-866b-c4f8c2501c79","year":2026},"citing_paper":{"arxiv_id":"2607.08448","last_updated":"2026-07-15T16:40:12Z","snapshot_observed_at":"2026-08-02T07:56:54.525966Z","submitted_at":"2026-07-09T13:08:54Z","title":"Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-10T07:18:57.823444Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.08448"},"observation_digest":"sha256:7e197d0e2e6ffbd305087abd4efd51bf8bd67917a78500525c32900b0827e9ff","observation_id":"10b81d45-4c7a-4a50-845c-65d8773ded84","resolution":{"observed_at":"2026-07-10T07:26:54.403226Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-08-02T07:56:56.473768Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08448","last_updated":"2026-07-15T16:40:12Z","snapshot_observed_at":"2026-08-02T07:56:54.525966Z","submitted_at":"2026-07-09T13:08:54Z","title":"Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T07:56:56.473768Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.08448"},"observation_digest":"sha256:55692095c50443d38e7ae91c51016937159887c097440105c68527bca7e62214","observation_id":"8faff38e-1710-4b2a-85bb-19a85f3564d8","resolution":{"observed_at":"2026-08-02T07:56:56.473768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-14T05:52:34.589171Z","title":"Rldx-1 technical report,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11397","last_updated":"2026-07-13T11:02:04Z","snapshot_observed_at":"2026-08-03T16:19:12.630473Z","submitted_at":"2026-07-13T11:02:04Z","title":"WALA Learning Executable Latent Actions from Action-Labeled Demonstrations and Action-Free Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T05:52:34.589171Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.11397"},"observation_digest":"sha256:94c049da5cbe4842101ea9949e89c718effc20d220230300af0c473f8a30c1ca","observation_id":"2670a3db-1c2e-4455-a9d0-c1bffb91d88b","resolution":{"observed_at":"2026-07-14T05:52:34.589171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-08-02T00:04:02.063691Z","title":"Rldx-1 technical report.arXiv preprint arXiv:2605.03269, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15330","last_updated":"2026-07-22T11:38:14Z","snapshot_observed_at":"2026-08-02T00:03:57.503409Z","submitted_at":"2026-07-16T16:02:25Z","title":"Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T00:04:02.063691Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.15330"},"observation_digest":"sha256:b38f7f54a22753b3edf9539c3bcff8936e2b8f372d863f3a3a9f4471b653bb9b","observation_id":"81b2b861-086a-422c-af9b-769064d5ff03","resolution":{"observed_at":"2026-08-02T00:04:02.063691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-08-01T20:28:16.620463Z","title":"Rldx-1 technical report.arXiv preprint arXiv:2605.03269, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16636","last_updated":"2026-07-18T04:46:53Z","snapshot_observed_at":"2026-08-02T16:18:19.845170Z","submitted_at":"2026-07-18T04:46:53Z","title":"PhyAgentOS: A Self-Evolving Operating System for Embodied Agents with Decoupled Cognitive Planning and Physical Execution","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T20:28:16.620463Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.16636"},"observation_digest":"sha256:0579bb3c3ef1bce38954cdb6faeb47cb8502cb108f3a0de9269ac4bab96c1506","observation_id":"c09bc165-8b0b-4eb9-b73b-fc899d791baa","resolution":{"observed_at":"2026-08-01T20:28:16.620463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03269","snapshot_observed_at":"2026-07-30T21:05:52.642317Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26789","last_updated":"2026-07-29T11:31:33Z","snapshot_observed_at":"2026-08-02T17:59:26.789390Z","submitted_at":"2026-07-29T11:31:33Z","title":"CheckVLA: Execution-Time Verification with Action-Conditioned World Model for Long-Horizon Mobile Manipulation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-30T21:05:52.642317Z"},"links":{"cited_paper":"/paper/2605.03269","citing_paper":"/paper/2607.26789"},"observation_digest":"sha256:864e73515446c287e74fae7049878beebe74602cda7b16e289fd47255b32caa9","observation_id":"f9f771d6-24c2-4bdd-83ac-6578d90f461a","resolution":{"observed_at":"2026-07-30T21:05:52.642317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.03269/citation-record","integrity":"/paper/2605.03269/integrity","json":"/paper/2605.03269/citation-record.json","paper":"/paper/2605.03269"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.20020","last_updated":"2025-03-25T19:02:56Z","snapshot_observed_at":"2026-08-02T07:15:58.798604Z","submitted_at":"2025-03-25T19:02:56Z","title":"Gemini Robotics: Bringing AI into the Physical World","version":1},"cited_work":{"arxiv_id":"2503.20020","doi":"10.48550/arxiv.2503.20020","metadata_source":"pith","pith_arxiv_id":"2503.20020","snapshot_observed_at":"2026-07-10T23:07:47.582320Z","title":"Gemini Robotics: Bringing AI into the Physical World","venue":"cs.RO","work_id":"f7c5ce10-8364-4fbe-964f-2802b81c3a98","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2503.20020","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:5941c2d994c64c818f6e9df88516a93ce1a2cbfa6c4f448f3d7a2eb534ac55fb","observation_id":"a232e548-d0a5-4243-833b-ad7db20449d9","resolution":{"observed_at":"2026-05-11T15:30:26.569831Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-07-06T23:03:02.938732Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"cited_work":{"arxiv_id":"2604.15483","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.15483","snapshot_observed_at":"2026-07-10T19:47:32.631418Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","venue":"cs.LG","work_id":"7391297f-4dff-465c-9790-cb760a2c0542","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2604.15483","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:0dd657e3a44134d8e0883dad03d43aea9743e57ec8f12f4ff54da948a79822a0","observation_id":"ffdc0da3-2d4b-457f-a807-1e7852b1af44","resolution":{"observed_at":"2026-05-09T06:05:35.161958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.00062","last_updated":"2026-02-24T21:52:50Z","snapshot_observed_at":"2026-07-06T22:34:38.619949Z","submitted_at":"2025-10-28T22:44:13Z","title":"World Simulation with Video Foundation Models for Physical AI","version":2},"cited_work":{"arxiv_id":"2511.00062","doi":"10.48550/arxiv.2511.00062","metadata_source":"pith","pith_arxiv_id":"2511.00062","snapshot_observed_at":"2026-07-11T00:07:42.940478Z","title":"World Simulation with Video Foundation Models for Physical AI","venue":"cs.CV","work_id":"1dc393b8-98c3-43bd-8ab0-25d7c2a9705b","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2511.00062","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:024f60e3d2f6e7e5376bf45250b9ff8e278ceafeb23924cf0017135b158b8544","observation_id":"3014a16a-ab53-4b04-ae5b-40792c4d8723","resolution":{"observed_at":"2026-05-12T23:01:14.323574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"cited_work":{"arxiv_id":"2511.14759","doi":"10.15607/rss.2025.xxi.128","metadata_source":"pith","pith_arxiv_id":"2511.14759","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","venue":"cs.LG","work_id":"7c1b3355-694a-44c6-880f-631e897e1713","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2511.14759","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:cc4b9d7a32bf0f9cdd04cc9a651362f7a7a2300da4351fd8dc06db7940201223","observation_id":"fa180a3b-b5db-44ba-8a1c-f25384a8d997","resolution":{"observed_at":"2026-05-09T06:05:35.153838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pytorch 2: Faster machine learning through dynamic python bytecode transformation and graph compilation","venue":null,"work_id":"9f6e5a9b-f54e-45dd-9222-8d70cbf57b4a","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:ca10c938cc9aa0faec6b080e6bbf4bef87885028f82219e1d6231df70c5ee6fe","observation_id":"b7b60aee-ac86-458e-946c-ce367cc9fca3","resolution":{"observed_at":"2026-05-26T03:37:19.300897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09985","last_updated":"2025-06-11T17:57:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-11T17:57:09Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","version":1},"cited_work":{"arxiv_id":"2506.09985","doi":"10.48550/arxiv.2506.09985","metadata_source":"pith","pith_arxiv_id":"2506.09985","snapshot_observed_at":"2026-07-11T02:27:49.493432Z","title":"V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning","venue":"cs.AI","work_id":"a9c28401-f16a-4933-89f0-788e2f94e52b","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2506.09985","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:d1ed9d8ed8515d034befe0368763d839a2c305a97389263cd699ad2ed9ebf964","observation_id":"32f6ec51-74e3-45ef-ae3b-5c40770770a7","resolution":{"observed_at":"2026-05-11T00:33:51.269344Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-03T19:08:37.559938+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T19:08:37.559938+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:7bd1265c2d5f236bb660be4d663c0b784b1d611f2687f0754f93cdea0401ebd7","observation_id":"106160a2-188d-439b-af0a-28fe9177483e","resolution":{"observed_at":"2026-05-09T06:05:35.158609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video pretraining (vpt): Learning to act by watching unlabeled online videos","venue":null,"work_id":"f8dbe627-e537-41e2-b52a-7990baeb4b0c","year":2022},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:dfb61d5ef69f1f94b0dc6b26eb758f366b40506a86c0cf3c3e54e695171a9d45","observation_id":"94d072ad-bc17-4fb9-bf71-81464210106a","resolution":{"observed_at":"2026-05-26T03:37:19.304741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-04T10:58:38.750074Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":"2407.07726","doi":"10.48550/arxiv.2407.07726","metadata_source":"pith","pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-07-10T23:37:43.136584Z","title":"PaliGemma: A versatile 3B VLM for transfer","venue":"cs.CV","work_id":"df6f48b3-5792-47c7-9614-cb856ea31ad9","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:e1fdd9891e56557a7c0d3ea1b8bcc185f23d4cbd05577378e34c6fe082b27c57","observation_id":"1fb8c65c-f701-4d55-a978-9b5652464ba1","resolution":{"observed_at":"2026-05-11T13:10:21.987351Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Anyskin: Plug-and-play skin sensing for robotic touch","venue":null,"work_id":"4f3a9884-ce98-42cd-8399-b342d331b593","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:fd7c73f62de2fdf2657c6bb306702909337344993f305078d3f3fa1ae0b12886","observation_id":"f79f0974-1309-413d-b6db-7788d97bf61e","resolution":{"observed_at":"2026-05-26T03:37:19.111516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17294","last_updated":"2025-07-29T12:31:26Z","snapshot_observed_at":"2026-07-06T22:01:30.654331Z","submitted_at":"2025-07-23T07:54:10Z","title":"VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback","version":2},"cited_work":{"arxiv_id":"2507.17294","doi":"10.48550/arxiv.2507.17294","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17294","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Vla-touch: Enhancing vision-language- action models with dual-level tactile feedback","venue":null,"work_id":"bbc9afdd-1cb4-4efc-9b65-017800c4f773","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2507.17294","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9ff26f95d96959cafa0ef60b7e2e33b577bb08a69551207431b317e8e9d433d3","observation_id":"5f02debd-0fa0-4f2a-b1c7-0056f256a972","resolution":{"observed_at":"2026-05-09T06:05:35.122413Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14734","last_updated":"2025-03-27T02:52:43Z","snapshot_observed_at":"2026-08-02T04:15:31.100670Z","submitted_at":"2025-03-18T21:06:21Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","version":2},"cited_work":{"arxiv_id":"2503.14734","doi":"10.48550/arxiv.2503.14734","metadata_source":"pith","pith_arxiv_id":"2503.14734","snapshot_observed_at":"2026-07-10T23:07:47.672265Z","title":"GR00T N1: An Open Foundation Model for Generalist Humanoid Robots","venue":"cs.RO","work_id":"e2db69c7-ee8a-4cb7-a761-7b8de1dfcf97","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2503.14734","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:869bd5a9c26aa75d8474129aeee4e50d2213f4ade13ea42d00f8862f73555760","observation_id":"0b1667ef-fb08-4645-9a75-3586f31e43e4","resolution":{"observed_at":"2026-05-10T19:09:10.448691Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T08:49:11.206777+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":"2504.16054","doi":"10.1609/aaai.v40i28.39562","metadata_source":"pith","pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","venue":"cs.LG","work_id":"d1ad7304-d09a-49bc-809e-846439f6aff9","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:6ac1e6c187cc98a11cc58f8240b4dbc62ea8e32a017de74f1160a9b84087f465","observation_id":"91e97520-68fe-4f77-b01f-4ca2e3bc632b","resolution":{"observed_at":"2026-05-09T06:05:35.009877Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"π0: A vision-language-action flow model for general robot control","venue":null,"work_id":"7a209eab-af5e-4ada-8e5e-74abb7a566ce","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:4766cc6d051ef9e4c11ca3cb313efbe37d729c2d2ed37a6abe2d969416372991","observation_id":"aa7a6fb8-280a-493c-80a5-e12bacbc2b87","resolution":{"observed_at":"2026-05-26T03:37:19.097003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Real-time execution of action chunking flow policies","venue":null,"work_id":"08b2caa0-43eb-43e4-96fa-7756b77bbedf","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:174158ca1a5743d4d20a5bee6cbc35f451c940de4016e6683ef410045392ddf0","observation_id":"2a2f4b9b-c539-4f36-93b6-4eb75cfbc236","resolution":{"observed_at":"2026-05-26T03:37:19.089906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:53:58.183538Z","title":"FLUX.2: Frontier Visual Intelligence.https://bfl.ai/blog/flux-2","venue":null,"work_id":"0d3a202a-bc97-4237-9314-60570459d4d5","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:ced882d5314591be58c177b797c11edae92e5970d30805ee9c4e1e8c4480e618","observation_id":"17b2980e-a4cb-458a-8dd2-2f862da493ff","resolution":{"observed_at":"2026-05-26T03:37:19.293548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rt-1: Robotics transformer for real-world control at scale","venue":null,"work_id":"b2f2c5ae-e15b-42b1-a3ff-eb6a768d38dc","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:e396d3a17b6218bb9842e7c405ced2913bcd0df8106cf19268cb954becca0601","observation_id":"87a0bcbd-17d2-4c33-a7e5-bd4868656b45","resolution":{"observed_at":"2026-05-26T03:37:19.134058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Language models are few-shot learners","venue":null,"work_id":"60af0a97-9902-4b10-968d-ab2e4f15a7ba","year":2020},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:4cd9f385b1fe7bdb57ad2ca191638268a3861174569de9330217c9a0317f4dce","observation_id":"51e9ad46-1186-4cb8-9a36-210bdb2b6b11","resolution":{"observed_at":"2026-05-26T03:37:19.122641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agibot world colosseo: A large-scale manipulation platform for scalable and intelligent embodied systems","venue":null,"work_id":"caf464e2-43e3-4926-8e26-228616e7b118","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:0aa6f677e052671ca9cc6dec3e9811936889cfe6c277dbdfb7a0a1fe76715826","observation_id":"705ef7b9-c97f-46a0-ad3d-514459ad57e1","resolution":{"observed_at":"2026-05-26T03:37:19.297251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Univla: Learning to act anywhere with task-centric latent actions","venue":null,"work_id":"83f55f95-2e8d-4381-858b-14c09b09e9ac","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:8227ab898be863b7f6307d25e5aae5f8ec3f02b7d772cc3945594c57fa9d33f9","observation_id":"b41a8b83-b533-404d-9c92-9ac59a2cfe5c","resolution":{"observed_at":"2026-05-26T03:37:19.107847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-03T02:22:13.984027Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":"2410.06158","doi":"10.48550/arxiv.2410.06158","metadata_source":"pith","pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","venue":"cs.RO","work_id":"843ab5eb-2815-4db8-b3bc-890b23fa5ffa","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:1383f2c2305444657d86266d19c973b9bc917a551a10b445bde64ea4eeb049ef","observation_id":"5722ee95-773c-44ba-ac19-8edaaad46dfc","resolution":{"observed_at":"2026-05-12T01:09:34.215368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-22T23:23:05.602157+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T23:23:05.602157+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.15271","doi":"10.48550/arxiv.2504.15271","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Eagle 2.5: Boosting long-context post-training for frontier vision-language models","venue":null,"work_id":"1812f253-bbba-4e3d-96eb-32b2c6481627","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:0758ac629b0abf942757a9d4069005ce315e42c22b8c014dea82e24710b00942","observation_id":"17461b1b-fbd0-48e0-bf54-eb824b23e207","resolution":{"observed_at":"2026-05-09T06:05:34.942869Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:37:16.159244Z","title":"Offline reinforcement learning via high-fidelity generative behavior modeling","venue":null,"work_id":"0c5ca3b6-549f-4afa-b3cc-c9e462751c11","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9403628f4f8796fb087eab21b6e8eebed38a8b89f46d10e192e07e1469eec193","observation_id":"34a8f6af-3187-4f1a-b491-92d19723dc50","resolution":{"observed_at":"2026-05-26T03:37:19.126229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training strategies for efficient embodied reasoning","venue":null,"work_id":"77898be1-04f0-4543-9fd8-60f61a3ae739","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9b188c70f640d95286e03e64c830ee40620c7a8930745e1c24812d08bd331a4a","observation_id":"1a69df2f-ff7f-4500-9a6e-bfb12c911d05","resolution":{"observed_at":"2026-05-26T03:37:19.259157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23682","last_updated":"2025-09-25T10:26:44Z","snapshot_observed_at":"2026-08-02T00:55:45.018424Z","submitted_at":"2025-07-31T15:57:46Z","title":"villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":"2507.23682","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.23682","snapshot_observed_at":"2026-07-04T17:30:00.529444Z","title":"villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models","venue":"cs.RO","work_id":"e4e687d7-64db-4ff4-8ddf-752b58365e0f","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2507.23682","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:ea8f08151db0a6bd35ab33b59a58a26ed9c4ccd4ff77e9a6fefa2cf515c23e0a","observation_id":"2b3b1fbc-cc8c-4d95-b6b5-d2b31d764e7a","resolution":{"observed_at":"2026-05-15T21:52:03.356882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.08706","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:48:45.799928Z","title":"Omnivtla: Vision- tactile-language-action model with semantic-aligned tactile sensing","venue":null,"work_id":"207598db-38fb-4e7a-bed8-76aef625d3cc","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:3e97d273cc11a4f35e74a96f232a6cb8220156fd77bc35416d165e89fbd13325","observation_id":"3f8d7b36-92c7-466a-849f-efccc013e154","resolution":{"observed_at":"2026-05-09T06:05:35.034248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T08:10:48.457047Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion","venue":null,"work_id":"d58a2d3e-38bd-4131-970c-fa4683c3e46e","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:8c0f78114fa243c2afb4bfd2eacf7d7c602c10082b2cfe4984f21a91f7727c96","observation_id":"cfa4aa5a-2c81-4996-89b9-0b61dd68d1a7","resolution":{"observed_at":"2026-05-26T03:37:19.103875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05014","last_updated":"2026-04-06T17:59:21Z","snapshot_observed_at":"2026-07-06T22:53:51.418227Z","submitted_at":"2026-04-06T17:59:21Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","version":1},"cited_work":{"arxiv_id":"2604.05014","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05014","snapshot_observed_at":"2026-07-10T07:26:54.478996Z","title":"StarVLA: A Lego-like Codebase for Vision-Language-Action Model Developing","venue":"cs.RO","work_id":"e9be5436-00f8-4b43-b82a-ff154145e079","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2604.05014","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:e942404a5349fa9116a999cc16e1e408d9e1b9ca527c79fafac6dd67a5cd5c41","observation_id":"05375eea-e5ad-4a22-a9cb-fe9e3772377d","resolution":{"observed_at":"2026-05-09T06:05:35.054633Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Palm-e: An embodied multimodal language model","venue":null,"work_id":"35ff75b1-f280-4369-b10a-53a6a0f9eb93","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:b8d3e8671551637fd75e3a2941645f23f49f0ab3499df541a8eedbc74e856fcd","observation_id":"77af8bf3-2f35-4d9e-bb14-1597e5f805e7","resolution":{"observed_at":"2026-05-26T03:37:19.280980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Knowledge insulating vision-language-action models: Train fast, run fast, generalize better","venue":null,"work_id":"91d6d12a-7297-4bea-a751-afd9e7489f3f","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:ee1863f40929bfcd4cc0608d9f8319b872213a56b750efe857180e03ba37b2e0","observation_id":"91776dce-3494-4afd-acb6-ef4298767a9f","resolution":{"observed_at":"2026-05-26T03:37:19.266568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling rectified flow transformers for high-resolution image synthesis","venue":null,"work_id":"c687e77f-00ed-494d-930f-0b48eeaa4a8b","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:5e6b956fa1a314492bcc0724567047b03ea62300b7c61ba57a107bf78be88739","observation_id":"7f0eafe4-04e6-4a54-a062-53d648d9b090","resolution":{"observed_at":"2026-05-26T03:37:19.286769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18564","last_updated":"2025-07-13T17:41:57Z","snapshot_observed_at":"2026-07-06T20:28:33.378335Z","submitted_at":"2025-01-30T18:37:16Z","title":"SAM2Act: Integrating Visual Foundation Model with A Memory Architecture for Robotic Manipulation","version":4},"cited_work":{"arxiv_id":"2501.18564","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.18564","snapshot_observed_at":"2026-07-10T23:37:43.201123Z","title":"Sam2act: Integrating visual foundation model with a memory architecture for robotic manipulation","venue":"cs.RO","work_id":"003c4f44-ae16-481f-9efd-87e5a5ae2cc1","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2501.18564","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:18007dd112425de649f2b98a610ff169232a6e2a048c43c6c8099e539561da02","observation_id":"94d8b89f-3988-42a4-b96e-bfe3a1ebe319","resolution":{"observed_at":"2026-05-09T06:05:34.810681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.13626","last_updated":"2025-12-26T12:19:56Z","snapshot_observed_at":"2026-07-06T22:32:42.381894Z","submitted_at":"2025-10-15T14:51:36Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","version":3},"cited_work":{"arxiv_id":"2510.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.13626","snapshot_observed_at":"2026-07-10T12:47:05.553101Z","title":"LIBERO-Plus: In-depth Robustness Analysis of Vision-Language-Action Models","venue":"cs.RO","work_id":"e35c8c6d-977d-4af1-963a-766ba98703ce","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2510.13626","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:19739758dd25ee37a339945aa0df1816315b49c345b91cf7c57f82071afd32fe","observation_id":"dd46845c-b6e0-41fc-9993-6f15b3168251","resolution":{"observed_at":"2026-05-12T10:40:26.497476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fourier actionnet dataset.https://action-net.org","venue":null,"work_id":"92ade20c-984b-4822-b169-db9f79f0865f","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:05ad5da15e544799a4c60ef1a0a431d49ce29434886f9d6541503f8871344e49","observation_id":"b475c28e-bc31-4fef-abcf-36e8ffa8b010","resolution":{"observed_at":"2026-05-26T03:37:19.222544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GR00T N1.5: An improved open foundation model for generalist humanoid robots","venue":null,"work_id":"c72290c0-9e0a-4885-aba6-1ec3d18402e8","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9e7c44a25fee3a86870c9c8d1861f253fbf6fe2113f60d3ff56b625773df6f7c","observation_id":"04f9c996-64bd-4bfc-ac8c-f9d14b62ec03","resolution":{"observed_at":"2026-05-26T03:37:19.236960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"GR00T N1.6: An improved open foundation model for generalist humanoid robots","venue":null,"work_id":"1191e06e-d737-4969-92fc-71c42914ece5","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:a930d422ebb2a476564f53da5920f85c5c9fec021ace22eb0475af5e17bb39c6","observation_id":"ebcfc282-879d-416c-a3e7-f1f06ff2ff9a","resolution":{"observed_at":"2026-05-26T03:37:19.145753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:43643536163e9e10d995e064f3581085d98c58f323220af033490db13fcbe6b1","observation_id":"332e4c90-2d90-438c-a7a6-c29baf429b0f","resolution":{"observed_at":"2026-05-09T06:05:35.045339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Octo: An open-source generalist robot policy","venue":null,"work_id":"c19163e3-6e04-4492-9bd4-053e8eb493e4","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:2bad62add29a99daa9d958beed1edcc9134c60fe6ddc908f9aacf5da148aaacf","observation_id":"990e4ba1-3b3b-434b-8152-ce026222b058","resolution":{"observed_at":"2026-05-26T03:37:19.283675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.19861","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:42.877055Z","title":"Gigaworld-0: World models as data engine to empower embodied ai","venue":null,"work_id":"5ee4b0ff-0f4e-4dd7-b4c5-bf779cbd80d1","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:cc202262d2108ab4c89207d65cd12d986af278415ba974f963e9b5d4725ad40b","observation_id":"5ff3133f-d779-431a-8e51-87d3b0ac99d0","resolution":{"observed_at":"2026-05-09T06:05:34.912700Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini API | Google AI for Developers.https://ai.google.dev/api","venue":null,"work_id":"e64470b9-b3c6-44dd-81fc-3831ecbf8f00","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:6a64d94380c33818b21fda016581f9ef52e5f8bf9fc9f403a0d756a96e940582","observation_id":"173960ff-f780-4db6-b585-5612472c20ce","resolution":{"observed_at":"2026-05-26T03:37:19.200569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"7eceee4c-6c65-4cd7-841a-5ffb5f2c1472","year":2022},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:369cfd1a29af40f27e591a077f6500e9feb26aced6d809aca2542f353882ee23","observation_id":"a0c5efbd-2dc7-4697-a46b-33d111390bf7","resolution":{"observed_at":"2026-05-26T03:37:19.203992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.03734","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:47:02.918794Z","title":"Otter: A vision-language-action model with text-aware visual feature extraction","venue":null,"work_id":"56cfc800-67ce-4e4b-b7db-edd998c8c4c0","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:89e6355b7b192fec714df5c7fab2c22d0df13d4c79b44aca2b265b249a7d2dee","observation_id":"1d5d8dab-735b-4715-be0d-f7f287819ac4","resolution":{"observed_at":"2026-05-09T06:05:35.129422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.09160","last_updated":"2025-07-12T06:44:37Z","snapshot_observed_at":"2026-08-04T01:38:32.621448Z","submitted_at":"2025-07-12T06:44:37Z","title":"Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization","version":1},"cited_work":{"arxiv_id":"2507.09160","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.09160","snapshot_observed_at":"2026-07-03T21:08:58.817723Z","title":"Tactile- VLA: Unlocking vision-language-action model’s physical knowledge for tactile generalization","venue":null,"work_id":"4c03a2e4-feee-4264-8ddf-c0031931b819","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2507.09160","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:e0462e7f23aff78be8ecf68cae8d8f24c62054c74540bd7dd1d1c2711c4d340d","observation_id":"e2649175-155d-4127-b5b4-ec2293a23d92","resolution":{"observed_at":"2026-05-09T06:05:34.787017Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models","venue":null,"work_id":"faa74a1e-b76c-4701-88e5-46b34fff827b","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:c22c311f8b3d8690a8b794e175411ef6538e1a2c3f7d37c1f13c6208f0ac4f8c","observation_id":"d2d5ca90-fd5d-423c-9582-f013da2e9874","resolution":{"observed_at":"2026-05-26T03:37:19.229884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.04246","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:43.254600Z","title":"arXiv:2510.04246 [cs]","venue":null,"work_id":"a1ac51e2-dba6-47a0-92d1-82cd3a31da10","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:a62ecf08f94d8743b7bb1cb3a71cee7cf6831d2ec6884e1bbfeccfebe47927a4","observation_id":"b6c1d698-a104-4308-88f1-297395695269","resolution":{"observed_at":"2026-05-09T06:05:34.968326Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dreamgen: Unlocking generalization in robot learning through video world models","venue":null,"work_id":"2f00f427-73ef-478e-8221-82f66496a1cb","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9ef1048b7c31114a51031e660722c93bddf38dacad335238244a5b6011a280bb","observation_id":"a5b1ae83-f570-46e4-b24f-b14e03dbcbe8","resolution":{"observed_at":"2026-05-26T03:37:19.083497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.22057","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatialboost: Enhancing visual representation through language-guided reasoning","venue":null,"work_id":"2b3ff235-d95c-49c5-80a7-bdf5eb5cb4f3","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:56329adacc69dad4e569846cfae9997c0da09b88906d0578e870da1d71a29659","observation_id":"3c5de90b-b04d-4589-86ef-140e394f7fa2","resolution":{"observed_at":"2026-05-09T06:05:34.797779Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00576","last_updated":"2025-08-30T18:04:19Z","snapshot_observed_at":"2026-07-06T22:21:09.483995Z","submitted_at":"2025-08-30T18:04:19Z","title":"Galaxea Open-World Dataset and G0 Dual-System VLA Model","version":1},"cited_work":{"arxiv_id":"2509.00576","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.00576","snapshot_observed_at":"2026-07-08T07:14:45.460259Z","title":"Galaxea open-world dataset and G0 dual-system VLA model","venue":"cs.RO","work_id":"568af32f-f647-4c11-a106-65ddfa305082","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2509.00576","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:c3ea13d13a03e1c78f1e4b28d73f192a3506d3af1a018eb5260161fe7fe71f9c","observation_id":"3eaf6814-fbd8-4f26-8496-79550521c05a","resolution":{"observed_at":"2026-05-09T06:05:35.089467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dexmimicgen: Automated data generation for bimanual dexterous manipulation via imitation learning","venue":null,"work_id":"c0236434-8d71-4874-9703-533e5c3df358","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:2d4c091ac23d1436ab31727e1f8a12e8276ca78cd966d56325e4b6047ef0c243","observation_id":"99ea2485-ffa7-4c5b-b8f8-201420dc6159","resolution":{"observed_at":"2026-05-26T03:37:19.093192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.07050","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:17:28.565592Z","title":"Interpreting physics in video world models","venue":null,"work_id":"b05a187e-b69a-4ec5-8048-f1603995f5a8","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:968b236dd1533270719576c34f148a9dd1ca1afe054abf689c3f03dc15f8a620","observation_id":"c6fffa37-3c00-40f4-a1fc-5537d803020f","resolution":{"observed_at":"2026-05-09T06:05:35.025192Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Planning and acting in partially observable stochastic domains.Artificial intelligence","venue":null,"work_id":"4b94462c-69c7-4192-b955-89e32c318b17","year":1998},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:08fc763b7ceefc54ac0e90c9dd814a7f7903953dd316bb6f91f7061e2bad2ad6","observation_id":"54347f12-709a-4933-9a4a-f2acd230710f","resolution":{"observed_at":"2026-05-26T03:37:19.167712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset","venue":null,"work_id":"7a57b1ab-361b-46e9-9bc3-022edbe979be","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:109262f551f9c65d1541913cf1177eb1596b89a5137e57c91d43ecaf2f9b0874","observation_id":"97ed6e0a-3b5f-4cc3-b773-6c75942f72d3","resolution":{"observed_at":"2026-05-26T03:37:19.119074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DEAS: Detached value learning with action sequence for scalable offline RL","venue":null,"work_id":"0a037b89-87be-401c-9289-c09468c6beb8","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9fd81afd44b4d1fbc88f5e0d07f2911c4a5a903fd82eeb5c4264f5c65c70f58b","observation_id":"5b1b1e41-518e-43a0-b70b-d60342a4af6a","resolution":{"observed_at":"2026-05-26T03:37:19.233427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robot-r1: Reinforcement learning for enhanced embodied reasoning in robotics","venue":null,"work_id":"aaee7605-871a-43a6-b69e-ff48470d72d6","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:20ea36c1cf22717e9a45b4788a24794fc545dcd955a5faadef25d01ff51e3ca6","observation_id":"ee386ebe-e122-4ef6-9762-5d3e99801f10","resolution":{"observed_at":"2026-05-26T03:37:19.166225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.21341","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roboalign: Learning test-time reasoning for language-action alignment in vision-language-action models.arXiv preprint arXiv:2603.21341, 2026b","venue":null,"work_id":"89f5a822-a8a5-490c-83a7-89befa7a7f03","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:6c1328db7dcadbc054122443411ec4cd4fd5f173d296aa489246f7262e613f1f","observation_id":"e2982e81-ae9d-4ebe-9c2c-615ebc8edaff","resolution":{"observed_at":"2026-05-09T06:05:35.030724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20760","last_updated":"2026-04-22T16:48:43Z","snapshot_observed_at":"2026-08-04T10:29:14.353844Z","submitted_at":"2026-04-22T16:48:43Z","title":"Exploring High-Order Self-Similarity for Video Understanding","version":1},"cited_work":{"arxiv_id":"2604.20760","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20760","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring High-Order Self-Similarity for Video Understanding","venue":"cs.CV","work_id":"3801a604-6875-4bd1-ba6f-89e654ea8760","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2604.20760","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:4ed006b0d3f4537a2a22c0d76d6e63f7e5e105597e87ae84a2b54ee50b329df1","observation_id":"f725ce35-c0c3-480f-a391-546110bbdec7","resolution":{"observed_at":"2026-05-09T06:05:34.987550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":"562e2403-9584-4c05-8b1c-fe825516136d","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:3094d1b835d88f8ecd7ca8770e6416f116a885a12df8f8889c195bf63f65c008","observation_id":"c633c32c-fea5-40cf-a9cc-ec399bd36f82","resolution":{"observed_at":"2026-05-26T03:37:19.164070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16163","last_updated":"2026-01-22T18:09:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-22T18:09:30Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","version":1},"cited_work":{"arxiv_id":"2601.16163","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.16163","snapshot_observed_at":"2026-07-10T18:47:31.583000Z","title":"Cosmos Policy: Fine-Tuning Video Models for Visuomotor Control and Planning","venue":"cs.AI","work_id":"3d63039f-41b0-4a31-af31-6fc10f5c1b1b","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2601.16163","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:5b3bb8210d6fd626c1d02b2f882b8b8fb2c2b4a3d7eb5a5cb969c6d2333c445c","observation_id":"ffc0ad8d-aced-4ff7-b940-1029778c2a2f","resolution":{"observed_at":"2026-05-12T14:50:13.054714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.18742","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robocurate: Harnessing diversity with action-verified neural trajectory for robot learning.arXiv preprint arXiv:2602.18742, 2026e","venue":null,"work_id":"4eedf0d0-adab-4a4a-8633-9170a3704797","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:ec732d82fa12a1b4e56901a033094a730f38943f40a11b0c01a68e29b4ea6ad4","observation_id":"61b14d8e-2c25-4055-882d-8d81fb5ca955","resolution":{"observed_at":"2026-05-09T06:05:34.778348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Contrastive representation regularization for vision-language-action models","venue":null,"work_id":"d4e4f47e-15f5-41d3-afd1-0f46f67bb0e2","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:f95dce9a01bc9610484940f076e422112d95187eaacfa3d05f3889da0a4c4ac9","observation_id":"ea34f7af-3add-4225-bb19-6f13ff8534a9","resolution":{"observed_at":"2026-05-26T03:37:19.240267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hamlet: Switch your vision-language-action model into a history-aware policy","venue":null,"work_id":"f8f91908-dfcd-4f7a-98da-a97e33426cc6","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:ad8cccc3471505dd848afcd25fa9175055128841d38333fb069a710de712a6ff","observation_id":"76b4fbd5-7260-4ce7-bb0e-a1b5864bce89","resolution":{"observed_at":"2026-05-26T03:37:19.194100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offline reinforcement learning with implicit Q-learning","venue":null,"work_id":"556536c4-8c0d-454f-9494-9cf52d9b1543","year":2022},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:7af38aa5b8a818075234e7e2cdd9e3177370ef9def819bb47c206ee235c1982d","observation_id":"013547a1-f4ef-49be-a609-08972aa17dd9","resolution":{"observed_at":"2026-05-26T03:37:19.081826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning self-similarity in space and time as generalized motion for video action recognition","venue":null,"work_id":"16d72847-0ac8-4850-97b7-cb8ea23ae9f3","year":2021},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:02b7461839cbe3d5870f233d8e2f874294a36825a8fd3f8a3c03f267ee94af59","observation_id":"6e83a692-eabe-4c4f-90d2-ad35b1880286","resolution":{"observed_at":"2026-05-26T03:37:19.100448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T06:00:44.034140Z","title":"FLUX.https://github.com/black-forest-labs/flux","venue":null,"work_id":"43665d74-e6fd-4abb-aee8-c86f31ceccd7","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:c5a89b00e8b3476d20e51643e6717c792594e038024cbeee5a7aeb3c667a197b","observation_id":"1cd2bb12-4baf-4579-adf3-3683f43acf6f","resolution":{"observed_at":"2026-05-26T03:37:19.182351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with augmented data","venue":null,"work_id":"8ea08fed-b427-428a-bd47-8aae4d868be5","year":2020},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:8f1ce9ad0abbd68c37ae7340e2332d2dd38e5fafd8d3b6541351986f5774e302","observation_id":"54d8a800-1f63-4893-86c6-8d221bcf1437","resolution":{"observed_at":"2026-05-26T03:37:19.277900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23272","last_updated":"2026-04-25T12:28:47Z","snapshot_observed_at":"2026-08-01T01:40:08.735966Z","submitted_at":"2026-04-25T12:28:47Z","title":"Modular Sensory Stream for Integrating Physical Feedback in Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":"2604.23272","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23272","snapshot_observed_at":"2026-07-04T03:59:33.616964Z","title":"Modular Sensory Stream for Integrating Physical Feedback in Vision-Language-Action Models","venue":"cs.RO","work_id":"f8d60520-aaf4-490c-810c-eb708cff726b","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2604.23272","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:db37ef90b644a202ec42f31b2941a357143615af29ece12f0574ca73ab01eebd","observation_id":"ada408e1-e43a-4cb2-bfd6-589b733a9438","resolution":{"observed_at":"2026-05-09T06:05:35.001491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Behavior-1k: A benchmark for embodied ai with 1,000 everyday activities and realistic simulation","venue":null,"work_id":"3795dca7-7bf6-4e1f-8e38-77b8836d2df2","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:58d75534fb0de2b75ab6ce5fdc2011367faa0de9320f6f54e89c7d9275765ef9","observation_id":"14b5d1e2-10be-4e18-a436-602f63e02c68","resolution":{"observed_at":"2026-05-26T03:37:19.149660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cronusvla: Transferring latent motion across time for multi-frame prediction in manipulation.arXiv e-prints, 2025a","venue":null,"work_id":"9a8de800-8be4-4610-a296-5628c1901806","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:7e2654104deac75b54af34a5ccad347b10a902b2478adb75d8dd7e7fcb5033c1","observation_id":"a5394b11-0ed6-41b0-beaf-9191f7aadc99","resolution":{"observed_at":"2026-05-26T03:37:19.271067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19650","last_updated":"2024-11-29T12:06:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-29T12:06:03Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","version":1},"cited_work":{"arxiv_id":"2411.19650","doi":"10.48550/arxiv.2411.19650","metadata_source":"pith","pith_arxiv_id":"2411.19650","snapshot_observed_at":"2026-07-10T23:07:48.078477Z","title":"CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation","venue":"cs.RO","work_id":"4b158d3e-3dff-4412-85cd-baa879465a5e","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2411.19650","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:b95e9b6fd8ae593696be75ddb360cd587d07bd5a94d51784da07445e5513dc87","observation_id":"6724b243-19e6-4503-b68b-bb428aa4cde3","resolution":{"observed_at":"2026-05-09T06:05:34.793904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinforcement learning with action chunking","venue":null,"work_id":"bb0e16cd-cf85-478c-bf56-c29038680750","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:3576f14b4b08c1a02a46aa1691f8c60848b0c4b66becd8a1cc973fa68b84e21c","observation_id":"2f0e7d2d-001a-44c5-87a9-81274a92ae17","resolution":{"observed_at":"2026-05-26T03:37:19.120546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Evaluating real-world robot manipulation policies in simulation","venue":null,"work_id":"f6e3732e-8ee6-4f0c-a624-dc391bffc22a","year":null},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:707448536f6615d58d8f1ec0fabd411d852b64ba21c7455d519ef0278557ad15","observation_id":"af9203ad-9df0-47be-a8ec-829357b93b36","resolution":{"observed_at":"2026-05-26T03:37:19.186115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02115","last_updated":"2026-05-13T21:07:49Z","snapshot_observed_at":"2026-08-01T20:59:07.888539Z","submitted_at":"2026-03-02T17:38:58Z","title":"Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons","version":2},"cited_work":{"arxiv_id":"2603.02115","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.02115","snapshot_observed_at":"2026-07-07T12:53:50.299376Z","title":"Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons","venue":"cs.RO","work_id":"0ba67028-9804-4dc9-aa40-2a96679d8cb8","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2603.02115","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:b569352177ff8bfa95adf1d139203dbe147b12ba3843a0d73d4c156ffbcc1ecf","observation_id":"f0248454-3c7c-4111-9d85-28e490bbecf3","resolution":{"observed_at":"2026-05-15T01:43:11.858255Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code as policies: Language model programs for embodied control","venue":null,"work_id":"e2386fc1-8473-4329-ac96-76fbb7e247e7","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:de0191dd1024b91bad25042ec8ff0742a07278e4fc5f9580cca2caf3f0da98b6","observation_id":"7f2c1e3a-7bfa-4404-9fb6-4ffd042302ab","resolution":{"observed_at":"2026-05-26T03:37:19.175492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:27:53.067973Z","title":"Flow matching for generative modeling","venue":null,"work_id":"13d04ee7-f703-4b57-a1e0-8be3885d9d5d","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:31cd20371f0c16732fc4e0ce91a99043b2aa5a1e79a5f6280f4ba74a3ec9f151","observation_id":"3412fedb-1509-40a6-a39b-d70199753e23","resolution":{"observed_at":"2026-05-26T03:37:19.211813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:cbf0d4277e69efdc8fedfc87dbffd2f6ecbe79d604523cbd4cf7e750a60310df","observation_id":"a809150c-f8ca-48aa-b8b4-0a924eecedfb","resolution":{"observed_at":"2026-05-09T06:05:34.953870Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LIBERO: Benchmarking knowledge transfer for lifelong robot learning","venue":null,"work_id":"63b26c49-a8ea-4136-ab9f-7c5f5682b486","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:5bc601c5111480b4ba384306bc4f8e9984a0b7603e30d75a6864ce75d5b5b766","observation_id":"4270d957-4fc9-4d8a-9982-ebf9ef38d430","resolution":{"observed_at":"2026-05-26T03:37:19.061964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T19:36:29.521451Z","title":"Decoupled weight decay regularization","venue":null,"work_id":"139a920c-85a1-42e5-937e-f14d907436d5","year":2019},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:0c215b219bb581a27bbfd0824dd1985d33279ffc0fb009ee6ef5eba99b90c3cf","observation_id":"3832cefa-660e-4bba-9bff-b8b4ec023324","resolution":{"observed_at":"2026-05-26T03:37:19.145522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mimicgen: A data generation system for scalable robot learning using human demonstrations","venue":null,"work_id":"dd503379-8d1b-4341-b36b-0639273b8073","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:541667a03baf019aa910d758fc685d240207487063429a17961e40ed81f2b675","observation_id":"16610edd-6b2d-452a-b3b5-331308ecb80c","resolution":{"observed_at":"2026-05-26T03:37:19.050898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Steering your generalists: Improving robotic foundation models via value guidance","venue":null,"work_id":"486be7f4-0eb4-45a3-8bde-5b7526d74b9f","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:dd4fda9a75a9bc39dd458e8a81464004e5c8c56f692e76112256b53dc528866e","observation_id":"d391e54a-67cb-47db-a24c-1ff819f21dd6","resolution":{"observed_at":"2026-05-26T03:37:19.066119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robocasa: Large-scale simulation of everyday tasks for generalist robots","venue":null,"work_id":"5f891a4c-481c-4786-ae84-4d29d0120302","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:90618e38a3e6fe499828e4edcca967864c68c1e2da0bdffc764bb5f6ef92b634","observation_id":"1ea7319a-63a6-4695-88e9-fb8d483b909c","resolution":{"observed_at":"2026-05-26T03:37:19.054500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.04356","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T07:26:54.407487Z","title":"Robocasa365: A large-scale simulation framework for training and benchmarking generalist robots","venue":null,"work_id":"5e8d6109-344e-490b-84b6-0b3e2b817e64","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:daccdbe03a9d7804b7329947da700c0b2e12c8e7eeb2aa546e74af98e3de4bb0","observation_id":"20642d95-523e-43ed-86d9-902715780cef","resolution":{"observed_at":"2026-05-09T06:05:34.977533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cosmos-predict2: World simulation model for physical ai","venue":null,"work_id":"f7d27807-ecc5-4d73-9a76-6b053e741e20","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:77a994ebdb92f837712b0685741e7e7054ad3da353ce1bace822722f3771c40f","observation_id":"4d9bd798-816e-4edb-bbf3-41878df9372b","resolution":{"observed_at":"2026-05-26T03:37:19.179117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nsight Compute.https://developer.nvidia.com/nsight-compute","venue":null,"work_id":"32ac7b2a-5e88-4e70-b089-0bf514ce3337","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:81d3e9bd84c0a18c404759a80b359c0758b35a077f60cb62168e2073b57b13de","observation_id":"4f20f2d5-049c-4625-8e3b-514322daa355","resolution":{"observed_at":"2026-05-26T03:37:19.149341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Open x-embodiment: Robotic learning datasets and rt-x models: Open x-embodiment collaboration 0","venue":null,"work_id":"e7b056f2-0f35-41aa-b04c-e7e936242c38","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:05fee00911e7f0b5051927ca9d52e1cf187a0ea01ff37bc0b2c3bc2ce0f5d005","observation_id":"566b861a-cc85-49eb-966e-b54b70846e19","resolution":{"observed_at":"2026-05-26T03:37:19.160480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06256","last_updated":"2025-04-08T17:58:47Z","snapshot_observed_at":"2026-08-03T00:43:33.310493Z","submitted_at":"2025-04-08T17:58:47Z","title":"Transfer between Modalities with MetaQueries","version":1},"cited_work":{"arxiv_id":"2504.06256","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.06256","snapshot_observed_at":"2026-07-04T16:39:58.250680Z","title":"Transfer between Modalities with MetaQueries","venue":"cs.CV","work_id":"a89f31c1-6a3f-451e-9971-692c11219ea3","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2504.06256","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:ab2b801bb68782813e9953919274acf018afc05de1c01afb9647f32f32d62ead","observation_id":"9b3af423-c337-48b3-8b57-77be25a87110","resolution":{"observed_at":"2026-05-14T22:49:23.311693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Trinity: Three- dimensional tensor program optimization via tile-level equality saturation","venue":null,"work_id":"ba9605e5-bb00-4195-b47e-84dbabea1f98","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:395124cadeb088e4e5d13b63be9d12daeae3989b49a861824b91d22c367240e7","observation_id":"024d3da5-c761-4810-a309-5973799fec86","resolution":{"observed_at":"2026-05-26T03:37:19.078211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":"ec9c4cdf-e9e9-4abf-b9ec-cfc432fe64c9","year":2019},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:a8ca6323f34beb489cdbfbf9eb08df839c0b2be9d4537790c6771769e8f73317","observation_id":"cbb1578f-5d3d-45e9-811d-a2364ae96eb7","resolution":{"observed_at":"2026-05-26T03:37:19.218816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":"d1b75a03-1bf6-4b02-91b3-07e031f32826","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:87263eb54f53a1b3e51f856f786cbd406e55990db4e80cfb96cfca8fec3ae23c","observation_id":"8335e97a-70ac-4a92-8e3a-3b72dc7a150b","resolution":{"observed_at":"2026-05-26T03:37:19.290105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FAST: Efficient action tokenization for vision-language-action models","venue":null,"work_id":"d38c0571-b29a-48e9-8f40-d11de7dcbb2a","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:c3582c7a8d880e8a18eb85dca4e9952c9e969a6bd9a6cd84513b2a08c0e1f32c","observation_id":"8ef857a7-68cf-4649-aa21-34a26abbb40b","resolution":{"observed_at":"2026-05-26T03:37:19.215837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"1148cf94-d447-4d63-a144-434b806437d4","year":2021},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:1ee2075931776f41278b8d55f7e498b09cd1e9bdc6c07e721603be4b20bb1d80","observation_id":"92ba43a1-c8aa-4fdf-a2a7-987592632726","resolution":{"observed_at":"2026-05-26T03:37:19.141927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Regularized behavior cloning for blocking the leakage of past action information","venue":null,"work_id":"6679f522-b3c6-499a-931f-fb920c7c7d3a","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9c30f50087f614edb14507350ec1fc8dabe1d3e40904aeb60db487ff2bdfe253","observation_id":"22f08a59-9496-46fe-af5f-3076100721ef","resolution":{"observed_at":"2026-05-26T03:37:19.274370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05202","last_updated":"2020-02-12T19:57:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-02-12T19:57:13Z","title":"GLU Variants Improve Transformer","version":1},"cited_work":{"arxiv_id":"2002.05202","doi":"10.48550/arxiv.2002.05202","metadata_source":"pith","pith_arxiv_id":"2002.05202","snapshot_observed_at":"2026-07-11T03:27:46.760869Z","title":"GLU Variants Improve Transformer","venue":"cs.LG","work_id":"17d0763c-1016-41ab-a478-478e890765eb","year":2020},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2002.05202","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9c3a6628066b7a8a292582f39387bf143b4e51568f720433cf5a275e4efaa7d0","observation_id":"7320cd96-2e58-447f-837e-6b4ccdd5fc5e","resolution":{"observed_at":"2026-05-10T17:05:01.922266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:07.002485+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Memoryvla: Perceptual-cognitive memory in vision-language-action models for robotic manipulation","venue":null,"work_id":"819d5079-64f0-45fd-8177-f7676c33f102","year":2026},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:a0f1f74e2fec0307206e268af49f159c07a24770ded83e6b7da42ea7a02d0891","observation_id":"6826f7be-8f0e-46e4-8ac2-b4e14cb1ee15","resolution":{"observed_at":"2026-05-26T03:37:19.226082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Progprompt: Generating situated robot task plans using large language models","venue":null,"work_id":"3a0f4bf6-5499-4eb6-985c-465012f987a9","year":2023},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:7bcefaf72fa9a5b86c365629eee483dcdb13ca6ebb847181ced56f140e9bfd72","observation_id":"5d283fe8-9aac-4d9a-8b0e-7855176a9fd3","resolution":{"observed_at":"2026-05-26T03:37:19.088155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20328","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T23:37:43.055592Z","title":"Memer: Scaling up memory for robot control via experience retrieval","venue":null,"work_id":"572b92b0-0318-4389-8b27-add4a67909a3","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:9b70a40effd1913f6a7da4289359c80190394e99a6b936438aeae8a609ddd563","observation_id":"1892047c-da55-42b3-9664-8308e050f287","resolution":{"observed_at":"2026-05-09T06:05:34.873574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing","venue":null,"work_id":"662b197f-880d-42d9-82b4-ee7896b9df09","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:7dbcda883ab97fe8b7b6ce04098bc84aaee374b8808dc9bb1030a6ccff8d2264","observation_id":"e64d938a-5f8d-414e-81a1-b2dc8805d576","resolution":{"observed_at":"2026-05-26T03:37:19.152951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rt-sketch: Goal-conditioned imitation learning from hand-drawn sketches","venue":null,"work_id":"8c739bad-24ae-493f-b937-f0b028f794f3","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:bd70affb151792c05ab968631667f0ead0c9f890ce081ded44411d00e4b1f9d2","observation_id":"d9f96f10-0f3a-48d7-bff0-f06f3ef0a75f","resolution":{"observed_at":"2026-05-26T03:37:19.152456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.23703","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:40:00.362264Z","title":"Robo-dopamine: General process reward modeling for high-precision robotic manipulation","venue":null,"work_id":"5a1de5c6-1c3a-46b7-8952-0f3372c4e944","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:3233de0c9fbe9472bba4c17297a6416cba1b42229e9d271a6d0ba0b95705798b","observation_id":"d726e8f7-94be-4476-8c95-b5003f6e76d6","resolution":{"observed_at":"2026-05-09T06:05:34.898337Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00425","last_updated":"2025-05-30T05:49:14Z","snapshot_observed_at":"2026-07-06T19:25:06.162911Z","submitted_at":"2024-10-01T06:10:39Z","title":"ManiSkill3: GPU Parallelized Robotics Simulation and Rendering for Generalizable Embodied AI","version":2},"cited_work":{"arxiv_id":"2410.00425","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.00425","snapshot_observed_at":"2026-07-09T10:26:11.043984Z","title":"arXiv preprint arXiv:2410.00425 (2024)","venue":"cs.RO","work_id":"fd93f487-a562-4878-b9a6-d2fe843f20b4","year":2024},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2410.00425","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:a9f2c5a537279783879f51b38627a4d8032ac2e72b0750855d3902428bbcf0a4","observation_id":"0a92b4a9-eeed-428b-bd43-ad2a20d733e3","resolution":{"observed_at":"2026-05-09T06:05:35.141727Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09561","last_updated":"2025-05-19T20:37:41Z","snapshot_observed_at":"2026-07-06T21:23:57.084147Z","submitted_at":"2025-05-14T17:00:47Z","title":"Learning Long-Context Diffusion Policies via Past-Token Prediction","version":2},"cited_work":{"arxiv_id":"2505.09561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09561","snapshot_observed_at":"2026-07-04T06:39:37.130898Z","title":"Learning Long-Context Diffusion Policies via Past-Token Prediction, May 2025","venue":null,"work_id":"79b036df-e965-4060-92dd-7388f52c82a5","year":2025},"citing_paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-08T19:02:19.756092Z"},"links":{"cited_paper":"/paper/2505.09561","citing_paper":"/paper/2605.03269"},"observation_digest":"sha256:560687c2cb3d8e9030a6654ead0e7fe104f430077ccceb47e7bff096acfdb243","observation_id":"21f3ec0f-ad4d-4ba2-aac5-6bf6865c9615","resolution":{"observed_at":"2026-05-09T06:05:34.962091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.03269","last_updated":"2026-05-06T14:24:04Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T23:16:10.769968Z","submitted_at":"2026-05-05T01:40:15Z","title":"RLDX-1 Technical Report"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":38,"verified_fuzzy":60},"total_outbound_references":125},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 125 outbound references and 14 inbound Pith citation observations for arXiv:2605.03269."}