Pith. sign in

Paper Citation Record · LEDGER

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

As of 13 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 100 inbound Pith citation observations for arXiv:2410.07864.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2410.07864 v2

Coverage vector

measured 14 of 14 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-11T07:46:30.553633Z

measured 114 of 114 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-12T06:34:41.77262+00:00

measured 100 of 289 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-12T11:20:03.565231Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T02:28:24.338817Z

Reference resolution

14 of 14 outbound references displayed

  • verified exact2
  • verified fuzzy5
  • unresolved0
  • parse uncertain0
  • malformed identifier1
  • metadata mismatch6

External citation measurements

5
pith, observed 2026-08-05T02:28:24.338817Z

Outbound references

Observation 2e8846cc-b9ab-4629-9a93-d9d012ffc3b5 · outbound

This paper cites Dimensionality reduction for dynamic movement primitives and application to bimanual manipulation of clothes.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Dimensionality reduction for dynamic movement primitives and application to bimanual manipulation of clothes

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-05-11T07:46:30.714341Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:06d83d4d4e510233dfd04232f66672f2b4d4b8b5984d0c9121f220af7fbf1e1c

Observation be0fd2e6-b2ad-4a4a-91e6-cfa436c0366a · outbound

This paper cites PaLM-E: An Embodied Multimodal Language Model.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation PaLM-E: An Embodied Multimodal Language Model

Reference 2

Resolution
metadata mismatch
local_arxiv, observed 2026-05-11T07:46:30.666368Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:7d97120ff12b3b9e47b50ea80885fc366b6fc8379126eb0a4ced8066e6155be2

Observation 5d09dad3-ca18-440b-b217-d0e2c56d461a · outbound

This paper cites Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-05-14T22:02:55.841967Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:9bb346090d98b480602cbe8c3d626da141d48e36c439a7dfc4e6aab07fe861b1

Observation dd54729d-9466-43cc-a2a8-f79689e2877a · outbound

This paper cites LoRA: Low-Rank Adaptation of Large Language Models.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation LoRA: Low-Rank Adaptation of Large Language Models

Reference 4

Resolution
metadata mismatch
local_arxiv, observed 2026-05-11T07:46:30.599344Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:ec542ffee1dc41a756102070d874e68923fe66347ddd0d435ff3146bdf007fc0

Observation 6bbbab2e-d38f-4043-a150-8aba8e7a1574 · outbound

This paper cites DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset

Reference 5

Resolution
verified exact
local_arxiv, observed 2026-05-11T07:46:30.617338Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:2d93b26896c4a7e3d280e904fa4b061d32937f2a7e4e3662a5d5be67c741db8e

Observation d841886e-8292-4ba3-b8b9-8489f6aae43e · outbound

This paper cites OpenVLA: An Open-Source Vision-Language-Action Model.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation OpenVLA: An Open-Source Vision-Language-Action Model

Reference 6

Resolution
metadata mismatch
local_arxiv, observed 2026-05-11T07:46:30.628345Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:51aad9a7b6740812fbf51f08751fc6c6e17c57edb11f96dc01577f070b180b82

Observation bd77deb0-fd99-4cd5-889a-1aab0dcd352e · outbound

This paper cites VoxAct-B: Voxel-Based Acting and Stabilizing Policy for Bimanual Manipulation.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation VoxAct-B: Voxel-Based Acting and Stabilizing Policy for Bimanual Manipulation

Reference 7

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T07:46:30.642339Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:b7618ff9450980332c204c93e7c76ac31c4d608180aa68ec086136fbc74f5189

Observation 48245547-e944-45bd-a801-28ff6b8e6c4e · outbound

This paper cites Multi-stage cable routing through hierarchical imitation learning.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Multi-stage cable routing through hierarchical imitation learning

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-05-11T07:46:30.681231Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:11683c2861f05e5f29fda64189b7a51e0e94a34bdd0b06ef55524d3deb59ec4a

Observation 6d1e496c-d3c2-408c-8841-ec9d14ec7e88 · outbound

This paper cites Multi-Stage Cable Routing through Hierarchical Imitation Learning.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Multi-Stage Cable Routing through Hierarchical Imitation Learning

Reference 9

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T07:46:30.656893Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:946338c6f6533b0f2628786d01f0b44ad96e0612f74d45969d7523b1583d37ce

Observation 965c942d-fd5d-485e-85f3-7f4c4fc2f305 · outbound

This paper cites Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Calvin: A benchmark for language-conditioned policy learning for long-horizon robot manipulation tasks

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-05-11T07:46:30.686340Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:f660adf9b3bdc4e35915deae8dd8ddf74e643e2e5b86a33d39290b631a46904f

Observation eb8ce3c1-e4f7-48f8-98f2-efc78d4abf08 · outbound

This paper cites Learning and retrieval from prior data for skill-based imitation learning.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Learning and retrieval from prior data for skill-based imitation learning

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-05-11T07:46:30.699136Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:9cc4f75545f013e990fc5817f5631c28aa3f969f349e2f4968c0e03abbb2c0e3

Observation a5efd4ad-7b66-4c00-9516-eb6535721e5f · outbound

This paper cites Imitating human behaviour with diffusion models.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Imitating human behaviour with diffusion models

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-05-11T07:46:30.706343Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:532e104f4c38008e0efd503ab71b264f957d4fe21974db9e98df0948625f7922

Observation 3f649201-fdca-464f-9174-8416942acf05 · outbound

This paper cites Multi-resolution sensing for real-time control with vision-language models.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation Multi-resolution sensing for real-time control with vision-language models

Reference 13

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T07:46:30.576721Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:539a251b06ba7d3ed8cd8b87e7c0df61db9b5e5d86370793f90a91c7b5672d72

Observation 26fafe9d-0002-4e32-a395-ac7598d5890e · outbound

This paper cites 0” actually has a physical meaning. For example, a speed of “0.

RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation 0” actually has a physical meaning. For example, a speed of “0

Reference 14

Resolution
malformed identifier
raw_fallback, observed 2026-05-11T07:46:30.670816Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T07:46:30.553633Z digest=sha256:2f7f789af70db398525f60a5e06e1bb76616352feaa2ef52b82f1df63937be66

Pith citing papers

Observation 04207019-ff4f-4ffb-b0be-308fe3a4c719 · inbound

A Survey on Vision-Language-Action Models for Embodied AI cites this paper.

A Survey on Vision-Language-Action Models for Embodied AI RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 115

Resolution
verified exact
local_arxiv, observed 2026-05-24T01:25:54.288196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-24T01:25:10.150459Z digest=sha256:d1af4dd2422bf7d3d46b6384c849e64b8326734a128dab2110c93c2549ac45a6

Observation cf0f0e4b-35cc-4504-8050-8f544c203244 · inbound

G3Flow: Generative 3D Semantic Flow for Pose-aware and Generalizable Object Manipulation cites this paper.

G3Flow: Generative 3D Semantic Flow for Pose-aware and Generalizable Object Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T11:20:03.565231Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T11:20:03.565231Z digest=sha256:bc6bfd9c9f0c1d69681506de9bd37206ddc9205f7e392f6c0a46a02c919b4a60

Observation ba9e594a-06b1-4aec-a0d6-fd4607716c92 · inbound

CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation cites this paper.

CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 38

Resolution
verified exact
local_arxiv, observed 2026-05-12T07:33:25.615474Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-12T07:33:25.188358Z digest=sha256:13e3e43aa3a85d76034729bdb91a7bd28b3fb67ff8392e461526bb7c3b2da601

Observation b2dc8acf-2e9c-47cd-a736-060af4d95d42 · inbound

RoboMatrix: A Skill-centric Hierarchical Framework for Scalable Robot Task Planning and Execution in Open-World cites this paper.

RoboMatrix: A Skill-centric Hierarchical Framework for Scalable Robot Task Planning and Execution in Open-World RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-12T05:47:13.638223Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T05:47:13.638223Z digest=sha256:eebe62ed9fb367a23e51dee0ed6555553cd11658178aa4e3c0a4b66629ad5bdf

Observation 36796e7f-eca3-4d49-8091-0668e16b3ff7 · inbound

Diffusion-VLA: Generalizable and Interpretable Robot Foundation Model via Self-Generated Reasoning cites this paper.

Diffusion-VLA: Generalizable and Interpretable Robot Foundation Model via Self-Generated Reasoning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-11T22:38:32.131516Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:38:32.131516Z digest=sha256:d0596f850a386090a9b76d58edf225628a765581d51855c46534a1eeac4adff4

Observation 5842a27a-3f75-4900-b364-ba114856539b · inbound

AnyBimanual: Transferring Unimanual Policy for General Bimanual Manipulation cites this paper.

AnyBimanual: Transferring Unimanual Policy for General Bimanual Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-11T19:26:41.896212Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T19:26:41.896212Z digest=sha256:1b5c2818ebd98984560a65d255b1de5e2806e6d5db5713898f017088982c9cbd

Observation c12b06fb-1ab1-4016-8a7b-10b941794990 · inbound

RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning cites this paper.

RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T16:45:08.254826Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T16:45:08.254826Z digest=sha256:c6d2ac405a04fc09d22c312ad2ab1de7c3fc79847de8459a2587a7e25b09a46b

Observation 98dff512-444c-49c2-803a-c64b89309be5 · inbound

Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations cites this paper.

Video Prediction Policy: A Generalist Robot Policy with Predictive Visual Representations RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 46

Resolution
metadata mismatch
local_arxiv, observed 2026-05-12T18:38:11.286617Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-12T18:38:11.110166Z digest=sha256:1765898402352cb3cbdb4c8eeeae3861fcb288bfb6c9116e91a7f6255df13721

Observation 6bbfb59a-abd2-4fd3-9b19-deda30e6b289 · inbound

VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks cites this paper.

VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-11T05:00:46.748166Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T05:00:46.748166Z digest=sha256:ae7204c20f78e00d5d7a60cb88cad316cfe036d122a6757c7857cbab4f06e802

Observation 65042dfe-1173-4d9a-bbee-2e6deb991fa0 · inbound

GeoManip: Geometric Constraints as General Interfaces for Robot Manipulation cites this paper.

GeoManip: Geometric Constraints as General Interfaces for Robot Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-10T19:47:36.531276Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T19:47:36.531276Z digest=sha256:dc6008e07efc8633bbc2695c3bc8ea6dfe751b5c25f9bbd96d62eb266ea1384e

Observation 8a636ff2-1fd5-40f4-b4ef-48879fad94ac · inbound

Universal Actions for Enhanced Embodied Foundation Models cites this paper.

Universal Actions for Enhanced Embodied Foundation Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-10T19:29:39.802818Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T19:29:39.802818Z digest=sha256:5aa78b8b50e1f4b77d982667c1d90a3cd38a5a26a1e9925ebd1ea205bc96ee36

Observation ccb25415-3a9b-4a5a-83f7-64cc078544c2 · inbound

You Only Teach Once: Learn One-Shot Bimanual Robotic Manipulation from Video Demonstrations cites this paper.

You Only Teach Once: Learn One-Shot Bimanual Robotic Manipulation from Video Demonstrations RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-10T15:18:52.366066Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T15:18:52.366066Z digest=sha256:168f3bfb14496b3d88950f42ff82670d7fa9727a73282a45c83f2471a64a2485

Observation efbf3394-d955-4134-b0b9-fb348a470f1e · inbound

An Atomic Skill Library Construction Method for Data-Efficient Embodied Manipulation cites this paper.

An Atomic Skill Library Construction Method for Data-Efficient Embodied Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-10T14:43:03.295744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T14:43:03.295744Z digest=sha256:90090bd94e6efca96cd1d3ae38ccc43212a190b0371e8d726ddc7fd4ecc9e978

Observation 342bfe02-59b7-47e0-b47b-a1826117852e · inbound

SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model cites this paper.

SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 39

Resolution
verified exact
local_arxiv, observed 2026-05-12T06:12:19.894118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-12T06:12:19.643111Z digest=sha256:81b1e2c242d3100cca76831a3d7e11127ca689e9d9b779c13a32ad4edc695c4b

Observation e3e333d3-5f89-4eed-923b-c5a95daefd15 · inbound

Embrace Collisions: Humanoid Shadowing for Deployable Contact-Agnostics Motions cites this paper.

Embrace Collisions: Humanoid Shadowing for Deployable Contact-Agnostics Motions RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-09T15:18:13.410253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-09T15:18:13.410253Z digest=sha256:bbfea050535af23f5dce36f01a220653690cecc4e494fa022e86ccc0e5cb8004

Observation 7566d0e7-d051-46a5-b8c0-fc8d2d58bf24 · inbound

MTDP: A Modulated Transformer based Diffusion Policy Model cites this paper.

MTDP: A Modulated Transformer based Diffusion Policy Model RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T22:56:36.682228Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T22:56:36.682228Z digest=sha256:7f6db3dc1fc955bdb8c2f0fd92b14095e81c169901c37ce97999408c77469682

Observation e33e9e85-65d1-4061-a93a-d09867759e79 · inbound

Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models cites this paper.

Hi Robot: Open-Ended Instruction Following with Hierarchical Vision-Language-Action Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 25

Resolution
verified exact
local_arxiv, observed 2026-05-15T22:53:37.219528Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=arxiv_source observed=2026-05-15T22:53:37.120692Z digest=sha256:7948fd5899a8de82b5b4b79200247ecc33da79ef20c904c9309b13b794b74263

Observation b8527c5b-f5cd-4f98-93c5-a9db201f9b6d · inbound

Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success cites this paper.

Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 27

Resolution
verified exact
arxiv_id, observed 2026-05-11T07:46:30.715521Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T04:35:31.914360Z digest=sha256:337e2ee1d3916a488eff18e886b1855ec74af0ad4ad3f39404d384fb45cc6d51

Observation dec8be8c-4924-48a1-b16d-718af2e77d87 · inbound

SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning cites this paper.

SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 35

Resolution
verified exact
local_arxiv, observed 2026-05-23T01:32:22.599380Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-23T01:27:33.123243Z digest=sha256:f1ba2bcc9602054c2a1b2d4df712fe07e3e7ad1143561613a920cd2b75be8550

Observation 3efcca3e-6b4f-43ac-8612-48894729d928 · inbound

HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model cites this paper.

HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 60

Resolution
verified exact
local_arxiv, observed 2026-05-15T22:00:49.129237Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-15T22:00:48.667428Z digest=sha256:321d514b7aad7398d311fa64d93d0f63dbd6ea32429ae4e05bbd0d405502ae9f

Observation 4fffcbe7-bf8f-45d5-b2a9-eaf52fde9fa1 · inbound

$\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization cites this paper.

$\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 55

Resolution
verified exact
local_arxiv, observed 2026-05-22T18:05:00.961170Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-22T18:02:23.305313Z digest=sha256:c0ed938c14a0ae891f52c8c883dd30bf5531ad659a07c03c4b297ed87a93bbbc

Observation 3fde8be9-5132-4e1a-934f-01770835b952 · inbound

GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data cites this paper.

GraspVLA: a Grasping Foundation Model Pre-trained on Billion-scale Synthetic Action Data RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 29

Resolution
verified exact
local_arxiv, observed 2026-05-17T20:55:52.337766Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-17T20:55:52.109166Z digest=sha256:c6129f3f8ef4c70ba0566e57c198ce30632340f84d51553ed76c53a2ce42fc10

Observation 95ece511-5057-4dde-8d52-f0cbb36a8635 · inbound

Object-Focus Actor for Data-efficient Robot Generalization Dexterous Manipulation cites this paper.

Object-Focus Actor for Data-efficient Robot Generalization Dexterous Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T15:26:45.079172Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T15:26:45.079172Z digest=sha256:2daa935b4416dac9fa36cfccb20b353be49231cc1adb3989e5ffd686c09f7cde

Observation 1eab8046-a372-47c0-9905-864f5bcb043a · inbound

WorldEval: World Model as Real-World Robot Policies Evaluator cites this paper.

WorldEval: World Model as Real-World Robot Policies Evaluator RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-07T14:25:43.613081Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:25:43.613081Z digest=sha256:a4f9f51a8bd0187fb77b5c5b6c3dd2fd35168322df691b4fe330511338c37b7e

Observation f939fbf7-bea3-4119-93b2-2f97b0c106c6 · inbound

ReFineVLA: Reasoning-Aware Teacher-Guided Transfer Fine-Tuning cites this paper.

ReFineVLA: Reasoning-Aware Teacher-Guided Transfer Fine-Tuning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T14:23:17.710194Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:23:17.710194Z digest=sha256:94716617c0664acd0dbb7bc2510379d3f5777be80493f5efec342e9d95367579

Observation a091da66-7b2d-410c-bd73-9b4b9b49537e · inbound

RFTF: Reinforcement Fine-tuning for Embodied Agents with Temporal Feedback cites this paper.

RFTF: Reinforcement Fine-tuning for Embodied Agents with Temporal Feedback RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T14:10:12.795591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T14:10:12.795591Z digest=sha256:f5aac6fc317e8695cad4be703dcde9aa6889d6fa6f2dfb1acb728f881603787b

Observation 3ffc20f6-a6ad-4d1b-8e20-c196e9fd9c10 · inbound

Learning Generalizable Robot Policy with Human Demonstration Video as a Prompt cites this paper.

Learning Generalizable Robot Policy with Human Demonstration Video as a Prompt RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T13:51:28.597493Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:51:28.597493Z digest=sha256:52c1e3a97e394d0c2fc4ab3511cda64fa3f0df82a3020c386f548949d64565f3

Observation 15826802-781f-4c5f-8012-9e179848a474 · inbound

Spatial RoboGrasp: Generalized Robotic Grasping Control Policy cites this paper.

Spatial RoboGrasp: Generalized Robotic Grasping Control Policy RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T13:53:43.771069Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T13:53:43.771069Z digest=sha256:a57e47dfe3f5b3a27e6ccfd07e5147a5afccd0fd35fcf1be880f8615d5e3aa80

Observation 8e3fbcf7-60c1-4579-bac9-cf9dbd6b82d4 · inbound

Think Twice, Act Once: Token-Aware Compression and Action Reuse for Efficient Inference in Vision-Language-Action Models cites this paper.

Think Twice, Act Once: Token-Aware Compression and Action Reuse for Efficient Inference in Vision-Language-Action Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T13:43:02.178483Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:43:02.178483Z digest=sha256:b3c4b5c2aceb5fec6423b6783d8f8e8265672b36bc7160e51739b7827d75ce0c

Observation a6aaff8d-86cc-47f4-928e-d0788e7ca553 · inbound

ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge cites this paper.

ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T13:25:58.334777Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:25:58.334777Z digest=sha256:59c0e4f2585a39802181e82ed1cadc44bab385a4fcd4db9e4cc1e344663f857d

Observation 9c99f3bd-bee6-41bf-8229-358bde098955 · inbound

Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials cites this paper.

Prior Reinforce: Goal-Conditioned Dynamic Manipulation with Limited Trials RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T13:26:27.782344Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:26:27.782344Z digest=sha256:121ef0fcf9eefb74b69a7c0fe9304e80d41065023e590b3c2260b57b8343d4e0

Observation 50fa4dfe-7599-43b1-b803-b66e80ffddb1 · inbound

Universal Visuo-Tactile Video Understanding for Embodied Interaction cites this paper.

Universal Visuo-Tactile Video Understanding for Embodied Interaction RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T13:09:24.408542Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:09:24.408542Z digest=sha256:1d08f0435edf19bb14193ca71a132565f09645b58e9832c916f58254baadf616

Observation 37ce83e3-a302-494a-8da9-14360fff7bf9 · inbound

Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize Better cites this paper.

Knowledge Insulating Vision-Language-Action Models: Train Fast, Run Fast, Generalize Better RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T12:45:23.411939Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:45:23.411939Z digest=sha256:16474784e730280e9549d87d9e67608b849c2e8c6e53753971bb378f2aa37587

Observation 0408ea97-8c40-43cb-9232-0a03ef86a20e · inbound

Towards a Generalizable Bimanual Foundation Policy via Flow-based Video Prediction cites this paper.

Towards a Generalizable Bimanual Foundation Policy via Flow-based Video Prediction RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-07T12:44:04.614233Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:44:04.614233Z digest=sha256:2bc7d66bdb60a4870e74f545a396224f6b75fd77535ca53e393afecce23d6005

Observation df5e4217-c6b9-4f92-95bf-a8135e5ac2fd · inbound

Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning cites this paper.

Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T11:34:14.365106Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T11:34:14.365106Z digest=sha256:41a3d0ebb9a2bd6787940d98b4298be72868ab834ebc5af5b090caf985e8b2ca

Observation 587726b3-0826-4a81-afb2-4cc58c84d4e1 · inbound

Bridging Perception and Action: Spatially-Grounded Mid-Level Representations for Robot Generalization cites this paper.

Bridging Perception and Action: Spatially-Grounded Mid-Level Representations for Robot Generalization RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T06:04:15.419455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T06:04:15.419455Z digest=sha256:6138b78a1f778977f8de58c6f94c76dd2a9cacf6a90f20b4781b0a7311dba3ed

Observation 64a5d589-4a09-471e-8024-896660178410 · inbound

Real-Time Execution of Action Chunking Flow Policies cites this paper.

Real-Time Execution of Action Chunking Flow Policies RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 37

Resolution
verified exact
local_arxiv, observed 2026-05-15T14:18:51.773552Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-15T14:18:51.613045Z digest=sha256:9206b6ab1eddec36e8cc207dbac80376355bdcd2d3b674409161034a18cc90e9

Observation 808fe66c-6c00-4206-92af-a94d62078226 · inbound

ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving cites this paper.

ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 23

Resolution
metadata mismatch
local_arxiv, observed 2026-05-15T07:36:24.466926Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-15T07:36:24.319361Z digest=sha256:d3a0ad4fcc31ab0b2145d25901295c4658185a5f85dcc2670a900c48f8b0b420

Observation 03f5e498-42f4-4af6-a658-f9fe2a779ff2 · inbound

HiBerNAC: Hierarchical Brain-emulated Robotic Neural Agent Collective for Disentangling Complex Manipulation cites this paper.

HiBerNAC: Hierarchical Brain-emulated Robotic Neural Agent Collective for Disentangling Complex Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-07T05:19:33.200175Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T05:19:33.200175Z digest=sha256:3186233e4d4d4c3dac508d254a15a78b504479d9742b1d1dd39fde8127b17748

Observation 065a14d9-ecbf-49c3-9f61-4a415d2640dc · inbound

Analytic Task Scheduler: Recursive Least Squares Based Method for Continual Learning in Embodied Foundation Models cites this paper.

Analytic Task Scheduler: Recursive Least Squares Based Method for Continual Learning in Embodied Foundation Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T04:50:52.064608Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:50:52.064608Z digest=sha256:86d8efdf8c576fdfbf56b678eb84c39e965c70a16c2a191f762455ce3224dbec

Observation ea21fac9-c7c1-4fc8-80f2-d937895f41d5 · inbound

From Intention to Execution: Probing the Generalization Boundaries of Vision-Language-Action Models cites this paper.

From Intention to Execution: Probing the Generalization Boundaries of Vision-Language-Action Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T04:42:04.128560Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T04:42:04.128560Z digest=sha256:e718612baf586790a797582dee53941ec508616d27c5b329c13cea6a9c9b4582

Observation 637c5282-a10b-42a1-b3ed-1418573a944c · inbound

SAIL: Faster-than-Demonstration Execution of Imitation Learning Policies cites this paper.

SAIL: Faster-than-Demonstration Execution of Imitation Learning Policies RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-07T01:09:31.153692Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T01:09:31.153692Z digest=sha256:f1cb84e22114e2a3d9814ed94faf4ced7fa76785ccd7620bb4a5501844b75464

Observation 960a02d4-e7c6-4bec-8684-ef955625343a · inbound

AntiGrounding: Lifting Robotic Actions into VLM Representation Space for Decision Making cites this paper.

AntiGrounding: Lifting Robotic Actions into VLM Representation Space for Decision Making RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-07T00:57:29.572917Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:57:29.572917Z digest=sha256:ed1b0b8c83e3e4f4d75a5b051787ce05280d566005d6dbd7eb38cfbcb6a54a38

Observation 3743e857-a31c-4f6b-9dbd-c97790271b1d · inbound

ControlVLA: Few-shot Object-centric Adaptation for Pre-trained Vision-Language-Action Models cites this paper.

ControlVLA: Few-shot Object-centric Adaptation for Pre-trained Vision-Language-Action Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:51:05.020892Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:51:05.020892Z digest=sha256:9f18c1f6b09b95e8d3fefcb92e9e771250f25a842483594f021041092a778e3b

Observation fe529777-4828-4587-a227-1e2801ace7a4 · inbound

CapsDT: Diffusion-Transformer for Capsule Robot Manipulation cites this paper.

CapsDT: Diffusion-Transformer for Capsule Robot Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T23:48:32.508620Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:48:32.508620Z digest=sha256:abe6b28c2303ac4cc9a9253a4d3a3b79fe63ad45db7c6e0871f10522974ebd79

Observation 4cee1f4c-9d6e-4561-831f-fff85c20d714 · inbound

RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation cites this paper.

RoboTwin 2.0: A Scalable Data Generator and Benchmark with Strong Domain Randomization for Robust Bimanual Robotic Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 31

Resolution
verified exact
arxiv_id, observed 2026-05-11T07:46:30.715521Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-11T06:40:27.206337Z digest=sha256:5ed4e558c908ab384c75f443bb92ffb65551dc39ebdd573c9a61c410de46a5ca

Observation eba4b8fc-77ba-492f-91d1-011bb97464b5 · inbound

T-Rex: Task-Adaptive Spatial Representation Extraction for Robotic Manipulation with Vision-Language Models cites this paper.

T-Rex: Task-Adaptive Spatial Representation Extraction for Robotic Manipulation with Vision-Language Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T23:12:04.499840Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T23:12:04.499840Z digest=sha256:af828ae0d8f3cbf1b85422aa3c53f203ab4b24416eb4e3b1655ee995f1a723d6

Observation a842d138-f682-4115-9c40-f0e948e0a3e9 · inbound

Knowledge-Driven Imitation Learning: Enabling Generalization Across Diverse Conditions cites this paper.

Knowledge-Driven Imitation Learning: Enabling Generalization Across Diverse Conditions RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T22:40:10.705370Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:40:10.705370Z digest=sha256:35540feb302988281e9aa8170e83298e780d6e879f17ec9601b557bd5ec5c692

Observation 3c5ac607-2bde-4865-a807-e0047ce66202 · inbound

RoboPearls: Editable Video Simulation for Robot Manipulation cites this paper.

RoboPearls: Editable Video Simulation for Robot Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-06T22:04:29.014167Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T22:04:29.014167Z digest=sha256:9f5559722d20ff3ca071bbcdec283ebf4debca319baddea80e6571258f52509e

Observation 736c7385-06ab-4f3d-a241-6bc18c4610e2 · inbound

Benchmarking Generalizable Bimanual Manipulation: RoboTwin Dual-Arm Collaboration Challenge at CVPR 2025 MEIS Workshop cites this paper.

Benchmarking Generalizable Bimanual Manipulation: RoboTwin Dual-Arm Collaboration Challenge at CVPR 2025 MEIS Workshop RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T21:49:51.675158Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:49:51.675158Z digest=sha256:b9648a066d2f735cdd4121b69c1e99b0d103c39b37d6cd0dc8c96979c03cb51e

Observation 7935683b-880f-4964-9c3f-841fbde44f68 · inbound

A Survey: Learning Embodied Intelligence from Physical Simulators and World Models cites this paper.

A Survey: Learning Embodied Intelligence from Physical Simulators and World Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T21:08:51.689112Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T21:08:51.689112Z digest=sha256:64d7ca88ff9b9d4a97f697520d8e55d211a848053c2357c82f0c07b1bfeee341

Observation 96279c6f-bb0a-4ed9-8b90-9a4d932bf08a · inbound

SE(3)-Equivariant Diffusion Policy in Spherical Fourier Space cites this paper.

SE(3)-Equivariant Diffusion Policy in Spherical Fourier Space RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T20:54:02.124105Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T20:54:02.124105Z digest=sha256:4383cd86bb291a81fce202091cd6f3257883c22e7dc124d0509d5a14796cd4fb

Observation 12701b88-f276-4a9f-a5f7-bfcf5e350e11 · inbound

TypeTele: Releasing Dexterity in Teleoperation by Dexterous Manipulation Types cites this paper.

TypeTele: Releasing Dexterity in Teleoperation by Dexterous Manipulation Types RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T20:47:35.292001Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:47:35.292001Z digest=sha256:6db794eb824eb9316f0a95bc83719ab92fbcbe35418f74a35aa2157c92e1a4e0

Observation be21756f-e518-4522-9aac-1975eab75ddd · inbound

A Survey on Vision-Language-Action Models: An Action Tokenization Perspective cites this paper.

A Survey on Vision-Language-Action Models: An Action Tokenization Perspective RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 24

Resolution
verified exact
local_arxiv, observed 2026-05-17T14:08:35.200745Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-17T14:08:34.893876Z digest=sha256:99a5c7633c62c920b5d4f4dd4f3c16191d309c51e54b4c984e99f783e4d4b4ea

Observation dd666f9e-0373-4449-916e-3d5f1159b04c · inbound

AC-DiT: Adaptive Coordination Diffusion Transformer for Mobile Manipulation cites this paper.

AC-DiT: Adaptive Coordination Diffusion Transformer for Mobile Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T20:45:27.863787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T20:45:27.863787Z digest=sha256:e068468da21d4ec109913ae4c6f3e81a49baf3366fe131f7c2995be1f1f9fcad

Observation 391b1b0e-e077-491e-a6d3-03cc4f460916 · inbound

DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge cites this paper.

DreamVLA: A Vision-Language-Action Model Dreamed with Comprehensive World Knowledge RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 92

Resolution
verified exact
local_arxiv, observed 2026-05-16T15:42:41.588140Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-16T15:42:41.363422Z digest=sha256:c6f4dcc96f97e80cd3c9c957ce9548597a054c5e6cfd2bf1b229d33326762182

Observation 5589af18-c6e5-4a64-9491-40d1ccb17c52 · inbound

EmbodieDreamer: Advancing Real2Sim2Real Transfer for Policy Training via Embodied World Modeling cites this paper.

EmbodieDreamer: Advancing Real2Sim2Real Transfer for Policy Training via Embodied World Modeling RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T19:35:42.802151Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:35:42.802151Z digest=sha256:51ab9834f734ec3c55f93a50c0c8bb6ebfc4b100233c8d2526cb732237a691ea

Observation 59c8f8cc-b1cb-4e1f-8651-a54bfd7375a2 · inbound

A Careful Examination of Large Behavior Models for Multitask Dexterous Manipulation cites this paper.

A Careful Examination of Large Behavior Models for Multitask Dexterous Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 9

Resolution
verified exact
local_arxiv, observed 2026-05-25T04:32:56.649385Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-25T04:32:56.397350Z digest=sha256:0695039554dd9a89a789720d3be49bea7f32473dd96eb2291cc7714c8a8512da

Observation 09df1018-e941-492c-8b21-3e2f4a5b1125 · inbound

Integrating Diffusion-based Multi-task Learning with Online Reinforcement Learning for Robust Quadruped Robot Control cites this paper.

Integrating Diffusion-based Multi-task Learning with Online Reinforcement Learning for Robust Quadruped Robot Control RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T19:26:17.611371Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:26:17.611371Z digest=sha256:4ef3143e7d1784f8ab653a76ff84c34105256a0840dfedc98d6a3a07d520c5ef

Observation 2aa3d729-62da-4e51-86db-8df1d1a14002 · inbound

Spatial-Temporal Aware Visuomotor Diffusion Policy Learning cites this paper.

Spatial-Temporal Aware Visuomotor Diffusion Policy Learning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T19:05:22.934587Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:05:22.934587Z digest=sha256:6c636edc1c3879b5deb675c3bfe7c09330730491f076446902e7e7cd1833bbb9

Observation d63427eb-a570-4a69-8893-fb1cb7153e0b · inbound

GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective cites this paper.

GenAI-based Multi-Agent Reinforcement Learning towards Distributed Agent Intelligence: A Generative-RL Agent Perspective RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-06T17:57:08.461783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T17:57:08.461783Z digest=sha256:4be85d34ebab0e53e16c8ccad359c5e68886fb26fca92738ec2edb16a184af57

Observation 9b905431-df86-4b0c-8098-24bca35f96f0 · inbound

Diffusion-Based Imaginative Coordination for Bimanual Manipulation cites this paper.

Diffusion-Based Imaginative Coordination for Bimanual Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T17:18:53.044253Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T17:18:53.044253Z digest=sha256:78d3f3427d43a1c4018be52530af06d63c06c131a92d4d90b7be35de57d61977

Observation 71a09552-45ae-4a6a-b881-b3bbae5d895c · inbound

AnyPos: Automated Task-Agnostic Actions for Bimanual Manipulation cites this paper.

AnyPos: Automated Task-Agnostic Actions for Bimanual Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 26

Resolution
verified exact
local_arxiv, observed 2026-05-19T03:52:57.517341Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-19T03:52:18.984005Z digest=sha256:57e14e1c634bbab91da2ca14c00ef13086f191cb5c4c9cf57808392a2ce18cdb

Observation 9a218022-d1db-49e3-98b9-5aaff9f9e8a7 · inbound

Vidar: Embodied Video Diffusion Model for Generalist Manipulation cites this paper.

Vidar: Embodied Video Diffusion Model for Generalist Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-05-16T09:54:28.329306Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-16T09:54:28.271928Z digest=sha256:67ddb6321fc1ae7cf55291a660aca4c5b14d4996814f5c8807934300c9f1c7a1

Observation ef2b0728-075f-44d0-903d-1adb46078544 · inbound

GR-3 Technical Report cites this paper.

GR-3 Technical Report RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 49

Resolution
verified exact
local_arxiv, observed 2026-05-17T08:04:12.719010Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-17T08:04:12.433863Z digest=sha256:8925baba2c9e6c9de401f52eef7fd414520762d37aab2e747ac4aa2e88912c69

Observation 5cb02ee9-952e-41f5-9348-4cf0688dee1e · inbound

Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos cites this paper.

Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 121

Resolution
unresolved
no resolver link, observed 2026-08-06T15:33:48.079951Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T15:33:48.079951Z digest=sha256:bf6cf5e916a79969fc57d2c3d581c480599d6cfa6794895379982072df902b7c

Observation 6c259e54-5c90-4886-8292-e2122eb90125 · inbound

Towards Human-level Intelligence via Human-like Whole-Body Manipulation cites this paper.

Towards Human-level Intelligence via Human-like Whole-Body Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T15:01:48.289297Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T15:01:48.289297Z digest=sha256:75721a91bba70050cff7d63f206540d6dc80431928bbb6698911310a060032aa

Observation bc85672b-c06b-4387-ba57-c0324cd96fe2 · inbound

VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback cites this paper.

VLA-Touch: Enhancing Vision-Language-Action Models with Dual-Level Tactile Feedback RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T14:57:34.210088Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T14:57:34.210088Z digest=sha256:18e11b972fa79b7e429385da5de2c682ad8477b92c9ef7bdf077ed07a76201f1

Observation 8baeeaea-cb0f-4687-bc98-7a2727894b97 · inbound

ERMV: Editing 4D Robotic Multi-view images to enhance embodied agents cites this paper.

ERMV: Editing 4D Robotic Multi-view images to enhance embodied agents RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T14:53:31.519794Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T14:53:31.519794Z digest=sha256:5e29435374612b8f171cb0be09237c7c79e7765efc1c6de196dd829d7e502106

Observation b579cacc-07e7-487f-a854-f98425378f0b · inbound

Exploring the Link Between Bayesian Inference and Embodied Intelligence: Toward Open Physical-World Embodied AI Systems cites this paper.

Exploring the Link Between Bayesian Inference and Embodied Intelligence: Toward Open Physical-World Embodied AI Systems RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T12:39:40.574066Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T12:39:40.574066Z digest=sha256:3c6f2c60fcd7cfd05a47302d0e8e7b972ace79881def538e662aed4a9278bf78

Observation b831381a-d95e-4dc9-a8ae-559f40794def · inbound

H-RDT: Human Manipulation Enhanced Bimanual Robotic Manipulation cites this paper.

H-RDT: Human Manipulation Enhanced Bimanual Robotic Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T10:48:19.029306Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T10:48:19.029306Z digest=sha256:01e06f5c20d7274a1d60a52d7846d8a85ae4d829bbe358ea04a9e4c3c132e11b

Observation 199be3b8-13b7-493a-8a47-f04a11ac8801 · inbound

villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models cites this paper.

villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 42

Resolution
verified exact
local_arxiv, observed 2026-05-15T21:52:03.113484Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-15T21:52:02.893886Z digest=sha256:a62ead0a20e5435dcac8b87146ca15309f2cead91d8145468d2a9b1ab8c1f6e6

Observation 6ea77e92-222a-4e07-bba1-ebb610d2752a · inbound

TOP: Time Optimization Policy for Stable and Accurate Standing Manipulation with Humanoid Robots cites this paper.

TOP: Time Optimization Policy for Stable and Accurate Standing Manipulation with Humanoid Robots RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T10:17:31.468878Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T10:17:31.468878Z digest=sha256:71a657f129c5b06034d142a7e926cf9dc3ac7a5ee9fdf1b8064b9298dd9e5598

Observation e2ecd4dc-17b9-45ed-9805-de74c66fdbba · inbound

CollaBot: Vision-Language Guided Simultaneous Collaborative Manipulation cites this paper.

CollaBot: Vision-Language Guided Simultaneous Collaborative Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T04:32:09.857706Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T04:32:09.857706Z digest=sha256:07ea3f0e39a6e3aaafc5495b91cb31e9b13ef64a061342407defd0e5a1ccc5ae

Observation e0df39ea-57e0-459a-820e-fa649403f35e · inbound

Shortcut Learning in Generalist Robot Policies: The Role of Dataset Diversity and Fragmentation cites this paper.

Shortcut Learning in Generalist Robot Policies: The Role of Dataset Diversity and Fragmentation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T22:50:41.723178Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T22:50:41.723178Z digest=sha256:86e4c07fde2d82225f61201916a496fbfa8d6a264ec2e5befb27b27440eb474c

Observation f43952db-1030-4867-803e-c1de92adf51f · inbound

SPARSE Data, Rich Results: Few-Shot Semi-Supervised Learning via Class-Conditioned Image Translation cites this paper.

SPARSE Data, Rich Results: Few-Shot Semi-Supervised Learning via Class-Conditioned Image Translation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T22:46:40.266822Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T22:46:40.266822Z digest=sha256:aecef945e7f340c4a56056cf3d52f21b650a3805bca4c75db3c6d744cc2d6944

Observation 21b237a7-900b-4669-83fe-c4bb2e4577ba · inbound

GraphCoT-VLA: A 3D Spatial-Aware Reasoning Vision-Language-Action Model for Robotic Manipulation with Ambiguous Instructions cites this paper.

GraphCoT-VLA: A 3D Spatial-Aware Reasoning Vision-Language-Action Model for Robotic Manipulation with Ambiguous Instructions RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-05T21:59:02.125016Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T21:59:02.125016Z digest=sha256:306c19bfc44aa366620e48299ca81303b8339701c7558a1bdc0c9f12c17ab680

Observation e70ad54d-784e-41ca-9509-eec2899144b2 · inbound

4D Visual Pre-training for Robot Learning cites this paper.

4D Visual Pre-training for Robot Learning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-05T17:03:21.284052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T17:03:21.284052Z digest=sha256:79e92c075d1149ac071143292724f8fd36e2ab02fcebcc4b5937a1ae73d2cffe

Observation bd2a1399-f367-4161-9cb4-32a2411bfdfd · inbound

Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges cites this paper.

Robotic Manipulation via Imitation Learning: Taxonomy, Evolution, Benchmark, and Challenges RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-05T16:55:52.094429Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T16:55:52.094429Z digest=sha256:a4a5026c8f33e0108687c6fda1de78f207f8978ddd6117ae91107bb9c647bcfe

Observation 627d1f8e-40e2-4a48-8f1f-776840e74917 · inbound

Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation cites this paper.

Long-VLA: Unleashing Long-Horizon Capability of Vision Language Action Model for Robot Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 367

Resolution
unresolved
no resolver link, observed 2026-08-05T15:26:40.613924Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T15:26:40.613924Z digest=sha256:ef6fc09311c19a51835add36bced889b6ac2b500485bb6fe8dd308ede86708dd

Observation a32661e2-b317-4faa-9254-7b2588fadb08 · inbound

Galaxea Open-World Dataset and G0 Dual-System VLA Model cites this paper.

Galaxea Open-World Dataset and G0 Dual-System VLA Model RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-05T13:31:09.939185Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T13:31:09.939185Z digest=sha256:4efd1400324d70006d68c7196738a3621c1cac398a7c8fb7a6b1c06b42e95e99

Observation 9735faac-f144-43d8-842e-ad933ca6b64e · inbound

MoTo: A Zero-shot Plug-in Interaction-aware Navigation for General Mobile Manipulation cites this paper.

MoTo: A Zero-shot Plug-in Interaction-aware Navigation for General Mobile Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-05T12:23:06.500940Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T12:23:06.500940Z digest=sha256:bc1edec4dba8c11c55ace29f8b4af5afb279122d21df3f390c0bbee4bc37d128

Observation 88a2cfdb-4de4-49c9-a16f-7298316f8fbc · inbound

Align-Then-stEer: Adapting the Vision-Language Action Models through Unified Latent Guidance cites this paper.

Align-Then-stEer: Adapting the Vision-Language Action Models through Unified Latent Guidance RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-05T12:02:28.294340Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T12:02:28.294340Z digest=sha256:85936d1058a9b105ba2bd0358b9e2601f1c54735305ae54a8b926b6b648dbff2

Observation e7fad33c-2005-432d-81ae-019fc8d0b345 · inbound

FLOWER: Democratizing Generalist Robot Policies with Efficient Vision-Language-Action Flow Policies cites this paper.

FLOWER: Democratizing Generalist Robot Policies with Efficient Vision-Language-Action Flow Policies RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-05T05:48:47.202352Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T05:48:47.202352Z digest=sha256:922cb595e10302bbd6b0ec7627ffcc03fa4281eb6e8057a1dad841a8d6325c32

Observation 63615615-67b2-401d-8c1f-96ace12693b9 · inbound

RaC: Robot Learning for Long-Horizon Tasks by Scaling Recovery and Correction cites this paper.

RaC: Robot Learning for Long-Horizon Tasks by Scaling Recovery and Correction RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-04T21:32:58.502794Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T21:32:58.502794Z digest=sha256:a6f307c71f088d038cdcda4d607daeff42ffefb775006bd0b9098cf375a61ebd

Observation df31838c-20a0-4d2c-9ad9-b7f6345f5f88 · inbound

SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning cites this paper.

SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 13

Resolution
verified exact
local_arxiv, observed 2026-05-15T08:02:11.310938Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-15T08:02:11.189795Z digest=sha256:707a2f7c55a8ea30d4654bde1f5aa9ac38c449021dbb6203dc406701d2cea3d2

Observation d284ecb0-18c3-4958-ad6b-3ac9e4252b11 · inbound

UMI-on-Air: Embodiment-Aware Guidance for Embodiment-Agnostic Visuomotor Policies cites this paper.

UMI-on-Air: Embodiment-Aware Guidance for Embodiment-Agnostic Visuomotor Policies RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-04T12:43:01.801277Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T12:43:01.801277Z digest=sha256:d0ad9a8e8dda340f240ef112fe6798181e563022bad783667b492fe4f644b1f9

Observation 43e567ff-f5b8-4e09-a2c4-ca07d87bf558 · inbound

Ctrl-World: A Controllable Generative World Model for Robot Manipulation cites this paper.

Ctrl-World: A Controllable Generative World Model for Robot Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 33

Resolution
verified exact
local_arxiv, observed 2026-05-16T01:14:10.508745Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-16T01:14:10.174044Z digest=sha256:da6e7d7cc52ef487f4935295f71ecb1052d71bb331f8c5c9a199bbd2af647f12

Observation b663d527-feee-4195-9142-8f252729b1ca · inbound

RESample: A Robust Data Augmentation Framework via Exploratory Sampling for Robotic Manipulation cites this paper.

RESample: A Robust Data Augmentation Framework via Exploratory Sampling for Robotic Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 20

Resolution
verified exact
local_arxiv, observed 2026-05-18T06:10:57.895444Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-18T06:10:47.309028Z digest=sha256:8efeafd5697c566efc6cef3588b5acb2231bc04a75b9b9e4696d821ce7aec791

Observation aed15cd8-11f6-46c7-8013-6591695999bd · inbound

RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation cites this paper.

RoboCOIN: An Open-Sourced Bimanual Robotic Data Collection for Integrated Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 22

Resolution
verified exact
local_arxiv, observed 2026-05-17T20:20:12.103266Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-17T20:16:16.133013Z digest=sha256:d6e75b0c0818a6414065cef64c5ee1c7fd66c3602398da6e1a0bb8d0d065d641

Observation 9950ed21-9c08-4f0b-8d60-e80376dc42b4 · inbound

Towards Spatial Trace with Reasoning in Vision-Language Models for Robotics cites this paper.

Towards Spatial Trace with Reasoning in Vision-Language Models for Robotics RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-03T16:27:32.567627Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T16:27:32.567627Z digest=sha256:61985203b69bb4579bf5903d3dc755224562b007c82367d7a4a6b39988fa4260

Observation 5dc47ed2-d0f1-41ca-b03d-f6e9981102b5 · inbound

Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation cites this paper.

Learning Semantic Atomic Skills for Multi-Task Robotic Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-03T15:05:04.697581Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T15:05:04.697581Z digest=sha256:f47ea82f734b328bab7d1ab0e5a5751992186c6c9bfe5582d6102e233a18ed5b

Observation e53aed43-6ec8-4659-8bcf-bcb10a6e39b7 · inbound

EVE: A Generator-Verifier System for Generative Policies cites this paper.

EVE: A Generator-Verifier System for Generative Policies RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-03T14:10:36.220795Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T14:10:36.220795Z digest=sha256:b2451ac03e62694d0cbfbe77ef9a16dcf26ee3d3e48755396d676f5b459e6b82

Observation 6825f712-3351-4e25-aa62-63d2296ebe0f · inbound

StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision cites this paper.

StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-03T14:00:20.753591Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T14:00:20.753591Z digest=sha256:ec0d94319565d758c280f837cd1d4a37a8cca6b83ca5b0887b1cd0349f2e0ad4

Observation 0c429127-b4d1-405b-82d7-7083b26138fc · inbound

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation cites this paper.

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 22

Resolution
verified exact
local_arxiv, observed 2026-05-16T18:41:10.949623Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-16T18:39:59.449746Z digest=sha256:03dd584d63e5ead8f8ebbee7af71890009c2ff1c288158bf2131a9eaf9c7709b

Observation 08405c43-c478-49b5-bba8-8966703d4781 · inbound

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation cites this paper.

Learning to Feel the Future: DreamTacVLA for Contact-Rich Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-03T13:35:54.155215Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T13:35:54.155215Z digest=sha256:ce8378d70b386dc5666e4874bdb03e6c4e4128652222fff95b1249bfb4097ffd

Observation 22929556-c19f-45ac-85c8-e4803bdb5595 · inbound

Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot cites this paper.

Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 50

Resolution
verified exact
local_arxiv, observed 2026-05-16T18:03:12.242207Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-16T18:02:11.393346Z digest=sha256:16b3601b87ee1bc052ced361369627cf6d82a55a3af227500e7f39ab7ab0611d

Observation e7806796-e624-41e1-b97e-ae4440779d55 · inbound

Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot cites this paper.

Genie Sim 3.0 : A High-Fidelity Comprehensive Simulation Platform for Humanoid Robot RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-03T12:41:55.172398Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-03T12:41:55.172398Z digest=sha256:c6c733b01661c7ae1c85a8bb1a3d4199fbc92ce2f43951ec20159c8b43904b65

Observation c32f9c34-b19d-40f0-80aa-961bd48211e6 · inbound

PALM: Progress-Aware Policy Learning via Affordance Reasoning for Long-Horizon Robotic Manipulation cites this paper.

PALM: Progress-Aware Policy Learning via Affordance Reasoning for Long-Horizon Robotic Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 80

Resolution
verified exact
local_arxiv, observed 2026-05-16T15:08:02.041441Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-16T15:05:21.907878Z digest=sha256:47f0f2b3842ba02f2d77ceae658e9f216507b75fad6f07f5aba45d5ef892b1a6

Observation 0cd79042-d63c-4aff-8d96-0cadb3663520 · inbound

Information Filtering via Variational Regularization for Robot Manipulation cites this paper.

Information Filtering via Variational Regularization for Robot Manipulation RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation

Reference 8

Resolution
verified exact
local_arxiv, observed 2026-05-16T09:40:48.947539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.

source=pdf_text observed=2026-05-16T09:38:21.657768Z digest=sha256:95c0a91a04a199c9eba514ccb02c39b3059b7154040daa731e28b1570d258d3e