Pith. sign in

Paper Citation Record · LEDGER

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity

As of 8 August 2026, this Paper Citation Record lists 88 of 88 outbound references and 0 inbound Pith citation observations for arXiv:2506.16652.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.16652 v1

Coverage vector

measured 88 of 88 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-06T23:43:18.014761Z

measured 88 of 88 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

88 of 88 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved88
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 530392fa-4ac1-4262-b2ef-0e2eb71e91cd · outbound

This paper cites an unresolved cited work.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Unresolved cited work

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:06.524744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:06.524744Z digest=sha256:afe4c67a741450b149732b8bd1f1ba1b3ac130bf0e2f362119765b870575f9e3

Observation ead7d370-fa97-43c5-b65a-d15525e1cb99 · outbound

This paper cites Diffusion policy: Visuomotor policy learning via action diffusion.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Diffusion policy: Visuomotor policy learning via action diffusion

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:06.725145Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:06.725145Z digest=sha256:c5eda90c45a162b90e685a57ca5fc8bdd2a0d76e354a5c8fe9a4352d2c4ccc4e

Observation 4dff6c96-a746-419b-8240-584857b1acb1 · outbound

This paper cites Diffusion policy: Visuomotor policy learning via action diffusion.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Diffusion policy: Visuomotor policy learning via action diffusion

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:06.944752Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:06.944752Z digest=sha256:496e1cc6273d7b1daca32c4aca525513127f02c7ba9b66759f59158f8023a0ad

Observation 2174d77b-c611-46b9-89ca-276929a64c8b · outbound

This paper cites DINOv2: Learning Robust Visual Features without Supervision.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity DINOv2: Learning Robust Visual Features without Supervision

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:07.226489Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:07.226489Z digest=sha256:78893ac0a5d3d5b5301d4c57e5239300f9161194f9aa7bdc14cbf088e8744bab

Observation 8809d1b7-15b0-47ff-97cb-b6e4e48dae43 · outbound

This paper cites Segment Anything.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Segment Anything

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:07.314820Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:07.314820Z digest=sha256:4751bebe7bfb804d84e6c94d41a578c3ad107b74e83f865ad331a0aacdfb2193

Observation 6065ebc8-815a-4f50-a592-32ee335909ba · outbound

This paper cites Aloha unleashed: A simple recipe for robot dexterity.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Aloha unleashed: A simple recipe for robot dexterity

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:07.385285Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:07.385285Z digest=sha256:5d111afb0296136a383b98d82125552a0056be72b4a1268e43c892eb5c140a6e

Observation 57edf40d-6821-492f-921e-d87a80fbbd81 · outbound

This paper cites Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:07.434890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:07.434890Z digest=sha256:0bbb370f8b9469af0a6ef59631ec6092943690e40255bb26e20421f28c228300

Observation 3c414d5e-1d2e-45b6-a06b-450cf0660d82 · outbound

This paper cites Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:07.614816Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:07.614816Z digest=sha256:c12c62596f22b3289bb39a17187e8b240cee23a396ecde4cb4f822fac2cd8e91

Observation 4bb60adb-ff49-4b5c-a282-471ffffec83c · outbound

This paper cites Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:07.755134Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:07.755134Z digest=sha256:c712ea0e95f75d659c7129a41cefe638d5ffdea5f73a04fcd74933ff672f37f6

Observation 8d5f6eea-21b9-4c7b-a359-0dd3062b97ab · outbound

This paper cites UMI on Legs: Making Manipulation Policies Mobile with Manipulation-Centric Whole-body Controllers.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity UMI on Legs: Making Manipulation Policies Mobile with Manipulation-Centric Whole-body Controllers

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:07.925121Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:07.925121Z digest=sha256:f8a4f72c0e6b436165f674daa35a394fef326234bc9113481f832a878a7c18c1

Observation 2d433d63-85a0-4f1d-b7a7-f03355f6da61 · outbound

This paper cites Deep imitation learning for complex manipulation tasks from virtual reality teleoperation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Deep imitation learning for complex manipulation tasks from virtual reality teleoperation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.047140Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.047140Z digest=sha256:8e55d03ebf06a70e95dcf830a168ab470edd6bf44f3fe006602251245cc361c4

Observation 2809c5b8-11b8-4f18-a6e0-b106d0e4a14a · outbound

This paper cites RVT: Robotic View Transformer for 3D Object Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RVT: Robotic View Transformer for 3D Object Manipulation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.226401Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.226401Z digest=sha256:f199318bc1afee5b8c3842293c51ae9be3ab37b05d10db3b241cedb87e10eae6

Observation edb8223a-b967-4055-9910-92b6dae55ec1 · outbound

This paper cites Perceiver-actor: A multi-task transformer for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Perceiver-actor: A multi-task transformer for robotic manipulation

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.344892Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.344892Z digest=sha256:dfcb1cf9d5260846837102554ee795851e17a13c1adce5e2e94106808fad3ec9

Observation 2946c490-6631-4bf1-b88b-f56eb95646cd · outbound

This paper cites Cliport: What and where pathways for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Cliport: What and where pathways for robotic manipulation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.454754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.454754Z digest=sha256:6a64874924c25ce3591dde068eb2d9e212986c5a72691cb85252afbe1f691470

Observation 2a830790-43a8-40d7-83dc-68cfd6059798 · outbound

This paper cites Viola: Imitation learning for vision-based manipulation with object proposal priors.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Viola: Imitation learning for vision-based manipulation with object proposal priors

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.584847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.584847Z digest=sha256:924887f5528e96ccece14c64999f4b9c8bda7e467012ea69ac5707bd719facad

Observation a0d9b467-9f52-4700-9076-064ce1f70f4b · outbound

This paper cites What Matters in Learning from Offline Human Demonstrations for Robot Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity What Matters in Learning from Offline Human Demonstrations for Robot Manipulation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.684947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.684947Z digest=sha256:28950f5f966867715190b1a3dd103b1b983b4896cc4e9b0c200a36edba27191c

Observation 3296d67c-ca87-4065-a1f1-964eb548aead · outbound

This paper cites Self-supervised correspondence in visuomotor policy learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Self-supervised correspondence in visuomotor policy learning

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.753600Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.753600Z digest=sha256:869042d46880d52b705644dc7c767d280d64adc4d9acbf089002b125b29b50b3

Observation cfaf3d92-9842-481e-a4ee-72dca1477af4 · outbound

This paper cites A reduction of imitation learning and structured prediction to no-regret online learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity A reduction of imitation learning and structured prediction to no-regret online learning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:08.906191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:08.906191Z digest=sha256:61da51dd886a203c7e70a368cb20d83ab928ec31a85bcdbca8af007328ff1217

Observation ae4975c4-86a8-4bda-8d89-19c6418507d7 · outbound

This paper cites One-shot imitation learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity One-shot imitation learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.014825Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.014825Z digest=sha256:b5bbfb48e5d9229098d5bae3933cf34f6da46742df0b690f0163f579e7f9ac7d

Observation f258fed9-b238-4ff8-bbb2-71d694138387 · outbound

This paper cites Waypoint-Based Imitation Learning for Robotic Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Waypoint-Based Imitation Learning for Robotic Manipulation

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.093640Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.093640Z digest=sha256:9630ab26b372dbcad41f3d3f2a3091edaf3cba189c8e0523630a3f5931c53e40

Observation ffef1f68-1225-406c-a3ed-e42db8dbfda4 · outbound

This paper cites Keypoint Action Tokens Enable In-Context Imitation Learning in Robotics.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Keypoint Action Tokens Enable In-Context Imitation Learning in Robotics

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.225030Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.225030Z digest=sha256:39109e04060e2d1e36f1e02d9feb4706916a5d9095ec51ccc1fc6bc09a9c3248

Observation 8b6ec2ab-7a13-4a87-ad71-d6e6fe8e7731 · outbound

This paper cites DINOBot: Robot Manipulation via Retrieval and Alignment with Vision Foundation Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity DINOBot: Robot Manipulation via Retrieval and Alignment with Vision Foundation Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.322992Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.322992Z digest=sha256:d4f0ca6412a88286c1462932ca75347444d23d7564abe3a4e1978cc17b36a59b

Observation 16b0c840-5580-4c33-8187-73367d7db7e1 · outbound

This paper cites You Only Demonstrate Once: Category-Level Manipulation from Single Visual Demonstration.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity You Only Demonstrate Once: Category-Level Manipulation from Single Visual Demonstration

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.462361Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.462361Z digest=sha256:4c5d5a61d2a054e70db4ca5bb4b60e56496d44e0dccc78539fe08c90a7fb9b8a

Observation 4fa11043-2014-49f4-b99b-14c3b146a2a3 · outbound

This paper cites Open X-Embodiment: Robotic Learning Datasets and RT-X Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Open X-Embodiment: Robotic Learning Datasets and RT-X Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.554909Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.554909Z digest=sha256:32a4326b85d001bf7130af1660af6e4ab096296f4bdca77d8417d29533b217ed

Observation 0eb65afc-73aa-4012-a46d-7086cd463469 · outbound

This paper cites RT-1: Robotics Transformer for Real-World Control at Scale.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RT-1: Robotics Transformer for Real-World Control at Scale

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.623942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.623942Z digest=sha256:6d64232e2bff7a30daa1cb15820e1bdb840c488108675004fae15fee643e45c2

Observation 091b71fd-fb37-4c23-8d27-0fc21cc53282 · outbound

This paper cites RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.744807Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.744807Z digest=sha256:ed0cc38e63ea1727a8488c18276405010406fba124f312179e491922c45cba20

Observation 8feba9ee-3f59-4720-acf3-db53a4ca4472 · outbound

This paper cites Implicit kinematic policies: Unifying joint and cartesian action spaces in end-to-end robot learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Implicit kinematic policies: Unifying joint and cartesian action spaces in end-to-end robot learning

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:09.874754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:09.874754Z digest=sha256:5db64278adbcb0b3d12041ed2bb0072733d08fcc39bfecba1adc8cef3bfa7288

Observation 97035697-5cfe-4cbf-8d4b-855eced3c79e · outbound

This paper cites Implicit behavioral cloning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Implicit behavioral cloning

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.034752Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.034752Z digest=sha256:2a1a7303e38cf558397ced9ec655024f61e60b650acb121d955c331ab3007b95

Observation aebd1e15-2bf3-4fb7-9b55-d3c33bba4883 · outbound

This paper cites Behavior transformers: Cloning k modes with one stone.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Behavior transformers: Cloning k modes with one stone

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.154899Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.154899Z digest=sha256:8056bd74612d2fcd4b3b927f37e019d011cc8ab59ccc887abd9eae31648eb332

Observation ea6ac4b4-8084-4130-91f4-173a7978e7c8 · outbound

This paper cites Implicit Generation and Generalization in Energy-Based Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Implicit Generation and Generalization in Energy-Based Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.275181Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.275181Z digest=sha256:d2f9aa537e1e68f3330f494736bd0ea1607b303089eeaf8e418ab7cb3a351c13

Observation 75d25a69-607c-44f9-a2de-f704f0cd451f · outbound

This paper cites Bayesian learning via stochastic gradient langevin dynamics.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Bayesian learning via stochastic gradient langevin dynamics

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.394745Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.394745Z digest=sha256:9b04d3e33719512b1e3e09318d8f0636f3647018713be5ed05b9c7d0cb281a1e

Observation dfb10ef5-910c-4f1b-97df-f04cd563b746 · outbound

This paper cites Concept Learning with Energy-Based Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Concept Learning with Energy-Based Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.504918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.504918Z digest=sha256:2e50544a5012faac6000207d22248b079e3e6bf4681053934f234e8b4d72a1c2

Observation edb0c770-db8b-44a1-9b3b-93190f5aacc4 · outbound

This paper cites Octo: An open-source generalist robot policy.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Octo: An open-source generalist robot policy

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.664926Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.664926Z digest=sha256:24610479550c1f70207ad92e84fb2e6bd3ea64ea0e0fbe15a254dad9ea54947a

Observation 6c2b88e6-ccdc-42aa-bc2a-fc54646e79d4 · outbound

This paper cites Imitating Human Behaviour with Diffusion Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Imitating Human Behaviour with Diffusion Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.794754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.794754Z digest=sha256:6ed31c10745bba64a4804adb73334e0bff66b3de952494f13293e2e40cd7990a

Observation 4d1ee1dd-f098-4c0a-806e-c5e791fbd988 · outbound

This paper cites 3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity 3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:10.907921Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:10.907921Z digest=sha256:f9be5450ff7b67203617ca97db8c1b3d18c9cec9e6578520242c44b46996d13d

Observation 8783cb81-7809-42ad-9252-0f905344f7b1 · outbound

This paper cites Robot See Robot Do: Imitating Articulated Object Manipulation with Monocular 4D Reconstruction.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Robot See Robot Do: Imitating Articulated Object Manipulation with Monocular 4D Reconstruction

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:11.034889Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:11.034889Z digest=sha256:d37a389a9fcdda91f29aa05efc814453d313268031be28b342efdb376594ab13

Observation 0cbd6ddb-4183-4f50-a16e-73171450c14f · outbound

This paper cites Learning transferable visual models from natural language supervision.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning transferable visual models from natural language supervision

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:11.164759Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:11.164759Z digest=sha256:b1c4e2b5fe3892912654b9297815570c8e987baf8688d870923f96ca7240c20e

Observation 0074272f-7172-45a0-86f5-08d662e1a7fb · outbound

This paper cites Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:11.344830Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:11.344830Z digest=sha256:07a3e29ee49adbce9b7745ebaf162f387fb5e790f18eeefc627082c8ccf1bec5

Observation da5d5e3c-1c63-48ff-ba5e-f47dd7c18765 · outbound

This paper cites Yolo-world: Real-time open-vocabulary object detection.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Yolo-world: Real-time open-vocabulary object detection

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:11.474826Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:11.474826Z digest=sha256:05f6f6b633d0d3d59ec5e08871767ca212761d857bcc6418b5d59986e44c0977

Observation 4b3b404a-6513-4fd6-8418-b2fb404a711b · outbound

This paper cites D ^3 fields: Dynamic 3d descriptor fields for zero-shot generalizable rearrangement.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity D ^3 fields: Dynamic 3d descriptor fields for zero-shot generalizable rearrangement

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:11.615171Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:11.615171Z digest=sha256:27732a55bd05fc9751f37f47528723fd80323ac41fd5bdaca0142dbee84f0074

Observation 04b808b3-4aa1-409f-9808-cd2ece70b37f · outbound

This paper cites Gendp: 3d semantic fields for category-level generalizable diffusion policy.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Gendp: 3d semantic fields for category-level generalizable diffusion policy

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:11.734834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:11.734834Z digest=sha256:d863c9fade3bae40c2d844f862bf68ff827678763f1f384120e8576f39892510

Observation fc9b5885-c966-4250-baf8-8b3bf3babe5e · outbound

This paper cites Rekep: Spatio-temporal reasoning of relational keypoint constraints for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Rekep: Spatio-temporal reasoning of relational keypoint constraints for robotic manipulation

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:11.895556Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:11.895556Z digest=sha256:1dc33e0a9690a4a5da7c30081e2af2162cab5625f378aca62fe28ee635a999fa

Observation 8c8153aa-701d-4d6c-92ab-266d308e75e2 · outbound

This paper cites Voxposer: Composable 3d value maps for robotic manipulation with language models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Voxposer: Composable 3d value maps for robotic manipulation with language models

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:12.084748Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:12.084748Z digest=sha256:ab91c1a04cfc0003ef2c851e91442306a6d853115b3faadacfbc876901117505

Observation baeba0e1-6394-4aa3-9a37-1d1f60b9587b · outbound

This paper cites Learning Generalizable Feature Fields for Mobile Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning Generalizable Feature Fields for Mobile Manipulation

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:12.224995Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:12.224995Z digest=sha256:d47ad57df3ba46616562f1783a3ae677ba2eb320f55be46215e903ee8f5776bc

Observation 54760dfe-5af2-412f-91c1-0585dadd9377 · outbound

This paper cites Gnfactor: Multi-task real robot learning with generalizable neural feature fields.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Gnfactor: Multi-task real robot learning with generalizable neural feature fields

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:12.424891Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:12.424891Z digest=sha256:a4977b93e3c8e64cf41e6214b498b2b841775d2531821c341e9caaf5f619cfd7

Observation 04a0e119-9373-4eb0-9516-6287aac01525 · outbound

This paper cites 3D Diffuser Actor: Policy Diffusion with 3D Scene Representations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity 3D Diffuser Actor: Policy Diffusion with 3D Scene Representations

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:12.634833Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:12.634833Z digest=sha256:5752bce692c5d90b08dd324435635d4664259ed9d291a85ca0f6858fb36365ce

Observation b6c77665-4bc1-4580-bd8c-c945edf18c79 · outbound

This paper cites Learning generalizable manipulation policies with object-centric 3d representations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning generalizable manipulation policies with object-centric 3d representations

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:12.754774Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:12.754774Z digest=sha256:bfc4cfddc2a4b3a5e79b04dc84806373d6d3c537b57deb2582085850fce30835

Observation f08ac459-94e5-486c-8cb4-36f6a0702591 · outbound

This paper cites Spawnnet: Learning generalizable visuomotor skills from pre-trained network.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Spawnnet: Learning generalizable visuomotor skills from pre-trained network

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:12.869559Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:12.869559Z digest=sha256:a0fc08b4ea18b499f98be069100248e01652547672554f4f0a576dec57d2e548

Observation 8d712428-93d8-4135-b097-07804ac85b02 · outbound

This paper cites Conceptgraphs: Open-vocabulary 3d scene graphs for perception and planning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Conceptgraphs: Open-vocabulary 3d scene graphs for perception and planning

Reference 49

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:12.984828Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:12.984828Z digest=sha256:d95d383d81ad765eaeaad2c008e8120db7d2f4102af230727b0dbc7cd901ee99

Observation e37e1365-4398-4676-a12f-1fb0c0a3c49e · outbound

This paper cites ConceptFusion: Open-set Multimodal 3D Mapping.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity ConceptFusion: Open-set Multimodal 3D Mapping

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.155135Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.155135Z digest=sha256:dea75aa2a703ee2dd2035ef260aff6a7e941407acaa72b7d33efa48ceb061e2f

Observation 0b8c997a-c733-4774-827a-f373d9736cc9 · outbound

This paper cites RoboEXP: Action-Conditioned Scene Graph via Interactive Exploration for Robotic Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RoboEXP: Action-Conditioned Scene Graph via Interactive Exploration for Robotic Manipulation

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.254910Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.254910Z digest=sha256:8413891aa462863b48c9dbf83c11d58fc6e5d1c2147203f29894210e245fc684

Observation 277d7f32-9bb2-40f8-a18d-18a839f067be · outbound

This paper cites Hydra: A Real-time Spatial Perception System for 3D Scene Graph Construction and Optimization.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Hydra: A Real-time Spatial Perception System for 3D Scene Graph Construction and Optimization

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.374775Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.374775Z digest=sha256:bfb355b12000e5ee164e840a445e16afa67e8c434ca131e86af7fa4306077f59

Observation ea00edfd-c4e9-43ca-a520-b893ceacf694 · outbound

This paper cites Clio: Real-time Task-Driven Open-Set 3D Scene Graphs.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Clio: Real-time Task-Driven Open-Set 3D Scene Graphs

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.468970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.468970Z digest=sha256:8c8ced61c695f2ba26e83df31860016d1741a777bca6092ab2f63b1f38327adb

Observation 3cca6a6e-f9d4-45c4-bd33-8f45a73db08a · outbound

This paper cites Foundations of spatial perception for robotics: Hierarchical representations and real-time systems.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Foundations of spatial perception for robotics: Hierarchical representations and real-time systems

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.644865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.644865Z digest=sha256:e71437009aa1ec88c8ddbfc49d083b827c8eff999551f226d6780dd4c4f626c1

Observation adabcccf-81e8-4fbb-aab6-8905679838b7 · outbound

This paper cites Indoor and outdoor 3d scene graph generation via language-enabled spatial ontologies.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Indoor and outdoor 3d scene graph generation via language-enabled spatial ontologies

Reference 55

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.764920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.764920Z digest=sha256:04a624abdc160ad5ea3b46ce1b40aa3b6d0bddf96bdffc02b18c89a37a973f46

Observation e6b65aa2-1669-460d-b865-fc389ea89bb5 · outbound

This paper cites Openscene: 3d scene understanding with open vocabularies.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Openscene: 3d scene understanding with open vocabularies

Reference 56

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.854754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.854754Z digest=sha256:4e9700d9b20403b3257f3a908d74ab56799e548fbd05ee39b983ca1bf39eebcc

Observation 3431d5ca-1f8a-479e-81c5-404bd67954ea · outbound

This paper cites Semantic Abstraction: Open-World 3D Scene Understanding from 2D Vision-Language Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Semantic Abstraction: Open-World 3D Scene Understanding from 2D Vision-Language Models

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:13.972628Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:13.972628Z digest=sha256:23037ce3446f019b0087a33ec8687145b42610c2b91743543f6a8dd9be76fc08

Observation 9863f160-baa8-4e26-ba60-7d13bcf74934 · outbound

This paper cites Vlfm: Vision-language frontier maps for zero-shot semantic navigation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Vlfm: Vision-language frontier maps for zero-shot semantic navigation

Reference 58

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.084778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.084778Z digest=sha256:e8a26d5e51f3dec96381aa764137c4bdeb39df1f4a9c7850de7ff1ad9b4d22b9

Observation c50c77f9-a746-4716-b91b-9c183bf18084 · outbound

This paper cites Think, act, and ask: Open-world interactive personalized robot navigation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Think, act, and ask: Open-world interactive personalized robot navigation

Reference 59

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.204894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.204894Z digest=sha256:2e5ef7f2b3a24a5e17dd7d650611420795b471c2d88c6df5a1229c20257f0f51

Observation 4d92a6aa-6110-43b3-9744-5bb6b49fd89e · outbound

This paper cites PaLM-E: An Embodied Multimodal Language Model.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity PaLM-E: An Embodied Multimodal Language Model

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.324750Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.324750Z digest=sha256:badc6860ee5c926b6f27c8d06e95bfe8d5fde4fc88a3a154a994e77c64b435aa

Observation bebc264f-8b16-4565-a2d4-042f5a69df21 · outbound

This paper cites Do As I Can, Not As I Say: Grounding Language in Robotic Affordances.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Do As I Can, Not As I Say: Grounding Language in Robotic Affordances

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.464752Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.464752Z digest=sha256:9999c7538b1588bdbba0ae71e4425e1a2dcfc575e5f1ca618524198350867162

Observation 88cdb411-390e-453d-b3dc-59d4c3cc855f · outbound

This paper cites Inner Monologue: Embodied Reasoning through Planning with Language Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Inner Monologue: Embodied Reasoning through Planning with Language Models

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.599688Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.599688Z digest=sha256:06cb8cca79ac7fb20492017028c7d3386b02626b1a2517bfe514812c1b9fac5a

Observation a336effe-8789-4c4f-9578-0cbaa647c504 · outbound

This paper cites Code as policies: Language model programs for embodied control.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Code as policies: Language model programs for embodied control

Reference 63

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.713014Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.713014Z digest=sha256:3561b76f6e168d5ec19c1f56d38a39da533a940ca0b083d49d4cdedd0e9d92b1

Observation a73b0e8e-ffde-4648-b2bd-8326791eb01d · outbound

This paper cites CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.844779Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.844779Z digest=sha256:5cc014cc411ea95c5476e5e9076020e5d1e4e97819aa927655df40596c981f77

Observation 253e318f-ba78-4852-baad-4fafd143d470 · outbound

This paper cites MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:14.985685Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:14.985685Z digest=sha256:6084775660c1ca21cff2fdbd8d21802c28cf8326ae86578b6e535b639f286380

Observation 9593aab6-c73b-4d81-bdf0-6cc766bb02c1 · outbound

This paper cites PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:15.132492Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:15.132492Z digest=sha256:1bc3701c53d0ce5a3d2e6670a63c63422c826234622fc4bc15ca29d349ae47c9

Observation 4632c0d5-df63-413b-91ca-f45090d767fa · outbound

This paper cites Video Language Planning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Video Language Planning

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:15.274831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:15.274831Z digest=sha256:816afec2893e6d0dc38dde75d3292878c595dfd046df3d198efb38fcd82896d3

Observation be6e9c80-d299-4615-811a-83901dfa5cc2 · outbound

This paper cites 3d-llm: Injecting the 3d world into large language models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity 3d-llm: Injecting the 3d world into large language models

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:15.384574Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:15.384574Z digest=sha256:869a98eac8555b4379d74e746ac330421644c181fefce16b165f71916312169e

Observation 6c40e8b2-3289-4f05-ba9e-b31810248948 · outbound

This paper cites Spatialvlm: Endowing vision-language models with spatial reasoning capabilities.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Spatialvlm: Endowing vision-language models with spatial reasoning capabilities

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:15.494772Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:15.494772Z digest=sha256:3bcbbe5ea9488de97cae7bdca17c6eac4bf3e46b39bb2bac81bb1fa873fd2da3

Observation 8196e1ae-bcf9-4f1c-b5de-c60dda6e8ab4 · outbound

This paper cites Physically grounded vision-language models for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Physically grounded vision-language models for robotic manipulation

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:15.654847Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:15.654847Z digest=sha256:00aa827a1b459abe8aa8c6b4dbfc954673cf3cfd4c06e832ba6e73b0821caeaf

Observation 410d0aa1-3209-44c5-bae8-2de46a11e1c0 · outbound

This paper cites Grounding Language Plans in Demonstrations Through Counterfactual Perturbations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Grounding Language Plans in Demonstrations Through Counterfactual Perturbations

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:15.814911Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:15.814911Z digest=sha256:1dbb5ddfb4c347d2d1ac7af67fce586ab14a0b3d22e4674aaa4767a5c0c84b98

Observation a4065065-fe87-48de-b923-98e6854f2713 · outbound

This paper cites Ns3d: Neuro-symbolic grounding of 3d objects and relations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Ns3d: Neuro-symbolic grounding of 3d objects and relations

Reference 72

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:15.974832Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:15.974832Z digest=sha256:23bb8e1a53de1b124d9ddee450bb39a707cc87de10d4682b9a5d465fbea19934

Observation d2c9f0f7-54d6-4314-9f05-e85f520a24dd · outbound

This paper cites RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:16.136090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:16.136090Z digest=sha256:ab5f3e8d28522f8c0bbc2609eb378ac5cdcad1d621054485eb496250de8b0432

Observation 23a833c6-23d9-49c7-93ab-3bf69e1c2e61 · outbound

This paper cites Manipulate-Anything: Automating Real-World Robots using Vision-Language Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Manipulate-Anything: Automating Real-World Robots using Vision-Language Models

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:16.284842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:16.284842Z digest=sha256:e6430d5499cc80fbbe87e4c0ab6b3a7c75997e95ee1a5b60a5026a7ab8e8dcff

Observation dfcc3070-edec-4eba-93b5-78d3cbacfefe · outbound

This paper cites $A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity $A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:16.396717Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:16.396717Z digest=sha256:1d8bfdc4b5a9f29a5f02bbebd0492a372a68b536ae435dd5846f8a1f54de4307

Observation 9923e08f-29ec-425f-939a-aa14592b801f · outbound

This paper cites Llm-grounder: Open-vocabulary 3d visual grounding with large language model as an agent.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Llm-grounder: Open-vocabulary 3d visual grounding with large language model as an agent

Reference 76

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:16.591307Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:16.591307Z digest=sha256:3cec32ce263ac1564a6d5c205f4663e3df40e1dec2be2ca549a26109a9db2eea

Observation 42bb8f5a-c3de-46c7-b076-5a94690a86f0 · outbound

This paper cites Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:16.734915Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:16.734915Z digest=sha256:62fd88725bcc88fb746c940d3af6883945f31b9e7cda279f8e246276fa7234c7

Observation eb990b57-1269-4fc5-940c-bb2bd06c059c · outbound

This paper cites Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis

Reference 78

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:16.914894Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:16.914894Z digest=sha256:a85ada3f9ee5c5d37b0f34e7f134b374646685ae7d2ba7615726306ebd015f14

Observation 6de6e3ff-3790-4354-a455-e104a1e34e46 · outbound

This paper cites Foundation Models in Robotics: Applications, Challenges, and the Future.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Foundation Models in Robotics: Applications, Challenges, and the Future

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.034898Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.034898Z digest=sha256:000709e7168c63fee3b877e379facfbe6328836c831c4f7e76d0fecb0c057b6f

Observation 7b95dbea-a782-486b-817c-97b08670ac1b · outbound

This paper cites Real-World Robot Applications of Foundation Models: A Review.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Real-World Robot Applications of Foundation Models: A Review

Reference 80

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.184834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.184834Z digest=sha256:abf5293c057f403e86a1068d20df6c0bbf8cbffbb6c041b9f777bc3c3e074c67

Observation 8c29bd59-3681-4b3b-a308-f23a2617ccc8 · outbound

This paper cites Foundation Models for Decision Making: Problems, Methods, and Opportunities.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Foundation Models for Decision Making: Problems, Methods, and Opportunities

Reference 81

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.295896Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.295896Z digest=sha256:1b1e432be03f701961c541ae0fbeaa71eb5519edde4ceaf2b0e1611556a07a06

Observation c53eb4c9-8195-4621-937e-4076ad1aab15 · outbound

This paper cites GPT-4 Technical Report.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity GPT-4 Technical Report

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.404763Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.404763Z digest=sha256:4d9a0196c7883d3d1999f7ecbbec439037c0e6e16a279920a26511f2c466fed1

Observation fdfb772a-44d8-4d52-8768-01c7e5d3dded · outbound

This paper cites Denoising Diffusion Probabilistic Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Denoising Diffusion Probabilistic Models

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.491513Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.491513Z digest=sha256:a93aa9882e3d25f9ad1df3117e35db4f0d5e2e94eb6f8e5b9522b13b7f52009f

Observation 9b9bf2b4-bb07-4e99-b12a-def58e8930a7 · outbound

This paper cites Pointnet++: Deep hierarchical feature learning on point sets in a metric space.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Pointnet++: Deep hierarchical feature learning on point sets in a metric space

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.585171Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.585171Z digest=sha256:67f8d880619e5ff2c43f562d04df7ca510caa0711850067f8d0e0fd3a2bbc923

Observation 122bba3d-6819-4c37-a05f-7388bde83acf · outbound

This paper cites Chang, Leonidas J.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Chang, Leonidas J

Reference 85

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.704751Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.704751Z digest=sha256:b0a8f9ff5e8910c825a98ca6e0909f8c380ba5d099f71038ecea9ad9a41e04e5

Observation b8c45de2-f754-46cf-a913-c8cde18d3ea5 · outbound

This paper cites @esa (Ref.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity @esa (Ref

Reference 86

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.816826Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.816826Z digest=sha256:fefc6ee971b4b8606cf98da9887d30b6dc9038f51199eb30c18e118060fc51db

Observation 4aeba1c7-db8e-40eb-9dc0-ea161c416339 · outbound

This paper cites an unresolved cited work.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Unresolved cited work

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:17.904752Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:17.904752Z digest=sha256:70d1e2d5ab75179bc6a6e9e29e0970feddcbbe103890db7f02df97b1563dd42d

Observation 78e455b4-cfe8-41e7-a6e6-19bd15ba26c3 · outbound

This paper cites an unresolved cited work.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Unresolved cited work

Reference 88

Resolution
unresolved
no resolver link, observed 2026-08-06T23:43:18.014761Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-06T23:43:18.014761Z digest=sha256:ff972c5b772a11852044881cbd334872c1e7c35e52b2d683e4b748404271572a

Pith citing papers

No inbound Pith citation observations are available.