Pith. sign in

Paper Citation Record · LEDGER

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity

As of 21 August 2026, this Paper Citation Record lists 88 of 88 outbound references and 0 inbound Pith citation observations for arXiv:2506.16652.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.16652 v1

Coverage vector

measured 88 of 88 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-15T19:31:53.542353Z

measured 88 of 88 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

88 of 88 outbound references displayed

  • verified exact0
  • verified fuzzy23
  • unresolved65
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 313d8d46-435b-4a0e-b87a-6fa6fd2dbf45 · outbound

This paper cites an unresolved cited work.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Unresolved cited work

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.195640Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.195640Z digest=sha256:dbad2bb80fab903f562fdd56a9ff865e618318ac4911143febfe94ee00924227

Observation 0c739d96-9780-4cfa-9e17-5f333b925652 · outbound

This paper cites Diffusion policy: Visuomotor policy learning via action diffusion.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Diffusion policy: Visuomotor policy learning via action diffusion

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.202058Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.202058Z digest=sha256:1a06772b691ddde032e9155a9bcaa7f431d112b87c65916fc3adef0a28dbb29c

Observation fe41b08f-41ab-4688-95f0-2963e57c77d8 · outbound

This paper cites Diffusion policy: Visuomotor policy learning via action diffusion.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Diffusion policy: Visuomotor policy learning via action diffusion

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.206402Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.206402Z digest=sha256:6b285af16306587574d1fb1329eac9ba7f2ae93124170787898b23c6ec771763

Observation fbef2ee6-7b76-4056-a7bc-73524bfa55ed · outbound

This paper cites DINOv2: Learning Robust Visual Features without Supervision.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity DINOv2: Learning Robust Visual Features without Supervision

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.210215Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.210215Z digest=sha256:76e72026602c3c141efda56576dddb8e9c15f5426c926b359e59a27bfe21c310

Observation 5a5b5b70-2f20-435d-9134-0de78bd9f930 · outbound

This paper cites Segment Anything.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Segment Anything

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.214351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.214351Z digest=sha256:afd521f139c83a9f2779c70155e2edcac2215f1a957a19b6f11d75a30ddd6f3f

Observation c5015853-a884-4eda-b5b2-b1eb1fe757cb · outbound

This paper cites Aloha unleashed: A simple recipe for robot dexterity.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Aloha unleashed: A simple recipe for robot dexterity

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.218753Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.218753Z digest=sha256:d4b5b8e98e124171f1f86edff5e9a1d48ae1cdb8c94d89f85c43531cda98ee5b

Observation 15170f9d-1142-4994-9e22-4289f6eff59c · outbound

This paper cites Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.222551Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.222551Z digest=sha256:d4f6cee8fd088e2f43b0606f2c3a43050adebabeef1fb7a07d2703d6d3c434dd

Observation b68de62c-97de-4e78-9a05-daaeb7b5e284 · outbound

This paper cites Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost Whole-Body Teleoperation

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.226573Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.226573Z digest=sha256:b92c77bac69cfbcadc4243210fcaad7e32bd606d9ad026be80e1665c62074010

Observation e5d37bd7-ce5f-46f2-8ba1-86b11e385b1e · outbound

This paper cites Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Universal Manipulation Interface: In-The-Wild Robot Teaching Without In-The-Wild Robots

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.230435Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.230435Z digest=sha256:9fac2027e91c5ca2414083ddf16b3f0fd0f11e6e05e15ba42a53e848642d5ef6

Observation b138039c-9eb5-488c-8219-895838ee4e65 · outbound

This paper cites UMI on Legs: Making Manipulation Policies Mobile with Manipulation-Centric Whole-body Controllers.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity UMI on Legs: Making Manipulation Policies Mobile with Manipulation-Centric Whole-body Controllers

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.234577Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.234577Z digest=sha256:4615a3569eb82b15ea1876b0504264f91f77c4e94027c7efe6007bc6e8899575

Observation a75adc0a-f84c-43c8-9e6e-5f75b92c767f · outbound

This paper cites Deep imitation learning for complex manipulation tasks from virtual reality teleoperation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Deep imitation learning for complex manipulation tasks from virtual reality teleoperation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.238561Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.238561Z digest=sha256:de5f5f863b4b0418e27b0743264116bbb1de340b00244106ab3a61b78c6e0432

Observation 145fa4dc-8c85-4a0a-832e-17ce1fbd4c55 · outbound

This paper cites RVT: Robotic View Transformer for 3D Object Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RVT: Robotic View Transformer for 3D Object Manipulation

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.242157Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.242157Z digest=sha256:1e669360088ecd23148f6db5fe4453da5f3c0f1bc9e29c5ab80b6557a4409f2b

Observation bbec9eee-3981-4412-a24b-cf3b68d90cba · outbound

This paper cites Perceiver-actor: A multi-task transformer for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Perceiver-actor: A multi-task transformer for robotic manipulation

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.246102Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.246102Z digest=sha256:2e8ebaa4c7c547757dc52fe14cd941b33077d4c7bb27101b6afc7864555c0f0b

Observation c25243e0-d505-47a0-96f0-3858a2fd1abf · outbound

This paper cites Cliport: What and where pathways for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Cliport: What and where pathways for robotic manipulation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.249581Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.249581Z digest=sha256:beb8f9f8141f0dce5b1f9d6c7ea27f0308110cf7e1dd641ebd285b5c389be631

Observation 79756a64-62fe-46ff-a0ac-55b1c0e1af75 · outbound

This paper cites Viola: Imitation learning for vision-based manipulation with object proposal priors.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Viola: Imitation learning for vision-based manipulation with object proposal priors

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.253314Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.253314Z digest=sha256:30d7e1fbf410e345b1389d756a88da3a902ee3f89e0ecc3a1f5db042a8e6b705

Observation 4a65485b-9fa8-43b3-a5db-3ea60e2f1ed4 · outbound

This paper cites What Matters in Learning from Offline Human Demonstrations for Robot Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity What Matters in Learning from Offline Human Demonstrations for Robot Manipulation

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.257092Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.257092Z digest=sha256:f7407cf7e064a1f3b8b767a627befcd8399553c130ab6e51eeae006ef2903cb0

Observation 784fb9e4-ba71-4327-b70c-3eb64a1950fb · outbound

This paper cites Self-supervised correspondence in visuomotor policy learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Self-supervised correspondence in visuomotor policy learning

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.519476Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.260971Z digest=sha256:a1c58be7f75648ed3c46002bbc8580bc031948253afd8d1983a7ed666247d05e

Observation fbeff72d-daa5-47f1-a64f-450006f8f354 · outbound

This paper cites A reduction of imitation learning and structured prediction to no-regret online learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity A reduction of imitation learning and structured prediction to no-regret online learning

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.264744Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.264744Z digest=sha256:f43ecda220ba61aa78cfc421ececcf8d516a862eb697e7698b32cb031abf1df1

Observation 9f40d64b-0fef-4aa6-ade7-18ca2abeb95c · outbound

This paper cites One-shot imitation learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity One-shot imitation learning

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.268331Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.268331Z digest=sha256:dd9e4185e4e9e20db73bf6b9d605c88aef243ecdb37bb4d1d885a5081792a7cf

Observation f9952f46-69cf-4728-a073-d2ca885d5d8a · outbound

This paper cites Waypoint-Based Imitation Learning for Robotic Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Waypoint-Based Imitation Learning for Robotic Manipulation

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.272000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.272000Z digest=sha256:e1b6e17bf7b5ac49802bc2c47f9b41c4072893bcfd54d3ba4f823d667a7fd194

Observation 82b29ceb-59db-488e-b269-b9bdab813e74 · outbound

This paper cites Keypoint Action Tokens Enable In-Context Imitation Learning in Robotics.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Keypoint Action Tokens Enable In-Context Imitation Learning in Robotics

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.275670Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.275670Z digest=sha256:575edaf631a08a78e189744a488e37b39285c020a6679086122fc7d25cf3e9b4

Observation 578522d0-5e6d-46aa-9586-26e2621fcf9c · outbound

This paper cites DINOBot: Robot Manipulation via Retrieval and Alignment with Vision Foundation Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity DINOBot: Robot Manipulation via Retrieval and Alignment with Vision Foundation Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.279351Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.279351Z digest=sha256:6f8cad49f44a215d95acb67a25d0f0526eaae0bc48c6d3ddfa90e7fb8ce3d4ff

Observation c9a813d2-cf0b-4411-8a48-c99210cda717 · outbound

This paper cites You Only Demonstrate Once: Category-Level Manipulation from Single Visual Demonstration.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity You Only Demonstrate Once: Category-Level Manipulation from Single Visual Demonstration

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.283130Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.283130Z digest=sha256:06b0443d96eced9aca4ab9b6f0f88d6107f6d856960f2b74f8463dffe097dcc6

Observation 4a31e81b-75a2-463b-bb82-fb7e92cdd1f6 · outbound

This paper cites Open X-Embodiment: Robotic Learning Datasets and RT-X Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Open X-Embodiment: Robotic Learning Datasets and RT-X Models

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.286787Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.286787Z digest=sha256:05c7dd50eeb3f47fbbce5f10ca285c3925894bd8932891c01201aaffa1c84224

Observation 8618c3fe-278d-4a48-a7c6-fdca4a0c46be · outbound

This paper cites RT-1: Robotics Transformer for Real-World Control at Scale.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RT-1: Robotics Transformer for Real-World Control at Scale

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.291048Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.291048Z digest=sha256:cc58edb369860a5daec6169640fec56a287c505f803cf25436a966afc3d45b69

Observation 3a612535-7c14-42e9-bd3c-f37e500750e3 · outbound

This paper cites RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.297109Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.297109Z digest=sha256:548a77453a84280026e0cba707586624b911f6483d8bf419ec26030a7217ddf7

Observation 585a0e66-7349-4d7a-8934-5b4b2add41c4 · outbound

This paper cites Implicit kinematic policies: Unifying joint and cartesian action spaces in end-to-end robot learning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Implicit kinematic policies: Unifying joint and cartesian action spaces in end-to-end robot learning

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.487081Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.301543Z digest=sha256:9f4fee6da0fac24b3cb4dac2abc8cd904a986064d439b531150649964d902644

Observation cdd83e2e-c73a-4ac7-b08c-b63e010823b0 · outbound

This paper cites Implicit behavioral cloning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Implicit behavioral cloning

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.473978Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.304966Z digest=sha256:7d35a559076a72e714d16515780cf6038076668a4f9fb778613c8489719c979f

Observation 673f9fc4-02f2-4237-a860-5da6445e18c5 · outbound

This paper cites Behavior transformers: Cloning k modes with one stone.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Behavior transformers: Cloning k modes with one stone

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.308422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.308422Z digest=sha256:f808f598bc40f3493dfbf25c8cd70a51ed440eb6510790808f988ed10a7555c6

Observation c2074787-67d6-4c56-8283-2d920ef4443e · outbound

This paper cites Implicit Generation and Generalization in Energy-Based Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Implicit Generation and Generalization in Energy-Based Models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.312004Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.312004Z digest=sha256:f194057ef03cc483b2ab14112c5ff6f16e84b59948ec47903ce538b42ab4b566

Observation e1971e17-78fb-4348-b7ec-bf063c3daa72 · outbound

This paper cites Bayesian learning via stochastic gradient langevin dynamics.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Bayesian learning via stochastic gradient langevin dynamics

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.454842Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.315570Z digest=sha256:597c3d50ed44ea971e102939e92467c877da863167a81a1f31eedf1beaab61b1

Observation 8f7be0b2-74f9-4962-a1b0-f33c99f4ebae · outbound

This paper cites Concept Learning with Energy-Based Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Concept Learning with Energy-Based Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.319248Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.319248Z digest=sha256:6ebd4d15bb8c934552a5aa8a70b6332617f44295f14be7fa50e889b77990bb44

Observation b9a4e1cc-b653-4cea-933e-243a8ab3f22c · outbound

This paper cites Octo: An open-source generalist robot policy.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Octo: An open-source generalist robot policy

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.323195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.323195Z digest=sha256:b7e137879fbe1fc520676066441e19576ffdd1438c946dab0db88d7aa14ac62d

Observation 50648a6d-70f2-4970-9ae8-287daa81b7f3 · outbound

This paper cites Imitating Human Behaviour with Diffusion Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Imitating Human Behaviour with Diffusion Models

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.327103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.327103Z digest=sha256:6cacfe94ef701b0b17613097f5cdd1eb4e84c0141669b3ed8300a17da1672cdf

Observation 1f4413ff-5573-4452-ae2e-bab025303a88 · outbound

This paper cites 3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity 3D Diffusion Policy: Generalizable Visuomotor Policy Learning via Simple 3D Representations

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.330737Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.330737Z digest=sha256:fa823f2acb5ba96ed69fb744b6c2a22f885ab531d252075d61cf68f6a25f2752

Observation 6d567547-08e5-45ba-bee9-2916c578d151 · outbound

This paper cites Robot See Robot Do: Imitating Articulated Object Manipulation with Monocular 4D Reconstruction.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Robot See Robot Do: Imitating Articulated Object Manipulation with Monocular 4D Reconstruction

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.334464Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.334464Z digest=sha256:1ebc27a4806a8fefdde376333718fbc4fa9c848e474dae47d9bfa1418205a073

Observation d13b0645-62f4-430c-bef1-8a1a501dfbc3 · outbound

This paper cites Learning transferable visual models from natural language supervision.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning transferable visual models from natural language supervision

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.338380Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.338380Z digest=sha256:d69f57a3df2496e095929ae1a4133fb290530aa1c8f47e692e6049e99bd52b64

Observation 4e1fd544-fd88-41e6-8fbc-3e6e6e9d8eed · outbound

This paper cites Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.341991Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.341991Z digest=sha256:3e8c9f5e1b04296a149ac2d0c8f6c7c9072c5eac7632489c65e17388db90c08a

Observation 010139b0-0dbf-4c32-9136-ed7489932cce · outbound

This paper cites Yolo-world: Real-time open-vocabulary object detection.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Yolo-world: Real-time open-vocabulary object detection

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.427001Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.345837Z digest=sha256:1b7a542b8a3def44e31e154586340c5b5598ce9c129b178a92304709c52db391

Observation 132c6054-39ff-4134-b3f3-daa19be71d81 · outbound

This paper cites D ^3 fields: Dynamic 3d descriptor fields for zero-shot generalizable rearrangement.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity D ^3 fields: Dynamic 3d descriptor fields for zero-shot generalizable rearrangement

Reference 40

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.412705Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.349428Z digest=sha256:97fdddf531e9c3a1f7a2587005cf7c38cdb36c30df32a30fc68f1de5ced2b30c

Observation 9996f7dc-5d1c-44f7-a744-59989e0e9f64 · outbound

This paper cites Gendp: 3d semantic fields for category-level generalizable diffusion policy.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Gendp: 3d semantic fields for category-level generalizable diffusion policy

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.401488Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.353054Z digest=sha256:1d5a7c57a90e29034fde59b4af9044a72fc861c5a6f5924ea772bafbf1af5b78

Observation a5430822-d880-4bbd-a686-85f0948f1319 · outbound

This paper cites Rekep: Spatio-temporal reasoning of relational keypoint constraints for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Rekep: Spatio-temporal reasoning of relational keypoint constraints for robotic manipulation

Reference 42

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.387793Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.359017Z digest=sha256:e13eae70450aff0ad186d3630d4834caca4a9539a7cf510b239ca8d859dde949

Observation f4be8e95-4ad5-41dd-8c8e-70d93ec7e120 · outbound

This paper cites Voxposer: Composable 3d value maps for robotic manipulation with language models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Voxposer: Composable 3d value maps for robotic manipulation with language models

Reference 43

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.374198Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.362913Z digest=sha256:10ef254e0f6b4459fe207208c6c9daf71ff48c3bc0381bf04c3416b7326233bd

Observation 486ad45d-113d-4d61-b751-e05707765b4e · outbound

This paper cites Learning Generalizable Feature Fields for Mobile Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning Generalizable Feature Fields for Mobile Manipulation

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.367062Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.367062Z digest=sha256:afd33cc4b3fcef1384eaec0ebfdfbf95cccd302edcfa943180b3f3efb09fa56d

Observation 88bd7269-f4b1-4204-bd3d-66dbaf84905c · outbound

This paper cites Gnfactor: Multi-task real robot learning with generalizable neural feature fields.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Gnfactor: Multi-task real robot learning with generalizable neural feature fields

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.362229Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.372402Z digest=sha256:f39bfb0d3272639431ea7354ab8a010f46a89e63435392b9dd978d837f458a69

Observation 55411eef-afd7-4672-b0e6-8a9b16ea69c5 · outbound

This paper cites 3D Diffuser Actor: Policy Diffusion with 3D Scene Representations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity 3D Diffuser Actor: Policy Diffusion with 3D Scene Representations

Reference 46

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.376536Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.376536Z digest=sha256:bf593f4702ec9e1989bf296a3621878d9ad7623b6cb8326592a56edadc035ada

Observation fc467cd9-c688-4562-ab87-33e2c3f7b92c · outbound

This paper cites Learning generalizable manipulation policies with object-centric 3d representations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Learning generalizable manipulation policies with object-centric 3d representations

Reference 47

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.350313Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.380682Z digest=sha256:22f6422b869ba6b9ca28d6553ffdc3b75a56ada92f7ffdfa3eded6882eaa9f6e

Observation 0bc578a0-eef2-45a7-9029-9ce787aaeb71 · outbound

This paper cites Spawnnet: Learning generalizable visuomotor skills from pre-trained network.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Spawnnet: Learning generalizable visuomotor skills from pre-trained network

Reference 48

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.337858Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.384108Z digest=sha256:d93486064bb59915df706a125127e34b357f1fc532715e4a1dde18ca93836457

Observation c70d293b-882f-43cc-8d12-1127eaaf97b3 · outbound

This paper cites Conceptgraphs: Open-vocabulary 3d scene graphs for perception and planning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Conceptgraphs: Open-vocabulary 3d scene graphs for perception and planning

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.326773Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.387795Z digest=sha256:455aeafe6cf06e935120142bf27ad83e7e48632f38265553c42e13d18fc9a678

Observation c4b9a32a-cdc9-43a1-96c5-abeabe0a525e · outbound

This paper cites ConceptFusion: Open-set Multimodal 3D Mapping.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity ConceptFusion: Open-set Multimodal 3D Mapping

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.391669Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.391669Z digest=sha256:ae795a953b75351194ffc0840130d2fdd4d216f51c6a031a59b7dbd10adaf1c8

Observation a55cf813-155b-4d91-8bf0-8d971cafe31f · outbound

This paper cites RoboEXP: Action-Conditioned Scene Graph via Interactive Exploration for Robotic Manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RoboEXP: Action-Conditioned Scene Graph via Interactive Exploration for Robotic Manipulation

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.396354Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.396354Z digest=sha256:5b52bb11685057a28d56c2a497a8d17112e5fb1328fb110949cb5c7e8e9df43e

Observation d81e393b-af03-4e69-b311-c9a3c1f8d11c · outbound

This paper cites Hydra: A Real-time Spatial Perception System for 3D Scene Graph Construction and Optimization.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Hydra: A Real-time Spatial Perception System for 3D Scene Graph Construction and Optimization

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.400053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.400053Z digest=sha256:4ab2b0c4d96ab2338bb47e6cff1c91fd4547e5eb06621f26331276894377232d

Observation c8b28dd2-643e-4b4d-9d30-86eed571a1e5 · outbound

This paper cites Clio: Real-time Task-Driven Open-Set 3D Scene Graphs.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Clio: Real-time Task-Driven Open-Set 3D Scene Graphs

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.403829Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.403829Z digest=sha256:e74c13d3a1839ba371fdec9a27c3eaa6575f933b5394c8c4a88578e718295f09

Observation c172c5ff-f485-44c5-92c5-de2d8f908afe · outbound

This paper cites Foundations of spatial perception for robotics: Hierarchical representations and real-time systems.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Foundations of spatial perception for robotics: Hierarchical representations and real-time systems

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.313233Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.407490Z digest=sha256:d7a5808ee4762fdd99ad0b1db64ec35297f886147e023d5b7214be77d71b241e

Observation 6c51ed22-fd45-426c-8ac6-e1332ba56bbf · outbound

This paper cites Indoor and outdoor 3d scene graph generation via language-enabled spatial ontologies.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Indoor and outdoor 3d scene graph generation via language-enabled spatial ontologies

Reference 55

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.300333Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.410959Z digest=sha256:5c5f3d179b966da753495d2acbbe13fec95f58a3e28509f38a0cda411258a6ec

Observation fabc9d5f-26e2-4f39-bd0e-84c085db95d8 · outbound

This paper cites Openscene: 3d scene understanding with open vocabularies.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Openscene: 3d scene understanding with open vocabularies

Reference 56

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.285912Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.414587Z digest=sha256:808af0b6352d5d9a55421ca6a769bdb0ecf730604aae25eb9ed2c2fff9410b8e

Observation 9b5287fc-1e5d-4162-8f29-b42d8919d11f · outbound

This paper cites Semantic Abstraction: Open-World 3D Scene Understanding from 2D Vision-Language Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Semantic Abstraction: Open-World 3D Scene Understanding from 2D Vision-Language Models

Reference 57

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.418195Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.418195Z digest=sha256:55ad9481fb8d1caf2bba2ac21b2e646d4edc08c184a2e50d60ca88801c3d3ce5

Observation d5f468e9-237a-4b1c-a352-cd96fc9b2125 · outbound

This paper cites Vlfm: Vision-language frontier maps for zero-shot semantic navigation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Vlfm: Vision-language frontier maps for zero-shot semantic navigation

Reference 58

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.273118Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.423331Z digest=sha256:793236ca28ed68e6980ce8da188c2e777eb9bc56aa078b9d7179e639f0d26bb8

Observation 85912ad5-1464-4e79-b8ad-92000a40dda7 · outbound

This paper cites Think, act, and ask: Open-world interactive personalized robot navigation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Think, act, and ask: Open-world interactive personalized robot navigation

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.259987Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.426998Z digest=sha256:fa3144ed3f6e4eec60cee68c35213a673e0e5d83ae0b5e23bc00306c8031ce71

Observation aadd2e24-2924-414f-ba41-609273a7651c · outbound

This paper cites PaLM-E: An Embodied Multimodal Language Model.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity PaLM-E: An Embodied Multimodal Language Model

Reference 60

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.430757Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.430757Z digest=sha256:4ce0e8064d510f2cc00aea71d3ea9361c3ea9fc95f9193624744c0af96372d57

Observation 13826af0-49ea-43da-b221-284040f2e783 · outbound

This paper cites Do As I Can, Not As I Say: Grounding Language in Robotic Affordances.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Do As I Can, Not As I Say: Grounding Language in Robotic Affordances

Reference 61

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.435022Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.435022Z digest=sha256:e61a45313e6f2a446926849000471a422a1b0be6375bd42f3d63ee63cae7b7c8

Observation a45f555c-97c2-4904-9484-ae580bc5879a · outbound

This paper cites Inner Monologue: Embodied Reasoning through Planning with Language Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Inner Monologue: Embodied Reasoning through Planning with Language Models

Reference 62

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.439082Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.439082Z digest=sha256:0bdbccdae7fa4372bb3ce433c80524290002d4388e9d518d66fec53789ccb079

Observation 591fbb9d-e488-4597-9300-cee0b863d7a3 · outbound

This paper cites Code as policies: Language model programs for embodied control.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Code as policies: Language model programs for embodied control

Reference 63

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.247465Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.443613Z digest=sha256:80b6f68c39f8ee5703095ffb13f888a6f2948308349f2bb7de91d498e98cb1f5

Observation f0696741-4eab-491e-a83f-7cdcf78ff913 · outbound

This paper cites CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models

Reference 64

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.447369Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.447369Z digest=sha256:ae9bb56e1d85ea5775b0ebf900c4220b7dfa333682caef47638aba45d4873e3d

Observation 0995f4d2-9675-4051-aa11-6111ba485dad · outbound

This paper cites MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting

Reference 65

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.451421Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.451421Z digest=sha256:72eaa796995f69d89b6462e647e58f1d3add7c5c03ba3a3bb9b075b98ae05b28

Observation 1fbc5949-a91c-4f0a-a408-94bd1d2310af · outbound

This paper cites PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.455936Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.455936Z digest=sha256:2082ecc5435475b21cfdc64ab9d262d2894860c58b99b6c8b5494e32890ffeab

Observation 9494fa01-a4c7-439d-8b76-b57fd5ac166c · outbound

This paper cites Video Language Planning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Video Language Planning

Reference 67

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.459886Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.459886Z digest=sha256:de1cfd5f443f2325d7baab93d81f1dbadb024c1f5cfe7c900b73d5ce0016a0c5

Observation d7f5f31f-f41e-457d-a1e2-95edc1d85095 · outbound

This paper cites 3d-llm: Injecting the 3d world into large language models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity 3d-llm: Injecting the 3d world into large language models

Reference 68

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.463735Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.463735Z digest=sha256:794d4cfdb218c867aafcc71eda418dc25ad4995990b646f07e4bf05247b96ab4

Observation ebc3fe20-064a-4fd5-ad51-6508223f3cc3 · outbound

This paper cites Spatialvlm: Endowing vision-language models with spatial reasoning capabilities.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Spatialvlm: Endowing vision-language models with spatial reasoning capabilities

Reference 69

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.227604Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.467573Z digest=sha256:99dcae3ac39e1ae3b66168007b8df0b57b65ff0b466b6d96816843d3b787714b

Observation 1ec8c763-d88c-49c3-ad93-e8cc1ab5ef85 · outbound

This paper cites Physically grounded vision-language models for robotic manipulation.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Physically grounded vision-language models for robotic manipulation

Reference 70

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.471192Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.471192Z digest=sha256:430d356c5acd4581e0ea35258ff11435461a41e455d8283c7f182b881599c109

Observation 533b6b6b-7740-4be6-8af3-e17659778502 · outbound

This paper cites Grounding Language Plans in Demonstrations Through Counterfactual Perturbations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Grounding Language Plans in Demonstrations Through Counterfactual Perturbations

Reference 71

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.474810Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.474810Z digest=sha256:d45e761ba4db01f65f33984ba06979e4546dce46ff54bfb3d8d90694439099d2

Observation b5124766-87cc-4ace-a094-186f4d0c488f · outbound

This paper cites Ns3d: Neuro-symbolic grounding of 3d objects and relations.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Ns3d: Neuro-symbolic grounding of 3d objects and relations

Reference 72

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.206367Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.480126Z digest=sha256:4cc184b6ab24e3902aa08aff295881d2ebc42ae4eaa7795eed0575b839d26eee

Observation 8b70650d-21a9-4356-b201-9eabd71f85ef · outbound

This paper cites RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.483663Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.483663Z digest=sha256:a952b90b50a32d29862a59fd50c123538ac6695a9a42189ac80b8cd07980438d

Observation 740a81f1-f0aa-4e87-94c5-4884104d18fe · outbound

This paper cites Manipulate-Anything: Automating Real-World Robots using Vision-Language Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Manipulate-Anything: Automating Real-World Robots using Vision-Language Models

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.488191Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.488191Z digest=sha256:646b9c1f18f484cb12d59ab9f1b41f04497c01d8ba9116eb07b55b924366cf27

Observation 5dbc5a12-f24c-4ba0-a699-c9bbb0bad00d · outbound

This paper cites $A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity $A^2$Nav: Action-Aware Zero-Shot Robot Navigation by Exploiting Vision-and-Language Ability of Foundation Models

Reference 75

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.491759Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.491759Z digest=sha256:5db11cbda0f9a5f77a02e17e79c2f7d97a068c4e1c5502a13d5c3d42c285aa67

Observation 32db721c-4f82-4672-b1c5-927c1f8ecbeb · outbound

This paper cites Llm-grounder: Open-vocabulary 3d visual grounding with large language model as an agent.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Llm-grounder: Open-vocabulary 3d visual grounding with large language model as an agent

Reference 76

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.192282Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.495512Z digest=sha256:60373b24070dec23bdb47dee55f1a6e6a72f5782dcfb95b325919a59df5b1add

Observation 9bb5baee-1c90-40cb-a8b1-1d54842f4d9a · outbound

This paper cites Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning

Reference 77

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.499260Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.499260Z digest=sha256:372c36e1bf261472d44318b32fcd6ac6bc1c857c554cb962c299b0b52d364344

Observation 483c479d-cb11-4a89-ba0f-e4a6df52d74a · outbound

This paper cites Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis

Reference 78

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.503023Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.503023Z digest=sha256:dd38809ab9f28750c9828b1e5a414648bc3b6c32047099788f816cd6c79332f5

Observation 23610d46-b944-49a9-a85e-fd36ad04c3cf · outbound

This paper cites Foundation Models in Robotics: Applications, Challenges, and the Future.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Foundation Models in Robotics: Applications, Challenges, and the Future

Reference 79

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.506730Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.506730Z digest=sha256:f33ab05663c21d21a5b00eb3ea238a543c312826f18ce1803f33dff6478c25d9

Observation 747da506-f6f2-497e-ac99-89b3349dccf6 · outbound

This paper cites Real-World Robot Applications of Foundation Models: A Review.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Real-World Robot Applications of Foundation Models: A Review

Reference 80

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.510563Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.510563Z digest=sha256:68843dabf15c21d4d9b6d966990fdeb644d7c36ba4e698ee3487447b949b070c

Observation 1e2fd249-82d2-4c6e-a7a6-d67362258b5c · outbound

This paper cites Foundation Models for Decision Making: Problems, Methods, and Opportunities.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Foundation Models for Decision Making: Problems, Methods, and Opportunities

Reference 81

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.514395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.514395Z digest=sha256:e79af8ae836eeb355c9841085c599a5f64ede8d1d28e63672023dca91b9e8691

Observation f0783110-170b-41cd-aed2-aed4cdcab0d6 · outbound

This paper cites GPT-4 Technical Report.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity GPT-4 Technical Report

Reference 82

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.518349Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.518349Z digest=sha256:fca4dbcb43cc0ba636caa3971d4790fcc14103cf2b71623504cb06ca53cca0d5

Observation 3832a70c-82b5-41c1-be6b-f5543063a77e · outbound

This paper cites Denoising Diffusion Probabilistic Models.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Denoising Diffusion Probabilistic Models

Reference 83

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.522136Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.522136Z digest=sha256:aba04a7cc02b9218e1b6c44be9552ec76ae89a3f500b484c248dae8f2ca35a9a

Observation 3b935b77-b136-48b7-9e2b-80e3b2f221eb · outbound

This paper cites Pointnet++: Deep hierarchical feature learning on point sets in a metric space.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Pointnet++: Deep hierarchical feature learning on point sets in a metric space

Reference 84

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.526116Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.526116Z digest=sha256:19bc11aefabc082a37252e01257403fbde9931fb0fdfb2d6a3356390bad62bdf

Observation 18ffc225-9d97-4aef-8a5a-33b79bb188ad · outbound

This paper cites Chang, Leonidas J.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Chang, Leonidas J

Reference 85

Resolution
verified fuzzy
raw_fallback, observed 2026-08-15T19:31:54.169457Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.529963Z digest=sha256:c2629e5eab2a8e86f59a43daa2d507a1920198482b5bfbfe57a8e2752ed4cd0d

Observation b44c7d90-f246-4bf9-b50e-530b63adaa25 · outbound

This paper cites @esa (Ref.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity @esa (Ref

Reference 86

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.533783Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.533783Z digest=sha256:a5bc6b13fed97566bc66d46eba4a6383d68a7eddede9ad45b6583245959338b1

Observation 25cb418a-a1c9-4d90-9ced-51deee8426f0 · outbound

This paper cites an unresolved cited work.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Unresolved cited work

Reference 87

Resolution
unresolved
no resolver link, observed 2026-08-15T19:31:53.538090Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T19:31:53.538090Z digest=sha256:7689014e6cf73a4e138ac0b3d6b53d5d7126e92559ea48f2d6bb92365afd8f8b

Observation bc6c5f96-8852-482d-92cf-f024ea5ae2c5 · outbound

This paper cites an unresolved cited work.

CodeDiffuser: Attention-Enhanced Diffusion Policy via VLM-Generated Code for Instruction Ambiguity Unresolved cited work

Reference 88

Resolution
unresolved
raw_fallback, observed 2026-08-15T19:31:54.138783Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-08-15T19:31:53.542353Z digest=sha256:ce958e9f47210f750b72f8caece33a0784c91ee80faa7beb7a9e7ff6c6d59b70

Pith citing papers

No inbound Pith citation observations are available.