Pith. sign in

Paper Citation Record · LEDGER

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning

As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2603.22169.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2603.22169 v3

Coverage vector

measured 28 of 28 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T17:38:54.753977Z

measured 28 of 28 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

28 of 28 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved28
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 22064f55-da37-4dfb-bf4e-b5df7aeae9a1 · outbound

This paper cites Decision-making for path planning of mobile robots under uncertainty: A review of belief-space planning simplifications,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Decision-making for path planning of mobile robots under uncertainty: A review of belief-space planning simplifications,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.480567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.480567Z digest=sha256:57acc9de65c90b04745c061d0261112719b61b81431218a6c931dec1609fb75e

Observation ae7ebeb0-2345-496a-aaa3-2517e295214e · outbound

This paper cites Thrun, W.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Thrun, W

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.540142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.540142Z digest=sha256:91ba1a9e8716eede5aea7dfcae2016182c686c7881f9499a580aa055b5ab9fd6

Observation c6c869d9-5837-493c-841c-193185f89095 · outbound

This paper cites Behavior tree learning for robotic task planning through monte carlo dag search over a formal grammar,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Behavior tree learning for robotic task planning through monte carlo dag search over a formal grammar,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.627347Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.627347Z digest=sha256:5f13795631f4a697d6e2a73a9675a87e1c50b0df8a90cae8da4327343429553b

Observation bae623c0-18f4-4c72-a1af-b88c6e25f18e · outbound

This paper cites How behavior trees modularize hybrid control systems and generalize sequential behavior composi- tions, the subsumption architecture, and decision trees,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning How behavior trees modularize hybrid control systems and generalize sequential behavior composi- tions, the subsumption architecture, and decision trees,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.781487Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.781487Z digest=sha256:c4117e1ae15cffcc87eef31c6e5e778fc2ba92ae52f089239c451dea4d595741

Observation 76fae97e-3784-441a-a074-0ea8cbb3a215 · outbound

This paper cites Concrete Problems in AI Safety.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Concrete Problems in AI Safety

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.873959Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.873959Z digest=sha256:046fcf03d713e294f764b76ca3e7c3b2d18673d9d2e96ea51ea2699b7392fda2

Observation 2f3546da-e940-413c-b04d-b45ac724c256 · outbound

This paper cites Do as i can, not as i say: Grounding language in robotic affordances,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Do as i can, not as i say: Grounding language in robotic affordances,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.984696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.984696Z digest=sha256:4cbe11a60e54c13171752e0d51f844e5facc3855d1a6d449ff5acdb232c4677f

Observation 87884c65-42de-4358-b5f6-bb703a694fb5 · outbound

This paper cites Code as policies: Language model programs for embodied control,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Code as policies: Language model programs for embodied control,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.084632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.084632Z digest=sha256:00d666f86f7382f7b690731a8e874b641d2ea08c0a17184b26f9acd3e8445a68

Observation d62cef11-e063-4c8f-a821-f731c754536f · outbound

This paper cites Progprompt: Program generation for situated robot task planning using large language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Progprompt: Program generation for situated robot task planning using large language models,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.215590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.215590Z digest=sha256:3766cb9a0b86a0fc875fce064ad5c5eb37cadf04064b68403f8ad36231603fb0

Observation cddf9f48-f871-47af-af54-09467415c251 · outbound

This paper cites Autogpt+p: Affordance- based task planning using large language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Autogpt+p: Affordance- based task planning using large language models,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.318876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.318876Z digest=sha256:bf4b923ba3fc89851e38a9873cd1b6868acff8b18e37e906410f77120eeed75f

Observation 8f191494-6d23-4f26-b741-95ca3ad78d35 · outbound

This paper cites Re- flexion: Language agents with verbal reinforcement learning,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Re- flexion: Language agents with verbal reinforcement learning,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.465727Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.465727Z digest=sha256:cfa5df2cd94b605c7716030d6e992ef51a8f2a589d789be96af2ef120d80828e

Observation 5a74e1a0-0ac6-4af9-ac51-ff36a4d55b48 · outbound

This paper cites Re- act: Synergizing reasoning and acting in language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Re- act: Synergizing reasoning and acting in language models,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.652045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.652045Z digest=sha256:45b7fa44d062186f47edd9572b98c8666966ae5f719a4a3a1ea5251bd037dfec

Observation c90c5922-19bf-4b48-b3cb-ebf87c71ef85 · outbound

This paper cites Self- refine: Iterative refinement with self-feedback,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Self- refine: Iterative refinement with self-feedback,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.803876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.803876Z digest=sha256:b21a62db73261e8b0e5207eb561156dfbf373bed150f04ea820519bcc31394c3

Observation 53e036ec-236b-4cb4-be76-37202d55d2a3 · outbound

This paper cites V oxposer: Composable 3d value maps for robotic manipulation with language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning V oxposer: Composable 3d value maps for robotic manipulation with language models,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.954541Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.954541Z digest=sha256:5b9a31193612a5e174a8b0683d1afc5c36a799f58a6d5f6779660f0e9bad43c4

Observation 0e176769-4000-40f5-bab7-ad023cc687fb · outbound

This paper cites Task and motion planning with large language models for object rearrangement,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Task and motion planning with large language models for object rearrangement,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.292942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.292942Z digest=sha256:168eef4303422c3628d46791c7441dcbe9da535746b13fb304c6c41cd1c7ea2d

Observation fecd361f-27ff-493d-9983-9e69179e7132 · outbound

This paper cites Innermonologue: Embodied reasoning through planning with language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Innermonologue: Embodied reasoning through planning with language models,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.418970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.418970Z digest=sha256:8e536c5cda78db9a4510f36887cba480a3334d23678cde57c845f777717f5190

Observation 674a73d1-26a7-44ad-8a9c-adf22115356f · outbound

This paper cites LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.509364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.509364Z digest=sha256:38f7e642b57255b690f8d734be205ecbcf835646e5e301a3e295f753445251ba

Observation 4adde68f-9a5f-44c0-81e6-ff92acf4ccdb · outbound

This paper cites Vision- language model-driven scene understanding and robotic object ma- nipulation,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Vision- language model-driven scene understanding and robotic object ma- nipulation,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.595677Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.595677Z digest=sha256:9cf8089d167bc4a012c8a2aae3a8d7d51c61112b66986a91616555249884fdd8

Observation 717918bc-d5b3-4e5d-b85c-1c847c0a2a7d · outbound

This paper cites Large language models for robotics: Opportunities, challenges, and perspectives,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Large language models for robotics: Opportunities, challenges, and perspectives,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.689702Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.689702Z digest=sha256:29ecba654b904dc5b5a56ed37da28a366f3b7c1ee2a44ea19d67624d71e1a80b

Observation a8be06c4-4434-4366-aac7-d61805e228ca · outbound

This paper cites V oyager: An open-ended embodied agent with large language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning V oyager: An open-ended embodied agent with large language models,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.851479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.851479Z digest=sha256:a549ff9a1fcb2ca357491a4921339b3a6c1b793e047d22025de89e78011aa550

Observation b0cf793c-66fd-4cce-9578-4581a0852110 · outbound

This paper cites Btgenbot: Behavior tree generation for robotic tasks with lightweight llms,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Btgenbot: Behavior tree generation for robotic tasks with lightweight llms,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.973568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.973568Z digest=sha256:75f3c9488097b611a109020e1f04554506afb1f7723c4ebb891b96594833a090

Observation b43cff01-cf46-4a61-9c1f-f1fb67a7dc02 · outbound

This paper cites Rl-vlm-f: Reinforcement learning from vision language foundation model feedback,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Rl-vlm-f: Reinforcement learning from vision language foundation model feedback,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.040308Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.040308Z digest=sha256:4f1b0d6753b831f1797f3e63293d3118925c84f934ae162eeffeda36e0de2bdc

Observation 51b2b0f3-54a2-4c8b-8747-bb9674d28107 · outbound

This paper cites Vision-language models are zero-shot reward models for reinforce- ment learning,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Vision-language models are zero-shot reward models for reinforce- ment learning,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.173831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.173831Z digest=sha256:c1141aea8873ceff085ea5a353e80d85d0eedc2d5c945a3e7582938b3a9b807d

Observation 60273c1d-e5fe-4cd5-90c7-dc3873a1f7d9 · outbound

This paper cites VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.349411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.349411Z digest=sha256:4dfcdb3105dc9cc62b2b9ae71f8bf7b917750422748cd252e1d0ca8a0491de18

Observation 1c4fc951-6528-456b-b62c-966afab3af4e · outbound

This paper cites CLIP-Motion: Learning Reward Functions for Robotic Actions Using Consecutive Observations.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning CLIP-Motion: Learning Reward Functions for Robotic Actions Using Consecutive Observations

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.447335Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.447335Z digest=sha256:00dfd4db25e938691eb8cce2654f3046d3ba6f6f3c69af8af6aa49d4337a55af

Observation a790c2ab-6a9a-4dea-9276-d6555e0c6a50 · outbound

This paper cites Learning reward for robot skills using large language models via self-alignment,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Learning reward for robot skills using large language models via self-alignment,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.490264Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.490264Z digest=sha256:64bf02e3afb565e6eb055f1c92977a4d3a7ebf8d31e67b16f172767bee12acf6

Observation 5e235c21-8cf5-4c69-a884-1a31b31c5459 · outbound

This paper cites Affordance- guided reinforcement learning via visual prompting,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Affordance- guided reinforcement learning via visual prompting,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.567141Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.567141Z digest=sha256:948d85f61f4f00fb476c6c62bc988ff3c09ff7801ef5b6090b4600220d50e45d

Observation 9f9000af-2192-4bf3-bbac-fefcba824700 · outbound

This paper cites Task success is not enough: Investigating the use of video-language models as behavior critics for catching undesirable agent behaviors,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Task success is not enough: Investigating the use of video-language models as behavior critics for catching undesirable agent behaviors,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.753977Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.753977Z digest=sha256:d00c689b89a36c0925be692a40f720cb66d1adcb3482c6b8212dee89c5d4e575

Observation aa493509-df04-4f3a-99c4-b62263604590 · outbound

This paper cites VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.176975Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.176975Z digest=sha256:3af72bd6bc4b96e1c21e64f5528f2edf4657017e7c561d383d1fe8ff4a305f7f

Pith citing papers

No inbound Pith citation observations are available.