Pith. sign in

Paper Citation Record · LEDGER

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning

As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2603.22169.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2603.22169 v3

Coverage vector

measured 28 of 28 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-02T17:38:54.753977Z

measured 28 of 28 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-14T06:32:32.682623+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

28 of 28 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved28
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 22064f55-da37-4dfb-bf4e-b5df7aeae9a1 · outbound

This paper cites Decision-making for path planning of mobile robots under uncertainty: A review of belief-space planning simplifications,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Decision-making for path planning of mobile robots under uncertainty: A review of belief-space planning simplifications,

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.480567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.480567Z digest=sha256:23032c643df64f25cdcd5fd1f2a7c2386ed39d9c50464b2fc7240360a70d1c90

Observation ae7ebeb0-2345-496a-aaa3-2517e295214e · outbound

This paper cites Thrun, W.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Thrun, W

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.540142Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.540142Z digest=sha256:4671abecc2212a50f99822307454ca35b00a116036eabb83d1ffbd3f3185b3ee

Observation c6c869d9-5837-493c-841c-193185f89095 · outbound

This paper cites Behavior tree learning for robotic task planning through monte carlo dag search over a formal grammar,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Behavior tree learning for robotic task planning through monte carlo dag search over a formal grammar,

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.627347Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.627347Z digest=sha256:596e7c028cc9a44ae7f3dfd8176e2e3cdd2309fc1d9520718070c4fae844e470

Observation bae623c0-18f4-4c72-a1af-b88c6e25f18e · outbound

This paper cites How behavior trees modularize hybrid control systems and generalize sequential behavior composi- tions, the subsumption architecture, and decision trees,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning How behavior trees modularize hybrid control systems and generalize sequential behavior composi- tions, the subsumption architecture, and decision trees,

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.781487Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.781487Z digest=sha256:73b4ce610c8976eab7f80ae69a0e9043a477a0a8e25e022144f69c594d452a1d

Observation 76fae97e-3784-441a-a074-0ea8cbb3a215 · outbound

This paper cites Concrete Problems in AI Safety.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Concrete Problems in AI Safety

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.873959Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.873959Z digest=sha256:5b7aa6705d7cd8ec0e5b3c1ef198403b6b2318cd5bb13a74fa71ee49fcd4c64c

Observation 2f3546da-e940-413c-b04d-b45ac724c256 · outbound

This paper cites Do as i can, not as i say: Grounding language in robotic affordances,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Do as i can, not as i say: Grounding language in robotic affordances,

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:51.984696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:51.984696Z digest=sha256:16a7fd427a30216fd18a19b576e45347fb200c8ad53d64d1e31578df39955057

Observation 87884c65-42de-4358-b5f6-bb703a694fb5 · outbound

This paper cites Code as policies: Language model programs for embodied control,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Code as policies: Language model programs for embodied control,

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.084632Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.084632Z digest=sha256:0ec708c2c5932eb6e523a38a3149ba0b168daabe7a77f63d53d78a482c343490

Observation d62cef11-e063-4c8f-a821-f731c754536f · outbound

This paper cites Progprompt: Program generation for situated robot task planning using large language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Progprompt: Program generation for situated robot task planning using large language models,

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.215590Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.215590Z digest=sha256:4908ff3d33a82ff2cf28c9a726c33be1afebf79a7e75a90641addf713c1554d0

Observation cddf9f48-f871-47af-af54-09467415c251 · outbound

This paper cites Autogpt+p: Affordance- based task planning using large language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Autogpt+p: Affordance- based task planning using large language models,

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.318876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.318876Z digest=sha256:5fcd381ca7cce0903b84c16826b470ab01677c089df57bd07c9d6c9b950bf9e1

Observation 8f191494-6d23-4f26-b741-95ca3ad78d35 · outbound

This paper cites Re- flexion: Language agents with verbal reinforcement learning,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Re- flexion: Language agents with verbal reinforcement learning,

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.465727Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.465727Z digest=sha256:8288f7df6130d9056c5a83879457dc7267a775c449d9bdf60163d212fe1337cd

Observation 5a74e1a0-0ac6-4af9-ac51-ff36a4d55b48 · outbound

This paper cites Re- act: Synergizing reasoning and acting in language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Re- act: Synergizing reasoning and acting in language models,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.652045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.652045Z digest=sha256:9f0b0943461573135a66c693c6ac6d424a2d6ec4db25e421fa2a4b8a2948bfb3

Observation c90c5922-19bf-4b48-b3cb-ebf87c71ef85 · outbound

This paper cites Self- refine: Iterative refinement with self-feedback,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Self- refine: Iterative refinement with self-feedback,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.803876Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.803876Z digest=sha256:0ee99077e853a4834e18f7d384aa597834e54993f4f3a73b53f70412573f518a

Observation 53e036ec-236b-4cb4-be76-37202d55d2a3 · outbound

This paper cites V oxposer: Composable 3d value maps for robotic manipulation with language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning V oxposer: Composable 3d value maps for robotic manipulation with language models,

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:52.954541Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:52.954541Z digest=sha256:6aedb286180ebe23d29890f4edd1fbd27e1d1e2fd8360c43e2fd408880d95e52

Observation 0e176769-4000-40f5-bab7-ad023cc687fb · outbound

This paper cites Task and motion planning with large language models for object rearrangement,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Task and motion planning with large language models for object rearrangement,

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.292942Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.292942Z digest=sha256:615fac287fd325ac636f0411c89b9186c3efc53f57e787fdbb1b09ecb40f0210

Observation fecd361f-27ff-493d-9983-9e69179e7132 · outbound

This paper cites Innermonologue: Embodied reasoning through planning with language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Innermonologue: Embodied reasoning through planning with language models,

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.418970Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.418970Z digest=sha256:2c7eb90075dd39cdc6f618cd7cb7ce065c4eaec761818b8a1428dbe979e2accc

Observation 674a73d1-26a7-44ad-8a9c-adf22115356f · outbound

This paper cites LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.509364Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.509364Z digest=sha256:12a3c5430444c4c47e4d5469439c8ec23bcf1cb99c1d700a9cb74481f8d01554

Observation 4adde68f-9a5f-44c0-81e6-ff92acf4ccdb · outbound

This paper cites Vision- language model-driven scene understanding and robotic object ma- nipulation,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Vision- language model-driven scene understanding and robotic object ma- nipulation,

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.595677Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.595677Z digest=sha256:0042f2d59c2b305fd772290f757080a4dc7ef93ed244c4f722536f4ca47fe33c

Observation 717918bc-d5b3-4e5d-b85c-1c847c0a2a7d · outbound

This paper cites Large language models for robotics: Opportunities, challenges, and perspectives,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Large language models for robotics: Opportunities, challenges, and perspectives,

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.689702Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.689702Z digest=sha256:6a24855e710f8de6e2c2b8cfd34c5edec430cda90fded38eedcfa39a0d3acbe2

Observation a8be06c4-4434-4366-aac7-d61805e228ca · outbound

This paper cites V oyager: An open-ended embodied agent with large language models,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning V oyager: An open-ended embodied agent with large language models,

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.851479Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.851479Z digest=sha256:d5b908ac028f4aa21b1950b269ac914f2815e6a729e2bcad534960af437d0481

Observation b0cf793c-66fd-4cce-9578-4581a0852110 · outbound

This paper cites Btgenbot: Behavior tree generation for robotic tasks with lightweight llms,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Btgenbot: Behavior tree generation for robotic tasks with lightweight llms,

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.973568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.973568Z digest=sha256:611f7556b8dd6c3e5d21c31fc2ffb01106e3332ec362526209646e064ef72a1d

Observation b43cff01-cf46-4a61-9c1f-f1fb67a7dc02 · outbound

This paper cites Rl-vlm-f: Reinforcement learning from vision language foundation model feedback,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Rl-vlm-f: Reinforcement learning from vision language foundation model feedback,

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.040308Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.040308Z digest=sha256:7c82c244c7bf70f3468ca3eefa5f22df8350566215882dcc7cf0ad96dabe9ca8

Observation 51b2b0f3-54a2-4c8b-8747-bb9674d28107 · outbound

This paper cites Vision-language models are zero-shot reward models for reinforce- ment learning,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Vision-language models are zero-shot reward models for reinforce- ment learning,

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.173831Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.173831Z digest=sha256:d5ababbe5a8b00b93d84b281eea5cfc95ed747ecd63559dae32010e46c1f2219

Observation 60273c1d-e5fe-4cd5-90c7-dc3873a1f7d9 · outbound

This paper cites VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.349411Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.349411Z digest=sha256:f7d355a593002c001abb59d27f091d86648068037fca2e909922b36bf61f792e

Observation 1c4fc951-6528-456b-b62c-966afab3af4e · outbound

This paper cites CLIP-Motion: Learning Reward Functions for Robotic Actions Using Consecutive Observations.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning CLIP-Motion: Learning Reward Functions for Robotic Actions Using Consecutive Observations

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.447335Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.447335Z digest=sha256:8feb13aaba41b34d257ba5bf1cad24d626108bc0b289ed510ad381c12cc64788

Observation a790c2ab-6a9a-4dea-9276-d6555e0c6a50 · outbound

This paper cites Learning reward for robot skills using large language models via self-alignment,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Learning reward for robot skills using large language models via self-alignment,

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.490264Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.490264Z digest=sha256:688ab4fc605431fc3a5a44c471b9b28ba3e68621a63ba51d3cf0407cf6465b1d

Observation 5e235c21-8cf5-4c69-a884-1a31b31c5459 · outbound

This paper cites Affordance- guided reinforcement learning via visual prompting,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Affordance- guided reinforcement learning via visual prompting,

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.567141Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.567141Z digest=sha256:e6007a37861725829cf7d6fc933efc260e95d3e94ddc7fda0a91d6033f7d7da6

Observation 9f9000af-2192-4bf3-bbac-fefcba824700 · outbound

This paper cites Task success is not enough: Investigating the use of video-language models as behavior critics for catching undesirable agent behaviors,.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning Task success is not enough: Investigating the use of video-language models as behavior critics for catching undesirable agent behaviors,

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:54.753977Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:54.753977Z digest=sha256:958ae0b93a98247be7edba316bc9e1789b145c3dfa3ae557ba1d5289ada0160c

Observation aa493509-df04-4f3a-99c4-b62263604590 · outbound

This paper cites VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models.

VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-02T17:38:53.176975Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T17:38:53.176975Z digest=sha256:d2bb5b9161226cb993f63f2f686f195609e152e17eb19e6269529391cdb4593c

Pith citing papers

No inbound Pith citation observations are available.