{"as_of":"2026-08-14T15:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:33b9912dea4538fff99c3e98bb08a3e9495b2d20dbe7a03a98395b1db4d24c5a","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T17:38:54.753977Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.22169/citation-record","integrity":"/paper/2603.22169/integrity","json":"/paper/2603.22169/citation-record.json","paper":"/paper/2603.22169"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:51.480567Z","title":"Decision-making for path planning of mobile robots under uncertainty: A review of belief-space planning simplifications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:51.480567Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:57acc9de65c90b04745c061d0261112719b61b81431218a6c931dec1609fb75e","observation_id":"22064f55-da37-4dfb-bf4e-b5df7aeae9a1","resolution":{"observed_at":"2026-08-02T17:38:51.480567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:51.540142Z","title":"Thrun, W","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:51.540142Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:91ba1a9e8716eede5aea7dfcae2016182c686c7881f9499a580aa055b5ab9fd6","observation_id":"ae7ebeb0-2345-496a-aaa3-2517e295214e","resolution":{"observed_at":"2026-08-02T17:38:51.540142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:51.627347Z","title":"Behavior tree learning for robotic task planning through monte carlo dag search over a formal grammar,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:51.627347Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:5f13795631f4a697d6e2a73a9675a87e1c50b0df8a90cae8da4327343429553b","observation_id":"c6c869d9-5837-493c-841c-193185f89095","resolution":{"observed_at":"2026-08-02T17:38:51.627347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:51.781487Z","title":"How behavior trees modularize hybrid control systems and generalize sequential behavior composi- tions, the subsumption architecture, and decision trees,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:51.781487Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:c4117e1ae15cffcc87eef31c6e5e778fc2ba92ae52f089239c451dea4d595741","observation_id":"bae623c0-18f4-4c72-a1af-b88c6e25f18e","resolution":{"observed_at":"2026-08-02T17:38:51.781487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06565","last_updated":"2016-07-25T17:23:29Z","snapshot_observed_at":"2026-07-06T05:00:46.434335Z","submitted_at":"2016-06-21T13:37:05Z","title":"Concrete Problems in AI Safety","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06565","snapshot_observed_at":"2026-08-02T17:38:51.873959Z","title":"Concrete problems in ai safety,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:51.873959Z"},"links":{"cited_paper":"/paper/1606.06565","citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:046fcf03d713e294f764b76ca3e7c3b2d18673d9d2e96ea51ea2699b7392fda2","observation_id":"76fae97e-3784-441a-a074-0ea8cbb3a215","resolution":{"observed_at":"2026-08-02T17:38:51.873959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:51.984696Z","title":"Do as i can, not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:51.984696Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:4cbe11a60e54c13171752e0d51f844e5facc3855d1a6d449ff5acdb232c4677f","observation_id":"2f3546da-e940-413c-b04d-b45ac724c256","resolution":{"observed_at":"2026-08-02T17:38:51.984696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:52.084632Z","title":"Code as policies: Language model programs for embodied control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:52.084632Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:00d666f86f7382f7b690731a8e874b641d2ea08c0a17184b26f9acd3e8445a68","observation_id":"87884c65-42de-4358-b5f6-bb703a694fb5","resolution":{"observed_at":"2026-08-02T17:38:52.084632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:52.215590Z","title":"Progprompt: Program generation for situated robot task planning using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:52.215590Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:3766cb9a0b86a0fc875fce064ad5c5eb37cadf04064b68403f8ad36231603fb0","observation_id":"d62cef11-e063-4c8f-a821-f731c754536f","resolution":{"observed_at":"2026-08-02T17:38:52.215590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:52.318876Z","title":"Autogpt+p: Affordance- based task planning using large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:52.318876Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:bf4b923ba3fc89851e38a9873cd1b6868acff8b18e37e906410f77120eeed75f","observation_id":"cddf9f48-f871-47af-af54-09467415c251","resolution":{"observed_at":"2026-08-02T17:38:52.318876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:52.465727Z","title":"Re- flexion: Language agents with verbal reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:52.465727Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:cfa5df2cd94b605c7716030d6e992ef51a8f2a589d789be96af2ef120d80828e","observation_id":"8f191494-6d23-4f26-b741-95ca3ad78d35","resolution":{"observed_at":"2026-08-02T17:38:52.465727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:52.652045Z","title":"Re- act: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:52.652045Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:45b7fa44d062186f47edd9572b98c8666966ae5f719a4a3a1ea5251bd037dfec","observation_id":"5a74e1a0-0ac6-4af9-ac51-ff36a4d55b48","resolution":{"observed_at":"2026-08-02T17:38:52.652045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:52.803876Z","title":"Self- refine: Iterative refinement with self-feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:52.803876Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:b21a62db73261e8b0e5207eb561156dfbf373bed150f04ea820519bcc31394c3","observation_id":"c90c5922-19bf-4b48-b3cb-ebf87c71ef85","resolution":{"observed_at":"2026-08-02T17:38:52.803876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:52.954541Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:52.954541Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:5b9a31193612a5e174a8b0683d1afc5c36a799f58a6d5f6779660f0e9bad43c4","observation_id":"53e036ec-236b-4cb4-be76-37202d55d2a3","resolution":{"observed_at":"2026-08-02T17:38:52.954541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:53.292942Z","title":"Task and motion planning with large language models for object rearrangement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.292942Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:168eef4303422c3628d46791c7441dcbe9da535746b13fb304c6c41cd1c7ea2d","observation_id":"0e176769-4000-40f5-bab7-ad023cc687fb","resolution":{"observed_at":"2026-08-02T17:38:53.292942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:53.418970Z","title":"Innermonologue: Embodied reasoning through planning with language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.418970Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:8e536c5cda78db9a4510f36887cba480a3334d23678cde57c845f777717f5190","observation_id":"fecd361f-27ff-493d-9983-9e69179e7132","resolution":{"observed_at":"2026-08-02T17:38:53.418970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09348","last_updated":"2023-12-14T21:18:34Z","snapshot_observed_at":"2026-08-13T05:02:04.446304Z","submitted_at":"2023-12-14T21:18:34Z","title":"LLM-MARS: Large Language Model for Behavior Tree Generation and NLP-enhanced Dialogue in Multi-Agent Robot Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09348","snapshot_observed_at":"2026-08-02T17:38:53.509364Z","title":"Llm-mars: Large language model for behavior tree generation and nlp-enhanced dialogue in multi-agent robot systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.509364Z"},"links":{"cited_paper":"/paper/2312.09348","citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:38f7e642b57255b690f8d734be205ecbcf835646e5e301a3e295f753445251ba","observation_id":"674a73d1-26a7-44ad-8a9c-adf22115356f","resolution":{"observed_at":"2026-08-02T17:38:53.509364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:53.595677Z","title":"Vision- language model-driven scene understanding and robotic object ma- nipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.595677Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:9cf8089d167bc4a012c8a2aae3a8d7d51c61112b66986a91616555249884fdd8","observation_id":"4adde68f-9a5f-44c0-81e6-ff92acf4ccdb","resolution":{"observed_at":"2026-08-02T17:38:53.595677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:53.689702Z","title":"Large language models for robotics: Opportunities, challenges, and perspectives,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.689702Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:29ecba654b904dc5b5a56ed37da28a366f3b7c1ee2a44ea19d67624d71e1a80b","observation_id":"717918bc-d5b3-4e5d-b85c-1c847c0a2a7d","resolution":{"observed_at":"2026-08-02T17:38:53.689702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:53.851479Z","title":"V oyager: An open-ended embodied agent with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.851479Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:a549ff9a1fcb2ca357491a4921339b3a6c1b793e047d22025de89e78011aa550","observation_id":"a8be06c4-4434-4366-aac7-d61805e228ca","resolution":{"observed_at":"2026-08-02T17:38:53.851479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:53.973568Z","title":"Btgenbot: Behavior tree generation for robotic tasks with lightweight llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.973568Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:75f3c9488097b611a109020e1f04554506afb1f7723c4ebb891b96594833a090","observation_id":"b0cf793c-66fd-4cce-9578-4581a0852110","resolution":{"observed_at":"2026-08-02T17:38:53.973568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:54.040308Z","title":"Rl-vlm-f: Reinforcement learning from vision language foundation model feedback,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:54.040308Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:4f1b0d6753b831f1797f3e63293d3118925c84f934ae162eeffeda36e0de2bdc","observation_id":"b43cff01-cf46-4a61-9c1f-f1fb67a7dc02","resolution":{"observed_at":"2026-08-02T17:38:54.040308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:54.173831Z","title":"Vision-language models are zero-shot reward models for reinforce- ment learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:54.173831Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:c1141aea8873ceff085ea5a353e80d85d0eedc2d5c945a3e7582938b3a9b807d","observation_id":"51b2b0f3-54a2-4c8b-8747-bb9674d28107","resolution":{"observed_at":"2026-08-02T17:38:54.173831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13817","last_updated":"2025-03-18T01:51:27Z","snapshot_observed_at":"2026-08-12T11:28:30.821181Z","submitted_at":"2025-03-18T01:51:27Z","title":"VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13817","snapshot_observed_at":"2026-08-02T17:38:54.349411Z","title":"Varp: Reinforcement learning from vision- language model feedback with agent regularized preferences,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:54.349411Z"},"links":{"cited_paper":"/paper/2503.13817","citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:4dfcdb3105dc9cc62b2b9ae71f8bf7b917750422748cd252e1d0ca8a0491de18","observation_id":"60273c1d-e5fe-4cd5-90c7-dc3873a1f7d9","resolution":{"observed_at":"2026-08-02T17:38:54.349411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03485","last_updated":"2025-01-29T14:28:23Z","snapshot_observed_at":"2026-08-13T05:31:49.691908Z","submitted_at":"2023-11-06T19:48:03Z","title":"CLIP-Motion: Learning Reward Functions for Robotic Actions Using Consecutive Observations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03485","snapshot_observed_at":"2026-08-02T17:38:54.447335Z","title":"Clip-motion: Learning reward func- tions for robotic actions using consecutive observations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:54.447335Z"},"links":{"cited_paper":"/paper/2311.03485","citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:6fd13f5e71a05fde224c8cd76a3726cc76e22e6053a748eeafe708489728a59e","observation_id":"1c4fc951-6528-456b-b62c-966afab3af4e","resolution":{"observed_at":"2026-08-02T17:38:54.447335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:54.490264Z","title":"Learning reward for robot skills using large language models via self-alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:54.490264Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:64bf02e3afb565e6eb055f1c92977a4d3a7ebf8d31e67b16f172767bee12acf6","observation_id":"a790c2ab-6a9a-4dea-9276-d6555e0c6a50","resolution":{"observed_at":"2026-08-02T17:38:54.490264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:54.567141Z","title":"Affordance- guided reinforcement learning via visual prompting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:54.567141Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:948d85f61f4f00fb476c6c62bc988ff3c09ff7801ef5b6090b4600220d50e45d","observation_id":"5e235c21-8cf5-4c69-a884-1a31b31c5459","resolution":{"observed_at":"2026-08-02T17:38:54.567141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T17:38:54.753977Z","title":"Task success is not enough: Investigating the use of video-language models as behavior critics for catching undesirable agent behaviors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:54.753977Z"},"links":{"citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:d00c689b89a36c0925be692a40f720cb66d1adcb3482c6b8212dee89c5d4e575","observation_id":"9f9000af-2192-4bf3-bbac-fefcba824700","resolution":{"observed_at":"2026-08-02T17:38:54.753977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-02T17:38:53.176975Z","title":"Available: https://doi.org/10.48550/arXiv.2307.05973","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T17:38:53.176975Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2603.22169"},"observation_digest":"sha256:3af72bd6bc4b96e1c21e64f5528f2edf4657017e7c561d383d1fe8ff4a305f7f","observation_id":"aa493509-df04-4f3a-99c4-b62263604590","resolution":{"observed_at":"2026-08-02T17:38:53.176975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.22169","last_updated":"2026-07-19T10:26:48Z","latest_version":3,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T08:56:37.211314Z","submitted_at":"2026-03-23T16:28:36Z","title":"VersualRL: Closed-Loop Verbal Reinforcement Learning with Visual Execution Feedback for Task-Level Robot Planning"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2603.22169."}