Pith. sign in

Paper Citation Record · LEDGER

RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

As of 23 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 38 inbound Pith citation observations for arXiv:2402.03681.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2402.03681 v4

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 38 of 38 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 38 of 38 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-16T05:31:55.956455Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

6
pith, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation cc57d9c5-0e98-4c8f-95e1-cf4e4564c3f0 · inbound

ViSTa Dataset: Do vision-language models understand sequential tasks? cites this paper.

ViSTa Dataset: Do vision-language models understand sequential tasks? RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-12T16:45:47.260990Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T16:45:47.260990Z digest=sha256:d4ef27c3cd15edab60ac67184f953c12680be839160a3664ae7d9cdb2c5672b0

Observation 7face66c-8094-4861-8bb5-e0511b7b31ba · inbound

LLM-Based Offline Learning for Embodied Agents via Consistency-Guided Reward Ensemble cites this paper.

LLM-Based Offline Learning for Embodied Agents via Consistency-Guided Reward Ensemble RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-12T12:33:07.169030Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-12T12:33:07.169030Z digest=sha256:17b3c9f620435d31b00dad36a1a019674d64efcfb82f4618794d267845125d5d

Observation e923c4c4-e55c-4e44-b176-e626888b8f78 · inbound

MALMM: Multi-Agent Large Language Models for Zero-Shot Robotics Manipulation cites this paper.

MALMM: Multi-Agent Large Language Models for Zero-Shot Robotics Manipulation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-12T11:57:03.861532Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T11:57:03.861532Z digest=sha256:c699047f11d712883c589c616008fa9ea449b5c169f8def4d65dfbe3e81071cc

Observation 386c3901-3ef0-45c6-8a8e-f23fb05974a4 · inbound

SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation cites this paper.

SILMM: Self-Improving Large Multimodal Models for Compositional Text-to-Image Generation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 69

Resolution
unresolved
no resolver link, observed 2026-08-11T20:25:14.989517Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:25:14.989517Z digest=sha256:b3c173bf13cd6ebfa7f6fc6dea2956eff5a99945215e55d299880120eb224066

Observation 08752a8d-6ae4-4138-9b49-da9046bd152a · inbound

YingSound: Video-Guided Sound Effects Generation with Multi-modal Chain-of-Thought Controls cites this paper.

YingSound: Video-Guided Sound Effects Generation with Multi-modal Chain-of-Thought Controls RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 100

Resolution
unresolved
no resolver link, observed 2026-08-11T17:17:49.488002Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T17:17:49.488002Z digest=sha256:56f36f6f6a2051be45382e71fa40e7721f3a52d32b6d66f66b1609d2058d72fa

Observation 00b8eccd-443e-422a-a52b-e4e2b94300da · inbound

VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving cites this paper.

VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T11:25:15.406842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T11:25:15.406842Z digest=sha256:fc527594b24f941c95a856d2a78fa6a3b2dd66302c29de36b7c76296fda0517e

Observation 72d9408e-e95e-407a-bcba-4cf965a72b72 · inbound

CLIP-RLDrive: Human-Aligned Autonomous Driving via CLIP-Based Reward Shaping in Reinforcement Learning cites this paper.

CLIP-RLDrive: Human-Aligned Autonomous Driving via CLIP-Based Reward Shaping in Reinforcement Learning RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T14:10:08.693481Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T14:10:08.693481Z digest=sha256:03611941566703a6f70a1f2a41012e68222c5b4320a24c1ab58b2d7e529fdefe

Observation 2e8e269f-ae0d-4245-a649-6aad57ad9ed3 · inbound

Contrastive Learning from Exploratory Actions: Leveraging Natural Interactions for Preference Elicitation cites this paper.

Contrastive Learning from Exploratory Actions: Leveraging Natural Interactions for Preference Elicitation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-10T22:32:07.962630Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T22:32:07.962630Z digest=sha256:804a8cbb91d0dc69c304121cc010056f3f9a18345f19500f063904a71b4c8717

Observation 7463f495-a244-4402-95be-4bc5fd03023d · inbound

FDPP: Fine-tune Diffusion Policy with Human Preference cites this paper.

FDPP: Fine-tune Diffusion Policy with Human Preference RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-10T20:34:07.043762Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T20:34:07.043762Z digest=sha256:df51f6e9866cdabbac65ff158debce4bdc334c6656563e1b241b667a0021f9c2

Observation 1e78bded-9810-45f3-9f60-d1d02b92c022 · inbound

PRISM: Projection-based Reward Integration for Scene-Aware Real-to-Sim-to-Real Transfer with Few Demonstrations cites this paper.

PRISM: Projection-based Reward Integration for Scene-Aware Real-to-Sim-to-Real Transfer with Few Demonstrations RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-16T05:31:55.956455Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T05:31:55.956455Z digest=sha256:b17dd13df6ad6c7a9d7bbe7ba4d65c4fbb58e29439208f26ac4b2f32fbd0446d

Observation cb0a0399-3f18-42a0-bdf4-76f5bfcbbff7 · inbound

TREND: Tri-teaching for Robust Preference-based Reinforcement Learning with Demonstrations cites this paper.

TREND: Tri-teaching for Robust Preference-based Reinforcement Learning with Demonstrations RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-15T22:52:23.759155Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T22:52:23.759155Z digest=sha256:192d68d07fc6c08760352f9cca6af260066738e41fc7d3a8a808e4cf445216b4

Observation d6e0d8eb-dcc5-43a1-8cd8-7c1850be8884 · inbound

Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation cites this paper.

Sample Efficient Reinforcement Learning via Large Vision Language Model Distillation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-15T20:59:41.208656Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-15T20:59:41.208656Z digest=sha256:bef2a5a9827d4ab58219ed64c96c8b5779d60940edfccfed2beb92bc001faa4f

Observation 507ccd29-01c6-4931-9078-8b810bcaa289 · inbound

ManiTaskGen: A Comprehensive Task Generator for Benchmarking and Improving Vision-Language Agents on Embodied Decision-Making cites this paper.

ManiTaskGen: A Comprehensive Task Generator for Benchmarking and Improving Vision-Language Agents on Embodied Decision-Making RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 52

Resolution
unresolved
no resolver link, observed 2026-08-07T13:53:59.540056Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:53:59.540056Z digest=sha256:b9be645255e5ffc1c669c2492b02f6f0c4b0d76377d1c4c6816c3f846770b757

Observation aad52432-1358-4d8d-8388-110825fd8d6a · inbound

ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving cites this paper.

ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T12:32:06.318385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:32:06.318385Z digest=sha256:72b1572b29d516f39ba69401f7119a82c2463cdd6dd8a7fd1e6024ed1c749aa1

Observation 1debe993-d244-4a08-84cc-9bc6ccd864dc · inbound

HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation cites this paper.

HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-06T05:41:42.219536Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T05:41:42.219536Z digest=sha256:fcd6577a6b5e5502e7025e42478de6935b79030dac4bd15aa03d43fe35dfd50a

Observation c5684732-36b4-4776-8e20-104819cb6eb6 · inbound

UAV-VL-R1: Generalizing Vision-Language Models via Supervised Fine-Tuning and Multi-Stage GRPO for UAV Visual Reasoning cites this paper.

UAV-VL-R1: Generalizing Vision-Language Models via Supervised Fine-Tuning and Multi-Stage GRPO for UAV Visual Reasoning RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-18T22:21:53.346287Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-18T22:17:41.758059Z digest=sha256:05ff82232a57d518dd6e3e3b2ab58ab1b909a06514fc07cd3bc1a1066e68ade2

Observation 060d5b69-72d5-4948-9dd6-85d684d9fe3c · inbound

Reflection-Based Task Adaptation for Self-Improving VLA cites this paper.

Reflection-Based Task Adaptation for Self-Improving VLA RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 39

Resolution
verified exact
arxiv_id, observed 2026-05-18T07:31:02.945003Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-18T07:28:11.187479Z digest=sha256:659f1a46742c73afbe442ff9093ebd49d7ee56fe45e48924f3b95536637f41e6

Observation 8145122e-b207-4fe9-ad62-9219e51fd3a4 · inbound

Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent cites this paper.

Meta-Learning and Meta-Reinforcement Learning -- Tracing the Path towards DeepMind's Adaptive Agent RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 182

Resolution
verified exact
arxiv_id, observed 2026-05-15T20:46:35.641376Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-15T20:46:15.275441Z digest=sha256:687688b1306d5b347c8222daa76de0b17f0cfc5112f06d531e7a29cc8d6bb78e

Observation b0f84f00-831b-4459-8c57-1980f1a76a1b · inbound

SOLE-R1: Video-Language Reasoning as the Sole Reward for On-Robot Reinforcement Learning cites this paper.

SOLE-R1: Video-Language Reasoning as the Sole Reward for On-Robot Reinforcement Learning RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 59

Resolution
unresolved
no resolver link, observed 2026-07-13T16:10:12.689957Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T16:10:12.689957Z digest=sha256:1379d9cc1ff010ded348b7ec8144154de2b0c18d1b9288896ea93cf699364b29

Observation be41da0a-9061-4663-b6dd-701b2e2ac0e9 · inbound

AtlasVA: Self-Evolving Visual Skill Memory for Teacher-Free VLM Agents cites this paper.

AtlasVA: Self-Evolving Visual Skill Memory for Teacher-Free VLM Agents RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 43

Resolution
metadata mismatch
arxiv_id, observed 2026-05-20T11:28:14.482581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-20T11:24:48.558423Z digest=sha256:4bafd29defc7624853f3722031eabfbc5484a76ae262c23e8f2fb29c208d0d49

Observation 595aa6c1-82b7-4519-8978-ab500322f516 · inbound

Reasoning Portability: Guiding Continual Learning for MLLMs in the RLVR Era cites this paper.

Reasoning Portability: Guiding Continual Learning for MLLMs in the RLVR Era RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 52

Resolution
verified exact
arxiv_id, observed 2026-05-20T13:33:19.313918Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-20T13:29:11.509966Z digest=sha256:a43aae0a80e3e2a0cd08ec8832774a6f93813e6d879b2aa989a407e03e6571a3

Observation 1cc2b38f-b9e8-463c-b334-a8bb8672514d · inbound

Beyond Pixels: Learning Invariant Rewards for Real-World Robotics From a Few Demonstrations cites this paper.

Beyond Pixels: Learning Invariant Rewards for Real-World Robotics From a Few Demonstrations RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 25

Resolution
verified exact
arxiv_id, observed 2026-05-22T05:34:40.341672Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-22T05:32:17.780012Z digest=sha256:205b224ed5d9d348f4cf2be19d723e425a7a2e6ba492a1cf5387e1a47872c328

Observation 2e8cf5b5-b2c5-4f1d-8830-fa282443f118 · inbound

CV-Arena: An Open Benchmark for Instructional Computer Vision Problem Solving with Human-AI Collaborative Preferences cites this paper.

CV-Arena: An Open Benchmark for Instructional Computer Vision Problem Solving with Human-AI Collaborative Preferences RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 71

Resolution
verified exact
arxiv_id, observed 2026-06-28T20:32:37.635642Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-28T18:36:46.381564Z digest=sha256:64f04089364180f6a108decd853ab1ed5d2b5d9e98a498494daa7c251b64f6d9

Observation 58dec1c0-6e7c-4150-8538-f0174bd95a96 · inbound

World Model Self-Distillation: Training World Models to Solve General Tasks cites this paper.

World Model Self-Distillation: Training World Models to Solve General Tasks RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 65

Resolution
verified exact
arxiv_id, observed 2026-07-03T10:07:55.861633Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-27T10:16:35.511426Z digest=sha256:076519a7145c6c8aab97ec52bfb4def5cacf57852e6f22cef26a26cb23adb66f

Observation 1549fe9b-7479-4347-8a31-cc63ad680120 · inbound

MAGNIFIED: RL Fine-tuning of Multimodal Large Language Models for Motion Planning cites this paper.

MAGNIFIED: RL Fine-tuning of Multimodal Large Language Models for Motion Planning RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 29

Resolution
verified exact
arxiv_id, observed 2026-07-02T03:56:35.152732Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-28T09:31:56.712360Z digest=sha256:08413ee5fae8da327e8a4a53d3c85e9158fd91359f4f526d7c9935ad1585ef3a

Observation bed6605d-e35a-41f4-81bb-bc60db7357fe · inbound

Learning Process Rewards via Success Visitation Matching for Efficient RL cites this paper.

Learning Process Rewards via Success Visitation Matching for Efficient RL RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 89

Resolution
verified exact
arxiv_id, observed 2026-07-04T09:59:44.552947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-26T09:20:35.062060Z digest=sha256:285addbe2cbc560d083bd7c9626d400bfc4cc70bec11993a13a88ca43d3022f8

Observation 3c476429-1c35-4df5-8adf-9aa9847da207 · inbound

MAPL: Multi-Objective Preference Learning for Robot Locomotion cites this paper.

MAPL: Multi-Objective Preference Learning for Robot Locomotion RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 14

Resolution
verified exact
arxiv_id, observed 2026-07-04T19:40:06.247908Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-25T21:11:00.753949Z digest=sha256:6ce508e1c5bf04307cd5b84b079c66b4d855582d17a7769d5f8ad7189c001581

Observation 597a613c-efae-4c62-b916-b96e68cab2fb · inbound

Digitizing Coaching Intelligence: An Agentic Framework for Holistic Athlete Profiling using VLM and RAG cites this paper.

Digitizing Coaching Intelligence: An Agentic Framework for Holistic Athlete Profiling using VLM and RAG RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-07-01T15:45:48.629240Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-06-30T01:04:10.556608Z digest=sha256:9cb77336a81ecdd7f2177c7cc96c361802014811a134354d0d725663a7186dd4

Observation 7942573f-050a-4597-90c3-7c9f599cb04a · inbound

Freeform Preference Learning for Robotic Manipulation cites this paper.

Freeform Preference Learning for Robotic Manipulation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 42

Resolution
verified exact
arxiv_id, observed 2026-07-01T10:55:41.993344Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-07-01T04:58:28.971536Z digest=sha256:1cf85a61bf4c4d4a6adee530d2d45c6c39809acb7b3067b46c5937ab70974c9b

Observation 0caae5b4-41cc-49c5-a5a7-dcc07bdc7d52 · inbound

Freeform Preference Learning for Robotic Manipulation cites this paper.

Freeform Preference Learning for Robotic Manipulation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 42

Resolution
unresolved
no resolver link, observed 2026-07-14T16:55:18.028851Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T16:55:18.028851Z digest=sha256:63449416bd128054c1208784baabbcb1382d5688435f540f81d2827715f51268

Observation e14f6cc5-e031-4ecd-8ea1-afff73aff912 · inbound

Freeform Preference Learning for Robotic Manipulation cites this paper.

Freeform Preference Learning for Robotic Manipulation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 41

Resolution
unresolved
no resolver link, observed 2026-08-04T02:32:21.801763Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T02:32:21.801763Z digest=sha256:95935b4a5c487ba06083d334e9199eb8b92f59e22618927085bd1330f8a2abe0

Observation f7fe787f-399f-467c-971e-38c5db5a2352 · inbound

QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents cites this paper.

QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 25

Resolution
metadata mismatch
arxiv_id, observed 2026-07-01T06:05:28.995527Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-07-01T05:59:13.631078Z digest=sha256:56a1fbd27c27aa4d6ca71828413dcced595bbea4d7d739f29fe7615219517060

Observation 03ba039f-d16d-4838-a07f-6ea9688dbcf6 · inbound

LLM-as-a-Verifier: A General-Purpose Verification Framework cites this paper.

LLM-as-a-Verifier: A General-Purpose Verification Framework RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 80

Resolution
verified exact
local_arxiv, observed 2026-07-07T12:53:50.157230Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-07-07T12:47:29.552283Z digest=sha256:3b13aa7f6dbec4b345ae4e729d76c0cca82dcb016df4ec46dba847e2a8f384cd

Observation 2159aea4-c9d6-488c-bf68-f1ac3e07fd84 · inbound

LLM-as-a-Verifier: A General-Purpose Verification Framework cites this paper.

LLM-as-a-Verifier: A General-Purpose Verification Framework RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 80

Resolution
unresolved
no resolver link, observed 2026-07-11T07:02:51.850836Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T07:02:51.850836Z digest=sha256:e8b57614ae8cd49548d304cc04702c10166cc7ece519b3e26f8391490ee71c5c

Observation cb1fefb5-d847-43f4-98f8-0233a4d79a31 · inbound

Prompt-Driven Exploration cites this paper.

Prompt-Driven Exploration RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 115

Resolution
unresolved
no resolver link, observed 2026-07-13T06:21:42.026251Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-13T06:21:42.026251Z digest=sha256:612b06f2561d75755ba55d5baa5655c709ef78a02c6882078bec7a9edbd72c44

Observation aaa22542-473a-4093-a51c-0125399e5ac2 · inbound

Learning More from Less: Reinforcement Learning from Hindsight cites this paper.

Learning More from Less: Reinforcement Learning from Hindsight RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 22

Resolution
unresolved
no resolver link, observed 2026-07-13T00:46:28.503923Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-13T00:46:28.503923Z digest=sha256:7e5f58a2cf08cfb32497c4edc559c38ff1b1bb6fea34feb5adccea59799f0ac1

Observation 886dba74-5a71-4507-9b08-7e7097e3363a · inbound

MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation cites this paper.

MARS-RA: Rank Aggregation for Credit Assignment via Multimodal Comparisons in Embodied Multi-Agent Cooperation RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 68

Resolution
unresolved
no resolver link, observed 2026-07-31T21:55:17.393310Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-31T21:55:17.393310Z digest=sha256:7b19f85f5ee03f84116e109dc1e765f33bd3a8625c28562f50ff022c81e3b60e

Observation 0513bdd3-5d69-46bb-8356-dde3addce4f4 · inbound

Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills cites this paper.

Weights or Skills? A Survey of Robot-Learning Techniques: from Action-Predicting Weights to Robots that Write their Own Skills RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback

Reference 260

Resolution
unresolved
no resolver link, observed 2026-08-04T19:45:35.307263Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T19:45:35.307263Z digest=sha256:79d26f57d4f4071a512f8c80aaac5682d1837b4ae896d4e57c9f137c7301fdac