VAORA aligns VLM chain-of-thought reasoning with visual scene observations and post-action outcomes via structured symbolic rewards, achieving cross-task and cross-environment generalization on physical reasoning benchmarks.
Proceedings of the National Academy of Sciences , volume = 117, number = 47, pages =
2 Pith papers cite this work, alongside 15 external citations. Polarity classification is still indexing.
2
Pith papers citing it
15
external citations · OpenAlex
fields
cs.AI 2years
2026 2representative citing papers
MedMSA framework retrieves knowledge via language models then builds formal probabilistic models to produce uncertainty-weighted differential diagnoses from symptoms.
citing papers explorer
-
Bridging Physical Reasoning and Task Generalization via Visual Action Outcome Reasoning Alignment
VAORA aligns VLM chain-of-thought reasoning with visual scene observations and post-action outcomes via structured symbolic rewards, achieving cross-task and cross-environment generalization on physical reasoning benchmarks.
-
Medical Model Synthesis Architectures: A Case Study
MedMSA framework retrieves knowledge via language models then builds formal probabilistic models to produce uncertainty-weighted differential diagnoses from symptoms.