Does vision-and-language pretraining improve lexical grounding? arXiv preprint arXiv:2109.10246,

Tian Yun, Chen Sun, Ellie Pavlick · arXiv 2109.10246

1 Pith paper cite this work. Polarity classification is still indexing.

1 Pith paper citing it

representative citing papers

LaMI: Augmenting Large Language Models via Late Multi-Image Fusion

cs.CL · 2024-06-19 · unverdicted · novelty 6.0

LaMI augments LLMs with visual commonsense via late fusion of predictions from multiple text-generated images, outperforming prior augmented LLMs on visual tasks while matching VLMs and preserving or improving NLP performance.

citing papers explorer

Showing 1 of 1 citing paper.

LaMI: Augmenting Large Language Models via Late Multi-Image Fusion cs.CL · 2024-06-19 · unverdicted · none · ref 2
LaMI augments LLMs with visual commonsense via late fusion of predictions from multiple text-generated images, outperforming prior augmented LLMs on visual tasks while matching VLMs and preserving or improving NLP performance.

Does vision-and-language pretraining improve lexical grounding? arXiv preprint arXiv:2109.10246,

fields

years

verdicts

representative citing papers

citing papers explorer