Pith. sign in

Lxmert: Learning cross-modality encoder representations from transform- ers

1 Pith paper cite this work. Polarity classification is still indexing.

1 Pith paper citing it

fields

q-bio.NC 1

years

2025 1

verdicts

CONDITIONAL 1

representative citing papers

Multi-modal brain encoding models for multi-modal stimuli

q-bio.NC · 2025-05-26 · conditional · novelty 5.0

On movie-watching fMRI data, multi-modal vision-audio transformers predict brain activity better than unimodal video or speech models, with video dominating cross-modal alignment and video plus audio jointly contributing in jointly-pretrained models.

citing papers explorer

Showing 1 of 1 citing paper.

  • Multi-modal brain encoding models for multi-modal stimuli q-bio.NC · 2025-05-26 · conditional · none · ref 15

    On movie-watching fMRI data, multi-modal vision-audio transformers predict brain activity better than unimodal video or speech models, with video dominating cross-modal alignment and video plus audio jointly contributing in jointly-pretrained models.