{"work":{"id":"d972314c-446c-43b5-9de5-4bb7c5f1cdcf","openalex_id":"https://openalex.org/W7133498487","doi":"10.48550/arxiv.2603.03276","arxiv_id":"2603.03276","raw_key":null,"title":"Beyond language modeling: An exploration of multimodal pretraining, March 2026","authors":null,"authors_text":"Shengbang Tong, David Fan, John Nguyen, Ellis Brown, Gaoyue Zhou, Shengyi Qian, Boyang Zheng, Théophane Vallaeys, Junlin Han, Rob Fergus, Naila Murray, Marjan Ghazvininejad, Mike Lewis, Nicolas Ballas, Amir Bar, Michael Rabbat, Jakob Verbee","year":2026,"venue":"arXiv (Cornell University)","abstract":null,"external_url":"https://arxiv.org/abs/2603.03276","cited_by_count":0,"metadata_source":"arxiv_reference","metadata_fetched_at":"2026-08-05T02:28:24.338817+00:00","pith_arxiv_id":null,"created_at":"2026-05-09T04:30:11.348548+00:00","updated_at":"2026-08-05T02:28:24.338817+00:00","title_quality_ok":true,"display_title":"Beyond language modeling: An exploration of multimodal pretraining","render_title":"Beyond language modeling: An exploration of multimodal pretraining"},"hub":{"state":{"work_id":"d972314c-446c-43b5-9de5-4bb7c5f1cdcf","tier":"hub","tier_reason":"10+ Pith inbound or 1,000+ external citations","pith_inbound_count":15,"external_cited_by_count":0,"distinct_field_count":4,"first_pith_cited_at":"2026-04-03T17:06:31+00:00","last_pith_cited_at":"2026-07-09T12:54:05+00:00","author_build_status":"not_needed","summary_status":"needed","contexts_status":"needed","graph_status":"needed","ask_index_status":"not_needed","reader_status":"not_needed","recognition_status":"not_needed","updated_at":"2026-08-13T04:40:13.499181+00:00","tier_text":"hub"},"tier":"hub","role_counts":[{"context_role":"background","n":5}],"polarity_counts":[{"context_polarity":"background","n":5}],"runs":{},"summary":{},"graph":{},"authors":[]}}