{"as_of":"2026-08-15T20:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:006f0488741e20df0f6a705da430dc6e036570b6410fd81569aab04d9500ea9a","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:23:03.488981Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:25:33.841314Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T15:07:04.010897Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2505.19190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-02T15:07:04.010897Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":"cc3005cc-a5cb-474a-a1e1-9181fae4c2ed","year":2025},"citing_paper":{"arxiv_id":"2604.10695","last_updated":"2026-04-14T03:39:04Z","snapshot_observed_at":"2026-08-11T15:47:01.949754Z","submitted_at":"2026-04-12T15:43:30Z","title":"Retrieving to Recover: Towards Incomplete Audio-Visual Question Answering via Semantic-consistent Purification","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T16:02:54.331280Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2604.10695"},"observation_digest":"sha256:7dac3d58e9e0d66a8bfca3c465a3c74266183d82ababb624284ee1907734e77b","observation_id":"30e0406f-257e-4a35-9739-11371888721c","resolution":{"observed_at":"2026-05-11T09:25:59.699253Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2505.19190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-02T15:07:04.010897Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":"cc3005cc-a5cb-474a-a1e1-9181fae4c2ed","year":2025},"citing_paper":{"arxiv_id":"2604.16930","last_updated":"2026-04-18T09:28:23Z","snapshot_observed_at":"2026-08-15T09:12:04.785679Z","submitted_at":"2026-04-18T09:28:23Z","title":"CoGR-MoE: Concept-Guided Expert Routing with Consistent Selection and Flexible Reasoning for Visual Question Answering","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-10T07:09:48.239662Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2604.16930"},"observation_digest":"sha256:02f5be8869509f99102caf93e49ef7333bc32d3fbface5501359488763078ce4","observation_id":"890d1830-f030-4362-b1ee-68d7730f55d2","resolution":{"observed_at":"2026-05-10T07:11:53.266530Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2505.19190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-02T15:07:04.010897Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":"cc3005cc-a5cb-474a-a1e1-9181fae4c2ed","year":2025},"citing_paper":{"arxiv_id":"2605.01153","last_updated":"2026-05-01T23:09:14Z","snapshot_observed_at":"2026-08-14T14:37:53.884690Z","submitted_at":"2026-05-01T23:09:14Z","title":"Toward a Unified Framework for Collaborative Design of Human-AI Interaction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T18:13:08.894589Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2605.01153"},"observation_digest":"sha256:17c054c98ef50d45c8abf400f575658fd7d99967a370e8db4fbac89c6852217e","observation_id":"f2174d57-02a2-421c-a6a8-f7afcc4bd903","resolution":{"observed_at":"2026-05-11T16:16:09.375067Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2505.19190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-02T15:07:04.010897Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":"cc3005cc-a5cb-474a-a1e1-9181fae4c2ed","year":2025},"citing_paper":{"arxiv_id":"2605.08585","last_updated":"2026-05-09T01:05:34Z","snapshot_observed_at":"2026-08-15T05:15:47.177487Z","submitted_at":"2026-05-09T01:05:34Z","title":"PromptDx: Differentiable Prompt Tuning for Multimodal In-Context Alzheimer's Diagnosis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-12T01:03:23.712417Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2605.08585"},"observation_digest":"sha256:874e05df1014248b86479311dee892134e439ff516a9b2074887d16dce33ba53","observation_id":"58f11c42-6181-4bed-845b-8b3cf50d7c58","resolution":{"observed_at":"2026-05-12T08:31:24.516040Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2505.19190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-02T15:07:04.010897Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":"cc3005cc-a5cb-474a-a1e1-9181fae4c2ed","year":2025},"citing_paper":{"arxiv_id":"2605.27431","last_updated":"2026-05-22T05:01:21Z","snapshot_observed_at":"2026-08-14T18:43:30.097421Z","submitted_at":"2026-05-22T05:01:21Z","title":"Tackling Multimodal Learning Challenges with Mixture-of-Expert: A Survey","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T15:26:44.904121Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2605.27431"},"observation_digest":"sha256:9a36bbfca5c09c6d04ecaa192ad0016afe722116af70f3925c5d58ebc68399cc","observation_id":"be6758f0-a971-4f9b-8a77-616f94c9e6dd","resolution":{"observed_at":"2026-06-30T15:34:48.339013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2505.19190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-02T15:07:04.010897Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":"cc3005cc-a5cb-474a-a1e1-9181fae4c2ed","year":2025},"citing_paper":{"arxiv_id":"2606.09853","last_updated":"2026-05-12T19:42:19Z","snapshot_observed_at":"2026-08-02T09:39:01.496025Z","submitted_at":"2026-05-12T19:42:19Z","title":"SynIB: Informational Bottleneck for Maximizing Synergy in Multimodal Learning","version":1},"reference_index":126,"source":"arxiv_source","source_observed_at":"2026-06-30T21:55:53.630732Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2606.09853"},"observation_digest":"sha256:37b9e649b1247807cdc10713f5be058e6e0bcffd0d605658440c1c531d707cad","observation_id":"551edb03-1d03-4fda-b64e-748288dd4d16","resolution":{"observed_at":"2026-06-30T22:05:06.118790Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":"2505.19190","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-02T15:07:04.010897Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":"cc3005cc-a5cb-474a-a1e1-9181fae4c2ed","year":2025},"citing_paper":{"arxiv_id":"2607.00573","last_updated":"2026-07-19T08:18:26Z","snapshot_observed_at":"2026-08-13T09:33:38.371532Z","submitted_at":"2026-07-01T07:59:05Z","title":"BrainFIBRE: A Foundation Model via Information Decomposition for Brain Microstructure","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-02T15:00:39.357350Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2607.00573"},"observation_digest":"sha256:b12d71f6983daf7c69b7efeae9445524a32ae95b5c69c646e905e7f31251baf1","observation_id":"8ebe97c2-88d4-4e8f-8ddd-f6a2144c8d5f","resolution":{"observed_at":"2026-07-02T15:07:04.012422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-08-02T09:20:43.515170Z","title":"arXiv preprint arXiv:2505.19190 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.00573","last_updated":"2026-07-19T08:18:26Z","snapshot_observed_at":"2026-08-13T09:33:38.371532Z","submitted_at":"2026-07-01T07:59:05Z","title":"BrainFIBRE: A Foundation Model via Information Decomposition for Brain Microstructure","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T09:20:43.515170Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2607.00573"},"observation_digest":"sha256:fac0b84c6b7169f8495cbf61758e18a34c532457c38975ec77577f47265a8625","observation_id":"7c95e8ce-20da-4032-895c-77f5630f355b","resolution":{"observed_at":"2026-08-02T09:20:43.515170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-07-13T07:37:23.629558Z","title":"arXiv preprint arXiv:2505.19190 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08778","last_updated":"2026-06-12T17:11:13Z","snapshot_observed_at":"2026-08-14T08:55:20.715480Z","submitted_at":"2026-06-12T17:11:13Z","title":"iLENS: Interpretable LLM-Guided Mixture-of-Experts for Neuroimaging Survival Analysis","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-13T07:37:23.629558Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2607.08778"},"observation_digest":"sha256:f9dc55dce13c65e4a3bc7bbd5fc1f062272696cf9d9fa2b159092ef2ad7bd8f7","observation_id":"29d437a8-e671-4a44-89eb-1a58e63c51e8","resolution":{"observed_at":"2026-07-13T07:37:23.629558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19190","snapshot_observed_at":"2026-08-12T00:25:33.841314Z","title":"I2moe:Interpretablemultimodalinteraction- awaremixture-of-experts.arXivpreprintarXiv:2505.19190","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08148","last_updated":"2026-08-08T14:15:43Z","snapshot_observed_at":"2026-08-14T22:41:10.586808Z","submitted_at":"2026-08-08T14:15:43Z","title":"DoGMA: A Central-Dogma-Guided Foundation Model for Multi-Omics Alignment and Multi-Task Learning in Oncology","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T00:25:33.841314Z"},"links":{"cited_paper":"/paper/2505.19190","citing_paper":"/paper/2608.08148"},"observation_digest":"sha256:00450506b97b3165bdb2634f716a44d8e4716799827f86004af42905d2947042","observation_id":"2776fb22-1012-44e8-a201-b8d00f17eecb","resolution":{"observed_at":"2026-08-12T00:25:33.841314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19190/citation-record","integrity":"/paper/2505.19190/integrity","json":"/paper/2505.19190/citation-record.json","paper":"/paper/2505.19190"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1702.01992","last_updated":"2017-02-07T13:05:19Z","snapshot_observed_at":"2026-08-15T17:40:07.652333Z","submitted_at":"2017-02-07T13:05:19Z","title":"Gated Multimodal Units for Information Fusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.01992","snapshot_observed_at":"2026-08-07T14:23:01.373995Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.373995Z"},"links":{"cited_paper":"/paper/1702.01992","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:d7f069e03c49bdafecbf4a3354a1fa701b33152f27696a22541539ac0269d9b3","observation_id":"0314ad6a-248a-4222-ae9b-2e9c1d538bfb","resolution":{"observed_at":"2026-08-07T14:23:01.373995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:04.634876Z","title":null,"venue":null,"work_id":"a71b18a3-38a7-402d-b716-6d6f6e328dae","year":2024},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:03.398431Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:4003f01f793adc521bdca049f84792f80b2fab88d9b3f7e6cea95bea94afff4a","observation_id":"dab1296a-6111-42df-9e58-8944cbbdca75","resolution":{"observed_at":"2026-08-07T14:23:04.690120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21770","last_updated":"2024-08-12T16:20:37Z","snapshot_observed_at":"2026-08-13T18:50:18.193476Z","submitted_at":"2024-07-31T17:46:51Z","title":"MoMa: Efficient Early-Fusion Pre-training with Mixture of Modality-Aware Experts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21770","snapshot_observed_at":"2026-08-07T14:23:02.222716Z","title":"V ., Shrivastava, A., Luo, L., Iyer, S., Lewis, M., Ghosh, G., Zettlemoyer, L., and Aghajanyan, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.222716Z"},"links":{"cited_paper":"/paper/2407.21770","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:c81071bacf598ea313021b1b4dbe057decd90e2d01308b03417bcb09a5b7919d","observation_id":"b1027178-e266-4836-8767-f51acae4cf53","resolution":{"observed_at":"2026-08-07T14:23:02.222716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00064","last_updated":"2018-05-31T19:28:23Z","snapshot_observed_at":"2026-08-14T19:08:48.803461Z","submitted_at":"2018-05-31T19:28:23Z","title":"Efficient Low-rank Multimodal Fusion with Modality-Specific Factors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.00064","snapshot_observed_at":"2026-08-07T14:23:02.305101Z","title":"B., Liang, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.305101Z"},"links":{"cited_paper":"/paper/1806.00064","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:c1cb2c8762ce7700fc9829aeb15341d95af3819c655408e2e1967ff5aa2ee556","observation_id":"966b3013-4912-41b2-ab00-4a191c92317a","resolution":{"observed_at":"2026-08-07T14:23:02.305101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:05.553961Z","title":"P., Deng, Z., Salakhutdinov, R., and Morency, L.-P","venue":null,"work_id":"be011995-2ef5-4e2f-9b11-4417ff921f1f","year":2022},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.381505Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:65e94db3607ae53d0084031c1a1115735a26015d98a38b98eae083c88d62b0ff","observation_id":"6d1d36f9-98cd-4807-83e1-a06c9b35c7e6","resolution":{"observed_at":"2026-08-07T14:23:05.621422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:05.408455Z","title":"H., Bai, S., Liang, P","venue":null,"work_id":"0c8b50d8-942d-4713-b245-d4868660c378","year":2019},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.630567Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:290de45149d4e3c6b17b6839bbd149548f6d8075e4356f14f977a516b12aaa6d","observation_id":"50c4bbe0-6005-4061-8440-dcd5e160f817","resolution":{"observed_at":"2026-08-07T14:23:05.483449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:05.208822Z","title":"H., Ma, M","venue":null,"work_id":"14cd344e-ed97-4359-a766-db7862b664ee","year":2020},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.726517Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:7bec34c139b6a52656c5a87b395db1b13e2bdb8976ce5aaa05d4624bac71648c","observation_id":"61bf84b5-1c6d-45e6-8983-4d572e6e49ea","resolution":{"observed_at":"2026-08-07T14:23:05.286200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15828","last_updated":"2025-01-28T20:32:51Z","snapshot_observed_at":"2026-08-14T11:22:31.442033Z","submitted_at":"2024-12-20T12:11:20Z","title":"Measuring Cross-Modal Interactions in Multimodal Models","version":2},"cited_work":{"arxiv_id":"2412.15828","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15828","snapshot_observed_at":"2026-08-07T14:23:03.829711Z","title":"Measuring Cross-Modal Interactions in Multimodal Models","venue":"cs.LG","work_id":"1c556fe4-b323-42db-bbd9-6bc6c60d49c3","year":2024},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.842320Z"},"links":{"cited_paper":"/paper/2412.15828","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:07058c608336fc49114d3e96609f588d48627b56a0c19fb26a46e006e36e1643","observation_id":"a69ac2ef-853c-419c-bc6f-5d164841db81","resolution":{"observed_at":"2026-08-07T14:23:03.897573Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1004.2515","last_updated":"2010-04-14T22:12:52Z","snapshot_observed_at":"2026-08-15T05:21:41.838423Z","submitted_at":"2010-04-14T22:12:52Z","title":"Nonnegative Decomposition of Multivariate Information","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1004.2515","snapshot_observed_at":"2026-08-07T14:23:02.917262Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.917262Z"},"links":{"cited_paper":"/paper/1004.2515","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:f417a2ca025bb4daee4dac44bcfab68fecbd8bfc03fb6a6cc4e9b80d3cb19c60","observation_id":"240d5b20-3a7a-45eb-a173-8298eea74d9e","resolution":{"observed_at":"2026-08-07T14:23:02.917262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:05.072483Z","title":"Beyond additive fusion: Learning non-additive multimodal interactions","venue":null,"work_id":"03f8d923-f826-4b42-94b2-5b065afb61c3","year":2022},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:03.006859Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:94f6e8ff618c27f8c49c3ad4153201f4f832765dfe6e4523d3d74935d8eb04b2","observation_id":"e0c4be47-b762-4d66-bac2-df988fb136d9","resolution":{"observed_at":"2026-08-07T14:23:05.124819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:04.990051Z","title":null,"venue":null,"work_id":"90913bcb-c103-46f5-bd58-094111789f03","year":2024},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:03.090174Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:5a8894bd43c522fa2653f4e2be269ca41a48ed32aadb3e7e8a78aed940eaa3ae","observation_id":"c88d2551-cea6-41b1-8c9d-65b1ec085475","resolution":{"observed_at":"2026-08-07T14:23:05.026656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06259","last_updated":"2016-08-12T02:39:40Z","snapshot_observed_at":"2026-08-14T21:51:56.879375Z","submitted_at":"2016-06-20T19:23:53Z","title":"MOSI: Multimodal Corpus of Sentiment Intensity and Subjectivity Analysis in Online Opinion Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06259","snapshot_observed_at":"2026-08-07T14:23:03.231496Z","title":"Mosi: multimodal corpus of sentiment intensity and subjectiv- ity analysis in online opinion videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:03.231496Z"},"links":{"cited_paper":"/paper/1606.06259","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:76b9b09dab79bee7d910c239bd8e845ef2ec3c45aaad0851bd1f0a835e48dfdb","observation_id":"5fe516e3-ccbe-453c-83a4-9b46d99bfcd0","resolution":{"observed_at":"2026-08-07T14:23:03.231496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:04.784915Z","title":"The Connection between Interaction Loss and PID We link our perturbation-based losses to components in Partial Information Decomposition (PID), following Bertschinger et al","venue":null,"work_id":"65c0d364-20a3-4941-957e-f4025ba4c1fe","year":2014},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:03.316984Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:e6150b7523a986cf7100b35c172328cc8e385c7e346f812dbfeddbb25bdd2166","observation_id":"d3cb7922-81e0-453e-8bbb-fb49ae11d7a0","resolution":{"observed_at":"2026-08-07T14:23:04.885824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:04.531583Z","title":"For the genomics, clinical, and biospecimen modalities, we used a one-hidden-layer MLP with a hidden dimension of 256 as the encoder","venue":null,"work_id":"2cd7a609-dd35-4b30-8b35-2af995a42400","year":2021},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:03.488981Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:ab26bced96fbffaa6b6d75363be2cb23c0610537997935c1e536e0dbf4939441","observation_id":"47ccb5a1-f5a0-4593-bd01-576e8788e313","resolution":{"observed_at":"2026-08-07T14:23:04.562802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07348","last_updated":"2024-10-09T18:01:27Z","snapshot_observed_at":"2026-08-12T22:26:55.893634Z","submitted_at":"2024-10-09T18:01:27Z","title":"MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07348","snapshot_observed_at":"2026-08-07T14:23:01.959332Z","title":"Moe++: Accelerat- ing mixture-of-experts methods with zero-computation experts","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.959332Z"},"links":{"cited_paper":"/paper/2410.07348","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:126253f00c5643d94790cb17cc94a8d942a1b6d4f12559d7a4530fbe5085f60c","observation_id":"71aaedb7-2d88-46d6-b444-47c72670721f","resolution":{"observed_at":"2026-08-07T14:23:01.959332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00316","last_updated":"2023-07-01T12:05:20Z","snapshot_observed_at":"2026-08-13T11:04:37.095512Z","submitted_at":"2023-07-01T12:05:20Z","title":"SHARCS: Shared Concept Space for Explainable Multimodal Learning","version":1},"cited_work":{"arxiv_id":"2307.00316","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.00316","snapshot_observed_at":"2026-08-07T14:23:04.163809Z","title":"SHARCS: Shared Concept Space for Explainable Multimodal Learning","venue":"cs.LG","work_id":"e97f442b-b88d-4f85-902f-f4d21fc08d57","year":2023},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":1999,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.614581Z"},"links":{"cited_paper":"/paper/2307.00316","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:5a2c8b667a15e6aa4b16dfe126966df425a5be9d35b49be895076944b56443c8","observation_id":"292b631c-c336-4964-b233-d67eb38e689c","resolution":{"observed_at":"2026-08-07T14:23:04.237110Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02107","last_updated":"2023-05-25T21:43:07Z","snapshot_observed_at":"2026-08-15T17:38:55.931719Z","submitted_at":"2022-06-05T06:40:15Z","title":"Interpretable Mixture of Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02107","snapshot_observed_at":"2026-08-07T14:23:01.854238Z","title":"A., Arik, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.854238Z"},"links":{"cited_paper":"/paper/2206.02107","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:24adba0e4b3dee69769e5e6b97d38e91f6b5fc3970c48c8e0c5776fcae3f8cae","observation_id":"7cc48df0-c601-43b7-abd5-49395c60ebad","resolution":{"observed_at":"2026-08-07T14:23:01.854238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2012.22002","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:03.678244Z","title":"Yun, S., Choi, I., Peng, J., Wu, Y ., Bao, J., Zhang, Q., Xin, J., Long, Q., and Chen, T","venue":null,"work_id":"a0a9a0ba-754d-4fa6-a666-50338f40481e","year":2012},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:03.195707Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:f18477f019f1e6c671579a35421e0431b4bc185781d0787c6e4b2fbb9329c470","observation_id":"605f23aa-2c97-4f80-bf86-3592ebb77b62","resolution":{"observed_at":"2026-08-07T14:23:03.716790Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07402","last_updated":"2025-03-05T16:48:23Z","snapshot_observed_at":"2026-08-14T03:24:39.753342Z","submitted_at":"2024-09-11T16:42:22Z","title":"What to align in multimodal contrastive learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07402","snapshot_observed_at":"2026-08-07T14:23:01.689425Z","title":"What to align in multimodal contrastive learning? arXiv preprint arXiv:2409.07402,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.689425Z"},"links":{"cited_paper":"/paper/2409.07402","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:b34b28d6c3ad6292363841e3f8bf2efdc2ed635f92234cdf14381091379fe57e","observation_id":"48010a53-95d6-41a8-8391-c88b4f7f2479","resolution":{"observed_at":"2026-08-07T14:23:01.689425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02933","last_updated":"2025-05-28T15:34:43Z","snapshot_observed_at":"2026-08-13T04:26:51.083853Z","submitted_at":"2024-02-05T11:55:50Z","title":"Intrinsic User-Centric Interpretability through Global Mixture of Experts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02933","snapshot_observed_at":"2026-08-07T14:23:02.538824Z","title":"A., Jaggi, M., and K ¨aser, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.538824Z"},"links":{"cited_paper":"/paper/2402.02933","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:431387482ac73b6a75be9fefba34421b9536be1918e6bd92c8c7094ef8b57686","observation_id":"77b51eed-89f5-4c8c-b4e6-fd362622857f","resolution":{"observed_at":"2026-08-07T14:23:02.538824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-07T14:23:02.462048Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.462048Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:679ed3ffa9b4da08984c9875838e5b484b2db6637abeafb6b1e656be04b2e333","observation_id":"a602560f-1c70-4dbe-b13a-ea4af09d828b","resolution":{"observed_at":"2026-08-07T14:23:02.462048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/8269806","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:04.357183Z","title":"ieee.org/document/8269806","venue":null,"work_id":"9c0a2035-bc7f-4c40-8b99-92cb3ab8ee3b","year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.472223Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:fa8de4a6eabd56c6a07f68eca35c2cfe4544e5109c930de6d47e02122d7e0784","observation_id":"9b81df00-ccf6-4dac-bf7a-6ef0abdbe0ff","resolution":{"observed_at":"2026-08-07T14:23:04.436150Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.07191","last_updated":"2020-11-14T01:58:41Z","snapshot_observed_at":"2026-08-15T01:30:08.209573Z","submitted_at":"2020-11-14T01:58:41Z","title":"On the Benefits of Early Fusion in Multimodal Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.07191","snapshot_observed_at":"2026-08-07T14:23:01.550167Z","title":"Bertschinger, N., Rauh, J., Olbrich, E., Jost, J., and Ay, N","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.550167Z"},"links":{"cited_paper":"/paper/2011.07191","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:0c215b10315e007d0530999aadd4ec35f69a53db7c0c32777f679067578296cd","observation_id":"f8de1df8-c640-4084-8832-ba6bd2cb7a12","resolution":{"observed_at":"2026-08-07T14:23:01.550167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.00056","last_updated":"2023-03-06T19:39:18Z","snapshot_observed_at":"2026-08-13T15:13:05.122779Z","submitted_at":"2022-06-30T18:42:06Z","title":"MultiViz: Towards Visualizing and Understanding Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.00056","snapshot_observed_at":"2026-08-07T14:23:02.048124Z","title":"P., Lyu, Y ., Chhablani, G., Jain, N., Deng, Z., Wang, X., Morency, L.-P., and Salakhutdinov, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.048124Z"},"links":{"cited_paper":"/paper/2207.00056","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:c1e0aae7e905ae81c41a7e5f052580a1d47723bc1b73e428060dfc325821d4e9","observation_id":"59e74df3-d81a-4cbf-af50-9b0b6e22da83","resolution":{"observed_at":"2026-08-07T14:23:02.048124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12247","last_updated":"2023-12-10T19:54:36Z","snapshot_observed_at":"2026-08-14T08:28:24.696447Z","submitted_at":"2023-02-23T18:59:05Z","title":"Quantifying & Modeling Multimodal Interactions: An Information Decomposition Framework","version":5},"cited_work":{"arxiv_id":"2302.12247","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.12247","snapshot_observed_at":"2026-08-07T14:23:04.006061Z","title":"Quantifying & Modeling Multimodal Interactions: An Information Decomposition Framework","venue":"cs.LG","work_id":"1da52138-a0cb-4251-8493-e0275d8c46c1","year":2023},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:02.127483Z"},"links":{"cited_paper":"/paper/2302.12247","citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:79aff1855d533f9f7415846dd119ec35420a0e912e612271d97a301ff43a8047","observation_id":"3e78aa34-1bd0-4720-bf5a-ef498d05c0c1","resolution":{"observed_at":"2026-08-07T14:23:04.051400Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:05.731756Z","title":"I., Pohl, K","venue":null,"work_id":"d8eb76d1-a55f-4870-b236-c01dc1818605","year":2018},"citing_paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:01.771613Z"},"links":{"citing_paper":"/paper/2505.19190"},"observation_digest":"sha256:97f31e534ceef2ff84c8f65b84a1b42ff8448c1845fdcc82016d7ac5ac514d4f","observation_id":"7a1bc72e-272b-432e-be3a-432fe345103e","resolution":{"observed_at":"2026-08-07T14:23:05.811500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19190","last_updated":"2025-05-25T15:34:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T18:47:56.717116Z","submitted_at":"2025-05-25T15:34:29Z","title":"I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":14,"verified_exact":3,"verified_fuzzy":7},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 10 inbound Pith citation observations for arXiv:2505.19190."}