{"as_of":"2026-08-17T21:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a984f541f38b95af04e13483f770647a175aa0afc537df20e78513a4789aaed","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:51:46.996181Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:51:46.891087Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-08T00:49:09.573510Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17446","snapshot_observed_at":"2026-08-15T15:51:46.891087Z","title":"…E#$ BiPeepholeLSTM …E#% …𝑀!VisualembeddingLayer TransformerEncoder…𝑀","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.891087Z"},"links":{"cited_paper":"/paper/2509.17446","citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:94d6bad2d0dc2ef3e9da269dad6e2169bcc466b692923a7c91bf2528170caa8c","observation_id":"f528d143-3c65-4591-bbea-a709f30617cc","resolution":{"observed_at":"2026-08-15T15:51:46.891087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"cited_work":{"arxiv_id":"2509.17446","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.17446","snapshot_observed_at":"2026-08-08T00:49:09.573510Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","venue":"cs.LG","work_id":"057f8c76-9529-4852-8910-0c34099350db","year":2025},"citing_paper":{"arxiv_id":"2608.04054","last_updated":"2026-08-04T10:55:51Z","snapshot_observed_at":"2026-08-17T16:58:49.363506Z","submitted_at":"2026-08-04T10:55:51Z","title":"Modality Agreement- and Conflict-Aware Prototype Hypergraph Learning for Multimodal Intent Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T00:49:09.503196Z"},"links":{"cited_paper":"/paper/2509.17446","citing_paper":"/paper/2608.04054"},"observation_digest":"sha256:7b80b76dba51be180b4747d21da9b0fe2e8a83065579f9b84ea71a6dfa004e97","observation_id":"b3106e20-e87d-4058-8b4d-fc168df99611","resolution":{"observed_at":"2026-08-08T00:49:09.580828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.17446/citation-record","integrity":"/paper/2509.17446/integrity","json":"/paper/2509.17446/citation-record.json","paper":"/paper/2509.17446"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17446","snapshot_observed_at":"2026-08-15T15:51:46.891087Z","title":"…E#$ BiPeepholeLSTM …E#% …𝑀!VisualembeddingLayer TransformerEncoder…𝑀","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.891087Z"},"links":{"cited_paper":"/paper/2509.17446","citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:94d6bad2d0dc2ef3e9da269dad6e2169bcc466b692923a7c91bf2528170caa8c","observation_id":"f528d143-3c65-4591-bbea-a709f30617cc","resolution":{"observed_at":"2026-08-15T15:51:46.891087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.542056Z","title":"Model Overview As illustrated in Fig","venue":null,"work_id":"f8995c9d-4ae3-4b8b-bdee-6a2224babcdf","year":null},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.896312Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:b8e2c2e2f0a7641738cd2058300842441a67cf6f668b5e36dd2b1836835f5664","observation_id":"5567a18e-07cc-4aba-ace6-2e1514b45ff2","resolution":{"observed_at":"2026-08-15T15:51:47.546471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1875.6676","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.266246Z","title":null,"venue":null,"work_id":"fa08192a-6937-4515-9fd2-eda182a64e71","year":null},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.901222Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:739dc24d8bfd0ff382b6b39cc92f3095e1b5589baf450efc5dbf4fa1d2deb074","observation_id":"90a68bb4-30f6-4c65-8d03-33eea146f003","resolution":{"observed_at":"2026-08-15T15:51:47.273979Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.528248Z","title":null,"venue":null,"work_id":"51446ce9-e2f8-4f8a-b4a6-5b4376b7dbd7","year":null},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.906048Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:30b4ef40e279061da494042d4a142835eded148b27071a1edc4633e7b37b7e0d","observation_id":"b0f42847-ed54-4637-a397-574b2270c050","resolution":{"observed_at":"2026-08-15T15:51:47.532950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.515343Z","title":null,"venue":null,"work_id":"9483d5d0-8070-421d-be55-472ecd8bd7cd","year":null},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.910514Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:2af88eb941b598c7da22cea87db5ebc0d3c0601f7df677553886fb0761f9d4ec","observation_id":"2d4d5bcf-f8a5-4021-bbde-ae522dfce194","resolution":{"observed_at":"2026-08-15T15:51:47.519408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.22934","last_updated":"2025-07-24T17:12:01Z","snapshot_observed_at":"2026-08-17T05:45:02.456557Z","submitted_at":"2025-07-24T17:12:01Z","title":"Deep Learning Approaches for Multimodal Intent Recognition: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.22934","snapshot_observed_at":"2026-08-15T15:51:46.914985Z","title":"Deep learning ap- proaches for multimodal intent recognition: A survey,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.914985Z"},"links":{"cited_paper":"/paper/2507.22934","citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:f653670253cda38a26f461b5061fe97945415c2582bf84443cc8f037fa71dc66","observation_id":"e48c8a52-375c-4de8-9d13-b36269182ee9","resolution":{"observed_at":"2026-08-15T15:51:46.914985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.502877Z","title":"Temporal working memory: Query- guided segment refinement for enhanced multimodal understanding,","venue":null,"work_id":"ee28d272-ac06-4d2c-a6f0-0f48dc53ca5b","year":2025},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.919561Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:6a7df00a147859c707048ed10785d6a285c7bb4d54742cf146391ca7d5aa20e7","observation_id":"bc6046f5-a54f-421d-9d01-f2a1a218b18c","resolution":{"observed_at":"2026-08-15T15:51:47.506674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.489539Z","title":"To- wards visual-prompt temporal answer grounding in in- structional video,","venue":null,"work_id":"cc1e936d-e612-41ec-8888-0ca43057d658","year":2024},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.923324Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:56e1303a2facdcbd5ff7a8e0504fe4eaf59685876b3a40032c77fe4f2395e1ac","observation_id":"2b22f4fc-0697-4edd-a33c-aa678ca08fa9","resolution":{"observed_at":"2026-08-15T15:51:47.494272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:46.926883Z","title":"Visual document understand- ing and question answering: A multi-agent collabora- tion framework with test-time scaling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.926883Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:40e30d31310e47aa4c86cc47ac8c49856cb590035a229ab27eae805b19a6b977","observation_id":"f4672e7e-dde4-42b1-9222-ebcebf606a84","resolution":{"observed_at":"2026-08-15T15:51:46.926883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.476433Z","title":"Multimodal transformer for un- aligned multimodal language sequences,","venue":null,"work_id":"d6b57c6d-469f-4347-b3af-d40331c68d2a","year":2019},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.930606Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:44cdbab14df502b65dcfaf50ceb9df7b4d699fdf342e209c2b38868bd677aa51","observation_id":"de325dd4-b4e6-40af-b9dd-ddb49be69200","resolution":{"observed_at":"2026-08-15T15:51:47.480557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.463567Z","title":"Adaptive mul- timodal fusion: Dynamic attention allocation for intent recognition,","venue":null,"work_id":"095875ca-a850-4a27-876a-7019fb8417c8","year":2025},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.934791Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:62f692a87f9a9ca13830469f624cc21c4bbc2f84f070b74b8c9463e73d273dd7","observation_id":"5b2d2083-93f1-4545-9bcc-b0812502239d","resolution":{"observed_at":"2026-08-15T15:51:47.467553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.450259Z","title":"Multimodal transformer with multi-scale alignment for multimodal sentiment analysis,","venue":null,"work_id":"18d576bc-892b-488e-9e7b-e2709ff2e546","year":2021},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.938626Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:fcc26107e74573d3a56577b13ca1c8d1ea170df34f941fb3f615ab716ba7e325","observation_id":"6000014f-e138-4efc-b697-2d60ff710782","resolution":{"observed_at":"2026-08-15T15:51:47.454648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00412","last_updated":"2021-09-16T08:32:03Z","snapshot_observed_at":"2026-08-16T17:59:29.798827Z","submitted_at":"2021-09-01T14:45:16Z","title":"Improving Multimodal Fusion with Hierarchical Mutual Information Maximization for Multimodal Sentiment Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.00412","snapshot_observed_at":"2026-08-15T15:51:46.942355Z","title":"Improving multimodal fusion with hierarchical mutual information maximiza- tion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.942355Z"},"links":{"cited_paper":"/paper/2109.00412","citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:a98df8e4bab5ffd454796233b72a7cbd2b33fe166f97c00ae8b11e6b0dc654de","observation_id":"7da4ab5b-a2fa-4629-8a4b-a046ceb2c561","resolution":{"observed_at":"2026-08-15T15:51:46.942355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.436322Z","title":"Dynamic multimodal fu- sion,","venue":null,"work_id":"bd82f57b-ee56-4bf8-bc53-50253c99a961","year":2023},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.946140Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:891d393715ed6fee538df29f5554ba3080b79ef2980eae6e5d43338cc786716a","observation_id":"0ddd00f2-d4fa-4101-9bce-1ed40ecc9cc9","resolution":{"observed_at":"2026-08-15T15:51:47.440593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.423749Z","title":"Token-level contrastive learning with modality-aware prompting for multimodal intent recog- nition,","venue":null,"work_id":"632e9e3b-220d-4902-9356-99c0597d03be","year":2024},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.949590Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:d67de521f789076f57657ef7bf16af8c5bef4cca6773aaa829ee853ea55351f3","observation_id":"725afab5-e854-41c6-a824-0e55ab6f22e1","resolution":{"observed_at":"2026-08-15T15:51:47.427623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05268","last_updated":"2023-10-30T05:31:05Z","snapshot_observed_at":"2026-08-17T13:14:52.355343Z","submitted_at":"2023-06-08T15:17:04Z","title":"Factorized Contrastive Learning: Going Beyond Multi-view Redundancy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05268","snapshot_observed_at":"2026-08-15T15:51:46.953000Z","title":"Factorized contrastive learning: Go- ing beyond multi-view redundancy,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.953000Z"},"links":{"cited_paper":"/paper/2306.05268","citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:932bbd85d46af7e256ec7506fe7877dd3dfdbb7dbeb0b055fa4bea77979f629c","observation_id":"f6560aa6-3759-4685-af4e-8dd0cb368bbd","resolution":{"observed_at":"2026-08-15T15:51:46.953000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-08-14T18:53:38.574749Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-15T15:51:46.957027Z","title":"Representa- tion learning with contrastive predictive coding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.957027Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:dc3b4f120be0cd9b9356305570f5a611938ea08477aeb4988da2bdbe218ca80d","observation_id":"1df649bb-1446-4120-9b21-e40bca68dbd0","resolution":{"observed_at":"2026-08-15T15:51:46.957027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.411176Z","title":"Mag-bert: Multimodal adapta- tion gate bert for multimodal sentiment analysis,","venue":null,"work_id":"9bb3852f-fe5e-4f06-9bff-c5535a2f2b19","year":2020},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.960653Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:e1424d48e36dbd78bbfbaf8ef67308d4502438dc1c4c0f9d7341e468d349e48e","observation_id":"6b1392ee-69b7-4f76-9a83-7fa95d545827","resolution":{"observed_at":"2026-08-15T15:51:47.415072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.398311Z","title":"Super- vised contrastive learning,","venue":null,"work_id":"81bb8cb9-902a-4ca9-bca7-f8eb58c970fc","year":2020},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.964160Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:6270f3062b88a8d864b46124c61e28ef2e5d2600df2130fafb672c0dcb3e87cb","observation_id":"d6829b96-a73a-483e-b91e-3d4e67226f81","resolution":{"observed_at":"2026-08-15T15:51:47.402249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.385497Z","title":"Contextual augmented global contrast for multimodal intent recog- nition,","venue":null,"work_id":"69cb577d-e1e7-43a3-a7c4-569103ac11eb","year":2024},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.968055Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:60e41f8897c20f75e608390d14c5f560cadbc8d5d9ba1bfbae6d1ae1dfc3384b","observation_id":"21c51923-216d-4caf-8526-ffb2664bc9f1","resolution":{"observed_at":"2026-08-15T15:51:47.389489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.369793Z","title":"Prototypical net- works for few-shot learning,","venue":null,"work_id":"4b84b11c-2eff-4896-95b1-69e4ffb76935","year":2017},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.971689Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:30e1abd41c3b4d3328c5bbea5c3e895d4fac3aa3b2936752014775b11e154fc2","observation_id":"4bc8d6e4-68b3-439c-acc2-7c90437a8740","resolution":{"observed_at":"2026-08-15T15:51:47.375484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.354794Z","title":"Mintrec: A new dataset for multimodal intent recognition,","venue":null,"work_id":"8130ff10-a00e-43a4-ab1c-da83fa71dfdb","year":2022},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.975806Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:f7cbb4b809f36f834253a82b10e57d8b16750577008162a1533a0d182ce5e99b","observation_id":"784331fc-9e48-4d4a-997b-281675232a6b","resolution":{"observed_at":"2026-08-15T15:51:47.358934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.341541Z","title":"Mintrec2.0: A large-scale benchmark dataset for multimodal intent recognition and out-of- scope detection in conversations,","venue":null,"work_id":"3ee2f822-9981-46f3-82aa-0be614b58e24","year":2024},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.980139Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:ea2c22bd914ac5a685e31218e48cc840985b4f4482c49245e549e6d461be6b17","observation_id":"933be9cd-5da7-4c99-a6c3-6a247770e382","resolution":{"observed_at":"2026-08-15T15:51:47.345706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.327877Z","title":"Understanding con- trastive representation learning through alignment and uniformity on the hypersphere,","venue":null,"work_id":"754f1b7c-e129-44d0-974c-e56f19fe20bd","year":2020},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.984268Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:214826449e04d3aaeedc11031ecf5bf7cdd0f9c68c6a681c0f70414fd8818a7b","observation_id":"03986d9a-d258-4798-b590-7c29da0d16be","resolution":{"observed_at":"2026-08-15T15:51:47.332076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.314363Z","title":"Can contrastive learning avoid short- cut solutions?,","venue":null,"work_id":"0c0eb7c1-9a1d-499a-885c-48afdf7a8a57","year":2021},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.988416Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:7ac787c1d96662ce9ab25dfb7941c8968db0dacf2fc00bc59d1406b2a81d5835","observation_id":"d07c04cb-57af-4065-ab7c-fe834c1ae367","resolution":{"observed_at":"2026-08-15T15:51:47.318269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02995","last_updated":"2023-03-06T09:44:01Z","snapshot_observed_at":"2026-08-16T15:50:32.957182Z","submitted_at":"2023-03-06T09:44:01Z","title":"HiCLIP: Contrastive Language-Image Pretraining with Hierarchy-aware Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.02995","snapshot_observed_at":"2026-08-15T15:51:46.992396Z","title":"Hiclip: Contrastive language-image pretraining with hierarchy-aware attention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.992396Z"},"links":{"cited_paper":"/paper/2303.02995","citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:993215a64712608a1e27716147dae14dcdf80d7c38db171a41ee77e65d5958ec","observation_id":"82b0a686-7890-495e-8ac5-d004893d7a58","resolution":{"observed_at":"2026-08-15T15:51:46.992396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:51:47.299575Z","title":"Attention bottlenecks for multimodal fusion,","venue":null,"work_id":"5972ceea-382e-4fbe-b315-c5c9e2c7d24c","year":2021},"citing_paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T15:51:46.996181Z"},"links":{"citing_paper":"/paper/2509.17446"},"observation_digest":"sha256:d881f9cb3c6793ed6a0b702efce988e04ebc709cca7f07e2f6ec2de2896ec627","observation_id":"ec593fda-efe6-4013-920b-613fda3256ba","resolution":{"observed_at":"2026-08-15T15:51:47.304860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.17446","last_updated":"2026-06-08T05:25:05Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T05:46:19.935928Z","submitted_at":"2025-09-22T07:38:53Z","title":"MVCL-DAF++: Enhancing Multimodal Intent Recognition via Prototype-Aware Contrastive Alignment and Coarse-to-Fine Dynamic Attention Fusion"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 2 inbound Pith citation observations for arXiv:2509.17446."}