{"as_of":"2026-08-08T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73621f4c69ecba55e6f835284e9776a9d4505d4b4d67f8e9bf32c0daaf00ccce","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:59:28.578687Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:59:23.248399Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T14:39:57.205684Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00865","snapshot_observed_at":"2026-08-07T11:59:23.248399Z","title":"σ(·)” is the sigmoid activation function. The final MSR of modality A is computed as: H (GIA)B A =G⊙H A→B + (1−G)⊙H A ∈R tA×d,(4) where “⊙","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.248399Z"},"links":{"cited_paper":"/paper/2506.00865","citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:8c6f87b9cdfdf4bffe6e228eeef59c1c416bcb3fcacd776af27a197a2c8e27fc","observation_id":"7ab1aef3-1351-4d14-9cf1-6d460973fa15","resolution":{"observed_at":"2026-08-07T11:59:23.248399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"cited_work":{"arxiv_id":"2506.00865","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00865","snapshot_observed_at":"2026-07-04T14:39:57.205684Z","title":"Gia-mic: Multimodal emotion recogni- tion with gated interactive attention and modality-invariant learn- ing constraints,","venue":null,"work_id":"824b7f14-127e-44ef-8b4b-ed2a43c02661","year":2025},"citing_paper":{"arxiv_id":"2606.26556","last_updated":"2026-06-25T03:07:34Z","snapshot_observed_at":"2026-08-07T18:42:28.880610Z","submitted_at":"2026-06-25T03:07:34Z","title":"WQ-Fusion: Dynamic Gated Attention for Cross-Domain Audio Representation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T03:21:39.842959Z"},"links":{"cited_paper":"/paper/2506.00865","citing_paper":"/paper/2606.26556"},"observation_digest":"sha256:8c45cf53bcc4ea72b57a67e11d97b285d573b457d422341dc4bdea83fcf92b21","observation_id":"c5a0d5f6-4968-48d2-9724-8502c10f7317","resolution":{"observed_at":"2026-07-04T14:39:57.207293Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00865/citation-record","integrity":"/paper/2506.00865/integrity","json":"/paper/2506.00865/citation-record.json","paper":"/paper/2506.00865"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:34.930549Z","title":"MER has broad applications in fields such as human- computer interaction and intelligent customer service [1]","venue":null,"work_id":"2ac6c2c8-1e53-413c-ba3d-75433144dac1","year":null},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.143238Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:dd2298cb9064f432399d34017754df6e589be579b59db17993dfb2a370fd8d53","observation_id":"bc19b2b7-8c85-4c33-ba3c-04f38832b7d8","resolution":{"observed_at":"2026-08-07T11:59:34.994518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00865","snapshot_observed_at":"2026-08-07T11:59:23.248399Z","title":"σ(·)” is the sigmoid activation function. The final MSR of modality A is computed as: H (GIA)B A =G⊙H A→B + (1−G)⊙H A ∈R tA×d,(4) where “⊙","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.248399Z"},"links":{"cited_paper":"/paper/2506.00865","citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:8c6f87b9cdfdf4bffe6e228eeef59c1c416bcb3fcacd776af27a197a2c8e27fc","observation_id":"7ab1aef3-1351-4d14-9cf1-6d460973fa15","resolution":{"observed_at":"2026-08-07T11:59:23.248399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:34.763114Z","title":"neu- tral","venue":null,"work_id":"2317bac8-0ea9-4c2f-b89c-6866693bab40","year":null},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.384149Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:41c5ab733342e919a90af924d0ab420e0f50895d15317a73c9f3c3ed0fa9e578","observation_id":"9a778160-5422-4318-9b05-04b2697df097","resolution":{"observed_at":"2026-08-07T11:59:34.855076Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:34.641087Z","title":"In contrast, with temporal modality-invariant constraints (γ̸= 0), the three modalities exhibit greater overlap, indicating increased shared information","venue":null,"work_id":"ac7af747-7e86-41ed-a502-d1650b8dce25","year":null},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.527948Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:1306e560f9cf263a530ab81dda22af55117d842d62da01172249902c3d5eddc6","observation_id":"6f4b5f1d-4a8d-41ce-9b8b-b42dd6f96292","resolution":{"observed_at":"2026-08-07T11:59:34.704613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:34.462196Z","title":null,"venue":null,"work_id":"109a9c4f-2286-4265-978b-697a986a1b0e","year":null},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.637815Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:8ad4bac0d8b16fa99069a4a3b57a0de9a1f27715f6075408325edef29d42a416","observation_id":"26d45dde-60ce-42df-b871-5f5ecd441317","resolution":{"observed_at":"2026-08-07T11:59:34.523411Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:34.329221Z","title":null,"venue":null,"work_id":"2010ff35-beea-4085-a8d6-704a19930cfb","year":null},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.777734Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:9c5ffc601987221148f47354ce00b84f2f8170db326f42f82891133869ab99be","observation_id":"d3fc1353-ef8c-4b7c-93a5-e2562340aa70","resolution":{"observed_at":"2026-08-07T11:59:34.396063Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:34.187865Z","title":"Semi-supervised multimodal emotion recognition with consensus decision-making and label correction,","venue":null,"work_id":"645b28a3-719e-4a53-8e19-727e32d8a77d","year":2023},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.933489Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:c7a173e89ead4195020ba1835b3b5654c0677d04cdd02567c348d03e571aa8e9","observation_id":"7e405fe3-0b59-4e0f-8a9e-e2166980ca8b","resolution":{"observed_at":"2026-08-07T11:59:34.250426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:34.052924Z","title":"Group gated fusion on attention- based bidirectional alignment for multimodal emotion recogni- tion,","venue":null,"work_id":"2944aa4f-409e-4ad8-bffc-8816d731a8c8","year":2020},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:24.057833Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:d0c6e426693e6fc11825df5f2975460163a0dbb8cfd824a895e35c413bc9f169","observation_id":"8081ec10-115e-4c9a-b10b-7a304e038981","resolution":{"observed_at":"2026-08-07T11:59:34.115304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:33.924635Z","title":"Speech emotion recognition using recurrent neural networks with directional self- attention,","venue":null,"work_id":"3e8e91ce-be8e-4680-9bb8-53a7cb6b2f83","year":2021},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:24.195063Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:100815d620c762ba8d94965245a929788df0f39fb16317e337561efc1f3d0d81","observation_id":"db7e3cf6-3479-4dce-8db0-e184cd0213c4","resolution":{"observed_at":"2026-08-07T11:59:33.993553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:33.782054Z","title":"Rep- resentation learning with spectro-temporal-channel attention for speech emotion recognition,","venue":null,"work_id":"1826d07c-76e1-4b54-a903-e35705c4874d","year":2021},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:24.335985Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:db9d1b90fbe78e80a847c07bc9973d0940fa007d157bfa1d8fd8dfd6c3fed92b","observation_id":"d11b004a-a64f-4ece-a297-7c359851d7ea","resolution":{"observed_at":"2026-08-07T11:59:33.845325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:33.626585Z","title":"Two- stage framework for robust speech emotion recognition using tar- get speaker extraction in human speech noise conditions,","venue":null,"work_id":"084c951d-5d7a-44f1-87ba-606231e8b2e9","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:24.491841Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:4f6dbc5a07bc57db6864876ef8ef7a1329707d515b2c379a2bfa3fe4beae50b0","observation_id":"66855203-b5bc-43a4-86b3-2000fa4027fd","resolution":{"observed_at":"2026-08-07T11:59:33.710996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:33.340480Z","title":"Joint multi- modal transformer for emotion recognition in the wild,","venue":null,"work_id":"e5c0394c-1113-42ed-99f2-1dd88867d471","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:24.812657Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:37987738d6cf8a85d2261e94f9d8407c8ab52e1cee2a1622d9d6e71a11cda42d","observation_id":"ee317e3d-7045-41e3-8f28-bbd928586d92","resolution":{"observed_at":"2026-08-07T11:59:33.422768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:33.159335Z","title":"Multi-modal video summarization based on two-stage fusion of audio, visual, and recognized text information,","venue":null,"work_id":"922613f9-40a2-4b27-8990-6e65b0abd784","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:24.988583Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:4ca4d1ed8cf5c3379206106ef5404e3ea17ec04c812f548845781a9bd601581a","observation_id":"f25d2e2b-c7c0-4ed6-941e-2e07d5e3ecce","resolution":{"observed_at":"2026-08-07T11:59:33.256684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:33.033681Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"ccac5f1b-04a8-4786-88f3-a9af0e44345f","year":2021},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:25.147085Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:e0736a7632d7d2cd35f1010db5ac640aaf69febf03f43412aac4daf00f005135","observation_id":"1d89398b-36ae-41f0-94a6-0792ac4f9c10","resolution":{"observed_at":"2026-08-07T11:59:33.087262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:32.858519Z","title":"2DP-2MRC: 2-dimensional pointer-based ma- chine reading comprehension method for multimodal moment re- trieval,","venue":null,"work_id":"188770af-9435-45ea-a9be-de4ffb1590b2","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:25.290064Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:e54fb8613ecc557bb72a3f5940f0879a9eff691a66b4ca6e18c24e4d158a2e65","observation_id":"ea071a4c-a7ff-48a9-873f-103b9fc8dc0c","resolution":{"observed_at":"2026-08-07T11:59:32.944082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:32.728494Z","title":"Vision trans- formers need registers,","venue":null,"work_id":"59c795e8-6642-484b-baa1-42741800ebef","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:25.495375Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:6309d7b0f5d2357a82eb9040f4aaf8898716a6463f04127314281191d4f9aa18","observation_id":"065c62eb-0216-4a41-abdf-f3f9063db5ac","resolution":{"observed_at":"2026-08-07T11:59:32.777492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:25.607105Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:25.607105Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:3d08c272e06c0dfeaefd898db82a2304bfecfc4286305f0d9525b95e9cb73ab0","observation_id":"6caa545d-6ff9-4293-a425-b90f8b4c15d0","resolution":{"observed_at":"2026-08-07T11:59:25.607105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:32.573067Z","title":"WavLM: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":"4c5186fa-3fde-4c2b-b2e6-d8f2b777bf87","year":2021},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:25.750641Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:d470ac1fd0290e0476c463e835d51ed0f36d6efcd42006b2ccd8b7b611392349","observation_id":"166f1c40-64f2-48b7-92a7-5961cf76aec8","resolution":{"observed_at":"2026-08-07T11:59:32.630793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:32.435643Z","title":"DeBERTa: Decoding- enhanced bert with disentangled attention,","venue":null,"work_id":"68b2f299-b8e6-48a9-bf73-0346ae6fe7fc","year":2021},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:25.827138Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:c8c8e704f780f5e15e527d95c418fa6c1e21247bc18889313f2aaaf5b9429374","observation_id":"c86caa6d-8552-4099-9a6a-7f9206dda6dd","resolution":{"observed_at":"2026-08-07T11:59:32.486927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:32.261404Z","title":"RoBERTa: a ro- bustly optimized bert pretraining approach,","venue":null,"work_id":"690348df-5856-4027-be77-c304e1bf95ca","year":2020},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:25.968121Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:8dc98f19d7bb672d4a51f6751c60fd49832fc068385fdf53f460ec1de52a2478","observation_id":"7abff183-4f04-4dba-9de0-6d084419106b","resolution":{"observed_at":"2026-08-07T11:59:32.354961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:32.090382Z","title":"Multi-modal speech emotion recognition using self-attention mechanism and multi-scale fusion framework,","venue":null,"work_id":"fa1833b6-43ed-4aeb-88f9-8858fd69dbb6","year":2022},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.107028Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:9869efdc887cd86237752871c6acdee90e4b669cb28ffcd917c4881faf8f5de1","observation_id":"5d1936fc-f6a0-4989-b9d1-5ae08f68786a","resolution":{"observed_at":"2026-08-07T11:59:32.194554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:31.820232Z","title":"Recursive joint cross-modal atten- tion for multimodal fusion in dimensional emotion recognition,","venue":null,"work_id":"92a26bbe-ddc0-4bc9-813d-0b628b077838","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.248927Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:219291952998f73061a3aec3b6a728287b338fa23b214f485d013d06a2785382","observation_id":"56a5fe58-39aa-48b0-ad16-e7a547e115aa","resolution":{"observed_at":"2026-08-07T11:59:31.946974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:31.599953Z","title":"Delving deep into rectifiers: Surpassing human-level performance on imagenet classification,","venue":null,"work_id":"c75b8081-29d1-4237-9a79-d1caa84c6ae8","year":2015},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.350928Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:025c0174137ecb59b674b8c731c0808d30786615960f58ef31fd12db0c7bb2a8","observation_id":"8ef890e3-45f5-43d0-868b-c2ff9f5e67fc","resolution":{"observed_at":"2026-08-07T11:59:31.712622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T11:59:26.478789Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.478789Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:0f2f49d068d28d356afe4332d96ce701dabaadcf9887508b8835c4b76dac2bb3","observation_id":"87f76af6-21fa-4281-908a-d6703a4c6d5b","resolution":{"observed_at":"2026-08-07T11:59:26.478789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:31.347583Z","title":"Adam: A method for stochastic opti- mization,","venue":null,"work_id":"bed5d314-b7f9-4ad3-9dfc-5a8963e80e2c","year":2015},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.596799Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:78ef6747a1b2084da130b6fdef69b203f70151e6322f9ae89f02b9337187d955","observation_id":"0a2d5de7-3ee3-4e89-8d34-dedecea7278b","resolution":{"observed_at":"2026-08-07T11:59:31.459504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:26.737858Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.737858Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:36ef2d36f2a6c78c9fba8eac884955310caf0ef028d900b7768c79180fae6c10","observation_id":"687f4d41-88be-4f95-af18-efbcd1438897","resolution":{"observed_at":"2026-08-07T11:59:26.737858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:26.868632Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.868632Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:3f71ec7e4d0ba59cbdbede919a82699a846937f2958b173ed18ca73fb2db2b37","observation_id":"98ddc04b-6f34-4899-a02d-8dc8970c31d9","resolution":{"observed_at":"2026-08-07T11:59:26.868632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:31.168514Z","title":"Robust multi-modal speech emotion recog- nition with ASR error adaptation,","venue":null,"work_id":"64f68580-531e-4e48-b7ec-1f9e2c530f29","year":2023},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:26.999012Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:8199cc9ec7b20bda39decb51553446c47532e98169af5e560ba15f8224db26be","observation_id":"f433f3a4-e6aa-44c3-a7f2-a9574f352762","resolution":{"observed_at":"2026-08-07T11:59:31.242060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:30.973761Z","title":"MGAT: Multi-granularity attention based transformers for multi-modal emotion recogni- tion,","venue":null,"work_id":"f2452a05-a2ff-4c16-96d1-ecbd57c66cd1","year":2023},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.119178Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:e80310f58f3ca5edaf3fe3cce92f1757a050bfe77c441f93b92c568818e2f9b1","observation_id":"bdc38a25-3b68-4b66-9785-6f93feccb868","resolution":{"observed_at":"2026-08-07T11:59:31.082236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:30.540413Z","title":"Inter-modality and intra- sample alignment for multi-modal emotion recognition,","venue":null,"work_id":"23ecf9d8-a737-4ad3-b277-028889e35b04","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.282021Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:101b8c2bea93d947ad0b7b49bec55e4a7efea4e771740af28e2a606f25cd45f3","observation_id":"0234421f-fc61-49ef-95f9-0344148dc85b","resolution":{"observed_at":"2026-08-07T11:59:30.665330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:27.413536Z","title":"A study on multimodal fusion and layer adapter in emotion recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.413536Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:cd70261b64f1899f9cd199feac3128db8625092e22b3ede12c31dd3c7f297b0f","observation_id":"2c7c1648-d1c8-4f07-8d8f-a14878168072","resolution":{"observed_at":"2026-08-07T11:59:27.413536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:30.332147Z","title":"MF-AED-AEC: Speech emo- tion recognition by leveraging multimodal fusion, ASR error de- tection, and ASR error correction,","venue":null,"work_id":"845e10c4-cfed-40ab-a410-96c9c9a3b368","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.533420Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:ece1f0179a5666d62117e6c79ab347507323c2e7eaa614fc3a5610042b2ae6f4","observation_id":"32c4f954-22ae-45cb-b9b3-d69412436949","resolution":{"observed_at":"2026-08-07T11:59:30.437784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:33.496478Z","title":"Multi-modal emotion recognition using multiple acoustic features and dual cross-modal transformer,","venue":null,"work_id":"e95e7303-0bba-4c5d-a7c8-d9808b3538d9","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.646207Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:929c11778ed91478a5db18b8cacb5d7c013bc1ce537088ffb96af599dd17570f","observation_id":"83fd8ae2-0f3f-4455-8347-bf0ae7cb28aa","resolution":{"observed_at":"2026-08-07T11:59:33.542026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:30.101549Z","title":"Fine- grained disentangled representation learning for multimodal emo- tion recognition,","venue":null,"work_id":"f543d858-7332-4a50-a1b0-3f3b886a5376","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.750420Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:68acd692184f56354adfaa2ff1019f56bd6e5594122dab5951a941287062d114","observation_id":"81998141-f00a-481b-9bac-4efba4a0a4dd","resolution":{"observed_at":"2026-08-07T11:59:30.193336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:29.794387Z","title":"Coordination attention based transformers with bidirectional contrastive loss for multimodal speech emotion recognition,","venue":null,"work_id":"60303f3e-0958-4c6c-8550-15ab55263529","year":2025},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.883216Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:9be914a193437579a02b8e4ff922b54ceacbac4716ce74ccd1537c9a8c202e09","observation_id":"8584cccf-3726-44a8-940c-2a3fb033fa7f","resolution":{"observed_at":"2026-08-07T11:59:29.956302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:29.522778Z","title":"Multi- channel weight-sharing autoencoder based on cascade multi-head attention for multimodal emotion recognition,","venue":null,"work_id":"3dc548fa-1342-4d40-8a0e-abcdd99118f6","year":2022},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:27.988364Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:7be8e3819d8f95f3b624e5840d16cb8375eae4514907e25fda0d30ea402ded64","observation_id":"79e3a1bb-016c-4c89-a6bd-52b6aac5711c","resolution":{"observed_at":"2026-08-07T11:59:29.653766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:29.318072Z","title":"GCNet: Graph completion network for incomplete multimodal learning in con- versation,","venue":null,"work_id":"51c616be-664b-4b3f-83c1-534b8001e949","year":2023},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:28.091206Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:3a86b56bbc9504d6c0f7ec10e137b3309f962e2f1b3fd0f6b702e27817837bf9","observation_id":"088ab72d-73a0-4f2e-abfb-a6eb213b5e01","resolution":{"observed_at":"2026-08-07T11:59:29.398038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:29.117326Z","title":"Enhancing modal fusion by alignment and label matching for multimodal emotion recognition,","venue":null,"work_id":"b36074bf-2471-4ec7-9a11-823cb12140b0","year":2024},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:28.172997Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:6e432a863fd278290e89d8de092bce3ec8025515cbbd21be2812eea442e4c8bf","observation_id":"6858b969-cbac-44ab-ab09-d518e54b1d7b","resolution":{"observed_at":"2026-08-07T11:59:29.227665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:28.943659Z","title":"Semi-supervised multi-modal emo- tion recognition with cross-modal distribution matching,","venue":null,"work_id":"12332a7a-7263-4121-bc3b-644e887e0c96","year":2020},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:28.275435Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:ce659d5e5862d6afa58754cb91fb7cfdaa1f46579eb75acf9ed5e298b28b54e5","observation_id":"2e512711-db6d-4c7e-9d46-d07bb0c4139c","resolution":{"observed_at":"2026-08-07T11:59:29.022256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:28.870676Z","title":"Adaptive multimodal emotion detection architecture for social robots,","venue":null,"work_id":"a15943fd-9298-40fa-93a6-5290bc7ed626","year":2022},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:28.402964Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:55c906b89cc6db085338294acbda1f258d19f1f1bd62c3f42fae54bf3f12b7e6","observation_id":"5a4ffecd-649c-4a38-b9bd-6764ca0b37c1","resolution":{"observed_at":"2026-08-07T11:59:28.902320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:28.697755Z","title":"A framework to evaluate fusion methods for multimodal emotion recognition,","venue":null,"work_id":"125f303e-c6cb-489f-8139-9aa04aac6e99","year":2023},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:28.493365Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:1aff21373ee63f83e85e2c62db3f81c2ce62395bf6d9f55208de7a8780f61c39","observation_id":"e8bbe38b-4eda-4815-931a-dcb797135413","resolution":{"observed_at":"2026-08-07T11:59:28.762919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:59:28.578687Z","title":"Visualizing data using t-sne,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:28.578687Z"},"links":{"citing_paper":"/paper/2506.00865"},"observation_digest":"sha256:bb75c69a28732a66f629c5296c231ef0cf369a54aa560185386141033b53204a","observation_id":"bac2de42-fb81-47b2-a5dc-77609e82771d","resolution":{"observed_at":"2026-08-07T11:59:28.578687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.00865","last_updated":"2025-06-01T07:07:02Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T11:53:58.579646Z","submitted_at":"2025-06-01T07:07:02Z","title":"GIA-MIC: Multimodal Emotion Recognition with Gated Interactive Attention and Modality-Invariant Learning Constraints"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2506.00865."}