{"as_of":"2026-08-08T22:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b56ccb6bb356a56f266782a5536ad3ba9398fcd00586d8a3275fcca737a611f","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:25:42.697041Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19010/citation-record","integrity":"/paper/2505.19010/integrity","json":"/paper/2505.19010/citation-record.json","paper":"/paper/2505.19010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:37.872689Z","title":"Multimodal machine learning: A survey and taxonomy,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:37.872689Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:47296956bb1255c4428fda68996889e559d14c654b52dda45692c6a7ea624978","observation_id":"7426dc14-bf73-4f5e-b7ac-79213c5db4ea","resolution":{"observed_at":"2026-08-07T14:25:37.872689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.167030Z","title":"Multimodal deep learning","venue":null,"work_id":"bfc79648-7beb-4b2f-851e-3af06ce26e6a","year":2011},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:37.942594Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:b08680ca1cec041e3f653e11d3c90a316f690aa45c96aefa2627dd043eb64904","observation_id":"f24c4196-a0a5-424c-ac26-7860ebe3edc7","resolution":{"observed_at":"2026-08-07T14:25:44.171133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.155757Z","title":"Emogif: A multimodal approach to detect emotional support in animated gifs,","venue":null,"work_id":"31cbe63e-d049-4267-a7ae-039952709ac2","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.027417Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:69ccc54f8f74de30648b801b1a20aaff86c311ad7b3d1a0bba7718eba1b91267","observation_id":"2b420d81-273b-4fdd-ac56-9acab1fcb84b","resolution":{"observed_at":"2026-08-07T14:25:44.160580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.146314Z","title":"Show, attend and tell: Neural image caption generation with visual attention,","venue":null,"work_id":"f658dbbd-fd8c-44fc-848d-c11b80cc5f4d","year":2015},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.111524Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:d1d9f9a92c851b60a24afc4a395e982de2459b92ebd85b744727d1cd1ce2dbd3","observation_id":"902f643d-cccd-451a-8b66-850a5ffae337","resolution":{"observed_at":"2026-08-07T14:25:44.149666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.135224Z","title":"Multiseao-mix: A multimodal multitask framework for sentiment, emotion, support, and offensive analysis in code-mixed setting,","venue":null,"work_id":"57631baf-a5f8-44be-a14f-f6768524807b","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.187381Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:50a211957b8993bfcd61af13c9da34f9cd5131ce6b8c6af06a5250fb0b3379f9","observation_id":"c4a83c42-d133-4e0c-ba31-b529b1748ae2","resolution":{"observed_at":"2026-08-07T14:25:44.139487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:38.279116Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.279116Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:22f8487fa88e718ef6837cac85b987afe3779b5bd705d2fd286a8283f8108746","observation_id":"5d41d327-900d-4882-b56f-2318326761f3","resolution":{"observed_at":"2026-08-07T14:25:38.279116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.119260Z","title":"Multilingual denoising pre-training for neural machine translation,","venue":null,"work_id":"236dd58d-02f1-403d-a445-891a24707390","year":2020},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.370581Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:ec2ab0afbd75de943958a3f97889c9185045ab49e52ca07cfc27d610634b3ec6","observation_id":"16e166f3-61b0-48d1-938a-a71918818feb","resolution":{"observed_at":"2026-08-07T14:25:44.123745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.108969Z","title":"Unsupervised cross-lingual repre- sentation learning,","venue":null,"work_id":"0a2be851-1659-48a2-adb5-50958ed8d584","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.470642Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:9b7d49c5ec5a3d9ca432f9d9980ddd8cd36e40183c8db7322065f97c2e38b7e2","observation_id":"658d7049-9d45-493b-b371-e5ebc9a0f820","resolution":{"observed_at":"2026-08-07T14:25:44.112907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.098784Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":"eccd7b04-d8ce-4efa-9a7d-3dacff4dd034","year":2012},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.552713Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:082763c2094fe769a09db600458480b0c0824639533ac2e12bd3bf740223c78b","observation_id":"7a3f7d40-4490-4c78-8346-0d8f285a8c6c","resolution":{"observed_at":"2026-08-07T14:25:44.102214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:38.624541Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.624541Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:4e301fc95b50fbee632e219b577880cc866801e7a288c990ce6d7ce1c5c6ad5c","observation_id":"6d7b13d8-ce9c-4d2d-9382-3a8f5f05fb59","resolution":{"observed_at":"2026-08-07T14:25:38.624541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T14:25:38.661836Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.661836Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:84419a147041fbf9d3250bb90bd86144d09e5009ea46c38e393606c9a2302f29","observation_id":"f1d1876b-3b70-424b-8a05-1bea3487143f","resolution":{"observed_at":"2026-08-07T14:25:38.661836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:38.750840Z","title":"Vilbert: Pretraining task-agnostic visiolinguistic representations for vision-and-language tasks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.750840Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:2907da9624c733997125a58babf69b02a82837a6ceffea234a428540ca157eb3","observation_id":"dd71c400-66c0-4fef-b5a6-a41928fc1343","resolution":{"observed_at":"2026-08-07T14:25:38.750840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-06T03:44:36.669916Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-07T14:25:38.844816Z","title":"Lxmert: Learning cross-modality encoder representations from transformers,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.844816Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:2636649c8cffd247fa28a64b43e1c20cdd9edc0fe73439246036273a896edc6e","observation_id":"ad827976-8831-489f-b4b5-16461dbe007a","resolution":{"observed_at":"2026-08-07T14:25:38.844816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.03557","last_updated":"2019-08-09T17:57:13Z","snapshot_observed_at":"2026-08-07T01:39:40.489262Z","submitted_at":"2019-08-09T17:57:13Z","title":"VisualBERT: A Simple and Performant Baseline for Vision and Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.03557","snapshot_observed_at":"2026-08-07T14:25:38.941875Z","title":"Visualbert: A simple and performant baseline for vision and language,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.941875Z"},"links":{"cited_paper":"/paper/1908.03557","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:595b1cfe06f42712c565993d5302e4d2ada52534a913978a8d4e0aff18c9facd","observation_id":"c6891c61-a7a7-47f5-8ff2-e98e354b9148","resolution":{"observed_at":"2026-08-07T14:25:38.941875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.077044Z","title":"Uniter: Learning universal image-text representations,","venue":null,"work_id":"0df247c7-c019-4ab3-bc3d-41f068a28bbe","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.053643Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:146340d9fcecf53f9bcb2f39141a89b3cf1d742e5e8387cc128f75ee9d2c1912","observation_id":"44702e3d-d257-4b8d-bf43-a3528f56e3dd","resolution":{"observed_at":"2026-08-07T14:25:44.080800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.065633Z","title":"Dimension-wise gated cross-attention for multimodal sentiment analysis,","venue":null,"work_id":"c2c9642c-3ae2-4dfc-b219-56cc616a8ece","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.162101Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:724b4de38b001cfa85b5675bc5b2dbe08cc7cb40a6242b28fec72ed86d17fecc","observation_id":"6ea5b5c5-9a58-4e88-98ab-87d2a4d5813e","resolution":{"observed_at":"2026-08-07T14:25:44.069844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:39.289878Z","title":"Multimodal transformer for unaligned multimodal language sequences,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.289878Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:15310da2f3c3746e2f605b7b24118ab543cb1f4e2fc4a8d5e13e7890772dff0a","observation_id":"3ee61b13-c91d-4c1f-844d-3ed3e0a293fe","resolution":{"observed_at":"2026-08-07T14:25:39.289878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.048688Z","title":"Relation-aware graph attention network for visual question answering,","venue":null,"work_id":"8c45a258-4fec-4f27-aa1a-cec8a4b4746e","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.406775Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:eb8850c3da056c6a7af72246b1ffe3df484e191145ee8792de0db84652596182","observation_id":"4a72b04b-181d-4c65-9fce-f816c012b36e","resolution":{"observed_at":"2026-08-07T14:25:44.052668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.037463Z","title":"Multi-modal discussion transformer: Integrating text, images and graph transformers to detect hate speech on social media,","venue":null,"work_id":"f11fe623-fae2-444f-b9dd-49d39deeacdf","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.523915Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:96baaf57aabc570dd2c2b4754622532ce0b17d652fc2db113837449fc865cb28","observation_id":"5fed8fd8-0564-41d0-aaea-03421edce743","resolution":{"observed_at":"2026-08-07T14:25:44.042456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.026897Z","title":"Multimodal sentiment analysis in realistic environments based on cross-modal hierarchical fusion network,","venue":null,"work_id":"46b87fba-90fa-4189-b857-8b1f1bdff817","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.599546Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:f96e691ebfb3a38e4915c53c38c2ef345693bad0885e7dfc74b4b28d4de3b8f2","observation_id":"d93366e1-d6b7-4950-899b-982d557f0de2","resolution":{"observed_at":"2026-08-07T14:25:44.030708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02950","last_updated":"2020-11-12T03:08:28Z","snapshot_observed_at":"2026-07-06T08:19:42.994042Z","submitted_at":"2019-09-06T14:59:18Z","title":"Supervised Multimodal Bitransformers for Classifying Images and Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02950","snapshot_observed_at":"2026-08-07T14:25:39.720399Z","title":"Super- vised multimodal bitransformers for classifying images and text,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.720399Z"},"links":{"cited_paper":"/paper/1909.02950","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:fdac814c05827d42e9a194ef772414a2e1ca3ad12414c3fba7fe23a718aecc7f","observation_id":"4c4ec39b-7d84-4557-a1c6-48705d2ba659","resolution":{"observed_at":"2026-08-07T14:25:39.720399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06218","last_updated":"2022-02-13T05:39:47Z","snapshot_observed_at":"2026-07-06T12:37:09.865277Z","submitted_at":"2022-02-13T05:39:47Z","title":"Emotion Based Hate Speech Detection using Multimodal Learning","version":1},"cited_work":{"arxiv_id":"2202.06218","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.06218","snapshot_observed_at":"2026-08-07T14:25:42.876482Z","title":"Emotion Based Hate Speech Detection using Multimodal Learning","venue":"cs.LG","work_id":"4bc5af59-3e74-403b-ba44-c606bcc2cd22","year":2022},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.782460Z"},"links":{"cited_paper":"/paper/2202.06218","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:419f7ae19a5ad6fbbb78e7724e4b003caf65f947c0af015a4066166e02a564e5","observation_id":"0c8edc1f-0588-410a-ba91-3e1aba14e250","resolution":{"observed_at":"2026-08-07T14:25:42.963784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.01963","last_updated":"2021-10-05T11:47:27Z","snapshot_observed_at":"2026-07-06T11:54:31.182477Z","submitted_at":"2021-10-05T11:47:27Z","title":"Multimodal datasets: misogyny, pornography, and malignant stereotypes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.01963","snapshot_observed_at":"2026-08-07T14:25:39.827592Z","title":"Multimodal datasets: misogyny, pornography, and malignant stereotypes,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.827592Z"},"links":{"cited_paper":"/paper/2110.01963","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:65bd3840e9ce72f195080cad76d71622db764050f027c3d4fde9de0a0e3379db","observation_id":"a5aea849-5b60-4c91-9ba3-ba9f74292407","resolution":{"observed_at":"2026-08-07T14:25:39.827592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.016685Z","title":"Mul- timodal meme dataset (multioff) for identifying offensive content in image and text,","venue":null,"work_id":"01fdd80a-c482-4f7e-91a4-143828e3b51a","year":2020},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.949349Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:16dbafc8443cd13cd8e002a7d96b528c8c10539ebcbd02113f4acead1fd07474","observation_id":"a63db17a-0cde-4306-8178-6f0a8f633a4f","resolution":{"observed_at":"2026-08-07T14:25:44.020130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.006641Z","title":"Multi-modal twitter data analysis for identifying offensive posts using a deep cross atten- tion based transformer framework,","venue":null,"work_id":"4368d261-09c1-4188-bdb8-c7f20552dad2","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.067162Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:36e8416dec1de4973316c8f05d95c939af726f03ab1b4752c5eb0aca171315e4","observation_id":"924dd7b5-3204-484c-99ed-2cf634370c1c","resolution":{"observed_at":"2026-08-07T14:25:44.010213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.996902Z","title":"Multimodal large language model with lora fine-tuning for multimodal sentiment analysis,","venue":null,"work_id":"f5c0c8c6-d765-42a5-8617-8732f81a0adb","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.137830Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:8f3012cff1a5c90ec9de2824fc7ef161e2eeb2fc777d03aa114a9c7a13f57790","observation_id":"19cedcaf-9350-41c0-8402-9057ca17d359","resolution":{"observed_at":"2026-08-07T14:25:44.000236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.986165Z","title":"Image–text sentiment analysis via deep multimodal attentive fusion,","venue":null,"work_id":"1d10066f-1f99-409e-a05e-7aaa701a0096","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.216114Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:414b1845a8cfd6b4863dfdd107235fd28701448c4d7c87319d4714cfca2a5fb9","observation_id":"e256ead2-3cde-417b-9d39-4c69b2de92fa","resolution":{"observed_at":"2026-08-07T14:25:43.990351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.974509Z","title":"Pars-off: a benchmark for offensive language detec- tion on farsi social media,","venue":null,"work_id":"d9f879ba-9d9b-4c21-bcb2-c45737d085b5","year":2022},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.263544Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:0439ae6f3013dea6a52c36fa3077f446c895e11e1b17205bf34bafc40c015422","observation_id":"e48b2613-2a04-4f89-ac37-67063a941e84","resolution":{"observed_at":"2026-08-07T14:25:43.978578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.963966Z","title":"Djmf: A discriminative joint multi-task framework for multimodal sentiment analysis based on intra- and inter-task dynamics,","venue":null,"work_id":"195410fc-3919-4605-a0b1-afc6b2412a99","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.339234Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:91c21dc609324fe3c7d39153c4a1a6de47082812b53d4f922429cf9b4f61ea92","observation_id":"f80807ea-ea4f-4792-a99f-57678393c689","resolution":{"observed_at":"2026-08-07T14:25:43.968244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.953242Z","title":"Joint multimodal sentiment analysis based on information relevance,","venue":null,"work_id":"88699fcf-5660-4669-95dd-63cd752e5488","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.447134Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:f1d8187cc9e322f58943c91e0e71c131c1c1a2906086fb95c0a43b52f51ecafb","observation_id":"7c3c2271-7254-4da2-b889-e6c1c827665f","resolution":{"observed_at":"2026-08-07T14:25:43.956788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.941914Z","title":"Decoding memes: a comprehensive analysis of late and early fusion models for explainable meme analysis,","venue":null,"work_id":"65e37379-c43b-4cdb-ab8c-8e7623958e8e","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.548012Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:41e01365167ab19c6a0f0aa402e40bc6cfed41adf9c7e34ed5a415056bd69962","observation_id":"1cac5b3c-82ce-4f10-8915-069425dd6992","resolution":{"observed_at":"2026-08-07T14:25:43.945663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.931297Z","title":"Multimodal sentiment analysis based on fusion methods: A survey,","venue":null,"work_id":"d3101236-c1e7-4e97-b7fb-02cd7b33ef55","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.719080Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:3bcae3c4a860f39fa65001ef72c2eb6bcc0fedcaf3f33498c99fe076aa5bce7c","observation_id":"c1839d22-1d2f-49f5-8cd2-070c29f005bf","resolution":{"observed_at":"2026-08-07T14:25:43.935069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:40.763284Z","title":"Multi- modal sentiment analysis: A systematic review of history, datasets, mul- timodal fusion methods, applications, challenges and future directions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.763284Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:db9e02dc16246cd04ccd2f7dcbe1ee042fe2eca3c089f016e5d0965c6e66b864","observation_id":"3e1398ab-bf55-4472-b599-16a963d673b1","resolution":{"observed_at":"2026-08-07T14:25:40.763284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.913625Z","title":"Mm-emor: multi-modal emotion recognition of social media using concatenated deep learning networks,","venue":null,"work_id":"a6179fc0-d622-4147-b1b1-8a7f5f6b9180","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.820598Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:43d067c5815f6895e68db21bd14049b89d595b4add100ef3acd9c99b7b20cfb5","observation_id":"787d78ac-3e24-473c-b2e7-813b1d07a987","resolution":{"observed_at":"2026-08-07T14:25:43.918379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01312","last_updated":"2023-07-31T09:03:40Z","snapshot_observed_at":"2026-08-08T11:20:20.355734Z","submitted_at":"2023-06-02T07:22:43Z","title":"Syntax-aware Hybrid prompt model for Few-shot multi-modal sentiment analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01312","snapshot_observed_at":"2026-08-07T14:25:40.877041Z","title":"Syntax-aware hybrid prompt model for few-shot multi-modal sentiment analysis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.877041Z"},"links":{"cited_paper":"/paper/2306.01312","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:f891fcc31c55146673445ddc41676c6ad305de641a8ee43215e3db299c46595a","observation_id":"8815cea7-11ac-4991-9b05-e3eb1fff0983","resolution":{"observed_at":"2026-08-07T14:25:40.877041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.902852Z","title":"Offensive language detection for low resource language using deep sequence model,","venue":null,"work_id":"1b0fea82-f1d9-44d9-b8f8-aa0495744b69","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.993710Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:dde1a66e9db7de5e7fff413e99dd19e6b9482fca824b7ee08be9d52753c6cb6f","observation_id":"62ddbb3a-c3ae-48ae-a559-7fddf7ca87e8","resolution":{"observed_at":"2026-08-07T14:25:43.906939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.892206Z","title":"Research on multimodal hate speech detection based on self-attention mechanism feature fusion,","venue":null,"work_id":"20dd076b-d74e-468c-a691-7ece6416a5e5","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.057539Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:0a2408e7f8b227477834d4f9129c600a525e8f253b7dc3e820651e60773b67e2","observation_id":"89c03910-56f2-4eff-afc3-d261b6131c18","resolution":{"observed_at":"2026-08-07T14:25:43.895778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.881463Z","title":"Multi-modal sentiment analysis based on image and text fusion using a cross-attention mechanism,","venue":null,"work_id":"7a648be2-8783-496e-9385-85cd26a416d6","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.090917Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:7d0a13841dbb59bde894d2e13a7d9cc39c54936ef12407c9ebff2219997b5ad6","observation_id":"8cd85a84-b3a1-42b6-9d9f-4c27380292ad","resolution":{"observed_at":"2026-08-07T14:25:43.885467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.870296Z","title":"Fusion and discrimina- tion: A multimodal graph contrastive learning framework for multimodal sarcasm detection,","venue":null,"work_id":"348d4bc1-ba17-4439-a013-031f75b4244d","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.181812Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:962e5bda9539ffae9f8bcaeea6b9feba953199b812f6a946c7c3baf25b232eaf","observation_id":"521a7d7b-7ab5-4c0c-b318-f9d3341605cd","resolution":{"observed_at":"2026-08-07T14:25:43.874199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:41.331681Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.331681Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:383a87a2c4090a1f017a115159279ccf3d93a1d6c1ace63e7c7bcef8b3df102e","observation_id":"7de52236-f4c7-4a8a-997a-80873bfc2197","resolution":{"observed_at":"2026-08-07T14:25:41.331681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:41.459863Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.459863Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:cc67548351932b2e00705eab8a332ec344c3e48b0fb205f84e124fcdf74050cc","observation_id":"c140f0ea-f23d-4e8c-b59b-82b2663b9dc4","resolution":{"observed_at":"2026-08-07T14:25:41.459863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-07T14:25:41.565766Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.565766Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:c31c847542e55ac0b05056b46257d42c64531d5cf2d03be02713ab0672085a1f","observation_id":"9721a778-daa1-4e1d-9eda-760fcdebc20f","resolution":{"observed_at":"2026-08-07T14:25:41.565766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T14:25:41.665332Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.665332Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:a586fc4e2f5a5dc1842ca3b8dee4c4a413ecbdc56b72aa5944df56c576761290","observation_id":"f0386b78-c883-4dcc-b185-0528fdbbc1c4","resolution":{"observed_at":"2026-08-07T14:25:41.665332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T14:25:41.789784Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.789784Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:80b36c079c97539625565538e93b8977d1b603734d4b20c3b24c79695235e64f","observation_id":"32841303-9c34-4cd8-a6ca-6df8dc9fb3d4","resolution":{"observed_at":"2026-08-07T14:25:41.789784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-07T14:25:41.901458Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.901458Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:cf72aa6985a67086847a3880aaf36b061b056c5a3f722198ae854d7416f41371","observation_id":"345bc459-e513-4b40-b9fa-2c4b7f37b9d5","resolution":{"observed_at":"2026-08-07T14:25:41.901458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.760915Z","title":"Efficientnetv2: Smaller models and faster training,","venue":null,"work_id":"e7c15090-bc48-4381-942a-006102d619a8","year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.053846Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:ede16729391d8c80ee01a71e82c50ee310d42293e268406c425012c6c3e6158c","observation_id":"0f379533-6fe3-4b33-a10c-f9f43f207ea9","resolution":{"observed_at":"2026-08-07T14:25:43.846765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.535860Z","title":"Unsupervised cross-lingual representation learning at scale,","venue":null,"work_id":"04f9143b-e8df-4e6b-84ab-b81332c20d56","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.156831Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:55c76acd344abc2fcd810c45f3fe037d8d4f203056b6c59775571dd3f43d32a9","observation_id":"26927944-0c9c-474a-980c-536ddc2e9062","resolution":{"observed_at":"2026-08-07T14:25:43.613111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:42.254379Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.254379Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:5719f51b6653b242dae396aa9fc18198ddb0d2f3bc432de9c9cca86e2a2a0ffe","observation_id":"e91d9004-aa73-4683-9e67-a1b98d9f00e6","resolution":{"observed_at":"2026-08-07T14:25:42.254379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:42.368041Z","title":"Align before fuse: Vision and language representation learning with momentum distillation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.368041Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:2de28032780626ee6d1d62df8f125af7dcc14b13989b763092e3e6386337a311","observation_id":"75e1c397-4e51-4842-8322-de58d87ca50e","resolution":{"observed_at":"2026-08-07T14:25:42.368041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:42.505072Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.505072Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:a56c9589957bc12802706ca1862790897c6d00b8d4e7ef1e74f3a598b7b4d691","observation_id":"2917c82c-04dd-4a1a-a83f-d3b8485219ce","resolution":{"observed_at":"2026-08-07T14:25:42.505072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.353728Z","title":"Task report: Memotion analysis 1.0@ semeval 2020: The visuo-lingual metaphor,","venue":null,"work_id":"96f94acd-6781-41ac-8481-0ddfa9f85071","year":2020},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.601322Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:c68be5b621c40f5f4b65a2b0da8f65970459e182029b9e4ec3123bf7fcc7459e","observation_id":"7c72eb09-ef45-438d-bd65-bd13d7fa27ce","resolution":{"observed_at":"2026-08-07T14:25:43.464721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.142128Z","title":"Mimic: misogyny identification in multimodal internet content in hindi-english code-mixed language,","venue":null,"work_id":"83ef93fe-ba8c-4034-af05-5f2b2f12f368","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.697041Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:f9a2deaf5148f5be228956c0430eb58c6ef76d9c197eea83579207e63b491801","observation_id":"34dc37ce-0518-45bc-b2de-3014a1c73e59","resolution":{"observed_at":"2026-08-07T14:25:43.227741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:19:33.421060Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2505.19010."}