{"as_of":"2026-08-19T00:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04fc77f5d00cbf7cb7636288aaf54936076df8ec6b3dd0e561ffdebf72694797","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":56,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:17:44.363763Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T23:56:38.424836Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2409.07825","last_updated":"2026-02-04T04:12:12Z","snapshot_observed_at":"2026-08-02T14:14:17.863359Z","submitted_at":"2024-09-12T08:15:39Z","title":"Deep Multimodal Learning with Missing Modality: A Survey","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-17T22:26:03.706725Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2409.07825"},"observation_digest":"sha256:5c4fabd497932a6b5d90bf3d8e95df870eacb89a7ed6d01a8e1053b0f0bccfb4","observation_id":"e732cb0f-40bb-42a1-9497-d3443dd6c52b","resolution":{"observed_at":"2026-05-17T22:26:03.889343Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-12T20:08:42.804657Z","title":"Poria, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.10018","last_updated":"2024-11-15T07:53:02Z","snapshot_observed_at":"2026-08-18T11:19:24.401323Z","submitted_at":"2024-11-15T07:53:02Z","title":"Once More, With Feeling: Measuring Emotion of Acting Performances in Contemporary American Film","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T20:08:42.804657Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2411.10018"},"observation_digest":"sha256:eb93ab184194da3514307a6d21e134ca4b76275f516998589c8180b530077c03","observation_id":"3e58d9d8-59dc-430d-a7d1-c85b5f02d3de","resolution":{"observed_at":"2026-08-12T20:08:42.804657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-12T20:13:57.880727Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13577","last_updated":"2024-11-26T09:20:48Z","snapshot_observed_at":"2026-08-15T08:49:03.887183Z","submitted_at":"2024-11-15T04:16:45Z","title":"WavChat: A Survey of Spoken Dialogue Models","version":2},"reference_index":168,"source":"pdf_text","source_observed_at":"2026-08-12T20:13:57.880727Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2411.13577"},"observation_digest":"sha256:222325b26726879c32cf6ead17fc28e2cb2e4fcbac00e39a4682c2a40f926419","observation_id":"c709dcf0-38fb-4d80-8873-b73e0644205c","resolution":{"observed_at":"2026-08-12T20:13:57.880727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-12T15:48:47.444332Z","title":"Meld: A multimodal multi- party dataset for emotion recognition in conversations[J]","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13917","last_updated":"2024-11-21T08:07:26Z","snapshot_observed_at":"2026-08-17T22:47:42.394884Z","submitted_at":"2024-11-21T08:07:26Z","title":"SpikEmo: Enhancing Emotion Recognition With Spiking Temporal Dynamics in Conversations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:48:47.444332Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2411.13917"},"observation_digest":"sha256:c9d913f8186e4a681c30fef952636d31340e91c1a96909259a4fc56925dad9c6","observation_id":"71f6a02a-5588-4675-a436-3c090e793f67","resolution":{"observed_at":"2026-08-12T15:48:47.444332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-12T14:53:50.255144Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14842","last_updated":"2025-06-06T07:43:02Z","snapshot_observed_at":"2026-08-17T04:40:08.847477Z","submitted_at":"2024-11-22T10:30:48Z","title":"Who Can Withstand Chat-Audio Attacks? An Evaluation Benchmark for Large Audio-Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T14:53:50.255144Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2411.14842"},"observation_digest":"sha256:81e9b41d3c336add0fef8492db669265b6c5ebb1a7f0a32fd53ef784151b34e2","observation_id":"f9366436-e76f-4f1f-8760-ae3355f798c9","resolution":{"observed_at":"2026-08-12T14:53:50.255144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-12T11:31:54.626678Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18162","last_updated":"2024-11-27T09:18:26Z","snapshot_observed_at":"2026-08-18T11:19:22.365461Z","submitted_at":"2024-11-27T09:18:26Z","title":"SentiXRL: An advanced large language Model Framework for Multilingual Fine-Grained Emotion Classification in Complex Text Environment","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T11:31:54.626678Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2411.18162"},"observation_digest":"sha256:6db1265362fa99cee3c11a80b173ca6b88b33790cc56184999282ed58d34b408","observation_id":"9c5c212b-0b8b-49d2-8e7d-3fdeb55bf159","resolution":{"observed_at":"2026-08-12T11:31:54.626678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T21:12:11.318506Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04908","last_updated":"2025-03-18T05:10:59Z","snapshot_observed_at":"2026-08-18T22:48:59.558646Z","submitted_at":"2024-12-06T10:04:26Z","title":"MERCI: Multimodal Emotional and peRsonal Conversational Interactions Dataset","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T21:12:11.318506Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.04908"},"observation_digest":"sha256:96c187338a97d681c50b0638c4dd6b9771f96a7cf8770157e7170109902d03aa","observation_id":"51133a9c-8d8c-4a69-aedb-3d974d2b367a","resolution":{"observed_at":"2026-08-11T21:12:11.318506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T20:38:01.958786Z","title":"arXiv preprint arXiv:1810.02508 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.05558","last_updated":"2024-12-07T06:43:39Z","snapshot_observed_at":"2026-08-13T21:24:20.794752Z","submitted_at":"2024-12-07T06:43:39Z","title":"WavFusion: Towards wav2vec 2.0 Multimodal Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:38:01.958786Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.05558"},"observation_digest":"sha256:40f93615fc7d7eba6b0afa6e400d75d156f411a7f9a87cff7951c05be90093aa","observation_id":"807482db-a36f-4fea-bd0d-bbce639f42f7","resolution":{"observed_at":"2026-08-11T20:38:01.958786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T18:21:40.053544Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08049","last_updated":"2025-03-31T07:15:17Z","snapshot_observed_at":"2026-08-17T13:13:02.377231Z","submitted_at":"2024-12-11T02:55:00Z","title":"EmoVerse: Exploring Multimodal Large Language Models for Sentiment and Emotion Understanding","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T18:21:40.053544Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.08049"},"observation_digest":"sha256:41c8f9e6ff016295255a64ddba0ed5e763b85e6f109dcfd42d76fa0a59215ade","observation_id":"1444384f-54c8-484c-b745-b60e68337c55","resolution":{"observed_at":"2026-08-11T18:21:40.053544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T18:05:13.492090Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08259","last_updated":"2025-03-26T11:54:06Z","snapshot_observed_at":"2026-08-18T20:29:32.042310Z","submitted_at":"2024-12-11T10:11:41Z","title":"VSD2M: A Large-scale Vision-language Sticker Dataset for Multi-frame Animated Sticker Generation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T18:05:13.492090Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.08259"},"observation_digest":"sha256:36cfb2e6bdc2fd886ffcf245e12e518008529774b60ac887538e6a58ed74de70","observation_id":"5005b19b-13ce-4266-8976-4333e6c7a9ac","resolution":{"observed_at":"2026-08-11T18:05:13.492090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T11:18:35.270979Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversa- tions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15622","last_updated":"2024-12-20T07:28:04Z","snapshot_observed_at":"2026-08-13T18:08:12.828161Z","submitted_at":"2024-12-20T07:28:04Z","title":"TouchASP: Elastic Automatic Speech Perception that Everyone Can Touch","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T11:18:35.270979Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.15622"},"observation_digest":"sha256:b2cfe8aaaa1fffcec0ea769d4b4e188f0ca4d73d782ec8feff24a1787c72e446","observation_id":"e0b7fb3c-99a3-42fa-9fe0-cd07cb0558f3","resolution":{"observed_at":"2026-08-11T11:18:35.270979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-11T05:41:47.636044Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17295","last_updated":"2024-12-23T05:32:48Z","snapshot_observed_at":"2026-08-16T18:14:16.719911Z","submitted_at":"2024-12-23T05:32:48Z","title":"Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T05:41:47.636044Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2412.17295"},"observation_digest":"sha256:e1ada476ecb62344f829214d8ed0fa20f190eea7380383b081634a4e8110e89e","observation_id":"d1902ffc-96f6-4347-9c70-b11f8d60bded","resolution":{"observed_at":"2026-08-11T05:41:47.636044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-10T22:38:07.692940Z","title":"CoRR, abs/1810.02508","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01123","last_updated":"2025-01-02T07:44:48Z","snapshot_observed_at":"2026-08-17T15:12:48.246255Z","submitted_at":"2025-01-02T07:44:48Z","title":"TED: Turn Emphasis with Dialogue Feature Attention for Emotion Recognition in Conversation","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-10T22:38:07.692940Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2501.01123"},"observation_digest":"sha256:a92938a00eb25ff55e92a66ad4e58b9c6b77a0d246d834a3f7bb8eed9874ccd7","observation_id":"9271ce35-a891-468b-8feb-7294782536e8","resolution":{"observed_at":"2026-08-10T22:38:07.692940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-10T22:32:05.020670Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.01384","last_updated":"2025-01-02T17:58:23Z","snapshot_observed_at":"2026-08-15T12:28:28.005906Z","submitted_at":"2025-01-02T17:58:23Z","title":"OmniChat: Enhancing Spoken Dialogue Systems with Scalable Synthetic Data for Diverse Scenarios","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T22:32:05.020670Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2501.01384"},"observation_digest":"sha256:5b7960e3d9ee316c0761bed3063cde36e94fc1213fd2655bfdeebfb005667c82","observation_id":"afe84b7f-9da2-47d1-bc17-7dabddfe33cb","resolution":{"observed_at":"2026-08-10T22:32:05.020670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-10T20:32:37.936955Z","title":"Meld: A multimodal multi -party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.08182","last_updated":"2025-01-14T15:08:56Z","snapshot_observed_at":"2026-08-18T11:20:10.601593Z","submitted_at":"2025-01-14T15:08:56Z","title":"CG-MER: A Card Game-based Multimodal dataset for Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:32:37.936955Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2501.08182"},"observation_digest":"sha256:8932e0d688a0f9ed83219865fed887596eaba6b0d9660679cd7af43d3a4990c2","observation_id":"41c10c31-bfe6-4d78-b665-8553b1dfd4fc","resolution":{"observed_at":"2026-08-10T20:32:37.936955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-10T14:43:42.168958Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-18T11:20:07.477713Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.168958Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:f7ff93af4039514dd6ae35a90142201b2d1df42751514f80333db36e5d1584d7","observation_id":"e6f5bcd4-f365-4d4a-a6fd-77819a7e2a7d","resolution":{"observed_at":"2026-08-10T14:43:42.168958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-10T13:34:25.692578Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.16327","last_updated":"2025-01-27T18:59:51Z","snapshot_observed_at":"2026-08-12T15:20:37.673304Z","submitted_at":"2025-01-27T18:59:51Z","title":"LUCY: Linguistic Understanding and Control Yielding Early Stage of Her","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-10T13:34:25.692578Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2501.16327"},"observation_digest":"sha256:9faca8c9f186bf925de3506c5556f45a0c5e319874d5e5754e78bdc941ad4d07","observation_id":"418d0f7c-a1b0-4381-b94a-4142749fb903","resolution":{"observed_at":"2026-08-10T13:34:25.692578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-08T15:45:46.158254Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06355","last_updated":"2025-07-08T21:12:11Z","snapshot_observed_at":"2026-08-17T15:03:42.032444Z","submitted_at":"2025-02-10T11:10:41Z","title":"Fine-tuning Multimodal Transformers on Edge: A Parallel Split Learning Approach","version":3},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-08T15:45:46.158254Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2502.06355"},"observation_digest":"sha256:e59ee8517778127581778f983189e5aa7febae19ad685db1da8a3fb9139aec8c","observation_id":"476a4860-d038-4dbb-988b-e16c8978d0a9","resolution":{"observed_at":"2026-08-08T15:45:46.158254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T22:04:02.380997Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.09294","last_updated":"2025-02-13T13:08:42Z","snapshot_observed_at":"2026-08-18T11:19:22.885870Z","submitted_at":"2025-02-13T13:08:42Z","title":"Indeterminacy in Affective Computing: Considering Meaning and Context in Data Collection Practices","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T22:04:02.380997Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2502.09294"},"observation_digest":"sha256:6bbe45bdd55291abb6f791e2a30b1ec7fee3db5fc5de531607d1c238e59d1767","observation_id":"59d79e34-7fbb-4f5c-83ba-5e63a64b6c67","resolution":{"observed_at":"2026-08-07T22:04:02.380997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-16T11:17:44.363763Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversa- tions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.15900","last_updated":"2025-04-29T02:51:19Z","snapshot_observed_at":"2026-08-18T11:21:01.017467Z","submitted_at":"2025-04-22T13:41:26Z","title":"SARI: Structured Audio Reasoning via Curriculum-Guided Reinforcement Learning","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:17:44.363763Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2504.15900"},"observation_digest":"sha256:f308c99a0d6d7fbb4eb7e4e36e0685117fd6eed3103a38bce685c44f554829d2","observation_id":"0b644c84-467b-4b84-85a6-854b1b43f699","resolution":{"observed_at":"2026-08-16T11:17:44.363763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2504.18425","last_updated":"2025-04-25T15:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-25T15:31:46Z","title":"Kimi-Audio Technical Report","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-11T19:21:26.933349Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2504.18425"},"observation_digest":"sha256:c81024600bc00995b251631b29d3a86efdd7b4b2e4deab2dbb78c1c74b8584d6","observation_id":"0bf973c9-bf35-4be1-b11e-6825249ac6fa","resolution":{"observed_at":"2026-05-11T19:21:27.179423Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-15T23:41:34.210293Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.04147","last_updated":"2025-05-07T05:55:45Z","snapshot_observed_at":"2026-08-17T13:04:30.039874Z","submitted_at":"2025-05-07T05:55:45Z","title":"R^3-VQA: \"Read the Room\" by Video Social Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:41:34.210293Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2505.04147"},"observation_digest":"sha256:650010dbb2d86bf594aa7b73d39437a79b189244da62e630314988417cb61ae1","observation_id":"c160bdec-ea6c-4a37-b4b4-485b967983e1","resolution":{"observed_at":"2026-08-15T23:41:34.210293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T15:21:32.662188Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.15348","last_updated":"2025-05-21T10:21:00Z","snapshot_observed_at":"2026-08-18T11:21:02.027991Z","submitted_at":"2025-05-21T10:21:00Z","title":"The Super Emotion Dataset","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:21:32.662188Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2505.15348"},"observation_digest":"sha256:e8272a21e43ca3783713a92047d69cfef5b8f556c9717a99db85282414f4396e","observation_id":"62f30405-db45-4ef7-8616-bf9d23185149","resolution":{"observed_at":"2026-08-07T15:21:32.662188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T15:30:02.422904Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversa- tions.arXiv preprint arXiv:1810.02508, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.17090","last_updated":"2025-05-20T22:14:38Z","snapshot_observed_at":"2026-08-17T23:18:46.931670Z","submitted_at":"2025-05-20T22:14:38Z","title":"EmoSign: A Multimodal Dataset for Understanding Emotions in American Sign Language","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:02.422904Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2505.17090"},"observation_digest":"sha256:8a2c35fdfb2c0fe89a40ba60c00ad2b7331388c4eb4a1b16687a144a150ea6bb","observation_id":"18a472da-0eb3-43ad-a503-d4395e809cec","resolution":{"observed_at":"2026-08-07T15:30:02.422904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T14:42:07.710509Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.17841","last_updated":"2025-05-23T12:55:33Z","snapshot_observed_at":"2026-08-14T05:05:44.596019Z","submitted_at":"2025-05-23T12:55:33Z","title":"TEDI: Trustworthy and Ethical Dataset Indicators to Analyze and Compare Dataset Documentation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:42:07.710509Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2505.17841"},"observation_digest":"sha256:8e25d8c0717335f235b035e664a599e0ba80ba2d22c318298d9d61c1371531e9","observation_id":"4255d708-4045-48ec-8599-290c2fe4213b","resolution":{"observed_at":"2026-08-07T14:42:07.710509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T14:12:38.697653Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversa- tions, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19797","last_updated":"2025-06-18T09:47:20Z","snapshot_observed_at":"2026-08-17T20:19:26.264835Z","submitted_at":"2025-05-26T10:29:42Z","title":"The Avengers: A Simple Recipe for Uniting Smaller Language Models to Challenge Proprietary Giants","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:38.697653Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2505.19797"},"observation_digest":"sha256:cf460cab54e82620d9a33c92ad3868e13cf6e81c82cb79e7bff2be3fb561df0a","observation_id":"85309405-8326-4388-82fb-9ed6d554e342","resolution":{"observed_at":"2026-08-07T14:12:38.697653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T13:28:21.277655Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21792","last_updated":"2025-05-27T21:47:20Z","snapshot_observed_at":"2026-08-18T09:59:18.700074Z","submitted_at":"2025-05-27T21:47:20Z","title":"Multimodal Federated Learning: A Survey through the Lens of Different FL Paradigms","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:21.277655Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2505.21792"},"observation_digest":"sha256:e48f302b83f7bbd433044b0e387df7014813c6232ad87cd283a358492ac8316b","observation_id":"b3669ce7-39d5-400b-bf49-6feadcd1544b","resolution":{"observed_at":"2026-08-07T13:28:21.277655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T13:11:42.287535Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations.arXiv preprint arXiv:1810.02508, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22548","last_updated":"2025-08-06T03:38:44Z","snapshot_observed_at":"2026-08-18T11:19:23.501464Z","submitted_at":"2025-05-28T16:32:16Z","title":"Emotion-o1: Adaptive Long Reasoning for Emotion Understanding in LLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.287535Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2505.22548"},"observation_digest":"sha256:46009d11f3da491c1ec613f8e3a2187d22f761b9d08a1607ab07b6335605281a","observation_id":"68fb445d-6e54-401c-9cb8-cca0d63f89d6","resolution":{"observed_at":"2026-08-07T13:11:42.287535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-07T12:12:13.361772Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.00343","last_updated":"2025-05-31T02:07:37Z","snapshot_observed_at":"2026-08-18T11:19:18.737659Z","submitted_at":"2025-05-31T02:07:37Z","title":"The iNaturalist Sounds Dataset","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T12:12:13.361772Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2506.00343"},"observation_digest":"sha256:eff8d0c8fa3fb22f66357e282f8171cb998b15e21a4c7d3f200b6c34ad2cfc35","observation_id":"08cbe19a-afec-47a9-93eb-ee42b94ebd1b","resolution":{"observed_at":"2026-08-07T12:12:13.361772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2506.05425","last_updated":"2026-04-28T02:01:09Z","snapshot_observed_at":"2026-08-17T04:30:20.028922Z","submitted_at":"2025-06-05T05:51:35Z","title":"SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T11:36:36.687324Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2506.05425"},"observation_digest":"sha256:54f03ba2b49ce1172b2d7c474b94154971be0613dff696da8ef0aba4324ff10b","observation_id":"013366a8-60d9-4d0e-ad8c-10682cab0683","resolution":{"observed_at":"2026-05-19T11:37:15.765324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-06T22:57:47.708657Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.20199","last_updated":"2025-06-28T03:04:05Z","snapshot_observed_at":"2026-08-16T18:00:57.552431Z","submitted_at":"2025-06-25T07:39:19Z","title":"How to Retrieve Examples in In-context Learning to Improve Conversational Emotion Recognition using Large Language Models?","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:47.708657Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2506.20199"},"observation_digest":"sha256:4343e2a4449b1b432d35bd57f50cd665d7eb394cda78f4e6f48b5d35dddb1779","observation_id":"8d704c22-2375-4045-865c-fcd9292121b6","resolution":{"observed_at":"2026-08-06T22:57:47.708657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-06T22:19:10.758674Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.22036","last_updated":"2026-07-13T03:35:11Z","snapshot_observed_at":"2026-08-17T08:32:42.131424Z","submitted_at":"2025-06-27T09:32:58Z","title":"Hyper-modal Imputation Diffusion Embedding with Dual-Distillation for Federated Multimodal Knowledge Graph Completion","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T22:19:10.758674Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2506.22036"},"observation_digest":"sha256:db72b0b168be8ef1a239acfa559583885b66038231fd5d01089ee7251d20fbbc","observation_id":"43e2da5b-9ae2-4425-ad17-ff14b9336e1f","resolution":{"observed_at":"2026-08-06T22:19:10.758674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2507.08128","last_updated":"2025-07-28T22:53:43Z","snapshot_observed_at":"2026-08-17T22:20:20.496099Z","submitted_at":"2025-07-10T19:40:21Z","title":"Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-15T03:42:44.523919Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2507.08128"},"observation_digest":"sha256:c725bf5cc29c7d567a5ca4e62831f1709dfd77a7a6edc51381c51ebb06a39e87","observation_id":"c55c26f9-af2a-4fca-8ae3-8e4e11ad7396","resolution":{"observed_at":"2026-05-15T03:42:45.121348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-06T16:27:49.583461Z","title":"Poria, D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.15878","last_updated":"2025-07-17T20:55:20Z","snapshot_observed_at":"2026-08-12T23:17:35.207372Z","submitted_at":"2025-07-17T20:55:20Z","title":"Salience Adjustment for Context-Based Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:27:49.583461Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2507.15878"},"observation_digest":"sha256:41164c87bab0246fb7fde2baabb658c86733dade1d424c820d498247af6bb854","observation_id":"cb049c05-3b65-42f8-b241-f696b3dc92c2","resolution":{"observed_at":"2026-08-06T16:27:49.583461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-06T05:02:24.438791Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.02429","last_updated":"2025-08-04T13:49:03Z","snapshot_observed_at":"2026-08-15T11:20:00.559254Z","submitted_at":"2025-08-04T13:49:03Z","title":"Multimodal Large Language Models for End-to-End Affective Computing: Benchmarking and Boosting with Generative Knowledge Prompting","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:02:24.438791Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2508.02429"},"observation_digest":"sha256:48bfb8a61d8185994c4f828721ed5b2ed9750149cea121d97a726c9ba02ad4ce","observation_id":"d915f76c-e091-4c4e-8496-012f69e9870b","resolution":{"observed_at":"2026-08-06T05:02:24.438791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-05T23:49:17.456516Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06564","last_updated":"2025-08-13T17:11:05Z","snapshot_observed_at":"2026-08-18T11:19:20.246489Z","submitted_at":"2025-08-06T19:43:58Z","title":"Grounding Emotion Recognition with Visual Prototypes: VEGA -- Revisiting CLIP in MERC","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T23:49:17.456516Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2508.06564"},"observation_digest":"sha256:93ff05856263368516427102cfb4420a7fc9c29660383da8d70a2056d35084e1","observation_id":"9a878111-3e64-45c5-be7f-f3070c80186d","resolution":{"observed_at":"2026-08-05T23:49:17.456516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-05T22:03:27.040416Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.07625","last_updated":"2025-08-11T05:08:31Z","snapshot_observed_at":"2026-08-18T11:18:23.283505Z","submitted_at":"2025-08-11T05:08:31Z","title":"A Trustworthy Method for Multimodal Emotion Recognition","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T22:03:27.040416Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2508.07625"},"observation_digest":"sha256:6b2ff467a7b19e866011d634f5aa24349b2f1b49803aab7e42f0fbc04b0ca899","observation_id":"594d4442-89ff-4a55-ad24-7a14fcc799f1","resolution":{"observed_at":"2026-08-05T22:03:27.040416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-05T17:56:54.367312Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.15418","last_updated":"2025-08-21T10:20:00Z","snapshot_observed_at":"2026-08-14T16:19:43.372797Z","submitted_at":"2025-08-21T10:20:00Z","title":"LLaSO: A Foundational Framework for Reproducible Research in Large Language and Speech Model","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T17:56:54.367312Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2508.15418"},"observation_digest":"sha256:95214fc28d65883c8d6db1d008dc15de79655c6988bd3a74bb02278c3fb377ed","observation_id":"9922ac05-b81e-4638-a22d-3422c6914f70","resolution":{"observed_at":"2026-08-05T17:56:54.367312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-05T15:00:14.045603Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20660","last_updated":"2025-08-28T11:07:36Z","snapshot_observed_at":"2026-08-16T00:28:53.748581Z","submitted_at":"2025-08-28T11:07:36Z","title":"CodecBench: A Comprehensive Benchmark for Acoustic and Semantic Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:00:14.045603Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2508.20660"},"observation_digest":"sha256:6477a2ec992c175f76f102a04db97a155772dea2e9892f6744b2057f2d5b680b","observation_id":"8f3a2d7c-3c5c-4a82-ad09-b6f4e4ee3e4e","resolution":{"observed_at":"2026-08-05T15:00:14.045603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-05T11:41:02.074677Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.02349","last_updated":"2025-09-04T14:25:57Z","snapshot_observed_at":"2026-08-16T11:26:28.123684Z","submitted_at":"2025-09-02T14:15:22Z","title":"AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T11:41:02.074677Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2509.02349"},"observation_digest":"sha256:a484dac671260de2dd902ff2b129bc192aa60bb683fc394db18e07d1c8ec2723","observation_id":"de151e24-330f-45b9-866c-006bb4c8f4fc","resolution":{"observed_at":"2026-08-05T11:41:02.074677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2509.19858","last_updated":"2026-05-22T14:38:31Z","snapshot_observed_at":"2026-08-18T21:25:47.358585Z","submitted_at":"2025-09-24T07:57:10Z","title":"Benchmarking Gaslighting Attacks Against Speech Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-25T08:06:59.951859Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2509.19858"},"observation_digest":"sha256:5aba979b5f91866e588c513858b1c17940aff3d430f0ea1c9a4e4297c9daf027","observation_id":"ddb7442b-451b-48e0-8207-beed547fc09a","resolution":{"observed_at":"2026-05-25T08:10:31.473686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2509.22220","last_updated":"2026-04-13T11:56:11Z","snapshot_observed_at":"2026-08-11T16:37:46.886811Z","submitted_at":"2025-09-26T11:32:51Z","title":"StableToken: A Noise-Robust Semantic Speech Tokenizer for Resilient SpeechLLMs","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-18T12:57:04.450462Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2509.22220"},"observation_digest":"sha256:359b0c699b161c9e125f1925bb2f4684b0dcbbc43e4fd27efe6907a3ff1fa10e","observation_id":"07e88292-3f1c-4f12-816f-e3de83876357","resolution":{"observed_at":"2026-05-18T13:01:24.312792Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-03T21:06:11.114113Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16757","last_updated":"2026-06-29T23:59:45Z","snapshot_observed_at":"2026-08-16T14:57:20.088308Z","submitted_at":"2025-11-20T19:17:35Z","title":"Revisiting Audio-language Pretraining for Learning General-purpose Audio Representation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T21:06:11.114113Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2511.16757"},"observation_digest":"sha256:00eaacf93dcc5d3b6b4497c881a8d1775f89890b3137c0ac6ada1d313e0ebc98","observation_id":"dbc2b25d-b38f-466c-9474-26e972a603c6","resolution":{"observed_at":"2026-08-03T21:06:11.114113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-03T13:12:34.368533Z","title":"Soujanya Poria, Devamanyu Hazarika, Navonil Majumder, Gautam Naik, Erik Cambria, and Rada Mihal- cea","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.00181","last_updated":"2026-06-10T12:47:18Z","snapshot_observed_at":"2026-08-18T11:20:10.159664Z","submitted_at":"2026-01-01T02:49:44Z","title":"Causal Emotion Recognition in Conversation: Context Saturation and Discourse-Marker Evidence","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T13:12:34.368533Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2601.00181"},"observation_digest":"sha256:a701b39d7a50a3e3c6decd527e1c60e842fa332e867c9bcaa709abb5d645db77","observation_id":"7bf5d356-7651-44cb-a359-53d21fec67f8","resolution":{"observed_at":"2026-08-03T13:12:34.368533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2604.07786","last_updated":"2026-04-17T05:07:25Z","snapshot_observed_at":"2026-08-15T17:32:21.571984Z","submitted_at":"2026-04-09T04:28:03Z","title":"Cross-Modal Emotion Transfer for Emotion Editing in Talking Face Video","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T17:39:02.676295Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2604.07786"},"observation_digest":"sha256:548c43531ef98692ee71dfa05062cf4ffd5b3e39905b7def904563011df757b2","observation_id":"80b713dd-d248-485c-a72a-d51c1cf7b3e3","resolution":{"observed_at":"2026-05-11T06:25:58.469582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2604.22739","last_updated":"2026-04-24T17:37:42Z","snapshot_observed_at":"2026-08-18T11:20:07.111029Z","submitted_at":"2026-04-24T17:37:42Z","title":"Inter-Stance: A Dyadic Multimodal Corpus for Conversational Stance Analysis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T12:18:23.772037Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2604.22739"},"observation_digest":"sha256:95bf5e7551722d1b22b319b3fa3dd8d183c57f5733d913a10b34ad78c6ef0691","observation_id":"1d82bec8-1524-48c8-8061-e34d1fdb891b","resolution":{"observed_at":"2026-05-11T19:21:06.856879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2605.06765","last_updated":"2026-05-07T17:59:56Z","snapshot_observed_at":"2026-08-11T13:23:12.680939Z","submitted_at":"2026-05-07T17:59:56Z","title":"VITA-QinYu: Expressive Spoken Language Model for Role-Playing and Singing","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-11T01:03:09.942984Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2605.06765"},"observation_digest":"sha256:e72914dc957c3efd4b1b7a0035cedae81a5c102539b50b366d0e4c46b43ac1a9","observation_id":"64c0ffad-ed57-43d2-95b1-aaef7b18b94b","resolution":{"observed_at":"2026-05-11T04:50:55.887432Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2605.15984","last_updated":"2026-05-15T14:17:19Z","snapshot_observed_at":"2026-08-17T09:45:35.944069Z","submitted_at":"2026-05-15T14:17:19Z","title":"Beyond Content: A Comprehensive Speech Toxicity Dataset and Detection Framework Incorporating Paralinguistic Cues","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-19T18:36:34.351533Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2605.15984"},"observation_digest":"sha256:a533f42152b2decb0fe2c13f2452f38b853df8140930ad6f9acc5d39d0e8598e","observation_id":"d5595b91-d2bd-4985-83b5-9bf5c52303c5","resolution":{"observed_at":"2026-05-19T18:37:42.809673Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2606.07585","last_updated":"2026-05-27T16:36:58Z","snapshot_observed_at":"2026-08-17T04:13:16.062693Z","submitted_at":"2026-05-27T16:36:58Z","title":"Multimodal Group Emotion Recognition In-the-Wild Towards a Privacy-Safe Non-Individual Approach","version":1},"reference_index":182,"source":"pdf_text","source_observed_at":"2026-06-29T13:01:00.924735Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2606.07585"},"observation_digest":"sha256:629a3fade086b872ca9b5cbc6092244a3de11a201799ab0dfde796bbf16ffa4f","observation_id":"b1d74e34-972c-46c2-a5fe-c4aa3fd42fe4","resolution":{"observed_at":"2026-06-29T13:03:26.051006Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2606.09390","last_updated":"2026-06-08T12:05:23Z","snapshot_observed_at":"2026-08-12T21:49:37.007752Z","submitted_at":"2026-06-08T12:05:23Z","title":"Real-time body pose non-verbal communication with a consistency-based reliability measure","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T17:23:54.914116Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2606.09390"},"observation_digest":"sha256:a5670c4d84b61ef4345184bbd9ef65e6a23a186887a135d0fb735b8a05be0fe7","observation_id":"1cb15cb7-161c-43bb-b952-ece211dbf0c8","resolution":{"observed_at":"2026-07-03T00:17:28.685162Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2606.18228","last_updated":"2026-06-16T17:53:34Z","snapshot_observed_at":"2026-08-18T11:19:23.903524Z","submitted_at":"2026-06-16T17:53:34Z","title":"MAJIC: Leveraging Articulatory Motion for Speech-based Emotion Recognition","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-26T22:32:15.878239Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2606.18228"},"observation_digest":"sha256:57183fa73c0367fb5afba5c1fd66465c7ecaeb979ad15fa90ce8096125416390","observation_id":"c3fff5a6-66bb-4438-bb61-b676638f5bd0","resolution":{"observed_at":"2026-07-03T23:19:03.677917Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":"1810.02508","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-07-09T23:56:38.424836Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"8abe855c-1ab5-4751-922f-155e1298fb5b","year":2018},"citing_paper":{"arxiv_id":"2607.06875","last_updated":"2026-07-08T00:17:20Z","snapshot_observed_at":"2026-08-13T12:31:33.478080Z","submitted_at":"2026-07-08T00:17:20Z","title":"Video2Reaction: Mapping Video to Audience Reaction Distribution in the Wild","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-09T23:51:55.422232Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2607.06875"},"observation_digest":"sha256:e9e41c0fd1f1b6386e9f9f7067ea43979a13c4917a344a4288d86f2913fa2418","observation_id":"c95a7239-c582-48b4-b650-f598e4f940e7","resolution":{"observed_at":"2026-07-09T23:56:38.426123Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-02T01:25:07.637033Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.14683","last_updated":"2026-07-16T07:44:42Z","snapshot_observed_at":"2026-08-17T00:14:54.448434Z","submitted_at":"2026-07-16T07:44:42Z","title":"InCarEmo: A Multimodal Dataset for In-Cabin Emotion Recognition and Driver State Monitoring","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T01:25:07.637033Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2607.14683"},"observation_digest":"sha256:acc81b113df65db2e601ac699861112abdca4dc0b56c5f16074a890f52b01410","observation_id":"a89eed8e-1841-4a6c-843c-1245e60cd0d9","resolution":{"observed_at":"2026-08-02T01:25:07.637033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-01T18:16:51.388447Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.388447Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:a2734e57a401953a526a58ad1ebe200df35b46a65e5077bead9356d179c4ba00","observation_id":"acb99571-8d10-496e-a60d-d94f803d3602","resolution":{"observed_at":"2026-08-01T18:16:51.388447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-01T18:16:36.454435Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.18336","last_updated":"2026-07-19T18:09:22Z","snapshot_observed_at":"2026-08-17T01:57:20.767214Z","submitted_at":"2026-07-19T18:09:22Z","title":"EmoEUS: Uncertainty Supervision for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:36.454435Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2607.18336"},"observation_digest":"sha256:55054530f0203ff2dc6e67cb0b23eef4f9f95c8265a03feb5f21611a88c51535","observation_id":"c46d8dc4-9ea7-4826-a273-816f7a411f02","resolution":{"observed_at":"2026-08-01T18:16:36.454435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-01T07:12:10.212235Z","title":"arXiv preprint arXiv:1810.02508 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21550","last_updated":"2026-07-23T17:35:20Z","snapshot_observed_at":"2026-08-15T07:33:56.279411Z","submitted_at":"2026-07-23T17:35:20Z","title":"X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T07:12:10.212235Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2607.21550"},"observation_digest":"sha256:9fbc16f1ddb16603fd0677091b66b1af7e47219dea60a0741d8bd097564b9870","observation_id":"246322d0-02e8-47f8-a425-78bdd04036be","resolution":{"observed_at":"2026-08-01T07:12:10.212235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1810.02508/citation-record","integrity":"/paper/1810.02508/integrity","json":"/paper/1810.02508/citation-record.json","paper":"/paper/1810.02508"},"outbound":[],"paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","latest_version":6,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T11:18:27.643786Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 56 inbound Pith citation observations for arXiv:1810.02508."}