{"as_of":"2026-08-08T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:99dcd499617fa727898f45530a8415591f9893e164b079951ddaa31c0e788a0c","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T18:16:52.159711Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T18:16:47.824858Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.17366","snapshot_observed_at":"2026-08-01T18:16:47.824858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.824858Z"},"links":{"cited_paper":"/paper/2607.17366","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:8d56f85b55e65f293838c3e951b2537c6a0fffe0782ee761f2daba1b72e70590","observation_id":"645a0f54-ba18-4311-83bb-a9a697feb0d2","resolution":{"observed_at":"2026-08-01T18:16:47.824858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.17366/citation-record","integrity":"/paper/2607.17366/integrity","json":"/paper/2607.17366/citation-record.json","paper":"/paper/2607.17366"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:47.758529Z","title":"Different from traditional emotion recog- nition, ERC analyzes dialogue turns and assigns one emotion label per utterance in the dialogue [2, 3]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.758529Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:464ac7dd0ec2651dd2dca5e116f6c759c8298f2b4128d8cf5c62d47b3bad8a82","observation_id":"72abece3-c238-4658-85bc-48e663214d53","resolution":{"observed_at":"2026-08-01T18:16:47.758529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.17366","snapshot_observed_at":"2026-08-01T18:16:47.824858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.824858Z"},"links":{"cited_paper":"/paper/2607.17366","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:8d56f85b55e65f293838c3e951b2537c6a0fffe0782ee761f2daba1b72e70590","observation_id":"645a0f54-ba18-4311-83bb-a9a697feb0d2","resolution":{"observed_at":"2026-08-01T18:16:47.824858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:47.952187Z","title":"frustrated","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.952187Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:a1557a899e4e11ab6c3fb5ce561542cc52bc7cb06bfe4577839b33f60b0d2982","observation_id":"83f6c1b0-c479-443c-888a-63ae682d2e83","resolution":{"observed_at":"2026-08-01T18:16:47.952187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.037266Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.037266Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:6717f49dddd40d29e3c5abad28bbf0e5e945ede608890d37b2e981c178f211af","observation_id":"d5c4c135-59be-438a-bfdf-47d6c4fef071","resolution":{"observed_at":"2026-08-01T18:16:48.037266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.121813Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.121813Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:4a92575a8d14848ed5f1c80f4d1ffe6c970bd86f6a1fcf907849f1a0344110a4","observation_id":"7f56b82f-b977-4a36-bbf6-d3df41f54d02","resolution":{"observed_at":"2026-08-01T18:16:48.121813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.195342Z","title":"All scientific content, experiments and analyses were produced and verified by the authors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.195342Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:ccf74bead25760788b54539cf45c52ee156a3319a2accf31a20f0c31c2aba173","observation_id":"a2c4a905-2744-4b50-a8f2-c139c85bff74","resolution":{"observed_at":"2026-08-01T18:16:48.195342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25624","last_updated":"2026-04-28T13:30:17Z","snapshot_observed_at":"2026-08-07T04:40:15.889438Z","submitted_at":"2026-04-28T13:30:17Z","title":"UNet-Based Fusion and Exponential Moving Average Adaptation for Noise-Robust Speaker Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25624","snapshot_observed_at":"2026-08-01T18:16:48.844266Z","title":"UNet-based fusion and exponential moving average adaptation for noise-robust speaker recognition,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.844266Z"},"links":{"cited_paper":"/paper/2604.25624","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:2d545bbf2a4f0e4c0d5bd8b7d84d9666ad4f9cc7d33802a93a45c30b570ec94a","observation_id":"009ef8f6-bad0-4fba-83e3-c6f87b363d52","resolution":{"observed_at":"2026-08-01T18:16:48.844266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.270725Z","title":"Current state of text sentiment analysis from opinion to emotion mining,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.270725Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:1417807a61ac435d6a39ad41a9083e8fd4829c1fa28b135d4ae336f8e88b88a0","observation_id":"1952ea8d-fd61-4cec-b8f4-48e39677ec5e","resolution":{"observed_at":"2026-08-01T18:16:48.270725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.354608Z","title":"Emotion recognition in conversation: Research challenges, datasets, and recent advances,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.354608Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:b1c80e3f457460380dfd5fa465539da27e404e6c04ea0b723d0f0548b653fbce","observation_id":"13515eed-cfca-4ab8-a1fb-39767cb1c7d9","resolution":{"observed_at":"2026-08-01T18:16:48.354608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.463551Z","title":"MM-NodeFormer: Node transformer multimodal fusion for emotion recognition in conver- sation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.463551Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:f8b38c8844d388b28e0727178010795f137a1b59ff7cd7b16c464e7471f1ce14","observation_id":"a3fa004d-5bce-4014-8b79-5143e8ce8222","resolution":{"observed_at":"2026-08-01T18:16:48.463551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06779","last_updated":"2021-07-14T15:37:02Z","snapshot_observed_at":"2026-07-06T11:29:07.489964Z","submitted_at":"2021-07-14T15:37:02Z","title":"MMGCN: Multimodal Fusion via Deep Graph Convolution Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06779","snapshot_observed_at":"2026-08-01T18:16:48.540579Z","title":"MMGCN: Multimodal fusion via deep graph convolution network for emotion recognition in conversation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.540579Z"},"links":{"cited_paper":"/paper/2107.06779","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:88234b7d057e08c23ae7ed92deac76ba67d19d25aad76b7e280fac68370bd382","observation_id":"0b1d7b1a-0a36-4ca0-80bd-e35dfd0958a1","resolution":{"observed_at":"2026-08-01T18:16:48.540579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.636778Z","title":"Adaptive graph learning for multimodal conversational emotion detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.636778Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:b0c0cb108ce7c5af8e88b6f1297d0558581e63f13de93721198f6f2974ee886a","observation_id":"cb07972a-8a14-4b09-8ab2-e42e22aa7e12","resolution":{"observed_at":"2026-08-01T18:16:48.636778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.718443Z","title":"Distilling attention knowledge for speaker verification,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.718443Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:791897ae5ea3bcdd5b43e1685b5a19d0d63c2394f790ff5501f435f835d0a84d","observation_id":"e92b0f7a-3eb1-40b2-810a-c6ba5ba99a08","resolution":{"observed_at":"2026-08-01T18:16:48.718443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.664826Z","title":"A transformer-based model with self-distillation for multimodal emotion recognition in conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.664826Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:09760bd0e97bb6d1e317128309c2713987efa80027009fee10df3937e959f0b6","observation_id":"2cc8a6a9-2011-4661-8997-3ff371acf5e5","resolution":{"observed_at":"2026-08-01T18:16:49.664826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.946415Z","title":"Curriculum learning meets directed acyclic graph for multimodal emotion recogni- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.946415Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:343ca8f594d454cdc0a35f8668585182c809e952654f750be8d24c5f8c8e4057","observation_id":"c01ace01-0473-4aa1-af77-233661c0da0b","resolution":{"observed_at":"2026-08-01T18:16:48.946415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.021798Z","title":"De- noising student features with diffusion models for knowledge dis- tillation in speaker verification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.021798Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:a72b0b3b293bddd872e63981ce1b09e6cb18d25a049d3b1a586e6617d5a49b69","observation_id":"f5886282-7ab0-4551-b7a8-63a8c175a898","resolution":{"observed_at":"2026-08-01T18:16:49.021798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.143508Z","title":"BA V-MossFormer2: En- hanced MossFormer2 for binaural audio-visual speech enhance- ment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.143508Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:1baa043c8fd72aa48e8fde2d28ccc69f8d2085ca332a9f254ee6d82ff4eb9398","observation_id":"184e7a6f-9bc5-47b1-a5fc-d282b2bfb03e","resolution":{"observed_at":"2026-08-01T18:16:49.143508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.222562Z","title":"COLD Fusion: Calibrated and or- dinal latent distribution fusion for uncertainty-aware multimodal emotion recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.222562Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:7eed218048faf4497a3cd24f62224b1f98332cf6d475224d351e545186e43476","observation_id":"bb91f7e8-0f42-42f1-a889-93840c1129d6","resolution":{"observed_at":"2026-08-01T18:16:49.222562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.376741Z","title":"Feature-enhanced multi- modal interaction model for emotion recognition in conversation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.376741Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:4b88938362fa1600b03420688f4727101d54ee4eb060fe4e6d427e900f01fda8","observation_id":"4de94e72-4934-4909-968c-8a643d5f77d7","resolution":{"observed_at":"2026-08-01T18:16:49.376741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.510511Z","title":"IDIR: Identifying and Distilling Informative Relations for Speaker Verification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.510511Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:73edd95a72a6e45e511decac4962ed2914c9efbff289feaa0c42e805493851bd","observation_id":"73919535-3b20-4181-b302-85a8ee2b9a73","resolution":{"observed_at":"2026-08-01T18:16:49.510511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:47.874082Z","title":",fk] = FeatureFusion[R(t),R (a),R (v)],(4) wheref i ∈R Df denotes the fused multimodal embedding of utteranceu i","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.874082Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:cb2702470dae11ad47e4d026045b4a7070fbbcca2caeb794322ea35d929e46c8","observation_id":"f5c08cd9-b8e8-4a88-801a-e69325fb0869","resolution":{"observed_at":"2026-08-01T18:16:47.874082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.766434Z","title":"Emotional inertia and psychological maladjustment,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.766434Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:f8b4576723c718adbe7c18ae40dff8ad93e7746714d89c9a9c5a15af1fef6e05","observation_id":"5d995a1f-7ddb-4018-b021-fdc78c76f36a","resolution":{"observed_at":"2026-08-01T18:16:49.766434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.879939Z","title":"Emotional inertia and external events: The roles of exposure, reactivity, and recovery,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.879939Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:ae1c32c01191526d4f5224b63c7b1e56062a1c498cf6ed65ebdc50ccdddb9e74","observation_id":"85bdb635-8b1d-480d-a8b1-d795aadd987e","resolution":{"observed_at":"2026-08-01T18:16:49.879939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.009513Z","title":"Emotion recognition in conversations with emotion shift detection based on multi-task learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.009513Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:35920dd20dad6c49aeff59d45e601a0958141c0e26279af453c51ffb8b138fa3","observation_id":"a5666021-908d-46c5-9cc5-f7701cbc71c3","resolution":{"observed_at":"2026-08-01T18:16:50.009513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.132145Z","title":"Hybrid curriculum learn- ing for emotion recognition in conversation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.132145Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:e96e22ca26ec074add56414aa50f2e17b161a94bdee0aa9b17c2e9469b7a2008","observation_id":"ab6a7b5e-b10e-4a61-b269-422ded8b7657","resolution":{"observed_at":"2026-08-01T18:16:50.132145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.204190Z","title":"The Emotion is Not One-hot Encoding: Learning with Grayscale Label for Emotion Recognition in Conversation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.204190Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:9127a777650d4d09699c9840c4063963d103506bbaf0c2737d95ea0c6a61eb8c","observation_id":"1c032a20-ee69-4d70-b653-7d7bb73f61ae","resolution":{"observed_at":"2026-08-01T18:16:50.204190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.337252Z","title":"Beyond single emotion: Multi-label ap- proach to conversational emotion recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.337252Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:428a0c16a3bb3fee8326ae065d3e956bbbe22219ec5b2f685e3cfa3efb45170b","observation_id":"fbc0fa7e-ffa2-4acf-a14e-3832a8c4ddc2","resolution":{"observed_at":"2026-08-01T18:16:50.337252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.447076Z","title":"M2FNET: Multi-modal fusion network for emotion recognition in conversation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.447076Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:8cc306d72faf5fd6ad8888c3aa620f26611dfab50cb10f685648822d3f7874ce","observation_id":"21d77d50-9852-4da9-a62f-6eda1a211042","resolution":{"observed_at":"2026-08-01T18:16:50.447076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.11540","last_updated":"2019-08-30T05:44:24Z","snapshot_observed_at":"2026-08-06T12:48:13.189790Z","submitted_at":"2019-08-30T05:44:24Z","title":"DialogueGCN: A Graph Convolutional Neural Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.11540","snapshot_observed_at":"2026-08-01T18:16:50.602525Z","title":"DialogueGCN: A graph convolutional neural net- work for emotion recognition in conversation,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.602525Z"},"links":{"cited_paper":"/paper/1908.11540","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:d4c9f04a0f32bab4ec52e1072190e5f56f9315998d9f48ad8281db5158cc429f","observation_id":"380ded5e-fbbe-4158-ae3d-3daffa656ca6","resolution":{"observed_at":"2026-08-01T18:16:50.602525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15432","last_updated":"2024-04-13T01:05:05Z","snapshot_observed_at":"2026-08-07T09:16:33.171687Z","submitted_at":"2023-07-28T09:29:42Z","title":"CFN-ESA: A Cross-Modal Fusion Network with Emotion-Shift Awareness for Dialogue Emotion Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15432","snapshot_observed_at":"2026-08-01T18:16:50.710392Z","title":"CFN-ESA: A cross-modal fusion network with emotion-shift awareness for dialogue emo- tion recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.710392Z"},"links":{"cited_paper":"/paper/2307.15432","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:c5576bb03b8e3d28179f538adfc191292f743ca3d0881265856e840ee1df9907","observation_id":"582d0d96-59ab-4dae-8baf-17c1da83f246","resolution":{"observed_at":"2026-08-01T18:16:50.710392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.896934Z","title":"DER-GCN: Dialog and event relation-aware graph convolutional neural network for mul- timodal dialog emotion recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.896934Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:7b42ac00e30160750f1c22f0cdafb3bf6b8b3535157c6967f46d12b62e54b6b1","observation_id":"37bd7782-6589-4790-9732-7dbef7cbb058","resolution":{"observed_at":"2026-08-01T18:16:50.896934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:51.116094Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.116094Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:12ce342c4124ded1997f882c7080dd9cfcb43c3e7f7439452f5205dd66a756da","observation_id":"e18e443f-da23-45e9-b58f-049d00e23dcc","resolution":{"observed_at":"2026-08-01T18:16:51.116094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-07-06T07:06:12.726165Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-01T18:16:51.388447Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.388447Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:9d13f28a108b42c719ac8cd6db94c2e28d1747feb87ea0bb59c867deed13ef7a","observation_id":"acb99571-8d10-496e-a60d-d94f803d3602","resolution":{"observed_at":"2026-08-01T18:16:51.388447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:51.573531Z","title":"MM-DFN: Mul- timodal dynamic fusion network for emotion recognition in con- versations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.573531Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:8fdb6e8b490ae221134f1253502a4c4cab7079c55fccc08cb3e9213dafb0e60d","observation_id":"65ef8de5-cdb8-4f65-b8b3-12ebf86e9d54","resolution":{"observed_at":"2026-08-01T18:16:51.573531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-01T18:16:51.811004Z","title":"RoBERTa: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.811004Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:c56b9158282b14b7f583dcdf3850bff2aec645f844c782f8af6559270e62af21","observation_id":"562f7139-2ce8-42d6-82ac-5c8af71d4bb6","resolution":{"observed_at":"2026-08-01T18:16:51.811004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:52.006106Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:52.006106Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:caae932a945c7caca2a8e532bc8a0b1feabae81522bd1217709420877449fca4","observation_id":"889ee96b-5f5f-4930-b71d-373a72fbb195","resolution":{"observed_at":"2026-08-01T18:16:52.006106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:52.159711Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:52.159711Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:2a06786b62b16e5c47b5576ba03b9b41d155541bdb1e2dad44ce71dba2d9846a","observation_id":"93f7e0d0-c137-4a83-8959-266640fd94ac","resolution":{"observed_at":"2026-08-01T18:16:52.159711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-07T06:47:08.059996Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2607.17366."}