{"as_of":"2026-08-08T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d1bbe391a88bb5c4ed8a428efd6a4db590c6badbdb6b87a018dc73368f098ec8","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:53:11.190273Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.21395/citation-record","integrity":"/paper/2507.21395/integrity","json":"/paper/2507.21395/citation-record.json","paper":"/paper/2507.21395"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.303805Z","title":"Exploring emotional connections: A systematic literature review of attachment in human-robot interaction,","venue":null,"work_id":"deb1d6a6-a3e9-4268-a904-b4d5ec46cc62","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.901066Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:9a467712e92d350d4fbcfc5dab46e76aaf7dfd84f9c1c7c6174b8e872b9958a5","observation_id":"c8907b39-3d64-4146-89e8-af09aa2a51ee","resolution":{"observed_at":"2026-08-06T12:53:12.308932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.286387Z","title":"Ai, robotics, medicine and health sciences,","venue":null,"work_id":"38501792-b5ae-4445-8484-a79c6531881a","year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.906361Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:de3642d57a30dd9f024d494eef5aa87ff65150f57df5268c3f67ef4fa55d4b63","observation_id":"5e48f0f1-6c6d-41e2-90f2-b98f62f5b8f0","resolution":{"observed_at":"2026-08-06T12:53:12.292061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.267583Z","title":"A scoping review of the literature on prosodic elements related to emotional speech in human-robot interaction,","venue":null,"work_id":"a134855a-cffa-44f8-96aa-265e3f01eea4","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.911595Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:e1d22d4e855efe31750d49cad5490a18b11180d09767f828433430c2f9fc5521","observation_id":"a840a6de-b39a-4a9a-a800-3483b22c357c","resolution":{"observed_at":"2026-08-06T12:53:12.273745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.248711Z","title":"A novel emotion recognition system for human– robot interaction (hri) using deep ensemble classification,","venue":null,"work_id":"567ea0f7-c460-4932-841c-c98f25e299db","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.916925Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:2bfdb1a19058c9bc177324231ed4af707def4787e391c3bbd4a11e01c87ab2e8","observation_id":"30e87067-317c-428c-92db-ddb8b56c14ec","resolution":{"observed_at":"2026-08-06T12:53:12.253509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.230330Z","title":"Towards the development of affective facial expression recognition for human-robot interaction,","venue":null,"work_id":"e8f80ebe-74e2-4179-ad71-fd1750788e51","year":2017},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.921596Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:f84378d3cd1edf46fe1d25315f40fd9f60b1d17af27e4b1ed8bad90441c18adb","observation_id":"13172f86-aba6-4a77-8b93-694597901a88","resolution":{"observed_at":"2026-08-06T12:53:12.236267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.213492Z","title":"Multimodal human–robot interaction for human-centric smart manufacturing: a survey,","venue":null,"work_id":"429ca388-5a81-44e5-aa41-ba8c6ca68d62","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.926328Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:af6ff5492223e479c98c2df618a7cec1dbcb6089b2e271909e82d5eeba54c586","observation_id":"5772f65b-8e7d-40ab-b984-b735232feb9c","resolution":{"observed_at":"2026-08-06T12:53:12.218397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.198424Z","title":"Beyond sentiment analysis: A review of recent trends in text based sentiment analysis and emotion detection,","venue":null,"work_id":"f472552e-0e8e-4a5f-b2b5-09b4606c341a","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.931969Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:f30f33681fc13cfd6d0cf8b63a66e4fe102ff996013e3dcd466e72683885544f","observation_id":"b4f02fb9-2a47-490d-aea8-af533a34a17d","resolution":{"observed_at":"2026-08-06T12:53:12.203129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.183791Z","title":"Deep learning–based text classification: a comprehensive review,","venue":null,"work_id":"a077c29f-ab66-4ad5-a20f-b431b6a5c0c6","year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.936766Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:1b43f4df8f703090cfbf9c332dfddc8973de72aa06dfc6000e5a9ea4fc326ef3","observation_id":"eb86e02a-07ea-44f0-895b-3eb62ed77744","resolution":{"observed_at":"2026-08-06T12:53:12.188315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.168559Z","title":"Building emotional dictionary for sentiment analysis of online news,","venue":null,"work_id":"23c368a2-ee79-4f1c-a4d9-572dfbced64c","year":2014},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.941709Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:9de30ce7b23a92d08c17c205127e40460f2046faf31f775382af307565625125","observation_id":"e49521c0-ac90-4486-baf5-5e7234174e67","resolution":{"observed_at":"2026-08-06T12:53:12.173276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.151542Z","title":"Deep convolutional neural networks for sentiment analysis of short texts,","venue":null,"work_id":"d4c3c041-a61e-49ed-adab-4117d16c0b2a","year":2014},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.946624Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:2fd6e2aa9bcdc1ef1348686962e0e3c9112a70c9daae4d56c1df16d7f9c989fe","observation_id":"5e425230-78a3-4ef5-9624-5d8c2bc2749f","resolution":{"observed_at":"2026-08-06T12:53:12.156368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.03820","last_updated":"2016-04-06T23:20:27Z","snapshot_observed_at":"2026-08-06T02:26:48.879223Z","submitted_at":"2015-10-13T19:00:57Z","title":"A Sensitivity Analysis of (and Practitioners' Guide to) Convolutional Neural Networks for Sentence Classification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.03820","snapshot_observed_at":"2026-08-06T12:53:10.951051Z","title":"A sensitivity analysis of (and practitioners’ guide to) convolutional neural networks for sentence classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.951051Z"},"links":{"cited_paper":"/paper/1510.03820","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:7af2edf82cbb2c2cd8c3549c376157ced027924a22176935d644aff11f911234","observation_id":"b572515e-e625-4097-b6bf-8639821f7fbc","resolution":{"observed_at":"2026-08-06T12:53:10.951051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.135446Z","title":"Recurrent neural networks for emotion recognition in video,","venue":null,"work_id":"f2b3d1e0-de37-405f-bda7-bd0059aadcfd","year":2015},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.956925Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:909321cc74a52f077f5c20d27af57fc090414f34c7daf0210587fa866f09e03a","observation_id":"f5226e0e-e3bc-4196-96d1-0016f390cba6","resolution":{"observed_at":"2026-08-06T12:53:12.141024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.119600Z","title":"Fundamentals of recurrent neural network (rnn) and long short-term memory (lstm) network,","venue":null,"work_id":"c6c26343-6457-4eb3-8133-90ae8d92a9e7","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.961416Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:1f93ba9a81ba3a8bb580ff15c9bb7509f9e7bfb7f934f79279c501420e6c1867","observation_id":"044045db-ecde-4f93-abc1-4238d311cd73","resolution":{"observed_at":"2026-08-06T12:53:12.124244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.105015Z","title":"Text sentiment analysis based on long short-term memory,","venue":null,"work_id":"3a293e19-cd75-4d20-9eb8-97088eb3a9ae","year":2016},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.965861Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:dbf78d721821d32863cc5651951aaccbe65c365e382c82a025f223253be2de26","observation_id":"2ab7bb32-d0d6-4225-9b3f-dbee271ad00a","resolution":{"observed_at":"2026-08-06T12:53:12.109507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.090034Z","title":"Emotion recognition from facial expressions using hybrid feature descriptors,","venue":null,"work_id":"1e704f4d-68ef-4df4-ab86-aba6ec7a570f","year":2018},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.970592Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:a4db101be670717f401e1d768a8722787fe444b312b2bdaad8cfc4ea8929d589","observation_id":"3f2e417f-6f12-4861-9304-7c8905a9d0ab","resolution":{"observed_at":"2026-08-06T12:53:12.094855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.074736Z","title":"Using multiple steerable filters and bayesian regularization for facial expression recognition,","venue":null,"work_id":"5b2b880b-8127-406d-ae6a-f1e2d62205de","year":2015},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.974896Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:9cf13f295ffedd1e7ec79c36465558e82d2e2b248215e5baaf06e970f20928d7","observation_id":"0cd8de46-0e41-488f-9a1d-496746b20724","resolution":{"observed_at":"2026-08-06T12:53:12.079812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.059981Z","title":"Automatic speech emotion recogni- tion using support vector machine,","venue":null,"work_id":"24ac2433-1495-4f7a-b2a1-537ef0b14e37","year":2011},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.979660Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:bc93cf7a051df8e2d299611634209c33dc377222032f6a8057c1ec90137d5b2f","observation_id":"dffe03a9-5a99-4032-a446-a4aefcad4e72","resolution":{"observed_at":"2026-08-06T12:53:12.064621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.042882Z","title":"Adieu features? end-to-end speech emotion recognition using a deep convolutional recurrent network,","venue":null,"work_id":"d2486f7a-d6db-46df-b83c-ba89f94f3233","year":2016},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.984240Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:e82530b2b6a9b89243937437909d7d80e957f9a9c04910c4fb453786840d41f1","observation_id":"aadc8dde-adb4-4df0-a6d2-ebe7333a39c3","resolution":{"observed_at":"2026-08-06T12:53:12.048643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.024081Z","title":"Micro-expression recognition based on 3d flow convolutional neural network,","venue":null,"work_id":"85009dac-05a0-43c1-8831-85901fa1cb8d","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.988606Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:006c9509389e3364d64f3dac8bd4e8b0ffd666fff88c4f85b7860506d281cfbb","observation_id":"ccaf72a0-0aaa-4196-bf20-255fadbcc725","resolution":{"observed_at":"2026-08-06T12:53:12.029312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.006354Z","title":"Applying segment-level attention on bi- modal transformer encoder for audio-visual emotion recognition,","venue":null,"work_id":"a4c9c108-03ac-415f-a890-d9dca1c216c0","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.993637Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:22f691e6d233143e64a359f39cfd125188904141c9fc72e405694ee301cc6720","observation_id":"df32d6e6-4ea6-4109-a0c9-25a0c2397baf","resolution":{"observed_at":"2026-08-06T12:53:12.012333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.989407Z","title":"Multimodal and temporal perception of audio-visual cues for emotion recognition,","venue":null,"work_id":"9c97de52-7b83-4e65-b128-e004056ecb25","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.998395Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:ccfaea8d5bd8db59146e1fb4337646b68db43678688008ffaee29d824332fbd8","observation_id":"32e84e13-d5eb-4b76-8154-d1f198e63977","resolution":{"observed_at":"2026-08-06T12:53:11.995330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.973996Z","title":"Multimodal emotion recognition using deep generalized canonical correlation analysis with an attention mechanism,","venue":null,"work_id":"12b5a33c-8eb9-4fef-990d-186239fedc18","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.002793Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:c2f86f6b5566cd77852470352d401a8ca5cf4dea1b8cda7fe270d44ce9f0ef4b","observation_id":"a318e279-2920-4720-b4ec-f79d1a17fe68","resolution":{"observed_at":"2026-08-06T12:53:11.978784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.958316Z","title":"Outlier processing in multimodal emotion recognition,","venue":null,"work_id":"77fe7de5-2e84-4323-bece-237443974ba3","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.007286Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:f47176acb24656aa1e60d2df6c8337bd620012cacc89f500431519d81cd5bea6","observation_id":"db8d1567-aee3-4403-a658-6cd2edc3d663","resolution":{"observed_at":"2026-08-06T12:53:11.963667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.942491Z","title":"Graph-based hierarchical semantic consistency network for remote sensing image-text retrieval,","venue":null,"work_id":"8da5e153-d12d-4dc8-99cd-484445e803f8","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.013056Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:97178529b8401ae8b5ee14b0ea940384087d5ebdfbb1ac628bb14f55d74c2dd5","observation_id":"b697cbe2-cc6a-4015-b691-ad6671a99d19","resolution":{"observed_at":"2026-08-06T12:53:11.947904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.925751Z","title":"Fine-grained alignment and interaction for video grounding with cross- modal semantic hierarchical graph,","venue":null,"work_id":"edecb2c2-0b05-460f-9d43-0eba4d2495dd","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.017794Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:f0f4151037349a4cb2f47280f55a5539bbe8bad68d042c65c11a08e5a17931a8","observation_id":"78315896-7a8b-4499-8d94-69a188c31dc9","resolution":{"observed_at":"2026-08-06T12:53:11.931739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.908768Z","title":"Hybrid multi-attention network for audio–visual emotion recognition through multimodal feature fusion,","venue":null,"work_id":"47ca15c8-f9d9-4fe0-b49a-5167488aba41","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.022422Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:4f071ea3a604c870408da51cf61a556d91a69d8c2c983e7201e2224c1fe4a48f","observation_id":"924eb5c1-c193-4b6c-a078-e8d6004e3d65","resolution":{"observed_at":"2026-08-06T12:53:11.913749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.891973Z","title":"Aia-net: Adaptive interactive attention network for text–audio emotion recognition,","venue":null,"work_id":"322dd914-1ae2-4a15-8a4e-5dc960e040b0","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.028268Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:c21fad6c6f8a3c255de703e1d351b2c3175bff3f0530bb83c063653a2c7a0ff1","observation_id":"084c2dc1-9f4e-4cad-9b44-a9f6acf77aaf","resolution":{"observed_at":"2026-08-06T12:53:11.898082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.875932Z","title":"Dynamic and static fusion mechanisms of infrared and visible images,","venue":null,"work_id":"9af510fc-d12f-4793-b330-85b69fc08fa8","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.034610Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:ae648de3a22d8b40844db701e772576a140a52a690d3656f12770ceba639c04b","observation_id":"e7a28fdf-9d2f-4f4f-b4a7-8f129cd58f47","resolution":{"observed_at":"2026-08-06T12:53:11.881056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03821","last_updated":"2021-01-26T08:08:02Z","snapshot_observed_at":"2026-08-06T12:56:05.362170Z","submitted_at":"2019-11-10T01:39:46Z","title":"Adaptive Fusion Techniques for Multimodal Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03821","snapshot_observed_at":"2026-08-06T12:53:11.039296Z","title":"Adaptive fusion techniques for multi- modal data,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.039296Z"},"links":{"cited_paper":"/paper/1911.03821","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:379ec7d1454d478774288da9463239d218596bb8d092b5ccc95404505ca0325e","observation_id":"62768984-9e57-4e85-b579-bf1e05b56eff","resolution":{"observed_at":"2026-08-06T12:53:11.039296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02794","last_updated":"2023-03-05T23:01:02Z","snapshot_observed_at":"2026-08-05T20:39:20.097228Z","submitted_at":"2023-03-05T23:01:02Z","title":"CoRTX: Contrastive Framework for Real-time Explanation","version":1},"cited_work":{"arxiv_id":"2303.02794","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.02794","snapshot_observed_at":"2026-08-06T12:53:11.471804Z","title":"CoRTX: Contrastive Framework for Real-time Explanation","venue":"cs.LG","work_id":"91c53fb1-5f55-40e4-80c5-7f6ddccd5fe7","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.050662Z"},"links":{"cited_paper":"/paper/2303.02794","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:b28daa0d36a9ab5bf5edd6b50cd9989d339b864650227971bf62a0d234f2ebbb","observation_id":"169c8c2d-444e-4ddf-9aed-d586519c2cfd","resolution":{"observed_at":"2026-08-06T12:53:11.498118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.04446","last_updated":"2019-04-09T03:25:53Z","snapshot_observed_at":"2026-07-06T07:44:51.580206Z","submitted_at":"2019-04-09T03:25:53Z","title":"HiGRU: Hierarchical Gated Recurrent Units for Utterance-level Emotion Recognition","version":1},"cited_work":{"arxiv_id":"1904.04446","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.04446","snapshot_observed_at":"2026-08-06T12:53:11.401465Z","title":"HiGRU: Hierarchical Gated Recurrent Units for Utterance-level Emotion Recognition","venue":"cs.CL","work_id":"37c4ae79-af0d-471c-a686-52f761e7c7dc","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.056219Z"},"links":{"cited_paper":"/paper/1904.04446","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:261aee416632e18939e8fdeb8fff5e990f9f2681d68a38f885ed588a64925a30","observation_id":"a80d9179-f257-431c-9eac-55c85c46a171","resolution":{"observed_at":"2026-08-06T12:53:11.436791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.860036Z","title":"Semantic-emotion neural network for emotion recognition from text,","venue":null,"work_id":"80c49746-cdc4-4b42-94b0-7f85da1c139c","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.062074Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:03d6bb841ccf72a18044e27f3962b627a16a533c75c279e4f7d21c45d6f97ed8","observation_id":"ab587487-9456-4776-b6f8-1d525a36421f","resolution":{"observed_at":"2026-08-06T12:53:11.865238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.844064Z","title":"Aspect-based sen- timent analysis via affective knowledge enhanced graph convolutional networks,","venue":null,"work_id":"37320426-6e43-4b20-bc5e-00a592a798e1","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.067483Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:5fc99e8fa0fd2a4c00cc6db5671af6abb092d43e60b558e0e4df211095342db6","observation_id":"89067538-fa8a-4651-b22f-8d0e6ab4cf1a","resolution":{"observed_at":"2026-08-06T12:53:11.849544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.827927Z","title":"Graph con- volutional network with multiple weight mechanisms for aspect-based sentiment analysis,","venue":null,"work_id":"7c604e18-d445-4f94-9560-7250c6a48816","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.074281Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:cb4511df2dcf595ad580689ff5aaa7f5461cc0df0e1a1ddf8f97043a6064aecb","observation_id":"4b084878-66c3-41de-90c4-8b679062a101","resolution":{"observed_at":"2026-08-06T12:53:11.833172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.810431Z","title":"Multimodal emotion recognition in polish (student consortium),","venue":null,"work_id":"376e12ce-b8da-412f-952c-d0d1f1c0b163","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.079139Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:7f0c8f9a42042ec60b43b53d1676a67bc6e40fed48efd8e755f169b37eb1ac0c","observation_id":"da61e49f-3a51-46bb-bd13-4591c95c61ca","resolution":{"observed_at":"2026-08-06T12:53:11.815309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.793833Z","title":"Cfn-esa: A cross-modal fusion network with emotion-shift awareness for dialogue emotion recognition,","venue":null,"work_id":"d2fcc23d-f45e-4765-960d-ba2c10fb60e0","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.084367Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:0369420e2f30b8cf065a1aa2fc01a34b9db1f391641d8784ca139cb139572c6e","observation_id":"f8ef073a-2ec8-4249-9010-4df1e551b7b3","resolution":{"observed_at":"2026-08-06T12:53:11.799257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.775878Z","title":"Multi-modal emotion recognition in conversation based on prompt learning with text-audio fusion features,","venue":null,"work_id":"7c5aa5d4-737b-44c0-a4a9-5468fac65e31","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.091821Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:eabdaac17033d3663d7b859486cee6c101c1329ecd89124693f0984dbed6ec1b","observation_id":"48e87261-9aef-4224-af2f-158fe7d7ef14","resolution":{"observed_at":"2026-08-06T12:53:11.781257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.11540","last_updated":"2019-08-30T05:44:24Z","snapshot_observed_at":"2026-08-06T12:48:13.189790Z","submitted_at":"2019-08-30T05:44:24Z","title":"DialogueGCN: A Graph Convolutional Neural Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.11540","snapshot_observed_at":"2026-08-06T12:53:11.097917Z","title":"Dia- loguegcn: A graph convolutional neural network for emotion recognition in conversation,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.097917Z"},"links":{"cited_paper":"/paper/1908.11540","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:8ce82a461801b8a45752984e73f5f84363e515306b472bf01480cb554b555903","observation_id":"677edfdc-a92f-4841-8db8-4b9bc47f269b","resolution":{"observed_at":"2026-08-06T12:53:11.097917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.759450Z","title":"Rgat: A deeper look into syntactic dependency information for coreference resolution,","venue":null,"work_id":"0a142e98-9782-4795-9178-02df70dcfe5c","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.104682Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:c362a7fc282c1976777eed02f8d1a30cff333c6f81d2c622162507732e4f01af","observation_id":"edb16290-4309-4446-b2ca-593d782ba975","resolution":{"observed_at":"2026-08-06T12:53:11.764756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.739778Z","title":"Sdr-gnn: Spectral domain reconstruction graph neural network for incomplete multimodal learning in conversational emotion recognition,","venue":null,"work_id":"e57cb53c-a480-461d-a755-275dba80c46f","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.110038Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:e5cec59f793feaba77d4c411951bd3334b3214c323c0a02379cbbcaaa6ab6a68","observation_id":"0f8b2911-fa91-4443-96a5-125faa4cfd51","resolution":{"observed_at":"2026-08-06T12:53:11.745394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.722893Z","title":"Multivariate, multi-frequency and multimodal: Rethinking graph neural networks for emotion recog- nition in conversation,","venue":null,"work_id":"d5ffbb59-cc01-49ab-bacc-4b3752fd7c1c","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.115173Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:4dd303c54b92e681059820c4a7a7badd66bb794ccc09cc3c942e02f71a4fee2d","observation_id":"7c3f5814-5af2-423a-a201-cfc314beca45","resolution":{"observed_at":"2026-08-06T12:53:11.728041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.705273Z","title":"Multimodal decoupled dis- tillation graph neural network for emotion recognition in conversation,","venue":null,"work_id":"84641018-9d0e-495e-b8c1-2c31582eb720","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.120242Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:b64d5eb0ffe1e18f7e7c06b785cd8b25d28883bf5ba5fbb528d281a18fbc813c","observation_id":"425a2f1c-c3a1-43a3-86b5-296ecd61946e","resolution":{"observed_at":"2026-08-06T12:53:11.711607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.686922Z","title":"Conversational memory network for emotion recognition in dyadic dialogue videos,","venue":null,"work_id":"e1e0ee5f-ac3f-49d9-bcec-5b7b9e461585","year":2018},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.125664Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:769ad4c1de9efa65c4edc094b08997561aa401bc40e6e7644d1dd4146c527339","observation_id":"688134a8-235c-436a-af76-d40ba9c6095d","resolution":{"observed_at":"2026-08-06T12:53:11.692640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.665819Z","title":"Icon: Interactive conversational memory network for multimodal emo- tion detection,","venue":null,"work_id":"d69aa755-5779-4789-8de9-262f9830b587","year":2018},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.131591Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:75f92ed0bb45fb9f94b4e40084a7bc7542d98e145bbb7983da3ca7e19c34154d","observation_id":"d1a4b21c-722d-4341-90e9-c9c8bd3507f3","resolution":{"observed_at":"2026-08-06T12:53:11.671898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.647190Z","title":"Dialoguernn: An attentive rnn for emotion detection in conversations,","venue":null,"work_id":"b89495cd-eb82-465f-85ed-4c9bec45922f","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.137184Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:280672a267dd5bafa4cb3161d7bba340e236d28891ed8d9da445111c7ff1996e","observation_id":"0f6e0ed8-cb3e-4326-95a8-f3fb5f47e249","resolution":{"observed_at":"2026-08-06T12:53:11.652544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.629736Z","title":"Dialoguecrn: Contextual reasoning net- works for emotion recognition in conversations,","venue":null,"work_id":"f035bd3e-06ff-427d-866c-be836b91bd8b","year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.142390Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:590707bc76988ee8a306cf94993bb69e514fcdf6b859d0742ef3d0540cc8f839","observation_id":"eed97ed0-7c05-4392-b80a-0152c75c08dd","resolution":{"observed_at":"2026-08-06T12:53:11.634776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06779","last_updated":"2021-07-14T15:37:02Z","snapshot_observed_at":"2026-07-06T11:29:07.489964Z","submitted_at":"2021-07-14T15:37:02Z","title":"MMGCN: Multimodal Fusion via Deep Graph Convolution Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06779","snapshot_observed_at":"2026-08-06T12:53:11.147490Z","title":"Mmgcn: Multimodal fusion via deep graph convolution network for emotion recognition in conversation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.147490Z"},"links":{"cited_paper":"/paper/2107.06779","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:b8b3cd0593487de51c76157965605c543a9f8ba5c70303c2f634ae9a824b2a96","observation_id":"48734d00-832a-4382-91c4-c3c610710c6c","resolution":{"observed_at":"2026-08-06T12:53:11.147490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.02455","last_updated":"2022-05-05T05:54:24Z","snapshot_observed_at":"2026-08-02T03:57:59.438119Z","submitted_at":"2022-05-05T05:54:24Z","title":"COGMEN: COntextualized GNN based Multimodal Emotion recognitioN","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.02455","snapshot_observed_at":"2026-08-06T12:53:11.153551Z","title":"Cogmen: Con- textualized gnn based multimodal emotion recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.153551Z"},"links":{"cited_paper":"/paper/2205.02455","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:dd8287b418d0e840369ab2c0824b9d842e1745a9e813871adec356068fdb1c91","observation_id":"97c2495c-ea7d-4338-8bb3-b08d44e21a60","resolution":{"observed_at":"2026-08-06T12:53:11.153551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.613999Z","title":"Joyful: Joint modality fusion and graph contrastive learning for multimoda emotion recogni- tion,","venue":null,"work_id":"b74e0ac4-f5e1-4bf0-9549-28d5d0d003ed","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.160990Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:41ddac59422448fbe8adca3ebe9b16032cd6717f5342a974b952de5a95eaa17f","observation_id":"acd776cb-244c-40e1-898d-f48b2ccdd938","resolution":{"observed_at":"2026-08-06T12:53:11.618699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.596236Z","title":"Mm-dfn: Multimodal dynamic fusion network for emotion recognition in conversations,","venue":null,"work_id":"135df4a3-cac4-429c-97bf-34d4f03db8d1","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.169474Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:3814ff5c500203bfb785fd2841feb76cb36e8701f2868b4e186ec54eb8aa7408","observation_id":"e2636b35-446e-4625-b11b-88d073e4820a","resolution":{"observed_at":"2026-08-06T12:53:11.601653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21536","last_updated":"2025-06-29T16:49:43Z","snapshot_observed_at":"2026-08-02T21:53:22.784750Z","submitted_at":"2024-07-31T11:47:36Z","title":"Tracing Intricate Cues in Dialogue: Joint Graph Structure and Sentiment Dynamics for Multimodal Emotion Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21536","snapshot_observed_at":"2026-08-06T12:53:11.175855Z","title":"Tracing intricate cues in dialogue: Joint graph structure and sentiment dynamics for multimodal emotion recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.175855Z"},"links":{"cited_paper":"/paper/2407.21536","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:59205f75d4ddf72c64b439c042fbe2b5a4488132ada56b0fca9f61f3f4bb67aa","observation_id":"0f0a91bb-705f-4b83-a70e-9e535d353e90","resolution":{"observed_at":"2026-08-06T12:53:11.175855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.564965Z","title":"Der-gcn: Dialog and event relation-aware graph convolutional neural network for multimodal dialog emotion recognition,","venue":null,"work_id":"376b5609-8577-4e25-abd4-65fed1418dbf","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.184214Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:51b5aea784a320ea44748559b9d72cc91643878e9d7bb54cbac701e3cc34b6d0","observation_id":"c1fbbc7a-3af7-434c-ac16-c780053d887b","resolution":{"observed_at":"2026-08-06T12:53:11.582914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01505","last_updated":"2023-07-09T23:27:27Z","snapshot_observed_at":"2026-07-06T15:37:08.613825Z","submitted_at":"2023-06-02T12:52:38Z","title":"Supervised Adversarial Contrastive Learning for Emotion Recognition in Conversations","version":2},"cited_work":{"arxiv_id":"2306.01505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.01505","snapshot_observed_at":"2026-08-06T12:53:11.248215Z","title":"Supervised Adversarial Contrastive Learning for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"a8b0af65-0bb7-4bdc-a74f-6c9f55ab956a","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.190273Z"},"links":{"cited_paper":"/paper/2306.01505","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:821aeafbe054cbdd8558c49bda6d6024efa2b977d0d1d2d6ee3e7d334b06d8c9","observation_id":"639c7448-3776-446a-bf7a-7c29b9cf2ed6","resolution":{"observed_at":"2026-08-06T12:53:11.258925Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":3,"verified_fuzzy":44},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2507.21395."}