{"as_of":"2026-08-08T04:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2cb410a05b3e4a374b71143b7ff0830dd69e2034e73f851ff546d8b37c3674f2","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:54:17.535098Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.20796/citation-record","integrity":"/paper/2508.20796/integrity","json":"/paper/2508.20796/citation-record.json","paper":"/paper/2508.20796"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:18.102645Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":"93ca98b8-ed9f-479f-a258-665ad11faf92","year":2008},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.385053Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:0b7ef6e16ed2d328bbbf928c6e1199eb383ad9092099fc5cc1f87fff6e82a61a","observation_id":"0b3f890c-1f78-4c47-b514-ed28def712ab","resolution":{"observed_at":"2026-08-05T14:54:18.108004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:18.081357Z","title":"Multimodal emotion recognition based on deep temporal features using cross-modal trans- former and self-attention,","venue":null,"work_id":"42fe4dcb-039c-4399-b068-daf8e0757917","year":2023},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.390825Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:e9cf1ecbc0fa2a3f64c4b8657f624a6cdf0d12383fb90dc12837da70f8f7a3c3","observation_id":"a0e37626-ff4b-4bcd-8d39-046d7e6948a1","resolution":{"observed_at":"2026-08-05T14:54:18.087884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:18.062322Z","title":"A first look into a convolutional neural network for speech emotion detection,","venue":null,"work_id":"715fd964-13f2-4df4-943a-09f8fbcae01b","year":2017},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.396671Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:70d1feaa962ad5a4b826bb4015d59147c84a54058de54c81346847eb6d6a08d2","observation_id":"0853cba1-65e0-4c1e-ab22-ebc69e1ca466","resolution":{"observed_at":"2026-08-05T14:54:18.067743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:18.044111Z","title":"Speech emotion recognition using deep learning techniques: A review,","venue":null,"work_id":"f59232ec-b4bb-4e03-b719-cccb52fe8f33","year":2019},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.402232Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:75420d9327ce365370cd538b19fdf56d0d69fca216e053afd23d7e6100a5d517","observation_id":"4d766f41-f700-4032-832c-0ff302c84417","resolution":{"observed_at":"2026-08-05T14:54:18.049727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.407856Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.407856Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:6a9bb0b3ebad2d2f13ec56d6f5f3dd5d40353550154c8bcee8fb1f16ab7e52b2","observation_id":"dc906b9a-7fc0-43b5-bccb-25535a29bcfb","resolution":{"observed_at":"2026-08-05T14:54:17.407856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:18.002571Z","title":"Hubert: How much can a bad teacher benefit asr pre-training?","venue":null,"work_id":"f850fc66-fff2-4b23-a104-3629f3aff1e1","year":2021},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.413840Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:9a120be6814721b0722f193b71b75491135c41a889ba1926dfc58aa1a5bdb739","observation_id":"1fc03c80-ae80-4340-8866-0aa5ceb308b1","resolution":{"observed_at":"2026-08-05T14:54:18.009528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.420197Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.420197Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:a773da9272a43f8dc5ecbdec0bf182ab1e978c2d88a37475d55cd75d5b08cd55","observation_id":"42647d03-93db-4651-bdb3-63ef01ff74f2","resolution":{"observed_at":"2026-08-05T14:54:17.420197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.968027Z","title":"Emotion recognition in conversation: Research challenges, datasets, and recent advances,","venue":null,"work_id":"58639d31-2c74-46ac-b468-0bc8dbb7a0b7","year":2019},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.425090Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:13eac9a81a351e195d663a752e958512edfa83abb6e4d3ec17d3c37047e3abe2","observation_id":"340e58b2-aba5-41a8-9779-9ecc02759d7c","resolution":{"observed_at":"2026-08-05T14:54:17.974561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.949034Z","title":"Multimodal machine learning: A survey and taxonomy,","venue":null,"work_id":"5741404c-b0c5-4ddb-b1f2-589aa35fb1bd","year":2018},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.431627Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:93f74d0e6a7c1571ed2ba6ec8afb033f6641e7446ee5e02391349ecf1cfd8d42","observation_id":"786cd38c-8369-4f76-977c-770d66c46cd8","resolution":{"observed_at":"2026-08-05T14:54:17.955131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.930551Z","title":"Multimodal sentiment analysis: Addressing key issues and setting up the baselines,","venue":null,"work_id":"87cc76fd-1cdf-4a15-811c-4dd623600879","year":2018},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.437898Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:959cda1af63a5a8ba62268d482bdfe37de5200c050739e4b4e9f5933c0e4e1b4","observation_id":"1eceb949-e1fc-43f5-82f5-47bd8322d91a","resolution":{"observed_at":"2026-08-05T14:54:17.936087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.07250","last_updated":"2017-07-23T05:54:20Z","snapshot_observed_at":"2026-07-06T05:52:17.418793Z","submitted_at":"2017-07-23T05:54:20Z","title":"Tensor Fusion Network for Multimodal Sentiment Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.07250","snapshot_observed_at":"2026-08-05T14:54:17.443069Z","title":"Ten- sor fusion network for multimodal sentiment analysis,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.443069Z"},"links":{"cited_paper":"/paper/1707.07250","citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:6a1d5612df7826ebf07b0a3c11b221680ef5653164aa40c6ceaddefb895e5ba4","observation_id":"389a3048-d1fc-479a-8f61-8f2e89f686b8","resolution":{"observed_at":"2026-08-05T14:54:17.443069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.909312Z","title":"Speech sentiment analysis via pre-trained features from end-to-end asr models,","venue":null,"work_id":"64c50261-5f23-471e-8fee-c96bf70d2328","year":2020},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.456483Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:067b9e8aac8c714ad9733d4e2d462f7558f4ae5413e76f76c079da44ed62505e","observation_id":"4d269478-61c0-4c2a-8aab-62da25aa26ae","resolution":{"observed_at":"2026-08-05T14:54:17.916705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.462219Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.462219Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:8ad5d1b68300ba77b180d471177ce9577e973803dfd2f087836394201aad923b","observation_id":"1f3ce878-23da-4098-80cd-e930137fbb4b","resolution":{"observed_at":"2026-08-05T14:54:17.462219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-05T14:54:17.467691Z","title":"Roberta: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.467691Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:5633140b5fd3a0bff6ed88d7c8abaaae4d57d1333fd4909365fd8ed78f183355","observation_id":"6aba427b-3978-4d72-a5e8-fe674d99fff0","resolution":{"observed_at":"2026-08-05T14:54:17.467691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.872466Z","title":"Audiovisual fusion: Challenges and new approaches,","venue":null,"work_id":"aebc2bc7-8980-4a06-baaa-1b065f5b75f3","year":2015},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.473824Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:705012225c9d3d09437cd7a011c211b45a03bdab651eaa5d237ca14cbd745f83","observation_id":"467d68c7-bebb-4982-8d97-f5e2c57b2023","resolution":{"observed_at":"2026-08-05T14:54:17.879772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.851156Z","title":"Modality-collaborative transformer with hybrid feature reconstruction for robust emotion recognition,","venue":null,"work_id":"43a73494-9996-489a-969a-d69275eeb61e","year":2024},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.480582Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:6fa994f9b8d7555f177e9fad0de147db0c4e2e91898fbb513d74d65fb8db2002","observation_id":"d08e0ac3-e61e-409f-857f-78bd57714069","resolution":{"observed_at":"2026-08-05T14:54:17.857347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.829845Z","title":"Exploring fusion tech- niques for multimodal emotion recognition,","venue":null,"work_id":"030c78ca-0ee0-4b7b-84c7-a25806275fdb","year":2024},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.487320Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:b444a147ee748fc02dbe84e1cf0962c226b458dbbdd9248ddad9c3977f10645d","observation_id":"1678542b-8498-4233-92e3-906bc387af8d","resolution":{"observed_at":"2026-08-05T14:54:17.836199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.810855Z","title":"Decision-level fusion method for emotion recognition using multimodal emotion recognition information,","venue":null,"work_id":"82b059fa-ad3c-4756-9a4a-bb1832929c0c","year":2018},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.493185Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:1599cca587d4d323e509a1aafffa4cca43c14d7e4d06a9378cafb592cd913be3","observation_id":"5728b906-10ee-4dd3-96a1-12b65cc948ef","resolution":{"observed_at":"2026-08-05T14:54:17.816654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.791752Z","title":"Msp-improv: An acted corpus of dyadic interactions to study emotion perception,","venue":null,"work_id":"75ec299f-b02b-4c13-aaf8-a7eb1b746512","year":2016},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.498178Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:9e3ff0ce320c0b33188ea9c1c8a0f68ce7a84f802b83e1d64281ba6609b927f7","observation_id":"3c48cca9-0ac8-47b8-8793-4650850f24a0","resolution":{"observed_at":"2026-08-05T14:54:17.798065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.01780","last_updated":"2018-08-23T10:05:33Z","snapshot_observed_at":"2026-07-06T05:50:01.492073Z","submitted_at":"2017-07-06T13:31:13Z","title":"On the Role of Text Preprocessing in Neural Network Architectures: An Evaluation Study on Text Categorization and Sentiment Analysis","version":3},"cited_work":{"arxiv_id":"1707.01780","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.01780","snapshot_observed_at":"2026-08-05T14:54:17.698294Z","title":"On the Role of Text Preprocessing in Neural Network Architectures: An Evaluation Study on Text Categorization and Sentiment Analysis","venue":"cs.CL","work_id":"903179d6-2677-41a7-9ee9-f533e7723f36","year":2017},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.502925Z"},"links":{"cited_paper":"/paper/1707.01780","citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:42d373022697226d47be9a533f1d545c43b74fb444a3d58abe00a8b40f0ccd44","observation_id":"7f094a71-ca5b-4c9c-a240-ec761c3cef54","resolution":{"observed_at":"2026-08-05T14:54:17.703860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.508476Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.508476Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:cf3db27457b4a26e03019d65b954019bf7b883d7ca1c5711d0d5012744b45f6b","observation_id":"354fadde-c5da-4f08-9afd-5799ccf2ba32","resolution":{"observed_at":"2026-08-05T14:54:17.508476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12250","last_updated":"2022-05-11T08:06:39Z","snapshot_observed_at":"2026-07-06T11:03:29.377343Z","submitted_at":"2021-04-25T20:28:53Z","title":"XLM-T: Multilingual Language Models in Twitter for Sentiment Analysis and Beyond","version":2},"cited_work":{"arxiv_id":"2104.12250","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.12250","snapshot_observed_at":"2026-08-05T14:54:17.659731Z","title":"XLM-T: Multilingual Language Models in Twitter for Sentiment Analysis and Beyond","venue":"cs.CL","work_id":"d8329113-4506-4fc2-835c-ad4f09dcc564","year":2021},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.513720Z"},"links":{"cited_paper":"/paper/2104.12250","citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:b99aab0f8f4009d68773c00b2c5df3d5ef2a5b97ab7c4ae7272cc9549c47eb6f","observation_id":"09989cf1-3f19-4d66-b543-00040bb44b13","resolution":{"observed_at":"2026-08-05T14:54:17.669263Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-05T14:54:17.518789Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.518789Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:daa6d0133ad7b26eae8aeee82ef75a73637d240ac3b2f2618c1f8caef136c111","observation_id":"bbe871e8-4012-4c69-b2a3-b752409ae992","resolution":{"observed_at":"2026-08-05T14:54:17.518789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-05T14:54:17.524335Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.524335Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:d644d9619b48900f016de31261ea99311ebbefb65f512c548957624e23e1afba","observation_id":"81f8d7ef-f632-45ca-98ea-b504a872ab60","resolution":{"observed_at":"2026-08-05T14:54:17.524335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:54:17.757411Z","title":"Comparative analyses of bert, roberta, distilbert, and xlnet for text-based emotion recognition,","venue":null,"work_id":"6a12dd38-7fc1-4d73-bd52-0a170c4211b3","year":2020},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.530014Z"},"links":{"citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:4c4d7d94ffdfb5b1b8f9eb9db38083438bfd8d94b74fb2867db72f9ca2a13abd","observation_id":"8f9a5fb8-b120-4473-a234-c8f4df5a2f16","resolution":{"observed_at":"2026-08-05T14:54:17.764326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02116","last_updated":"2020-04-08T01:02:17Z","snapshot_observed_at":"2026-08-02T09:09:10.011185Z","submitted_at":"2019-11-05T22:42:00Z","title":"Unsupervised Cross-lingual Representation Learning at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02116","snapshot_observed_at":"2026-08-05T14:54:17.535098Z","title":"Un- supervised cross-lingual representation learning at scale,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T14:54:17.535098Z"},"links":{"cited_paper":"/paper/1911.02116","citing_paper":"/paper/2508.20796"},"observation_digest":"sha256:21bc380becb775f37cbcd74bd3f611d98ead9a52738af75d4e6e8c87ca767d3b","observation_id":"840638f8-ece8-44e8-bf30-87ac0c3a3fa0","resolution":{"observed_at":"2026-08-05T14:54:17.535098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.20796","last_updated":"2025-08-28T13:58:09Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T22:34:52.355108Z","submitted_at":"2025-08-28T13:58:09Z","title":"Speech Emotion Recognition via Entropy-Aware Score Selection"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":15},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2508.20796."}