{"as_of":"2026-08-08T10:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e53bcf6e38eccc3f3484f47a47a6ccc94b68bf2a9c1bdc64c5214e77fb76dfab","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:56:05.607696Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:56:02.131837Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:56:06.781642Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2506.02059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02059","snapshot_observed_at":"2026-08-07T11:56:06.781642Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","venue":"cs.SD","work_id":"c7436f17-5b16-4d7d-8f0c-6ba19754950b","year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.131837Z"},"links":{"cited_paper":"/paper/2506.02059","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:9ca2ffc152575e3a24c49898849671ee8de09d6f1d725c8dbd5407a69d5c79bc","observation_id":"711c5d98-9dcb-4080-bbf4-e4df9a710278","resolution":{"observed_at":"2026-08-07T11:56:06.958185Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02059/citation-record","integrity":"/paper/2506.02059/integrity","json":"/paper/2506.02059/citation-record.json","paper":"/paper/2506.02059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.595119Z","title":"The goal of SER is to automatically infer emotional states from speech signals, enabling more natural and adaptive interactions between humans and machines","venue":null,"work_id":"2d9f8c15-79f5-4d1f-a297-6b02000044fa","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.096052Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:b33e957e565ebca3d9e99174ad04e9a3efb569681f19a5a6c1e7ba844eafa9ef","observation_id":"a6b44e2d-3790-4f5d-a236-43331f2023b9","resolution":{"observed_at":"2026-08-07T11:56:09.599644Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2506.02059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02059","snapshot_observed_at":"2026-08-07T11:56:06.781642Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","venue":"cs.SD","work_id":"c7436f17-5b16-4d7d-8f0c-6ba19754950b","year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.131837Z"},"links":{"cited_paper":"/paper/2506.02059","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:9ca2ffc152575e3a24c49898849671ee8de09d6f1d725c8dbd5407a69d5c79bc","observation_id":"711c5d98-9dcb-4080-bbf4-e4df9a710278","resolution":{"observed_at":"2026-08-07T11:56:06.958185Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.579036Z","title":"happy,” “sad,","venue":null,"work_id":"ecbc4b5b-004e-4a78-bbe3-40ae7cd1f3cf","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.184517Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:fc75e46c237ac176694bfa16f4d77e8ff761087283398802fce92d4830bbec74","observation_id":"ad9ed6f4-bb30-4591-8791-26e8495ed198","resolution":{"observed_at":"2026-08-07T11:56:09.584807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.546940Z","title":"anger”/“happiness","venue":null,"work_id":"89ae351d-9073-44a0-b8af-3bf8741a6b96","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.243155Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:5a0531d461698a18f0fecd77c416a3d99dae37427b753da4a0504c1c7109be72","observation_id":"ee00961f-e033-4b37-a7da-fa037edd58b3","resolution":{"observed_at":"2026-08-07T11:56:09.551533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.562049Z","title":"We use Whisper.small.en via transformers 4.39.3","venue":null,"work_id":"d0d56b4f-ca0f-4756-96c5-43c060d2db90","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.218277Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:f28c82957765c15ebfc31d526c0bceb4316b25b8dcf4afbf9272f2a156267564","observation_id":"626ce7cd-b21a-43ca-8be9-1922189d656c","resolution":{"observed_at":"2026-08-07T11:56:09.567721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.530773Z","title":null,"venue":null,"work_id":"83d4746e-2015-4102-bd4a-97331c008372","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.280737Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:4ae6fc61796605ae9a1c77d99f00935d9d069f908de199a8032ee55b49b33ffa","observation_id":"c386c8f2-1a78-47fa-987f-cb78678354de","resolution":{"observed_at":"2026-08-07T11:56:09.535935Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.513614Z","title":"The views, opin- ions and/or findings expressed are those of the authors solely","venue":null,"work_id":"0e10a90e-31e1-4c56-8af1-e11d76229a90","year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.318600Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:25c5d86ca372af3ed1d3291a3065ec15a44572e128e26eb10122aa9989891292","observation_id":"04005c1e-abf8-4dbf-a574-8a23d00ef00f","resolution":{"observed_at":"2026-08-07T11:56:09.518324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.498569Z","title":"Modular neural-svm scheme for speech emotion recognition using anova feature selec- tion method,","venue":null,"work_id":"1a5be110-d98d-40e5-81cf-0759e58bfa3a","year":2013},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.407140Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:92f04f60a784260e0624710aa6f086eac64d01a3911a4d6b9d8de8abaf226937","observation_id":"649c2c82-f91a-4f73-b042-6990a419e43f","resolution":{"observed_at":"2026-08-07T11:56:09.503664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.481479Z","title":"Amplitude modulation features for emotion recognition from speech","venue":null,"work_id":"5c04b09e-bf85-41e0-959e-e01a17815f38","year":2013},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.458442Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:05bf0143bc4fc05636135db651f165fb7509e1e73905ae09f7500163b4df4ed4","observation_id":"f0e14408-ebb8-4cc9-b335-9a5f3ed075d7","resolution":{"observed_at":"2026-08-07T11:56:09.486276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.463894Z","title":"Enhanced multiclass svm with threshold- ing fusion for speech-based emotion classification,","venue":null,"work_id":"2067e5cf-8d4c-466d-a365-53076be10bed","year":2017},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.506456Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:ab0f4aeaa4699e4fe55587a57f0bb08f5c750b5e0c0a88bce51dd9ccde193c2a","observation_id":"bd947d92-b5ad-4280-a6da-a3b53e3e4b6e","resolution":{"observed_at":"2026-08-07T11:56:09.469625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.444560Z","title":"Selection of features for emotion recognition from speech,","venue":null,"work_id":"fe09c16c-b74f-4e9d-b00e-4bf3a9078f02","year":2016},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.569761Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:29a898cdd106df5303e7f8e00c249447487d1d7ccd4cd2fdea873d0a62864836","observation_id":"03cb07dc-1684-44dc-927f-68a6a9a257c9","resolution":{"observed_at":"2026-08-07T11:56:09.449555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.428228Z","title":"Hidden markov model- based speech emotion recognition,","venue":null,"work_id":"34c63850-353b-4a64-a0f9-16345f1cc29b","year":2003},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.655419Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:302cdef2b7cc4f8531f0bd0af63d0f99286f8dbcc6e743cf0aef9399c0b79962","observation_id":"b11728a4-f371-4dd6-9dde-80623f5e6da3","resolution":{"observed_at":"2026-08-07T11:56:09.433918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.354158Z","title":"A modified feature selec- tion method based on metaheuristic algorithms for speech emo- tion recognition,","venue":null,"work_id":"7e98a825-8b0f-485c-ac75-30699998d996","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.710431Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:870cde89ed7d7e34e95da805a3d3f2899d80479c71bd6862e148589e156ed124","observation_id":"6e25c054-1b41-4bfd-bdf4-c76a7672c303","resolution":{"observed_at":"2026-08-07T11:56:09.393905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.262341Z","title":"Speech emotion recognition based on formant characteristics feature ex- traction and phoneme type convergence,","venue":null,"work_id":"725a91b3-eba4-4927-9cfa-d59f62f085b3","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.773271Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:9e962c6fab678af1cd96e0488412499d5fc9e6dce1a618a1d07f8fe30d74f23b","observation_id":"2902a2df-9dbe-471e-9b8e-c79251ecb4d6","resolution":{"observed_at":"2026-08-07T11:56:09.302221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.202422Z","title":"Efficient speech emo- tion recognition using modified feature extraction,","venue":null,"work_id":"07cc1f2c-67de-464d-a723-8d697db6b026","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.827006Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:d2e9375dc00b375dc5a1ac9f4d56239dbdca98bf8432a239f6b286336804c570","observation_id":"d9c28d80-5b08-4d09-911d-072f7d42a07e","resolution":{"observed_at":"2026-08-07T11:56:09.229804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.07590","last_updated":"2020-02-03T09:56:56Z","snapshot_observed_at":"2026-08-08T09:59:06.189761Z","submitted_at":"2020-02-03T09:56:56Z","title":"Speech Emotion Recognition using Support Vector Machine","version":1},"cited_work":{"arxiv_id":"2002.07590","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.07590","snapshot_observed_at":"2026-08-07T11:56:06.437663Z","title":"Speech Emotion Recognition using Support Vector Machine","venue":"eess.AS","work_id":"08e89960-b88b-43fa-a7b5-bad508063feb","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.875636Z"},"links":{"cited_paper":"/paper/2002.07590","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:3a4127e4462c4785545cf0fe75335deaddbd814ee3d179fca689f44e0baecccb","observation_id":"1cd9105a-8319-4945-bf94-2cb8d67a8eef","resolution":{"observed_at":"2026-08-07T11:56:06.605533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10985","last_updated":"2025-01-07T14:49:48Z","snapshot_observed_at":"2026-08-05T05:06:13.650613Z","submitted_at":"2024-09-17T08:36:45Z","title":"Improving Speech Emotion Recognition in Under-Resourced Languages via Speech-to-Speech Translation with Bootstrapping Data Selection","version":2},"cited_work":{"arxiv_id":"2409.10985","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10985","snapshot_observed_at":"2026-08-07T11:56:06.129812Z","title":"Improving Speech Emotion Recognition in Under-Resourced Languages via Speech-to-Speech Translation with Bootstrapping Data Selection","venue":"eess.AS","work_id":"87dd3d30-0589-44b3-9ea3-939844364240","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.926732Z"},"links":{"cited_paper":"/paper/2409.10985","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:826eafc6e11d9f3bdc7a9c1c47888b004cc268566e6bb587c7f906abd107d406","observation_id":"7b1f82c0-80ec-418c-9e65-b2716007962d","resolution":{"observed_at":"2026-08-07T11:56:06.238255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.184002Z","title":"Multimodal multi-loss fusion network for sentiment analysis,","venue":null,"work_id":"e5bd70a3-081d-4e61-b051-7df3858f8a02","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.982031Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:cbb2424e709794997bd9b832e66859e782c9012cab3a911f7bb9ab7e9484dbe2","observation_id":"28641fe7-e446-4c89-8acc-8c95b4ce87e1","resolution":{"observed_at":"2026-08-07T11:56:09.190171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.03359","last_updated":"2020-08-07T20:06:33Z","snapshot_observed_at":"2026-07-06T09:45:29.258982Z","submitted_at":"2020-08-07T20:06:33Z","title":"A New Approach to Accent Recognition and Conversion for Mandarin Chinese","version":1},"cited_work":{"arxiv_id":"2008.03359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.03359","snapshot_observed_at":"2026-08-07T11:56:05.877378Z","title":"A New Approach to Accent Recognition and Conversion for Mandarin Chinese","venue":"eess.AS","work_id":"f0ecffba-8254-4981-a439-b10a910d33c8","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.034207Z"},"links":{"cited_paper":"/paper/2008.03359","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:9dbe6e7afcd7eeb4f229b5026c426e6028785f34e970169b7066e15bfea2d180","observation_id":"3f7a2d10-ec43-47df-885c-42ffd4d74567","resolution":{"observed_at":"2026-08-07T11:56:05.970124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21315","last_updated":"2024-12-23T12:35:12Z","snapshot_observed_at":"2026-07-31T18:13:32.261738Z","submitted_at":"2024-07-31T03:53:14Z","title":"Beyond Silent Letters: Amplifying LLMs in Emotion Recognition with Vocal Nuances","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21315","snapshot_observed_at":"2026-08-07T11:56:03.104110Z","title":"Beyond silent letters: Amplifying llms in emotion recognition with vocal nuances,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.104110Z"},"links":{"cited_paper":"/paper/2407.21315","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:6506eb09362948d2adab5f8dfc8251d926d755cb38ac7d92ba57219f3191c859","observation_id":"c9733aa8-c2ab-487d-aa7b-5e710fd048e5","resolution":{"observed_at":"2026-08-07T11:56:03.104110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.165270Z","title":"Context-independent multilingual emo- tion recognition from speech signals,","venue":null,"work_id":"5a64fd0d-f471-4618-8d16-303de2f1aa2b","year":2003},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.167518Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:71fd1f0cc312057bd6691cb3b52332d9cba4195f36b96f7af8b791a517919a16","observation_id":"32b377b3-ac82-422a-babb-9e21147438ef","resolution":{"observed_at":"2026-08-07T11:56:09.171131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.143596Z","title":"On acoustic emotion recognition: compensating for covariate shift,","venue":null,"work_id":"f6672870-072d-4df1-8af0-92ca0035614d","year":2013},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.246325Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:2ff6616797be331fe88a86b5e7d6959a7801d6189656636198c422de18e4b602","observation_id":"56eb58da-2293-4c62-bf36-f0154f73a795","resolution":{"observed_at":"2026-08-07T11:56:09.150490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.123191Z","title":"Cross-corpus speech emotion recognition based on transfer non- negative matrix factorization,","venue":null,"work_id":"4d5fcc57-4bf2-4681-bec0-3a9f60df9ea7","year":2016},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.299686Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:cb1ec8152fde59859242ee041912201b25ba6d560e246b095d85a032830bc1cf","observation_id":"372952eb-a0ba-4421-a8c4-407b24af6562","resolution":{"observed_at":"2026-08-07T11:56:09.129930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.102599Z","title":"Deep implicit distribution alignment networks for cross-corpus speech emotion recognition,","venue":null,"work_id":"ff060e2d-ffc9-420b-9820-b48f19703e1c","year":2023},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.363184Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:9865742624c592ebafcdc5c1d12c6c2602d3ccec9e35dd475383c08de516a18d","observation_id":"d1ef6795-d78a-41a0-99f6-1e983550b7ab","resolution":{"observed_at":"2026-08-07T11:56:09.109755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20511","last_updated":"2025-09-09T06:34:44Z","snapshot_observed_at":"2026-08-07T13:50:50.101034Z","submitted_at":"2025-05-26T20:23:24Z","title":"Multimodal Emotion Recognition in Conversations: A Survey of Methods, Trends, Challenges and Prospects","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20511","snapshot_observed_at":"2026-08-07T11:56:03.435550Z","title":"Multimodal emotion recognition in conversations: A survey of methods, trends, challenges and prospects,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.435550Z"},"links":{"cited_paper":"/paper/2505.20511","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:14d730cde1cb81b17861ded47995d8a8929348c66bdcde24fb30000c21082563","observation_id":"3baf0bf4-0123-43a8-9954-62ceef008c27","resolution":{"observed_at":"2026-08-07T11:56:03.435550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.085127Z","title":"Contrastive unsupervised learning for speech emotion recognition,","venue":null,"work_id":"26744c77-baf2-43d4-afb9-f96552afb68c","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.506157Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:439734a53f6f36a594737689711016116193f2e22ffa7427285b18d3826a6e5a","observation_id":"da608ef9-71fe-4509-b7b2-01279465fc0b","resolution":{"observed_at":"2026-08-07T11:56:09.090419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.067689Z","title":"Scser: Supervised contrastive learning for speech emotion recognition using transformers,","venue":null,"work_id":"72803b93-19f3-443e-95ec-e4bf9a2e66b6","year":2022},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.596537Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:b4d153c0816f1ae9e9ba97b8ef1ec38d7813f5cf9eb185a23a0ed08dc6f62da5","observation_id":"081c4b8d-4a2c-40fd-835c-b6a79ebce29d","resolution":{"observed_at":"2026-08-07T11:56:09.073103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.046118Z","title":"Bootstrap your own latent-a new approach to self-supervised learning,","venue":null,"work_id":"f410f499-20b6-4ef2-bdc3-389aaf07fe00","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.693730Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:4bd44798ab8db0c6b02a27d902cdf46bcb1b7617b8a9c4b7635b121c245d7529","observation_id":"4252db27-0d03-4e1d-b00f-28eee7e62f32","resolution":{"observed_at":"2026-08-07T11:56:09.053503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.025987Z","title":"Byol for audio: Self-supervised learning for general-purpose au- dio representation,","venue":null,"work_id":"d60fbf59-f5f5-4242-aae1-e37a6446e6df","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.756089Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:ccd90049c52504a333489c774c850327bba2ee331a4e9562a1f851aaad6ecb33","observation_id":"42f6409a-0536-49cb-8eb8-f8ea737c7294","resolution":{"observed_at":"2026-08-07T11:56:09.031408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:03.844069Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.844069Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:3ab418e87d7f558daf5fff7bca8d9bad2fedd28fb8bd52ca44df26fc866925ce","observation_id":"25e394cc-5c87-4b85-aec9-00af40a4988a","resolution":{"observed_at":"2026-08-07T11:56:03.844069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.998721Z","title":"SpecAugment: A simple data augmen- tation method for automatic speech recognition,","venue":null,"work_id":"dc8d345f-9c47-4301-9676-25c5a04894c9","year":2019},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.936881Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:4a03d6282f2719f4ee0097b0768571ada00ccb8adbc741e12952f5196d627186","observation_id":"49720e77-e5ed-4648-b487-4e1deddc1385","resolution":{"observed_at":"2026-08-07T11:56:09.004048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.981516Z","title":"Revealing emo- tional clusters in speaker embeddings: A contrastive learning strategy for speech emotion recognition,","venue":null,"work_id":"d1765499-d7c8-44cd-b267-28e680ba362f","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.001232Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:e1e1de670cab75ad0b200e86e6f41986004319bde2b1f989feee4f4fdb3c4c98","observation_id":"26a850d0-a5df-49d4-859a-9c2c9b8caf77","resolution":{"observed_at":"2026-08-07T11:56:08.986676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.964243Z","title":"A comparative study of pre-trained speech and audio embeddings for speech emotion recognition,","venue":null,"work_id":"eb0801ef-377f-427e-9ca5-bc41aa7cb831","year":2023},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.065659Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:46978a4e950fb948672a1a0f2c548f80f66fb7ce3b5df5f382ef79f9c598c5b7","observation_id":"78dbe2b8-532c-4d9e-a8a7-41fa54bc73fe","resolution":{"observed_at":"2026-08-07T11:56:08.969904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.945386Z","title":"ECAPA- TDNN: Emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,","venue":null,"work_id":"2438df4a-0ce3-453a-bc8f-6bcd9d1b0bfb","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.137419Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:a63faafa4837070bf5a66206420c84c37f123bcdb06a293e76760f8d371b3f20","observation_id":"48016ccc-71ee-4e5b-be4c-f4c7d677e932","resolution":{"observed_at":"2026-08-07T11:56:08.951389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.878495Z","title":"Improved deep metric learning with multi-class N-pair loss objective,","venue":null,"work_id":"85a6e713-e58a-45ae-a7e2-5c42a9b13b38","year":2016},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.202197Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:eb15d6eadfccb75f291d9db7f84bd3eb94d1fee158120076f438b255e6b1fcaa","observation_id":"dadfe835-2a82-420d-86ff-c66cdcda19de","resolution":{"observed_at":"2026-08-07T11:56:08.918800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.762109Z","title":"Building naturalistic emotionally bal- anced speech corpus by retrieving emotional speech from ex- isting podcast recordings,","venue":null,"work_id":"0ac2941d-94e7-46f4-baeb-cd1c7e7a73bd","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.226941Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:015c99acd85895d04e66e30521e887a58c49c304b209ca70691f9e934224373f","observation_id":"3908389f-27df-4c19-aa4f-7218ec2ccfa2","resolution":{"observed_at":"2026-08-07T11:56:08.780186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.675229Z","title":"IEMOCAP: interactive emotional dyadic motion capture database,","venue":null,"work_id":"b81078bd-1baf-428b-a9ae-e9a4cae41cd0","year":2008},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.415054Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:c0efea38406fd696a31dd9d673683de3884052e40843e92fd20195308819a397","observation_id":"f1ac2343-f515-459e-bb2c-16d87a6cf20d","resolution":{"observed_at":"2026-08-07T11:56:08.713876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.574028Z","title":"A database of german emotional speech,","venue":null,"work_id":"008cf52b-3e4d-464a-9f37-beb3052504f2","year":2005},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.570053Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:b186e47a621530278ef07db5676a901d24a3f10b7e2dfd22b434283aafe25862","observation_id":"a01d78e1-bb79-4889-91e5-fa4d7c9e0e65","resolution":{"observed_at":"2026-08-07T11:56:08.624503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.475760Z","title":"Cross lingual speech emotion recognition: Urdu vs. western languages,","venue":null,"work_id":"e3fa192e-e982-41c0-9397-58891190e4e0","year":2018},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.732996Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:bf11b609397747721e204cf38f4e3f3a426cb53457ed503b87ea304b00a39885","observation_id":"5b5c7b7f-c743-4ae6-9063-3d7e50640443","resolution":{"observed_at":"2026-08-07T11:56:08.502177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.226026Z","title":"SUST bangla emotional speech corpus (SUBESCO): An audio-only emotional speech corpus for bangla,","venue":null,"work_id":"c2dcdb6e-8099-4cd3-b6c3-fb28d843cfd0","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.863032Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:605088c6fd88f85650f7756507fbed70c6bdb83de284bec23a480e695e04c156","observation_id":"65dc2f63-138f-40e0-b291-56e6f48019a4","resolution":{"observed_at":"2026-08-07T11:56:08.329137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.005563Z","title":"A mapping on current classifying categories of emotions used in multimodal models for emotion recognition,","venue":null,"work_id":"1e7f5508-1f3f-4186-9fa6-39c2a4dde412","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.022216Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:a62b9a20e9a1a44a3458bfa88a65d6a2bfdd288286b5beac841be095897607d6","observation_id":"830f635f-6053-414a-8119-da2872996e0c","resolution":{"observed_at":"2026-08-07T11:56:08.110377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.735876Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":"26bf4d78-e3e8-4402-b335-18c5accda1f5","year":2019},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.176805Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:eb4c658c0741978114485ea22cd69adb93ceaecf3ba70c945a376714da8b7886","observation_id":"a34ed134-b4f2-4754-b400-6760a12f5838","resolution":{"observed_at":"2026-08-07T11:56:07.838724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.516869Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"6cd49880-b5af-4e95-af12-4a882fdb4119","year":2022},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.310254Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:7a246bc4d6a9585297c7b1e3dfe3f81d27fb64961e4b3c0992bcf78e1be8c573","observation_id":"ed0c6136-ee25-41a1-9108-d368845d6830","resolution":{"observed_at":"2026-08-07T11:56:07.618498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.276752Z","title":"Towards generalizable SER: Soft labeling and data augmentation for modeling temporal emotion shifts in large-scale multilingual speech,","venue":null,"work_id":"20d9b1e8-ad97-4ca9-beec-8e84732d01db","year":2023},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.493371Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:6e2c14c3f9166e794cf00ac80776c822c0ef06678afa751d58cd143c93545b3b","observation_id":"047d47be-059e-4f90-972c-96dcbe8fd65a","resolution":{"observed_at":"2026-08-07T11:56:07.395728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.090764Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":"a39089c5-b701-4bca-ac24-ae69800323be","year":2017},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.607696Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:9e1304d6a1b092e4691554299b4a7b3f442131e2b12f1009c4160ce094131010","observation_id":"130be1d4-ebdd-4281-9300-3757a479fd89","resolution":{"observed_at":"2026-08-07T11:56:07.184074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T11:49:40.357153Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":3,"verified_fuzzy":36},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2506.02059."}