{"as_of":"2026-08-16T11:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:37e9efaa2550b55567be3a4f7e0e0918cc11e265c3508b055f1ecede64a38424","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:46:43.004412Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.03054/citation-record","integrity":"/paper/1908.03054/integrity","json":"/paper/1908.03054/citation-record.json","paper":"/paper/1908.03054"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1601.01577","last_updated":"2016-01-07T15:57:45Z","snapshot_observed_at":"2026-08-14T22:15:34.265450Z","submitted_at":"2016-01-07T15:57:45Z","title":"Gender Identification using MFCC for Telephone Applications - A Comparative Study","version":1},"cited_work":{"arxiv_id":"1601.01577","doi":null,"metadata_source":"pith","pith_arxiv_id":"1601.01577","snapshot_observed_at":"2026-08-14T14:46:43.098674Z","title":"Gender Identification using MFCC for Telephone Applications - A Comparative Study","venue":"cs.SD","work_id":"f25ce788-8cf8-4124-bf20-e7539be8aab7","year":2016},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.761591Z"},"links":{"cited_paper":"/paper/1601.01577","citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:7938cf36255f80502bf5010d6452774f446ce7c165fbaf9b14191542c39d4b37","observation_id":"0e54242a-fe09-429e-afc6-e472d06679f5","resolution":{"observed_at":"2026-08-14T14:46:43.106781Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.765802Z","title":"Toward affective speech-to-speech translation: Strategy for emotional speech recognition and synthesis in multiple languages","venue":null,"work_id":"646c6d21-453a-4248-a541-d1d29e641dfd","year":2014},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.769190Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:cde5fc7bad79b01ad457a10fcac0e03544a4d005facab8cb35ef5b2b0b169b6a","observation_id":"e51f419e-a99a-43dc-8292-abca689b8b3d","resolution":{"observed_at":"2026-08-14T14:46:43.770632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.749415Z","title":"Single frequency ﬁltering approach for discriminating speech and nonspeech","venue":null,"work_id":"5801248e-387b-4040-abce-54553235331c","year":2015},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.774732Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:8d292ec4938182fa8729e448f13d2ebe6646bc9aafd15ddd2f3cb54719739473","observation_id":"9f1b6e5c-bdf1-46a8-b0a5-5f3ec93d53ec","resolution":{"observed_at":"2026-08-14T14:46:43.754155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.734378Z","title":"Extraction of fundamental frequency from degraded speech using temporal envelopes at high snr fre- quencies","venue":null,"work_id":"79d874bc-bc11-4c31-86ad-e68e9ba15573","year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.780787Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:015aa188d8ebe96a9dbc7a817c129ba2038f79e755bab55d8a5546ec176a22e4","observation_id":"6ccab0e2-53d0-49a9-a68c-5583f7441fcf","resolution":{"observed_at":"2026-08-14T14:46:43.738893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.718858Z","title":"Speech emotion recognition from spectrograms with deep convolutional neural network","venue":null,"work_id":"7aefe74b-a245-4a6b-8030-bda6e3fe967c","year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.786382Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:4c6173191e33cbbd1bfab8846e6326e1412e80311fd2416a5903bc9563e5f15b","observation_id":"4e40d733-74b6-4fe4-a7e7-9da81e32f1af","resolution":{"observed_at":"2026-08-14T14:46:43.724523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.702211Z","title":"Deep features-based speech emotion recognition for smart affective services","venue":null,"work_id":"3df2c6f0-2f7e-4ddb-a5be-0e269bb78ea7","year":2019},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.791558Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:290747b63f8c93c160ad6ec90ab383b2d0bb460a01321fe9a1f246bbfc796e37","observation_id":"fdcb643a-e634-4585-bce7-6b857fc73122","resolution":{"observed_at":"2026-08-14T14:46:43.708037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.685741Z","title":"Spectro-temporal analysis of speech signals using zero-time windowing and group delay function","venue":null,"work_id":"e66f346f-5328-476e-935e-03d002b4013d","year":2013},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.797017Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:22e61c94dd553a6fd2a6674ecd81f99c92aefdfb4178cb84d8df2c1c5c90da92","observation_id":"24181f02-2253-4018-92af-bc7a7bebd1de","resolution":{"observed_at":"2026-08-14T14:46:43.691110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:42.801351Z","title":"Iemocap: Interactive emotional dyadic motion capture database","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.801351Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:1b4a36f662cc848aa705f80dcf306784d0c773949b30fbad50299cafe1bdb6fc","observation_id":"77791e2e-ecb0-4303-b89c-386a04e0fe79","resolution":{"observed_at":"2026-08-14T14:46:42.801351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1202.2745","last_updated":"2012-02-13T14:35:41Z","snapshot_observed_at":"2026-08-15T04:19:28.790554Z","submitted_at":"2012-02-13T14:35:41Z","title":"Multi-column Deep Neural Networks for Image Classification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1202.2745","snapshot_observed_at":"2026-08-14T14:46:42.806058Z","title":"Multi-column deep neural networks for image classiﬁcation","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.806058Z"},"links":{"cited_paper":"/paper/1202.2745","citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:0527eaaa191968e455f0722756718bc3eecf7cdb9ec5587b7b7399691eaf17ea","observation_id":"f7ed8a03-27b4-480c-a705-94fc835ef501","resolution":{"observed_at":"2026-08-14T14:46:42.806058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:42.810960Z","title":"A tutorial on the cross-entropy method","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.810960Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:4409c09c2ffc620f0692dd970b435de882f7c0fe65d747243664e0300e9dab68","observation_id":"40b5dfb0-7128-4f1c-bb6d-3047ea075598","resolution":{"observed_at":"2026-08-14T14:46:42.810960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.652113Z","title":"Survey on speech emotion recognition: Features, classiﬁcation schemes, and databases","venue":null,"work_id":"be58746e-f67f-4225-9b95-6102466c8d46","year":2011},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.818045Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:eee74b33fa36d4e0cf47891fae8004197751a7fd972b6e86148fd281d00d76f7","observation_id":"02d07e4f-5636-4ffe-8ae4-8d25116f4a00","resolution":{"observed_at":"2026-08-14T14:46:43.657664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.638989Z","title":"Eval- uating deep learning architectures for speech emotion recognition","venue":null,"work_id":"9c0ad70a-5f85-4a7e-9b30-252e6c2d7c3e","year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.823550Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:15306ae6584e8c3f42da501a3bf9e9f8fde1efc22df7847ce6ca30b76c392e30","observation_id":"5d77cdf4-c002-4933-9654-fb12ffd8d072","resolution":{"observed_at":"2026-08-14T14:46:43.643468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.625448Z","title":"Acoustical properties of speech as indicators of depression and suicidal risk","venue":null,"work_id":"ed63632d-8aaa-438e-85ce-b0522856f1e2","year":2000},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.828374Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:38ca80b8024951c58774e90d3e9c23342615460b4c2309de6f68d749f51cf429","observation_id":"d54671cf-ac09-44c0-b565-dd31ba6de7f8","resolution":{"observed_at":"2026-08-14T14:46:43.630493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.611385Z","title":"On the importance of glottal ﬂow spectral energy for the recognition of emotions in speech","venue":null,"work_id":"25164450-19b8-4c26-93f0-8fb1d3415dae","year":2010},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.833349Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:df9b8e5e79ffeb54400caa6dc85a2c1635de714c1da397443887169f077e275e","observation_id":"88fbb2d5-c65e-4c40-9d09-b8b95c2cea12","resolution":{"observed_at":"2026-08-14T14:46:43.615400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03167","last_updated":"2015-03-02T20:44:12Z","snapshot_observed_at":"2026-08-12T21:01:12.961874Z","submitted_at":"2015-02-11T01:44:18Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03167","snapshot_observed_at":"2026-08-14T14:46:42.837964Z","title":"Batch normalization: Accelerat- ing deep network training by reducing internal covariate shift","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.837964Z"},"links":{"cited_paper":"/paper/1502.03167","citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:181b16501fb73bd51d3ceeb90efd4c77010964c051c34de74dca28f86ab520c5","observation_id":"1e0e8455-8c11-45ef-8676-dc37560145a5","resolution":{"observed_at":"2026-08-14T14:46:42.837964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.597924Z","title":"Application of the wavelet transform for pitch detection of speech signals","venue":null,"work_id":"b0a3b56c-25d2-4cbc-8bb2-79cd1b492d6f","year":1992},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.842902Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:160e4f095401755c3bd6c9484add9221565632ba01a28d1f330082108ab8ff70","observation_id":"f6fb16d5-feb7-41a2-b59d-b3e99e5bccd8","resolution":{"observed_at":"2026-08-14T14:46:43.602811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.584086Z","title":"Epoch extraction from emotional speech using single frequency ﬁltering approach","venue":null,"work_id":"68ebd381-e8e5-41ef-b23f-94605030f5b3","year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.848061Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:a18e3198f3da43e47013ea0bbc1022e0668fb83af3f4983b191dc0dcad9aa29f","observation_id":"bb28125c-96ec-4bb5-a4ba-835319d96eb2","resolution":{"observed_at":"2026-08-14T14:46:43.588460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.571137Z","title":"Speaker identiﬁcation using spectrograms of varying frame sizes","venue":null,"work_id":"791e0a82-e779-43bd-97d0-927465c2b6ba","year":2012},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.853614Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:ba259dc65072106e859824db76887689081afca09f727a8aa017e4c7e2ed4e42","observation_id":"6d81342e-996b-4184-95b4-1199b7dbc328","resolution":{"observed_at":"2026-08-14T14:46:43.575424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-14T14:46:42.861103Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.861103Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:8a5c93e4c409ab7822072f0c1b07a38389d4a0a4e8f2d49449bdda2370d39853","observation_id":"f4ccda1b-5129-48bf-893a-e828862da75d","resolution":{"observed_at":"2026-08-14T14:46:42.861103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.558765Z","title":"The perceptual importance of selected voice quality parameters","venue":null,"work_id":"9ab63678-870e-4144-bee3-32d52270a280","year":1997},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.867005Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:b0bd7ffca0c5005439cc168e8cb8a8089746f44c5bb122fe94891c609faab479","observation_id":"c382978d-de4d-4b0d-bc0f-e6b542892a24","resolution":{"observed_at":"2026-08-14T14:46:43.563358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.545708Z","title":"Improvement of the backpropagation algorithm for training neural networks","venue":null,"work_id":"afa6d573-aa26-4f23-bd84-2f36d1836804","year":1990},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.872290Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:f1296e86de8366abaa0019c7ce07933b3c2a8009f6457cc43d4af995cc6d12e8","observation_id":"32f27912-f52b-4adf-b2ec-145f96968f0e","resolution":{"observed_at":"2026-08-14T14:46:43.550779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.532905Z","title":"Automatic speaker age and gender recognition using acoustic and prosodic level infor- mation fusion","venue":null,"work_id":"fa0711b7-6374-4f0e-a6bc-50d8903c5aa7","year":2013},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.878651Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:47a1d7864245ba482d25061cf6bc70cb3c5023853775e37503f0206194962103","observation_id":"46ab7839-bac6-40e3-9487-52df41db1b40","resolution":{"observed_at":"2026-08-14T14:46:43.536943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.520788Z","title":"Learning salient features for speech emotion recognition using con- volutional neural networks","venue":null,"work_id":"a31ec6df-189f-4e4e-a044-6e8fb9227542","year":2014},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.884679Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:7b76efc764d2e6ab02fbd80981fafbe30428e14e04b673196883fce4bfb6e6f6","observation_id":"ab600307-96ef-424d-8325-0a972849721f","resolution":{"observed_at":"2026-08-14T14:46:43.525017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.505827Z","title":"Age and gender classiﬁcation using fusion of acoustic and prosodic features","venue":null,"work_id":"c2188f00-d2ec-427d-a46a-d5a1a3c4808c","year":2010},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.893655Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:ea3d21c337df7851f42982cee186f58e33637f34021947ca6f3b7f56d925fe11","observation_id":"6aeae182-0701-4e16-834f-c6e3ddb0090d","resolution":{"observed_at":"2026-08-14T14:46:43.511016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.491921Z","title":"Automatic speech emotion recognition using recurrent neural networks with local attention","venue":null,"work_id":"f7d6ecec-5a49-47d2-b50a-aa0e5c1351dc","year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.899479Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:5093de974dc78932c92549933e0f816fc889498d2c2d5211eb32c212851061b5","observation_id":"b1296f7c-9b65-40cd-ba63-bbf8b7c5c098","resolution":{"observed_at":"2026-08-14T14:46:43.496864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.478918Z","title":"Epoch extraction from speech signals","venue":null,"work_id":"8fde37f1-ba77-4b6d-8b37-afa4bcf0f1fd","year":2008},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.905980Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:5e559c8da88f33f5504e0e096293f72ed75030402037fe51a107c5dc5ad89d51","observation_id":"1c186624-13bd-4ef0-81a8-c6cea99a6dc9","resolution":{"observed_at":"2026-08-14T14:46:43.483476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.465375Z","title":"Rectiﬁed linear units improve restricted boltzmann machines","venue":null,"work_id":"634e7cf7-b15f-46a8-bf40-da503669de48","year":2010},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.912323Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:235c1632da7484a0f864283fa61030f79c91407413b5cdc152e727f3b5c03ff4","observation_id":"718708e7-12ef-401e-8e04-eede2a5dd0b8","resolution":{"observed_at":"2026-08-14T14:46:43.469674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.00612","last_updated":"2017-06-02T10:12:52Z","snapshot_observed_at":"2026-08-14T20:56:30.752824Z","submitted_at":"2017-06-02T10:12:52Z","title":"Attentive Convolutional Neural Network based Speech Emotion Recognition: A Study on the Impact of Input Features, Signal Length, and Acted Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.00612","snapshot_observed_at":"2026-08-14T14:46:42.917426Z","title":"Attentive convolutional neural network based speech emotion recognition: A study on the impact of input features, signal length, and acted speech","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.917426Z"},"links":{"cited_paper":"/paper/1706.00612","citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:047d4a90db9615fbbe5b6483cced04743176172f2e52967c2e142d46c8d3afe7","observation_id":"36c8c545-ee43-4c69-996e-404082cfa14b","resolution":{"observed_at":"2026-08-14T14:46:42.917426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.452966Z","title":"Robust estimation of fundamental frequency using single frequency ﬁltering approach","venue":null,"work_id":"63bfeb9a-7ba8-4ec4-a0e2-e989a4cdd5ff","year":2016},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.924449Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:82df682878d7995cbc58ebe2028d960e21adee9b94be2853cc67a5ff8e2d95cd","observation_id":"ad9af006-b220-471b-ae40-f7dc0ba30566","resolution":{"observed_at":"2026-08-14T14:46:43.457684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.437699Z","title":"On the convergence of adam and beyond","venue":null,"work_id":"948c5b09-41fc-4b11-a914-357853cca911","year":2018},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.934668Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:720d7c7ceaae816b16de8c1c1c3ee89a0ffc0e29798ee584c27e1cfef2b4855e","observation_id":"14fbb3e5-74f9-48a5-8c12-cb4948e9a664","resolution":{"observed_at":"2026-08-14T14:46:43.444112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.423393Z","title":"A direct adaptive method for faster backpropagation learning: The rprop algorithm","venue":null,"work_id":"44c51222-3d02-4222-bdef-0fb4f5f21ca3","year":1993},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.939635Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:4f780a8a99f8367a2001847c2e01f880894aecb2a3780670b857a288a5ac07a0","observation_id":"db46bfbc-7b76-4552-8fee-41b86a0dfb70","resolution":{"observed_at":"2026-08-14T14:46:43.428106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.408653Z","title":"Efﬁcient emotion recognition from speech using deep learning on spectrograms","venue":null,"work_id":"79307577-1aaf-4eb3-a8b8-e247f7f5c862","year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.945583Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:9b5369975d4b4f3751041f47a1363eabec4d5c05c3a4554f4cbf21cb2eee655b","observation_id":"455e4835-b294-4e0f-98e4-a5e254e0289a","resolution":{"observed_at":"2026-08-14T14:46:43.413759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.393467Z","title":"Speech emotion recognition combining acoustic features and linguistic information in a hybrid support vector machine-belief network architecture","venue":null,"work_id":"69f36301-f40d-4273-874c-7cf42d9551f0","year":2004},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.950417Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:ed95c9d1b243d1b9d8803dd68c2a71efb8ef92febc19c7e754b0f45b9606e226","observation_id":"05c2c528-483d-490c-9212-c63c460e4bde","resolution":{"observed_at":"2026-08-14T14:46:43.398810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.378576Z","title":"Modeling prosodic feature sequences for speaker recognition","venue":null,"work_id":"e2ebdedf-69e4-447b-bfe6-40403cd9d9aa","year":2005},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.954997Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:e5af4b58bf79d1be035a9c6321e983f9427d57301d7b5cf04690e41df1bc5e9e","observation_id":"5c598574-c1c1-4746-b7b2-6bbf2dae51c0","resolution":{"observed_at":"2026-08-14T14:46:43.383399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.218257Z","title":"Adieu features? end-to-end speech emotion recognition using a deep convolutional recurrent network","venue":null,"work_id":"0408976a-f45e-4ef1-9b87-386f236846d2","year":2016},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.959707Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:cdbc15d11ae31266ef7c101b78ed51aebe21cb15d7a2eb1ac4d0d65966dac810","observation_id":"b9af78da-8b3e-4f43-a901-f4a5e61fc0c9","resolution":{"observed_at":"2026-08-14T14:46:43.369379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.203716Z","title":"Spectral-temporal receptive ﬁelds and mfcc balanced feature extraction for robust speaker recognition","venue":null,"work_id":"64bf6a50-1f34-47c4-ba4e-2ca8d89bb7f2","year":2017},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.965392Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:9b051ff5477ce3d5cd9f24c68d3be79699d7519e784e5f93c23df2671cba1a66","observation_id":"ef6f1ab2-7721-4458-9503-1b9bc2d82961","resolution":{"observed_at":"2026-08-14T14:46:43.208468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.190548Z","title":"Text-independent speech emotion recognition using frequency adaptive features","venue":null,"work_id":"9892210a-f42b-4ae6-a282-4899a05997d7","year":2018},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.974212Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:10e87eb8b419986b2ca27739e081bcb2b4543513f9d712001408a1732d2f2916","observation_id":"ead31618-8793-4478-91a2-eb836fbbd412","resolution":{"observed_at":"2026-08-14T14:46:43.195271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.174056Z","title":"Epoch detection from emotional speech signal using zero time windowing","venue":null,"work_id":"420ad2c2-80ce-441f-999c-140ac84d372b","year":2018},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.982101Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:3b8dd512f5626a5e871ae9e4b768a360cf0910832ead6de103e973db7ad6df89","observation_id":"d1e11af5-382b-47eb-9a48-2cedfa5ccb8f","resolution":{"observed_at":"2026-08-14T14:46:43.178537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.159741Z","title":"Method for identifying autho- rized users using a spectrogram and apparatus of the same, August 22","venue":null,"work_id":"2273d502-767e-4bfe-b0f3-fc96293a11d9","year":null},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.986904Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:52e2d929a9c453284dc6655df070bde2cf4b7e5bcaa1fbb41042346c9b6db367","observation_id":"4142f4ea-2d0c-4e08-930f-ecc7c35b5162","resolution":{"observed_at":"2026-08-14T14:46:43.164474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.131432Z","title":"Speech emotion recognition using spectrogram & phoneme embedding","venue":null,"work_id":"250a8e54-3a9f-448e-bd5e-c5868c8bed88","year":2018},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.997015Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:00cf790690b8d2966ff08e7ab1dfb30a4d324f823d0dd4a8b2a6d766c7a6a5b9","observation_id":"839e65df-0d06-4e6a-b029-5046e49e9ca9","resolution":{"observed_at":"2026-08-14T14:46:43.135844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.117269Z","title":"Spectrogram based multi-task audio classiﬁcation","venue":null,"work_id":"a0f27279-633c-4182-80de-f23ab5592397","year":2019},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:43.004412Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:b5fb56dfa66f4bd2a59a1f431b6c1eff352f8a369424045346f7dc1668030575","observation_id":"f592b6f6-d5eb-4a01-9a45-7fc6578bd98b","resolution":{"observed_at":"2026-08-14T14:46:43.121687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:46:43.146116Z","title":"09/884,287","venue":null,"work_id":"4472b6b4-cef7-4e4d-9764-5bbb2e32077e","year":null},"citing_paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-14T14:46:42.992804Z"},"links":{"citing_paper":"/paper/1908.03054"},"observation_digest":"sha256:33b39e511975b5f25688b7f3b01de3518ccf405b110feca3ff45bf182b352992","observation_id":"3db65816-92b6-445c-b5f8-5f241fef46ca","resolution":{"observed_at":"2026-08-14T14:46:43.150516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.03054","last_updated":"2019-08-07T11:49:58Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T05:48:08.937142Z","submitted_at":"2019-08-07T11:49:58Z","title":"Pitch-Synchronous Single Frequency Filtering Spectrogram for Speech Emotion Recognition"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":35},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:1908.03054."}