{"as_of":"2026-08-19T00:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6824f5e19b1c05ace2a2cbb329da65e4e504eaad3e89a3c23ee03f4337df1d05","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T16:58:54.892906Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.12674/citation-record","integrity":"/paper/2501.12674/integrity","json":"/paper/2501.12674/citation-record.json","paper":"/paper/2501.12674"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:55.203486Z","title":"Speech emotion recognition using speech feature and word embedding","venue":null,"work_id":"2a572c35-0cbd-46fe-8a03-7312687bb0b8","year":2019},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.838548Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:cab6ecebfa8c6b06cccc629cac15d730c103b8a596c7413576274cd6ad3066d3","observation_id":"cc3d66b0-e429-49b5-94e2-ff1ec8c89469","resolution":{"observed_at":"2026-08-10T16:58:55.207651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:55.190256Z","title":"Iemocap: Interactive emotional dyadic motion capture database","venue":null,"work_id":"1f5f915a-32c3-4835-ab3b-135f024efbca","year":2008},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.843590Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:b6365feb6b67c5ecc2b92b5cdf9624b0f57dc50e5be3d56773ccb8410ac86216","observation_id":"94b75a0d-18dd-4c41-81b1-45eb41ed2951","resolution":{"observed_at":"2026-08-10T16:58:55.194292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:55.176376Z","title":"Deep neural networks for emotion recognition combining audio and transcripts","venue":null,"work_id":"67ccfd91-8ae0-4362-91b2-9a839ce09486","year":2018},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.847920Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:a4684e94d52b5c6fbb3b5fa28cfdf35a25ffffa0f865973f187587d458b088de","observation_id":"c51d7b0e-c523-4bb5-8d68-2d2bacaf4c38","resolution":{"observed_at":"2026-08-10T16:58:55.180886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:55.161469Z","title":"Combining speech-based and linguistic classifiers to recognize emotion in user spoken utterances","venue":null,"work_id":"d0b8a982-32dc-4c54-b723-ce94be8e7664","year":2019},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.852222Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:95897f93948754659d74f5091035d4cd3bdc536d9ddeb0cab740495721f6d6af","observation_id":"b6aaeeb3-9454-4bcd-b530-9f817666a0d9","resolution":{"observed_at":"2026-08-10T16:58:55.166326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:55.146378Z","title":"Speech emotion recognition with acoustic and lexical features","venue":null,"work_id":"88fdf3aa-ef8f-4a02-b682-dd0806f82179","year":2015},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.857021Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:7cc1cee0097e342e94f9298d83dca45f3f767d42eab25dd2ccc20561b15f1837","observation_id":"291fc7b0-e529-4972-859f-d2ae6bbf7e9b","resolution":{"observed_at":"2026-08-10T16:58:55.151376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:55.027103Z","title":"Com- bining acoustic and language information for emotion recognition","venue":null,"work_id":"f015ff4d-c4ef-4b5e-b2dc-9234c3aed742","year":2002},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.861849Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:6d495f250e923b40fda62874b31fce551fdeabaa8741cbfab98500b9ebb6a9be","observation_id":"01c9c80d-17e1-4bcf-8f87-c5992779c4da","resolution":{"observed_at":"2026-08-10T16:58:55.031713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:55.011331Z","title":"Automatic speech emotion recognition using machine learning: digital transformation of mental health","venue":null,"work_id":"e6ab2597-ae74-424b-aab4-c2ec09532070","year":2022},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.866760Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:49b3db148127d8ded635e03495926d60e1678d7601ea65548bf67dc1dd5852c3","observation_id":"cb100c73-3b54-4138-87de-f965635b6f65","resolution":{"observed_at":"2026-08-10T16:58:55.016573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:54.995051Z","title":"Emotion in speech: Recognition and application to call centers","venue":null,"work_id":"51103202-c119-44c4-9cc6-177a616b819c","year":1999},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.871108Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:8591031b853a58f31f8ac465a38aa0d2a9b2073a08673c9108be6a85e5fe7215","observation_id":"aca4fe94-e260-40fc-81cb-5246d0cdb87b","resolution":{"observed_at":"2026-08-10T16:58:55.000516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:54.981042Z","title":"A text independent speech emotion recognition based on convolutional neural network","venue":null,"work_id":"3ec39611-810f-4327-870f-1cbc0d7ac82b","year":2023},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.875252Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:900800c22bd9b211273c740890c2926f5d727224cbbf0c56b4ea1662ea02e8e8","observation_id":"60e79c1a-1fc8-4126-89ad-c333ec590c23","resolution":{"observed_at":"2026-08-10T16:58:54.985165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.05788","last_updated":"2019-11-06T20:10:26Z","snapshot_observed_at":"2026-08-18T23:15:26.663808Z","submitted_at":"2018-04-16T16:58:37Z","title":"Multi-Modal Emotion recognition on IEMOCAP Dataset using Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.05788","snapshot_observed_at":"2026-08-10T16:58:54.879516Z","title":"Multi-modal emotion recognition on iemocap dataset using deep learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.879516Z"},"links":{"cited_paper":"/paper/1804.05788","citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:411005dbd3c3f3b780d4b9a8a0f71a546a381bb7ed894f73f3c10d2627fcd92c","observation_id":"2a045957-88fb-468c-8298-239066a8cfa2","resolution":{"observed_at":"2026-08-10T16:58:54.879516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:54.967625Z","title":"Speech emotion recognition using spectrogram & phoneme embedding","venue":null,"work_id":"a89ec67c-7c76-44f4-b394-c492d641b497","year":2018},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.884079Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:2e80358484056718c5e19192c88c228532598987f3357047e9afd6f071f159ab","observation_id":"2dddc164-b200-435a-b8dc-10b6cad7946e","resolution":{"observed_at":"2026-08-10T16:58:54.971782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:54.953612Z","title":"Multimodal speech emotion recognition using audio and text","venue":null,"work_id":"e357be5c-84f2-4534-8fe3-6cd13e54916e","year":2018},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.888412Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:6fb266faf2c801929db43937be617fd4442df85ca7665aaab5e9099047e56b96","observation_id":"35a70011-fa13-4aa9-9539-32f49eea1b3c","resolution":{"observed_at":"2026-08-10T16:58:54.957881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T16:58:54.937991Z","title":"Emotional chatting machine: Emotional conversation generation with internal and external memory","venue":null,"work_id":"c013039a-3ee5-4ce4-a464-0b91fbc97c3e","year":2018},"citing_paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T16:58:54.892906Z"},"links":{"citing_paper":"/paper/2501.12674"},"observation_digest":"sha256:8d65d0e5027a83a10993f3221966cdab7e9397082d4b907fe1fad77bca9e6277","observation_id":"b9d321c8-bb49-4f84-8d85-1b0eae86d614","resolution":{"observed_at":"2026-08-10T16:58:54.943863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.12674","last_updated":"2025-01-22T06:23:36Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-18T21:21:09.891105Z","submitted_at":"2025-01-22T06:23:36Z","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2501.12674."}