{"as_of":"2026-08-08T18:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a0f3981b81b7a89a17fb09557c5d9a1199375c616ae2d3d8714e3a74d96c201","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:21:20.857915Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05634/citation-record","integrity":"/paper/2509.05634/integrity","json":"/paper/2509.05634/citation-record.json","paper":"/paper/2509.05634"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.401352Z","title":"Cross-modal fusion techniques for utterance-level emotion recognition from text and speech,","venue":null,"work_id":"2600d2bc-7c1e-4904-b589-2e1d98792f78","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.772516Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:c91ff8828f6985f53cde2a16dbb64e89c85491e9d3ffc5d64b58f42946318d47","observation_id":"9e9f2fb4-1124-4f3f-a790-6c2aa39b9fc3","resolution":{"observed_at":"2026-08-05T05:21:21.406887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.5057432","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:20.915114Z","title":"Artificial intelligence-driven customer service: Enhancing personalization, loyalty, and customer satisfaction,","venue":null,"work_id":"65502766-456f-44b0-82a1-16904ac65cfa","year":2024},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.777125Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:269ee69e809a8ce4f768c78aaba502ec69e234df524a83142e902536566a4cc5","observation_id":"5312aca1-1f25-4a6a-9ff4-51d8b485b1d9","resolution":{"observed_at":"2026-08-05T05:21:20.919232Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-024-52989-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:20.901926Z","title":"Speech emotion recognition via graph-based representations,","venue":null,"work_id":"f2402078-3660-4f1e-81a8-017cf7b2d82e","year":2024},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.780996Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:b7b5e3a7d7bb45c7aa8d876494c4f3313f2d522ae668529d05eb57b9eac2d024","observation_id":"10a7d42a-ac3d-49df-bdd1-8b86a7863ac8","resolution":{"observed_at":"2026-08-05T05:21:20.905997Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.152303Z","title":"A review on speech emotion recog- nition: A survey, recent advances, challenges, and the influence of noise,","venue":null,"work_id":"c0534b07-40af-4d95-9f86-d195191a0106","year":2024},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.784850Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:9768a962d1e5683b01cce4ddf659bdad933adff5c6f7c2f6e26ebab69843d592","observation_id":"55ae0269-cbdc-418a-bcf5-0133c044c2d3","resolution":{"observed_at":"2026-08-05T05:21:21.157531Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.specom.2022.03.002","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:46:29.746714Z","title":"Survey on bimodal speech emotion recognition from acoustic and linguistic informa- tion fusion,","venue":"Speech Communication","work_id":"c7359b0f-e72b-4b25-b005-b93b8b6f0166","year":2022},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.788773Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:e6fedf01d23447b70bfb73dfba50221c0beb165fa1e9f4e18ae2b910931960ba","observation_id":"d3b73810-449a-415d-9dce-dbf4252b556c","resolution":{"observed_at":"2026-08-05T05:21:20.892336Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.386768Z","title":"DST: Deformable Speech Transformer for emotion recognition,","venue":null,"work_id":"d80c872c-3cc2-4f20-969d-e0a41ac73936","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.792708Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:332406987f4b11fcec65592797860b8b55c70e38879262824d030ee583b8b076","observation_id":"c5152077-6bbf-4b29-b0ca-a7582067c639","resolution":{"observed_at":"2026-08-05T05:21:21.391930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.372600Z","title":"Temporal-frequency state space duality: An efficient paradigm for speech emotion recognition,","venue":null,"work_id":"740f2ba7-a1bc-47d8-8ab8-55405829fc4a","year":2025},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.797095Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:5f2a2569e4b932552ac736fb7e704fd5359354188e68fbc23bd05b475bd36988","observation_id":"cda0d4a2-ee52-460e-b8a4-81d561b3ea54","resolution":{"observed_at":"2026-08-05T05:21:21.377255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.358712Z","title":"DWFormer: Dy- namic Window transFormer for speech emotion recognition,","venue":null,"work_id":"9b281ef4-0b42-4c99-824a-de5beaa8cfc1","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.800733Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:2b21ca6f1c3ef292a542ce66a0093808226a1bdd55619c8ba4810c207302cd22","observation_id":"3dd1308e-bf3c-4eea-b73c-0545e584c961","resolution":{"observed_at":"2026-08-05T05:21:21.363600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.343995Z","title":"SpeechFormer: A hierarchical efficient framework incorporating the characteristics of speech,","venue":null,"work_id":"4fb4a04f-97c8-47f1-908e-bd6b54eea18a","year":2022},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.804368Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:0244498abe2defa9ff73d00f8fac8e515cf0512c8312bb62f331ebdc4f510114","observation_id":"8dbeb2c7-f09b-4185-b33a-e937b52df68a","resolution":{"observed_at":"2026-08-05T05:21:21.349103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.329164Z","title":"SpeechFormer++: A hierarchical efficient framework for paralinguistic speech processing,","venue":null,"work_id":"cae7421a-291a-41fa-84e4-780623c6a866","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.807919Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:bd70aa6c9c1b099679d4374bd78437d88a5920a0d1fdd94717b42caef6ba3fe6","observation_id":"a6e2dc6d-a7b5-4786-a648-d2ab9502eedc","resolution":{"observed_at":"2026-08-05T05:21:21.334578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.314580Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":"0c2d5002-117d-4b9b-aac3-15cc326048a1","year":2019},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.811558Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:865ee66848d699891eba273c476c6ddbe0162149322b3ea22257b90b979d04f2","observation_id":"396b83cc-f1fa-4f47-9795-4e11910a6cdf","resolution":{"observed_at":"2026-08-05T05:21:21.319840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.299021Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"d053d4b7-ced6-487f-aa3a-c3f8679a8000","year":2020},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.815193Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:9ad5c05962246d16115eda9e82b26a9d7da6788a993886481b51fdd1a2536104","observation_id":"c16c8819-af65-44a1-b2d4-7813a22e1fcf","resolution":{"observed_at":"2026-08-05T05:21:21.304242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-08-06T14:36:57.042438Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-08-05T05:21:20.819131Z","title":"Seamless: Multilingual expressive and streaming speech translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.819131Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:dfeb79747e3926db4c8f6e971196440ccf84ae601f2c93f8cb11336d301d2c06","observation_id":"3e685189-5188-4e6d-b25d-2e0eaeddabad","resolution":{"observed_at":"2026-08-05T05:21:20.819131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.284733Z","title":"BERT: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":"d53c6b9b-5f32-4acb-9797-9fe3b54de618","year":2019},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.823198Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:14890ce0eaba51c3da4538823f04b60d46ef6b11646011ff89790893c39fcafa","observation_id":"1c83cf53-d04a-4454-955a-f5f369df30e8","resolution":{"observed_at":"2026-08-05T05:21:21.289406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.271154Z","title":"Unsupervised cross-lingual representation learning at scale,","venue":null,"work_id":"ddb4c5ac-6824-4b0c-a144-4ac8a0b1e4fa","year":2020},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.826975Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:9eac3377afb16106cb9faef4a5d881fdecad6621b36ef448f3106d3a69043ca4","observation_id":"3b694448-ff63-455e-a8a3-c2e8ef6a828e","resolution":{"observed_at":"2026-08-05T05:21:21.275369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.256317Z","title":"DeBERTa: Decoding-enhanced BERT with disentangled attention,","venue":null,"work_id":"8687d484-3b8b-4cfd-857c-96c5db14563d","year":2021},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.830940Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:a15526693755653556710756f9a9832ee400fcef41945e508608fa7e2202e1ef","observation_id":"c2f3d554-4f71-45ac-af73-7919569723d1","resolution":{"observed_at":"2026-08-05T05:21:21.261487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-05T05:21:20.834622Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.834622Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:01124ad5881b2e2903fc55350acbfe59d3501cc84c5ebf144a9549665538a0a7","observation_id":"f27e0545-d736-4be4-9ca0-ffc5b9619758","resolution":{"observed_at":"2026-08-05T05:21:20.834622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.242640Z","title":"Real time speech enhancement in the waveform domain,","venue":null,"work_id":"ccc447b6-1fb4-48e2-8805-daa7082d1eae","year":2020},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.838861Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:1fae5365ecc5b1e8121f428312e7f9bd48e0f7e738eb293b9d8e1eec961ca0a2","observation_id":"684f59f6-9c84-4b8b-8abd-8b44992ec725","resolution":{"observed_at":"2026-08-05T05:21:21.247137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.226368Z","title":"Unmasking real-world audio deepfakes: A data-centric approach,","venue":null,"work_id":"d1c8851a-ba5d-42cf-bf64-c709aa33b52d","year":2025},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.842804Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:8961d93b43002d169293b1161c25681172a91f398fe92e4be57b071d3f5306c8","observation_id":"36d8dd70-8488-4057-a50f-b5a69d5d787f","resolution":{"observed_at":"2026-08-05T05:21:21.232044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.211294Z","title":"A change of heart: Improving speech emotion recognition through speech-to-text modality conversion","venue":null,"work_id":"d2c5ed56-1af5-4a2b-af10-cad0784aea2e","year":null},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.846348Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:3309f19de2bc3a8cbca061964e5b666b0d3163eb1dc5f9e88ccaa456c36255e2","observation_id":"6ae965c8-58a2-4cf3-bd36-9f0429836a97","resolution":{"observed_at":"2026-08-05T05:21:21.216507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.196299Z","title":"TADA: Training-free attribution and out-of-domain detection of audio deepfakes,","venue":null,"work_id":"61786d2a-c7d1-41ce-8eec-6d8b4e4d16d8","year":2025},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.850412Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:b89b8684fec07ab70b934a98356e573a9e7c1adb51dc3508c8f9d9adf91227c6","observation_id":"a9c085dd-ca06-4927-af7f-cdbd826c6f63","resolution":{"observed_at":"2026-08-05T05:21:21.201345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.181674Z","title":null,"venue":null,"work_id":"24f228aa-80d0-4bf8-955c-d056c9b0bfc0","year":2018},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.854202Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:9b7ff32f2d70dfc37bd101d706c97e7955e031ec808613541b0898488205e897","observation_id":"41ace998-d871-445d-8c35-d315301a7fb6","resolution":{"observed_at":"2026-08-05T05:21:21.186045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.167567Z","title":"An analysis of large speech models-based representations for speech emotion recogni- tion,","venue":null,"work_id":"9824f99c-b88c-4fd6-a397-b55abb190f42","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.857915Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:28896ec5492b8754ce9b01d8d44d394977afef306004e3d833bf3afd028fe798","observation_id":"d5e418ad-2fee-4996-a9ae-7247b6215a90","resolution":{"observed_at":"2026-08-05T05:21:21.172190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T21:53:40.940063Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":4,"verified_fuzzy":16},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2509.05634."}