{"as_of":"2026-08-10T21:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4e87e2d4f73d59779c883cbf5bbdba3d17ef2eee1c60c003320dce2fc688a893","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:36:05.834924Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.07806/citation-record","integrity":"/paper/2507.07806/integrity","json":"/paper/2507.07806/citation-record.json","paper":"/paper/2507.07806"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.344431Z","title":"Schuller and A","venue":null,"work_id":"521f8bae-c383-4211-98bd-0fa07181e093","year":2013},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.682757Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:022cf358c1c1c5d7d1384577e194d6e6726b74ea0e1ad18a0f22c94539a9bc76","observation_id":"459f071c-36b8-4627-8f81-ff84710d4b6b","resolution":{"observed_at":"2026-08-06T18:36:06.348892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14415","last_updated":"2024-03-26T15:59:05Z","snapshot_observed_at":"2026-07-06T18:03:55.981890Z","submitted_at":"2024-03-26T15:59:05Z","title":"Domain Adaptation in Intent Classification Systems: A Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14415","snapshot_observed_at":"2026-08-06T18:36:05.688417Z","title":"Domain adaptation in intent classification systems: A review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.688417Z"},"links":{"cited_paper":"/paper/2404.14415","citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:d19e60e157d1da89f750b43c0c633deec34fd69afbae46656e357b7437db9076","observation_id":"7b576c6a-0312-406a-90c4-428e421371c8","resolution":{"observed_at":"2026-08-06T18:36:05.688417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.328984Z","title":"End-to-end continuous speech emotion recognition in real-life customer service call center conversations,","venue":null,"work_id":"e0400600-d25e-4892-b9bf-50c075f69e29","year":2023},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.693595Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:f83cd2c078909be5b2d98b2da6cb7509a3fb5b66c196f116407ac81004432847","observation_id":"1304a568-28fe-4e84-b709-f6e163bb688d","resolution":{"observed_at":"2026-08-06T18:36:06.333983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.313915Z","title":"A VEC 2019 workshop and challenge: State-of-mind, detecting depression with AI, and cross-cultural affect recognition,","venue":null,"work_id":"a6508acb-8480-47d7-83b3-7ddf908f7c8f","year":2019},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.698250Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:2a729ad62fedecc8ec5e44ca65c705585566aaeae49cd24b2cea2f9908cb5d99","observation_id":"c9124f1a-64ab-4dda-af29-0bd2c3f1818d","resolution":{"observed_at":"2026-08-06T18:36:06.318440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.298098Z","title":"Cross- lingual/cross-channel intent detection in contact-center conversations,","venue":null,"work_id":"9e3e4445-434d-4685-8482-11d324b3cc5a","year":2023},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.703251Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:f48663bd3838c3d66824c050b82c432710e0d94ec5cc970fad2d913335217d1e","observation_id":"e4db70e6-b527-45bb-b68b-6a7728adaaf2","resolution":{"observed_at":"2026-08-06T18:36:06.303401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.282960Z","title":"Survey of deep representation learning for speech emotion recognition,","venue":null,"work_id":"53728732-af08-42b8-b7b2-a2f6bf13c35d","year":2021},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.707968Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:bd8a0bf8bd9b4fd707b926e4da3c05b2694a0cc2339cca51bafb9fd0e98b72b9","observation_id":"ea5e5ffd-bd87-4bd0-872e-8753b9bafeef","resolution":{"observed_at":"2026-08-06T18:36:06.287562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.268185Z","title":"Fast yet effective speech emotion recognition with self-distillation,","venue":null,"work_id":"a3a76fce-010d-43e0-9241-e417030b9ee5","year":2023},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.713291Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:f166f6f5cb84fbc9b2c74d3f42c778c40e5bcb49e857e965cf2bbe158ebc6692","observation_id":"4b2c86e6-21fc-41f4-9ff2-602cf4cb4d66","resolution":{"observed_at":"2026-08-06T18:36:06.273253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.253613Z","title":"An effective multimodal representation and fusion method for multimodal intent recognition,","venue":null,"work_id":"e62714b3-ed16-4ed8-add6-43f9db8da9ba","year":2023},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.718444Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:00cc91e2f49a657580417310bf4171bc584df141136dff81c7afeec348399e4c","observation_id":"9d6ed6ae-6c47-49a8-8077-1c6423d2c152","resolution":{"observed_at":"2026-08-06T18:36:06.258293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.723111Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.723111Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:cd8be9015072dd1c09166ca1c503e8c8772211cd3782451223babbbeb9760b32","observation_id":"564fc5e0-2370-4478-9948-b866156d255e","resolution":{"observed_at":"2026-08-06T18:36:05.723111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.728104Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.728104Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:ce5d2ba05f842be742ea1a2b2f156fcaf0d60dd4c9ba6c2a18edba1f9fc982ea","observation_id":"d065fe91-460a-44bd-b3fb-591ef18aefe7","resolution":{"observed_at":"2026-08-06T18:36:05.728104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T18:36:05.732683Z","title":"RoBERTa: A robustly optimized BERT pretraining approach,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.732683Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:0c8f90fa4535b8d88b19ee4b52d6d64f03e5449936afcc86d31c4b82d7490146","observation_id":"2ce85b3c-598a-4047-9c81-045551f209ee","resolution":{"observed_at":"2026-08-06T18:36:05.732683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.219488Z","title":"Semi- supervised spoken language understanding via self-supervised speech and language model pretraining,","venue":null,"work_id":"24903be4-a5f5-442d-9e72-fb2266296f08","year":2021},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.737670Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:3cdde69eacf5fa03e14be864f9c986c990caa396444fbc8c5f87773a27faad38","observation_id":"2c8f555c-d88b-415a-82c6-34febf89718f","resolution":{"observed_at":"2026-08-06T18:36:06.223801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.205902Z","title":"Semi-supervised speech emotion recognition with ladder networks,","venue":null,"work_id":"6d334697-099a-41dd-b315-abaeb83e9f91","year":2020},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.742401Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:a905e04b81a63cb16805329e9384e58ddcac2fb8f4563f92ec022ed9993aaba1","observation_id":"58d41bbd-c371-4e89-8edd-265107925fec","resolution":{"observed_at":"2026-08-06T18:36:06.210406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.190274Z","title":"Multi-task semi-supervised adversarial autoencoding for speech emo- tion recognition,","venue":null,"work_id":"c38d46d2-ea64-4d82-b9fc-2252b8f89ff4","year":2020},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.747676Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:df67087d03ecb51744683ffa2f122505d61d5458c270575d36a20b1431dc1fb1","observation_id":"c2e8a114-f010-45c6-97d0-b04a486eb775","resolution":{"observed_at":"2026-08-06T18:36:06.195528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.174777Z","title":"Speech emotion recognition using semi-supervised learning with ladder networks,","venue":null,"work_id":"7f910cb3-98f7-444f-807d-4168ced13ee2","year":2018},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.752576Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:296aeca4184bf5323142357208584c86c4730a56b97bf004c13529f024be996a","observation_id":"6325551b-eadf-40b0-8e46-09157b491024","resolution":{"observed_at":"2026-08-06T18:36:06.179768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.160197Z","title":"Enhanced semi-supervised learning for multimodal emotion recognition,","venue":null,"work_id":"c7cdf25f-c950-4f90-a20d-17883019005b","year":2016},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.758747Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:00f1f4b95e29f91be26d5512f19935495e61144f3bba9464205d178466317aa8","observation_id":"4d875591-4ab2-47d0-aee7-d56699f38268","resolution":{"observed_at":"2026-08-06T18:36:06.164547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.145732Z","title":"Semi-fedSER: Semi-supervised learning for speech emotion recognition on federated learning using multiview pseudo-labeling,","venue":null,"work_id":"6ffc6cec-c8c2-452d-8aff-69a2ceb54cdb","year":2022},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.763894Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:cf0417ed3dd700c9b871f9c8fb829e05a4185c811ee2ef362d1152ab16dde692","observation_id":"92af3c29-9a59-43a5-a56a-fcb32b2330ce","resolution":{"observed_at":"2026-08-06T18:36:06.150172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.131178Z","title":"Combining active and semi-supervised learning for spoken language understanding,","venue":null,"work_id":"47f471a8-07c6-40fa-a004-7fba4560f0eb","year":2005},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.768775Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:eaa0c801a2746416cde36f51de5364b94ed68c8999e1d7c57e96e43710ec0441","observation_id":"5fc4f503-3ea3-426e-b231-ab441a0fbe43","resolution":{"observed_at":"2026-08-06T18:36:06.135820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.116118Z","title":"Semi-supervised acoustic model training by discriminative data selection from multiple asr systems’ hypotheses,","venue":null,"work_id":"61eb2731-039f-4c21-ad86-fcef1ea046b3","year":2016},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.773039Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:daaaf36d5603eb6d94839db794bce25a76e60f9d7a5defe644f7c71ef5381e13","observation_id":"cd7981aa-8497-4e9f-a996-9ecbd247596c","resolution":{"observed_at":"2026-08-06T18:36:06.121315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.777583Z","title":"Fixmatch: Simplifying semi- supervised learning with consistency and confidence,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.777583Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:7c5a72e8ad60b38ecbbdda679c7899a1c092cc372b62c5c269918aa4f5c38698","observation_id":"6bd3858c-75eb-49f7-8cf4-a14c21c90169","resolution":{"observed_at":"2026-08-06T18:36:05.777583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.091156Z","title":"Combining cross-modal knowledge transfer and semi-supervised learning for speech emotion recognition,","venue":null,"work_id":"8e2cc1f5-16a1-4916-9c1e-9f8a3f0e6c2b","year":2021},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.782416Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:ea5e34e32ee52a6b4476df69b0030cd5d1aeca99b60f001b281fd9510cc05f0b","observation_id":"29cb90da-878c-4862-a41f-4be76dab7215","resolution":{"observed_at":"2026-08-06T18:36:06.095997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.076178Z","title":"Multi-lingual multi-task speech emotion recognition using wav2vec 2.0,","venue":null,"work_id":"a599928f-a3b7-40c3-9b97-3638f063b242","year":2022},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.786514Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:bc05ea5cbd27b10f550441d90f6fd6a40d9879d64ea4e1d5bfa6d464e098635f","observation_id":"6658381c-74e2-477c-8c2c-c16b01af8de6","resolution":{"observed_at":"2026-08-06T18:36:06.080982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.057275Z","title":"Knowledge transfer for on-device speech emotion recognition with neural structured learning,","venue":null,"work_id":"b712f944-3edd-4f8e-88fe-e78a026b4e94","year":2023},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.791275Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:e9ae14d67e75ea478a33859484530440e9071472378610eef4c48bafbe21c2e5","observation_id":"59abb32f-d2af-4bb5-9640-fe59d6c5104b","resolution":{"observed_at":"2026-08-06T18:36:06.065283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02751","last_updated":"2024-07-04T15:13:24Z","snapshot_observed_at":"2026-08-04T18:54:52.703854Z","submitted_at":"2024-07-03T01:56:00Z","title":"Emotion and Intent Joint Understanding in Multimodal Conversation: A Benchmarking Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02751","snapshot_observed_at":"2026-08-06T18:36:05.795773Z","title":"Emotion and intent joint understanding in multimodal conversation: A benchmarking dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.795773Z"},"links":{"cited_paper":"/paper/2407.02751","citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:85c4a06c6e2f819518068e0bdbc861cc5ec9ea62d161be16810b0051206652e0","observation_id":"e822ecf1-6d2a-44da-8ba2-e1245a6bdfaa","resolution":{"observed_at":"2026-08-06T18:36:05.795773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.037932Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":"5a6c43f4-b492-4359-a447-9eb6d0e25a68","year":2023},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.800525Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:748803b61478d71390fbe3be4e7fa94f8c273a87109694c429d5d70fa66c4be8","observation_id":"da1c8dfe-f627-47df-8578-b2784151eb11","resolution":{"observed_at":"2026-08-06T18:36:06.044993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:06.016906Z","title":"Dynamic thresholding on fixmatch with weak and strong data augmentations for sound event detection,","venue":null,"work_id":"0f2584b2-6aa0-4d7a-bf45-8ea60e286233","year":2022},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.804696Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:c7a24e702ec5b6b7a339965783a5435c622d8a63786cac71043813c8848a0ef7","observation_id":"6b5b5763-d904-4f93-a300-066ded8e6c91","resolution":{"observed_at":"2026-08-06T18:36:06.024941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.995934Z","title":"EDA: Easy data augmentation techniques for boosting performance on text classification tasks,","venue":null,"work_id":"25be196d-cbfa-432c-acb8-59e161705370","year":2019},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.809178Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:8ce25dc23076317ed5ea657ad286358b1d59feb2fae11250f1069bf5b296dad4","observation_id":"4eae5d76-c074-4f83-8bb6-64be207a7ec4","resolution":{"observed_at":"2026-08-06T18:36:06.001116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.980972Z","title":"Deep scalogram representations for acoustic scene classification,","venue":null,"work_id":"68b37679-31e7-4f2c-99d8-70311116b8b5","year":2018},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.817119Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:7f082d04fda1cc7453597baab50ad542db581416d95c4d822d92a644059fb3bf","observation_id":"5e7a5558-bbe2-4b37-abce-f5e28b1eca5e","resolution":{"observed_at":"2026-08-06T18:36:05.985724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.965829Z","title":"Verification of acoustical correlates of emotional speech using formant-synthesis,","venue":null,"work_id":"4afca3b1-f438-48a1-bfee-b5422b057695","year":2000},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.822475Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:4d1055a89a6344f9cd182d512e0a87409ec15ea611149a62a10ed115796a213e","observation_id":"7735d5d8-7ce1-401c-ab72-6ad0da11d158","resolution":{"observed_at":"2026-08-06T18:36:05.970711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.948085Z","title":"The acoustic realization of anger, fear, joy and sadness in chinese,","venue":null,"work_id":"4fa6b1f8-3ca3-48fd-9ab7-5c2c10fa4a40","year":2002},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.826664Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:4bfa8c243c1771d161a3bd9f5c5c1f2e74bb7655a5f436094e21550783cc7b81","observation_id":"37dc512b-ef47-45d6-b875-ee6d531eaaaa","resolution":{"observed_at":"2026-08-06T18:36:05.953608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:36:05.930086Z","title":"WavLM: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":"b2350537-c914-46ba-a16d-8306076c0eab","year":2022},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.830815Z"},"links":{"citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:42655fe525942a292af56356df362a167eb532793d3c747a32bb3281a581338a","observation_id":"89345faa-2a56-4924-a25b-06838cf13c53","resolution":{"observed_at":"2026-08-06T18:36:05.937018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06090","last_updated":"2024-06-19T11:53:54Z","snapshot_observed_at":"2026-07-06T15:53:11.310262Z","submitted_at":"2023-07-12T11:27:40Z","title":"Can Large Language Models Aid in Annotating Speech Emotional Data? Uncovering New Frontiers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06090","snapshot_observed_at":"2026-08-06T18:36:05.834924Z","title":"Can large language models aid in annotating speech emotional data? Uncovering new frontiers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:36:05.834924Z"},"links":{"cited_paper":"/paper/2307.06090","citing_paper":"/paper/2507.07806"},"observation_digest":"sha256:df71e5e304ce1368ac07fc536c9a00e94f7a288e06a8f6024146bdefcf65235f","observation_id":"70925387-01ac-4823-b521-5d86d47255d9","resolution":{"observed_at":"2026-08-06T18:36:05.834924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07806","last_updated":"2025-07-10T14:30:29Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T18:29:35.096414Z","submitted_at":"2025-07-10T14:30:29Z","title":"End-to-end Acoustic-linguistic Emotion and Intent Recognition Enhanced by Semi-supervised Learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":25},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2507.07806."}