{"as_of":"2026-08-08T06:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77cdcb6b5aca0d42f82ac9fba9cc193dcb5c3c69c3d3c7944785041d2592c411","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T19:01:25.208175Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T10:26:25.288372Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:49:52.016080Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2508.14130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14130","snapshot_observed_at":"2026-07-04T12:49:52.016080Z","title":"arXiv preprint arXiv:2508.14130 (2025)","venue":null,"work_id":"705546a3-3ada-45fe-bb93-ffa4110af366","year":2025},"citing_paper":{"arxiv_id":"2512.07571","last_updated":"2026-04-06T08:39:08Z","snapshot_observed_at":"2026-07-06T22:38:03.983093Z","submitted_at":"2025-12-08T14:05:40Z","title":"A Simple Method to Enhance Pre-trained Language Models with Speech Tokens for Classification","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-17T00:46:08.921194Z"},"links":{"cited_paper":"/paper/2508.14130","citing_paper":"/paper/2512.07571"},"observation_digest":"sha256:0c0e4e5650ffd7c01ce5becee9a890f9d726649a6adde369f0e96a4b0169852b","observation_id":"b4b295d5-5ee6-4bd4-9d36-e64715d0856e","resolution":{"observed_at":"2026-05-17T00:48:45.965142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2508.14130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14130","snapshot_observed_at":"2026-07-04T12:49:52.016080Z","title":"arXiv preprint arXiv:2508.14130 (2025)","venue":null,"work_id":"705546a3-3ada-45fe-bb93-ffa4110af366","year":2025},"citing_paper":{"arxiv_id":"2606.24941","last_updated":"2026-07-27T15:49:33Z","snapshot_observed_at":"2026-08-07T07:53:29.622172Z","submitted_at":"2026-06-22T20:45:49Z","title":"EmotionAI: A Privacy-Preserving Computational Intelligence Pipeline for Speech-Emotion-Grounded Conversational Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T06:05:49.433814Z"},"links":{"cited_paper":"/paper/2508.14130","citing_paper":"/paper/2606.24941"},"observation_digest":"sha256:928b9344dc7f0de6d03fcdc65b0b5350fecc0252024f72f55d314526a4e628af","observation_id":"a30cd5cf-f01a-4bef-a6a5-42185b6b7e27","resolution":{"observed_at":"2026-07-04T12:49:52.017420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14130","snapshot_observed_at":"2026-08-02T10:26:25.288372Z","title":"arXiv preprint arXiv:2508.14130 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.24941","last_updated":"2026-07-27T15:49:33Z","snapshot_observed_at":"2026-08-07T07:53:29.622172Z","submitted_at":"2026-06-22T20:45:49Z","title":"EmotionAI: A Privacy-Preserving Computational Intelligence Pipeline for Speech-Emotion-Grounded Conversational Analysis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T10:26:25.288372Z"},"links":{"cited_paper":"/paper/2508.14130","citing_paper":"/paper/2606.24941"},"observation_digest":"sha256:0e945386d3c4331d618331ea786fff145cd8856ee7f4f38797c1b17988fabc6c","observation_id":"a546dc66-a3a6-4edb-b707-b4e3929b3445","resolution":{"observed_at":"2026-08-02T10:26:25.288372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.14130/citation-record","integrity":"/paper/2508.14130/integrity","json":"/paper/2508.14130/citation-record.json","paper":"/paper/2508.14130"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.685037Z","title":"Alsaad, Yusra Azhar, and Yasser Al Nasser.Depression in Children","venue":null,"work_id":"b3295aa6-0fa2-4b75-b9b8-0b5867ea892f","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:19.919619Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:6dba969666c50008abb06b10652aa02cf338df4cf2fe61c14fbd162cf00fe46f","observation_id":"e4ac4cc6-9f83-4606-81f5-5df0af1a7f74","resolution":{"observed_at":"2026-08-05T19:01:46.689700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.665231Z","title":"Self-supervised learning from images with a joint- embedding predictive architecture","venue":null,"work_id":"cb712e6f-b571-483c-a526-020c6f242a01","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:19.966654Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:60d291a15cf4d998f87b71d7c9f0253cc3fd42248b4a90b7711f515a5d442a63","observation_id":"d33317e0-c168-428b-bcd9-5d754b000091","resolution":{"observed_at":"2026-08-05T19:01:46.670936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.647175Z","title":"vq-wav2vec: Self-supervised learning of discrete speech representations","venue":null,"work_id":"fbe82906-7716-48af-8d00-cdc6eff74c0f","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.015139Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:5947bec0be2d5d3b567b6f3e3a21ad03428dfc6bd571bc220851847390b77a54","observation_id":"36424f8d-492c-4a38-bfc6-52b72e0ad2fc","resolution":{"observed_at":"2026-08-05T19:01:46.652213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11477","last_updated":"2020-10-22T06:09:10Z","snapshot_observed_at":"2026-08-07T05:13:16.889179Z","submitted_at":"2020-06-20T02:35:02Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11477","snapshot_observed_at":"2026-08-05T19:01:20.124665Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.124665Z"},"links":{"cited_paper":"/paper/2006.11477","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:795670e819b4cd80fb1f43378ea0d292fda5b4ae380d397cf17b8d9b2fb993a9","observation_id":"f3095a81-f6c5-4f8d-88aa-f88f294afb2c","resolution":{"observed_at":"2026-08-05T19:01:20.124665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.628402Z","title":"VICReg: Variance-invariance-covariance regular- ization for self-supervised learning","venue":null,"work_id":"89f8dcf2-a656-41c5-a6b9-73f775237333","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.212739Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:42d772ab02e84f957d1a257364302c44888ac639ed53895e7085feea2677c8a6","observation_id":"f6ea7c20-042d-4a93-a0c3-4e98dd316dd4","resolution":{"observed_at":"2026-08-05T19:01:46.634597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.608926Z","title":"Revisiting feature prediction for learning visual representations from video","venue":null,"work_id":"8a63eff7-6471-4d9b-b895-8db8cff6b7c0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.290655Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:88560f656dfb8ed07ee3e4a15dcf62652540ad04a730ddcbf829a1e5bd3f22cd","observation_id":"3df58c14-0e90-4e56-afed-c010015acd68","resolution":{"observed_at":"2026-08-05T19:01:46.614173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.592408Z","title":null,"venue":null,"work_id":"244e70c1-e542-4b45-89d1-fdea04fe28a0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.364384Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:c3ac758918151e3f6d5219ffd77c42053188ee553ad05079c85dbc9da64bb2c9","observation_id":"cbffb741-49e2-448f-8109-0428c724d434","resolution":{"observed_at":"2026-08-05T19:01:46.597891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.570395Z","title":"Unsupervised learning of visual features by contrasting cluster assignments","venue":null,"work_id":"a4ccb9a4-e7dd-4b09-bce8-376d7f5f335c","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.413028Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:a57acea6b7c50a4fc112ae062b6a5a239036421695ac4c3fc17642b37efb2472","observation_id":"2f391802-f54f-490c-866f-8b902bacee4a","resolution":{"observed_at":"2026-08-05T19:01:46.576531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:20.485952Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.485952Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:662d17f22bedce0c42a8f554af132e4221523fd55ed1a11f70f893a0e0574376","observation_id":"15629ce6-2c4a-4170-ad9d-9de93168ef0e","resolution":{"observed_at":"2026-08-05T19:01:20.485952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.552823Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing","venue":null,"work_id":"5a80add7-0fc4-4e79-8b22-1ef737ef9a5b","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.585767Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:fe12018fae0d6feca01c41725d228abd143617fc6a3695bd4941853bc59abe42","observation_id":"f5fd2387-655e-4d16-b744-3e1e3b93e39e","resolution":{"observed_at":"2026-08-05T19:01:46.557915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.537300Z","title":"BEATs: Audio pre-training with acoustic tokenizers","venue":null,"work_id":"8a666270-c310-408c-a227-661968336fa2","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.660752Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:490e9544e9f6196b6d5da004ad50b5f5dc072697ef0a0116ca6149b357700efc","observation_id":"5ca26339-8f0d-4c2c-a364-677c304f767a","resolution":{"observed_at":"2026-08-05T19:01:46.542209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-05T19:01:20.706326Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.706326Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:1021b570c6538acee17318dc90d7b7007e28e0aa2de7605a83cbeb29cc87a8b7","observation_id":"abb879ae-48a2-4378-9d0a-fec68e32d91f","resolution":{"observed_at":"2026-08-05T19:01:20.706326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:20.802087Z","title":"Qwen2-audio technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.802087Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:5eaf24eca5a0990a3eb3e006e5cd782f7e37f600280c140182c6f7ed3a61a517","observation_id":"0f727b67-fdb9-4467-8cd5-2b7fa2e834b0","resolution":{"observed_at":"2026-08-05T19:01:20.802087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.506179Z","title":"Chi, Jeff Dean, Jacob Devlin, Adam Roberts, Denny Zhou, Quoc V","venue":null,"work_id":"66a3c04b-efe1-4793-9fb8-05fc3bb68019","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.878475Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:441dee92247c94dffcb421acd0e9564929213847237d67146ad86665f3b00852","observation_id":"40827567-f0a0-4179-97a5-4bd7f71ec114","resolution":{"observed_at":"2026-08-05T19:01:46.513806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.483878Z","title":"An unsupervised autoregressive model for speech representation learning","venue":null,"work_id":"24d486b0-d27b-4109-b057-46b5f641c9d8","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.962044Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:bf77dc75e36723169ed1898fe61bbf5e73c816b8c246635b029689d19a9e0824","observation_id":"e03cabcc-4e51-4898-ad1a-9e5652bb2227","resolution":{"observed_at":"2026-08-05T19:01:46.492673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08295","last_updated":"2025-03-24T21:06:53Z","snapshot_observed_at":"2026-07-06T18:13:55.543513Z","submitted_at":"2024-05-14T03:33:31Z","title":"SpeechVerse: A Large-scale Generalizable Audio Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08295","snapshot_observed_at":"2026-08-05T19:01:21.059534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.059534Z"},"links":{"cited_paper":"/paper/2405.08295","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ddcba406f9a74353d74fafe6b26ecfb449b931a0b3042b819834bf76c73566c8","observation_id":"89172613-8aed-4848-822a-cc168751ec30","resolution":{"observed_at":"2026-08-05T19:01:21.059534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.464718Z","title":"Speech prosody in mental disorders","venue":null,"work_id":"10fc45a5-be57-4703-8e87-d995718fe110","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.118457Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:d5d5e018664e1643c42550c96c09ce474354e9624d43ff3c429c1d3aba35d050","observation_id":"690bd071-bfb0-4438-88bb-ada9aec607a7","resolution":{"observed_at":"2026-08-05T19:01:46.470425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.447935Z","title":"Learning to predict activity progress by self-supervised video alignment","venue":null,"work_id":"76389d5f-c74b-44f4-875a-c985add3343a","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.178788Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:35aceafe59e4a5b069e4d0563f3e013cabccbb05dc3b95c1508bce4480e203b0","observation_id":"b2404d2a-47a7-4189-b87e-df0042ade9cd","resolution":{"observed_at":"2026-08-05T19:01:46.452637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:21.236038Z","title":"Moshi: a speech-text foundation model for real-time dialogue, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.236038Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:322c0db561bc6220a4c02be6b44a19ff1387916dd6d6a4dd3b1785920982822a","observation_id":"b2de2793-8150-4a36-919f-6183ccbe3087","resolution":{"observed_at":"2026-08-05T19:01:21.236038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.413838Z","title":"Prompting large language models with speech recognition abilities","venue":null,"work_id":"8b99042f-0a29-4d07-9706-372a52495105","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.297640Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:7d94e9f41c02570e20f6b8336c68735afea3fb3c00a47f75dfdf4b3d05408a7e","observation_id":"604d02fc-9a22-482a-b562-95ff874a7276","resolution":{"observed_at":"2026-08-05T19:01:46.420259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.386845Z","title":"Risk factors for problematic smartphone use in children and adolescents: a review of existing literature","venue":null,"work_id":"57fe91a2-02da-47ea-ba06-2218f7b172e3","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.458051Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ba7b1d0502e4f21396c47955c4030773fdb42417f51733bf7577b7287f4c6a6a","observation_id":"e8a5b3c1-c32d-46bd-9864-27e6553b1fa3","resolution":{"observed_at":"2026-08-05T19:01:46.395703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.363159Z","title":"Richemond, Elena Buchatskaya, Carl Doersch, Bernardo Avila Pires, Zhaohan Daniel Guo, Mohammad Gheshlaghi Azar, Bilal Piot, Koray Kavukcuoglu, Rémi Munos, and Michal Valko","venue":null,"work_id":"928bb2b1-02c3-46aa-8800-f65e6ed59556","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.583688Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:6612f35ffb2a6e0cabb38f91ecc46f22b59ef7c8bfe7015820fc9532e156e974","observation_id":"b8d10302-99dc-4115-875b-00490fef6635","resolution":{"observed_at":"2026-08-05T19:01:46.370681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.342578Z","title":"A generalizable speech emotion recognition model reveals depression and remission","venue":null,"work_id":"01ca4145-985e-4063-90e2-5e2b8d7f74e6","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.670496Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:e28f4d442ab6dc7264d7bc91f9441ec466e28a1260891cb058db1a7ea8c73ca9","observation_id":"7ca5f94c-7264-41d4-8213-83f52712fda3","resolution":{"observed_at":"2026-08-05T19:01:46.349010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.325449Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units","venue":null,"work_id":"6abe9172-65aa-403c-bc65-1a0e9d3b2867","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.773425Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:64e4d0b9417dfd5a9f62fb0da93b6a5e2dd911f6afe987a1dcbec99d48680c2e","observation_id":"40c3cf6b-0ca5-4f3d-81ff-5d4bd48da5bc","resolution":{"observed_at":"2026-08-05T19:01:46.330403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.306864Z","title":"Robust wav2vec 2.0: Analyzing domain shift in self-supervised pre-training","venue":null,"work_id":"a4cd6474-96bd-45a6-87d6-5cf51f01415a","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.916857Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:acd89657d79c161ad67789ed0db6895822a813644b4b09da5f061c38abe44c7d","observation_id":"89df3e79-c389-4d1a-9a94-75e64dacc146","resolution":{"observed_at":"2026-08-05T19:01:46.313639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:22.032658Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.032658Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:9dd367c7174e0825ae11a760f24f067f4be6ccb110d83af738aa1c0c18eb41f8","observation_id":"936e8dbd-253c-457e-ad9f-4bceef2447f1","resolution":{"observed_at":"2026-08-05T19:01:22.032658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.277800Z","title":"WavLLM: Towards robust and adaptive speech large language model","venue":null,"work_id":"37d8af0e-7812-4c72-a62d-1e0df269f000","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.166000Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:89ab53f33372be8418b18549856079814109ab8aa2d4fc5c0dc63d045813ff37","observation_id":"4213839a-3fe4-4180-a015-443a8249b72d","resolution":{"observed_at":"2026-08-05T19:01:46.283002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.261197Z","title":"Ibrahim, Antony Perzo, and Simon Leglaive","venue":null,"work_id":"c35037e6-22fd-4437-9063-b0ad70e92b7b","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.236296Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:0ae51396736f08caf533bb4a9750a4953eb552f01e06fbe453528422045ec7cb","observation_id":"39036777-0294-4e66-8fdb-8d1b103a5245","resolution":{"observed_at":"2026-08-05T19:01:46.265753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.243070Z","title":"Audio flamingo: A novel audio language model with few-shot learning and dialogue abilities","venue":null,"work_id":"1645c841-2cad-403b-a587-a4e28af41494","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.294637Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:eb0971f15931b22289ad8e98584db896d220c29a1e7e1165ad3f1ca998d8c595","observation_id":"79b54156-0e4f-4b5d-b37c-e08c3b7dcce0","resolution":{"observed_at":"2026-08-05T19:01:46.248319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.223665Z","title":"Masked vision and language modeling for multi-modal representation learning","venue":null,"work_id":"ca986932-526b-48ec-b7cb-921b24995247","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.327771Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:d09c4410a26935f3099904124aac41acf3df26984b6b8878a9ec48dd2ecc0a51","observation_id":"38d4ede5-7c28-4328-9407-2d32cfab6f3e","resolution":{"observed_at":"2026-08-05T19:01:46.229769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.202453Z","title":"Modeling caption diversity in contrastive vision-language pretraining","venue":null,"work_id":"ae20a2dc-9ef6-46bb-8063-d07ddb398730","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.418248Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:3cfe135aaf5b1c4f57121293f2b88afb920b4ece7774df985217029c3480286e","observation_id":"c49c21c6-75a1-4f0b-ac02-5ab1ca196f22","resolution":{"observed_at":"2026-08-05T19:01:46.209139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.181371Z","title":"Binning as a pretext task: Improving self-supervised learning in tabular domains","venue":null,"work_id":"fe263485-0f09-4a42-ba66-6722798e800a","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.491884Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:07ac24df59bbe1f4ea24c40bf2db0e5d8866cf3b80b2c40846081d5748b722c4","observation_id":"ecc48aa8-cef9-49b8-a540-2fd99399f896","resolution":{"observed_at":"2026-08-05T19:01:46.188186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:22.549102Z","title":"Blip-2: bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.549102Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:cb4c4291434bb7d88b25346ed0ff07e5634b587e7d41e6c9827903bc5db30a5f","observation_id":"26c43586-b09a-4a0c-9709-fb9fa2167edf","resolution":{"observed_at":"2026-08-05T19:01:22.549102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.142140Z","title":"Revise, reason, and recognize: Llm-based emotion recognition via emotion-specific prompts and asr error correction","venue":null,"work_id":"4e0e0e32-33ff-4e00-8077-b648d59b436c","year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.610013Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8446af06a1b186d20a13a097aeacfab225372772dd54088312287508bb46b53c","observation_id":"14095ca2-d63e-43dc-95e7-430077254b37","resolution":{"observed_at":"2026-08-05T19:01:46.148362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.123066Z","title":"Liu, Yu-An Chung, and James R","venue":null,"work_id":"f27eae25-2905-42f6-8815-b382327359e9","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.657713Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:79d5c9c80c4261d0bb556c00f9100d1a8b07a2ccf759db860ab44015cce46653","observation_id":"057f500a-a6d8-4ba3-ad0c-d7029a3a581b","resolution":{"observed_at":"2026-08-05T19:01:46.128203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.104254Z","title":"Liu, Shang-Wen Li, and Hung yi Lee","venue":null,"work_id":"28f62755-c0f3-4a3c-9716-2ead661d3ffd","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.720352Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:cee19b55b245ca744a7556d93409a34707346fb770c82534309ede5f19de1e84","observation_id":"1dcec125-d867-409a-bf03-11333f56b31e","resolution":{"observed_at":"2026-08-05T19:01:46.109729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:22.792704Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.792704Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:520e3f6586e6ff7b1e95b88bf042b15a5d3f83e1c945b7e2ff32784f5d6de442","observation_id":"6f306275-d1e2-4902-b8eb-fcfa73a28bfa","resolution":{"observed_at":"2026-08-05T19:01:22.792704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.065831Z","title":"Building naturalistic emotionally balanced speech corpus by retrieving emotional speech from existing podcast recordings","venue":null,"work_id":"f7356865-703a-411f-b69d-726cdfafbdf7","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.858025Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:64b112299012ec7ffa3c104050be63f63ca862b02bea68ea8cb9cd74a760aed6","observation_id":"fa4c8014-235e-4332-95b9-0f46aaab0837","resolution":{"observed_at":"2026-08-05T19:01:46.072566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.045715Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":"eb00038f-f469-4903-821b-c1bfe3ffa3a3","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.900565Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:31de8011609bf4f9e5df6644ef2a9fb4dc612a5459cdc57572983a26ba93ad99","observation_id":"7768da0b-c871-47cf-a1ef-50a7026b794f","resolution":{"observed_at":"2026-08-05T19:01:46.052217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.993508Z","title":"Byol for audio: Self-supervised learning for general-purpose audio representation","venue":null,"work_id":"270dcdad-494d-4faa-854e-7e13d014a885","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.963271Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:6f4728a234ca522b58396a52a9e3320b3c7ad48171457f7348339c6654796bc6","observation_id":"84332ff0-aa25-47d0-8217-5e72e28142b6","resolution":{"observed_at":"2026-08-05T19:01:46.033339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.768404Z","title":"Byol for audio: Exploring pre-trained general-purpose audio representations","venue":null,"work_id":"513bfd5f-abec-42e5-81c6-a31acb11c898","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.026570Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:f630837c1e3a19d8d3c8202ccb061f57f3d237823c09d91fcda7d5f41f70ca0e","observation_id":"652bda04-7608-4b0e-95af-1bbc0902a1a7","resolution":{"observed_at":"2026-08-05T19:01:45.941970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.621828Z","title":"Olson, Dasha A","venue":null,"work_id":"49edd63d-4243-427e-81d7-a0f5de1e641e","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.099129Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:493497f3af2eefbe3fd9b52abfc19706f17394d38dad292ad6fb42b412acde59","observation_id":"d4a3ba5a-17db-4167-934f-b11140853003","resolution":{"observed_at":"2026-08-05T19:01:45.721655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:23.138521Z","title":"Librispeech: An asr corpus based on public domain audio books","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.138521Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:c4eea144dcbae85f9ae4bc23925987c4ad6fbe28cd786744b173f7779339b27d","observation_id":"b65bf25c-dc21-4d93-ad29-8a21e08c1199","resolution":{"observed_at":"2026-08-05T19:01:23.138521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.326233Z","title":"Strimel, and Andreas Schwarz","venue":null,"work_id":"1220460f-64c9-40cf-9b18-c468b71170fd","year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.178378Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:25d09aef028db8d0a20d809b7347f0b1d44401e133412386f89f9d20d028010a","observation_id":"faaf7ce7-4e2f-4b16-b32c-fe0831262366","resolution":{"observed_at":"2026-08-05T19:01:45.441316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.084265Z","title":"Emotion Recognition from Speech Using wav2vec 2.0 Embeddings","venue":null,"work_id":"48dbccf2-80b2-4412-a504-8190cef91a7b","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.226362Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:c1bc8ce5e1ac2734234689ad433915c0fa78fda71670ca7a7ced72c1dd06729d","observation_id":"9fcfa147-358a-44e1-8512-e0f4e57b4a00","resolution":{"observed_at":"2026-08-05T19:01:45.190947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.848287Z","title":"V oice modulation: A window into the origins of human vocal control? Trends in Cognitive Sciences, 20(4):304–318, 2016","venue":null,"work_id":"da4e63ac-3f4f-41a1-8344-2b8721dba757","year":2016},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.320516Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:d177cb7935aec3bad9de01dfe94ea143e610ac6546a934ad45377b1c4e98e990","observation_id":"d65b04ca-57f1-4c6d-a2b1-0117ede1df2f","resolution":{"observed_at":"2026-08-05T19:01:44.962829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:23.392952Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.392952Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:475d5d16ddf4aa2c1b8366cae3865b25064d2efee5b0dda723f489ea131fb89e","observation_id":"ae6ae9af-902b-45a5-aed8-eee93c463da4","resolution":{"observed_at":"2026-08-05T19:01:23.392952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.543029Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"0974466a-0546-4cfd-87c6-03089f233c70","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.453725Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:48afcaa1af06df7d0e800c4895056a1c24a157a5af625d9fe6cda6b67a95d7cf","observation_id":"be217bed-d5a8-49d7-a7ae-ad151ec2fa41","resolution":{"observed_at":"2026-08-05T19:01:44.666612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.296704Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"0a053b18-f5e5-48ca-b6f2-9a0474e987b7","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.494518Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:b48b3a76ab3a318b7a3a64e414f0f2b0bfe7aaec50c7c3d69a6ce41937a8dd65","observation_id":"4260065f-cb11-48f9-899c-091ba0206297","resolution":{"observed_at":"2026-08-05T19:01:44.405983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.002186Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":"cd0a879f-40dc-4b76-98b5-5390cb028921","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.569936Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:18edc9fdb4082a3e64e773baf1d3ef8deb66b6576da629892f63d86e3560c9f5","observation_id":"a97c329d-bf9f-48bb-b580-8e5e3ed94722","resolution":{"observed_at":"2026-08-05T19:01:44.116729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05862","last_updated":"2019-09-11T08:19:49Z","snapshot_observed_at":"2026-08-06T05:33:37.746688Z","submitted_at":"2019-04-11T17:29:30Z","title":"wav2vec: Unsupervised Pre-training for Speech Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05862","snapshot_observed_at":"2026-08-05T19:01:23.671306Z","title":"wav2vec: Unsupervised pre-training for speech recognition","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.671306Z"},"links":{"cited_paper":"/paper/1904.05862","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4efb7c8c5d2eecd1bffbf4bdb9d868b9586e77b4ee4ff607871405464da69ad3","observation_id":"7f0dfb18-be61-48e4-a07e-b129e4107d22","resolution":{"observed_at":"2026-08-05T19:01:23.671306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.906973Z","title":"Flava: A foundational language and vision alignment model","venue":null,"work_id":"466c5450-b8af-4397-bec6-d47bf5908f1e","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.742668Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:5b31b9b3e05292f2480fa9667a1dd77eed1281fd6a02543bc87cdc558611bb21","observation_id":"a0f11967-843b-4a54-b1c4-7cb694f85153","resolution":{"observed_at":"2026-08-05T19:01:43.956446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.770224Z","title":"SALMONN: Towards generic hearing abilities for large language models","venue":null,"work_id":"80a77cbd-3ace-407e-a538-a1510b7efab0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.786403Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:23a161bff490565fd49850d30c648e41fc0bb5b7bdc7fce73de710a1575a3008","observation_id":"f967e566-c2ed-4242-9ce3-21ad008c08ae","resolution":{"observed_at":"2026-08-05T19:01:43.813149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:23.825644Z","title":"Chameleon: Mixed-modal early-fusion foundation models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.825644Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:dd327f9219411ae523fa77e0a632a6cd7a39994484fe53e06623c285ec4ab0a0","observation_id":"4dc53a46-6f11-4622-bed8-3768cedebb69","resolution":{"observed_at":"2026-08-05T19:01:23.825644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.649544Z","title":"T-JEPA: Augmentation-free self-supervised learning for tabular data","venue":null,"work_id":"37bba3d4-92e3-4e9f-82db-c06d42ce74d3","year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.870260Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ecbbe41ce2bf3bc4b60e459b2d1d45c09e736d9a702472105eeba99a29eb0fee","observation_id":"756f964c-ce41-4c4a-a19d-bfe7322083f4","resolution":{"observed_at":"2026-08-05T19:01:43.702511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.501772Z","title":null,"venue":null,"work_id":"71befe51-7890-4dd3-b453-0f38cee2a27c","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.926872Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8e339dbf0ff2df9db8c8b2d83975b959968ba5c270b5a91f5439ae942c7afc34","observation_id":"fa718704-5668-4f85-990e-c9ff4e21fff0","resolution":{"observed_at":"2026-08-05T19:01:43.570579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.336833Z","title":"Improved baselines for data-efficient perceptual augmentation of LLMs, 2024","venue":null,"work_id":"141f118b-6f1c-49fc-9a04-f2650d73f886","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.004589Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:aac022b32c3d3db2604d508d4b5b8b8b889adaea609f5bb34a1aab8e7aed2ca1","observation_id":"4b65a974-fb17-4c12-a888-238c189946e4","resolution":{"observed_at":"2026-08-05T19:01:43.405953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.152595Z","title":"Neural discrete representation learning","venue":null,"work_id":"39daa84c-ed11-4335-ac30-482594f71ff5","year":2017},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.086829Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:fcfa861bc588939b272f73b0573dd0b2ef4d8d072fdf6a4f0f009bf3da1b00f7","observation_id":"3d5188bb-92b2-44e0-8bf8-57865b360f16","resolution":{"observed_at":"2026-08-05T19:01:43.238606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.988432Z","title":"Schuller","venue":null,"work_id":"3828e0e8-94dd-4184-8468-4c68adfc8642","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.130131Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:0077024eb05078ea21bc9b524c4be4e0f778be9c831bbc316331991c896cbf16","observation_id":"befbdacb-0845-4b22-8b62-5238da51bc28","resolution":{"observed_at":"2026-08-05T19:01:43.053250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02735","last_updated":"2022-10-03T20:50:54Z","snapshot_observed_at":"2026-07-06T12:05:22.076764Z","submitted_at":"2021-11-04T10:39:06Z","title":"A Fine-tuned Wav2vec 2.0/HuBERT Benchmark For Speech Emotion Recognition, Speaker Verification and Spoken Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02735","snapshot_observed_at":"2026-08-05T19:01:24.191393Z","title":"A fine-tuned wav2vec 2.0/hubert benchmark for speech emotion recognition, speaker verification and spoken language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.191393Z"},"links":{"cited_paper":"/paper/2111.02735","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:84de8d394052eaf088410f2d6924376d3b275cca6e1b151d3da9c6a83afdfde3","observation_id":"e093735d-c928-47c2-a74d-e3511988e94b","resolution":{"observed_at":"2026-08-05T19:01:24.191393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.849207Z","title":"Towards latent masked image modeling for self-supervised visual representation learning","venue":null,"work_id":"8c2afccd-3268-4dd0-8f23-fa455fe51db0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.280553Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:88b8fa84a7a48f0af22661edb65dab9efcf2293aec9bf2aadb0f4527d0ee0f44","observation_id":"1f672392-9f67-4e8e-876e-be60fc74d23a","resolution":{"observed_at":"2026-08-05T19:01:42.916560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.672069Z","title":"On decoder-only architecture for speech-to-text and large language model integration, 2023","venue":null,"work_id":"c6f23481-98f6-4de6-853c-1341ac5cff2f","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.344446Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:10fa9fb785efaffcdc19200bec04f4ec1236798e1408925508865ff0da12a7db","observation_id":"993294aa-cb5b-4a93-a125-70f9f0950cf5","resolution":{"observed_at":"2026-08-05T19:01:42.747469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.499709Z","title":"Switchtab: Switched autoencoders are effective tabular learners","venue":null,"work_id":"779cd382-8ebf-46da-9f27-d7d7ab6c6bc2","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.372433Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:521f57fdf5321e50d37d1a02ee8eb5dd6c24c0e964e35653b0e9fe2984cf117c","observation_id":"269d79d5-751b-4afd-8961-346dcc2f7e35","resolution":{"observed_at":"2026-08-05T19:01:42.571055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T19:01:24.436973Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.436973Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:0de5ca4437a3cc495ab8458857e8522fa12a0009f4dc41236f5e23050841ca6b","observation_id":"713a01ad-c6fe-44ff-89ee-b57d89fd35da","resolution":{"observed_at":"2026-08-05T19:01:24.436973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.359163Z","title":"Detection of mood disorder using speech emotion profiles and lstm","venue":null,"work_id":"d180d556-120a-4e8f-9015-b7a1146cbe80","year":2016},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.497700Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:a899e7f0c0abd07e35ee90d113ec9cc138984853e3807bd8c4a41bd77ca0e0f3","observation_id":"429e1704-9c86-4f1f-8775-020160c7d55e","resolution":{"observed_at":"2026-08-05T19:01:42.426558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.111045Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":"ad388093-a730-4e36-bbeb-d686c8f531ac","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.566366Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:6aba2796cc2fb26aa84afb540f7854af533ea924ced3d33fccfd849e65a939f2","observation_id":"fcdb43d8-40d4-4b00-bc94-aa549ac2d188","resolution":{"observed_at":"2026-08-05T19:01:42.242393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.970339Z","title":"Connecting speech encoder and large language model for asr","venue":null,"work_id":"34833bed-0af3-4a96-96c4-b2692f199954","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.645692Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:44d632f1abf84688cc56f65cd4541e2bd9cb84cde94489429314c073fc53e014","observation_id":"e9c94ed4-59cc-45e3-9adb-876839345ba7","resolution":{"observed_at":"2026-08-05T19:01:42.042815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.741710Z","title":"Barlow twins: Self- supervised learning via redundancy reduction","venue":null,"work_id":"9892dbb6-1a74-4eb8-a2a3-931477913686","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.704777Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:76dbe772393675dba98f0c339411d3fe14808e0224c97072fe4af2388e6acff4","observation_id":"326cb922-af5f-47c9-84b4-e5d544e91a91","resolution":{"observed_at":"2026-08-05T19:01:41.874164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.560705Z","title":"XTab: cross-table pretraining for tabular transformers","venue":null,"work_id":"550f7554-41f1-4eb3-97c3-04160bebb0a5","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.823489Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ffd31aa43f633050fabee06794581a660bcd8afeb37b4c1ae7b9b15df794c2b4","observation_id":"8be054d5-7c0e-4a08-ace2-3738e3b75aaa","resolution":{"observed_at":"2026-08-05T19:01:41.627401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.398311Z","title":"role\": \"system","venue":null,"work_id":"eea983bd-2061-43c8-b240-07905c2ae47e","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.881803Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:9f43e7fbbfa32e718cd75f6cc9bf268c515074a67c6d798b7d1092ea33cd5cc4","observation_id":"b964a577-3280-4235-9c38-8196d83c06d3","resolution":{"observed_at":"2026-08-05T19:01:41.461050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.150640Z","title":null,"venue":null,"work_id":"39e632e2-eb57-4ce0-a720-43c64e2b3445","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.967275Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:37e27045d7e66d9e4e7356dc7eda488c3dd18240578da0e0bbfeaa44d3aa5dd0","observation_id":"657de9e1-c6dd-498f-9983-c9b061b92936","resolution":{"observed_at":"2026-08-05T19:01:41.251542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:40.941314Z","title":"role\": \"user","venue":null,"work_id":"df51cf78-5712-4999-b3ca-07e0091ebff6","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:25.055295Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8888399ce485916722bd947028b6b8bb6f984237863dbf3d67ecc3cddafa50c8","observation_id":"d493cb03-0b91-4a44-a5d0-7c045ba05ad5","resolution":{"observed_at":"2026-08-05T19:01:41.032813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:40.728414Z","title":"Identify and write down the words spoken in the preceding audio","venue":null,"work_id":"42f054e3-ebaf-4317-a062-11455dba908a","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:25.146172Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:bf67349b7e9fa7134995716d1f582886198d799b12684b08143143b78aa7ea86","observation_id":"066c914b-30eb-434d-a273-b3f133287e22","resolution":{"observed_at":"2026-08-05T19:01:40.831038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:40.541169Z","title":"role\": \"user","venue":null,"work_id":"c15368f4-d7f1-499d-9371-3f898c6a4a51","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:25.208175Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:70e786c4ffdab117c40ad34c708b9ced04d95e22f0fa4f9939267d9ed9bb4248","observation_id":"56d56ad6-ed4e-4375-8d26-32bc19de6274","resolution":{"observed_at":"2026-08-05T19:01:40.615378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T05:00:34.000889Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":56},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 3 inbound Pith citation observations for arXiv:2508.14130."}