{"as_of":"2026-08-08T06:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:52ca4ca16d6ffcfa38c3fe053662556d801ccbf143adc1ee72c8eebf92aa72cd","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:09:28.386700Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:09:23.482691Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-07T15:09:23.482691Z","title":"Despite substan- tial progress with deep learning, SER remains challenging due to the complexity of emotional expressions and the subjectivity of emotion perception [4]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.482691Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:02aed6f3249e2848689f89b9fc9001d2d64cf8ad46add11b7d5cf7b38b259576","observation_id":"ecaa7c47-827e-4368-8e54-5bfd8e07e92f","resolution":{"observed_at":"2026-08-07T15:09:23.482691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":"2505.16220","doi":"10.48550/arxiv.2505.16220","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta-perser: Few-shot listener personalized speech emotion recognition via meta-learning","venue":"ArXiv.org","work_id":"4999609f-4f60-454d-94a5-28d2fb6acf78","year":2025},"citing_paper":{"arxiv_id":"2605.03039","last_updated":"2026-05-04T18:06:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T18:06:17Z","title":"Mixed-Precision Information Bottlenecks for On-Device Trait-State Disentanglement in Bipolar Agitation Detection","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-08T19:11:30.638672Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2605.03039"},"observation_digest":"sha256:3d1e9595eb0aeea8749739a55215febfc6ebf5ae25597ca1e6b6ae3c3fb14e6b","observation_id":"683bc5d7-4f13-4b73-9ec5-28c656249489","resolution":{"observed_at":"2026-05-09T06:00:36.697028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":"2505.16220","doi":"10.48550/arxiv.2505.16220","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta-perser: Few-shot listener personalized speech emotion recognition via meta-learning","venue":"ArXiv.org","work_id":"4999609f-4f60-454d-94a5-28d2fb6acf78","year":2025},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":236,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:3233ee74f00e9392787d1dc84991a40ab2febce4868af186804a55254e4c3805","observation_id":"0a24cfb7-9a25-414f-8cfb-eac97702ed2c","resolution":{"observed_at":"2026-06-30T22:15:05.601545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16220/citation-record","integrity":"/paper/2505.16220/integrity","json":"/paper/2505.16220/citation-record.json","paper":"/paper/2505.16220"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-07T15:09:23.482691Z","title":"Despite substan- tial progress with deep learning, SER remains challenging due to the complexity of emotional expressions and the subjectivity of emotion perception [4]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.482691Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:02aed6f3249e2848689f89b9fc9001d2d64cf8ad46add11b7d5cf7b38b259576","observation_id":"ecaa7c47-827e-4368-8e54-5bfd8e07e92f","resolution":{"observed_at":"2026-08-07T15:09:23.482691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:36.171478Z","title":"Backbone SER Framework We employ a unified model architecture based on the s3prl toolkit [25]","venue":null,"work_id":"0d75b962-2ce5-46e7-98b9-5fe7793db145","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.544628Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:75719d1597741dd2c1ed1f7675eee0863baa6955114220f9f3d8215f23ab064e","observation_id":"a2a68036-7bbd-4473-821a-d7598f049aea","resolution":{"observed_at":"2026-08-07T15:09:36.225641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:36.015051Z","title":"other.” We exclude the “other","venue":null,"work_id":"4153f3e9-396e-446d-8b2b-f369ef832f5a","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.654968Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:58cfbf156980189bcdcc48216bf6083113d1cdfdacbda1dd3b95f79dcaa0575c","observation_id":"7a2ab609-3a2e-4913-bfc2-a17f326fbb62","resolution":{"observed_at":"2026-08-07T15:09:36.082426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.845433Z","title":"Proposed Meta-PerSER Table 1 demonstrates that Meta-PerSER consistently outper- forms all baseline methods across both Seen and Unseen Data scenarios and across all upstream models","venue":null,"work_id":"7631fbc4-2b40-4a3a-8317-36fe2bf6814f","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.773414Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:32a83279f3e090a3714ece96f687e743e4acef2f776b88423a1f6eb8453888a3","observation_id":"a2d022cc-adec-47b1-9025-17b664acc572","resolution":{"observed_at":"2026-08-07T15:09:35.934863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.665759Z","title":null,"venue":null,"work_id":"992cba9b-3abf-41ee-a12b-9c3c4b68717d","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.940640Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:8e55c40f5b60f78019e3ca57da6c8b6f2dd38c606674970d421e251851d3e69e","observation_id":"764b443b-6373-4165-95d3-e61cf8a04097","resolution":{"observed_at":"2026-08-07T15:09:35.732571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.507545Z","title":"Meta-PerSER integrates a pre-trained self-supervised backbone with Combined-Set Meta- Training, Derivative Annealing, and per-layer adaptive learning rates","venue":null,"work_id":"c7e9c979-50de-42a5-bf94-3d0898126e4e","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.060331Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:46f61adc83a5f978e668b5801f4274a4c06f453770508caa5378dc1396887016","observation_id":"99841a1e-c773-4ab1-8d11-0581f2d683cb","resolution":{"observed_at":"2026-08-07T15:09:35.580645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.315261Z","title":"Speech emotion recognition combining acoustic features and linguistic information in a hy- brid support vector machine-belief network architecture,","venue":null,"work_id":"182e88ce-88b8-4d57-b0ae-4f410e800252","year":2004},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.212370Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:9d69a976c08750a042e13881531c3d178f427953a4b94303b590dec6dec59d62","observation_id":"09044711-7e64-47fb-a00c-7ce5c7350f2b","resolution":{"observed_at":"2026-08-07T15:09:35.416286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.133454Z","title":"Speech Emotion Recognition Using Deep Learn- ing Techniques: A Review,","venue":null,"work_id":"49953b1a-104c-4c50-bbf0-cdfb200eaf94","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.372886Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:ebb6d5dc4bc38e9dadb12ed1e9fedee2f5f807240a8411ae3fb139e631692c53","observation_id":"f7121961-ccf2-4346-a129-e63f11d6825f","resolution":{"observed_at":"2026-08-07T15:09:35.223662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.935572Z","title":"Speech Emotion Recognition with Fusion of Acoustic- and Linguistic-Feature- Based Decisions,","venue":null,"work_id":"a0d5eb50-3697-4045-b504-4ce37975cac9","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.504122Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:e41b4a9eaba3446ab531ba714ff970980015c2430e2a217a35b506c876df534b","observation_id":"a15afbb7-abec-4c16-b06a-e9961507c104","resolution":{"observed_at":"2026-08-07T15:09:35.029795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.796123Z","title":"EMO-Codec: An In-Depth Look at Emotion Preservation Capacity of Legacy and Neural Codec Models with Subjective and Objective Evaluations,","venue":null,"work_id":"50c4cd70-7aa8-43a7-9ebd-fe56fc09c1d5","year":2024},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.618688Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:8e2330783a1c95b75eb974e1b72cbffd7e25cd7273ab56fd4a96600082d4a34d","observation_id":"c7ab34d7-b9eb-49a3-86cb-c8ad2a1785d6","resolution":{"observed_at":"2026-08-07T15:09:34.858958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.633106Z","title":"Interpreting ambiguous emotional expressions,","venue":null,"work_id":"2a11a159-c7d2-4e3f-b457-680d82c5807f","year":2009},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.761531Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:3dce1f728c38d3960d204236aa9454d38436d31293b8af4ddefa78c5b70952a1","observation_id":"7dc1b3bc-e465-42cf-a8d4-1385527c3c73","resolution":{"observed_at":"2026-08-07T15:09:34.699354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.00360","last_updated":"2019-09-01T09:05:58Z","snapshot_observed_at":"2026-07-06T08:18:13.532149Z","submitted_at":"2019-09-01T09:05:58Z","title":"The Ambiguous World of Emotion Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.00360","snapshot_observed_at":"2026-08-07T15:09:24.902229Z","title":"The Ambiguous World of Emotion Representation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.902229Z"},"links":{"cited_paper":"/paper/1909.00360","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:dd293b46fb112af333bd9174c22df1ba3f88fa8b06bd44e983391fb403497caa","observation_id":"6a84702f-8403-4d32-a0ea-222621795bcb","resolution":{"observed_at":"2026-08-07T15:09:24.902229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.448364Z","title":"Speaker Attentive Speech Emotion Recognition,","venue":null,"work_id":"60804680-e690-4bb6-918d-cf58c0a03c18","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.006797Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:ee24b0cb6f8a841e87710fe01e2948e0aedc089d60bdc4afee5b73e5bf9fdee5","observation_id":"47a10a85-eb28-4209-b7fc-ff148de5fd7c","resolution":{"observed_at":"2026-08-07T15:09:34.545899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.291214Z","title":"Personalized Adapta- tion with Pre-trained Speech Encoders for Continuous Emotion Recognition,","venue":null,"work_id":"72167d6f-76d0-41a3-a518-cc7e03da407f","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.117728Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:c79b0f45d6b5d94c6004cb152708062acc63832b6cdb2a9888b7946fb4c13a06","observation_id":"eeac684d-bbe6-4ffd-90fa-b59e9034574b","resolution":{"observed_at":"2026-08-07T15:09:34.348824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.160544Z","title":"The “Problem","venue":null,"work_id":"b3b1be8a-888e-4a1a-9ada-e099c7036ceb","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.239183Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:73a2c56585382d5bd7801a55a58900ce7b3fa1aa9a65de25aa1aeafb7795f72b","observation_id":"612d0aa4-429b-45f9-8201-82504ff89a89","resolution":{"observed_at":"2026-08-07T15:09:34.214333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.939486Z","title":"DICES Dataset: Diversity in Conversational AI Evaluation for Safety,","venue":null,"work_id":"f60edca2-7031-4b74-ad82-2083aa0f0f74","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.382377Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:ca9900c5b8fc3a917ada5ae3393c066c4d663c47f5267a32557687a1631a7073","observation_id":"37054a00-36a1-4ebf-bfc7-320c2cf313d6","resolution":{"observed_at":"2026-08-07T15:09:34.054503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.804125Z","title":"On Re- leasing Annotator-Level Labels and Information in Datasets,","venue":null,"work_id":"e40c16d3-47c4-4d04-8a68-1edc1c437f31","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.514058Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:99ad038a5ac59740b1ed961497ed3611c9f835a483f3cdfa0adc03422a45003c","observation_id":"05c512d8-b149-4ba7-802b-da4e402aa0f4","resolution":{"observed_at":"2026-08-07T15:09:33.857690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.622016Z","title":"Open-Emotion: A Reproducible EMO-Superb For Speech Emotion Recognition Systems,","venue":null,"work_id":"49fd9236-1c10-4d31-9b1f-ad514783c04e","year":2024},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.654630Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:9a2958e505f98fdfcb77a01a837642816ffcc2f360f04b43ae698d0c4a302cfa","observation_id":"33ae503b-aeb8-4a90-be21-ca083732fc4f","resolution":{"observed_at":"2026-08-07T15:09:33.708913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.506042Z","title":"Every Rating Matters: Joint Learn- ing of Subjective Labels and Individual Annotators for Speech Emotion Classification,","venue":null,"work_id":"fe3a7327-cd17-4990-8cbd-e5ae54d20f8c","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.792885Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:d151ed6c7e7a7ad966d8977662d4d0426cde66e0494f1d7ff9f8ed209702ab59","observation_id":"ee086334-d68c-4754-b5e3-508455a77c9d","resolution":{"observed_at":"2026-08-07T15:09:33.560933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.343850Z","title":"Dealing with Dis- agreements: Looking Beyond the Majority V ote in Subjective Annotations,","venue":null,"work_id":"bd87957b-2d66-42a6-af32-5627a43bf165","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.914974Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:ff1f5f9160e6d3f2932738a18f3f73d9619ffac1e1744bbf945e7e8bc704156f","observation_id":"edd9bd00-aae3-4b9a-ac2b-37425e7b7116","resolution":{"observed_at":"2026-08-07T15:09:33.439858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.053316Z","title":"Meta- Learning in Neural Networks: A Survey,","venue":null,"work_id":"f4eed59a-c930-4672-b170-38a562db967d","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.017141Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:dc44446d17207aa3dd39ddfb4a4f5dcc387372022ec9443841c59deb91b9c67e","observation_id":"d89b476b-f03b-4402-bae4-199196b66a55","resolution":{"observed_at":"2026-08-07T15:09:33.160134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:26.124390Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.124390Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:7cdaa515719ccc388574d9dbb5dbbe9e94ae81069bf70aeb76cf04a4f35716fe","observation_id":"1075fe1d-4524-4132-bb51-d908ee6451c8","resolution":{"observed_at":"2026-08-07T15:09:26.124390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:32.701207Z","title":"Optimization as a Model for Few- Shot Learning,","venue":null,"work_id":"a0467f25-4f3f-467e-8a4d-b5ca5028b6e4","year":2017},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.229399Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:4114d73f19e6121ca2266fb701e2db27857d4920e17114b973908b89ee1f509c","observation_id":"29b61794-18d6-4812-930e-10103b51ee56","resolution":{"observed_at":"2026-08-07T15:09:32.862748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:32.414867Z","title":"Meta-Learning for Speech Emotion Recognition Considering Ambiguity of Emotion Labels,","venue":null,"work_id":"acd00d40-3a0a-4bc7-9877-84f4b5f32cb5","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.349187Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:a8b9401ceb213230d39edd9aad866ff833eed9af3310ed81871b1989c9fb9df3","observation_id":"c5e40ac8-04bb-4e51-b545-cd0961ed4f06","resolution":{"observed_at":"2026-08-07T15:09:32.583112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:32.146622Z","title":"Meta- Learning for Low-Resource Speech Emotion Recognition,","venue":null,"work_id":"aabdcd23-fb4b-4a19-a39e-12d324ef633e","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.473567Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:0a20d93221602ef0790b94d12014a5432434984e4d971ac03abe3480d0bde5b1","observation_id":"cbc67106-18e7-49ba-903b-e00bafc7d770","resolution":{"observed_at":"2026-08-07T15:09:32.266809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:31.847571Z","title":"Dealing with Dis- agreements: Looking Beyond the Majority V ote in Subjective Annotations,","venue":null,"work_id":"e51ea970-8c0a-4368-a0f5-ebf3b5de0b4a","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.610321Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:19b45c4c4defd870742aa22920063879d585bc21c214b483a88c45ede0534ff2","observation_id":"8baf4a67-9bf7-4dd7-9667-7ca72a788dfa","resolution":{"observed_at":"2026-08-07T15:09:32.009550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:31.581817Z","title":"Speech emotion recognition based on meta-transfer learning with domain adaption,","venue":null,"work_id":"e4f0b523-6c23-4d88-9edd-6e8ead58d5c5","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.735695Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:737043f4add3ee45f9c0bdd546c9deb7b64d1c439d403c4b5a05a506d8fcf6a6","observation_id":"31b04a2c-4be4-4134-911f-89e228f0297d","resolution":{"observed_at":"2026-08-07T15:09:31.730538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:31.280475Z","title":"On efficacy of Meta-Learning for Domain Generalization in Speech Emotion Recognition,","venue":null,"work_id":"5a5a68f3-9586-4c8f-9df2-523507c55ac4","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.875962Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:5471837d3ab0ff75beb15439e28525200c57bd17309681dc2ac74b1de964d671","observation_id":"8a12fb9a-39c1-45ec-be76-cf8199f95d97","resolution":{"observed_at":"2026-08-07T15:09:31.444958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.997728Z","title":"Learning to Recognize Per-Rater’s Emotion Perception Using Co-Rater Training Strategy with Soft and Hard Labels,","venue":null,"work_id":"a0a89ce2-fd87-4bf9-a8e8-095c490b958d","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.997422Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:e58edfd83bfa3269cf60d3f389df7db1b41d3375402f7c65b7a3c9ae502813f4","observation_id":"49c444e8-b95b-426a-966e-f3b71ef5d1b8","resolution":{"observed_at":"2026-08-07T15:09:31.115676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.711580Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":"290ad510-d58a-4b0b-9c64-5fd931cb6e5f","year":2008},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.127918Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:588fc3931958a8cb9e0240913b703042117f0dbcef8c55607a65a8d861147c0e","observation_id":"37ea7bbf-d707-4138-9b1c-172197fc2ed9","resolution":{"observed_at":"2026-08-07T15:09:30.863409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:27.305920Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.305920Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:be30bfb0115b000da2a5c7ad6eea416ebe1002c5d4ce20552236572902209221","observation_id":"a76636bf-08d4-452d-bba5-e405d48764a8","resolution":{"observed_at":"2026-08-07T15:09:27.305920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.400602Z","title":"wav2vec 2.0: a framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":"c7ac6379-492b-404b-bad5-3ced97e6e8a2","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.463252Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:b8b3fc951b4d9950a18938e24149e573efa230289d613bb40b8ae502e584226a","observation_id":"c30a1408-254a-448e-9e31-0e405344efd9","resolution":{"observed_at":"2026-08-07T15:09:30.567152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.088574Z","title":"HuBERT: Self-Supervised Speech Rep- resentation Learning by Masked Prediction of Hidden Units,","venue":null,"work_id":"9036bd4e-7f7c-4a6a-9878-a1ed60355c8e","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.585621Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:81817de26b537f3c61f6fdc4c6d4b10c4d5e7e8c36404d850d51f73fa740fc02","observation_id":"a5fa9ae3-f087-42f2-8fa1-ee772ad1990a","resolution":{"observed_at":"2026-08-07T15:09:30.190577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:29.720568Z","title":"WavLM: Large-Scale Self-Supervised Pre- Training for Full Stack Speech Processing,","venue":null,"work_id":"3edd9371-e684-427d-a5d5-347123148d53","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.717558Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:2209cf1b04927a4a6d9a2396a14c0d25d10e6707ab28bef6dfaf85c57fa8484a","observation_id":"55c61b94-62fe-4784-83cb-e3a0e370e95e","resolution":{"observed_at":"2026-08-07T15:09:29.894914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:29.459705Z","title":"Class- Balanced Loss Based on Effective Number of Samples,","venue":null,"work_id":"189fe270-a198-419b-9ed7-33950006c97b","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.832798Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:7e988ef75bf372d50e0ccac844d1bb5c31ff24fcbab8b5f5950751d8aada75cf","observation_id":"0e833bb9-e452-4fad-aecc-31b3161aa58f","resolution":{"observed_at":"2026-08-07T15:09:29.591860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:29.101525Z","title":"How to train your MAML,","venue":null,"work_id":"cd248b52-8640-4685-b02e-7dd89f5fc9fb","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.928192Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:5713061b83ced150d74225bdaea56831152e176e4329deb168814409f27c6a8f","observation_id":"9c949f02-5630-40a6-b272-eb779f2931c6","resolution":{"observed_at":"2026-08-07T15:09:29.267113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:28.848588Z","title":"Few-Shot Acoustic Event Detection Via Meta Learn- ing,","venue":null,"work_id":"0aa9111c-fe00-45d7-a41a-35a3ff97e77e","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:28.067844Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:cb50ab03d4e32fd39fdd96a1cf06a6e2b67dfb8288388f1e786ad3ac7182f126","observation_id":"ff40ef00-877f-4d1d-a941-3cccf3aaa559","resolution":{"observed_at":"2026-08-07T15:09:28.971431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03347","last_updated":"2021-02-08T18:20:55Z","snapshot_observed_at":"2026-08-04T23:43:09.378056Z","submitted_at":"2019-11-08T16:13:54Z","title":"Macro F1 and Macro F1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03347","snapshot_observed_at":"2026-08-07T15:09:28.255290Z","title":"Macro f1 and macro f1,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:28.255290Z"},"links":{"cited_paper":"/paper/1911.03347","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:2ca8774ffddd4dad95be7749082113c87e1bc0d6a196e3691c07f85cb7361268","observation_id":"e3d2a4c4-9b03-44b0-abf8-b2b9e54f1dee","resolution":{"observed_at":"2026-08-07T15:09:28.255290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:28.547945Z","title":"Emo- bias: A large scale evaluation of social bias on speech emotion recognition,","venue":null,"work_id":"303672f2-6e96-4ed0-9e53-91b223ff3b73","year":2024},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:28.386700Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:6f44779b2c0094014407657254ccc71529b7f8999f0f64b256441dabd13e9e42","observation_id":"a57f0bac-014d-4f3b-8276-070188614498","resolution":{"observed_at":"2026-08-07T15:09:28.665534Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T15:02:59.208526Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 3 inbound Pith citation observations for arXiv:2505.16220."}