{"as_of":"2026-08-10T07:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7fbc16474de0ff8e2cf96d37ef275c8adbe914100aa2f4d7918467588897d6ed","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:34:40.081413Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:34:39.943231Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:08:59.274757Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18484","snapshot_observed_at":"2026-08-07T14:34:39.943231Z","title":"delivery skills","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.943231Z"},"links":{"cited_paper":"/paper/2505.18484","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:3b189f1300a88885cd912f41c85d00b8751613fb7ac7d8fec39c0120fd28b8d9","observation_id":"2f4dce82-3a37-479b-a928-ee231547cc4d","resolution":{"observed_at":"2026-08-07T14:34:39.943231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2505.18484","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18484","snapshot_observed_at":"2026-08-06T19:08:59.274757Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","venue":"cs.SD","work_id":"dc33261b-365e-48c9-a817-b65106977d40","year":2025},"citing_paper":{"arxiv_id":"2507.08031","last_updated":"2025-07-14T01:10:56Z","snapshot_observed_at":"2026-08-09T15:18:04.025388Z","submitted_at":"2025-07-09T02:40:02Z","title":"Beyond Scale: Small Language Models are Comparable to GPT-4 in Mental Health Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:08:56.780027Z"},"links":{"cited_paper":"/paper/2505.18484","citing_paper":"/paper/2507.08031"},"observation_digest":"sha256:bac022207ed5b9894e0f523ada7757c4e25b2adac2ea09098466b78b1763b74f","observation_id":"d0cf2ed4-002f-405d-88a0-61037b8c5166","resolution":{"observed_at":"2026-08-06T19:08:59.364163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18484/citation-record","integrity":"/paper/2505.18484/integrity","json":"/paper/2505.18484/citation-record.json","paper":"/paper/2505.18484"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.514252Z","title":"articulate","venue":null,"work_id":"e4240867-2399-4086-b23b-82579296ddbf","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.937922Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:eaf525210f52a08dce9394aa7975e6a7e819b631f53b983f72c147501fb5e9bf","observation_id":"ceb724ee-326e-485f-9289-1f38c0881b09","resolution":{"observed_at":"2026-08-07T14:34:40.518009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18484","snapshot_observed_at":"2026-08-07T14:34:39.943231Z","title":"delivery skills","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.943231Z"},"links":{"cited_paper":"/paper/2505.18484","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:3b189f1300a88885cd912f41c85d00b8751613fb7ac7d8fec39c0120fd28b8d9","observation_id":"2f4dce82-3a37-479b-a928-ee231547cc4d","resolution":{"observed_at":"2026-08-07T14:34:39.943231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.502477Z","title":"ang”, followed by “er","venue":null,"work_id":"67512403-0832-4ad9-a7d2-f09f817a18d0","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.947336Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:d461d8837ab0f8e5ffd81e81c60bfe67a64c5ae61beb4df4884957f66ea4efd6","observation_id":"f9ad77d0-9c4e-4490-a303-d8ca2a222d84","resolution":{"observed_at":"2026-08-07T14:34:40.506799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.489823Z","title":null,"venue":null,"work_id":"7e3d4b5b-817d-48a8-8a71-b3b49cd00458","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.952181Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:a6ff66327683b4acf7d5c8114f7db389a302c44cbb38bfe507bf8ab499307cb6","observation_id":"9727d8f2-1ac1-45b9-aac6-ef92648a0854","resolution":{"observed_at":"2026-08-07T14:34:40.493956Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.478669Z","title":"iness 6.46 2.44 0.43 0.08 0.7","venue":null,"work_id":"55bc930c-68e0-4906-a7c2-3f07c5b1c5bd","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.956621Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:b4ed921ef7b8252078a4f76580c27c206d27a34982a267c8fad6a6d080399f99","observation_id":"162b2ddc-0356-4d85-9d8b-be6b00a467fe","resolution":{"observed_at":"2026-08-07T14:34:40.482747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.467094Z","title":null,"venue":null,"work_id":"1323fabf-13b4-4f99-9b34-a72eb25c1080","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.960467Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:00de261a0f1ec51b5a03f4898abc362d06d5ded2669e6d3ff4018b2732b309cf","observation_id":"d58368ca-9bf7-48c6-831e-4752d2b39148","resolution":{"observed_at":"2026-08-07T14:34:40.470922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.453336Z","title":"Performance on ambiguous SER Table 1 presents the performance of ambiguous SER using ambiguity-based metrics, evaluating the entire distribution pre- dictions","venue":null,"work_id":"d685970d-a10f-4c49-a640-83d738d86788","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.964972Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:908f9fadf0050546fd61864201112eb86544a8c01c6348ee7c77a94b2d89a74a","observation_id":"e60dbd52-17ea-4ab7-bfb4-7a0dc9e926f7","resolution":{"observed_at":"2026-08-07T14:34:40.458230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.441127Z","title":null,"venue":null,"work_id":"79b71f85-f81a-4893-b0a4-fa54721f437b","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.969631Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:a6345b9aec8560ad7df900e8302532567540a3f45178adc470158aa29ca4e9bc","observation_id":"b77a4294-41ae-47f3-86d6-85906e4a459e","resolution":{"observed_at":"2026-08-07T14:34:40.445105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.428860Z","title":"Speech emotion recognition using su- pervised deep recurrent system for mental health monitoring,","venue":null,"work_id":"0148479f-4d73-4434-91bd-25da1a509c6e","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.973471Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:40c41b16f2b2939336403d0af2a27f871f3f54e015054aa4af9b6dd709410627","observation_id":"b10068ab-5200-40ff-8bd9-308d87c67a97","resolution":{"observed_at":"2026-08-07T14:34:40.433202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.416654Z","title":"Speech emotion recogni- tion approaches in human computer interaction,","venue":null,"work_id":"78114d07-17f0-4fce-8247-e3642286bfdd","year":2013},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.977398Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:f4775c99a67f028d63df2774297a744313b460126bfce85e3121bb2d82782b73","observation_id":"b7ac49fc-b52c-4913-bb7e-d096c11a17c1","resolution":{"observed_at":"2026-08-07T14:34:40.420540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.403402Z","title":"Beyond silent letters: Amplifying llms in emotion recognition with vocal nuances,","venue":null,"work_id":"782cc85b-f6bd-48fb-bc94-be653ed4b7ef","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.981924Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:8e4ef919bdecf7ae113eb6831fd5c2c17820560e3330eca8cb2b4dba74b96c3f","observation_id":"c615b57c-b495-4fec-9242-2070302efb02","resolution":{"observed_at":"2026-08-07T14:34:40.408252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.390629Z","title":"From text to emotion: Unveiling the emotion annotation capabilities of llms,","venue":null,"work_id":"eeab6731-0440-4310-89c9-b4d42d8ab33b","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.985505Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:48ab3c1aebaabac279a1f9f3a88f16ff7fe048a078edb5e85831fdaf03b05678","observation_id":"23a65b8c-d306-4f90-8c3b-d403cd64643e","resolution":{"observed_at":"2026-08-07T14:34:40.394965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:39.989281Z","title":"Foundation model assisted automatic speech emotion recognition: Transcribing, annotating, and aug- menting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.989281Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:4492a226c4a01b02334aa9f0fac38e2df5c2e88e0d096aa5458435613d248784","observation_id":"c83cbbf4-3fdb-4864-82e0-4d1782aebb1b","resolution":{"observed_at":"2026-08-07T14:34:39.989281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.371836Z","title":"Interpreting ambiguous emotional ex- pressions,","venue":null,"work_id":"2b853ae7-1c34-403f-a36c-9ffe6cad9cc9","year":2009},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.993193Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:19dc487e2acca12071b694f834b2a5324514499322c5564f53ddd1fadcfedfff","observation_id":"1e2be274-14c1-416b-b1c7-68aa6382ad07","resolution":{"observed_at":"2026-08-07T14:34:40.375569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.359805Z","title":"Emotion recog- nition systems must embrace ambiguity,","venue":null,"work_id":"d3bfff61-721b-4b4a-9b86-dbde38a45385","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.996641Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:f43a68b7056b94fbd0e5ca8f9c6280453a0f3fd9b69b2f77eb00a934c76c27f9","observation_id":"358189d0-c283-40e2-9a88-25e59c59a193","resolution":{"observed_at":"2026-08-07T14:34:40.364400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.349309Z","title":"An investi- gation of emotion prediction uncertainty using gaussian mixture regression","venue":null,"work_id":"fcd46292-3813-46f8-89cf-df08052d4228","year":2017},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.004953Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:c1737b11069461e6f9d3a5ccba0d872e5a16210d4e10c49c0d148e1912d32a26","observation_id":"ab774182-4eb0-4374-9649-ccb6f38d350e","resolution":{"observed_at":"2026-08-07T14:34:40.353131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.338747Z","title":"Dynamic multi-rater gaussian mixture regression incorporating temporal dependencies of emotion uncertainty using kalman filters,","venue":null,"work_id":"4c0e6ccd-b2a5-4220-9446-c9ddbabdd0fa","year":2018},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.009475Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:9486131ca8b79397b17aa718eda6a8b7793b739c4cfa5d8310150f82478c8794","observation_id":"1d2e9abb-0e53-4f32-83d5-a07143b690c8","resolution":{"observed_at":"2026-08-07T14:34:40.342621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.327028Z","title":"Child emotion recognition using probabilistic neural network with effective features,","venue":null,"work_id":"727eb8c0-a496-489f-a6e4-a3e23341c443","year":2020},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.013320Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:6c92a92d29fe3bdfa24413bb670195219bc302e332dd1a43313953c64e36c5ae","observation_id":"d4b221f7-2ff7-4b78-9e67-da65a10f6471","resolution":{"observed_at":"2026-08-07T14:34:40.331650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.315765Z","title":"Text emotion distribution learning via multi-task convolutional neural network","venue":null,"work_id":"614feb82-9515-449e-8a27-d16f2ff6d1ec","year":2018},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.016783Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:90b9def5baa80204330fd69333aedc45d1eab562de2a0b62ef5949663b650c6f","observation_id":"ecd59617-02d2-4387-9e8f-fb12fe70d5ea","resolution":{"observed_at":"2026-08-07T14:34:40.319847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.304464Z","title":"A novel se- quential monte carlo framework for predicting ambiguous emo- tion states,","venue":null,"work_id":"6d575f8b-53f2-4a62-9fec-f3c013ca9e1d","year":2022},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.021081Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:dba5ba5d4a8d6085ccb833386b40aee8551185c09c8ca891f1bf9ce54aba1fa4","observation_id":"a9f3acc7-d4ca-488d-b758-049ac6f5d76c","resolution":{"observed_at":"2026-08-07T14:34:40.308531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.291824Z","title":"Dual-constrained dynamical neural odes for ambiguity-aware continuous emotion prediction,","venue":null,"work_id":"746f453e-9295-4d13-90d0-e544934df48a","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.024819Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:dcfaae01e5aa3594e2a7a01dbfb44afe92d8b34d538f24015aa1a9950796c600","observation_id":"d8dc7226-bbcc-42b5-8242-7a675eee69d0","resolution":{"observed_at":"2026-08-07T14:34:40.295557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.278523Z","title":"Aer-llm: Ambiguity- aware emotion recognition leveraging large language models,","venue":null,"work_id":"b723428d-639a-49eb-a49b-da3105c88479","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.028315Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:d1fafba5336b5207bc577bd390f6aadf30ca1fe09529dc3a5fe8e1f34b860d63","observation_id":"57e4a674-5483-48d4-b072-1d6c043376be","resolution":{"observed_at":"2026-08-07T14:34:40.283330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.266763Z","title":"Robust speech emotion recognition using cnn+ lstm based on stochastic fractal search optimization algorithm,","venue":null,"work_id":"f6d57378-7283-4ec1-84a8-84db1e0bc9d7","year":2022},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.031852Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:6159da8708c7ffa34418169f315a13de400c85b0444e8eb292f7f2c50a634c52","observation_id":"51e3bc6a-8fd7-4950-af47-16fbda7e5653","resolution":{"observed_at":"2026-08-07T14:34:40.270970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.255347Z","title":"Speech emo- tion recognition based on multi-feature speed rate and lstm,","venue":null,"work_id":"8d26d4e6-c8c8-49fd-b011-c1dfd7299dfe","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.035605Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:56e160d19799a519d1ac877b5fdc20b33cf69b72fd6975140f2a2580acaf2cb7","observation_id":"90465bd4-be80-4e31-be34-38fa8b631607","resolution":{"observed_at":"2026-08-07T14:34:40.259543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.242852Z","title":"Multimodal speech emotion recognition based on large language model,","venue":null,"work_id":"64cbc8e6-345b-4662-a0c3-a0b79898e6d7","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.039132Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:714addd76494acabe6ecabe718e4939a47a3c2ed9c498ffa118a2da80c2fa059","observation_id":"9a7a54e8-28e0-4640-b64a-7c579543e0dc","resolution":{"observed_at":"2026-08-07T14:34:40.247295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.231264Z","title":"Mul- timodal emotion recognition using feature fusion: An llm-based approach,","venue":null,"work_id":"433b80ef-178b-481d-8f50-c1bbdfaec143","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.042461Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:08a9b30b5c5d0f255966cbfc455f6f8bdee06ea7175c7c29f71b7a309aa7f27d","observation_id":"6627bb96-7d3c-43db-b6d4-ca9c7245429d","resolution":{"observed_at":"2026-08-07T14:34:40.235094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.220370Z","title":"Interpreting ambiguous emotional expressions,","venue":null,"work_id":"4fa3b874-19cf-4d43-a379-29e183e6d98f","year":2009},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.045880Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:82a6427e673b4aa68ad50a951b9c0c8230f22d31872cb9d681c13076678265f4","observation_id":"bbc1c962-b208-4e6d-8b2a-cdb0ba1b87e9","resolution":{"observed_at":"2026-08-07T14:34:40.224117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.207984Z","title":"Multi-classifier interactive learning for ambiguous speech emotion recognition,","venue":null,"work_id":"36152fc7-ff89-4437-ad03-5a0293e7bd98","year":2022},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.050685Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:dafdaa8cf19ca9986b31bf557ae276c793f915d9e146c7f53f531568899cba01","observation_id":"014415cd-e538-4d50-b584-6a65ec44b510","resolution":{"observed_at":"2026-08-07T14:34:40.212314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12862","last_updated":"2024-02-20T09:53:38Z","snapshot_observed_at":"2026-07-06T17:32:44.565172Z","submitted_at":"2024-02-20T09:53:38Z","title":"Handling Ambiguity in Emotion: From Out-of-Domain Detection to Distribution Estimation","version":1},"cited_work":{"arxiv_id":"2402.12862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12862","snapshot_observed_at":"2026-08-07T14:34:40.123018Z","title":"Handling Ambiguity in Emotion: From Out-of-Domain Detection to Distribution Estimation","venue":"cs.CL","work_id":"38b7cfe5-9518-4333-9a63-e08df75f70c8","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.053991Z"},"links":{"cited_paper":"/paper/2402.12862","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:a7a5dc00d53150ba02dbc0eefba55bdccc78b5bdd6c7cf35d5e84cc1ce7665a7","observation_id":"4069a32d-fdf7-4177-b7e4-966abd6cb4e8","resolution":{"observed_at":"2026-08-07T14:34:40.129002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.196030Z","title":"Using gaussian processes with lstm neural networks to predict continuous-time, dimen- sional emotion in ambiguous speech,","venue":null,"work_id":"d2065ff8-d661-46da-a87c-de0d487bd387","year":2019},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.058137Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:e732acf49940366784c744168d34ae8762086808927920b29ad047fd5bddea7e","observation_id":"7c2dddc4-6849-42e4-99d4-3708d73e46af","resolution":{"observed_at":"2026-08-07T14:34:40.201003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.185376Z","title":"Emotionally numb or empathetic? evaluating how llms feel using emotionbench,","venue":null,"work_id":"c27f8991-f089-4771-bcb8-c2f72a93f26b","year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.061736Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:56ac478c1cad050600a3955270135d830333ae230ce2a1048acdcbb91972efa4","observation_id":"e7442c27-3216-407a-a91b-506acf1247cb","resolution":{"observed_at":"2026-08-07T14:34:40.188829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.065616Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.065616Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:b9bf42fbcc1e6614ec358b3ebaf45278259574595c738cea7689df5e23c484b0","observation_id":"b4898dd0-bc1f-466c-ab81-acd5b1a638c8","resolution":{"observed_at":"2026-08-07T14:34:40.065616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.069502Z","title":"Joint audio and speech understanding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.069502Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:ca0137ad6fa57ff460d8120c7f6cc0f5a28e3690a2c6b5f977b379100197bef3","observation_id":"9b01b4c5-364c-48d6-b95f-e89a1d3def48","resolution":{"observed_at":"2026-08-07T14:34:40.069502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.161200Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"7593957d-3133-4432-96a4-1b63f3c5ae1f","year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.073296Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:bef7ee01b1da0ecc7d34b612e16bad7074674f8ec86c364fbeb2905571fa0c26","observation_id":"319f9368-c3da-4c74-a19a-874b69a81e19","resolution":{"observed_at":"2026-08-07T14:34:40.165002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.149698Z","title":"Listen, think, and understand,","venue":null,"work_id":"fcd3aad6-0d1d-4101-aa60-57292e019cad","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.076975Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:6ad53e5e23864c45188727b28231bd789ee4e7898df51dcac4252c5750b26231","observation_id":"693fa584-bcd5-4a42-a964-5d1b8868bed6","resolution":{"observed_at":"2026-08-07T14:34:40.153392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12881","last_updated":"2024-08-05T12:13:39Z","snapshot_observed_at":"2026-07-06T16:22:21.746857Z","submitted_at":"2023-09-22T14:11:23Z","title":"Affect Recognition in Conversations Using Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12881","snapshot_observed_at":"2026-08-07T14:34:40.081413Z","title":"Af- fect recognition in conversations using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.081413Z"},"links":{"cited_paper":"/paper/2309.12881","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:84bb0f494d28bb953328725478f096b977cb4a6dd304a247c829672dcde73b1f","observation_id":"41b265b3-2616-44ec-888b-d2551d89d260","resolution":{"observed_at":"2026-08-07T14:34:40.081413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":7,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2505.18484."}