Pith. sign in

Paper Citation Record · LEDGER

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition

As of 22 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2412.16904.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.16904 v1

Coverage vector

measured 37 of 37 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T06:05:02.400801Z

measured 38 of 38 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-09T13:02:30.423708Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-09T13:02:30.482021Z

Reference resolution

37 of 37 outbound references displayed

  • verified exact0
  • verified fuzzy28
  • unresolved9
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ffc219a4-1d9d-433d-b3d5-a308b19bad9f · outbound

This paper cites Emotion neural transducer for fine-grained speech emotion recog- nition,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Emotion neural transducer for fine-grained speech emotion recog- nition,

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:03.052648Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.220581Z digest=sha256:823a0300f4f6e6a1040b8bddc5e0b7fee361cb75c00821d5573e7c8346c45a41

Observation d0ed6db6-bb36-4ae1-95da-1637ff1ee4a3 · outbound

This paper cites Dwformer: Dynamic window transformer for speech emotion recognition,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Dwformer: Dynamic window transformer for speech emotion recognition,

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:03.035193Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.227454Z digest=sha256:e14382bd1bf44bffe6006fcde2b81a7d27916bc1656e15264a9df2943a4dadf8

Observation c5f4eae9-6b9c-4ebc-bbb7-cbcc85d85087 · outbound

This paper cites Dst: Deformable speech transformer for emotion recognition,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Dst: Deformable speech transformer for emotion recognition,

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:03.013534Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.232046Z digest=sha256:c333502d58d7846275207893099acca68c6a6e4ea388a2069534cbf48e60f72e

Observation b7d27a64-c95a-4d0f-a528-a53856c91a82 · outbound

This paper cites Speechformer++: A hierarchical efficient framework for paralinguistic speech processing,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Speechformer++: A hierarchical efficient framework for paralinguistic speech processing,

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.990418Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.237753Z digest=sha256:246b67b7eb35d005ef97cf66a81fd4ebb6790b24d4dd4c5141961b38a5a6f479

Observation 6652a36c-6654-497f-9add-745d5212cf99 · outbound

This paper cites Audio-visual segmentation with semantics,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Audio-visual segmentation with semantics,

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.972061Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.243932Z digest=sha256:9f8162ddd7693aea4284798a3466374211fa465a05e96e393950b18349fc114e

Observation 85a554be-e995-4e86-b556-f7ce22bd2627 · outbound

This paper cites Prototype Learning for Micro-gesture Classification.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Prototype Learning for Micro-gesture Classification

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.248844Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.248844Z digest=sha256:1a43df29e97c234118a124334df0cd4dd9678c688f9c147d0c76c4ea3162904d

Observation c8e25e53-ad64-43e8-ac8b-d2344ec02699 · outbound

This paper cites Data augmentation for human behavior analysis in multi-person conversa- tions,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Data augmentation for human behavior analysis in multi-person conversa- tions,

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.954013Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.256070Z digest=sha256:ef30fe695fc25629d79940345693475d0c80e4dca57519e1c0da159578c55cd7

Observation a3e56950-e7cc-4896-84e2-f034a8d47ce7 · outbound

This paper cites Patch-level Sounding Object Tracking for Audio-Visual Question Answering.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Patch-level Sounding Object Tracking for Audio-Visual Question Answering

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.260879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.260879Z digest=sha256:1ddb1af4f30893248de87dbfe7ed35b66e04619dbb69900d6875aefe9a34f564

Observation 3c34c73b-b367-4613-b0a3-3c4d841031d7 · outbound

This paper cites Cluster-phys: Facial clues clustering towards efficient remote physiological measure- ment,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Cluster-phys: Facial clues clustering towards efficient remote physiological measure- ment,

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.937145Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.266268Z digest=sha256:23b75c77de23649d769c2323d441d2c5cbf4b66f4b110f170ea24dd77603bbc0

Observation b282cc2c-19c8-4deb-97cd-99815dfa91a5 · outbound

This paper cites Speech emotion recognition with co-attention based multi- level acoustic information,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Speech emotion recognition with co-attention based multi- level acoustic information,

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.919402Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.272417Z digest=sha256:843ab63c7e755df7174752817755d92d8b6bccbad185e3736a60934057020fe9

Observation 1a0927a9-6d01-43b0-b899-c3977fc14b15 · outbound

This paper cites Wavlm: Large-scale self-supervised pre-training for full stack speech processing,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Wavlm: Large-scale self-supervised pre-training for full stack speech processing,

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.276991Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.276991Z digest=sha256:bf6f0d0efd42be1a288fc23db5cc68e0eef48f875a73a8d6eb9d332321e07fb8

Observation a5dbde79-197f-496a-a4b2-e058eaa81e60 · outbound

This paper cites Graph- based multimodal sequential embedding for sign language translation,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Graph- based multimodal sequential embedding for sign language translation,

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.282597Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.282597Z digest=sha256:42f50950bd1661d4b47ba089103295145c574f96e6aebc41fc316be8996dbaac

Observation 2c784a95-6273-4fa1-b58c-7e21300a76bd · outbound

This paper cites Gloss-driven conditional diffusion models for sign language produc- tion,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Gloss-driven conditional diffusion models for sign language produc- tion,

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.881637Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.287496Z digest=sha256:faeb91b50df61cf19b3adaa44c32ebdaff078a5519f1ff765bd8c7bdf3c483e3

Observation b0593542-c58c-44a0-9456-e94402f46ee4 · outbound

This paper cites SpeechFormer: A Hierarchical Efficient Framework Incorporating the Characteristics of Speech.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition SpeechFormer: A Hierarchical Efficient Framework Incorporating the Characteristics of Speech

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.292886Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.292886Z digest=sha256:0daf2fb345a3ee87c03cff992cfd18fc9af2ad4a35541a67e2b81316ad48d023

Observation bd58bcc4-d65e-4feb-a5df-eda1cdee5028 · outbound

This paper cites Mingling or misalignment? temporal shift for speech emotion recognition with pre-trained repre- sentations,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Mingling or misalignment? temporal shift for speech emotion recognition with pre-trained repre- sentations,

Reference 15

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.866055Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.298612Z digest=sha256:389920a0580a9fe2f311578f6f6068a8edca830d2e9312e99a62f87e607a145c

Observation a43cacc2-1923-4c9e-80e9-ded48db46990 · outbound

This paper cites Adaptive dynamic filtering network for image denoising,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Adaptive dynamic filtering network for image denoising,

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.849595Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.303287Z digest=sha256:334bd7d9db24cbcd618fc9e75e85279062a01ba3283b970ea89bc3d70ec44944

Observation 7452d28b-54f3-417f-8893-e255d4ab3707 · outbound

This paper cites Mutual information-driven triple interaction network for efficient image dehaz- ing,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Mutual information-driven triple interaction network for efficient image dehaz- ing,

Reference 17

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.832490Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.307889Z digest=sha256:9111ae18707f0e1f98fc9c964de7ac0c6ebd6de05520910678a87276ce08c3c1

Observation 8f9b3941-6aa7-41eb-9467-28555ccba2d5 · outbound

This paper cites Deraincyclegan: Rain attentive cyclegan for single image deraining and rainmaking,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Deraincyclegan: Rain attentive cyclegan for single image deraining and rainmaking,

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.817164Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.312621Z digest=sha256:bcb75555ec7d872877f6b611a2ee38c179355a1c3f88475f423191f0e6be21f9

Observation 65fa8c31-b4dc-49d0-af11-eaa0b4dc8bc3 · outbound

This paper cites Low-light wheat image enhancement using an explicit inter-channel sparse transformer,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Low-light wheat image enhancement using an explicit inter-channel sparse transformer,

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.800343Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.317384Z digest=sha256:440bff814729ee856b22d25e2e60062ad61da6410d6b6447e09f41b545eab18b

Observation e36a06cb-6fa9-4cf6-9868-45b947677d0f · outbound

This paper cites Iemocap: Interactive emotional dyadic motion capture database,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Iemocap: Interactive emotional dyadic motion capture database,

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.780233Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.321965Z digest=sha256:7ea045ca4ef45f797902351f14435000845a1c8808e86ac935ad84b0d3070567

Observation 76ff1be0-5477-4d98-973c-991b40c11bd2 · outbound

This paper cites Spice: Self-supervised pitch estimation,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Spice: Self-supervised pitch estimation,

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.756370Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.326393Z digest=sha256:0252dbb7d1a699adf1ac7f2a75714cfb7cc98f8686a7cb77dad2ffff69a2e238

Observation 621f5f6e-15f2-4f0f-96e3-e2756a6626d6 · outbound

This paper cites Mamba: Linear-Time Sequence Modeling with Selective State Spaces.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Mamba: Linear-Time Sequence Modeling with Selective State Spaces

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.331559Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.331559Z digest=sha256:aa7f8e13c579531ef4e5511fb0c65763c528ff98470a4c56377569575adb5947

Observation e4d573b6-2565-4154-9c74-c8ff441e5da7 · outbound

This paper cites Transformers are SSMs: Generalized models and efficient algorithms through structured state space duality,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Transformers are SSMs: Generalized models and efficient algorithms through structured state space duality,

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.740883Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.336398Z digest=sha256:b3f7f683751fc05ca1dfa15d2c6648d1fe4c4acb90fcd0d958fd9a4f2330c7bb

Observation 3f31342c-bc80-4344-b3f6-2f3a5d107ea5 · outbound

This paper cites Micro-gesture Online Recognition using Learnable Query Points.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Micro-gesture Online Recognition using Learnable Query Points

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.341115Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.341115Z digest=sha256:98f9df4e5c64aab1d6eefae26f42f78aed611a4df9c8189c12c05ae68daa1359

Observation 7a49ebe5-07bc-4f3c-9b04-64824abf1840 · outbound

This paper cites Eulermormer: Robust eulerian motion magnification via dynamic filtering within transformer,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Eulermormer: Robust eulerian motion magnification via dynamic filtering within transformer,

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.724322Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.345727Z digest=sha256:9f8ea431094317fd8fe884dffc5c6221b7267f3726a309452bc6fc956c1550a4

Observation 2fa5fbcc-9170-4b57-a074-d55bad517fc8 · outbound

This paper cites Maskable retentive network for video moment retrieval,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Maskable retentive network for video moment retrieval,

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.708169Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.350365Z digest=sha256:bf99c48ae687cf968882f6d4f909939deba93bd8c429947ae4090c58dc04d64d

Observation 7b500cd5-2b8a-42ab-bdc8-801bcf545a3f · outbound

This paper cites Multi-scale temporal transformer for speech emotion recognition,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Multi-scale temporal transformer for speech emotion recognition,

Reference 27

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.692461Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.354468Z digest=sha256:252e7fb8ba7aaa6d7965fe5642f7b775d9d5e1b8ddebd56cb136d2bf01cd21a7

Observation ca389b92-95aa-4c8f-a8df-45a555f081e0 · outbound

This paper cites Global filter networks for image classification,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Global filter networks for image classification,

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.676505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.359082Z digest=sha256:33c2a4fe4ec47983e88fda5657530ce35b89a7cde7e0ef20fdb77bd560db2d91

Observation 719f89ad-39f6-496c-87d4-71b0897c04d9 · outbound

This paper cites Non-linear fre- quency warping using constant-q transformation for speech emotion recognition,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Non-linear fre- quency warping using constant-q transformation for speech emotion recognition,

Reference 29

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.660378Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.363358Z digest=sha256:8b1e72a4b6371c9d3ce0e515d40b4d210f8b58346ed4e3282fc0806d6734069b

Observation 6f197af4-d7fb-4c77-84b3-1a9809c45310 · outbound

This paper cites Speech emotion recognition based on optimized deep features of dual-channel complementary spectrogram,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Speech emotion recognition based on optimized deep features of dual-channel complementary spectrogram,

Reference 30

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.641178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.367870Z digest=sha256:427cacab76147008e03b429876ba019399d53b93e2a2336226ad4d43e69f8727

Observation a16f859b-a336-49f9-ad40-1f4e6f5a7c4b · outbound

This paper cites Proposal-free video grounding with contextual pyramid network,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Proposal-free video grounding with contextual pyramid network,

Reference 31

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.625541Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.372519Z digest=sha256:ead39ababdd6a503e9005d25c89bb5f6d338554f4b035b262d38c3dcb280e53a

Observation 54b900ad-dee5-466e-a915-c542370250f7 · outbound

This paper cites Fre- quency decoupling for motion magnification via multi-level isomorphic architecture,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Fre- quency decoupling for motion magnification via multi-level isomorphic architecture,

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.609952Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.376958Z digest=sha256:bbc6b702554101ea51af32a1bc1bcb50ce19636a29dbbaab64a29eb25c25fa89

Observation eaa6e69b-f96e-4a72-9d2d-a7c103eb1e6e · outbound

This paper cites Contrastive positive sample propagation along the audio-visual event line,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Contrastive positive sample propagation along the audio-visual event line,

Reference 33

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.593331Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.381670Z digest=sha256:361f8a65c304e6ad11c799ad3894afe1062ce0e7fc807a7ed164208000aa81c8

Observation 8762e5b9-eb68-4442-a8e8-b8212a59b4a1 · outbound

This paper cites MELD: A multimodal multi- party dataset for emotion recognition in conversations,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition MELD: A multimodal multi- party dataset for emotion recognition in conversations,

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.577246Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.386395Z digest=sha256:7e0bbe05e24401bc5fd8dcaf2d4ef4336c46365212540baa4b03b62b701f99d4

Observation 846183c0-cf65-4bd9-a583-17f75ffcb3ff · outbound

This paper cites wav2vec 2.0: A framework for self-supervised learning of speech representations,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition wav2vec 2.0: A framework for self-supervised learning of speech representations,

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.391431Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.391431Z digest=sha256:46526cb53ffd4a6732c1f66b1ec31821a30f8530c895a8b5d106859d3bac4d91

Observation 5002ea9f-3e72-45d5-8aa9-07765beaad85 · outbound

This paper cites Hubert: Self- supervised speech representation learning by masked prediction of hidden units,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Hubert: Self- supervised speech representation learning by masked prediction of hidden units,

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-11T06:05:02.396360Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T06:05:02.396360Z digest=sha256:20ce76dc3774372e7b69256968581a49c8f497b6b334f32fdfe45a6b2f3c6a5a

Observation 62e6eb86-cab9-48d8-8f7a-442bf4005f5f · outbound

This paper cites Robust speech recognition via large- scale weak supervision,.

Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition Robust speech recognition via large- scale weak supervision,

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T06:05:02.540934Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-11T06:05:02.400801Z digest=sha256:7cf50800912bd6db154ecad1ccb71820d920cb5dc8b170c22e10106f48906f6b

Pith citing papers

Observation 57f34549-ab8b-4030-b1b5-c6da317c987c · inbound

Exploiting Ensemble Learning for Cross-View Isolated Sign Language Recognition cites this paper.

Exploiting Ensemble Learning for Cross-View Isolated Sign Language Recognition Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition

Reference 42

Resolution
verified exact
local_arxiv, observed 2026-08-09T13:02:30.485666Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-08-09T13:02:30.423708Z digest=sha256:c6ec0c63804afe32eae9ab91de5471652d478aa0a61298a74aea1d4f76f15c07