{"as_of":"2026-08-15T00:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:da080d523a55aa50279de3efd5f5eff05cf0e3b9785da522d31e699ae23dc421","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:54:15.373566Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:54:10.964316Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:54:15.537273Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2506.01138","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.01138","snapshot_observed_at":"2026-08-07T11:54:15.537273Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","venue":"eess.AS","work_id":"e607f062-8dba-451b-9afc-cbda7c112966","year":2025},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:10.964316Z"},"links":{"cited_paper":"/paper/2506.01138","citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:ec2def4105367e10697629d71572e635a1fecbdd97faf088213d8c08eabb4dd5","observation_id":"6411fc0c-ea98-4786-8c29-d1def009dd26","resolution":{"observed_at":"2026-08-07T11:54:15.600603Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01138/citation-record","integrity":"/paper/2506.01138/integrity","json":"/paper/2506.01138/citation-record.json","paper":"/paper/2506.01138"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2506.01138","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.01138","snapshot_observed_at":"2026-08-07T11:54:15.537273Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","venue":"eess.AS","work_id":"e607f062-8dba-451b-9afc-cbda7c112966","year":2025},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:10.964316Z"},"links":{"cited_paper":"/paper/2506.01138","citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:ec2def4105367e10697629d71572e635a1fecbdd97faf088213d8c08eabb4dd5","observation_id":"6411fc0c-ea98-4786-8c29-d1def009dd26","resolution":{"observed_at":"2026-08-07T11:54:15.600603Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:19.621983Z","title":null,"venue":null,"work_id":"230a3f40-6b25-4a71-a20d-a63c90e9225a","year":1920},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:11.074114Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:690b5020cbabc23421a53a12b4e236f5400d4e88ab14e00275eeb057e9491bc9","observation_id":"2f082fd6-5207-47a7-b301-e6ce456cf798","resolution":{"observed_at":"2026-08-07T11:54:19.711899Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:19.347503Z","title":"We make use of SVM, Fully Con- nected Network (FCN), and CNN as the downstreams modeling with individual PTMs","venue":null,"work_id":"ad645de9-b78a-4132-80a4-7eb23ee9b1ef","year":null},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:11.220150Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:78842d5fc592f34f8ff98d9152736641d41ae6d9a9737b5b644e05f87b1fd1a0","observation_id":"1bdebc26-34a8-4b1b-bf78-a54703ffb2c1","resolution":{"observed_at":"2026-08-07T11:54:19.499324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:19.106856Z","title":null,"venue":null,"work_id":"d645f392-ba63-48fc-9ae8-7fb0e0f85c98","year":null},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:11.347750Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:b8486ca655be863ecddb54d3d17c8d1596a42e49cc0243b4d61275face43dd67","observation_id":"6c5e307f-6886-408a-a2a9-2d6470b2e1c2","resolution":{"observed_at":"2026-08-07T11:54:19.234067Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:18.484783Z","title":"To this end, we propose, PARROT, a novel framework that synergizes PTMs via parallel branch fusion of Optimal Transport and Hadamard Product","venue":null,"work_id":"de6b8f7c-d49c-4307-9c03-e8119b0dd361","year":null},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:11.602243Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:8e77f2860d137ae9701defc79d718cee24029204b80345f1efd08b03238ac8da","observation_id":"387ea731-d33c-45c4-b767-a480d833ffe4","resolution":{"observed_at":"2026-08-07T11:54:18.648901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.591992Z","title":"Speech emotion recognition using deep 1d & 2d cnn lstm networks,","venue":null,"work_id":"f7ea81fe-31df-4829-9b81-445a3d1df020","year":2019},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.578614Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:3b3b5ec190c25e640c89d477c3660a1e5775f5065ab40a667cb864f2634f37f2","observation_id":"4d8c590b-e249-4be1-a63f-d0ea05280039","resolution":{"observed_at":"2026-08-07T11:54:17.755953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:11.748030Z","title":"Towards a small set of robust acoustic features for emotion recognition: Challenges,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:11.748030Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:5af777f20bfdb43816cc5e080f54e4804396a2244999252a1bdb67e5f76e53cd","observation_id":"d3256382-5183-4a7a-81b3-707780ff1690","resolution":{"observed_at":"2026-08-07T11:54:11.748030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:11.882029Z","title":"Is everything fine, grandma? acoustic and linguistic modeling for robust elderly speech emotion recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:11.882029Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:f730ad5115b2cd9d2771fe25388de8b5597355107c3e03a5ad09f7019314dc6c","observation_id":"da4bba01-3614-41ae-8af8-385fc7fe62e0","resolution":{"observed_at":"2026-08-07T11:54:11.882029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:18.259216Z","title":"Speaker dependent speech emotion recognition using mfcc and support vector machine,","venue":null,"work_id":"d1aafe1c-ad31-43ab-998a-f521e4ac2757","year":2016},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.070953Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:2ea9f8fb3ef392e14c0cc12bc9e96b65b5c862f331a2a5913b607005c2d41537","observation_id":"a0460432-25c4-4ce0-8364-53ee91e0490a","resolution":{"observed_at":"2026-08-07T11:54:18.330281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:18.100730Z","title":"V ocal- based emotion recognition using random forests and decision tree,","venue":null,"work_id":"3a8371b3-c21d-4b47-bc30-82227100b784","year":2017},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.262618Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:d05da7c2b7fbbf42243cea9814849f28c1b2a5ea6bff0d8d0de9f8d591fd4fbc","observation_id":"41c86549-847b-4870-81f6-0d52b5d1a285","resolution":{"observed_at":"2026-08-07T11:54:18.193058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.885420Z","title":"Deep learning techniques for speech emotion recognition, from databases to models,","venue":null,"work_id":"549021c8-be14-4afc-8847-264a9fafbf61","year":2021},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.457349Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:b41c896002692960341d1c36913b160d4287cc5c10075ad8e0129926d087b93c","observation_id":"cb049f32-41df-4e49-a977-635e9779c823","resolution":{"observed_at":"2026-08-07T11:54:17.997156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.391864Z","title":"Speech emotion recognition using self-supervised features,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.391864Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:ba8608b2c946af101345c8916305e15bb6ba16fba526e4a144b8eb0bbd691ef8","observation_id":"6b0848b5-b1b4-4f4c-adab-1dc11e37b20b","resolution":{"observed_at":"2026-08-07T11:54:13.391864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.312495Z","title":"Ensemble deep learning with hubert for speech emo- tion recognition,","venue":null,"work_id":"acea885e-88a8-471d-99a9-cf53a864127b","year":2023},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.726163Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:a65db83d7821f69306c24bcfb1529daf7746d76e4c4f920fa8f3638b30c328cc","observation_id":"6c4d7784-c9c1-42f8-970b-4a7948854114","resolution":{"observed_at":"2026-08-07T11:54:17.448916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:17.031789Z","title":"Evaluating self-supervised speech representations for speech emotion recognition,","venue":null,"work_id":"79eb9473-5fb7-4722-81bb-3a133181069b","year":2022},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:12.908027Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:c0d3f0d86f18a416903f842dc02c4d001166f4787e4ea25808735c9cc04584b2","observation_id":"f21013e1-0343-435d-9833-ee7596ec763d","resolution":{"observed_at":"2026-08-07T11:54:17.147735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:16.830946Z","title":"Ser evals: In-domain and out-of-domain benchmarking for speech emotion recognition,","venue":null,"work_id":"e01438aa-0cdf-4238-81c3-7649938dcca5","year":2024},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.055465Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:3da55c5833bec87c1f5f42714bfe16e049e6457d2e9edfe5ed7de856118e4251","observation_id":"a475b65f-8971-406a-9ec7-db1964c99ea7","resolution":{"observed_at":"2026-08-07T11:54:16.948743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:16.694781Z","title":"Are paralinguistic representations all that is needed for speech emotion recognition?","venue":null,"work_id":"af6a9d5e-3c30-4c03-87c9-e84353f2b38e","year":2024},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.133993Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:bc032aa87407345cda0f381681a4016856e4499a470a8751b9a80db8c80ce11c","observation_id":"66531ef0-2f06-4bfb-b05e-edd009f12da5","resolution":{"observed_at":"2026-08-07T11:54:16.761856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.246968Z","title":"Emotion recognition from speech using wav2vec 2.0 embeddings,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.246968Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:77045e0807e64bf5da3fc86145f0ffdecada630be0f52e883ceffa3964bc1554","observation_id":"c0203b5d-f1d8-4ff4-9b9d-0a6e7ab2ee1e","resolution":{"observed_at":"2026-08-07T11:54:13.246968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.946030Z","title":"Investi- gation of ensemble features of self-supervised pretrained models for automatic speech recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.946030Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:060cdb7245da94fe299ce8c793cb0f33c9f21eec765802fe701ebceb4333074f","observation_id":"c178cfa0-73bc-4006-b0b8-597b19bfd2da","resolution":{"observed_at":"2026-08-07T11:54:13.946030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:16.499229Z","title":"Audio mamba: Selective state spaces for self-supervised audio representations,","venue":null,"work_id":"bf9b71dd-2f57-4b66-9d6b-874cb284f35d","year":2024},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.503353Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:b5d3dff91617a77faf43ebb839ac45fed2eb655ebd5d57fb2fedaa8a34b7fa69","observation_id":"e9073fe4-bb6b-4ab7-89eb-750abc965a91","resolution":{"observed_at":"2026-08-07T11:54:16.605874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:16.271495Z","title":"Audio mamba: Bidirectional state space model for audio representation learning,","venue":null,"work_id":"4df235da-5f71-487f-ab22-7c9dcc5acd85","year":2024},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.611231Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:a36dbdf9be85ca5f5c54d7986f44c98324106538397c1521ec6f404e5bd804e8","observation_id":"ccd7a359-7d6e-44f5-8a17-dac0218e3ea2","resolution":{"observed_at":"2026-08-07T11:54:16.397475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11831","last_updated":"2025-02-04T22:29:08Z","snapshot_observed_at":"2026-08-13T22:41:25.790952Z","submitted_at":"2024-05-20T06:58:47Z","title":"SSAMBA: Self-Supervised Audio Representation Learning with Mamba State Space Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11831","snapshot_observed_at":"2026-08-07T11:54:13.658520Z","title":"Ssamba: Self-supervised audio representation learning with mamba state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.658520Z"},"links":{"cited_paper":"/paper/2405.11831","citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:8afb9f95d43e16b93a42494ba7355a0e155988c458825534bde09df9376597b3","observation_id":"402f96af-3413-4342-a5a0-ed6d1d095597","resolution":{"observed_at":"2026-08-07T11:54:13.658520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T11:54:13.728077Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.728077Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:3075b6cc0ba4eb2d0f58bf31d925f19a7344f6c69a9112cc1d1e85d3fac37af7","observation_id":"f662163b-6cf5-4c92-abd7-dc7b20609da0","resolution":{"observed_at":"2026-08-07T11:54:13.728077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:13.830561Z","title":"Investigation of ensemble of self-supervised models for speech emotion recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:13.830561Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:e3cd3686771c9fc2159d3e01302265f66d0fc38de0e73c962922fc0eb1374f4d","observation_id":"c17f7253-5d0c-43e5-920c-4a4b02e9c92d","resolution":{"observed_at":"2026-08-07T11:54:13.830561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.804183Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.804183Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:015e3cf26bef32281be440b831f9644324132f3f31467cd65b0d83f26600b026","observation_id":"8ef5c6ec-df8f-4276-8aae-d46f33963427","resolution":{"observed_at":"2026-08-07T11:54:14.804183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.086617Z","title":"Heterogeneity over homogeneity: Investigating multilingual speech pre-trained models for detecting audio deepfake,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.086617Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:0e408aad0d886609f26f8296bb0980a26e91aa699d720ba5fe225ff0f07eef6e","observation_id":"510653c3-4113-4e2d-814c-1171376dcdb7","resolution":{"observed_at":"2026-08-07T11:54:14.086617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.186128Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.186128Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:bce105779eb744f3439b0d241f3df5adcc9f133a5f667251569b195ae9ac8837","observation_id":"df80d8ff-d653-4b28-8740-202487d62fdb","resolution":{"observed_at":"2026-08-07T11:54:14.186128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:18.784313Z","title":null,"venue":null,"work_id":"43bb4b60-750a-4dd4-8947-5272a4b6287a","year":null},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:11.486822Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:c6d849e555d9f1a3017a55be8e40d2514a310bed14f635ad2ce06fb9af127a64","observation_id":"961cf102-2c12-45ce-b9b5-b759e83b2347","resolution":{"observed_at":"2026-08-07T11:54:18.949597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.332055Z","title":"Unispeech-sat: Universal speech repre- sentation learning with speaker aware pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.332055Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:57bbe18b1a224349997a193adf4ee430e6d5425fa5fd044a0be8f9b86e74da4a","observation_id":"1a515ae9-f8e0-4f83-9116-9fb6138f3749","resolution":{"observed_at":"2026-08-07T11:54:14.332055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.485186Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.485186Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:08431234f9de7329c7c36b4002922183f450b16f53c1c6f03dee8c6cd8c497ec","observation_id":"2345687b-f8f1-4e21-9d23-251f33e6ab2f","resolution":{"observed_at":"2026-08-07T11:54:14.485186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.648340Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.648340Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:89aa869a05231d7170460dd8cd6b534abb245375868e528139199f475be879a5","observation_id":"3fceeb46-3ec8-4794-8ec5-9486eeb406ea","resolution":{"observed_at":"2026-08-07T11:54:14.648340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:14.911110Z","title":"Crema-d: Crowd-sourced emotional multimodal actors dataset,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:14.911110Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:dd7666400257e1a3dbb8f44a18f921e482df5e115516d8514b3b383e42cc7bcd","observation_id":"7710b695-a7bf-4855-acd7-23d074507c73","resolution":{"observed_at":"2026-08-07T11:54:14.911110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.042935Z","title":"A database of german emotional speech","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.042935Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:84cba325736e8da90553d1cc929b95b786757c571817d8f5f96104caab853d65","observation_id":"05aedece-3d86-4d60-aed9-d52d7f6e61ca","resolution":{"observed_at":"2026-08-07T11:54:15.042935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.970249Z","title":"The mexican emotional speech database (mesd): elaboration and assessment based on machine learning,","venue":null,"work_id":"ec5116fe-0b50-4595-a102-8b8a28283cdd","year":2021},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.135245Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:358eea1ea77da361c2df61530fdfd7435e75b0ffd6e178fe8523e25f5fb50a46","observation_id":"c5191fac-a0f5-44a8-8b5d-6f60c27168b3","resolution":{"observed_at":"2026-08-07T11:54:16.070844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.693350Z","title":"Speech self-supervised representation benchmarking: Are we do- ing it right?","venue":null,"work_id":"90398d76-8361-4945-ba61-1feee6010744","year":2023},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.224057Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:fb5502d3b943ddea33805fc804f0af130fd31a27c9f31a488442b4dd7db6d4a3","observation_id":"4564c507-12c8-43f5-96d3-93762afe856e","resolution":{"observed_at":"2026-08-07T11:54:15.814920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:54:15.373566Z","title":"Superb: Speech pro- cessing universal performance benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:15.373566Z"},"links":{"citing_paper":"/paper/2506.01138"},"observation_digest":"sha256:4f894f23f0f7a8e485381bcebdad9e01f1ba5f46d6fc07ed2eeef5047d5fb0ef","observation_id":"4a6319b6-851f-41fb-93c1-5772fa44e016","resolution":{"observed_at":"2026-08-07T11:54:15.373566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.01138","last_updated":"2025-06-01T19:46:41Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T03:02:00.702679Z","submitted_at":"2025-06-01T19:46:41Z","title":"PARROT: Synergizing Mamba and Attention-based SSL Pre-Trained Models via Parallel Branch Hadamard Optimal Transport for Speech Emotion Recognition"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2506.01138."}