{"as_of":"2026-08-08T13:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1be890b68aa83a6412d028de6936d5bd7be598edecf3ffd9b347d0a164d850ab","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:43:01.355059Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:42:57.929686Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T19:06:03.340800Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-08-07T13:42:57.929686Z","title":"Effective ER is critical in fields such as human-robot interaction (HRI), healthcare, and virtual agents, where understanding and responding to human emotions are essential","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:57.929686Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:1602e17a96d107604cca6733d96d2605e376cbec3efdfa8712f6d1f8a3e8fc0c","observation_id":"2486b714-fb00-4a45-aae6-f009202cc48b","resolution":{"observed_at":"2026-08-07T13:42:57.929686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2505.21196","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-07-01T19:06:03.340800Z","title":"Learning annotation consensus for con- tinuous emotion recognition,","venue":null,"work_id":"75363152-9ddd-4a77-b832-05c40d5a2624","year":2025},"citing_paper":{"arxiv_id":"2605.27479","last_updated":"2026-05-26T12:05:13Z","snapshot_observed_at":"2026-08-03T06:09:12.042510Z","submitted_at":"2026-05-26T12:05:13Z","title":"Resource-Constrained Affect Modelling via Variance Regularisation Pruning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T19:54:06.216112Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2605.27479"},"observation_digest":"sha256:a7b174f1974b40ea06f2e1a014c53df45fe1d4edd7e35ca912f51200f75d5b94","observation_id":"8c614024-cd3c-42da-9906-ad66c862cefc","resolution":{"observed_at":"2026-06-29T20:03:56.422719Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2505.21196","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-07-01T19:06:03.340800Z","title":"Learning annotation consensus for con- tinuous emotion recognition,","venue":null,"work_id":"75363152-9ddd-4a77-b832-05c40d5a2624","year":2025},"citing_paper":{"arxiv_id":"2606.27536","last_updated":"2026-06-25T20:35:17Z","snapshot_observed_at":"2026-07-07T00:01:44.678954Z","submitted_at":"2026-06-25T20:35:17Z","title":"Learning from Annotation Uncertainty: Entropy-Aware Curriculum for Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T00:53:21.116337Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2606.27536"},"observation_digest":"sha256:2997db658183598862a5873859c2f8e22edc819e5eb7e14a7009012d3d588890","observation_id":"d011a3b5-41c9-4ad2-9dfc-c91b4ab492a9","resolution":{"observed_at":"2026-07-01T19:06:03.342440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21196/citation-record","integrity":"/paper/2505.21196/integrity","json":"/paper/2505.21196/citation-record.json","paper":"/paper/2505.21196"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21196","snapshot_observed_at":"2026-08-07T13:42:57.929686Z","title":"Effective ER is critical in fields such as human-robot interaction (HRI), healthcare, and virtual agents, where understanding and responding to human emotions are essential","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:57.929686Z"},"links":{"cited_paper":"/paper/2505.21196","citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:1602e17a96d107604cca6733d96d2605e376cbec3efdfa8712f6d1f8a3e8fc0c","observation_id":"2486b714-fb00-4a45-aae6-f009202cc48b","resolution":{"observed_at":"2026-08-07T13:42:57.929686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.820134Z","title":"gold standard","venue":null,"work_id":"627f167d-39cc-4c23-b13c-b9bd8500f1f3","year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.075633Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:aced44fead6a3f6e37b4b632cccce1a00d847b636ce6b49a13aabf6431005837","observation_id":"aa2b730c-7c71-46de-85d2-b822fd28daf7","resolution":{"observed_at":"2026-08-07T13:43:05.840384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.680548Z","title":"Following recommendations in [17], we freeze the convolutional feature encoder layers while fine-tuning the higher-level transformer blocks","venue":null,"work_id":"07af2aac-ab96-474f-9d3c-54699cf56560","year":null},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.288406Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:9b43cf85c72325b0e4334b6dd72a4c2b1dafa51a6e0452f0d96ce195519fd419","observation_id":"e2ca1b6a-e820-489f-bc7f-823a9dc0eb33","resolution":{"observed_at":"2026-08-07T13:43:05.748338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.484433Z","title":null,"venue":null,"work_id":"3e340ef1-9b10-4fbd-9cd6-7c9dee67da4e","year":2016},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.423780Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:14729897b506ed34f89d0be2832b19e02529577f2007d99a63907376e8aa523e","observation_id":"45ef3cb6-953c-4742-8354-8660ff94b330","resolution":{"observed_at":"2026-08-07T13:43:05.583315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.299912Z","title":"These capa- bilities could significantly impact interactive technologies and empathy computing, facilitating more nuanced and responsive interactions","venue":null,"work_id":"c06907de-bb21-4cdc-8fa1-9fe54a95048e","year":null},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.587391Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:540fe582cf685227a82ed4486176822eff3641c3947ecabdf03f19f4b359eae3","observation_id":"7ed1a066-da65-43ed-9792-a1b79283b475","resolution":{"observed_at":"2026-08-07T13:43:05.389453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:05.099582Z","title":"Speech emotion recognition: Two decades in a nutshell, benchmarks, and ongoing trends,","venue":null,"work_id":"abef6479-27a4-4475-956b-8ca469e5f715","year":2018},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.759137Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:1f86ff1f3ce20ba2babd480f9227b71129323e60ba8972d196bdcf88169a8e91","observation_id":"ccd37d8b-fa16-47fe-8f9e-a51234021fe2","resolution":{"observed_at":"2026-08-07T13:43:05.191726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.981206Z","title":"Universals and cultural differences in the judg- ments of facial expressions of emotion","venue":null,"work_id":"ccb1aa7b-2a2c-44a8-a58c-49358f501ad6","year":1987},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:58.929631Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:be9ab35ec3d50a2c10e1b2fb99eac32fb4b11950353e8c6d7488909e5f989fb1","observation_id":"d483b37d-69a0-4601-b2a2-f874ae48695e","resolution":{"observed_at":"2026-08-07T13:43:05.013240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.888525Z","title":"Evidence for a three-factor the- ory of emotions,","venue":null,"work_id":"f7420a89-b750-4839-9a45-f808d72f8658","year":1977},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.076982Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:464fa2620e9e7acc68a2bf1c537086c7b14c57999007bd6bd630da8f1f7998da","observation_id":"5e010ed8-2d8d-41cb-97fe-2b19f8229b44","resolution":{"observed_at":"2026-08-07T13:43:04.942053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.713525Z","title":"Multi- modal learning for speech emotion recognition: An analysis and comparison of asr outputs with ground truth transcription","venue":null,"work_id":"548b6f04-72b2-4d57-9857-30976f9263bb","year":2019},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.173947Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:c1b32e552d7d14da96177757e0f29c75bafadba7c8b690468f77c68a922e3e9b","observation_id":"92787b42-cd5b-4f14-a169-a0e090ff85d3","resolution":{"observed_at":"2026-08-07T13:43:04.814281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.542193Z","title":"Affect detection: An interdisci- plinary review of models, methods, and their applications,","venue":null,"work_id":"02a899a0-0f00-4880-8e19-25a1c7ecc4c5","year":2010},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.238010Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:9a10fdb734af263fdd289096f10d4452474de7378c5c0377fe8a7e72c8423543","observation_id":"5e9933d6-d6aa-42a1-8b61-193662772dc8","resolution":{"observed_at":"2026-08-07T13:43:04.630724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.327397Z","title":"Multistage linguistic conditioning of convolu- tional layers for speech emotion recognition,","venue":null,"work_id":"a5a9b4f8-ef79-4cef-8e57-27e3a16322f1","year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.353262Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:2b4b956d0315c38c3c57aaec450d9d4907cfdee595d4058006830dfc3b095858","observation_id":"c5b39a36-8018-426d-8969-d45ff8d41b8b","resolution":{"observed_at":"2026-08-07T13:43:04.407264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:04.150771Z","title":"Ro- bust speech emotion recognition under different encoding condi- tions,","venue":null,"work_id":"da3d0d20-b8ec-4b49-9df2-6c64c3af621f","year":2019},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.492398Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:18c92dbe712a886c60cdb6be4a65113e631412d70daee6291ed82ca9ac9e2df5","observation_id":"d7c2b453-9495-47a3-9408-25e97d6343b6","resolution":{"observed_at":"2026-08-07T13:43:04.258784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.915314Z","title":"Affective robotics: Current research and future direc- tions,","venue":null,"work_id":"18bd81cb-88c2-4fac-bd10-bc87551d56e9","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.648063Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:361731b3ce1cb41efcb16f1722d3566d21a1f2b7d17d1213f2f412a67d0055b9","observation_id":"b6e9b2d5-deb1-40e4-9089-246163ecd796","resolution":{"observed_at":"2026-08-07T13:43:04.017803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.789675Z","title":"A review of affective computing: From unimodal analysis to multimodal fu- sion,","venue":null,"work_id":"fc5a552b-cef1-4a50-9bd5-b496de4a99e7","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.712788Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:aa708b85a78541d7f9d8ba1d7b71879dac47ddb507a76fe90261825526af6ace","observation_id":"7d7f57a5-24ba-4479-ac30-7f166e3c1d57","resolution":{"observed_at":"2026-08-07T13:43:03.842179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.533071Z","title":"Use of affective visual information for summarization of human-centric videos,","venue":null,"work_id":"b813ee6a-1868-426d-a077-9ada89eb32a5","year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:42:59.879313Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:65dff9bda3c278ce8dccaa016ea2c89ed57cabdc9b29b94facfba8888015a726","observation_id":"85bec195-0c86-4920-9e76-aef4c7dc7b5d","resolution":{"observed_at":"2026-08-07T13:43:03.668128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:03.267956Z","title":"Introduc- ing the recola multimodal corpus of remote collaborative and af- fective interactions,","venue":null,"work_id":"6afba50a-b735-4f42-8abf-07a6d2ba8c68","year":2013},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.008366Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:44026bff89b59cbed3a36e75a8131a0d447cb4242773f808a142d097afb83551","observation_id":"4d962ade-1042-44cd-bd42-5e01cb2dd1e7","resolution":{"observed_at":"2026-08-07T13:43:03.387469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.940446Z","title":"Cognimuse: A multimodal video database an- notated with saliency, events, semantics and emotion with appli- cation to summarization,","venue":null,"work_id":"54b1276e-6cbd-4867-a6ed-ee385d0c09b3","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.230996Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:b0691b364f2e31e8722c3c2e6c4f99de3ebe661528a7d4c70213b20542590898","observation_id":"accc8130-3168-4566-9081-912cf60cf9d7","resolution":{"observed_at":"2026-08-07T13:43:03.077289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.747466Z","title":null,"venue":null,"work_id":"671e684c-e635-4ebf-838f-6617032deb63","year":1997},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.432216Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:c8ca401c8402fd607313357b0e08bc6898520e0d8ff4d3b34ae01d10f7deca1f","observation_id":"18860c9d-c37d-4f20-a9a9-ca36da252de3","resolution":{"observed_at":"2026-08-07T13:43:02.781482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.570746Z","title":"Prediction of asynchronous dimensional emotion ratings from audiovisual and physiological data,","venue":null,"work_id":"9f989f1b-4de6-42ea-ab3d-1c58ea92914c","year":2015},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.597675Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:982857e1b579373b2f8124058da67b3afc83cce2ebe581ff0286fbeaa8a1bdaa","observation_id":"e469e655-e0f7-418a-9f5d-7a466e9a7798","resolution":{"observed_at":"2026-08-07T13:43:02.687726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:02.245401Z","title":"End-to-end multimodal emotion recognition using deep neural networks,","venue":null,"work_id":"f8cf4b95-b4ee-4c23-b511-d461e401728b","year":2017},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.735729Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:0cf600a2b78d8113041d9db4a0cf9959e7b4599eb85e296b29df4c2afa7681c2","observation_id":"37d2ca17-0df1-4971-98ca-65b125c96fef","resolution":{"observed_at":"2026-08-07T13:43:02.406769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.04107","last_updated":"2020-09-09T05:06:44Z","snapshot_observed_at":"2026-07-06T09:54:02.091694Z","submitted_at":"2020-09-09T05:06:44Z","title":"Multi-modal Attention for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.04107","snapshot_observed_at":"2026-08-07T13:43:00.880411Z","title":"Multi-modal attention for speech emotion recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:00.880411Z"},"links":{"cited_paper":"/paper/2009.04107","citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:a70ba917cc1f2d43bcbb9258c574533bdf283f7bab808f51073e8be7d6d604c4","observation_id":"d99b507b-246d-4ca3-ba17-1fc6b982fe04","resolution":{"observed_at":"2026-08-07T13:43:00.880411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.083158Z","title":"Dawn of the trans- former era in speech emotion recognition: closing the valence gap,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.083158Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:ce805aaa9ae5f681be83cf62f392327255627e5f1252a37d7793e107ee1ae9b5","observation_id":"1dba6740-a37b-4f71-bf0f-dab28327bc02","resolution":{"observed_at":"2026-08-07T13:43:01.083158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.978216Z","title":"Recognizing emotions evoked by movies using multitask learning,","venue":null,"work_id":"9bf67086-4f51-41f5-badb-9bd102e30aec","year":2021},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.279329Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:b96c65a1cc2ac114cf3e164f423b0bcc1ea37e7c04035d2916fcf9856a40f22d","observation_id":"5f102836-2f05-4106-8095-52672fba331d","resolution":{"observed_at":"2026-08-07T13:43:02.121256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.706905Z","title":"The ox- ford handbook of affective computing,","venue":null,"work_id":"de684ccc-0b5a-44fd-8b98-eff94a90905f","year":2015},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.351222Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:07f36cb3956d64838e5aba97cff73a2278afe31815ab64d92dee7674bdbeeb49","observation_id":"1e799cf9-e0b0-483c-8350-5822a40b03da","resolution":{"observed_at":"2026-08-07T13:43:01.850404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:43:01.463975Z","title":"Primitives-based evaluation and estimation of emotions in speech,","venue":null,"work_id":"5c8d285d-0a17-48d4-9ab5-1d121f70f0d7","year":2007},"citing_paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:01.355059Z"},"links":{"citing_paper":"/paper/2505.21196"},"observation_digest":"sha256:1027fadc274af507303c8a0ddebbe6bd5f0badf950de05fa9622a1035a0f4975","observation_id":"78557e42-7a1b-4a36-9aba-45fe6ddb96d6","resolution":{"observed_at":"2026-08-07T13:43:01.534602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21196","last_updated":"2025-05-27T13:43:45Z","latest_version":1,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-07T13:30:41.096176Z","submitted_at":"2025-05-27T13:43:45Z","title":"Learning Annotation Consensus for Continuous Emotion Recognition"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2505.21196."}