{"as_of":"2026-08-08T02:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f5af86982e3d1f1d58a9865d867957577aac889bcff68acbab2e22e6081cc04c","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:26:51.361777Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:26:48.588697Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T16:26:51.692001Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"cited_work":{"arxiv_id":"2507.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13626","snapshot_observed_at":"2026-08-06T16:26:51.692001Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","venue":"eess.AS","work_id":"8816efb3-3de6-4dae-b6ba-98365598e62e","year":2025},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.588697Z"},"links":{"cited_paper":"/paper/2507.13626","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:67d2215887de69ac0920e105a4f5f2bf7c8a4e774b5932debfd62ebda6ba15a3","observation_id":"024b4c23-8533-439a-9e2f-a0b93d9661a8","resolution":{"observed_at":"2026-08-06T16:26:51.750509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.13626/citation-record","integrity":"/paper/2507.13626/integrity","json":"/paper/2507.13626/citation-record.json","paper":"/paper/2507.13626"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"cited_work":{"arxiv_id":"2507.13626","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.13626","snapshot_observed_at":"2026-08-06T16:26:51.692001Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","venue":"eess.AS","work_id":"8816efb3-3de6-4dae-b6ba-98365598e62e","year":2025},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.588697Z"},"links":{"cited_paper":"/paper/2507.13626","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:67d2215887de69ac0920e105a4f5f2bf7c8a4e774b5932debfd62ebda6ba15a3","observation_id":"024b4c23-8533-439a-9e2f-a0b93d9661a8","resolution":{"observed_at":"2026-08-06T16:26:51.750509Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.672944Z","title":"all listener","venue":null,"work_id":"e57f4615-c7dd-4032-9870-911260ccc122","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.669915Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:3728a8e2df0ba54130085b8ae5e22237cf861769001ef4ca9ed1f2dd344def4e","observation_id":"91079d56-e74a-42d4-8969-77a7991f6e9f","resolution":{"observed_at":"2026-08-06T16:26:55.751403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.305159Z","title":"prefer- ence","venue":null,"work_id":"77861d4d-5475-41c4-8305-768f76128f36","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.881492Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:22eed25ab186d0038b18d54ad6e509511429f344de53c24c9f31b3bd70e5f319","observation_id":"c7ab896f-ecfc-418c-b7c0-520a80252659","resolution":{"observed_at":"2026-08-06T16:26:55.379288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4100.9376","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.563422Z","title":"Datasets 4.1.1","venue":null,"work_id":"c064be8f-b260-4cbd-a4be-31e6f0d9375f","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.979981Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:770cec5a3fce844d3354087cfd8dfc7c768cfc912dafda0028b862cb5bbfb9f0","observation_id":"b227920a-fe9c-455a-b0ba-8464bea82671","resolution":{"observed_at":"2026-08-06T16:26:51.610345Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.141836Z","title":null,"venue":null,"work_id":"566793de-98ac-402f-8f14-02b163aff126","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.051701Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:ecfc6916d5069e800cc14216f51dfe6f5e3839bd6c9cf4b32c5fe5a18bac6b6c","observation_id":"8041a287-d07d-4eae-b164-12d980ad1f12","resolution":{"observed_at":"2026-08-06T16:26:55.242333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.989384Z","title":null,"venue":null,"work_id":"9d9cb2e8-7366-48e1-a5f3-2fb52cdcad9d","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.101507Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:277601e6ed92012d2aaf1a82dd32acc86794cd36d0e559acc4863a122478e986","observation_id":"5b73d180-b75b-4cda-bb56-86a5a08bcc92","resolution":{"observed_at":"2026-08-06T16:26:55.056884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.152872Z","title":"Ef- fect of attentive listening robot on pleasure and arousal change in psychiatric daycare,","venue":null,"work_id":"26f7cbad-deae-46aa-81cd-5a03da6733d6","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.702767Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:c3a3418ae20b13f0d3666c3d90ff98a452c6c791b23f9f3f2b62ded9908b5b1b","observation_id":"9400441c-ff38-4c1b-84d9-41e6e5c0f616","resolution":{"observed_at":"2026-08-06T16:26:54.228681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:49.234447Z","title":"Speech intelligibility prediction using a neurogram similarity index measure,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.234447Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:bc51efcafd22c03bb93f2e674aa725b637686c5577347eaab22e9f17f156d191","observation_id":"b2281349-9313-411d-8afa-6aea4de69d1b","resolution":{"observed_at":"2026-08-06T16:26:49.234447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.870836Z","title":"Glow-tts: A generative flow for text-to-speech via monotonic alignment search,","venue":null,"work_id":"b84f9987-8764-496f-a45b-7617e0df52e5","year":2020},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.295448Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:09f003060b6437390090ba472cadb93ef60cb321b2efa7a8f906698a0fdb3452","observation_id":"a4971b68-2b9d-4dbe-bf7f-ae34b1a770d5","resolution":{"observed_at":"2026-08-06T16:26:54.936732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.752821Z","title":"Grad-tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":"ce9016db-bfca-4085-a243-3a602668e545","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.370049Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:c9f324ef0a9d97ae3eaba41c649e8bbac0d544ed4dc7d47aa090163e4ca06a1e","observation_id":"3b6befe2-68e2-47c6-83be-bb22088c76e4","resolution":{"observed_at":"2026-08-06T16:26:54.799858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.607880Z","title":"Low bit-rate speech coding with vq-vae and a wavenet decoder,","venue":null,"work_id":"1170ddcc-a6a0-4460-a6c3-45d7ae98a819","year":2019},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.452732Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:652d8e7bb5bced7569ec56985ac5efeda7ab5ccb196999ccf26e4ff8e6ea99e0","observation_id":"973c4d01-ffde-4ca5-a033-eba47b4ec345","resolution":{"observed_at":"2026-08-06T16:26:54.646174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.447833Z","title":"Lpcnet: Improving neural speech synthesis through linear prediction,","venue":null,"work_id":"194bc9b4-6dec-4b75-94f2-21ae28885197","year":2019},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.539155Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:6fc3089de090dcfdb94adb6d3efc9fc5918ea455e96b69706cb44a6225be1aad","observation_id":"28dbdaa2-52f8-43fa-a561-ddb5e892d01b","resolution":{"observed_at":"2026-08-06T16:26:54.514998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.308862Z","title":"Developing conversational virtual humans for social emotion elicitation based on large language models,","venue":null,"work_id":"d48fb36c-dce8-490d-8ed4-ca5103a8f54e","year":2024},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.623254Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:9778177daabf99d1fa17bdfd603edaa8dfb6e33741ae2d21f0453395c3fd6889","observation_id":"13464c96-3e16-44fb-8120-8f5c1b331224","resolution":{"observed_at":"2026-08-06T16:26:54.372902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.101335Z","title":"Moslight: A lightweight data-efficient system for non-intrusive speech quality assessment,","venue":null,"work_id":"99ad6194-0f11-4cff-b79a-bf586fbf5fe6","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.297681Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:6056f032723b4f3a82e08dec2f79b809d462d02cbc121a03f84d12cb0956b783","observation_id":"738eba42-5ac5-48a8-9f10-6fc99e7fc947","resolution":{"observed_at":"2026-08-06T16:26:53.178914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:54.041509Z","title":"An evaluation of speech-based recognition of emotional and physiological markers of stress,","venue":null,"work_id":"90007370-f490-4b4b-a840-2377fe3bb204","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.806369Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7d3f977181135d3f3bafd78132737644e703384c6d9de5d6901d56885186ccd9","observation_id":"ccecc54c-2f2e-44fe-bbd7-aa37e6a4da82","resolution":{"observed_at":"2026-08-06T16:26:54.110573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.915601Z","title":"Mental health monitoring from speech and language,","venue":null,"work_id":"a6b85530-0b11-425d-a350-762c2aa12f37","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.881868Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:158e12af3bf4020961f0ba166bb18d338c323d47085924bc6f27ebffe12d6c75","observation_id":"2c478314-0935-4554-bdd3-566432591486","resolution":{"observed_at":"2026-08-06T16:26:53.971205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.738842Z","title":"Mining valence, arousal, and dominance: possibilities for de- tecting burnout and productivity?","venue":null,"work_id":"c7ab3fda-a28f-4fb1-abfc-bbd865c8e9ab","year":2016},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:49.960280Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:b33d558a14933d95625f2c17c624b58a5d2a796a3fc18b3ad63b2f5195aed367","observation_id":"080f8632-31f9-4cbc-916e-5d97be733cf8","resolution":{"observed_at":"2026-08-06T16:26:53.822880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.573022Z","title":"Ldnet: Uni- fied listener dependent modeling in mos prediction for synthetic speech,","venue":null,"work_id":"b0bb47c4-220b-45b0-b704-017271314c1d","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.059562Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:79f9a1d6c9a5ae65dc70f41e97a98a4fd923f1cadd5a8cb7f29820447dd1f399","observation_id":"3f8bdec2-8d2b-4eb1-9e62-96a2efe9a2b4","resolution":{"observed_at":"2026-08-06T16:26:53.661813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.420293Z","title":"UTMOS: UTokyo-SaruLab System for V oice- MOS Challenge 2022,","venue":null,"work_id":"6b947e60-26bd-44cb-8ce0-3bb5970bca1a","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.145017Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:5a5a4b45456cd1f327bd5bfb0b045aea0de049503db474b4b56ebea81d5898f2","observation_id":"bb1680f6-8c02-44fc-8f4c-c2d0e5c9789d","resolution":{"observed_at":"2026-08-06T16:26:53.506604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:53.254393Z","title":"Sqat- ld: Speech quality assessment transformer utilizing listener de- pendent modeling for zero-shot out-of-domain mos prediction,","venue":null,"work_id":"afdf9542-c621-471d-aedb-c4fef15d9056","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.247411Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:4ff13eac95afc36661331f7c0eadab653f4d1f4300cb1f8917fe075031f51b74","observation_id":"a47a948c-e10f-4883-9866-472e431baea5","resolution":{"observed_at":"2026-08-06T16:26:53.354590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:50.792739Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.792739Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7649829aec69e2c084c308b2b396c69d23d4d853e6c158d85aae350368145c07","observation_id":"ab00940d-82bb-406f-960a-19d05ffd7508","resolution":{"observed_at":"2026-08-06T16:26:50.792739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.947204Z","title":"Meaningless statistics,","venue":null,"work_id":"32c1d7bb-4753-48f8-994b-caf079aa686c","year":1987},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.365122Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:f02f07af9e459850c08f34d2148367e60e35d353c0f4138832f794808070c828","observation_id":"2376936c-ce4a-4965-9135-aab2cd323a23","resolution":{"observed_at":"2026-08-06T16:26:53.008495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.794946Z","title":"Preference-based training framework for automatic speech quality assessment using deep neural network,","venue":null,"work_id":"4e6b5b1a-8fa6-439b-bd8a-86d6b6d61cd3","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.448142Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:29148aab1039957cb2e627530080d50c0872ab811ad8aab39ca375bb72bc1712","observation_id":"e1f49513-ed02-4119-884b-daca928a07a5","resolution":{"observed_at":"2026-08-06T16:26:52.871378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:50.533280Z","title":"Dawn of the trans- former era in speech emotion recognition: closing the valence gap,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.533280Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:47657cd70bc28fb770f31c1c3b61f867c67b3fbe074023b3d6bbc03e55bca4a9","observation_id":"1b78adf0-8afa-4a83-bf21-4b6bf100e934","resolution":{"observed_at":"2026-08-06T16:26:50.533280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.656001Z","title":"Speech emotion recognition based on listener-dependent emotion perception mod- els,","venue":null,"work_id":"ddd30c70-df73-4221-8d41-62ba956fb692","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.597515Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:72931b5a12f8453194c7ad13ae18875fbd25dbb5b7f8453de270ee460f1d224c","observation_id":"56647c9b-b61b-4419-8390-5dc3c4c21fe8","resolution":{"observed_at":"2026-08-06T16:26:52.729633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.497265Z","title":"Multi-task conformer with multi-feature com- bination for speech emotion recognition,","venue":null,"work_id":"ce7970b0-792e-4faa-bbb1-24745388227a","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.667652Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:2247991feebc1262d45133463a36be0fa10d97430d227ed60fe6ae0632ac6d22","observation_id":"21fe2704-2215-4ca3-b4f8-f9dc23432ca2","resolution":{"observed_at":"2026-08-06T16:26:52.529387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.338715Z","title":"Mbnet: Mos prediction for synthesized speech with mean-bias network,","venue":null,"work_id":"e018f1ea-f962-4868-9300-f19807acf678","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.728821Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:0091f9e74524851d64e6bc34a4da38f7eb128f8e776eee39a99372b41b6c12f1","observation_id":"6b6aeeb4-d352-4d24-9d7e-290c1d5a7d65","resolution":{"observed_at":"2026-08-06T16:26:52.424912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.294187Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.294187Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7dfe59cf7893827f206101d443727e22280d2311dd2bf24ceedf10150513ab22","observation_id":"bf5b91ca-025f-4d6b-af0c-53e2ec9c753b","resolution":{"observed_at":"2026-08-06T16:26:51.294187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11680","last_updated":"2021-09-23T22:50:32Z","snapshot_observed_at":"2026-08-02T00:37:53.191869Z","submitted_at":"2021-09-23T22:50:32Z","title":"Simple and Effective Zero-shot Cross-lingual Phoneme Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11680","snapshot_observed_at":"2026-08-06T16:26:50.889367Z","title":"Simple and effective zero-shot cross-lingual phoneme recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.889367Z"},"links":{"cited_paper":"/paper/2109.11680","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:4895d7fceaa46327dfccdc4e057f9d9fca336884f820633b534ad5e70ee6a9eb","observation_id":"9ec44357-d726-4598-b4c3-b813b7740c46","resolution":{"observed_at":"2026-08-06T16:26:50.889367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.200929Z","title":"A density-based algorithm for discovering clusters in large spatial databases with noise","venue":null,"work_id":"f547b741-f96a-4ecc-9bf4-5b30005fcfb6","year":1996},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:50.960938Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:74b418bd9e9b49284b8e99ed656b664bfe90a2b251e11393842b1642d181ff91","observation_id":"4b99fca8-1b4e-41dc-9a98-350610c70159","resolution":{"observed_at":"2026-08-06T16:26:52.263749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:52.068323Z","title":"Robust wav2vec 2.0: Analyzing domain shift in self- supervised pre-training,","venue":null,"work_id":"c473dd88-95a4-4845-b292-31520d81c3a7","year":2021},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.030162Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:91654793298af60ec732695d4fd9ece68a954ed9d34dfbe4d52b1a43e7ae5e89","observation_id":"98e896c7-7cc8-4649-aa96-71a76ea22aa0","resolution":{"observed_at":"2026-08-06T16:26:52.134863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.089994Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.089994Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:7d93295991949660d1edf94aa64bc6ce2b9725df740cbc464e45edfc8eddb357","observation_id":"5a79dae9-feb6-4da1-971a-32a6e3b9d5e0","resolution":{"observed_at":"2026-08-06T16:26:51.089994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T16:26:51.167162Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.167162Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:781da9d51115e6c292534be232f21ae32fe03e02ad80f0aef93cdc4f53b93a73","observation_id":"3652ca6e-da39-4ee9-86da-b04ff8d13132","resolution":{"observed_at":"2026-08-06T16:26:51.167162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.938304Z","title":"The V oiceMOS Challenge 2022,","venue":null,"work_id":"128c70bb-312c-4dd7-b294-d5a68a08e375","year":2022},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.225829Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:ee8e80f3546357336f9f1741aeac0d77dbc243ef2e5ec1f6e6a8c1c68185c012","observation_id":"3afd3b3c-00c1-43b1-babe-b48ebced884e","resolution":{"observed_at":"2026-08-06T16:26:51.989354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:51.810807Z","title":"Exploring wav2vec 2.0 fine tuning for improved speech emotion recognition,","venue":null,"work_id":"1e923d2d-2540-4476-ab03-c37e827a9db3","year":2023},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:51.361777Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:65755e340a5c4ad8c4b7a5d5344bc78a0a27ac4252f7e20904ff2cb9bdf71a07","observation_id":"d2638599-23ee-49b6-8c86-ff9e51d517ac","resolution":{"observed_at":"2026-08-06T16:26:51.856641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:26:55.469562Z","title":"Due to its robust performance and relevance, the UTP model serves as the baseline for our proposed approach","venue":null,"work_id":"938f578f-2221-4a1d-8b56-8ff0aae3c155","year":null},"citing_paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T16:26:48.776779Z"},"links":{"citing_paper":"/paper/2507.13626"},"observation_digest":"sha256:df10c7d53b3ef089f457940df64881d2cff69dcd2ba94f90ab4b4c1c6c14ee4f","observation_id":"11c2779a-ce3b-4ae3-a81c-ae3e5878de59","resolution":{"observed_at":"2026-08-06T16:26:55.559246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.13626","last_updated":"2025-07-21T08:12:36Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T16:17:28.987357Z","submitted_at":"2025-07-18T03:39:48Z","title":"Unifying Listener Scoring Scales: Comparison Learning Framework for Speech Quality Assessment and Continuous Speech Emotion Recognition"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":25},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2507.13626."}