{"as_of":"2026-08-08T11:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:679a39c17a19f706712e7612d23cafc13217c785224b66f19d79562fb725b5b7","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:10:00.349207Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.19335/citation-record","integrity":"/paper/2506.19335/integrity","json":"/paper/2506.19335/citation-record.json","paper":"/paper/2506.19335"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:05.247615Z","title":"Perceptual evaluation of speech quality (PESQ)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"72ba4ea2-ff0b-41b4-b979-08eaf4a3d94f","year":2001},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:57.866160Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:70a8d52e76afa7763df69526f3abc61e6899c53154449bb53248bb55ad9b852d","observation_id":"d96e89fb-35c7-4d42-a8c8-b3b92d4a957d","resolution":{"observed_at":"2026-08-06T23:10:05.311086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:05.015221Z","title":"MOSNet: Deep learning based objective assessment for voice conversion,","venue":null,"work_id":"39f388f8-57f5-4d52-86cc-f552106c204c","year":2019},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:57.948058Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:cf29de603448bd65fcaca222c2d079c94ffb11cce6ee5fb9c86250d115ba78e0","observation_id":"262f80f0-d3e2-43f7-be0a-17c5b67f2e4d","resolution":{"observed_at":"2026-08-06T23:10:05.083770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.872225Z","title":"Speech quality assessment through MOS using non-matching references,","venue":null,"work_id":"8f187470-b8f6-4d69-baa1-bbc71fcd527c","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.041595Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:038b85ad7469b18972d8cb900de2ef04f5f5174d1ea068bc4dd5f547e6df05d0","observation_id":"9197a5b9-9b9b-4b0f-a38b-03d1f8d1b5be","resolution":{"observed_at":"2026-08-06T23:10:04.937579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.08130","last_updated":"2023-02-16T07:49:06Z","snapshot_observed_at":"2026-07-06T14:52:27.430439Z","submitted_at":"2023-02-16T07:49:06Z","title":"Personalized Audio Quality Preference Prediction","version":1},"cited_work":{"arxiv_id":"2302.08130","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.08130","snapshot_observed_at":"2026-08-06T23:10:01.104968Z","title":"Personalized Audio Quality Preference Prediction","venue":"cs.SD","work_id":"512b308b-e065-47f5-bcf5-b96dd1c2ffcb","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.213212Z"},"links":{"cited_paper":"/paper/2302.08130","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:33d3d9918d991342abddba9ae334d662e2791fb8de505c8610b8bf67f4f664d3","observation_id":"c71ca7bc-4267-44f2-96c7-18c5e3a5d0ac","resolution":{"observed_at":"2026-08-06T23:10:01.234200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.699294Z","title":"Generalization ability of MOS prediction networks,","venue":null,"work_id":"bff5797f-58b1-4785-8ca8-3937217e6a31","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.324453Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:f0b4c53a785e65d919a5bbf027107c630f063506d86a4418601129c345e08be4","observation_id":"c9dc12f4-5eaa-40d3-9fc9-b9c2258de40f","resolution":{"observed_at":"2026-08-06T23:10:04.760945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.525454Z","title":"Methods for subjective determination of transmis- sion quality,","venue":null,"work_id":"0c313783-84d2-47a1-b901-50842516bb9a","year":1996},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.506366Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:5ce8bfbddc051be260dcbeccfcf745cb626c5851afc1b09bb4da143a2d643104","observation_id":"a444f8f2-56f9-41b9-9de1-a780a0da43ce","resolution":{"observed_at":"2026-08-06T23:10:04.607970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.325442Z","title":"Here or There: Preference Judgments for Relevance,","venue":null,"work_id":"76b81e1b-aa3f-4ae5-9c0e-2658a31974d6","year":2008},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.613893Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:0bfb2135fd48cae0376005d765813237a9867067661843fca5253ab3418b4c04","observation_id":"2fdcfd3d-ae4a-410a-a07b-185dccbf09a9","resolution":{"observed_at":"2026-08-06T23:10:04.409339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:04.051744Z","title":"Comparison of four subjective methods for image quality assessment,","venue":null,"work_id":"12d4b10a-04e2-4a21-991e-57b910550499","year":2012},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.685104Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:8d45bfb382c41719e55d621b51e8040328438a412e71309d81a2065f6c8088be","observation_id":"1429e2b7-19db-4dc4-b468-5c013be32caf","resolution":{"observed_at":"2026-08-06T23:10:04.190441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:03.687518Z","title":"AutoMOS: Learning a non-intrusive assessor of naturalness- of-speech,","venue":null,"work_id":"a44bba52-8ba0-4c09-94b8-38692e2e76d8","year":2016},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:58.865820Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:561956f0b993f07cf542ec9d571bb2a0b28b97a73f78eef8ca66df4e18d25646","observation_id":"51f76f08-d07f-4565-8f2d-209e8ab3c64d","resolution":{"observed_at":"2026-08-06T23:10:03.860825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:03.332984Z","title":"MBNet: MOS prediction for synthesized speech with mean-bias network,","venue":null,"work_id":"fab05ccc-ecc3-42ae-9a61-ae4312e41d19","year":2021},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.010942Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:c5e2eeb17a7d14480aafaa8a14acf7c6b8dc5a30fde7023876aa83433270a125","observation_id":"ba7e165e-7bdd-4f0f-a75e-f85a7a98d38e","resolution":{"observed_at":"2026-08-06T23:10:03.533531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:03.053548Z","title":"LDNet: Unified listener dependent modeling in MOS prediction for synthetic speech,","venue":null,"work_id":"50ffd979-e025-4a41-bec4-c813221a180f","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.103562Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b0fee0249b8c084bf9d81c389c22960ad762e53839c0673566bdaae59bc3a10a","observation_id":"2de4dc13-b3f0-4cf9-8a48-df0ab51f6b60","resolution":{"observed_at":"2026-08-06T23:10:03.158797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.844449Z","title":"UTMOS: Utokyo-Sarulab System for V oiceMOS Challenge 2022,","venue":null,"work_id":"fe46c399-4ce2-4325-bc5b-bfe2940e0c4c","year":2022},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.192461Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:ccbc940f327e4ec10dc915b56603b7ac6bbdaaa8c36187574fb0279f1c240b00","observation_id":"59604e28-9040-4c68-8248-2930bb71ed10","resolution":{"observed_at":"2026-08-06T23:10:02.936281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10493","last_updated":"2023-06-18T07:38:17Z","snapshot_observed_at":"2026-08-07T06:13:53.790129Z","submitted_at":"2023-06-18T07:38:17Z","title":"MOSPC: MOS Prediction Based on Pairwise Comparison","version":1},"cited_work":{"arxiv_id":"2306.10493","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.10493","snapshot_observed_at":"2026-08-06T23:10:00.884033Z","title":"MOSPC: MOS Prediction Based on Pairwise Comparison","venue":"cs.SD","work_id":"3eb42dc9-5a84-4a94-88fb-2685345222d6","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.313257Z"},"links":{"cited_paper":"/paper/2306.10493","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:e32fac34e6cb1a00ffc05e0de8b35b6c61c3c80cb2a0bc96df4295574c9a88e7","observation_id":"1eee25eb-1344-468e-a8cf-923af492cc87","resolution":{"observed_at":"2026-08-06T23:10:00.978345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15203","last_updated":"2023-08-29T10:40:57Z","snapshot_observed_at":"2026-07-06T16:11:43.387948Z","submitted_at":"2023-08-29T10:40:57Z","title":"Preference-based training framework for automatic speech quality assessment using deep neural network","version":1},"cited_work":{"arxiv_id":"2308.15203","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.15203","snapshot_observed_at":"2026-08-06T23:10:00.662159Z","title":"Preference-based training framework for automatic speech quality assessment using deep neural network","venue":"eess.AS","work_id":"295dbb5c-6b02-4d82-af91-670a05fdc286","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.405444Z"},"links":{"cited_paper":"/paper/2308.15203","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:e1dbff142457c7ec979f9cfeb0a998b34f069771f50078fe94360a3ae171d7b1","observation_id":"34ae232f-92cb-447d-804e-8a70f2590be9","resolution":{"observed_at":"2026-08-06T23:10:00.733577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.614053Z","title":"PromptTTS: Controllable text-to-speech with text descriptions,","venue":null,"work_id":"b7b43da8-d425-4ad9-a75d-c656ad25b6c1","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.511569Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:51bf602fa2e83b25332b27523dd90cdb4cf1ab0d8050bca205395ef2ed070d07","observation_id":"a6e6c00c-2fd0-4445-952f-19e1d1445ba3","resolution":{"observed_at":"2026-08-06T23:10:02.731247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.369364Z","title":"Coco-Nut: Corpus of Japanese Utterance and V oice Characteristics Description for Prompt-Based Control,","venue":null,"work_id":"265ee824-3931-4499-8faa-a36007f882a7","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.627219Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:ef884b0f145d89694553dfa75da317258c91062ee603d1b7f39101da3e48498b","observation_id":"89174a89-7a4d-48b7-b6cf-0bfd5d10d5d8","resolution":{"observed_at":"2026-08-06T23:10:02.481922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16509","last_updated":"2023-12-27T14:41:23Z","snapshot_observed_at":"2026-07-06T16:53:35.776613Z","submitted_at":"2023-11-28T04:49:17Z","title":"StyleCap: Automatic Speaking-Style Captioning from Speech Based on Speech and Language Self-supervised Learning Models","version":2},"cited_work":{"arxiv_id":"2311.16509","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16509","snapshot_observed_at":"2026-08-06T23:10:00.460568Z","title":"StyleCap: Automatic Speaking-Style Captioning from Speech Based on Speech and Language Self-supervised Learning Models","venue":"cs.CL","work_id":"4d09d021-5208-44de-a6b2-dd645f374284","year":2023},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.709627Z"},"links":{"cited_paper":"/paper/2311.16509","citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:3b00056f26c69e333bee897e7a74ace013cb1a3a3f3c06e84ac3861ba9b2ddf3","observation_id":"b5b8105c-6099-402a-9b54-081f6bd5f2b6","resolution":{"observed_at":"2026-08-06T23:10:00.557403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.179904Z","title":"Extraction of everyday expression associated with voice quality of normal utterance,","venue":null,"work_id":"2816589b-effe-4e78-8caf-bab8ae79ce2a","year":1999},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.805380Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:44161d09b5232f9a368f3cb07282b5698dce72192712145ad7a5ad5c15fc5ce5","observation_id":"3d6d22b9-29ff-4752-8d14-4e86aded1b4f","resolution":{"observed_at":"2026-08-06T23:10:02.309847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:02.043932Z","title":"A dendrite method for cluster analysis,","venue":null,"work_id":"3c0c265f-21e4-4603-8cb0-78d7c8e05454","year":1974},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.886900Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b1438c45bbcc8e90f87c56cc3d87e59d97a2ce8c9e54d1429bec6b3e12452260","observation_id":"0d89aa07-e4b8-4a9f-acd3-708bbe064cec","resolution":{"observed_at":"2026-08-06T23:10:02.088948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:09:59.945984Z","title":"The proof and measurement of association between two things.,","venue":null,"work_id":null,"year":1961},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:09:59.945984Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b9f00a81229fb47cd208387d0f18fdcc111ed3e56d580849f0ff7e23e97e7edd","observation_id":"54f76ea7-9a2b-42e1-81b5-ed6fb5f4cde5","resolution":{"observed_at":"2026-08-06T23:09:59.945984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.863496Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"64d55494-b9fc-402c-bf02-848f57ae4dc0","year":2020},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.053354Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:cfc20d68145b571287cf147495ddfcedb80c2cac94066dfd5deb2a2a612f7adc","observation_id":"544b8d65-f418-40db-aeaa-8a74c35c7970","resolution":{"observed_at":"2026-08-06T23:10:01.967506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.673374Z","title":"Librispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":"303cc2fd-4431-42cd-9b44-cec6ba2d8899","year":2015},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.166955Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:e86f8fa0a38f3f688899cb85f9f2993f30f124e12e6db4f3ff84a562d321ce6b","observation_id":"4684b367-d441-405f-b124-5ef639da91f3","resolution":{"observed_at":"2026-08-06T23:10:01.734546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.514089Z","title":"fairseq: A fast, extensible toolkit for sequence modeling,","venue":null,"work_id":"a39b0a62-1abe-41e2-bbe2-28e4246435b1","year":2019},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.253399Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:6a5ae324fe57d0494114854a7541c6e4cdffc1ed05fe84887545c0015f259f53","observation_id":"d7366710-805f-4dfc-a18a-9a09bff9b422","resolution":{"observed_at":"2026-08-06T23:10:01.587812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:10:01.333944Z","title":"Learning to Rank Using Gradient Descent,","venue":null,"work_id":"c80eb322-3b1a-404c-bffe-f36402041aff","year":2005},"citing_paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:10:00.349207Z"},"links":{"citing_paper":"/paper/2506.19335"},"observation_digest":"sha256:b4f749979a3236f8530d6fc2072faf82966c2e687c63129170e5f6a1ab55e2ae","observation_id":"f5d662b7-3175-4958-95e7-8bf15dad5fee","resolution":{"observed_at":"2026-08-06T23:10:01.402685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.19335","last_updated":"2025-06-24T06:00:05Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T23:04:45.548518Z","submitted_at":"2025-06-24T06:00:05Z","title":"Learning to assess subjective impressions from speech"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":4,"verified_fuzzy":19},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.19335."}