{"as_of":"2026-08-08T07:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:14f8c153e9e774a3e447712913e67532902f25acac04d5b69ce3f3e3c35479fc","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:59:53.498359Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:59:53.349227Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:59:53.578636Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"cited_work":{"arxiv_id":"2507.17208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17208","snapshot_observed_at":"2026-08-06T14:59:53.578636Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","venue":"eess.AS","work_id":"a6b2eb6a-137a-471a-aa82-c3e09ee5d53d","year":2025},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.349227Z"},"links":{"cited_paper":"/paper/2507.17208","citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:f90632353a897b7cb71597d38039055cb91aaf92bb7d8952cd2c2d7a845d8f4e","observation_id":"0557ffbd-8a97-4897-80f3-28dc7d2cd753","resolution":{"observed_at":"2026-08-06T14:59:53.582393Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.17208/citation-record","integrity":"/paper/2507.17208/integrity","json":"/paper/2507.17208/citation-record.json","paper":"/paper/2507.17208"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.944207Z","title":"It has been applied to many kinds of applica- tions, such as text-to-speech and emotion recognition, among others [1, 2, 3]","venue":null,"work_id":"b838fd75-5e63-4cff-834f-69169195591c","year":null},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.345146Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:994e99be5ac2def1f9fbeacd41528b516ff11e5bac4e4a49d8234cf1ccc67f23","observation_id":"c4132dcd-19d7-4bcc-9573-d40fb7f739e9","resolution":{"observed_at":"2026-08-06T14:59:53.948258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"cited_work":{"arxiv_id":"2507.17208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.17208","snapshot_observed_at":"2026-08-06T14:59:53.578636Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","venue":"eess.AS","work_id":"a6b2eb6a-137a-471a-aa82-c3e09ee5d53d","year":2025},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.349227Z"},"links":{"cited_paper":"/paper/2507.17208","citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:f90632353a897b7cb71597d38039055cb91aaf92bb7d8952cd2c2d7a845d8f4e","observation_id":"0557ffbd-8a97-4897-80f3-28dc7d2cd753","resolution":{"observed_at":"2026-08-06T14:59:53.582393Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.933404Z","title":"Experimental setup Datasets: In our experiments, we used two datasets","venue":null,"work_id":"75959f6d-b3ae-470e-a92d-bfba04184693","year":null},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.353247Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:b49db78ae539b86c1e8f11a19e1e8c063a92ba02f233e2f5416a3dd4d2e30ae2","observation_id":"840a7197-cdaa-4ac2-a62a-854b663a06d4","resolution":{"observed_at":"2026-08-06T14:59:53.937831Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.922311Z","title":"By incorporating the absolute pitch into the model, SLASH enhanced the pitch prediction accuracy of conventional SSL-based methods, which depend on relative pitch objectives","venue":null,"work_id":"c786aac7-92a0-4afd-a68d-3e05dc494027","year":null},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.356902Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:8fe6e951df8f75a2649b3badc14b91b52f83fe28ee6becb63914f98bb82d6aa8","observation_id":"1324bbdf-067c-4ad8-8505-30a905589631","resolution":{"observed_at":"2026-08-06T14:59:53.926436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15561","last_updated":"2021-07-23T12:32:52Z","snapshot_observed_at":"2026-08-08T00:23:53.256906Z","submitted_at":"2021-06-29T16:50:51Z","title":"A Survey on Neural Speech Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15561","snapshot_observed_at":"2026-08-06T14:59:53.360356Z","title":"A survey on neural speech synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.360356Z"},"links":{"cited_paper":"/paper/2106.15561","citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:f217042d298483764cb04083468cc0d899dfe75f208553619fec890ff8df26c3","observation_id":"bbec28ee-caa4-468a-ba38-b175895f5f7d","resolution":{"observed_at":"2026-08-06T14:59:53.360356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.911655Z","title":"Speech emotion recognition using deep learning techniques: A review,","venue":null,"work_id":"d750e9a5-acfd-42fc-bef2-016a52653b3b","year":2019},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.365170Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:f39bd8a4ba1facd4845c596ac309718a8ef4b4185be2fca5ae6cf9a1b0adda7d","observation_id":"31749ecb-f8b6-4cc9-8fbd-2fb868272c4d","resolution":{"observed_at":"2026-08-06T14:59:53.915930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.900438Z","title":"An overview of voice conversion and its challenges: From statistical modeling to deep learning,","venue":null,"work_id":"bc3145ec-c910-4a97-b3a6-a46189f35e32","year":2020},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.368977Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:62b12b4b918735dd0db71d5435d9c5143740b78d91cfda9f4423de368cd71578","observation_id":"d5712d0c-c578-4dd4-9d7d-ab9487760f8a","resolution":{"observed_at":"2026-08-06T14:59:53.904766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.888466Z","title":"PYIN: A fundamental frequency estimator using probabilistic threshold distributions,","venue":null,"work_id":"992a6f6b-ed7a-4966-9b3a-7bfa9d83b330","year":2014},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.373190Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:34e3a27e1a01d9cd5906dadb0d8b6f9412134576b44d5cb2b95cc4348aa7e5c6","observation_id":"30d970ca-d21d-4527-b327-a87b1f4fb527","resolution":{"observed_at":"2026-08-06T14:59:53.893264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.876961Z","title":"A sawtooth waveform inspired pitch estimator for speech and music,","venue":null,"work_id":"5a141d85-bebb-4db1-b8e5-408d736d6899","year":2008},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.377359Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:55d6560c45531137238ea7390caa4187999b4bf659d7e5b15157d9cd03e44968","observation_id":"161e625f-55e5-4574-a0c0-545b3059ed36","resolution":{"observed_at":"2026-08-06T14:59:53.881585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.865048Z","title":"A robust algorithm for pitch tracking (RAPT),","venue":null,"work_id":"13b8c058-4b95-4df8-9e35-890aa9f70a5b","year":1995},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.380682Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:c1ef42c336fc6b82b0497f769aa84208c4943e47fd8bd055ca022844fb1962f4","observation_id":"a623cd81-325e-41a4-b19f-ea2be75783e5","resolution":{"observed_at":"2026-08-06T14:59:53.869194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.853911Z","title":"PESTO: Pitch estimation with self-supervised transposition-equivariant objec- tive,","venue":null,"work_id":"c49bb5f3-69a7-48b8-8de6-952c0c757ae1","year":2023},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.384838Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:b76e1da683ec16c3af7c716e71338ef6bd9f6348109b3989857e0cab8132a961","observation_id":"34a6407b-58d7-4bab-89f1-7dc329742893","resolution":{"observed_at":"2026-08-06T14:59:53.858147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.842429Z","title":"SPICE: Self-supervised pitch estimation,","venue":null,"work_id":"851b098d-a294-4fba-adb3-8ccaa9856895","year":2020},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.388406Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:904fdc161f7fe551ea51a1aa5eb4f0e98b382dd1253a519bc62acc4d464ca393","observation_id":"01f4518f-a093-4662-84f1-f4c571122f28","resolution":{"observed_at":"2026-08-06T14:59:53.846610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.832044Z","title":"Crepe: A convolu- tional representation for pitch estimation,","venue":null,"work_id":"7b9b74b2-096f-4089-b3cb-6c127d3c78ba","year":2018},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.391880Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:f5086b0cf791c8bc0bd9d076208949965318218fef3fb46c20995910c331a546","observation_id":"f9b7e45e-f122-4d58-8f57-1d0c5ff4cc65","resolution":{"observed_at":"2026-08-06T14:59:53.835702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.821699Z","title":"DeepF0: End-to-end fundamen- tal frequency estimation for music and speech signals,","venue":null,"work_id":"20bc0609-a829-4f82-a250-b391d8590ded","year":2021},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.395560Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:16de553e5c48b57051f13aa253babf6bcc49b07932deb1da80f332afd5df8b22","observation_id":"38625b17-a927-43b2-afee-3205498d9c63","resolution":{"observed_at":"2026-08-06T14:59:53.825369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.810151Z","title":"Noise-robust DSP-assisted neural pitch estimation with very low complexity,","venue":null,"work_id":"0fada1dd-3fe3-4878-9874-b67fc9bdb100","year":2024},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.400094Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:b1c85cc56181bed58d3d8426e28c0aba6d9e92abb0704088dc6cca83ebd30f31","observation_id":"089d3406-ee7f-406d-af5a-62ea0deb3f46","resolution":{"observed_at":"2026-08-06T14:59:53.814824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09407","last_updated":"2022-11-17T08:29:57Z","snapshot_observed_at":"2026-07-06T14:19:43.043908Z","submitted_at":"2022-11-17T08:29:57Z","title":"NANSY++: Unified Voice Synthesis with Neural Analysis and Synthesis","version":1},"cited_work":{"arxiv_id":"2211.09407","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.09407","snapshot_observed_at":"2026-08-06T14:59:53.556325Z","title":"NANSY++: Unified Voice Synthesis with Neural Analysis and Synthesis","venue":"cs.SD","work_id":"5a25fe9f-32d1-4d40-83d0-1c3539621cfc","year":2022},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.403572Z"},"links":{"cited_paper":"/paper/2211.09407","citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:4d6bc2d0a6ddf1191e3a0c22ac6161de812537d87cf7140fd7804b450b86105e","observation_id":"cdf6c810-7c59-415b-ab9e-ddd0f8336852","resolution":{"observed_at":"2026-08-06T14:59:53.560739Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.798840Z","title":"Singing voice separa- tion and vocal F0 estimation based on mutual combination of ro- bust principal component analysis and subharmonic summation,","venue":null,"work_id":"e6f2d341-c6e0-4857-a7b7-a9165bec4312","year":2016},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.407328Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:e93fc241043f952d70cb01eb0ae3cb79da95e1f5dff8be0f9a935e879e395b83","observation_id":"193cd4ad-c9b8-45ee-8ddf-66446c1f1741","resolution":{"observed_at":"2026-08-06T14:59:53.802898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.788698Z","title":"Unsupervised harmonic parameter estimation using differentiable DSP and spectral opti- mal transport,","venue":null,"work_id":"0155c5e5-0e9b-46e4-94f8-50a4e0436582","year":2024},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.411442Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:62918927e2f37451982ce1459e6f683b7d6ad7f4a574a57d7c56b2b3f188c165","observation_id":"50fbb57d-84cb-41cf-b93c-8f534433d212","resolution":{"observed_at":"2026-08-06T14:59:53.792416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04643","last_updated":"2020-01-14T06:49:37Z","snapshot_observed_at":"2026-07-06T08:50:18.096688Z","submitted_at":"2020-01-14T06:49:37Z","title":"DDSP: Differentiable Digital Signal Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.04643","snapshot_observed_at":"2026-08-06T14:59:53.415326Z","title":"DDSP: Differentiable digital signal processing,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.415326Z"},"links":{"cited_paper":"/paper/2001.04643","citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:93e248106019f8850fe2ad2d3d7536e4c4fccf92a60e75c042ba2067c336d261","observation_id":"59b00769-c895-4bf5-a692-58d5202f61b8","resolution":{"observed_at":"2026-08-06T14:59:53.415326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.777197Z","title":"Technical foundations of tandem- straight, a speech analysis, modification and synthesis frame- work,","venue":null,"work_id":"2ddbe840-0a35-4f93-b8f7-228f4f595e36","year":2011},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.419347Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:1b054f3cffb3540e2c6841364316de9b84e1254e2c7baa159ba502c9a17b2dd8","observation_id":"e98f068b-29ce-4a61-8492-5ffad18ea928","resolution":{"observed_at":"2026-08-06T14:59:53.781101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.767488Z","title":"WORLD: A vocoder- based high-quality speech synthesis system for real-time applica- tions,","venue":null,"work_id":"da6284c2-c7b5-477d-b381-056935007779","year":2016},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.423455Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:83e681ad2685b70335ce6276d35195a83be2fdca295e9e8421921b62417afce2","observation_id":"7a51550f-7c5e-40e4-a1c4-715c2c9e511c","resolution":{"observed_at":"2026-08-06T14:59:53.770781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.756931Z","title":"A spectral envelope estimation method based on F0-adaptive multi-frame integration analysis,","venue":null,"work_id":"81365add-6c7a-4aaa-b2b1-414b6e134f00","year":2012},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.428007Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:e7a9d9d3f872eb24baa56bf442be2c8bb7b2bfff300849a9d26ee0cf62e418a5","observation_id":"beac2734-bf82-41da-914b-31c8840608b5","resolution":{"observed_at":"2026-08-06T14:59:53.760809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.07282","last_updated":"2023-05-08T13:45:05Z","snapshot_observed_at":"2026-08-02T18:02:32.792463Z","submitted_at":"2022-08-15T15:48:36Z","title":"Differentiable WORLD Synthesizer-based Neural Vocoder With Application To End-To-End Audio Style Transfer","version":5},"cited_work":{"arxiv_id":"2208.07282","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.07282","snapshot_observed_at":"2026-08-06T14:59:53.529368Z","title":"Differentiable WORLD Synthesizer-based Neural Vocoder With Application To End-To-End Audio Style Transfer","venue":"eess.AS","work_id":"1a15d6dd-1f9a-4e7a-8537-5d9c199b9d50","year":2022},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.431793Z"},"links":{"cited_paper":"/paper/2208.07282","citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:4b97bb58464ff201f4659e6d945f20f8b2ffb540c803fcdc863ebc5c51429b01","observation_id":"c91b2f6b-5bec-4449-a631-c908ac175f8e","resolution":{"observed_at":"2026-08-06T14:59:53.535942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.744589Z","title":"Calculation of a constant Q spectral transform,","venue":null,"work_id":"af601a2e-2176-43a8-932f-ad7afc7065eb","year":1991},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.436314Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:c5757ba9a14c2d145daf01d3ce3f5627e7b924e1e516dbe0909306815436d0e6","observation_id":"759dd120-e030-4022-a8f1-d2911e2ba727","resolution":{"observed_at":"2026-08-06T14:59:53.748476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.733477Z","title":"Robust estimation of a location parameter,","venue":null,"work_id":"e5dc1766-8c02-4201-a486-4b802d64ddfc","year":1964},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.441294Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:4549d438cf79e002413630393ea9faeaa068b5993d407de473a733d3c972bddf","observation_id":"e3645cea-de11-4d8f-b690-c84aeede71fd","resolution":{"observed_at":"2026-08-06T14:59:53.737799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.721051Z","title":"Spectral smoothing technique in PARCOR speech analysis-synthesis,","venue":null,"work_id":"bf8a5b0e-dfad-4be8-b120-e8ca163ac9d1","year":1978},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.444820Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:b556b203228f9a964847c113991f6d90356b3a658ac105e12256135c3e1e183b","observation_id":"283b9773-82ae-4bab-8818-dc977acb93fa","resolution":{"observed_at":"2026-08-06T14:59:53.725470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.710958Z","title":"Learning to learn by gradient descent by gradient descent,","venue":null,"work_id":"a7701b6c-6630-4d46-b1cf-5c6c87c5e42b","year":2016},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.448371Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:4ed34de1c915dbfef83c20306d3575f4b0d8902b00ace22efeb7def62ef66847","observation_id":"15a6d693-2c07-4c86-b055-b3414fcc257d","resolution":{"observed_at":"2026-08-06T14:59:53.715232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.700460Z","title":"A spectral energy distance for parallel speech synthesis,","venue":null,"work_id":"90637fe3-3411-4e77-abce-a91d47a487c2","year":2020},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.451733Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:8653a3e39d76448df9041ec38bf7c82f175b2e6b4d0f04e12d0ed3486343abfa","observation_id":"4eb387b1-fdcd-4ebf-aa7b-eb7a1cbe1ba1","resolution":{"observed_at":"2026-08-06T14:59:53.704764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.690582Z","title":"LibriTTS-R: A restored multi-speaker text-to-speech corpus,","venue":null,"work_id":"dbac2cd5-8557-4778-a6c9-7335f11a35f2","year":2023},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.455624Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:2fd5ee2bc4ee61e10ca539aa5cf2c5c691f2b453a111e52b7fba0ab6c97b0210","observation_id":"69281a0f-f797-4506-a81f-5913d60816bb","resolution":{"observed_at":"2026-08-06T14:59:53.694773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.681206Z","title":"On the improvement of singing voice separation for monaural recordings using the MIR-1K dataset,","venue":null,"work_id":"52a39441-bb49-42ea-a9cc-4c97c1d15422","year":2009},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.460278Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:aa865a607d66b3e83dd1a0d2d146ab8c1d8720dc9f836ca38a81098caf5578ea","observation_id":"78b63fb6-8ae4-4dae-a47c-c64f5978276e","resolution":{"observed_at":"2026-08-06T14:59:53.684669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.671583Z","title":"ESPnet-TTS: Uni- fied, reproducible, and integratable open source end-to-end text- to-speech toolkit,","venue":null,"work_id":"96e5d04e-f4dd-47a4-93ad-ad2706bd8363","year":2020},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.464870Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:b773da37e581274fc826f558a8fb450201c74b6b0301fda21dc3766a53c14fad","observation_id":"d69b9152-61c8-4b7c-9688-33bf9aa99174","resolution":{"observed_at":"2026-08-06T14:59:53.675128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.661634Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":"eca28dd4-193f-45e5-be12-83e4ae3f8092","year":2019},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.469735Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:ffd6bb6036b5c3579e70c53f3951b45aa33b6a95b923aecad3ff1d374a220dbe","observation_id":"f934d510-c05d-4a77-96f8-ddee088ea706","resolution":{"observed_at":"2026-08-06T14:59:53.665163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.652150Z","title":"Fast and reliable F0 estimation method based on the period extraction of vocal fold vibration of singing voice and speech,","venue":null,"work_id":"66bbaa64-7a06-479a-9b22-42ddc4f7fc0f","year":2009},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.473562Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:73de23fa5cc8d570d02147aee4091bc03712a2dae65e94ef4430b02c4dad8ad9","observation_id":"1312bd19-4574-4fd7-9daf-d4fb8ad39220","resolution":{"observed_at":"2026-08-06T14:59:53.655731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.642825Z","title":"Harvest: A high-performance fundamental frequency estimator from speech signals,","venue":null,"work_id":"645a5d7d-aac2-4c9f-b265-ec9d7cbf9d8f","year":2017},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.477496Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:e06705a6827ea220bf12e2977f691e9ec4e84df9a9a335090e76b2fa46d51950","observation_id":"8d711df3-e4ec-4798-8aea-95d783e9333d","resolution":{"observed_at":"2026-08-06T14:59:53.646507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.632033Z","title":"Multiple fundamental fre- quency estimation by modeling spectral peaks and non-peak re- gions,","venue":null,"work_id":"6f4ea88a-162f-409a-ab95-af9e2840b125","year":2010},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.481576Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:2150af2ed641b704c5d086db86bad859ff00c778ef8e6b61094dd8e3d6d3b4a5","observation_id":"af257b4e-b97d-4928-97be-372c9c0fe827","resolution":{"observed_at":"2026-08-06T14:59:53.635556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.621327Z","title":"MedleyDB: A multitrack dataset for annotation- intensive MIR research","venue":null,"work_id":"1b8acd38-63a6-44ee-880a-9b1f126a6c85","year":2014},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.485441Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:a6ba79ee55f105986131e551a6b3da487a66d4ed7c5678dd10ca8127acb7e4c6","observation_id":"4a1de76e-c04a-4485-abf5-98f53fdb42a3","resolution":{"observed_at":"2026-08-06T14:59:53.625833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.610062Z","title":"An analysis/synthesis framework for automatic F0 annotation of multitrack datasets,","venue":null,"work_id":"fafabc49-095f-47d2-bf43-c2facee5c7ce","year":2017},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.489549Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:d8a78d9aaf302fc62f91dccce0f9b71503abb2f27b84075de50cf9440f957052","observation_id":"597ffbe7-1f90-46a6-a1cb-184ba3471167","resolution":{"observed_at":"2026-08-06T14:59:53.613854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.599803Z","title":"Neural audio synthesis of musi- cal notes with wavenet autoencoders,","venue":null,"work_id":"0af480d3-1b60-46e3-8bf4-1d51e681bbed","year":2017},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.494244Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:bb23a37911b09b363db85ba3c2bcf40982ecc22783eaf9023614b0ee2cd13bcc","observation_id":"2f2ca08e-d900-46f3-a801-4e72f78c26a6","resolution":{"observed_at":"2026-08-06T14:59:53.603344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:59:53.589408Z","title":"Melody extraction from polyphonic music signals: Approaches, applica- tions, and challenges,","venue":null,"work_id":"c69ed8ea-72a2-4899-ac63-4366448e755d","year":2014},"citing_paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:59:53.498359Z"},"links":{"citing_paper":"/paper/2507.17208"},"observation_digest":"sha256:bb738609fa70631fd46f3b5b9c4f63dafc0d677c62cc2157e57a1f15cf43ed35","observation_id":"cf7fdb41-2f9f-4183-8f90-7ad8f384b377","resolution":{"observed_at":"2026-08-06T14:59:53.593284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17208","last_updated":"2025-07-23T04:55:28Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-08T00:25:21.422625Z","submitted_at":"2025-07-23T04:55:28Z","title":"SLASH: Self-Supervised Speech Pitch Estimation Leveraging DSP-derived Absolute Pitch"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":2,"verified_fuzzy":33},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 1 inbound Pith citation observation for arXiv:2507.17208."}