{"as_of":"2026-08-22T19:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:304e090ff70765e5028972564716f603fb83bd871b9532b0ab61b3f1938a5bf2","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:52:02.208288Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:34:10.985344Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T21:34:11.100456Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"cited_work":{"arxiv_id":"2412.14890","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.14890","snapshot_observed_at":"2026-08-06T21:34:11.100456Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","venue":"eess.AS","work_id":"7e4859fd-765b-46af-85a1-7d9c3b5456ac","year":2024},"citing_paper":{"arxiv_id":"2506.23859","last_updated":"2025-08-19T09:17:36Z","snapshot_observed_at":"2026-08-18T15:48:46.859005Z","submitted_at":"2025-06-30T13:55:10Z","title":"Less is More: Data Curation Matters in Scaling Speech Enhancement","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:34:10.985344Z"},"links":{"cited_paper":"/paper/2412.14890","citing_paper":"/paper/2506.23859"},"observation_digest":"sha256:f04679aa8719919f7f245de1e006cb3990b4dc35e5b1aeca0eb0e86b25776bb4","observation_id":"7e756b8c-a242-4173-b0b9-26a309a11357","resolution":{"observed_at":"2026-08-06T21:34:11.146381Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.14890/citation-record","integrity":"/paper/2412.14890/integrity","json":"/paper/2412.14890/citation-record.json","paper":"/paper/2412.14890"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.036895Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.036895Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:b4135121bfe197dd1f7b1c4eb8b3a52dfd285ddbfc697be821abd0e0c3c0c4d5","observation_id":"a14177bd-ad2c-43f7-8790-2d0db3d4b51a","resolution":{"observed_at":"2026-08-11T11:52:02.036895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.742165Z","title":"Toward universal speech enhancement for diverse input conditions,","venue":null,"work_id":"271221f2-5e18-48d4-8ca2-ef0754dcc54c","year":2023},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.042873Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:67adf6899dc3cd239f9397e8ec3db2a8b57cf59b4bfdfc86228de8debb32dc0a","observation_id":"7b1f8548-ef68-4b19-8232-9bbfc7f2a327","resolution":{"observed_at":"2026-08-11T11:52:02.746609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.729366Z","title":"Improving design of input condition invariant speech enhancement,","venue":null,"work_id":"08010ed1-b006-4379-a0e5-2736b61aa72b","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.047165Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:600d52d7fd7b49a90301db5e0701538aafb9533cf33750755f34d0e05b15428e","observation_id":"ed2376b4-e4d6-4a0e-b953-ef408c0214f2","resolution":{"observed_at":"2026-08-11T11:52:02.733618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.716854Z","title":"Beyond performance plateaus: A comprehensive study on scalability in speech enhancement,","venue":null,"work_id":"7eec40eb-5ed6-435f-a178-74767212cdb2","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.051608Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:ac5b6675b64dda703df259b4309a8abb597800f05dedf2ed78c4eebf9075b0ee","observation_id":"4b3ee41a-668b-4442-a8dc-de4323a1122f","resolution":{"observed_at":"2026-08-11T11:52:02.721060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.703527Z","title":"Complexity scaling for speech denoising,","venue":null,"work_id":"2a51b7ee-39f3-43b0-aa83-6a63d5ca0c9c","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.056368Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:35b0fa4166ecd0dcc58ed7d4afc485d19f225bda5b5da739f079a2a4bda05159","observation_id":"2e06e545-298b-4931-a730-c4601a8170bb","resolution":{"observed_at":"2026-08-11T11:52:02.708281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.688284Z","title":"The effect of training dataset size on discriminative and diffusion-based speech enhancement systems,","venue":null,"work_id":"9d83ea38-143f-4202-8bad-4b15e9cacd9a","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.060842Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:caefb9542183f2ddb0d1cdefd2dcc969b3eae16e1351e189dd076c0f066ccbe5","observation_id":"d65c85fc-b86f-4fd5-bca2-5ade30b1cb1d","resolution":{"observed_at":"2026-08-11T11:52:02.692772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.673531Z","title":"NaturalSpeech 3: Zero-shot speech synthesis with factorized codec and diffusion models,","venue":null,"work_id":"323620a6-02bd-442c-a018-32ef88c1a611","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.065964Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:9f7fee1008a3525b6d0e4e6b1bad8e8c885ee1a53334839ad4d2cd4fecd03bc8","observation_id":"f2fbab19-098d-4293-97b9-b3fecfe6a4cb","resolution":{"observed_at":"2026-08-11T11:52:02.678109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-11T11:52:02.070649Z","title":"Neural codec language models are zero-shot text to speech synthesizers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.070649Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:30559ba2ad0627a3fcefcfb38e745e2036757eb1d191c45f11a6d79d2e962d37","observation_id":"f351a62f-b996-4c87-acfb-5b03d6052eae","resolution":{"observed_at":"2026-08-11T11:52:02.070649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.658635Z","title":"V oicebox: Text- guided multilingual universal speech generation at scale,","venue":null,"work_id":"c472eeb9-87a4-480d-86be-4385dbdc8018","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.076292Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:b5720397fc3df9bc855fb23c58b25f60ac69a811ee1b6c816065de971ca72e39","observation_id":"d809cfac-26e4-4f6f-938a-f4c1bdbf24e0","resolution":{"observed_at":"2026-08-11T11:52:02.664160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.644991Z","title":"XTTS: A massively multilingual zero-shot text-to-speech model,","venue":null,"work_id":"e15dc074-a2f7-47e9-9267-5f214eb356df","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.081093Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:ce7634656ee544b95e7bbafeb45dd5d95885a5a6c04f0eb0061edc3089bb5771","observation_id":"682a8efb-6615-4a46-ba79-aa12c7499acb","resolution":{"observed_at":"2026-08-11T11:52:02.649729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-08-15T11:55:32.600679Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-08-11T11:52:02.085944Z","title":"Seed-TTS: A family of high-quality versatile speech generation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.085944Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:3c0b03daa5cb02d62d27205f82b6c09a9fc743d8f36f8187db34c5c77e2920d5","observation_id":"0b92ec8f-25d7-4e4b-8804-c34fff244045","resolution":{"observed_at":"2026-08-11T11:52:02.085944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08093","last_updated":"2024-02-15T18:57:26Z","snapshot_observed_at":"2026-08-16T20:07:00.407637Z","submitted_at":"2024-02-12T22:21:30Z","title":"BASE TTS: Lessons from building a billion-parameter Text-to-Speech model on 100K hours of data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08093","snapshot_observed_at":"2026-08-11T11:52:02.091428Z","title":"BASE TTS: Lessons from building a billion-parameter text-to-speech model on 100k hours of data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.091428Z"},"links":{"cited_paper":"/paper/2402.08093","citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:53b9d04646a2bee9f4ea71a8515082c2b5412cfba816fac0a489ae3a16478542","observation_id":"ce706718-366e-4f8b-8383-7fc2af091fc3","resolution":{"observed_at":"2026-08-11T11:52:02.091428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.629859Z","title":"SynthASR: Unlocking synthetic data for speech recogni- tion,","venue":null,"work_id":"016a6afd-21fd-48c6-94ed-58b10a74d48f","year":2021},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.097171Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:f96435b8abd7005fa4917767d7fcea2a4a67b9af630849394501ca6019e00920","observation_id":"6413e5e8-be8d-48ea-8d88-d50c9a897df7","resolution":{"observed_at":"2026-08-11T11:52:02.635044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.613918Z","title":"Deep generative models for synthetic data: A survey,","venue":null,"work_id":"32cae097-aa7f-4566-a1c9-2e2d0a9717e4","year":2023},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.101652Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:c569afe70c00fe7fba289ba3258d44dfce3d0038b817e91ca54fd241cad3d829","observation_id":"47f60589-8515-4150-8ab2-42914128b0e9","resolution":{"observed_at":"2026-08-11T11:52:02.619232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17997","last_updated":"2024-10-26T23:55:01Z","snapshot_observed_at":"2026-08-17T04:53:21.427269Z","submitted_at":"2024-07-25T12:44:45Z","title":"On the Effect of Purely Synthetic Training Data for Different Automatic Speech Recognition Architectures","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17997","snapshot_observed_at":"2026-08-11T11:52:02.106214Z","title":"On the effect of purely synthetic training data for different automatic speech recognition archi- tectures,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.106214Z"},"links":{"cited_paper":"/paper/2407.17997","citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:5008be13dfb68005d6fafea9aebc2b3a95f4f4a6db2c707976657d6b7ecd4afd","observation_id":"2eea7ee8-48b8-4bb9-8e91-9ee63f773130","resolution":{"observed_at":"2026-08-11T11:52:02.106214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.596993Z","title":"SynAug: Synthesis- based data augmentation for text-dependent speaker verification,","venue":null,"work_id":"856bb367-800e-45d6-ad1d-c068ebfd478d","year":2021},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.111072Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:a1841754004ec8354d6d5f7e9bd11c3b448a4e69c37f237b89eaa89a023d76bd","observation_id":"3880b1b4-f7d4-423c-8a4d-0969979c2298","resolution":{"observed_at":"2026-08-11T11:52:02.602191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.580499Z","title":"Speech enhancement using deep learning methods: A review,","venue":null,"work_id":"01fffaf5-3848-4e71-9bfa-806ee56dfc8a","year":2021},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.115633Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:ca8a44d131fd32892ffe7dd66343dad67030f60369d1c40e0cf1a701604ab81e","observation_id":"2b82fcff-b987-46e0-aa40-ddf218ee7415","resolution":{"observed_at":"2026-08-11T11:52:02.585561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.121155Z","title":"Conv-TasNet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.121155Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:006aafe6eda745012bc16d23ba179438158a1402ad93e46ff6f3e26727205f58","observation_id":"20e6c184-67ba-47b2-8cd3-8329ad5903a9","resolution":{"observed_at":"2026-08-11T11:52:02.121155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.557623Z","title":"Music source separation with band-split RNN,","venue":null,"work_id":"f63a080d-488b-4e99-9804-d5c2ffbc41c1","year":1901},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.126229Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:f20b4d7a1152ad0b151a2ad478b7dbb76ae3b7b107731d01fe97bca21ea6c9e9","observation_id":"3038e4d7-c93d-4705-b526-5d88c6a2490f","resolution":{"observed_at":"2026-08-11T11:52:02.561999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.131773Z","title":"Speech enhancement and dereverberation with diffusion-based genera- tive models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.131773Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:a24dfbb08fc4486eb04c4dd015c6ec9cf58084f49423d8cbb0819623e83b7ba3","observation_id":"c5a9e386-b460-42ab-931d-d1442b4d408c","resolution":{"observed_at":"2026-08-11T11:52:02.131773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.535757Z","title":"DDTSE: Discriminative diffusion model for target speech extraction,","venue":null,"work_id":"18d25dfc-8f5e-4e61-ac05-e6496ffa916f","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.137349Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:677300f1346515c0e07bdd32de1404624761a7469db79ddd6a233ab258f2a61b","observation_id":"c04641b3-c136-4aae-8408-a429a73269a8","resolution":{"observed_at":"2026-08-11T11:52:02.541300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.522993Z","title":"Conditional diffusion probabilistic model for speech enhancement,","venue":null,"work_id":"b5101750-92b7-490a-ad48-27b4f12599f8","year":2022},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.143025Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:30dfea533bba1a100ba4c910fdf75d75921b6e416b3aaa6dd84b8fc41b9b2c1f","observation_id":"92d5a7c0-84ce-439c-9c7a-d88396ab9c93","resolution":{"observed_at":"2026-08-11T11:52:02.527505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13471","last_updated":"2024-06-19T11:51:37Z","snapshot_observed_at":"2026-08-16T15:43:45.564496Z","submitted_at":"2024-06-19T11:51:37Z","title":"Diffusion-based Generative Modeling with Discriminative Guidance for Streamable Speech Enhancement","version":1},"cited_work":{"arxiv_id":"2406.13471","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.13471","snapshot_observed_at":"2026-08-11T11:52:02.261496Z","title":"Diffusion-based Generative Modeling with Discriminative Guidance for Streamable Speech Enhancement","venue":"eess.AS","work_id":"fb11c27a-a5f1-4f94-bd47-2a6cc1b2f5f3","year":2024},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.148300Z"},"links":{"cited_paper":"/paper/2406.13471","citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:cfc13e6ba9ea135feb20bc58e44abdad31e44cd1e4934ded53cf3669c8351e57","observation_id":"96fa7e95-dda6-4de2-b2ae-c430ed53d386","resolution":{"observed_at":"2026-08-11T11:52:02.267824Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.11262","last_updated":"2020-05-22T16:26:54Z","snapshot_observed_at":"2026-08-15T22:07:29.787968Z","submitted_at":"2020-05-22T16:26:54Z","title":"LibriMix: An Open-Source Dataset for Generalizable Speech Separation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.11262","snapshot_observed_at":"2026-08-11T11:52:02.153325Z","title":"Librimix: An open-source dataset for generalizable speech separation,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.153325Z"},"links":{"cited_paper":"/paper/2005.11262","citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:e75359acc730a1309bd2b5dc87f39ce726c45174e2da82c7ab49f2efe5186f5a","observation_id":"9b206c6c-41e4-4e62-9b8a-9e0cee88fcb7","resolution":{"observed_at":"2026-08-11T11:52:02.153325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.158220Z","title":"Librispeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.158220Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:fb38c24ea8326dd58f3a5f591b93f2b166bcd1fadef960d92157feb58d963ed8","observation_id":"572fc6ed-931b-4986-875a-2fa7c88f25bb","resolution":{"observed_at":"2026-08-11T11:52:02.158220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.496444Z","title":"WHAM!: Extending speech separation to noisy environments,","venue":null,"work_id":"1759fb1b-4916-4e4f-9b40-bab86d0be9dc","year":2019},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.163276Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:7385f6a6dcc96c81f78eb9e2ca782ad0e5ef736959b616233f390e3f2430cd54","observation_id":"e2b67349-0a6b-4171-a72f-8a91272ec476","resolution":{"observed_at":"2026-08-11T11:52:02.501884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.480837Z","title":"TUT database for acoustic scene classification and sound event detection,","venue":null,"work_id":"dc027a9c-07a9-4f42-8685-605e26a7ff2b","year":2016},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.167476Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:88db13ef42adc67eb0d985344e07328a8ffae771a3d700cccc9670bea2ec8a3f","observation_id":"e77cfd80-1703-48b5-b645-438bddb33f96","resolution":{"observed_at":"2026-08-11T11:52:02.486295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.464995Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":"6da982ec-bf32-433f-9593-124de5ab659c","year":2020},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.171864Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:fd6006f39069c15922d7f5803eadd6d4e9c063ca7165d06ad793d180c4239277","observation_id":"fa5ca55c-2209-4efd-9650-ca695629e633","resolution":{"observed_at":"2026-08-11T11:52:02.469919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.451306Z","title":"ESPnet- SE: End-to-end speech enhancement and separation toolkit designed for ASR integration,","venue":null,"work_id":"ca829d39-5b8e-4245-a001-83cadef3f546","year":2021},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.176450Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:fae85f911b8d66774820ea1be89d1d275efac24544dcf2c193dc7412cef6a436","observation_id":"7bec1413-8bb8-4021-805c-b54d83c1d687","resolution":{"observed_at":"2026-08-11T11:52:02.456196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.437011Z","title":"Freesound datasets: A platform for the creation of open audio datasets,","venue":null,"work_id":"57088fa3-5081-4aed-be02-5ce09b8b31d2","year":2017},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.181295Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:30e58152bb6545870cbba16ca9242d886dec296b6c28d38dd2fc605e88ccc7a9","observation_id":"a1fbb37d-d8dc-4b9f-ae44-7846399c4830","resolution":{"observed_at":"2026-08-11T11:52:02.442371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.420764Z","title":"Audio set: An ontology and human- labeled dataset for audio events,","venue":null,"work_id":"65c882ed-c7e7-4578-96fc-f8c2829d41ab","year":2017},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.185547Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:6be3b8f63aad06374bac53d1dda1fb0e9e5fb6f9e089611bea2268ff07ce7c01","observation_id":"0ecf8c74-8e07-4aba-afbc-25b1f04e40ba","resolution":{"observed_at":"2026-08-11T11:52:02.426314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.403385Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":"379786dd-c01f-4ddc-a653-df4675e15039","year":2001},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.190446Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:bc05b3611a46d5e33f9ac737064786a3202618da5bbe9280425b7ec8ef1d6bf0","observation_id":"78429498-d8b2-4317-aa59-12a532b08ed5","resolution":{"observed_at":"2026-08-11T11:52:02.409117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.194971Z","title":"An algorithm for predicting the intelligibility of speech masked by modulated noise maskers,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.194971Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:8833e428ecff038c5fbb093807471a20823bcae4b5effa589d7839278955b330","observation_id":"7bb1bff7-a674-47ad-8515-865f963ee91b","resolution":{"observed_at":"2026-08-11T11:52:02.194971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.369678Z","title":"Performance measurement in blind audio source separation,","venue":null,"work_id":"43c64bfa-4058-4957-8a7d-220058a90159","year":2006},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.199574Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:97e2a55559e10ca10e0a5c4b2a5832506b8863709f7e4e4358f1c32dd6354d5f","observation_id":"6946ca85-01d5-4245-9b20-b045af5ec7f8","resolution":{"observed_at":"2026-08-11T11:52:02.374604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.355059Z","title":"DNSMOS: A non-intrusive perceptual objective speech quality metric to evaluate noise suppressors,","venue":null,"work_id":"6aa81c97-5d45-4c89-a21b-306062821da9","year":2021},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.203935Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:825529a84b6960f4e8a6ec7b34837d61277849965b462296da0b230c8df9d9a3","observation_id":"33c0ce8f-ecc4-4c3a-9ddc-c30cef0f8d25","resolution":{"observed_at":"2026-08-11T11:52:02.359508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:52:02.338222Z","title":"Comparative intelligibility investigation of single-channel noise-reduction algorithms for Chinese, Japanese, and English,","venue":null,"work_id":"237d9ac6-8bd6-4d28-9a49-9d11479f45c4","year":2011},"citing_paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T11:52:02.208288Z"},"links":{"citing_paper":"/paper/2412.14890"},"observation_digest":"sha256:173e36d8301cdd570704b5152231a86366cc57dee5d90ef473ac51837093d8fa","observation_id":"6bd4f2ca-60b1-40aa-a41d-5da8d227ff4e","resolution":{"observed_at":"2026-08-11T11:52:02.344458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.14890","last_updated":"2024-12-19T14:21:51Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T22:08:17.555534Z","submitted_at":"2024-12-19T14:21:51Z","title":"Scale This, Not That: Investigating Key Dataset Attributes for Efficient Speech Enhancement Scaling"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 1 inbound Pith citation observation for arXiv:2412.14890."}