{"as_of":"2026-08-08T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7890128b240c5a8adc48d17ae6c5ad045aed1dbf9ba62101c2b3464a07a97f89","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:47:43.772071Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20140/citation-record","integrity":"/paper/2507.20140/integrity","json":"/paper/2507.20140/citation-record.json","paper":"/paper/2507.20140"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.767995Z","title":null,"venue":null,"work_id":"d2ee0e82-724b-44e5-b41a-c2fa241e9f32","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.633765Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:5b671e35c04736f89748e5aa026acaa2ab3e1683540f31a59f3a3664e8f1fc83","observation_id":"d40a9b31-c119-4ed0-88b8-21dc5ebb35a5","resolution":{"observed_at":"2026-08-06T13:47:44.827950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:41.949882Z","title":"doi: 10.1609/aaai.v37i6.25879","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.949882Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:1afe2b4bb595bdd60b3768e18d8fde72806444c89a5172bb67c0c14102d9fa6c","observation_id":"b29818ce-0729-4898-a85e-273c51b2fe3a","resolution":{"observed_at":"2026-08-06T13:47:41.949882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.054073Z","title":"doi: 10.18653/v1/2023.acl-long.805","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.054073Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:c7578c5d7bdd24533885fe2f60ec00e05d4dbb15f42995fe602611d53e4dacc6","observation_id":"6ac6d32b-ed8b-4adf-be23-e5b026d2a0af","resolution":{"observed_at":"2026-08-06T13:47:42.054073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.394351Z","title":"Libri-light: A benchmark for asr with limited or no supervision","venue":null,"work_id":"aee54d6b-eb98-45d9-befc-07da1d68f011","year":2020},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.125593Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:5217c4f226c4065a04c697687e897cc190b1ce2e6afcd64d1e6047b485054e04","observation_id":"3055b33c-5e10-40eb-a43c-eade073635b0","resolution":{"observed_at":"2026-08-06T13:47:47.568271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.198678Z","title":"Kong, J., Kim, J., and Bae, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.198678Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:3fd90267d097224635d0f394cced2fd9f093ee70519973b81792def2204fa456","observation_id":"f9de93c8-b3cf-44df-bcc3-0546764776fd","resolution":{"observed_at":"2026-08-06T13:47:42.198678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16835","last_updated":"2024-02-26T18:57:37Z","snapshot_observed_at":"2026-08-08T00:43:51.702314Z","submitted_at":"2024-02-26T18:57:37Z","title":"Eight Methods to Evaluate Robust Unlearning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16835","snapshot_observed_at":"2026-08-06T13:47:42.330926Z","title":"Eight methods to evaluate robust unlearning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.330926Z"},"links":{"cited_paper":"/paper/2402.16835","citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:e9936af43be81409dc3480f36a7e214f233ef48ec366f6e6fa6e6fefc02a5cea","observation_id":"32238566-cc39-47bd-868c-dbd8e7220f39","resolution":{"observed_at":"2026-08-06T13:47:42.330926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.077139Z","title":"C., and Kolter, J","venue":null,"work_id":"8b5df49f-b484-47d3-a018-f8bba9b91ec9","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.411924Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:94e2fb223b715f36ceedaaf15d4408cd6b2d212d244e9687f033a28e8d28b268","observation_id":"6f6cf54a-a5c2-47be-9249-756c0b8c7423","resolution":{"observed_at":"2026-08-06T13:47:47.224196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.03458","last_updated":"2019-07-08T08:42:42Z","snapshot_observed_at":"2026-07-06T08:05:45.616325Z","submitted_at":"2019-07-08T08:42:42Z","title":"The GDPR & Speech Data: Reflections of Legal and Technology Communities, First Steps towards a Common Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.03458","snapshot_observed_at":"2026-08-06T13:47:42.637957Z","title":"The gdpr & speech data: Re- flections of legal and technology communities, first steps towards a common understanding","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.637957Z"},"links":{"cited_paper":"/paper/1907.03458","citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:3b0272dbc340e33123cf03fb95445f988e59da67be42ee57475a96950333ae4c","observation_id":"39d41a1d-eef3-4104-8210-3e2ed0bcf430","resolution":{"observed_at":"2026-08-06T13:47:42.637957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.571794Z","title":"Librispeech: An asr corpus based on public domain au- dio books","venue":null,"work_id":"82ebf87e-d2b4-40e6-8ef8-585efccd4d53","year":2015},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.868422Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:64ffebfb2953b694f302d1b5b7be6acd4ff954fa3d26abf03cb56bfe952e0053","observation_id":"5d6ce624-d95d-44e2-a15a-764183e659ba","resolution":{"observed_at":"2026-08-06T13:47:46.680283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.306629Z","title":"Regulation (eu) 2016/679 of the european parliament and of the council","venue":null,"work_id":"c599261a-d8c0-4d30-a33c-5777946d92c8","year":2016},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.061070Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:46b889742afc4467f099e971d0b74d2f93db069b46273075e0c74a4bd0e15106","observation_id":"8cecd3c1-baf4-46c5-9d0f-f4e5220a3c65","resolution":{"observed_at":"2026-08-06T13:47:46.448277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.090741Z","title":"Unrolling sgd: Understanding factors influencing ma- chine unlearning","venue":null,"work_id":"c5ec3a34-6235-4ea1-8a9c-ebfe0b006118","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.109971Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:1685bb5a3b3afb51a7bf7d59cc5241d31b67fc2dd838a646721412645a705fd7","observation_id":"47356c61-a435-4ec1-931b-6c280f7021b2","resolution":{"observed_at":"2026-08-06T13:47:46.179620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.868139Z","title":null,"venue":null,"work_id":"7b28aa83-3da9-49e6-9d33-4248def08ced","year":2020},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.180454Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:9c53f147286f89909d144c0580fb175b026e229ca0f86ab1403d65e41630fd05","observation_id":"e11715fc-b976-4333-a779-09eaee7b731e","resolution":{"observed_at":"2026-08-06T13:47:45.969897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.698120Z","title":"The voiceprivacy 2024 challenge evaluation plan","venue":null,"work_id":"95a618d2-4818-435f-8956-b3345162a47d","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.258377Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:aaa96dc60ad5d32f9f533e2e78a9f2681c6299ea696045268ca0a1b53c7e2925","observation_id":"eb39564e-9b02-4a83-97b1-e6648b1cf99b","resolution":{"observed_at":"2026-08-06T13:47:45.760368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.521561Z","title":"Ma- chine unlearning of features and labels","venue":null,"work_id":"1016da36-9383-4e2a-9d43-18ad2c4dc1d9","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.335721Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:cee0e7e7568473ce14f6a949aa2f7fb63409a4c388ad13334f8de887e7332993","observation_id":"90518fba-7004-4b9f-a3c9-9578959d9a1a","resolution":{"observed_at":"2026-08-06T13:47:45.587398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.330418Z","title":"Forget- me-not: Learning to forget in text-to-image diffusion models","venue":null,"work_id":"585ebb55-8512-4283-bd4d-003ae6f9ec39","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.408858Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:26ef3c9284dd74039154f78fda72406cdbea46717fba5765333776be64492065","observation_id":"6e93f037-9142-413c-a4e8-a48d69b5c274","resolution":{"observed_at":"2026-08-06T13:47:45.407571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.178284Z","title":null,"venue":null,"work_id":"8ef9f381-e63e-4fd0-8e2a-ea665e5c442c","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.495845Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:529f9449e5255a3c0f07ddbb2d4e7c98822ea342029fe7c477a3c77f3b3e5a76","observation_id":"65624a8c-696e-4794-80fa-cb2fc6bacf4b","resolution":{"observed_at":"2026-08-06T13:47:45.245269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.960358Z","title":null,"venue":null,"work_id":"12ef487f-4af8-454b-8bf8-6ee352a68033","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.568933Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:54b645ba1b910717e88006a3209a605bed13370f63711f8d64e71124e2250da1","observation_id":"1f71f391-e618-4ce8-b6bb-abbbcce105ff","resolution":{"observed_at":"2026-08-06T13:47:45.062315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.604882Z","title":"From LibriSpeech test-clean dataset samples of durations 4 to 10 seconds, we construct noise at a -10dB signal-to-noise ratio over half of each sample’s duration","venue":null,"work_id":"040a2477-d62a-4cde-afe1-e1d1147a6d1d","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.706546Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:d81a737fc905042b29dd97f20f3a256b6d48af5c760c81758ba9ef6ccac005fa","observation_id":"71ca581e-8769-4c08-81e1-f2b46c217bf9","resolution":{"observed_at":"2026-08-06T13:47:44.681590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.401434Z","title":"WER and SIM evaluation follows the procedures of Table1","venue":null,"work_id":"c0d1f20a-b484-4703-a210-7905aeffcb75","year":2019},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.772071Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:3dc90035c72ef78fecb0c8f09f5af1fe5368dcc23a1994695410d955307d59d1","observation_id":"b9b10ca2-40d8-4a35-81ca-57f60e4c258b","resolution":{"observed_at":"2026-08-06T13:47:44.519820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.259727Z","title":"doi: 10.1109/18.61115","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.259727Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:935bf2583392e307c3d2ab8d9471a9cac510e25fd72d8643509cc469f8b73d5d","observation_id":"40f3456b-9473-4aef-9889-d21bed54cb8a","resolution":{"observed_at":"2026-08-06T13:47:42.259727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.780308Z","title":"Montreal forced aligner: Trainable text- speech alignment using kaldi","venue":null,"work_id":"94638309-1ba8-4abf-8ba8-6dbb56cf9a68","year":2017},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.485745Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:c0254dda554eddff4e4f2004fce9dd546a418a0be8e7d5d61755282953b2930d","observation_id":"1a510928-e14f-4ac9-b5e8-203f78517346","resolution":{"observed_at":"2026-08-06T13:47:46.945251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.958499Z","title":"Press, O., Smith, N","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.958499Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:3f9b2895e6011b42789a5ac30d9d72cc7f97022c2c0c52331294dae387d2dd9d","observation_id":"be97f314-a3e2-48fc-8aa9-2b714995b873","resolution":{"observed_at":"2026-08-06T13:47:42.958499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.559914Z","title":"the right to be forgotten","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.559914Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:7132a9d3581cfc2223e1879e8ddb6c97c7753280540dbdc5a772ed90484802b3","observation_id":"c3fc0525-ac3f-421b-9367-4bf3b7ce8265","resolution":{"observed_at":"2026-08-06T13:47:42.559914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:41.873389Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing","venue":null,"work_id":null,"year":1941},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.873389Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:8b780202dc1864c75043fd649534a76028c34811860a4d577a956381dd3367bf","observation_id":"8b57ef5a-c87f-4198-a65a-6338ec5c8d39","resolution":{"observed_at":"2026-08-06T13:47:41.873389Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.766351Z","title":"A., Jia, H., Travers, A., Zhang, B., Lie, D., and Papernot, 9 Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech N","venue":null,"work_id":"583a02e3-381f-410d-b2ac-97b226116936","year":2021},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.730513Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:ac06b12d51529619b4171aa65e1c9182983b0fdee00d73ef85b4186ea1aed620","observation_id":"2fd62a0b-f382-4f33-acff-fc86a14397b6","resolution":{"observed_at":"2026-08-06T13:47:47.879513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.953544Z","title":"Five years of the right to be forgotten","venue":null,"work_id":"10f4e063-c2b9-4713-a8dc-d84531d88985","year":2019},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.643940Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:46cceeb60a1ac040102046c16c993fe36282d1f7a4747c32296b643678f230c0","observation_id":"1a753c89-6590-40f2-a33a-8c9559047c57","resolution":{"observed_at":"2026-08-06T13:47:48.016885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.627634Z","title":"Graph unlearning","venue":null,"work_id":"0009c80a-68ec-4276-95b4-fc4e37c987f6","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.793216Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:d4b7458ebe0c99d0649a26099519e75e2288a98d805475a3b2a9a8c123eaf016","observation_id":"f297f6d6-6001-474b-a855-f9323938f005","resolution":{"observed_at":"2026-08-06T13:47:47.735720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T13:47:41.998231Z","title":"and Salimans, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.998231Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:b7cb29bdf4074611aca827b01fd0c66bb99aba50a4aca924239078c322b72d41","observation_id":"c8a2759a-603d-4b9a-a3db-49445ae2a5aa","resolution":{"observed_at":"2026-08-06T13:47:41.998231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.742031Z","title":"doi: 10.1145/3749987","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.742031Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:d9944628390335516930c74196488d7b505391336ce958ec2ac2e781b9e33d5e","observation_id":"fcc5f29b-33e2-497e-a584-63df39c48703","resolution":{"observed_at":"2026-08-06T13:47:42.742031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2507.20140."}