{"as_of":"2026-08-08T03:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:038002cda4d9b05cf1e251fcb05c2e25b272cafcc4a469e63fd04bbf425a1e0f","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:30:36.600275Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:30:33.930912Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15004","snapshot_observed_at":"2026-08-07T15:30:33.930912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:33.930912Z"},"links":{"cited_paper":"/paper/2505.15004","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:e005acacf332e99ce0d78be82d54963c73f45e4f0268f8cec3741c52fa8bb503","observation_id":"198e4187-60d1-40ae-909a-e47c601fccc9","resolution":{"observed_at":"2026-08-07T15:30:33.930912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"cited_work":{"arxiv_id":"2505.15004","doi":"10.48550/arxiv.2505.15004","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15004","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2505.15004 , abstract =","venue":"ArXiv.org","work_id":"c4b24c83-5317-48d5-8231-0bb3c3c0e885","year":null},"citing_paper":{"arxiv_id":"2606.00407","last_updated":"2026-05-29T22:49:56Z","snapshot_observed_at":"2026-08-04T15:20:49.286788Z","submitted_at":"2026-05-29T22:49:56Z","title":"Privacy-preserving Prosody Representation Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-28T20:32:36.085961Z"},"links":{"cited_paper":"/paper/2505.15004","citing_paper":"/paper/2606.00407"},"observation_digest":"sha256:bfc730f2f3562094e822a83f24c35fc91bfd2df8deb5d0fb767291094065d31d","observation_id":"66f1d654-5490-4031-a209-8dfe8f04af9a","resolution":{"observed_at":"2026-06-28T20:42:37.027025Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15004/citation-record","integrity":"/paper/2505.15004/integrity","json":"/paper/2505.15004/citation-record.json","paper":"/paper/2505.15004"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15004","snapshot_observed_at":"2026-08-07T15:30:33.930912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:33.930912Z"},"links":{"cited_paper":"/paper/2505.15004","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:e005acacf332e99ce0d78be82d54963c73f45e4f0268f8cec3741c52fa8bb503","observation_id":"198e4187-60d1-40ae-909a-e47c601fccc9","resolution":{"observed_at":"2026-08-07T15:30:33.930912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.035445Z","title":null,"venue":null,"work_id":"a733f754-0665-4a0f-b762-3fdad09685c8","year":null},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:33.970569Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:f959fef379d6ccd9b895254370c267df848ba520edd6f0ff39cdf80ff833a2cb","observation_id":"c4b4d3a8-cc93-48e3-82ca-ec9b269ac95b","resolution":{"observed_at":"2026-08-07T15:30:37.038410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.024821Z","title":"Dataset We train EASY using the training portions of both the Lib- riSpeech [28] and LibriTTS [29] corpora","venue":null,"work_id":"2f3dd8c1-f303-4f9b-8fd1-858cde10452e","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.072220Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:2d2f6a7d108fd350b83d444102351d7b797a95a68eed7a46356c968fb648f638","observation_id":"970dbd83-bc31-49fc-8382-fffd9df50f81","resolution":{"observed_at":"2026-08-07T15:30:37.028658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.013219Z","title":null,"venue":null,"work_id":"f8ab08b8-e326-481e-9dab-74dc84497849","year":null},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.140325Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:1b1a89f36014f8a4d619594d99dba08a72806848f810d67430a82374184f9523","observation_id":"874e0e59-c6ca-4602-95d0-4acc4c7f64e3","resolution":{"observed_at":"2026-08-07T15:30:37.016844Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.002833Z","title":"Speaker identity is first disentangled using a supervised classifier, producing a speaker-independent representation","venue":null,"work_id":"5d12e90e-44dd-4059-9d88-4e78860d97e8","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.315191Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:5971ec6493ceb0a2fd477ab08a0eb7a5c5f07efbdc69ad45e5f6306252a3e701","observation_id":"53901543-c9d8-41f4-b434-e7b55d07a359","resolution":{"observed_at":"2026-08-07T15:30:37.006358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.992196Z","title":null,"venue":null,"work_id":"27d1bba8-9907-4d2c-af3e-1f3f164bce15","year":null},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.497940Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:18169902dc0f5d30fcca07a6b58694ce738276564d2d92bc37eafb1a89e43b35","observation_id":"96e2530a-9857-4d2f-97a5-9a2746081b89","resolution":{"observed_at":"2026-08-07T15:30:36.995560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.981100Z","title":null,"venue":null,"work_id":"dd39cac5-10c5-4db6-a995-cff206523a57","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.639183Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:7318bbdeac2b8cb843aeffc4af479bf38d233cbc9692d1f97bf88fb9e60883b0","observation_id":"ee9b3edb-3147-4912-ad71-262c7aebca6b","resolution":{"observed_at":"2026-08-07T15:30:36.984332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-07T15:30:34.761517Z","title":"Moshi: a speech-text foundation model for real-time dialogue,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.761517Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:44fd789549aeb3d94bbc095a7d8ce2196cba55056ace1b9b68b1e8b754d00668","observation_id":"2c6be2a3-d5e2-4a77-a880-eda5ccc1eb85","resolution":{"observed_at":"2026-08-07T15:30:34.761517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16725","last_updated":"2024-11-05T02:24:18Z","snapshot_observed_at":"2026-07-06T19:07:46.545514Z","submitted_at":"2024-08-29T17:18:53Z","title":"Mini-Omni: Language Models Can Hear, Talk While Thinking in Streaming","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16725","snapshot_observed_at":"2026-08-07T15:30:34.872228Z","title":"Mini-omni: Language models can hear, talk while thinking in streaming,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.872228Z"},"links":{"cited_paper":"/paper/2408.16725","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:433355394c579eda8c60c011fe2cc73ce147c020c8efa80bc78e7ad127ba0dde","observation_id":"30413a33-0c12-489e-aee1-2006289fca67","resolution":{"observed_at":"2026-08-07T15:30:34.872228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05928","last_updated":"2025-04-23T00:44:18Z","snapshot_observed_at":"2026-08-04T00:45:37.646375Z","submitted_at":"2024-08-12T05:40:21Z","title":"Adapting General Disentanglement-Based Speaker Anonymization for Enhanced Emotion Preservation","version":2},"cited_work":{"arxiv_id":"2408.05928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.05928","snapshot_observed_at":"2026-08-07T15:30:36.753539Z","title":"Adapting General Disentanglement-Based Speaker Anonymization for Enhanced Emotion Preservation","venue":"cs.SD","work_id":"e8c565be-96b2-412e-bbfc-20a1a13893a0","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.993617Z"},"links":{"cited_paper":"/paper/2408.05928","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:52dab259ba5ab75d172205e81d7c3026cd22793e0f149d53509160d04bb7da73","observation_id":"4f8e7d93-e3ec-4553-9f37-a35982475fb3","resolution":{"observed_at":"2026-08-07T15:30:36.757607Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.970742Z","title":"The voiceprivacy 2020 challenge: Results and findings,","venue":null,"work_id":"f3a35746-04ef-479b-83b1-339c7fab22a0","year":2020},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.054353Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:89e7f215b70789ff7dc0ea87abef1f73177f86e619673b24f6fbb26973e83d0d","observation_id":"420119ee-e7bb-4689-b2db-1c10dbc7721d","resolution":{"observed_at":"2026-08-07T15:30:36.974239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.960218Z","title":"The voiceprivacy 2022 challenge: Progress and perspec- tives in voice anonymisation,","venue":null,"work_id":"b9fe68d7-4cf2-40f6-806e-7f98f2edf587","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.058080Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:9812d1ea5519f352eb8b6ec1a3fb55a3c8793614215d057c66836bba13920c2f","observation_id":"d4856ac8-a685-4b28-bbf7-77558d383de7","resolution":{"observed_at":"2026-08-07T15:30:36.963920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02677","last_updated":"2024-06-12T14:05:43Z","snapshot_observed_at":"2026-07-06T17:55:03.561275Z","submitted_at":"2024-04-03T12:20:51Z","title":"The VoicePrivacy 2024 Challenge Evaluation Plan","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02677","snapshot_observed_at":"2026-08-07T15:30:35.135306Z","title":"The voiceprivacy 2024 challenge evaluation plan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.135306Z"},"links":{"cited_paper":"/paper/2404.02677","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:6077d6f532d67e707f81559a9f98b2ba6c77a1f3b6b8c762eb867cb48de5234b","observation_id":"fdfaab5b-a642-4136-953a-348acff1100d","resolution":{"observed_at":"2026-08-07T15:30:35.135306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.949150Z","title":"Speaker anonymisation using the mcadams co- efficient,","venue":null,"work_id":"5246e879-59df-46cf-8ab2-ba60e8bb6477","year":2021},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.206394Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:5cfb789c1f6a18c5750e0aebdbc059d07b47b2c0c75e4b783beea0a9f762ceef","observation_id":"253d0efc-150c-4113-bcfe-5c663207518f","resolution":{"observed_at":"2026-08-07T15:30:36.953226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:35.265049Z","title":"Improving speaker de-identification with functional data analysis of f0 trajectories,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.265049Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:5c909a318058dc8c471959bd48d4c98b3a6dc83bb758c022717dc92ce95251f4","observation_id":"87a6899c-0e43-449c-94a4-be0bb4670658","resolution":{"observed_at":"2026-08-07T15:30:35.265049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.932825Z","title":"Speaker anonymiza- tion by pitch shifting based on time-scale modification,","venue":null,"work_id":"07d1b648-460c-4e04-9713-4a3b3cb6e767","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.319225Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:1e62648d2c61cbe78f418852d43140c90840c31adeadb8b32035fc66509674a0","observation_id":"e846ce8b-9eab-4c13-8aa5-9f3e0bca68f4","resolution":{"observed_at":"2026-08-07T15:30:36.935949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.922017Z","title":"Privacy and utility of x-vector based speaker anonymiza- tion,","venue":null,"work_id":"4fc484ba-ed24-461c-859f-d08df0b4ce0d","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.381806Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:b4dd765d74fb04caf4fa107512e8fb88c9249e2bef5cf3e6b646a456f0bb8c06","observation_id":"a5474b93-e62c-46d4-ad54-6957a291fd48","resolution":{"observed_at":"2026-08-07T15:30:36.926325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18823","last_updated":"2023-09-13T01:21:34Z","snapshot_observed_at":"2026-08-02T05:27:42.730435Z","submitted_at":"2023-05-30T08:16:10Z","title":"Speaker anonymization using orthogonal Householder neural network","version":2},"cited_work":{"arxiv_id":"2305.18823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.18823","snapshot_observed_at":"2026-08-07T15:30:36.727479Z","title":"Speaker anonymization using orthogonal Householder neural network","venue":"cs.SD","work_id":"40acd0b1-19bd-4acb-9958-2fd505ad2187","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.444294Z"},"links":{"cited_paper":"/paper/2305.18823","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:6c5ad142f7287fcd36a482520fcba2a3b92589094f1f341cbb8e2815285df140","observation_id":"47de9b19-db89-43dd-bc52-cc27d3f2127f","resolution":{"observed_at":"2026-08-07T15:30:36.731285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.910815Z","title":"Dis- tinguishable speaker anonymization based on formant and fun- damental frequency scaling,","venue":null,"work_id":"49bcf749-a9b2-4d11-a2d5-ccbad907d002","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.516656Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:300283cd5a3b31e8289466c7730480cbb9273c3c2a479daae3ad7f520ba8cd31","observation_id":"a70635d3-d9a2-4f20-83f6-dbbfdea6964e","resolution":{"observed_at":"2026-08-07T15:30:36.914745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.900426Z","title":"Prosody is not identity: A speaker anonymization approach using prosody cloning,","venue":null,"work_id":"f96bdc54-b4c0-4543-bcf4-925fba8798cc","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.555826Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:7e7347ebac24c2ec7ec5d53471864a37b9f777a380b132c8fc67e13d159b979f","observation_id":"e654ac20-bf51-4086-bae9-c4e64a453260","resolution":{"observed_at":"2026-08-07T15:30:36.903851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.889837Z","title":"Distinctive and natural speaker anonymization via singular value transformation- assisted matrix,","venue":null,"work_id":"0e7d4c1b-05dd-47da-9565-d5b2f776049f","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.639921Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:07669a4564b6fdd956c9f17ae6e3470453c7a40489dc54499d7e5316d3641e77","observation_id":"192a6bfd-f099-4980-a6d1-2a9d47d64857","resolution":{"observed_at":"2026-08-07T15:30:36.893073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.879901Z","title":"Speaker anonymization using neural audio codec language models,","venue":null,"work_id":"31129f67-6351-4c43-a4ac-f45b3dec0c9d","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.740288Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:d8a239a3732fb9fd33404d64f41a8b9ce88095ed88447d563979ca0453b92f0d","observation_id":"fa6c6e0d-30bf-408a-9f75-aa345bb68551","resolution":{"observed_at":"2026-08-07T15:30:36.883456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.869037Z","title":"MUSA: Multi-lingual speaker anonymization via serial disen- tanglement,","venue":null,"work_id":"38755116-985d-45f2-88dc-91a5593b7b6a","year":2025},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.813385Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:f6b67b8698c584bf4f104645b4a93551f28556d79343d159d935da040ae6fea6","observation_id":"7d3bc3c6-f7b9-4d17-9c11-db7f28aacd36","resolution":{"observed_at":"2026-08-07T15:30:36.873028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.858452Z","title":"Salt: Dis- tinguishable speaker anonymization through latent space transfor- mation,","venue":null,"work_id":"24260ada-470b-4ddc-86fb-236b99fd401b","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.949038Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:2c73f29e1b3c404676c86179e69e1893c45a819cb3c9e25ced9cf0d584a98739","observation_id":"eb0be5cd-d109-4d0d-b926-0902266a4081","resolution":{"observed_at":"2026-08-07T15:30:36.862252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11969","last_updated":"2022-09-24T09:36:43Z","snapshot_observed_at":"2026-08-06T13:31:56.854924Z","submitted_at":"2022-09-24T09:36:43Z","title":"NWPU-ASLP System for the VoicePrivacy 2022 Challenge","version":1},"cited_work":{"arxiv_id":"2209.11969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.11969","snapshot_observed_at":"2026-08-07T15:30:36.708828Z","title":"NWPU-ASLP System for the VoicePrivacy 2022 Challenge","venue":"eess.AS","work_id":"676cd58f-0b9c-4b73-ab74-57dbe9f741f9","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.002336Z"},"links":{"cited_paper":"/paper/2209.11969","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:b46c58f333a8211d9f7cafe384f72f285964df7454f4834013a2d5cd89569f15","observation_id":"42ba75be-8371-4866-b3b4-c8deeb91e9e7","resolution":{"observed_at":"2026-08-07T15:30:36.715710Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04173","last_updated":"2025-02-04T08:43:31Z","snapshot_observed_at":"2026-07-06T19:11:27.624528Z","submitted_at":"2024-09-06T10:32:42Z","title":"NPU-NTU System for Voice Privacy 2024 Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04173","snapshot_observed_at":"2026-08-07T15:30:36.064371Z","title":"NPU-NTU system for voice privacy 2024 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.064371Z"},"links":{"cited_paper":"/paper/2409.04173","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:e53e35c2dfc6d7cf8c3c2ef59b10a3bb6d5d8c041277e385b5e14d4f7eb6b574","observation_id":"ec6480a6-fcad-4548-bd3d-74723a45db51","resolution":{"observed_at":"2026-08-07T15:30:36.064371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.073990Z","title":"WavLM: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.073990Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:006525a8cf32d3fecfb62bdaebcea0a4b18427807d761cfa23bdfc1d6af398a2","observation_id":"820d4c77-a299-429b-8aa1-25d957227a7e","resolution":{"observed_at":"2026-08-07T15:30:36.073990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15185","last_updated":"2023-12-23T07:46:55Z","snapshot_observed_at":"2026-08-08T00:25:44.100410Z","submitted_at":"2023-12-23T07:46:55Z","title":"emotion2vec: Self-Supervised Pre-Training for Speech Emotion Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15185","snapshot_observed_at":"2026-08-07T15:30:36.078119Z","title":"Emotion2vec: Self-supervised pre-training for speech emotion representation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.078119Z"},"links":{"cited_paper":"/paper/2312.15185","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:ce8d4bab6be970b19589c8c92c152d9d97747b0348ef32ca68bc0410bdb9f71d","observation_id":"4f619372-433f-4e44-baf3-81c64b1af81b","resolution":{"observed_at":"2026-08-07T15:30:36.078119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.840185Z","title":"Language modeling with gated convolutional networks,","venue":null,"work_id":"a587101b-4140-4ea1-ac23-214eb1553070","year":2017},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.091664Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:d251fd875125cbd36cb97716b379f2562c8ae2082dcb03ad2aed9a0d65ec1685","observation_id":"8315c05d-acaa-4d8a-b8ca-094a9873eb14","resolution":{"observed_at":"2026-08-07T15:30:36.843689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.186145Z","title":"Neural discrete representa- tion learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.186145Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:a302050f9e3a0f8fedd174b9adc1624fbfb8daabb439a19519e723ab65508921","observation_id":"a03cb183-98be-45a1-b9d0-5eac9e45bd7b","resolution":{"observed_at":"2026-08-07T15:30:36.186145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16692","last_updated":"2024-01-23T01:56:57Z","snapshot_observed_at":"2026-08-07T03:22:13.424379Z","submitted_at":"2023-08-31T12:53:09Z","title":"SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16692","snapshot_observed_at":"2026-08-07T15:30:36.244621Z","title":"Speechtok- enizer: Unified speech tokenizer for speech large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.244621Z"},"links":{"cited_paper":"/paper/2308.16692","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:f400a1f130457f41e88fe2accabc4da929dcba779369a1a792e0fff5847874c2","observation_id":"7fb72ea3-0c45-46da-8637-16335c415d8d","resolution":{"observed_at":"2026-08-07T15:30:36.244621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.324730Z","title":"HiFi-GAN: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.324730Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:6cbfae59e837e387897c8e352691d2fd10844327febb9046bfef22bc0f8671b2","observation_id":"7d66a765-7a62-4447-a8fe-81d02f264211","resolution":{"observed_at":"2026-08-07T15:30:36.324730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T15:30:36.404353Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.404353Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:88b37de8423bad955731bd744b9d90a7a8bdd12f20f77e6059097423f835bbb9","observation_id":"253a6c96-6aff-4fbb-b24d-1f91f865a911","resolution":{"observed_at":"2026-08-07T15:30:36.404353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.816271Z","title":"Lib- riSpeech: an asr corpus based on public domain audio books,","venue":null,"work_id":"b3f7ef14-aa0a-4b64-b507-331fa204586d","year":2015},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.457247Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:844be6ee1fb6ab0daac642c8f0c035f1b385b70530c5f43f2ab202a7b03e1c2b","observation_id":"74faf3e4-1d6c-4555-92c3-852891efc1ca","resolution":{"observed_at":"2026-08-07T15:30:36.819896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-07T13:32:24.356336Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-07T15:30:36.515701Z","title":"LibriTTS: A corpus derived from librispeech for text- to-speech,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.515701Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:4c1a43691efa43678e2ba72efbfef71b796db9c08765f5d909f1e8fca1f73d54","observation_id":"b3295ebf-d24a-4ac1-b320-05d138f3d8b0","resolution":{"observed_at":"2026-08-07T15:30:36.515701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.565042Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.565042Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:7babfe55da7604c0ef81398812074290d0bc97dc7f739198fbfe425153836bcd","observation_id":"e375618c-99d5-423f-a137-05f81a1e5d36","resolution":{"observed_at":"2026-08-07T15:30:36.565042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04455","last_updated":"2024-03-01T16:52:19Z","snapshot_observed_at":"2026-07-06T16:04:02.943124Z","submitted_at":"2023-08-05T16:14:17Z","title":"Anonymizing Speech: Evaluating and Designing Speaker Anonymization Techniques","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04455","snapshot_observed_at":"2026-08-07T15:30:36.583819Z","title":"Anonymizing speech: Evaluating and de- signing speaker anonymization techniques,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.583819Z"},"links":{"cited_paper":"/paper/2308.04455","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:4d3f909eb9acfcc6408b192b2b63fb17b4c32d42e8b5cdc0fe2eb81a07999e40","observation_id":"9e779790-8d96-41b1-8f70-ae37354db7d8","resolution":{"observed_at":"2026-08-07T15:30:36.583819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08913","last_updated":"2024-09-17T14:39:44Z","snapshot_observed_at":"2026-07-06T19:15:00.165369Z","submitted_at":"2024-09-13T15:29:37Z","title":"HLTCOE JHU Submission to the Voice Privacy Challenge 2024","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08913","snapshot_observed_at":"2026-08-07T15:30:36.587841Z","title":"Hltcoe jhu sub- mission to the voice privacy challenge 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.587841Z"},"links":{"cited_paper":"/paper/2409.08913","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:fbb2ab1f7919b01deb517cac2ec114d6b9097bcd1d6e3f28e1113ae5c5ac435c","observation_id":"587c064d-858a-46e7-95a2-8bdb903fa253","resolution":{"observed_at":"2026-08-07T15:30:36.587841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.798804Z","title":"System descrip- tion: Speaker anonymization system with sentiment transfer and feature interpolation,","venue":null,"work_id":"ea5b9b8e-2e6c-4dc1-a02d-b8d73f85747f","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.600275Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:c552345b83e4e25f8fae1ea6ffbc18701c85df4b32caecdc390c8b4c2c28a1c2","observation_id":"ee39ac8b-036c-4bec-8eeb-1295b0b96370","resolution":{"observed_at":"2026-08-07T15:30:36.802506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-08T00:26:13.183309Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":3,"verified_fuzzy":16},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 2 inbound Pith citation observations for arXiv:2505.15004."}