{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:YFPST6DASH4USOU55WWUDGMPOX","short_pith_number":"pith:YFPST6DA","schema_version":"1.0","canonical_sha256":"c15f29f86091f9493a9dedad41998f75c9bc599f4b4551dd678575844ffbeedd","source":{"kind":"arxiv","id":"2503.19176","version":2},"attestation_state":"computed","paper":{"title":"SoK: How Robust is Audio Watermarking in Generative AI models?","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CR","authors_text":"Aaron Bien Ramos, Ashwin Innuganti, Hanqing Guo, Qiben Yan, Yizhu Wen","submitted_at":"2025-03-24T21:57:59Z","abstract_excerpt":"Audio watermarking is increasingly used to verify the provenance of AI-generated content, enabling applications such as detecting AI-generated speech, protecting music IP, and defending against voice cloning. To be effective, audio watermarks must resist removal attacks that distort signals to evade detection. While many schemes claim robustness, these claims are typically tested in isolation and against a limited set of attacks. A systematic evaluation against diverse removal attacks is lacking, hindering practical deployment. In this paper, we investigate whether recent watermarking schemes "},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2503.19176","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CR","submitted_at":"2025-03-24T21:57:59Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"f1233e258603b48b5462d136af3474ce88f056800094cee19f97becdb42b2c72","abstract_canon_sha256":"36446b99d102b220089631a1f6f2779bcab2e7e47999de7604f6810583b55f60"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:39:48.002936Z","signature_b64":"4fwZEdRQqZcXzblG5sBS1JQOkVsFAgew5ffxZJ6nlb67boyTZOs28TIof9iP+yi+qsWO6rKqXcxqSefGXLHCCA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"c15f29f86091f9493a9dedad41998f75c9bc599f4b4551dd678575844ffbeedd","last_reissued_at":"2026-07-05T10:39:48.002393Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:39:48.002393Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"SoK: How Robust is Audio Watermarking in Generative AI models?","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CR","authors_text":"Aaron Bien Ramos, Ashwin Innuganti, Hanqing Guo, Qiben Yan, Yizhu Wen","submitted_at":"2025-03-24T21:57:59Z","abstract_excerpt":"Audio watermarking is increasingly used to verify the provenance of AI-generated content, enabling applications such as detecting AI-generated speech, protecting music IP, and defending against voice cloning. To be effective, audio watermarks must resist removal attacks that distort signals to evade detection. While many schemes claim robustness, these claims are typically tested in isolation and against a limited set of attacks. A systematic evaluation against diverse removal attacks is lacking, hindering practical deployment. In this paper, we investigate whether recent watermarking schemes "},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2503.19176","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2503.19176/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2503.19176","created_at":"2026-07-05T10:39:48.002459+00:00"},{"alias_kind":"arxiv_version","alias_value":"2503.19176v2","created_at":"2026-07-05T10:39:48.002459+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2503.19176","created_at":"2026-07-05T10:39:48.002459+00:00"},{"alias_kind":"pith_short_12","alias_value":"YFPST6DASH4U","created_at":"2026-07-05T10:39:48.002459+00:00"},{"alias_kind":"pith_short_16","alias_value":"YFPST6DASH4USOU5","created_at":"2026-07-05T10:39:48.002459+00:00"},{"alias_kind":"pith_short_8","alias_value":"YFPST6DA","created_at":"2026-07-05T10:39:48.002459+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":6,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.23335","citing_title":"The Watermark Shortcut: How Provenance Marking Sabotages Audio Deepfake Detection","ref_index":17,"is_internal_anchor":false},{"citing_arxiv_id":"2606.22310","citing_title":"Learning to Evade: Adaptive Attacks on Audio Watermarking","ref_index":17,"is_internal_anchor":false},{"citing_arxiv_id":"2606.11828","citing_title":"Feature-Aligned Speech Watermarking for Robustness to Reconstruction Distortions","ref_index":2,"is_internal_anchor":false},{"citing_arxiv_id":"2605.30614","citing_title":"Audio Pirates: Black-box Audio Watermark Removal via Diffusion Priors","ref_index":17,"is_internal_anchor":false},{"citing_arxiv_id":"2605.01515","citing_title":"MelShield: Robust Mel-Domain Audio Watermarking for Provenance Attribution of AI Generated Synthesized Speech","ref_index":22,"is_internal_anchor":false},{"citing_arxiv_id":"2604.13776","citing_title":"Who Gets Flagged? The Pluralistic Evaluation Gap in AI Content Watermarking","ref_index":53,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX","json":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX.json","graph_json":"https://pith.science/api/pith-number/YFPST6DASH4USOU55WWUDGMPOX/graph.json","events_json":"https://pith.science/api/pith-number/YFPST6DASH4USOU55WWUDGMPOX/events.json","paper":"https://pith.science/paper/YFPST6DA"},"agent_actions":{"view_html":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX","download_json":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX.json","view_paper":"https://pith.science/paper/YFPST6DA","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2503.19176&json=true","fetch_graph":"https://pith.science/api/pith-number/YFPST6DASH4USOU55WWUDGMPOX/graph.json","fetch_events":"https://pith.science/api/pith-number/YFPST6DASH4USOU55WWUDGMPOX/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX/action/timestamp_anchor","attest_storage":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX/action/storage_attestation","attest_author":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX/action/author_attestation","sign_citation":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX/action/citation_signature","submit_replication":"https://pith.science/pith/YFPST6DASH4USOU55WWUDGMPOX/action/replication_record"}},"created_at":"2026-07-05T10:39:48.002459+00:00","updated_at":"2026-07-05T10:39:48.002459+00:00"}