{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:67LUNMJXM4APRSLH4HPFPSF47X","short_pith_number":"pith:67LUNMJX","schema_version":"1.0","canonical_sha256":"f7d746b1376700f8c967e1de57c8bcfdd3bb2c27f37d59a40218133d7efaf9f3","source":{"kind":"arxiv","id":"2407.20105","version":1},"attestation_state":"computed","paper":{"title":"Strong Copyright Protection for Language Models via Adaptive Model Fusion","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CR"],"primary_cat":"cs.LG","authors_text":"Fanny Yang, Francesco Pinto, Javier Abad, Konstantin Donhauser","submitted_at":"2024-07-29T15:32:30Z","abstract_excerpt":"The risk of language models unintentionally reproducing copyrighted material from their training data has led to the development of various protective measures. In this paper, we propose model fusion as an effective solution to safeguard against copyright infringement. In particular, we introduce Copyright-Protecting Fusion (CP-Fuse), an algorithm that adaptively combines language models to minimize the reproduction of protected materials. CP-Fuse is inspired by the recently proposed Near-Access Free (NAF) framework and additionally incorporates a desirable balancing property that we demonstra"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2407.20105","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.LG","submitted_at":"2024-07-29T15:32:30Z","cross_cats_sorted":["cs.CR"],"title_canon_sha256":"ef5735e5f4701062cb71ad4f91ce2711b7dc0260f5071e95066ece06549867f5","abstract_canon_sha256":"573ebd907812e70c5e6ee91ef11350d4a7d1568811eda262cb26ec68b9c50ecf"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:49:48.904629Z","signature_b64":"uvuX8LWVQcOFonWnJORbjS4UrLFDTqK0xcTxGmaMJEG7Cc7ckO6urqHp5aGT21FUwTpnLYMO8IgW2SadQO5RAQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"f7d746b1376700f8c967e1de57c8bcfdd3bb2c27f37d59a40218133d7efaf9f3","last_reissued_at":"2026-07-05T08:49:48.904208Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:49:48.904208Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Strong Copyright Protection for Language Models via Adaptive Model Fusion","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CR"],"primary_cat":"cs.LG","authors_text":"Fanny Yang, Francesco Pinto, Javier Abad, Konstantin Donhauser","submitted_at":"2024-07-29T15:32:30Z","abstract_excerpt":"The risk of language models unintentionally reproducing copyrighted material from their training data has led to the development of various protective measures. In this paper, we propose model fusion as an effective solution to safeguard against copyright infringement. In particular, we introduce Copyright-Protecting Fusion (CP-Fuse), an algorithm that adaptively combines language models to minimize the reproduction of protected materials. CP-Fuse is inspired by the recently proposed Near-Access Free (NAF) framework and additionally incorporates a desirable balancing property that we demonstra"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2407.20105","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2407.20105/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2407.20105","created_at":"2026-07-05T08:49:48.904272+00:00"},{"alias_kind":"arxiv_version","alias_value":"2407.20105v1","created_at":"2026-07-05T08:49:48.904272+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2407.20105","created_at":"2026-07-05T08:49:48.904272+00:00"},{"alias_kind":"pith_short_12","alias_value":"67LUNMJXM4AP","created_at":"2026-07-05T08:49:48.904272+00:00"},{"alias_kind":"pith_short_16","alias_value":"67LUNMJXM4APRSLH","created_at":"2026-07-05T08:49:48.904272+00:00"},{"alias_kind":"pith_short_8","alias_value":"67LUNMJX","created_at":"2026-07-05T08:49:48.904272+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2505.16066","citing_title":"Merge to Mix: Mixing Datasets via Model Merging","ref_index":1,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X","json":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X.json","graph_json":"https://pith.science/api/pith-number/67LUNMJXM4APRSLH4HPFPSF47X/graph.json","events_json":"https://pith.science/api/pith-number/67LUNMJXM4APRSLH4HPFPSF47X/events.json","paper":"https://pith.science/paper/67LUNMJX"},"agent_actions":{"view_html":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X","download_json":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X.json","view_paper":"https://pith.science/paper/67LUNMJX","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2407.20105&json=true","fetch_graph":"https://pith.science/api/pith-number/67LUNMJXM4APRSLH4HPFPSF47X/graph.json","fetch_events":"https://pith.science/api/pith-number/67LUNMJXM4APRSLH4HPFPSF47X/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X/action/timestamp_anchor","attest_storage":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X/action/storage_attestation","attest_author":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X/action/author_attestation","sign_citation":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X/action/citation_signature","submit_replication":"https://pith.science/pith/67LUNMJXM4APRSLH4HPFPSF47X/action/replication_record"}},"created_at":"2026-07-05T08:49:48.904272+00:00","updated_at":"2026-07-05T08:49:48.904272+00:00"}