{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:U2MNVBJ5OCHD4BLW2UMQEVLJRO","short_pith_number":"pith:U2MNVBJ5","schema_version":"1.0","canonical_sha256":"a698da853d708e3e0576d5190255698b83b0c66d4ed03b99a1be04a131dab961","source":{"kind":"arxiv","id":"2509.00096","version":2},"attestation_state":"computed","paper":{"title":"Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CL"],"primary_cat":"cs.LG","authors_text":"Haotian Yu, Pan Li, Runchao Li, Xianxuan Long, Xiaotian Han, Yao Fu, Yu Yin","submitted_at":"2025-08-27T15:48:18Z","abstract_excerpt":"Neural network pruning has emerged as a promising approach for deploying LLMs in low-resource scenarios while preserving downstream task performance. However, for the first time, we reveal that such pruning disrupts LLMs' internal activation features crucial for lie detection, where probing classifiers (typically small logistic regression models) trained on these features assess the truthfulness of LLM-generated statements. This discovery raises a crucial open question: how can we prune LLMs without sacrificing these critical lie detection capabilities? Our investigation further reveals that n"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2509.00096","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2025-08-27T15:48:18Z","cross_cats_sorted":["cs.CL"],"title_canon_sha256":"467336a36d94b7338c3afa679a14b8fdab7d50106fa5131f30603f37afcea5ab","abstract_canon_sha256":"6bf653c940d6b74338a0557e9b862f3b4df96785930f53f6739aa60904c8e77d"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T12:04:17.466282Z","signature_b64":"2EJf1jgUX9d8hjUlBJMzxWt/F/hjJtQxH5jku2Sm1aSH6bF4SNteb8EaUSztwd6MbCtwkdi2mQzZW1WYk+ESDg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"a698da853d708e3e0576d5190255698b83b0c66d4ed03b99a1be04a131dab961","last_reissued_at":"2026-07-05T12:04:17.465709Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T12:04:17.465709Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Pruning Weights but Not Truth: Safeguarding Truthfulness While Pruning LLMs","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CL"],"primary_cat":"cs.LG","authors_text":"Haotian Yu, Pan Li, Runchao Li, Xianxuan Long, Xiaotian Han, Yao Fu, Yu Yin","submitted_at":"2025-08-27T15:48:18Z","abstract_excerpt":"Neural network pruning has emerged as a promising approach for deploying LLMs in low-resource scenarios while preserving downstream task performance. However, for the first time, we reveal that such pruning disrupts LLMs' internal activation features crucial for lie detection, where probing classifiers (typically small logistic regression models) trained on these features assess the truthfulness of LLM-generated statements. This discovery raises a crucial open question: how can we prune LLMs without sacrificing these critical lie detection capabilities? Our investigation further reveals that n"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2509.00096","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2509.00096/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2509.00096","created_at":"2026-07-05T12:04:17.465789+00:00"},{"alias_kind":"arxiv_version","alias_value":"2509.00096v2","created_at":"2026-07-05T12:04:17.465789+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2509.00096","created_at":"2026-07-05T12:04:17.465789+00:00"},{"alias_kind":"pith_short_12","alias_value":"U2MNVBJ5OCHD","created_at":"2026-07-05T12:04:17.465789+00:00"},{"alias_kind":"pith_short_16","alias_value":"U2MNVBJ5OCHD4BLW","created_at":"2026-07-05T12:04:17.465789+00:00"},{"alias_kind":"pith_short_8","alias_value":"U2MNVBJ5","created_at":"2026-07-05T12:04:17.465789+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2512.22671","citing_title":"Fragile Knowledge, Robust Instruction-Following: The Width Pruning Dichotomy in Llama-3.2","ref_index":3,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO","json":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO.json","graph_json":"https://pith.science/api/pith-number/U2MNVBJ5OCHD4BLW2UMQEVLJRO/graph.json","events_json":"https://pith.science/api/pith-number/U2MNVBJ5OCHD4BLW2UMQEVLJRO/events.json","paper":"https://pith.science/paper/U2MNVBJ5"},"agent_actions":{"view_html":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO","download_json":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO.json","view_paper":"https://pith.science/paper/U2MNVBJ5","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2509.00096&json=true","fetch_graph":"https://pith.science/api/pith-number/U2MNVBJ5OCHD4BLW2UMQEVLJRO/graph.json","fetch_events":"https://pith.science/api/pith-number/U2MNVBJ5OCHD4BLW2UMQEVLJRO/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO/action/timestamp_anchor","attest_storage":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO/action/storage_attestation","attest_author":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO/action/author_attestation","sign_citation":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO/action/citation_signature","submit_replication":"https://pith.science/pith/U2MNVBJ5OCHD4BLW2UMQEVLJRO/action/replication_record"}},"created_at":"2026-07-05T12:04:17.465789+00:00","updated_at":"2026-07-05T12:04:17.465789+00:00"}