{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:X6ER2B6CYWOBLOWVX6MQ4R4H7T","short_pith_number":"pith:X6ER2B6C","schema_version":"1.0","canonical_sha256":"bf891d07c2c59c15bad5bf990e4787fcd04a4c6d41569d05d4528b3aed419d6a","source":{"kind":"arxiv","id":"2501.03266","version":2},"attestation_state":"computed","paper":{"title":"LLM Content Moderation and User Satisfaction: Evidence from Response Refusals in Chatbot Arena","license":"http://creativecommons.org/licenses/by-nc-sa/4.0/","headline":"","cross_cats":["cs.AI","cs.CY","cs.HC","cs.SI"],"primary_cat":"cs.CL","authors_text":"Stefan Pasch","submitted_at":"2025-01-04T06:36:44Z","abstract_excerpt":"LLM safety and ethical alignment are widely discussed, but the impact of content moderation on user satisfaction remains underexplored. In particular, little is known about how users respond when models refuse to answer a prompt-one of the primary mechanisms used to enforce ethical boundaries in LLMs. We address this gap by analyzing nearly 50,000 model comparisons from Chatbot Arena, a platform where users indicate their preferred LLM response in pairwise matchups, providing a large-scale setting for studying real-world user preferences. Using a novel RoBERTa-based refusal classifier fine-tun"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2501.03266","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by-nc-sa/4.0/","primary_cat":"cs.CL","submitted_at":"2025-01-04T06:36:44Z","cross_cats_sorted":["cs.AI","cs.CY","cs.HC","cs.SI"],"title_canon_sha256":"6537e11e991c39bdc6b64ab3ef3755957203d1a4f3c6ec9cb2762d94ab4db408","abstract_canon_sha256":"2f89a7cc12e40180e537d9979d70326193c527b2555c78ec885f57ad6a4e9531"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:03:55.274490Z","signature_b64":"0C64MuLzLXFGwfDlQL4WUOD/aSP/tPpIeKwjC2KJ/dore5+ZuwClsOxHiVTgn56kuMc3pMVbYwFJHxpt3V73Bw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"bf891d07c2c59c15bad5bf990e4787fcd04a4c6d41569d05d4528b3aed419d6a","last_reissued_at":"2026-07-05T11:03:55.274013Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:03:55.274013Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"LLM Content Moderation and User Satisfaction: Evidence from Response Refusals in Chatbot Arena","license":"http://creativecommons.org/licenses/by-nc-sa/4.0/","headline":"","cross_cats":["cs.AI","cs.CY","cs.HC","cs.SI"],"primary_cat":"cs.CL","authors_text":"Stefan Pasch","submitted_at":"2025-01-04T06:36:44Z","abstract_excerpt":"LLM safety and ethical alignment are widely discussed, but the impact of content moderation on user satisfaction remains underexplored. In particular, little is known about how users respond when models refuse to answer a prompt-one of the primary mechanisms used to enforce ethical boundaries in LLMs. We address this gap by analyzing nearly 50,000 model comparisons from Chatbot Arena, a platform where users indicate their preferred LLM response in pairwise matchups, providing a large-scale setting for studying real-world user preferences. Using a novel RoBERTa-based refusal classifier fine-tun"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2501.03266","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2501.03266/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2501.03266","created_at":"2026-07-05T11:03:55.274066+00:00"},{"alias_kind":"arxiv_version","alias_value":"2501.03266v2","created_at":"2026-07-05T11:03:55.274066+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2501.03266","created_at":"2026-07-05T11:03:55.274066+00:00"},{"alias_kind":"pith_short_12","alias_value":"X6ER2B6CYWOB","created_at":"2026-07-05T11:03:55.274066+00:00"},{"alias_kind":"pith_short_16","alias_value":"X6ER2B6CYWOBLOWV","created_at":"2026-07-05T11:03:55.274066+00:00"},{"alias_kind":"pith_short_8","alias_value":"X6ER2B6C","created_at":"2026-07-05T11:03:55.274066+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":2,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2605.16272","citing_title":"Beyond Compliance: How AI Could Help Creative Writers by Refusing Them","ref_index":70,"is_internal_anchor":false},{"citing_arxiv_id":"2604.02713","citing_title":"Breakdowns in Conversational AI: Interactional Failures in Emotionally and Ethically Sensitive Contexts","ref_index":28,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T","json":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T.json","graph_json":"https://pith.science/api/pith-number/X6ER2B6CYWOBLOWVX6MQ4R4H7T/graph.json","events_json":"https://pith.science/api/pith-number/X6ER2B6CYWOBLOWVX6MQ4R4H7T/events.json","paper":"https://pith.science/paper/X6ER2B6C"},"agent_actions":{"view_html":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T","download_json":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T.json","view_paper":"https://pith.science/paper/X6ER2B6C","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2501.03266&json=true","fetch_graph":"https://pith.science/api/pith-number/X6ER2B6CYWOBLOWVX6MQ4R4H7T/graph.json","fetch_events":"https://pith.science/api/pith-number/X6ER2B6CYWOBLOWVX6MQ4R4H7T/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T/action/timestamp_anchor","attest_storage":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T/action/storage_attestation","attest_author":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T/action/author_attestation","sign_citation":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T/action/citation_signature","submit_replication":"https://pith.science/pith/X6ER2B6CYWOBLOWVX6MQ4R4H7T/action/replication_record"}},"created_at":"2026-07-05T11:03:55.274066+00:00","updated_at":"2026-07-05T11:03:55.274066+00:00"}