{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:QY2CSW6DERQ3O6X7263LXOUUO7","short_pith_number":"pith:QY2CSW6D","schema_version":"1.0","canonical_sha256":"8634295bc32461b77affd7b6bbba9477c38c10831face622c01f9bbc55b7f8be","source":{"kind":"arxiv","id":"2507.21134","version":1},"attestation_state":"computed","paper":{"title":"TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CY","cs.LG"],"primary_cat":"cs.CL","authors_text":"Ehsan Shareghi, Nigel Collier, Yijiang River Dong, Zheng Hui","submitted_at":"2025-07-22T17:52:29Z","abstract_excerpt":"As large language models (LLMs) are increasingly deployed in high-risk domains such as law, finance, and medicine, systematically evaluating their domain-specific safety and compliance becomes critical. While prior work has largely focused on improving LLM performance in these domains, it has often neglected the evaluation of domain-specific safety risks. To bridge this gap, we first define domain-specific safety principles for LLMs based on the AMA Principles of Medical Ethics, the ABA Model Rules of Professional Conduct, and the CFA Institute Code of Ethics. Building on this foundation, we i"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2507.21134","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2025-07-22T17:52:29Z","cross_cats_sorted":["cs.CY","cs.LG"],"title_canon_sha256":"14acf82d3b2d541e0aef27e017af3c7694a9145b807194ce7564a3be7626c49f","abstract_canon_sha256":"647a48904f003f84282809f889079296ad2cf1323cdec89e49100c374225e41f"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:44:31.811374Z","signature_b64":"JL4zinReMM/Ms8Q4b3s8EhFFw27fZSlPj1ifLotXB90AlxKGlAgN/XIUMzoG+C6ISVf4x+OQkJC1jO32HWD8Aw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"8634295bc32461b77affd7b6bbba9477c38c10831face622c01f9bbc55b7f8be","last_reissued_at":"2026-07-05T11:44:31.810917Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:44:31.810917Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CY","cs.LG"],"primary_cat":"cs.CL","authors_text":"Ehsan Shareghi, Nigel Collier, Yijiang River Dong, Zheng Hui","submitted_at":"2025-07-22T17:52:29Z","abstract_excerpt":"As large language models (LLMs) are increasingly deployed in high-risk domains such as law, finance, and medicine, systematically evaluating their domain-specific safety and compliance becomes critical. While prior work has largely focused on improving LLM performance in these domains, it has often neglected the evaluation of domain-specific safety risks. To bridge this gap, we first define domain-specific safety principles for LLMs based on the AMA Principles of Medical Ethics, the ABA Model Rules of Professional Conduct, and the CFA Institute Code of Ethics. Building on this foundation, we i"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2507.21134","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2507.21134/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2507.21134","created_at":"2026-07-05T11:44:31.810979+00:00"},{"alias_kind":"arxiv_version","alias_value":"2507.21134v1","created_at":"2026-07-05T11:44:31.810979+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2507.21134","created_at":"2026-07-05T11:44:31.810979+00:00"},{"alias_kind":"pith_short_12","alias_value":"QY2CSW6DERQ3","created_at":"2026-07-05T11:44:31.810979+00:00"},{"alias_kind":"pith_short_16","alias_value":"QY2CSW6DERQ3O6X7","created_at":"2026-07-05T11:44:31.810979+00:00"},{"alias_kind":"pith_short_8","alias_value":"QY2CSW6D","created_at":"2026-07-05T11:44:31.810979+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":4,"internal_anchor_count":4,"sample":[{"citing_arxiv_id":"2606.25442","citing_title":"PolicyAlign: Direct Policy-Based Safety Alignment for Large Language Models","ref_index":51,"is_internal_anchor":true},{"citing_arxiv_id":"2601.04740","citing_title":"StealthGraph: Exposing Domain-Specific Risks in LLMs through Knowledge-Graph-Guided Harmful Prompt Generation","ref_index":2,"is_internal_anchor":true},{"citing_arxiv_id":"2605.04992","citing_title":"You Snooze, You Lose: Automatic Safety Alignment Restoration through Neural Weight Translation","ref_index":59,"is_internal_anchor":true},{"citing_arxiv_id":"2604.14548","citing_title":"VoxSafeBench: Not Just What Is Said, but Who, How, and Where","ref_index":15,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7","json":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7.json","graph_json":"https://pith.science/api/pith-number/QY2CSW6DERQ3O6X7263LXOUUO7/graph.json","events_json":"https://pith.science/api/pith-number/QY2CSW6DERQ3O6X7263LXOUUO7/events.json","paper":"https://pith.science/paper/QY2CSW6D"},"agent_actions":{"view_html":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7","download_json":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7.json","view_paper":"https://pith.science/paper/QY2CSW6D","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2507.21134&json=true","fetch_graph":"https://pith.science/api/pith-number/QY2CSW6DERQ3O6X7263LXOUUO7/graph.json","fetch_events":"https://pith.science/api/pith-number/QY2CSW6DERQ3O6X7263LXOUUO7/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7/action/timestamp_anchor","attest_storage":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7/action/storage_attestation","attest_author":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7/action/author_attestation","sign_citation":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7/action/citation_signature","submit_replication":"https://pith.science/pith/QY2CSW6DERQ3O6X7263LXOUUO7/action/replication_record"}},"created_at":"2026-07-05T11:44:31.810979+00:00","updated_at":"2026-07-05T11:44:31.810979+00:00"}