{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2023:RRIVJONWWSYJ6VWKP3BJ2VQHKB","short_pith_number":"pith:RRIVJONW","schema_version":"1.0","canonical_sha256":"8c5154b9b6b4b09f56ca7ec29d5607506904c6467c1e962cbff125d74254332a","source":{"kind":"arxiv","id":"2303.16963","version":1},"attestation_state":"computed","paper":{"title":"Fairness-Aware Data Valuation for Supervised Learning","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CY"],"primary_cat":"cs.LG","authors_text":"Jos\\'e Pombal, M\\'ario A. T. Figueiredo, Pedro Bizarro, Pedro Saleiro","submitted_at":"2023-03-29T18:51:13Z","abstract_excerpt":"Data valuation is a ML field that studies the value of training instances towards a given predictive task. Although data bias is one of the main sources of downstream model unfairness, previous work in data valuation does not consider how training instances may influence both performance and fairness of ML models. Thus, we propose Fairness-Aware Data vauatiOn (FADO), a data valuation framework that can be used to incorporate fairness concerns into a series of ML-related tasks (e.g., data pre-processing, exploratory data analysis, active learning). We propose an entropy-based data valuation met"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2303.16963","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2023-03-29T18:51:13Z","cross_cats_sorted":["cs.CY"],"title_canon_sha256":"54b1a4bbdf8beb186590f097477ac4e41acb6d1e000262e125086be3745fa322","abstract_canon_sha256":"c71a25dfc3f8ac0961617ab08910ab89a2dcea81ef963d13826e290852d1a739"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T05:56:17.746874Z","signature_b64":"N6IpIEZo7JbrjnAS62z6tLKq5CianDJKZDZBVVnJk44Q30FFJyht3DMN0rKN0Mq5JN4B1lfNjMurWy1TnXMdCw==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"8c5154b9b6b4b09f56ca7ec29d5607506904c6467c1e962cbff125d74254332a","last_reissued_at":"2026-07-05T05:56:17.746287Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T05:56:17.746287Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Fairness-Aware Data Valuation for Supervised Learning","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CY"],"primary_cat":"cs.LG","authors_text":"Jos\\'e Pombal, M\\'ario A. T. Figueiredo, Pedro Bizarro, Pedro Saleiro","submitted_at":"2023-03-29T18:51:13Z","abstract_excerpt":"Data valuation is a ML field that studies the value of training instances towards a given predictive task. Although data bias is one of the main sources of downstream model unfairness, previous work in data valuation does not consider how training instances may influence both performance and fairness of ML models. Thus, we propose Fairness-Aware Data vauatiOn (FADO), a data valuation framework that can be used to incorporate fairness concerns into a series of ML-related tasks (e.g., data pre-processing, exploratory data analysis, active learning). We propose an entropy-based data valuation met"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2303.16963","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2303.16963/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2303.16963","created_at":"2026-07-05T05:56:17.746355+00:00"},{"alias_kind":"arxiv_version","alias_value":"2303.16963v1","created_at":"2026-07-05T05:56:17.746355+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2303.16963","created_at":"2026-07-05T05:56:17.746355+00:00"},{"alias_kind":"pith_short_12","alias_value":"RRIVJONWWSYJ","created_at":"2026-07-05T05:56:17.746355+00:00"},{"alias_kind":"pith_short_16","alias_value":"RRIVJONWWSYJ6VWK","created_at":"2026-07-05T05:56:17.746355+00:00"},{"alias_kind":"pith_short_8","alias_value":"RRIVJONW","created_at":"2026-07-05T05:56:17.746355+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2508.14741","citing_title":"CaTE Data Curation for Trustworthy AI","ref_index":124,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB","json":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB.json","graph_json":"https://pith.science/api/pith-number/RRIVJONWWSYJ6VWKP3BJ2VQHKB/graph.json","events_json":"https://pith.science/api/pith-number/RRIVJONWWSYJ6VWKP3BJ2VQHKB/events.json","paper":"https://pith.science/paper/RRIVJONW"},"agent_actions":{"view_html":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB","download_json":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB.json","view_paper":"https://pith.science/paper/RRIVJONW","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2303.16963&json=true","fetch_graph":"https://pith.science/api/pith-number/RRIVJONWWSYJ6VWKP3BJ2VQHKB/graph.json","fetch_events":"https://pith.science/api/pith-number/RRIVJONWWSYJ6VWKP3BJ2VQHKB/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB/action/timestamp_anchor","attest_storage":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB/action/storage_attestation","attest_author":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB/action/author_attestation","sign_citation":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB/action/citation_signature","submit_replication":"https://pith.science/pith/RRIVJONWWSYJ6VWKP3BJ2VQHKB/action/replication_record"}},"created_at":"2026-07-05T05:56:17.746355+00:00","updated_at":"2026-07-05T05:56:17.746355+00:00"}