{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:PUPIMXXK4XFY3ZJ3GZFOQAIUZS","short_pith_number":"pith:PUPIMXXK","schema_version":"1.0","canonical_sha256":"7d1e865eeae5cb8de53b364ae80114ccb9553acfeece5e9c0095bca7a9aeee17","source":{"kind":"arxiv","id":"2502.01523","version":2},"attestation_state":"computed","paper":{"title":"CondAmbigQA: A Benchmark and Dataset for Conditional Ambiguous Question Answering","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Haoran Xie, S. Joe Qin, Yang Li, Zongxi Li","submitted_at":"2025-02-03T17:01:51Z","abstract_excerpt":"Users often assume that large language models (LLMs) share their cognitive alignment of context and intent, leading them to omit critical information in question-answering (QA) and produce ambiguous queries. Responses based on misaligned assumptions may be perceived as hallucinations. Therefore, identifying possible implicit assumptions is crucial in QA. To address this fundamental challenge, we propose Conditional Ambiguous Question-Answering (CondAmbigQA), a benchmark comprising 2,000 ambiguous queries and condition-aware evaluation metrics. Our study pioneers \"conditions\" as explicit contex"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2502.01523","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CL","submitted_at":"2025-02-03T17:01:51Z","cross_cats_sorted":[],"title_canon_sha256":"7ee795f48ef17118651bac3a0f9720dd1eaf876f7db67db5d217abae7e1ec063","abstract_canon_sha256":"193a27b849191d2c91ce70c10d4d4fc18b2c8393d4832499a78f0e8f8ffc8dcc"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T12:09:12.825890Z","signature_b64":"KI/nOogwLU9p7qWNuplmIz33t6/sBDw701C5JprQmdoiCcPKzpm16uaGqVXtTJeJR0bhth94nh1/DkmYgkyzBQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"7d1e865eeae5cb8de53b364ae80114ccb9553acfeece5e9c0095bca7a9aeee17","last_reissued_at":"2026-07-05T12:09:12.825422Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T12:09:12.825422Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"CondAmbigQA: A Benchmark and Dataset for Conditional Ambiguous Question Answering","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Haoran Xie, S. Joe Qin, Yang Li, Zongxi Li","submitted_at":"2025-02-03T17:01:51Z","abstract_excerpt":"Users often assume that large language models (LLMs) share their cognitive alignment of context and intent, leading them to omit critical information in question-answering (QA) and produce ambiguous queries. Responses based on misaligned assumptions may be perceived as hallucinations. Therefore, identifying possible implicit assumptions is crucial in QA. To address this fundamental challenge, we propose Conditional Ambiguous Question-Answering (CondAmbigQA), a benchmark comprising 2,000 ambiguous queries and condition-aware evaluation metrics. Our study pioneers \"conditions\" as explicit contex"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2502.01523","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2502.01523/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2502.01523","created_at":"2026-07-05T12:09:12.825481+00:00"},{"alias_kind":"arxiv_version","alias_value":"2502.01523v2","created_at":"2026-07-05T12:09:12.825481+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2502.01523","created_at":"2026-07-05T12:09:12.825481+00:00"},{"alias_kind":"pith_short_12","alias_value":"PUPIMXXK4XFY","created_at":"2026-07-05T12:09:12.825481+00:00"},{"alias_kind":"pith_short_16","alias_value":"PUPIMXXK4XFY3ZJ3","created_at":"2026-07-05T12:09:12.825481+00:00"},{"alias_kind":"pith_short_8","alias_value":"PUPIMXXK","created_at":"2026-07-05T12:09:12.825481+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":0,"internal_anchor_count":0,"sample":[]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS","json":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS.json","graph_json":"https://pith.science/api/pith-number/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/graph.json","events_json":"https://pith.science/api/pith-number/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/events.json","paper":"https://pith.science/paper/PUPIMXXK"},"agent_actions":{"view_html":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS","download_json":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS.json","view_paper":"https://pith.science/paper/PUPIMXXK","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2502.01523&json=true","fetch_graph":"https://pith.science/api/pith-number/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/graph.json","fetch_events":"https://pith.science/api/pith-number/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/action/timestamp_anchor","attest_storage":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/action/storage_attestation","attest_author":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/action/author_attestation","sign_citation":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/action/citation_signature","submit_replication":"https://pith.science/pith/PUPIMXXK4XFY3ZJ3GZFOQAIUZS/action/replication_record"}},"created_at":"2026-07-05T12:09:12.825481+00:00","updated_at":"2026-07-05T12:09:12.825481+00:00"}