{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:E7ONGMUO4FUIYDOLAU36D7D67S","short_pith_number":"pith:E7ONGMUO","schema_version":"1.0","canonical_sha256":"27dcd3328ee1688c0dcb0537e1fc7efcb914ace8a111507a6d9c220fd0cc723b","source":{"kind":"arxiv","id":"2509.03787","version":1},"attestation_state":"computed","paper":{"title":"Evaluating the Robustness of Retrieval-Augmented Generation to Adversarial Evidence in the Health Domain","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CL"],"primary_cat":"cs.IR","authors_text":"Amin Bigdeli, Amira Ghenai, Charles L. A. Clarke, Shakiba Amirshahi","submitted_at":"2025-09-04T00:45:58Z","abstract_excerpt":"Retrieval augmented generation (RAG) systems provide a method for factually grounding the responses of a Large Language Model (LLM) by providing retrieved evidence, or context, as support. Guided by this context, RAG systems can reduce hallucinations and expand the ability of LLMs to accurately answer questions outside the scope of their training data. Unfortunately, this design introduces a critical vulnerability: LLMs may absorb and reproduce misinformation present in retrieved evidence. This problem is magnified if retrieved evidence contains adversarial material explicitly intended to prom"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2509.03787","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.IR","submitted_at":"2025-09-04T00:45:58Z","cross_cats_sorted":["cs.CL"],"title_canon_sha256":"cb87dc7d69d81c157d6314890397023666e1aabaa124040f0e809e015e1c2441","abstract_canon_sha256":"e699b26b1cb9d2f5a69a39b9b17e9d7045fae7b8b39be2441ede986f27ae60b9"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T12:04:46.057548Z","signature_b64":"eGJjqZImJmdfL2MDyRtYyOVFa/57O1ka7EPbHbfKPO7G3INptZBpLmSjrbEotyYdAUIwKKNMabXmVrlKmu0MCQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"27dcd3328ee1688c0dcb0537e1fc7efcb914ace8a111507a6d9c220fd0cc723b","last_reissued_at":"2026-07-05T12:04:46.057036Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T12:04:46.057036Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Evaluating the Robustness of Retrieval-Augmented Generation to Adversarial Evidence in the Health Domain","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CL"],"primary_cat":"cs.IR","authors_text":"Amin Bigdeli, Amira Ghenai, Charles L. A. Clarke, Shakiba Amirshahi","submitted_at":"2025-09-04T00:45:58Z","abstract_excerpt":"Retrieval augmented generation (RAG) systems provide a method for factually grounding the responses of a Large Language Model (LLM) by providing retrieved evidence, or context, as support. Guided by this context, RAG systems can reduce hallucinations and expand the ability of LLMs to accurately answer questions outside the scope of their training data. Unfortunately, this design introduces a critical vulnerability: LLMs may absorb and reproduce misinformation present in retrieved evidence. This problem is magnified if retrieved evidence contains adversarial material explicitly intended to prom"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2509.03787","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2509.03787/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2509.03787","created_at":"2026-07-05T12:04:46.057097+00:00"},{"alias_kind":"arxiv_version","alias_value":"2509.03787v1","created_at":"2026-07-05T12:04:46.057097+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2509.03787","created_at":"2026-07-05T12:04:46.057097+00:00"},{"alias_kind":"pith_short_12","alias_value":"E7ONGMUO4FUI","created_at":"2026-07-05T12:04:46.057097+00:00"},{"alias_kind":"pith_short_16","alias_value":"E7ONGMUO4FUIYDOL","created_at":"2026-07-05T12:04:46.057097+00:00"},{"alias_kind":"pith_short_8","alias_value":"E7ONGMUO","created_at":"2026-07-05T12:04:46.057097+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":2,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2605.10253","citing_title":"Knowledge Poisoning Attacks on Medical Multi-Modal Retrieval-Augmented Generation","ref_index":51,"is_internal_anchor":false},{"citing_arxiv_id":"2605.01302","citing_title":"Beyond Semantic Relevance: Counterfactual Risk Minimization for Robust Retrieval-Augmented Generation","ref_index":1,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S","json":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S.json","graph_json":"https://pith.science/api/pith-number/E7ONGMUO4FUIYDOLAU36D7D67S/graph.json","events_json":"https://pith.science/api/pith-number/E7ONGMUO4FUIYDOLAU36D7D67S/events.json","paper":"https://pith.science/paper/E7ONGMUO"},"agent_actions":{"view_html":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S","download_json":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S.json","view_paper":"https://pith.science/paper/E7ONGMUO","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2509.03787&json=true","fetch_graph":"https://pith.science/api/pith-number/E7ONGMUO4FUIYDOLAU36D7D67S/graph.json","fetch_events":"https://pith.science/api/pith-number/E7ONGMUO4FUIYDOLAU36D7D67S/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S/action/timestamp_anchor","attest_storage":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S/action/storage_attestation","attest_author":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S/action/author_attestation","sign_citation":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S/action/citation_signature","submit_replication":"https://pith.science/pith/E7ONGMUO4FUIYDOLAU36D7D67S/action/replication_record"}},"created_at":"2026-07-05T12:04:46.057097+00:00","updated_at":"2026-07-05T12:04:46.057097+00:00"}