{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:ROVA6AHCQQKGUX3D4A75EXYZHN","short_pith_number":"pith:ROVA6AHC","schema_version":"1.0","canonical_sha256":"8baa0f00e284146a5f63e03fd25f193b4487a79e9d4011e4c106e6d66b093620","source":{"kind":"arxiv","id":"2404.12372","version":2},"attestation_state":"computed","paper":{"title":"MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Chenyi Zhou, Jian Wu, Jiaxiang Liu, Xiaotang Gai, Yang Feng, Zuozhu Liu","submitted_at":"2024-04-18T17:53:19Z","abstract_excerpt":"Medical Visual Question Answering (MedVQA), which offers language responses to image-based medical inquiries, represents a challenging task and significant advancement in healthcare. It assists medical experts to swiftly interpret medical images, thereby enabling faster and more accurate diagnoses. However, the model interpretability and transparency of existing MedVQA solutions are often limited, posing challenges in understanding their decision-making processes. To address this issue, we devise a semi-automated annotation process to streamline data preparation and build new benchmark MedVQA "},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2404.12372","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2024-04-18T17:53:19Z","cross_cats_sorted":[],"title_canon_sha256":"1c7deae875a31dff84a01191bc9667ddbca98234ba6fd31942dd836ceddf4ee4","abstract_canon_sha256":"640857d497a3721b4a6cf387c4a501ebe1a1106f096d45ad724cd188f850f3ac"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T09:16:48.536808Z","signature_b64":"r0pvJDa9m9isBr9Qsf8oEqIixY0jO+EG/gvAia6FjKL4w+yuU+aCfMSU3Xz+k5tqXB6N7d7A6+fzqUWCGrz6Cg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"8baa0f00e284146a5f63e03fd25f193b4487a79e9d4011e4c106e6d66b093620","last_reissued_at":"2026-07-05T09:16:48.536307Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T09:16:48.536307Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"MedThink: Explaining Medical Visual Question Answering via Multimodal Decision-Making Rationale","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Chenyi Zhou, Jian Wu, Jiaxiang Liu, Xiaotang Gai, Yang Feng, Zuozhu Liu","submitted_at":"2024-04-18T17:53:19Z","abstract_excerpt":"Medical Visual Question Answering (MedVQA), which offers language responses to image-based medical inquiries, represents a challenging task and significant advancement in healthcare. It assists medical experts to swiftly interpret medical images, thereby enabling faster and more accurate diagnoses. However, the model interpretability and transparency of existing MedVQA solutions are often limited, posing challenges in understanding their decision-making processes. To address this issue, we devise a semi-automated annotation process to streamline data preparation and build new benchmark MedVQA "},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2404.12372","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2404.12372/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2404.12372","created_at":"2026-07-05T09:16:48.536379+00:00"},{"alias_kind":"arxiv_version","alias_value":"2404.12372v2","created_at":"2026-07-05T09:16:48.536379+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2404.12372","created_at":"2026-07-05T09:16:48.536379+00:00"},{"alias_kind":"pith_short_12","alias_value":"ROVA6AHCQQKG","created_at":"2026-07-05T09:16:48.536379+00:00"},{"alias_kind":"pith_short_16","alias_value":"ROVA6AHCQQKGUX3D","created_at":"2026-07-05T09:16:48.536379+00:00"},{"alias_kind":"pith_short_8","alias_value":"ROVA6AHC","created_at":"2026-07-05T09:16:48.536379+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":5,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2604.26283","citing_title":"MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evolution","ref_index":21,"is_internal_anchor":false},{"citing_arxiv_id":"2604.26283","citing_title":"MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evolution","ref_index":21,"is_internal_anchor":false},{"citing_arxiv_id":"2604.26283","citing_title":"MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evolution","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2604.26283","citing_title":"MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evolution","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2604.20350","citing_title":"X-PCR: A Benchmark for Cross-modality Progressive Clinical Reasoning in Ophthalmic Diagnosis","ref_index":12,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN","json":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN.json","graph_json":"https://pith.science/api/pith-number/ROVA6AHCQQKGUX3D4A75EXYZHN/graph.json","events_json":"https://pith.science/api/pith-number/ROVA6AHCQQKGUX3D4A75EXYZHN/events.json","paper":"https://pith.science/paper/ROVA6AHC"},"agent_actions":{"view_html":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN","download_json":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN.json","view_paper":"https://pith.science/paper/ROVA6AHC","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2404.12372&json=true","fetch_graph":"https://pith.science/api/pith-number/ROVA6AHCQQKGUX3D4A75EXYZHN/graph.json","fetch_events":"https://pith.science/api/pith-number/ROVA6AHCQQKGUX3D4A75EXYZHN/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN/action/timestamp_anchor","attest_storage":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN/action/storage_attestation","attest_author":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN/action/author_attestation","sign_citation":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN/action/citation_signature","submit_replication":"https://pith.science/pith/ROVA6AHCQQKGUX3D4A75EXYZHN/action/replication_record"}},"created_at":"2026-07-05T09:16:48.536379+00:00","updated_at":"2026-07-05T09:16:48.536379+00:00"}