{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2026:WS3PUM3ZQTP5WVDDFDGRNHJAD3","short_pith_number":"pith:WS3PUM3Z","schema_version":"1.0","canonical_sha256":"b4b6fa337984dfdb546328cd169d201efe65abfb4a5e4959ecabffe7e1f431bc","source":{"kind":"arxiv","id":"2601.03321","version":3},"attestation_state":"computed","paper":{"title":"HERO: Hierarchical Evidential Reasoning Optimization for Radiology Report Generation via Reason-then-Summarize","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.LG","authors_text":"Chenghua Lin, Guodong Liu, Haoteng Tang, Hui Ji, Jifeng Song, Kun Zhao, Liang Zhan, Pan Wang, Siyuan Dai","submitted_at":"2026-01-06T14:17:44Z","abstract_excerpt":"Multimodal Large Language Models (MLLMs) have substantially advanced Radiology Report Generation (RRG), yet aligning them through reinforcement learning (RL) remains challenging due to heterogeneous medical supervision. Vanilla Group Relative Policy Optimization (GRPO) assigns uniform credit across the entire generation, leading to segment interference, token dilution, and evidence--diagnosis decoupling, which exacerbates clinical hallucinations. We propose HERO (Hierarchical Evidential Reasoning Optimization), a factorized policy optimization framework that aligns heterogeneous supervision wi"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2601.03321","kind":"arxiv","version":3},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2026-01-06T14:17:44Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"21a1f580258ba44822cfb4b4de16ce384c27ba2df94c9c0ef2e61599fdbe4522","abstract_canon_sha256":"faef8ad5ecfd9a859c5d2a40b90f5216f20ccd51fd52e50f309f88dffdf575ef"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-08-05T00:41:15.635510Z","signature_b64":"RGPJr4Zz6ZPGp6+3hGh1O5RqSekz/jd+NGhPZsZFlOe96wImFQ0ncmoGhHDneaGCYMky/Qd1/YZCFhBOnJOmBA==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"b4b6fa337984dfdb546328cd169d201efe65abfb4a5e4959ecabffe7e1f431bc","last_reissued_at":"2026-08-05T00:41:15.632844Z","signature_status":"signed_v1","first_computed_at":"2026-08-05T00:41:15.632844Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"HERO: Hierarchical Evidential Reasoning Optimization for Radiology Report Generation via Reason-then-Summarize","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.LG","authors_text":"Chenghua Lin, Guodong Liu, Haoteng Tang, Hui Ji, Jifeng Song, Kun Zhao, Liang Zhan, Pan Wang, Siyuan Dai","submitted_at":"2026-01-06T14:17:44Z","abstract_excerpt":"Multimodal Large Language Models (MLLMs) have substantially advanced Radiology Report Generation (RRG), yet aligning them through reinforcement learning (RL) remains challenging due to heterogeneous medical supervision. Vanilla Group Relative Policy Optimization (GRPO) assigns uniform credit across the entire generation, leading to segment interference, token dilution, and evidence--diagnosis decoupling, which exacerbates clinical hallucinations. We propose HERO (Hierarchical Evidential Reasoning Optimization), a factorized policy optimization framework that aligns heterogeneous supervision wi"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2601.03321","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2601.03321/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2601.03321","created_at":"2026-08-05T00:41:15.633804+00:00"},{"alias_kind":"arxiv_version","alias_value":"2601.03321v3","created_at":"2026-08-05T00:41:15.633804+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2601.03321","created_at":"2026-08-05T00:41:15.633804+00:00"},{"alias_kind":"pith_short_12","alias_value":"WS3PUM3ZQTP5","created_at":"2026-08-05T00:41:15.633804+00:00"},{"alias_kind":"pith_short_16","alias_value":"WS3PUM3ZQTP5WVDD","created_at":"2026-08-05T00:41:15.633804+00:00"},{"alias_kind":"pith_short_8","alias_value":"WS3PUM3Z","created_at":"2026-08-05T00:41:15.633804+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":1,"internal_anchor_count":1,"sample":[{"citing_arxiv_id":"2605.01725","citing_title":"Motion-Aware Caching for Efficient Autoregressive Video Generation","ref_index":76,"is_internal_anchor":true}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3","json":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3.json","graph_json":"https://pith.science/api/pith-number/WS3PUM3ZQTP5WVDDFDGRNHJAD3/graph.json","events_json":"https://pith.science/api/pith-number/WS3PUM3ZQTP5WVDDFDGRNHJAD3/events.json","paper":"https://pith.science/paper/WS3PUM3Z"},"agent_actions":{"view_html":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3","download_json":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3.json","view_paper":"https://pith.science/paper/WS3PUM3Z","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2601.03321&json=true","fetch_graph":"https://pith.science/api/pith-number/WS3PUM3ZQTP5WVDDFDGRNHJAD3/graph.json","fetch_events":"https://pith.science/api/pith-number/WS3PUM3ZQTP5WVDDFDGRNHJAD3/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3/action/timestamp_anchor","attest_storage":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3/action/storage_attestation","attest_author":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3/action/author_attestation","sign_citation":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3/action/citation_signature","submit_replication":"https://pith.science/pith/WS3PUM3ZQTP5WVDDFDGRNHJAD3/action/replication_record"}},"created_at":"2026-08-05T00:41:15.633804+00:00","updated_at":"2026-08-05T00:41:15.633804+00:00"}