{"bundle_type":"pith_open_graph_bundle","bundle_version":"1.0","pith_number":"pith:2026:YLPXIENMUS63UNDJCRGVGCY62D","short_pith_number":"pith:YLPXIENM","canonical_record":{"source":{"id":"2604.12035","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2026-04-13T20:24:03Z","cross_cats_sorted":[],"title_canon_sha256":"087c9f3065710456573d1dde655622e449d3f2d4ff858c63ecaa6aea5c2c99e8","abstract_canon_sha256":"dab49b90c0cb9521451afd006bc33abb77902fde9026f162d708046fe304f5bd"},"schema_version":"1.0"},"canonical_sha256":"c2df7411aca4bdba3469144d530b1ed0d778380d0e80f1dbddc83d6d3a9d8f1c","source":{"kind":"arxiv","id":"2604.12035","version":2},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2604.12035","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"arxiv_version","alias_value":"2604.12035v2","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2604.12035","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"pith_short_12","alias_value":"YLPXIENMUS63","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"pith_short_16","alias_value":"YLPXIENMUS63UNDJ","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"pith_short_8","alias_value":"YLPXIENM","created_at":"2026-07-21T01:20:47Z"}],"events":[{"event_type":"record_created","subject_pith_number":"pith:2026:YLPXIENMUS63UNDJCRGVGCY62D","target":"record","payload":{"canonical_record":{"source":{"id":"2604.12035","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2026-04-13T20:24:03Z","cross_cats_sorted":[],"title_canon_sha256":"087c9f3065710456573d1dde655622e449d3f2d4ff858c63ecaa6aea5c2c99e8","abstract_canon_sha256":"dab49b90c0cb9521451afd006bc33abb77902fde9026f162d708046fe304f5bd"},"schema_version":"1.0"},"canonical_sha256":"c2df7411aca4bdba3469144d530b1ed0d778380d0e80f1dbddc83d6d3a9d8f1c","receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-21T01:20:47.908725Z","signature_b64":"J4KokbDCAqSKn8gX+K9UU+Oub52h49ZBqmR0L2pMZhLSqGgSn58RE1mDWiJZF6JGcXA9AyfBCmkedd6BEBofDg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"c2df7411aca4bdba3469144d530b1ed0d778380d0e80f1dbddc83d6d3a9d8f1c","last_reissued_at":"2026-07-21T01:20:47.907710Z","signature_status":"signed_v1","first_computed_at":"2026-07-21T01:20:47.907710Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"source_kind":"arxiv","source_id":"2604.12035","source_version":2,"attestation_state":"computed"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-21T01:20:47Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"XGVhy3f8rv5BykjLGldjMmbwYT45Hj+3OziYRGRvJwtBgg2J5WfDNKdCHNFrl/+1op549JVgqaxa7mNd6tkDDw==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-06T14:45:46.639971Z"},"content_sha256":"e47c6a110e757a971b492e191cf73b67e4a5843b9998a44d50815fe8d009b892","schema_version":"1.0","event_id":"sha256:e47c6a110e757a971b492e191cf73b67e4a5843b9998a44d50815fe8d009b892"},{"event_type":"graph_snapshot","subject_pith_number":"pith:2026:YLPXIENMUS63UNDJCRGVGCY62D","target":"graph","payload":{"graph_snapshot":{"paper":{"title":"When Does Visual Token Pruning Improve Calibration? The Role of Evidence Coverage in MLLMs","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"Visual token pruning can lower calibration error in multimodal models while preserving accuracy.","cross_cats":[],"primary_cat":"cs.CV","authors_text":"Hanzhe Hong, Heqing Du, Kaizhen Tan, Siru Tao, Yang Feng","submitted_at":"2026-04-13T20:24:03Z","abstract_excerpt":"Visual token pruning is widely used to reduce the inference cost of multimodal large language models (MLLMs), but it is usually evaluated only by accuracy. We study how pruning affects calibration, defined as the agreement between confidence and correctness, and show that the selection rule matters more than the token budget alone. On POPE with LLaVA-1.5, coverage-based pruning from 576 to 128 tokens reduces expected calibration error from 0.041 to 0.016 without a statistically significant accuracy loss. In contrast, attention-based selection preserves confidence while accuracy deteriorates, b"},"claims":{"count":4,"items":[{"kind":"strongest_claim","text":"On POPE, a pure-coverage setting in SCOPE achieves substantially lower ECE than the full unpruned model while maintaining similar accuracy. An internal alpha-sweep shows reducing the saliency weight improves calibration at all tested token budgets.","source":"verdict.strongest_claim","status":"machine_extracted","claim_id":"C1","attestation":"unclaimed"},{"kind":"weakest_assumption","text":"That the specific datasets, model, token budgets, and pruning implementations tested are representative enough for the observed calibration trends to generalize beyond these conditions.","source":"verdict.weakest_assumption","status":"machine_extracted","claim_id":"C2","attestation":"unclaimed"},{"kind":"one_line_summary","text":"Certain coverage-based visual token pruning strategies lower Expected Calibration Error compared to unpruned models while keeping accuracy similar on POPE, and pruning reduces ECE on ScienceQA-IMG.","source":"verdict.one_line_summary","status":"machine_extracted","claim_id":"C3","attestation":"unclaimed"},{"kind":"headline","text":"Visual token pruning can lower calibration error in multimodal models while preserving accuracy.","source":"verdict.pith_extraction.headline","status":"machine_extracted","claim_id":"C4","attestation":"unclaimed"}],"snapshot_sha256":"c1d787991e05358a47365b7a3e1377b01791b9a8160f4790195605df04e1b690"},"source":{"id":"2604.12035","kind":"arxiv","version":2},"verdict":{"id":"26c546ef-6cdd-4b7a-b2c7-6b687e34fc93","model_set":{"reader":"grok-4.3"},"created_at":"2026-05-10T15:48:15.253493Z","strongest_claim":"On POPE, a pure-coverage setting in SCOPE achieves substantially lower ECE than the full unpruned model while maintaining similar accuracy. An internal alpha-sweep shows reducing the saliency weight improves calibration at all tested token budgets.","one_line_summary":"Certain coverage-based visual token pruning strategies lower Expected Calibration Error compared to unpruned models while keeping accuracy similar on POPE, and pruning reduces ECE on ScienceQA-IMG.","pipeline_version":"pith-pipeline@v0.9.0","weakest_assumption":"That the specific datasets, model, token budgets, and pruning implementations tested are representative enough for the observed calibration trends to generalize beyond these conditions.","pith_extraction_headline":"Visual token pruning can lower calibration error in multimodal models while preserving accuracy."},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2604.12035/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"verdict_id":"26c546ef-6cdd-4b7a-b2c7-6b687e34fc93"},"signer":{"signer_id":"pith.science","signer_type":"pith_registry","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"created_at":"2026-07-21T01:20:47Z","supersedes":[],"prev_event":null,"signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"/h1tGRJmVLmMSNwcxVeAgF2c/fQ+cQgyPNAlE+QeWoVbSkGgbyxJNnEok5/YIeeTfyCXNqplTWKSX/U6UNv9Aw==","signed_message":"open_graph_event_sha256_bytes","signed_at":"2026-08-06T14:45:46.640638Z"},"content_sha256":"07f72295dd24bc2b711b372ff6ad079cec6ca3b532cadc7593ff627d26430fe8","schema_version":"1.0","event_id":"sha256:07f72295dd24bc2b711b372ff6ad079cec6ca3b532cadc7593ff627d26430fe8"}],"timestamp_proofs":[],"mirror_hints":[{"mirror_type":"https","name":"Pith Resolver","base_url":"https://pith.science","bundle_url":"https://pith.science/pith/YLPXIENMUS63UNDJCRGVGCY62D/bundle.json","state_url":"https://pith.science/pith/YLPXIENMUS63UNDJCRGVGCY62D/state.json","well_known_bundle_url":"https://pith.science/.well-known/pith/YLPXIENMUS63UNDJCRGVGCY62D/bundle.json","status":"primary"}],"public_keys":[{"key_id":"pith-v1-2026-05","algorithm":"ed25519","format":"raw","public_key_b64":"stVStoiQhXFxp4s2pdzPNoqVNBMojDU/fJ2db5S3CbM=","public_key_hex":"b2d552b68890857171a78b36a5dccf368a953413288c353f7c9d9d6f94b709b3","fingerprint_sha256_b32_first128bits":"RVFV5Z2OI2J3ZUO7ERDEBCYNKS","fingerprint_sha256_hex":"8d4b5ee74e4693bcd1df2446408b0d54","rotates_at":null,"url":"https://pith.science/pith-signing-key.json","notes":"Pith uses this Ed25519 key to sign canonical record SHA-256 digests. Verify with: ed25519_verify(public_key, message=canonical_sha256_bytes, signature=base64decode(signature_b64))."}],"merge_version":"pith-open-graph-merge-v1","built_at":"2026-08-06T14:45:46Z","links":{"resolver":"https://pith.science/pith/YLPXIENMUS63UNDJCRGVGCY62D","bundle":"https://pith.science/pith/YLPXIENMUS63UNDJCRGVGCY62D/bundle.json","state":"https://pith.science/pith/YLPXIENMUS63UNDJCRGVGCY62D/state.json","well_known_bundle":"https://pith.science/.well-known/pith/YLPXIENMUS63UNDJCRGVGCY62D/bundle.json"},"state":{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2026:YLPXIENMUS63UNDJCRGVGCY62D","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"dab49b90c0cb9521451afd006bc33abb77902fde9026f162d708046fe304f5bd","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2026-04-13T20:24:03Z","title_canon_sha256":"087c9f3065710456573d1dde655622e449d3f2d4ff858c63ecaa6aea5c2c99e8"},"schema_version":"1.0","source":{"id":"2604.12035","kind":"arxiv","version":2}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2604.12035","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"arxiv_version","alias_value":"2604.12035v2","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2604.12035","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"pith_short_12","alias_value":"YLPXIENMUS63","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"pith_short_16","alias_value":"YLPXIENMUS63UNDJ","created_at":"2026-07-21T01:20:47Z"},{"alias_kind":"pith_short_8","alias_value":"YLPXIENM","created_at":"2026-07-21T01:20:47Z"}],"graph_snapshots":[{"event_id":"sha256:07f72295dd24bc2b711b372ff6ad079cec6ca3b532cadc7593ff627d26430fe8","target":"graph","created_at":"2026-07-21T01:20:47Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":4,"items":[{"attestation":"unclaimed","claim_id":"C1","kind":"strongest_claim","source":"verdict.strongest_claim","status":"machine_extracted","text":"On POPE, a pure-coverage setting in SCOPE achieves substantially lower ECE than the full unpruned model while maintaining similar accuracy. An internal alpha-sweep shows reducing the saliency weight improves calibration at all tested token budgets."},{"attestation":"unclaimed","claim_id":"C2","kind":"weakest_assumption","source":"verdict.weakest_assumption","status":"machine_extracted","text":"That the specific datasets, model, token budgets, and pruning implementations tested are representative enough for the observed calibration trends to generalize beyond these conditions."},{"attestation":"unclaimed","claim_id":"C3","kind":"one_line_summary","source":"verdict.one_line_summary","status":"machine_extracted","text":"Certain coverage-based visual token pruning strategies lower Expected Calibration Error compared to unpruned models while keeping accuracy similar on POPE, and pruning reduces ECE on ScienceQA-IMG."},{"attestation":"unclaimed","claim_id":"C4","kind":"headline","source":"verdict.pith_extraction.headline","status":"machine_extracted","text":"Visual token pruning can lower calibration error in multimodal models while preserving accuracy."}],"snapshot_sha256":"c1d787991e05358a47365b7a3e1377b01791b9a8160f4790195605df04e1b690"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2604.12035/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Visual token pruning is widely used to reduce the inference cost of multimodal large language models (MLLMs), but it is usually evaluated only by accuracy. We study how pruning affects calibration, defined as the agreement between confidence and correctness, and show that the selection rule matters more than the token budget alone. On POPE with LLaVA-1.5, coverage-based pruning from 576 to 128 tokens reduces expected calibration error from 0.041 to 0.016 without a statistically significant accuracy loss. In contrast, attention-based selection preserves confidence while accuracy deteriorates, b","authors_text":"Hanzhe Hong, Heqing Du, Kaizhen Tan, Siru Tao, Yang Feng","cross_cats":[],"headline":"Visual token pruning can lower calibration error in multimodal models while preserving accuracy.","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2026-04-13T20:24:03Z","title":"When Does Visual Token Pruning Improve Calibration? The Role of Evidence Coverage in MLLMs"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2604.12035","kind":"arxiv","version":2},"verdict":{"created_at":"2026-05-10T15:48:15.253493Z","id":"26c546ef-6cdd-4b7a-b2c7-6b687e34fc93","model_set":{"reader":"grok-4.3"},"one_line_summary":"Certain coverage-based visual token pruning strategies lower Expected Calibration Error compared to unpruned models while keeping accuracy similar on POPE, and pruning reduces ECE on ScienceQA-IMG.","pipeline_version":"pith-pipeline@v0.9.0","pith_extraction_headline":"Visual token pruning can lower calibration error in multimodal models while preserving accuracy.","strongest_claim":"On POPE, a pure-coverage setting in SCOPE achieves substantially lower ECE than the full unpruned model while maintaining similar accuracy. An internal alpha-sweep shows reducing the saliency weight improves calibration at all tested token budgets.","weakest_assumption":"That the specific datasets, model, token budgets, and pruning implementations tested are representative enough for the observed calibration trends to generalize beyond these conditions."}},"verdict_id":"26c546ef-6cdd-4b7a-b2c7-6b687e34fc93"}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:e47c6a110e757a971b492e191cf73b67e4a5843b9998a44d50815fe8d009b892","target":"record","created_at":"2026-07-21T01:20:47Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"dab49b90c0cb9521451afd006bc33abb77902fde9026f162d708046fe304f5bd","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2026-04-13T20:24:03Z","title_canon_sha256":"087c9f3065710456573d1dde655622e449d3f2d4ff858c63ecaa6aea5c2c99e8"},"schema_version":"1.0","source":{"id":"2604.12035","kind":"arxiv","version":2}},"canonical_sha256":"c2df7411aca4bdba3469144d530b1ed0d778380d0e80f1dbddc83d6d3a9d8f1c","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"c2df7411aca4bdba3469144d530b1ed0d778380d0e80f1dbddc83d6d3a9d8f1c","first_computed_at":"2026-07-21T01:20:47.907710Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-21T01:20:47.907710Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"J4KokbDCAqSKn8gX+K9UU+Oub52h49ZBqmR0L2pMZhLSqGgSn58RE1mDWiJZF6JGcXA9AyfBCmkedd6BEBofDg==","signature_status":"signed_v1","signed_at":"2026-07-21T01:20:47.908725Z","signed_message":"canonical_sha256_bytes"},"source_id":"2604.12035","source_kind":"arxiv","source_version":2}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:e47c6a110e757a971b492e191cf73b67e4a5843b9998a44d50815fe8d009b892","sha256:07f72295dd24bc2b711b372ff6ad079cec6ca3b532cadc7593ff627d26430fe8"],"state_sha256":"b90ee0444594675bb5fbc59beb71fe51b5af366cf57396ebdaa3dfed14de09cc"},"bundle_signature":{"signature_status":"signed_v1","algorithm":"ed25519","key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signature_b64":"153XICwKz3JOeGdgm7/dCQPRzPaRq2KVHubQcLNwPB0UlcatJYIuoBu9Dmv/nD8SWrplH8PsBIXu4J8Pp8exAQ==","signed_message":"bundle_sha256_bytes","signed_at":"2026-08-06T14:45:46.913961Z","bundle_sha256":"d4001740080d8d876a097bdbc61b3d819f1d4724290b98788645b4c61f24492f"}}