{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:PBQCFJABOM3NXG5TON6FKSQBPF","short_pith_number":"pith:PBQCFJAB","schema_version":"1.0","canonical_sha256":"786022a4017336db9bb3737c554a0179641307c03c4ae7ef0244365a787c7a3d","source":{"kind":"arxiv","id":"2509.09090","version":1},"attestation_state":"computed","paper":{"title":"SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CV","authors_text":"Hengyu Fang, Huanrui Yang, Li Du, Yijiang Liu, Yuan Du","submitted_at":"2025-09-11T01:52:25Z","abstract_excerpt":"Vision-Language-Action (VLA) models exhibit unprecedented capabilities for embodied intelligence. However, their extensive computational and memory costs hinder their practical deployment. Existing VLA compression and acceleration approaches conduct quantization or token pruning in an ad-hoc manner but fail to enable both for a holistic efficiency improvement due to an observed incompatibility. This work introduces SQAP-VLA, the first structured, training-free VLA inference acceleration framework that simultaneously enables state-of-the-art quantization and token pruning. We overcome the incom"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2509.09090","kind":"arxiv","version":1},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CV","submitted_at":"2025-09-11T01:52:25Z","cross_cats_sorted":["cs.AI"],"title_canon_sha256":"2538376a12ec49550471cf1539d187bbe94cabe44f1378f9ed67a83be1058403","abstract_canon_sha256":"0a1ce283492519b71de4f90300d49d2ebb6ca66b0a17189272a5cc6396ba8587"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T12:09:29.127977Z","signature_b64":"uPvJQey1fOHiRYhl5fuIjeQh8nfbO0R3KYH5s6IfkYcbnaEvDacG1jGzNh+Sqk11mcwJGPnnrg7sZ7FJJdVxCQ==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"786022a4017336db9bb3737c554a0179641307c03c4ae7ef0244365a787c7a3d","last_reissued_at":"2026-07-05T12:09:29.127507Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T12:09:29.127507Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI"],"primary_cat":"cs.CV","authors_text":"Hengyu Fang, Huanrui Yang, Li Du, Yijiang Liu, Yuan Du","submitted_at":"2025-09-11T01:52:25Z","abstract_excerpt":"Vision-Language-Action (VLA) models exhibit unprecedented capabilities for embodied intelligence. However, their extensive computational and memory costs hinder their practical deployment. Existing VLA compression and acceleration approaches conduct quantization or token pruning in an ad-hoc manner but fail to enable both for a holistic efficiency improvement due to an observed incompatibility. This work introduces SQAP-VLA, the first structured, training-free VLA inference acceleration framework that simultaneously enables state-of-the-art quantization and token pruning. We overcome the incom"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2509.09090","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2509.09090/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2509.09090","created_at":"2026-07-05T12:09:29.127571+00:00"},{"alias_kind":"arxiv_version","alias_value":"2509.09090v1","created_at":"2026-07-05T12:09:29.127571+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2509.09090","created_at":"2026-07-05T12:09:29.127571+00:00"},{"alias_kind":"pith_short_12","alias_value":"PBQCFJABOM3N","created_at":"2026-07-05T12:09:29.127571+00:00"},{"alias_kind":"pith_short_16","alias_value":"PBQCFJABOM3NXG5T","created_at":"2026-07-05T12:09:29.127571+00:00"},{"alias_kind":"pith_short_8","alias_value":"PBQCFJAB","created_at":"2026-07-05T12:09:29.127571+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":8,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.31382","citing_title":"Revisiting Parameter Redundancy in Vision-Language-Action Models: Insights from VLM-to-VLA Adaptation","ref_index":6,"is_internal_anchor":false},{"citing_arxiv_id":"2603.14371","citing_title":"OxyGen: Unified KV Cache Management for VLA Inference under Multi-Task Parallelism","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2603.19199","citing_title":"FASTER: Rethinking Real-Time Flow VLAs","ref_index":20,"is_internal_anchor":false},{"citing_arxiv_id":"2603.19199","citing_title":"FASTER: Rethinking Real-Time Flow VLAs","ref_index":20,"is_internal_anchor":false},{"citing_arxiv_id":"2605.02739","citing_title":"Latent Bridge: Feature Delta Prediction for Efficient Dual-System Vision-Language-Action Model Inference","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2604.11572","citing_title":"DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models","ref_index":3,"is_internal_anchor":false},{"citing_arxiv_id":"2604.05672","citing_title":"A1: A Fully Transparent Open-Source, Adaptive and Efficient Truncated Vision-Language-Action Model","ref_index":9,"is_internal_anchor":false},{"citing_arxiv_id":"2604.17320","citing_title":"Towards Joint Quantization and Token Pruning of Vision-Language Models","ref_index":8,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF","json":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF.json","graph_json":"https://pith.science/api/pith-number/PBQCFJABOM3NXG5TON6FKSQBPF/graph.json","events_json":"https://pith.science/api/pith-number/PBQCFJABOM3NXG5TON6FKSQBPF/events.json","paper":"https://pith.science/paper/PBQCFJAB"},"agent_actions":{"view_html":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF","download_json":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF.json","view_paper":"https://pith.science/paper/PBQCFJAB","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2509.09090&json=true","fetch_graph":"https://pith.science/api/pith-number/PBQCFJABOM3NXG5TON6FKSQBPF/graph.json","fetch_events":"https://pith.science/api/pith-number/PBQCFJABOM3NXG5TON6FKSQBPF/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF/action/timestamp_anchor","attest_storage":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF/action/storage_attestation","attest_author":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF/action/author_attestation","sign_citation":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF/action/citation_signature","submit_replication":"https://pith.science/pith/PBQCFJABOM3NXG5TON6FKSQBPF/action/replication_record"}},"created_at":"2026-07-05T12:09:29.127571+00:00","updated_at":"2026-07-05T12:09:29.127571+00:00"}