{"state_type":"pith_open_graph_state","state_version":"1.0","pith_number":"pith:2025:4YXGLB6V7BAJBMLXGB64QYYQFF","merge_version":"pith-open-graph-merge-v1","event_count":2,"valid_event_count":2,"invalid_event_count":0,"equivocation_count":0,"current":{"canonical_record":{"metadata":{"abstract_canon_sha256":"0ac6c3c1204f7e37f9cb239a1e643cdaceda0452ffc33270456d9254448e5917","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2025-08-14T02:43:53Z","title_canon_sha256":"aa42ce30f1a0958979d6699c7de99554ff337f1483314291c26f4fb0692264a8"},"schema_version":"1.0","source":{"id":"2508.10293","kind":"arxiv","version":2}},"source_aliases":[{"alias_kind":"arxiv","alias_value":"2508.10293","created_at":"2026-07-05T11:54:51Z"},{"alias_kind":"arxiv_version","alias_value":"2508.10293v2","created_at":"2026-07-05T11:54:51Z"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2508.10293","created_at":"2026-07-05T11:54:51Z"},{"alias_kind":"pith_short_12","alias_value":"4YXGLB6V7BAJ","created_at":"2026-07-05T11:54:51Z"},{"alias_kind":"pith_short_16","alias_value":"4YXGLB6V7BAJBMLX","created_at":"2026-07-05T11:54:51Z"},{"alias_kind":"pith_short_8","alias_value":"4YXGLB6V","created_at":"2026-07-05T11:54:51Z"}],"graph_snapshots":[{"event_id":"sha256:7b7a6ebf6b3c489912af99c773afbba3e5f6363b5dbd1df987bd28306aefec8d","target":"graph","created_at":"2026-07-05T11:54:51Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"graph_snapshot":{"author_claims":{"count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","strong_count":0},"builder_version":"pith-number-builder-2026-05-17-v1","claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"integrity":{"available":true,"clean":true,"detectors_run":[],"endpoint":"/pith/2508.10293/integrity.json","findings":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938","summary":{"advisory":0,"by_detector":{},"critical":0,"informational":0}},"paper":{"abstract_excerpt":"Large reasoning models (LRMs) have recently achieved significant progress in complex reasoning tasks, aided by reinforcement learning with verifiable rewards. However, LRMs often suffer from overthinking, expending excessive computation on simple problems and reducing efficiency. Existing efficient reasoning methods typically require accurate task assessment to preset token budgets or select reasoning modes, which limits their flexibility and reliability. In this work, we revisit the essence of overthinking and identify that encouraging effective steps while penalizing ineffective ones is key ","authors_text":"Chengqi Dong, Chuhuai Yue, Guojun Yin, Hang He, Jiajun Chai, Wei Lin, Yinan Gao","cross_cats":[],"headline":"","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2025-08-14T02:43:53Z","title":"Promoting Efficient Reasoning with Verifiable Stepwise Reward"},"references":{"count":0,"internal_anchors":0,"resolved_work":0,"sample":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2508.10293","kind":"arxiv","version":2},"verdict":{"created_at":null,"id":null,"model_set":{},"one_line_summary":"","pipeline_version":null,"pith_extraction_headline":"","strongest_claim":"","weakest_assumption":""}},"verdict_id":null}}],"author_attestations":[],"timestamp_anchors":[],"storage_attestations":[],"citation_signatures":[],"replication_records":[],"corrections":[],"mirror_hints":[],"record_created":{"event_id":"sha256:21c6dbd601895868e001790ee0cecdb0389836f831e4ef86abcc6987fe696067","target":"record","created_at":"2026-07-05T11:54:51Z","signer":{"key_id":"pith-v1-2026-05","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","signer_id":"pith.science","signer_type":"pith_registry"},"payload":{"attestation_state":"computed","canonical_record":{"metadata":{"abstract_canon_sha256":"0ac6c3c1204f7e37f9cb239a1e643cdaceda0452ffc33270456d9254448e5917","cross_cats_sorted":[],"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.AI","submitted_at":"2025-08-14T02:43:53Z","title_canon_sha256":"aa42ce30f1a0958979d6699c7de99554ff337f1483314291c26f4fb0692264a8"},"schema_version":"1.0","source":{"id":"2508.10293","kind":"arxiv","version":2}},"canonical_sha256":"e62e6587d5f84090b177307dc86310296f99bf8bd893c0dc70091322d5c9c7ca","receipt":{"algorithm":"ed25519","builder_version":"pith-number-builder-2026-05-17-v1","canonical_sha256":"e62e6587d5f84090b177307dc86310296f99bf8bd893c0dc70091322d5c9c7ca","first_computed_at":"2026-07-05T11:54:51.160052Z","key_id":"pith-v1-2026-05","kind":"pith_receipt","last_reissued_at":"2026-07-05T11:54:51.160052Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54","receipt_version":"0.3","signature_b64":"tID9hKKuWw5kh4HFZpsPAECkQhBvuL6t+emp7+DreWbHn/p65KuPpb5FAJ7Dw8SMIJoUmdYJ9/fIzu66iS6SAw==","signature_status":"signed_v1","signed_at":"2026-07-05T11:54:51.160694Z","signed_message":"canonical_sha256_bytes"},"source_id":"2508.10293","source_kind":"arxiv","source_version":2}}},"equivocations":[],"invalid_events":[],"applied_event_ids":["sha256:21c6dbd601895868e001790ee0cecdb0389836f831e4ef86abcc6987fe696067","sha256:7b7a6ebf6b3c489912af99c773afbba3e5f6363b5dbd1df987bd28306aefec8d"],"state_sha256":"1a15e82ed27d1c851db61949502be56b96b29097e4f0101637b4ab1c6e3c19cf"}