{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:ENOVKCSFF7WXQDFIHJRAA6GTMR","short_pith_number":"pith:ENOVKCSF","schema_version":"1.0","canonical_sha256":"235d550a452fed780ca83a620078d364750d232ed1e5260d6b14331318703c4f","source":{"kind":"arxiv","id":"2506.09800","version":1},"attestation_state":"computed","paper":{"title":"Reinforced Refinement with Self-Aware Expansion for End-to-End Autonomous Driving","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.RO","authors_text":"Caojun Wang, Chen Lv, Haochen Liu, Haochen Tian, Haohan Yang, Hongchen Li, Hongyang Li, Ke Guo, Li Chen, Tianyu Li","submitted_at":"2025-06-11T14:42:11Z","abstract_excerpt":"End-to-end autonomous driving has emerged as a promising paradigm for directly mapping sensor inputs to planning maneuvers using learning-based modular integrations. However, existing imitation learning (IL)-based models suffer from generalization to hard cases, and a lack of corrective feedback loop under post-deployment. While reinforcement learning (RL) offers a potential solution to tackle hard cases with optimality, it is often hindered by overfitting to specific driving cases, resulting in catastrophic forgetting of generalizable knowledge and sample inefficiency. To overcome these chall"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2506.09800","kind":"arxiv","version":1},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.RO","submitted_at":"2025-06-11T14:42:11Z","cross_cats_sorted":[],"title_canon_sha256":"146a44da476b51ae98aeeab7be582df9dbe37f232ca4248aecbcdfba2c37582f","abstract_canon_sha256":"3c558be44d9d58265aa37731781e32863aabf966507aacef58281f3a4e4a91e4"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:19:57.228294Z","signature_b64":"x7I8mm3cVSpPUvgq0qBGFZkBZLNKJBlh+eJXUEvW2L3+HMfTLV6mzGQH94M4u2B9wHVOCn/sZz12S/skdEVnDg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"235d550a452fed780ca83a620078d364750d232ed1e5260d6b14331318703c4f","last_reissued_at":"2026-07-05T11:19:57.227715Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:19:57.227715Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Reinforced Refinement with Self-Aware Expansion for End-to-End Autonomous Driving","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.RO","authors_text":"Caojun Wang, Chen Lv, Haochen Liu, Haochen Tian, Haohan Yang, Hongchen Li, Hongyang Li, Ke Guo, Li Chen, Tianyu Li","submitted_at":"2025-06-11T14:42:11Z","abstract_excerpt":"End-to-end autonomous driving has emerged as a promising paradigm for directly mapping sensor inputs to planning maneuvers using learning-based modular integrations. However, existing imitation learning (IL)-based models suffer from generalization to hard cases, and a lack of corrective feedback loop under post-deployment. While reinforcement learning (RL) offers a potential solution to tackle hard cases with optimality, it is often hindered by overfitting to specific driving cases, resulting in catastrophic forgetting of generalizable knowledge and sample inefficiency. To overcome these chall"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2506.09800","kind":"arxiv","version":1},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2506.09800/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2506.09800","created_at":"2026-07-05T11:19:57.227776+00:00"},{"alias_kind":"arxiv_version","alias_value":"2506.09800v1","created_at":"2026-07-05T11:19:57.227776+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2506.09800","created_at":"2026-07-05T11:19:57.227776+00:00"},{"alias_kind":"pith_short_12","alias_value":"ENOVKCSFF7WX","created_at":"2026-07-05T11:19:57.227776+00:00"},{"alias_kind":"pith_short_16","alias_value":"ENOVKCSFF7WXQDFI","created_at":"2026-07-05T11:19:57.227776+00:00"},{"alias_kind":"pith_short_8","alias_value":"ENOVKCSF","created_at":"2026-07-05T11:19:57.227776+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":8,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2512.10719","citing_title":"SpaceDrive: Infusing Spatial Awareness into VLM-based Autonomous Driving","ref_index":42,"is_internal_anchor":false},{"citing_arxiv_id":"2605.14201","citing_title":"MAPLE: Latent Multi-Agent Play for End-to-End Autonomous Driving","ref_index":29,"is_internal_anchor":false},{"citing_arxiv_id":"2511.23369","citing_title":"SimScale: Learning to Drive via Real-World Simulation at Scale","ref_index":58,"is_internal_anchor":false},{"citing_arxiv_id":"2512.07661","citing_title":"Optimization-Guided Diffusion for Interactive Scene Generation","ref_index":24,"is_internal_anchor":false},{"citing_arxiv_id":"2506.08052","citing_title":"ReCogDrive: A Reinforced Cognitive Framework for End-to-End Autonomous Driving","ref_index":22,"is_internal_anchor":false},{"citing_arxiv_id":"2605.14201","citing_title":"MAPLE: Latent Multi-Agent Play for End-to-End Autonomous Driving","ref_index":29,"is_internal_anchor":false},{"citing_arxiv_id":"2604.07378","citing_title":"Evaluation as Evolution: Transforming Adversarial Diffusion into Closed-Loop Curricula for Autonomous Vehicles","ref_index":32,"is_internal_anchor":false},{"citing_arxiv_id":"2604.15308","citing_title":"RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework","ref_index":38,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR","json":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR.json","graph_json":"https://pith.science/api/pith-number/ENOVKCSFF7WXQDFIHJRAA6GTMR/graph.json","events_json":"https://pith.science/api/pith-number/ENOVKCSFF7WXQDFIHJRAA6GTMR/events.json","paper":"https://pith.science/paper/ENOVKCSF"},"agent_actions":{"view_html":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR","download_json":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR.json","view_paper":"https://pith.science/paper/ENOVKCSF","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2506.09800&json=true","fetch_graph":"https://pith.science/api/pith-number/ENOVKCSFF7WXQDFIHJRAA6GTMR/graph.json","fetch_events":"https://pith.science/api/pith-number/ENOVKCSFF7WXQDFIHJRAA6GTMR/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR/action/timestamp_anchor","attest_storage":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR/action/storage_attestation","attest_author":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR/action/author_attestation","sign_citation":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR/action/citation_signature","submit_replication":"https://pith.science/pith/ENOVKCSFF7WXQDFIHJRAA6GTMR/action/replication_record"}},"created_at":"2026-07-05T11:19:57.227776+00:00","updated_at":"2026-07-05T11:19:57.227776+00:00"}