{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2020:SAPITM6DUCKEJSCE5MOJYDBZQ7","short_pith_number":"pith:SAPITM6D","schema_version":"1.0","canonical_sha256":"901e89b3c3a09444c844eb1c9c0c3987c4fb8fa0b2daccc9fb7f066aa7c3bc0f","source":{"kind":"arxiv","id":"2010.00467","version":3},"attestation_state":"computed","paper":{"title":"Bag of Tricks for Adversarial Training","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CV","stat.ML"],"primary_cat":"cs.LG","authors_text":"Hang Su, Jun Zhu, Tianyu Pang, Xiao Yang, Yinpeng Dong","submitted_at":"2020-10-01T15:03:51Z","abstract_excerpt":"Adversarial training (AT) is one of the most effective strategies for promoting model robustness. However, recent benchmarks show that most of the proposed improvements on AT are less effective than simply early stopping the training procedure. This counter-intuitive fact motivates us to investigate the implementation details of tens of AT methods. Surprisingly, we find that the basic settings (e.g., weight decay, training schedule, etc.) used in these methods are highly inconsistent. In this work, we provide comprehensive evaluations on CIFAR-10, focusing on the effects of mostly overlooked t"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2010.00467","kind":"arxiv","version":3},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.LG","submitted_at":"2020-10-01T15:03:51Z","cross_cats_sorted":["cs.CV","stat.ML"],"title_canon_sha256":"63c4b8d21a1e14290b702a0b28f287cac96d8d05837f7362749992621e98b551","abstract_canon_sha256":"9ae39973999e8ef2c343f3b311d54719b213b6d6b600f181ce006ded8aba1ca3"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T02:28:06.049396Z","signature_b64":"XxE4knBrILmCrFWR5DZ6QMelD7E7x1EQzirO+LraA8MpFLwCFzbBLJp4uM0YaBE72HdrrimzBOpRUmov0Ee8Bg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"901e89b3c3a09444c844eb1c9c0c3987c4fb8fa0b2daccc9fb7f066aa7c3bc0f","last_reissued_at":"2026-07-05T02:28:06.048947Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T02:28:06.048947Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Bag of Tricks for Adversarial Training","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.CV","stat.ML"],"primary_cat":"cs.LG","authors_text":"Hang Su, Jun Zhu, Tianyu Pang, Xiao Yang, Yinpeng Dong","submitted_at":"2020-10-01T15:03:51Z","abstract_excerpt":"Adversarial training (AT) is one of the most effective strategies for promoting model robustness. However, recent benchmarks show that most of the proposed improvements on AT are less effective than simply early stopping the training procedure. This counter-intuitive fact motivates us to investigate the implementation details of tens of AT methods. Surprisingly, we find that the basic settings (e.g., weight decay, training schedule, etc.) used in these methods are highly inconsistent. In this work, we provide comprehensive evaluations on CIFAR-10, focusing on the effects of mostly overlooked t"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2010.00467","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2010.00467/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2010.00467","created_at":"2026-07-05T02:28:06.049004+00:00"},{"alias_kind":"arxiv_version","alias_value":"2010.00467v3","created_at":"2026-07-05T02:28:06.049004+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2010.00467","created_at":"2026-07-05T02:28:06.049004+00:00"},{"alias_kind":"pith_short_12","alias_value":"SAPITM6DUCKE","created_at":"2026-07-05T02:28:06.049004+00:00"},{"alias_kind":"pith_short_16","alias_value":"SAPITM6DUCKEJSCE","created_at":"2026-07-05T02:28:06.049004+00:00"},{"alias_kind":"pith_short_8","alias_value":"SAPITM6D","created_at":"2026-07-05T02:28:06.049004+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":3,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2607.00207","citing_title":"Homogenization of $\\ell_2$-Adversarial Training in High-Dimensions: Exact Dynamics under Stochastic Gradient Descent","ref_index":48,"is_internal_anchor":false},{"citing_arxiv_id":"2606.04767","citing_title":"Measuring Model Robustness via Fisher Information: Spectral Bounds, Theoretical Guarantees, and Practical Algorithms","ref_index":95,"is_internal_anchor":false},{"citing_arxiv_id":"2605.15416","citing_title":"Margin-Adaptive Confidence Ranking for Reliable LLM Judgement","ref_index":141,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7","json":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7.json","graph_json":"https://pith.science/api/pith-number/SAPITM6DUCKEJSCE5MOJYDBZQ7/graph.json","events_json":"https://pith.science/api/pith-number/SAPITM6DUCKEJSCE5MOJYDBZQ7/events.json","paper":"https://pith.science/paper/SAPITM6D"},"agent_actions":{"view_html":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7","download_json":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7.json","view_paper":"https://pith.science/paper/SAPITM6D","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2010.00467&json=true","fetch_graph":"https://pith.science/api/pith-number/SAPITM6DUCKEJSCE5MOJYDBZQ7/graph.json","fetch_events":"https://pith.science/api/pith-number/SAPITM6DUCKEJSCE5MOJYDBZQ7/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7/action/timestamp_anchor","attest_storage":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7/action/storage_attestation","attest_author":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7/action/author_attestation","sign_citation":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7/action/citation_signature","submit_replication":"https://pith.science/pith/SAPITM6DUCKEJSCE5MOJYDBZQ7/action/replication_record"}},"created_at":"2026-07-05T02:28:06.049004+00:00","updated_at":"2026-07-05T02:28:06.049004+00:00"}