{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:ZO25V2XLFEOMJXB6AOOZODUHS3","short_pith_number":"pith:ZO25V2XL","schema_version":"1.0","canonical_sha256":"cbb5daeaeb291cc4dc3e039d970e8796d0950e47123672914c8c86ac67c06e8d","source":{"kind":"arxiv","id":"2410.21272","version":2},"attestation_state":"computed","paper":{"title":"Arithmetic Without Algorithms: Language Models Solve Math With a Bag of Heuristics","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Aaron Mueller, Anja Reusch, Yaniv Nikankin, Yonatan Belinkov","submitted_at":"2024-10-28T17:59:06Z","abstract_excerpt":"Do large language models (LLMs) solve reasoning tasks by learning robust generalizable algorithms, or do they memorize training data? To investigate this question, we use arithmetic reasoning as a representative task. Using causal analysis, we identify a subset of the model (a circuit) that explains most of the model's behavior for basic arithmetic logic and examine its functionality. By zooming in on the level of individual circuit neurons, we discover a sparse set of important neurons that implement simple heuristics. Each heuristic identifies a numerical input pattern and outputs correspond"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2410.21272","kind":"arxiv","version":2},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2024-10-28T17:59:06Z","cross_cats_sorted":[],"title_canon_sha256":"509281457bf2d256925a98a66fa122f52791bb9a290545b80708b1714ce4fb5e","abstract_canon_sha256":"28efa79a98c527e948fed2d8fa4845ad4699d64c0d086282edefcab54665ff78"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T11:06:09.522795Z","signature_b64":"LcDmnZ7Sw9TwZn5X1UP1Ff10HfQ9tNVozN2Q0GToLlHQXuT9szqlwJhkMVaQHrcJmNQ5jSHLCAlGBnbZ0rR2Ag==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"cbb5daeaeb291cc4dc3e039d970e8796d0950e47123672914c8c86ac67c06e8d","last_reissued_at":"2026-07-05T11:06:09.522237Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T11:06:09.522237Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"Arithmetic Without Algorithms: Language Models Solve Math With a Bag of Heuristics","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":[],"primary_cat":"cs.CL","authors_text":"Aaron Mueller, Anja Reusch, Yaniv Nikankin, Yonatan Belinkov","submitted_at":"2024-10-28T17:59:06Z","abstract_excerpt":"Do large language models (LLMs) solve reasoning tasks by learning robust generalizable algorithms, or do they memorize training data? To investigate this question, we use arithmetic reasoning as a representative task. Using causal analysis, we identify a subset of the model (a circuit) that explains most of the model's behavior for basic arithmetic logic and examine its functionality. By zooming in on the level of individual circuit neurons, we discover a sparse set of important neurons that implement simple heuristics. Each heuristic identifies a numerical input pattern and outputs correspond"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2410.21272","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2410.21272/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2410.21272","created_at":"2026-07-05T11:06:09.522302+00:00"},{"alias_kind":"arxiv_version","alias_value":"2410.21272v2","created_at":"2026-07-05T11:06:09.522302+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2410.21272","created_at":"2026-07-05T11:06:09.522302+00:00"},{"alias_kind":"pith_short_12","alias_value":"ZO25V2XLFEOM","created_at":"2026-07-05T11:06:09.522302+00:00"},{"alias_kind":"pith_short_16","alias_value":"ZO25V2XLFEOMJXB6","created_at":"2026-07-05T11:06:09.522302+00:00"},{"alias_kind":"pith_short_8","alias_value":"ZO25V2XL","created_at":"2026-07-05T11:06:09.522302+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":8,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2605.03058","citing_title":"Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ablation","ref_index":40,"is_internal_anchor":false},{"citing_arxiv_id":"2606.27981","citing_title":"ToxiREX: A Dataset on Toxic REasoning in ConteXt","ref_index":28,"is_internal_anchor":false},{"citing_arxiv_id":"2606.11657","citing_title":"Sparse probes and murky physics: a case study of interpretability challenges in a foundation model for continuum dynamics","ref_index":28,"is_internal_anchor":false},{"citing_arxiv_id":"2605.22488","citing_title":"Represented Is Not Computed: A Causal Test of Candidate Algorithmic Intermediates in a Transformer","ref_index":18,"is_internal_anchor":false},{"citing_arxiv_id":"2603.29025","citing_title":"The Model Says Walk: How Surface Heuristics Override Implicit Constraints in LLM Reasoning","ref_index":12,"is_internal_anchor":false},{"citing_arxiv_id":"2604.15306","citing_title":"Generalization in LLM Problem Solving: The Case of the Shortest Path","ref_index":36,"is_internal_anchor":false},{"citing_arxiv_id":"2604.16756","citing_title":"Mitigating Prompt-Induced Cognitive Biases in General-Purpose AI for Software Engineering","ref_index":37,"is_internal_anchor":false},{"citing_arxiv_id":"2605.03058","citing_title":"Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ablation","ref_index":40,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3","json":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3.json","graph_json":"https://pith.science/api/pith-number/ZO25V2XLFEOMJXB6AOOZODUHS3/graph.json","events_json":"https://pith.science/api/pith-number/ZO25V2XLFEOMJXB6AOOZODUHS3/events.json","paper":"https://pith.science/paper/ZO25V2XL"},"agent_actions":{"view_html":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3","download_json":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3.json","view_paper":"https://pith.science/paper/ZO25V2XL","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2410.21272&json=true","fetch_graph":"https://pith.science/api/pith-number/ZO25V2XLFEOMJXB6AOOZODUHS3/graph.json","fetch_events":"https://pith.science/api/pith-number/ZO25V2XLFEOMJXB6AOOZODUHS3/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3/action/timestamp_anchor","attest_storage":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3/action/storage_attestation","attest_author":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3/action/author_attestation","sign_citation":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3/action/citation_signature","submit_replication":"https://pith.science/pith/ZO25V2XLFEOMJXB6AOOZODUHS3/action/replication_record"}},"created_at":"2026-07-05T11:06:09.522302+00:00","updated_at":"2026-07-05T11:06:09.522302+00:00"}