{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2024:OSBNGAQT34X6VB2ZOUU2XUI2XV","short_pith_number":"pith:OSBNGAQT","schema_version":"1.0","canonical_sha256":"7482d30213df2fea87597529abd11abd718d68503b2c66aa55fd7e62eee312a0","source":{"kind":"arxiv","id":"2404.14619","version":2},"attestation_state":"computed","paper":{"title":"OpenELM: An Efficient Language Model Family with Open Training and Inference Framework","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI","cs.LG"],"primary_cat":"cs.CL","authors_text":"Chenfan Sun, Dmitry Belenko, Iman Mirzadeh, Mahyar Najibi, Maxwell Horton, Mohammad Hossein Sekhavat, Mohammad Rastegari, Peter Zatloukal, Qingqing Cao, Sachin Mehta, Yanzi Jin","submitted_at":"2024-04-22T23:12:03Z","abstract_excerpt":"The reproducibility and transparency of large language models are crucial for advancing open research, ensuring the trustworthiness of results, and enabling investigations into data and model biases, as well as potential risks. To this end, we release OpenELM, a state-of-the-art open language model. OpenELM uses a layer-wise scaling strategy to efficiently allocate parameters within each layer of the transformer model, leading to enhanced accuracy. For example, with a parameter budget of approximately one billion parameters, OpenELM exhibits a 2.36% improvement in accuracy compared to OLMo whi"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2404.14619","kind":"arxiv","version":2},"metadata":{"license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","primary_cat":"cs.CL","submitted_at":"2024-04-22T23:12:03Z","cross_cats_sorted":["cs.AI","cs.LG"],"title_canon_sha256":"3b9b748e60458bc86ec972da9a284b5ba89df284970a9fb8f5465c68e5c68717","abstract_canon_sha256":"a18bb6d48e5f4b0f1b819a1af4aa4701c6a47dd62e36f8fe75df10803a59a921"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T08:14:23.871791Z","signature_b64":"piOjaHZpdSstzAJI/5uyvUXW8cMRQuu6mEGgHwZobrdk3wK/mjYao8enJBWmsTP3C7/TSejp/Gy9J/BWisYyCg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"7482d30213df2fea87597529abd11abd718d68503b2c66aa55fd7e62eee312a0","last_reissued_at":"2026-07-05T08:14:23.871262Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T08:14:23.871262Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"OpenELM: An Efficient Language Model Family with Open Training and Inference Framework","license":"http://arxiv.org/licenses/nonexclusive-distrib/1.0/","headline":"","cross_cats":["cs.AI","cs.LG"],"primary_cat":"cs.CL","authors_text":"Chenfan Sun, Dmitry Belenko, Iman Mirzadeh, Mahyar Najibi, Maxwell Horton, Mohammad Hossein Sekhavat, Mohammad Rastegari, Peter Zatloukal, Qingqing Cao, Sachin Mehta, Yanzi Jin","submitted_at":"2024-04-22T23:12:03Z","abstract_excerpt":"The reproducibility and transparency of large language models are crucial for advancing open research, ensuring the trustworthiness of results, and enabling investigations into data and model biases, as well as potential risks. To this end, we release OpenELM, a state-of-the-art open language model. OpenELM uses a layer-wise scaling strategy to efficiently allocate parameters within each layer of the transformer model, leading to enhanced accuracy. For example, with a parameter budget of approximately one billion parameters, OpenELM exhibits a 2.36% improvement in accuracy compared to OLMo whi"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2404.14619","kind":"arxiv","version":2},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2404.14619/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2404.14619","created_at":"2026-07-05T08:14:23.871328+00:00"},{"alias_kind":"arxiv_version","alias_value":"2404.14619v2","created_at":"2026-07-05T08:14:23.871328+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2404.14619","created_at":"2026-07-05T08:14:23.871328+00:00"},{"alias_kind":"pith_short_12","alias_value":"OSBNGAQT34X6","created_at":"2026-07-05T08:14:23.871328+00:00"},{"alias_kind":"pith_short_16","alias_value":"OSBNGAQT34X6VB2Z","created_at":"2026-07-05T08:14:23.871328+00:00"},{"alias_kind":"pith_short_8","alias_value":"OSBNGAQT","created_at":"2026-07-05T08:14:23.871328+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":6,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2606.18246","citing_title":"Variable-Width Transformers","ref_index":25,"is_internal_anchor":false},{"citing_arxiv_id":"2605.23857","citing_title":"Strong Teacher Not Needed? On Distillation in LLM Pretraining","ref_index":8,"is_internal_anchor":false},{"citing_arxiv_id":"2407.09577","citing_title":"FlashNorm: Fast Normalization for Transformers","ref_index":4,"is_internal_anchor":false},{"citing_arxiv_id":"2503.08223","citing_title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","ref_index":155,"is_internal_anchor":false},{"citing_arxiv_id":"2605.17653","citing_title":"LLMForge: Multi-Backend Hardware-Aware Neural Architecture Search with Infinite-Head Attention for Edge Language Models","ref_index":22,"is_internal_anchor":false},{"citing_arxiv_id":"2605.14521","citing_title":"Enjoy Your Layer Normalization with the Computational Efficiency of RMSNorm","ref_index":92,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV","json":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV.json","graph_json":"https://pith.science/api/pith-number/OSBNGAQT34X6VB2ZOUU2XUI2XV/graph.json","events_json":"https://pith.science/api/pith-number/OSBNGAQT34X6VB2ZOUU2XUI2XV/events.json","paper":"https://pith.science/paper/OSBNGAQT"},"agent_actions":{"view_html":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV","download_json":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV.json","view_paper":"https://pith.science/paper/OSBNGAQT","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2404.14619&json=true","fetch_graph":"https://pith.science/api/pith-number/OSBNGAQT34X6VB2ZOUU2XUI2XV/graph.json","fetch_events":"https://pith.science/api/pith-number/OSBNGAQT34X6VB2ZOUU2XUI2XV/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV/action/timestamp_anchor","attest_storage":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV/action/storage_attestation","attest_author":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV/action/author_attestation","sign_citation":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV/action/citation_signature","submit_replication":"https://pith.science/pith/OSBNGAQT34X6VB2ZOUU2XUI2XV/action/replication_record"}},"created_at":"2026-07-05T08:14:23.871328+00:00","updated_at":"2026-07-05T08:14:23.871328+00:00"}