{"record_type":"pith_number_record","schema_url":"https://pith.science/schemas/pith-number/v1.json","pith_number":"pith:2025:3ZWVZPFINH5AQHI4FXUXNTHBOU","short_pith_number":"pith:3ZWVZPFI","schema_version":"1.0","canonical_sha256":"de6d5cbca869fa081d1c2de976cce1752393d608349e2564f949cd78ff903be2","source":{"kind":"arxiv","id":"2501.02795","version":3},"attestation_state":"computed","paper":{"title":"InfiFusion: A Unified Framework for Enhanced Cross-Model Reasoning via LLM Fusion","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CV"],"primary_cat":"cs.CL","authors_text":"Baoyi He, Chunlin Ji, Fei Wu, Hongxia Yang, Qi Zhou, Shengyu Zhang, Yiming Zhang, Yuhao Fu, Zhaoyi Yan, Zhijie Sang","submitted_at":"2025-01-06T06:29:55Z","abstract_excerpt":"We introduce InfiFusion, an efficient training pipeline designed to integrate multiple domain-specialized Large Language Models (LLMs) into a single pivot model, effectively harnessing the strengths of each source model. Traditional fusion methods either merge model parameters directly or rely on knowledge distillation with rigid assumptions, limiting their flexibility and efficiency. InfiFusion overcomes these limitations by enhancing Universal Logit Distillation (ULD) with Top-K selection and Logits Standardization. We propose two fusion strategies: Pairwise Fusion (InfiFusion$_p$), where ea"},"verification_status":{"content_addressed":true,"pith_receipt":true,"author_attested":false,"weak_author_claims":0,"strong_author_claims":0,"externally_anchored":false,"storage_verified":false,"citation_signatures":0,"replication_records":0,"graph_snapshot":true,"references_resolved":false,"formal_links_present":false},"canonical_record":{"source":{"id":"2501.02795","kind":"arxiv","version":3},"metadata":{"license":"http://creativecommons.org/licenses/by/4.0/","primary_cat":"cs.CL","submitted_at":"2025-01-06T06:29:55Z","cross_cats_sorted":["cs.CV"],"title_canon_sha256":"c53ce87e582f8bd06a31ea017f7e00beb0956eb42554f24655bfa07933c738cd","abstract_canon_sha256":"0217874b2ee9c4fc50558d9cc220255877e5222741b88d47b19bb2abb585548b"},"schema_version":"1.0"},"receipt":{"kind":"pith_receipt","key_id":"pith-v1-2026-05","algorithm":"ed25519","signed_at":"2026-07-05T10:15:24.329465Z","signature_b64":"YP55ZHFymFOEfmerOVC7W7T7wbPVUBDMJy8f+OLeHW5qlPzP7od6o1TWRQ1+Jq1qpAV0ZIWRJHTTqlRFmxoEDg==","signed_message":"canonical_sha256_bytes","builder_version":"pith-number-builder-2026-05-17-v1","receipt_version":"0.3","canonical_sha256":"de6d5cbca869fa081d1c2de976cce1752393d608349e2564f949cd78ff903be2","last_reissued_at":"2026-07-05T10:15:24.328919Z","signature_status":"signed_v1","first_computed_at":"2026-07-05T10:15:24.328919Z","public_key_fingerprint":"8d4b5ee74e4693bcd1df2446408b0d54"},"graph_snapshot":{"paper":{"title":"InfiFusion: A Unified Framework for Enhanced Cross-Model Reasoning via LLM Fusion","license":"http://creativecommons.org/licenses/by/4.0/","headline":"","cross_cats":["cs.CV"],"primary_cat":"cs.CL","authors_text":"Baoyi He, Chunlin Ji, Fei Wu, Hongxia Yang, Qi Zhou, Shengyu Zhang, Yiming Zhang, Yuhao Fu, Zhaoyi Yan, Zhijie Sang","submitted_at":"2025-01-06T06:29:55Z","abstract_excerpt":"We introduce InfiFusion, an efficient training pipeline designed to integrate multiple domain-specialized Large Language Models (LLMs) into a single pivot model, effectively harnessing the strengths of each source model. Traditional fusion methods either merge model parameters directly or rely on knowledge distillation with rigid assumptions, limiting their flexibility and efficiency. InfiFusion overcomes these limitations by enhancing Universal Logit Distillation (ULD) with Top-K selection and Logits Standardization. We propose two fusion strategies: Pairwise Fusion (InfiFusion$_p$), where ea"},"claims":{"count":0,"items":[],"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"source":{"id":"2501.02795","kind":"arxiv","version":3},"verdict":{"id":null,"model_set":{},"created_at":null,"strongest_claim":"","one_line_summary":"","pipeline_version":null,"weakest_assumption":"","pith_extraction_headline":""},"integrity":{"clean":true,"summary":{"advisory":0,"critical":0,"by_detector":{},"informational":0},"endpoint":"/pith/2501.02795/integrity.json","findings":[],"available":true,"detectors_run":[],"snapshot_sha256":"c28c3603d3b5d939e8dc4c7e95fa8dfce3d595e45f758748cecf8e644a296938"},"references":{"count":0,"sample":[],"resolved_work":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57","internal_anchors":0},"formal_canon":{"evidence_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"author_claims":{"count":0,"strong_count":0,"snapshot_sha256":"258153158e38e3291e3d48162225fcdb2d5a3ed65a07baac614ab91432fd4f57"},"builder_version":"pith-number-builder-2026-05-17-v1"},"aliases":[{"alias_kind":"arxiv","alias_value":"2501.02795","created_at":"2026-07-05T10:15:24.328981+00:00"},{"alias_kind":"arxiv_version","alias_value":"2501.02795v3","created_at":"2026-07-05T10:15:24.328981+00:00"},{"alias_kind":"doi","alias_value":"10.48550/arxiv.2501.02795","created_at":"2026-07-05T10:15:24.328981+00:00"},{"alias_kind":"pith_short_12","alias_value":"3ZWVZPFINH5A","created_at":"2026-07-05T10:15:24.328981+00:00"},{"alias_kind":"pith_short_16","alias_value":"3ZWVZPFINH5AQHI4","created_at":"2026-07-05T10:15:24.328981+00:00"},{"alias_kind":"pith_short_8","alias_value":"3ZWVZPFI","created_at":"2026-07-05T10:15:24.328981+00:00"}],"events":[],"event_summary":{},"paper_claims":[],"inbound_citations":{"count":3,"internal_anchor_count":0,"sample":[{"citing_arxiv_id":"2505.13893","citing_title":"InfiGFusion: Graph-on-Logits Distillation via Efficient Gromov-Wasserstein for Model Fusion","ref_index":15,"is_internal_anchor":false},{"citing_arxiv_id":"2604.01674","citing_title":"Can Heterogeneous Language Models Be Fused?","ref_index":23,"is_internal_anchor":false},{"citing_arxiv_id":"2605.18904","citing_title":"Dynamic Model Merging Made Slim","ref_index":92,"is_internal_anchor":false}]},"formal_canon":{"evidence_count":0,"sample":[],"anchors":[]},"links":{"html":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU","json":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU.json","graph_json":"https://pith.science/api/pith-number/3ZWVZPFINH5AQHI4FXUXNTHBOU/graph.json","events_json":"https://pith.science/api/pith-number/3ZWVZPFINH5AQHI4FXUXNTHBOU/events.json","paper":"https://pith.science/paper/3ZWVZPFI"},"agent_actions":{"view_html":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU","download_json":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU.json","view_paper":"https://pith.science/paper/3ZWVZPFI","resolve_alias":"https://pith.science/api/pith-number/resolve?arxiv=2501.02795&json=true","fetch_graph":"https://pith.science/api/pith-number/3ZWVZPFINH5AQHI4FXUXNTHBOU/graph.json","fetch_events":"https://pith.science/api/pith-number/3ZWVZPFINH5AQHI4FXUXNTHBOU/events.json","actions":{"anchor_timestamp":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU/action/timestamp_anchor","attest_storage":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU/action/storage_attestation","attest_author":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU/action/author_attestation","sign_citation":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU/action/citation_signature","submit_replication":"https://pith.science/pith/3ZWVZPFINH5AQHI4FXUXNTHBOU/action/replication_record"}},"created_at":"2026-07-05T10:15:24.328981+00:00","updated_at":"2026-07-05T10:15:24.328981+00:00"}